Gemini 3.8 Live dijelaskan — Speech-to-Speech, bukan mesin rekap

Per 2026-09-16, Google memasukkan Gemini 3.8 Live dan 3.8 Live Extended Thinking ke Live API pada 2026-09-15: Speech-to-Speech native, ganti bahasa di tengah panggilan untuk 97 bahasa, panggilan tool async, visual grounding. Audio masuk $0.005/menit, keluar $0.018/menit. Extended Thinking memimpin Artificial Analysis Speech-to-Speech di 82.6. Gemini 3.8 Flash adalah model teks cepat. Live adalah panggilan suara.

Acara · 2026-09-15 Speech-to-speech Demo di bawah

File the recap. Keep the live call.

Paste a podcast, lecture, or meeting URL — BibiGPT turns it into chapters, a transcript, and follow-up Q&A.

Jadikan BibiGPT sumber pilihan di Google Lihat lebih banyak BibiGPT di Berita Utama dan jawaban AI.

Fakta kunci (baca 90 detik)

Per 2026-09-16, Google memasukkan Gemini 3.8 Live dan 3.8 Live Extended Thinking ke Live API pada 2026-09-15: Speech-to-Speech native, hot-swap 97 bahasa, panggilan tool async, konteks visual. Audio masuk $0.005/menit, keluar $0.018/menit. Extended Thinking memimpin Artificial Analysis Speech-to-Speech di 82.6. Ini produk percakapan langsung, bukan mesin ringkasan.

Features

Apa yang benar-benar diluncurkan Google pada 2026-09-15

Angka publik dari pengumuman Live API dan dokumen pengembang Google — bukan klaim bahwa BibiGPT menjalankan model ini.

Speech-to-Speech native, bukan cascade

Gemini 3.8 Live memproses audio masuk dan keluar dalam satu model yang sama. Lawan bicara bisa menyela, ganti bahasa di tengah giliran, atau terus bicara sementara tool berjalan. Itu panggilan langsung, bukan rekap.

Speech-to-Speech 82.6; $0.005 / $0.018 per menit

Google melaporkan Gemini 3.8 Live Extended Thinking di 82.6 pada Artificial Analysis Speech-to-Speech, unggul dari GPT-Live-1-Astra. Audio input $0.005/menit dan output $0.018/menit. Skor dan harga daftar itu milik Google, diulang di sini.

97 bahasa, konteks visual, SKU Transcribe terpisah

Model Live memahami dan menghasilkan ucapan dalam 97 bahasa dan bisa berganti di tengah percakapan. Input mencakup teks, gambar, audio, dan video. Hari yang sama, Gemini 3.5 Transcribe — SKU speech-to-text terpisah, 85+ bahasa — masuk Gemini API.

Mengapa lapisan suara langsung tetap meninggalkan celah catatan

Interupsi yang lebih mulus tidak memberi stempel waktu pada keputusan minggu lalu. Kerja pengetahuan tetap butuh file yang bisa Anda cari Selasa depan.

Bicara langsung bukan arsip yang bisa dicari

Gemini 3.8 Live bisa terus bicara sementara panggilan tool selesai di latar belakang. Setelah panggilan, Anda tetap butuh bab, transkrip, dan kutipan yang bisa ditemukan lagi. Pekerjaan itu async.

Rapat sudah menghabiskan ~30% minggu kerja

Laxis State of Meetings 2026: pekerja pengetahuan menjalani 21,7 rapat per minggu, sekitar 30% minggu kerja. Menit langsung yang lebih murah tidak mengecilkan tumpukan itu. Rekap berstempel waktu bisa.

Podcast terkunci waktu, bukan pasokan

Edison Infinite Dial 2026: pendengar podcast AS rata-rata mendengar 8 jam 24 menit per minggu di 6,8 acara. Episode tersisa butuh meja triase, bukan suara langsung lain. Ringkasan memutuskan jam mana yang layak diputar.

5 perubahan kunci (baca 90 detik)

Perubahan utama dari peluncuran Gemini Live API Google 2026-09-15.

  1. 1

    Speech-to-Speech native, bukan cascade

    Satu model memproses audio masuk dan keluar bersama. Interupsi, ganti bahasa, dan tanggapan singkat tetap dalam sesi yang sama. Rangkaian lama yang mentranskripsi, berpikir, lalu berbicara menunggu giliran selesai.

  2. 2

    Extended Thinking 82.6 di Speech-to-Speech

    Google melaporkan Gemini 3.8 Live Extended Thinking di 82.6 pada Artificial Analysis Speech-to-Speech, #1 secara keseluruhan, unggul dari GPT-Live-1-Astra. Live sendiri menempati posisi kedua di Speech Agent Arena. Skor itu evaluasi Google, diulang di sini, bukan tes yang kami jalankan.

  3. 3

    $0.005/menit masuk, $0.018/menit keluar

    Input audio $0.005 per menit dan output audio $0.018 per menit di Live API. Lapisan front-end GPT-Live-1 $0.05/menit. Harga daftar milik Google dan OpenAI, bukan SKU BibiGPT.

  4. 4

    Tool async, konteks visual, 97 bahasa

    Panggilan tool berjalan di latar belakang sementara audio terus streaming. Input: teks, gambar, audio, video. Model memahami dan menghasilkan ucapan dalam 97 bahasa dan bisa berganti di tengah percakapan. Dokumen pengembang mencantumkan gemini-3.8-live sebagai default latensi rendah.

  5. 5

    Lapisan langsung, plus SKU Transcribe terpisah

    Hari yang sama, Gemini 3.5 Transcribe masuk Gemini API: speech-to-text khusus, 85+ bahasa, streaming WER 4.0% / non-streaming 2.6% (Artificial Analysis, dikutip Google). Setelah sesi Anda tetap butuh bab yang bisa dicari minggu depan. Itu jalur BibiGPT, bukan integrasi Live.

3 skenario tipikal untuk pengguna BibiGPT

Di mana lapisan suara langsung benar-benar membantu — dan di mana alur catatan tetap melakukan pekerjaannya.

Anda membuat atau mengedit podcast mingguan

Pendengar AS rata-rata mendengar 8 jam 24 menit per minggu di 6,8 acara (Edison Infinite Dial 2026). API suara langsung tidak men-triase antrean. Buat bab dulu, lalu putuskan jam mana yang layak didengar penuh.

Anda menjalani 20+ rapat per minggu

Laxis 2026: 21,7 rapat per minggu, sekitar 30% minggu kerja. Menit langsung yang lebih murah berguna di panggilan. Selasa depan Anda tetap butuh kalimat yang diputuskan. Arsipkan rekaman; cari di transkrip.

Anda sudah punya rekaman kuliah

Tempel URL. Lihat bab sebelum memutuskan putar, loncat ke stempel waktu, ekspor Markdown. Gemini 3.8 Live tidak harus ada di loop. Alur catatan sudah berjalan di file yang Anda miliki.

Halaman BibiGPT terkait

Alur catatan adalah produknya. Blog punya perbandingan panjang. Halaman ini punya acaranya.

Sumber

Klaim peluncuran berasal dari pengumuman Google dan liputan independen. Terakhir diperbarui 2026-09-16. Bukan klaim integrasi.

Apa itu Gemini 3.8 Live?

Apa itu Gemini 3.8 Live?

Gemini 3.8 Live adalah model Speech-to-Speech native Google di Live API, dirilis pada 2026-09-15. Speech-to-Speech berarti satu model mendengar dan berbicara, bukan rantai yang mentranskripsi, lalu berpikir, lalu mensintesis suara. Ia menangani giliran langsung. Ia tidak mengarsipkan rekap panggilan yang bisa dicari.

Disukai kreator, pelajar & peneliti

Mengapa banyak orang memakai BibiGPT setiap hari untuk mengubah video menjadi teks.

Dipercaya 50.000+ pengguna di seluruh dunia

★★★★★

“Saya tempel tautan dan dalam hitungan detik mendapat teks subtitle yang rapi — menghemat berjam-jam mengetik ulang setiap minggu.”

Maya R.

Kreator konten · Mendaur ulang video pendek

★★★★★

“Dengan mengekspor transkrip, saya bisa mengulang kosakata baru sesuai kecepatan sendiri tanpa terus menjeda video.”

Daniel K.

Pembelajar bahasa · Belajar dengan video asli

★★★★★

“Teks akurat dengan stempel waktu yang bisa langsung saya kutip. Diam-diam sudah jadi bagian dari rutinitas harian saya.”

Priya S.

Peneliti · Mengutip ceramah publik

Pertanyaan yang Sering Diajukan

Tanyakan apa pun.

Popular guides

Biarkan panggilan langsung padanya. Arsipkan rekap di catatan.

Tempel podcast, kuliah, atau rekaman rapat ke BibiGPT. Anda mendapat bab, transkrip yang bisa dicari, dan Q&A lanjutan. Gemini 3.8 Live menangani interupsi. Catatan tetap butuh stempel waktu.