Scroll ke bawah untuk melanjutkan

Gemini 3.8 Live Hadir dengan Percakapan Suara yang Lebih Natural, Ini Kemampuan Barunya

Gemini 3.8 Live membawa fitur percakapan suara lebih natural, pemahaman visual, penalaran real-time, 97 bahasa, dan tugas di latar belakang.

gemini 3.8 live percakapan suara lebih natural
Gemini 3.8 Live memiliki kemampuan baru untuk fitur percakapan suara yang lebih canggih. (Dok. Google)

PEWARTA.CO.ID — Google memperkenalkan Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking pada 15 September 2026 sebagai generasi baru model percakapan real-time yang dirancang membuat interaksi suara dengan AI terasa lebih natural, cepat, dan mampu menangani tugas yang lebih kompleks. Keduanya tidak sekadar memperbaiki kemampuan berbicara, tetapi juga membawa penalaran, pemahaman visual, serta eksekusi tugas di belakang layar sambil percakapan tetap berlangsung.

Google menempatkan Gemini 3.8 Live sebagai model untuk pengalaman suara berlatensi rendah, sedangkan versi Extended Thinking ditujukan untuk pekerjaan yang membutuhkan penalaran lebih dalam dan langkah pemecahan masalah yang lebih kompleks. Model tersebut mulai tersedia untuk pengembang melalui Gemini API dan Google AI Studio, sementara pengalaman berbasis konsumen diperluas melalui Gemini Live, Search Live, Gemini App, dan sejumlah layanan Google Workspace.

Percakapan suara dibuat lebih mengalir

Salah satu perubahan utama ada pada cara Gemini menangani percakapan yang berlangsung secara real-time. Google menyebut Gemini 3.8 Live dirancang untuk dialog yang lebih lancar dengan kemampuan memahami konteks percakapan sekaligus memproses masukan visual dalam waktu hampir nyata.

Pengguna tidak harus memperlakukan interaksi suara seperti sesi tanya-jawab satu kali. Gemini dapat mempertahankan alur percakapan sambil memproses permintaan berikutnya, sehingga pengalaman lebih mendekati percakapan dua arah daripada sekadar mengucapkan pertanyaan lalu menunggu jawaban.

Kemampuan ini menjadi penting ketika tugas membutuhkan beberapa langkah. Google mencontohkan Gemini 3.8 Live digunakan untuk membantu pekerjaan seperti pemecahan masalah secara real-time, sementara model Extended Thinking dapat terus berbicara ketika proses penalaran atau eksekusi tugas masih berlangsung.

Gemini bisa terus berbicara saat mengerjakan tugas

Perubahan yang cukup signifikan terletak pada pemanggilan alat secara asinkron. Gemini 3.8 Live dapat menjalankan pemanggilan fungsi dan API di latar belakang sambil percakapan tetap berjalan, sehingga pengguna tidak harus berhadapan dengan jeda panjang ketika AI sedang menunggu hasil sebuah proses.

Dalam praktiknya, pola ini memungkinkan AI mengakui permintaan terlebih dahulu, kemudian mengerjakan tugas di belakang layar sambil pengguna tetap dapat melanjutkan interaksi.

Pada versi Extended Thinking, kemampuan tersebut dipadukan dengan penalaran multi-langkah yang lebih kuat. Google menjelaskan model dapat memberikan tanda kemajuan secara verbal, misalnya memberi tahu bahwa ia sedang memeriksa sesuatu, kemudian menyampaikan hasil ketika proses berikutnya selesai.

Perubahan ini membuat percakapan suara tidak lagi harus berhenti setiap kali AI melakukan pekerjaan tambahan.

Memahami kamera dan konteks visual secara langsung

Gemini 3.8 Live juga membawa visual grounding, sehingga model dapat menggunakan masukan visual sebagai bagian dari percakapan. Google menyebut model dapat memproses masukan visual hampir secara real-time untuk memberikan respons yang lebih sesuai dengan apa yang sedang dilihat pengguna.

Kemampuan ini membuka pola penggunaan yang berbeda dari chatbot berbasis teks. Pengguna dapat mengarahkan kamera pada objek, menunjukkan situasi tertentu, lalu mendiskusikannya melalui suara.

Google memberikan contoh pengalaman seperti bantuan onboarding karyawan secara langsung dan permainan catur dengan konteks visual yang diproses hampir real-time.

Bagi pengguna umum, kemampuan tersebut dapat membuat AI lebih berguna ketika informasi tidak cukup dijelaskan hanya lewat teks.

Bisa berpindah bahasa di tengah percakapan

Salah satu kemampuan yang cukup menarik adalah dukungan pergantian bahasa selama percakapan berlangsung. Google menyatakan Gemini 3.8 Live dapat mendeteksi dan beralih di antara 97 bahasa yang didukung di tengah percakapan.

Fungsi ini relevan dalam situasi ketika pengguna berpindah bahasa secara spontan, misalnya saat menyebut istilah tertentu dalam bahasa Inggris tetapi melanjutkan penjelasan dalam Bahasa Indonesia.

Kemampuan multibahasa seperti ini juga penting bagi pengembangan agen suara yang digunakan di lingkungan internasional. Google memang memposisikan Gemini 3.8 Live sebagai fondasi untuk membangun aplikasi dan agen suara yang dapat digunakan dalam skala besar.

Namun, jumlah bahasa yang didukung tidak berarti seluruh pengalaman akan selalu identik di setiap wilayah. Ketersediaan fitur pada aplikasi tertentu tetap dapat dipengaruhi produk, akun, bahasa, dan wilayah.

Extended Thinking dirancang untuk tugas yang lebih rumit

Jika Gemini 3.8 Live difokuskan pada percakapan cepat dan real-time, Gemini 3.8 Live Extended Thinking mengambil pendekatan berbeda. Model ini dirancang untuk tugas yang memerlukan penalaran lebih dalam sambil mempertahankan percakapan suara secara terus-menerus.

Google menyebut model tersebut dapat melakukan background reasoning dan asynchronous tool calls ketika percakapan tetap berjalan. Pengguna tidak harus menunggu dalam keheningan sampai seluruh proses selesai.

Dalam contoh yang ditampilkan Google, kemampuan ini digunakan untuk pekerjaan kompleks seperti menyusun rencana bisnis, menangani alur pemesanan multi-langkah, dan memberikan umpan balik terhadap tugas yang sedang dikerjakan pengguna.

Karena itu, Extended Thinking lebih tepat dipahami sebagai pilihan ketika tugas membutuhkan kedalaman penalaran, bukan sekadar respons suara yang cepat.

Audio yang dihasilkan juga memiliki penanda SynthID

Google menyatakan seluruh audio yang dihasilkan produk AI-nya diberi watermark tak kasatmata menggunakan SynthID. Penanda tersebut dirancang agar audio buatan AI tetap dapat dideteksi, dengan tujuan membantu mengurangi risiko penyalahgunaan dan misinformasi.

Bagi pengguna, fitur ini tidak terlihat dalam percakapan sehari-hari. Namun, keberadaannya menunjukkan bahwa peningkatan kemampuan suara Gemini berjalan bersamaan dengan upaya Google untuk membuat konten sintetis lebih mudah dikenali.

Gemini 3.8 Live bukan sekadar pembaruan suara

Yang membedakan Gemini 3.8 Live dari peningkatan voice assistant biasa adalah kombinasi beberapa kemampuan sekaligus: percakapan real-time, pemahaman visual, eksekusi alat di latar belakang, pergantian bahasa, dan penalaran.

Google juga memperkenalkan Gemini 3.8 Live with Live Avatar pada 24 September 2026. Versi tersebut menambahkan kehadiran visual berbasis video dengan ekspresi dan gerak bibir yang disinkronkan dengan suara, terutama untuk pengalaman interaktif seperti layanan pelanggan, tutor virtual, dan agen digital.

Perkembangan ini menunjukkan bahwa arah Gemini semakin dekat dengan konsep AI yang dapat diajak berinteraksi secara langsung, melihat konteks di sekitar, lalu membantu menjalankan tugas tanpa memutus percakapan.

Bagi pengguna, manfaat yang paling mudah dirasakan bukan sekadar suara Gemini yang terdengar lebih natural. Perubahan yang lebih penting adalah kemampuan AI untuk tetap memahami konteks ketika percakapan menjadi panjang, melakukan pekerjaan sambil berbicara, dan merespons berdasarkan informasi visual yang sedang diperlihatkan.

Sahabat Pewarta yang ingin mencoba pengalaman terbaru ini perlu membedakan antara Gemini 3.8 Live sebagai model dan fitur yang tersedia pada produk tertentu. Sebagian kemampuan tersedia melalui Gemini API dan Google AI Studio untuk pengembang, sementara akses pengguna umum digulirkan melalui Gemini Live, Search Live, Gemini App, dan Workspace sesuai ketersediaan produk masing-masing.

Dengan hadirnya Gemini 3.8 Live, percakapan suara AI memasuki tahap yang lebih interaktif. AI tidak lagi hanya berfungsi sebagai mesin pemberi jawaban setelah mendengar pertanyaan, tetapi mulai diarahkan menjadi mitra digital yang dapat mendengar, melihat, berpikir, dan bekerja sambil tetap menjaga alur percakapan.

Pilihan Redaksi:
Tersalin 👍
Redaksi PEWARTA
Redaksi PEWARTA
Portal berita Indonesia terkini 2026, viral terbaru dan terpopuler hari ini disajikan secara update. Bagian dari ekosistem media online Pewarta Network.

WARTA TERBARU

  • Gemini 3.8 Live Hadir dengan Percakapan Suara yang Lebih Natural, Ini Kemampuan Barunya
  • Gemini 3.8 Live Hadir dengan Percakapan Suara yang Lebih Natural, Ini Kemampuan Barunya
  • Gemini 3.8 Live Hadir dengan Percakapan Suara yang Lebih Natural, Ini Kemampuan Barunya
  • Gemini 3.8 Live Hadir dengan Percakapan Suara yang Lebih Natural, Ini Kemampuan Barunya
  • Gemini 3.8 Live Hadir dengan Percakapan Suara yang Lebih Natural, Ini Kemampuan Barunya
  • Gemini 3.8 Live Hadir dengan Percakapan Suara yang Lebih Natural, Ini Kemampuan Barunya