Google Rilis Gemini 3.8 Live dan Extended Thinking, Ini Kemampuannya

3 hours ago 3

Harianjogja.com, JOGJA— Google memperkenalkan dua model kecerdasan buatan (AI) baru yang dirancang khusus untuk membuat percakapan suara terasa lebih alami sekaligus mampu menangani tugas yang lebih kompleks.

Kedua model tersebut adalah Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking. Google mengumumkan keduanya pada 15 September 2026 sebagai model live dialogue terbaru untuk membangun agen suara yang dapat bernalar dan menjalankan tugas tanpa harus memutus alur percakapan.

Perbedaan utama keduanya terletak pada kemampuan penalaran. Gemini 3.8 Live ditujukan untuk kebutuhan percakapan suara dengan latensi rendah dan penggunaan dalam skala besar. Sementara itu, Gemini 3.8 Live Extended Thinking dirancang untuk pekerjaan yang membutuhkan perencanaan dan penalaran lebih kompleks.

Gemini Bisa Bernalar Tanpa Membuat Pengguna Menunggu dalam Diam

Salah satu kemampuan yang menjadi perhatian pada Gemini 3.8 Live Extended Thinking adalah kemampuan melakukan penalaran di latar belakang ketika percakapan suara tetap berlangsung.

Ketika pengguna memberikan perintah yang membutuhkan beberapa tahap, model dapat memberikan respons percakapan sementara sambil melanjutkan proses penalaran atau menjalankan tool secara asinkron.

Dengan mekanisme tersebut, pengguna tidak harus menghadapi jeda panjang tanpa respons ketika AI sedang mengerjakan tugas. Google memberikan contoh respons pengisi percakapan seperti memberi tahu pengguna bahwa sistem sedang memeriksa sesuatu sebelum melanjutkan ke hasil akhir.

Kemampuan menjalankan tool secara asinkron juga menjadi bagian penting dari Gemini 3.8 Live Extended Thinking. Model ini ditujukan untuk tugas yang membutuhkan analisis kompleks, pengambilan data dari beberapa sumber, atau proses yang memerlukan waktu lebih lama.

Sementara itu, Gemini 3.8 Live lebih diarahkan untuk percakapan dengan respons cepat, perintah langsung, dan penggunaan tool yang dapat diselesaikan dengan cepat.

Bisa Memahami Suara, Gambar, Video, dan Teks

Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking merupakan model multimodal. Keduanya dapat menerima input berupa audio, gambar, video, dan teks, kemudian menghasilkan keluaran berupa audio dan teks.

Kemampuan tersebut membuat percakapan suara tidak hanya bergantung pada apa yang diucapkan pengguna.

Sebagai contoh, pengguna dapat memberikan konteks visual ketika berbicara dengan AI. Informasi dari gambar atau video tersebut kemudian dapat digunakan sebagai bagian dari konteks untuk menghasilkan respons.

Google juga menyebut peningkatan kemampuan multibahasa sebagai salah satu bagian dari model audio terbarunya.

Dibuat untuk Agen Suara

Google menempatkan kedua model ini sebagai fondasi untuk membangun voice agent, bukan sekadar chatbot yang membacakan jawaban.

Gemini 3.8 Live ditujukan untuk aplikasi yang membutuhkan percakapan cepat, seperti layanan pelanggan, pencarian berbasis suara, latihan bahasa, hingga pengalaman interaktif. Sementara Gemini 3.8 Live Extended Thinking lebih cocok untuk tugas yang membutuhkan beberapa tahap pemrosesan.

Pada model Extended Thinking, misalnya, AI dapat digunakan untuk menangani pekerjaan yang membutuhkan pengambilan data secara paralel atau analisis bertahap. Google memberikan contoh penggunaan seperti agen perjalanan yang mencari penerbangan dan hotel serta membandingkan informasi sebelum memberikan jawaban.

Hasil Pengujian Gemini 3.8 Live

Google juga memaparkan hasil sejumlah pengujian untuk menunjukkan kemampuan kedua model tersebut.

Dalam Speech to Speech Quality Index dari Artificial Analysis, Gemini 3.8 Live Extended Thinking memperoleh skor 82,6. Model tersebut juga mencatat skor 68,6 persen pada τ-Voice dan 35,1 persen pada benchmark τ-Voice-banking dari Sierra.

Untuk kemampuan penalaran audio, Gemini 3.8 Live Extended Thinking mencatat skor 97,7 persen pada Big Bench Audio.

Sementara itu, Gemini 3.8 Live disebut menempati posisi kedua dalam Speech Agent Arena. Google juga menyebut kedua model mendorong Pareto Frontier dalam EVA-Bench milik ServiceNow untuk alur kerja kompleks dengan mempertimbangkan akurasi dan kualitas percakapan.

Angka-angka tersebut merupakan hasil benchmark yang dirujuk Google. Karena setiap benchmark menggunakan metodologi dan tujuan pengujian yang berbeda, skor tersebut perlu dibaca sesuai konteks masing-masing pengujian.

Audio AI Google Dilengkapi SynthID

Google juga menerapkan SynthID pada audio yang dihasilkan produk AI-nya. Teknologi penanda digital tersebut dirancang untuk membantu mengidentifikasi konten yang dibuat menggunakan AI.

Kehadiran penanda tersebut menjadi bagian dari upaya Google untuk meningkatkan kemampuan identifikasi konten hasil generasi AI, terutama ketika teknologi suara semakin mampu menghasilkan percakapan yang terdengar natural.

Gemini 3.8 Live Sudah Tersedia di Mana?

Untuk pengembang, Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking tersedia melalui Gemini API dan Google AI Studio. Dokumentasi Google juga mencantumkan kedua model tersebut sebagai model yang dapat digunakan melalui Live API.

Untuk kebutuhan perusahaan, Google menyediakan Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking dalam skema private preview pada layanan tertentu. Google juga memperluas penggunaan model tersebut ke berbagai layanan Workspace dan pengalaman Gemini.

Bagi pengguna umum, kemampuan model tersebut hadir dalam berbagai produk Google. Gemini 3.8 Live digunakan pada pengalaman seperti Search Live, sedangkan kemampuan Extended Thinking digunakan dalam Gemini Live serta sejumlah pengalaman Google lainnya.

Google juga menyebut integrasi kemampuan tersebut dengan layanan seperti Gmail, Docs, dan Keep untuk membantu pengguna menjalankan pekerjaan menggunakan suara.

Dengan Gemini 3.8 Live, arah pengembangan AI suara Google tidak lagi sekadar membuat mesin yang mampu menjawab pertanyaan secara lisan. Fokusnya bergeser pada kemampuan mendengarkan, memahami konteks, bernalar, menjalankan tugas, dan tetap berkomunikasi dengan pengguna selama proses berlangsung.

Cek Berita dan Artikel yang lain di Harian Jogja, dan edisi cetak versi elektronik kami hadir di Epaper Harian Jogja.

Read Entire Article
Ekonomi | Asset | Lokal | Tech|