Google hari ini mengumumkan peluncuran Gemini 3.8 Live dan Gemini 3.8 Live Extended Thinking, yang disebutnya sebagai "model percapakan real-time tercanggih". Menyusul peluncuran 3.1 Flash Live pada bulan Maret, model-model baru ini dirancang untuk membuat percakapan dengan kecerdasan buatan menjadi lebih intuitif dan cerdas. Sesuai namanya, Gemini 3.8 Live Extended Thinking menawarkan "kecerdasan yang lebih tinggi dan penalaran multi-langkah" untuk tugas-tugas yang sangat kompleks, seperti Gmail Live (pencarian percakapan), Docs Live (pembuatan dan penyuntingan draf), serta Keep Live (pembuatan catatan) yang baru dirilis.
Model tersebut juga mulai diluncurkan di Gemini Live, dengan 3.8 Live Extended Thinking yang mampu "melakukan penalaran dan berbicara secara bersamaan".
Model ini menyediakan kecerdasan yang lebih tinggi untuk alur kerja yang kompleks sekaligus mempertahankan kelancaran percakapan, menggunakan isyarat lisan awal seperti "biarkan saya memeriksa...", yang merespons perintah secara alami dan memandu pengguna melalui叙述进展 secara real-time saat menyelesaikan tugas latar belakang multi-langkah. Dari sisi tolok ukur, "memperingkat pertama secara keseluruhan (82,6) dalam indeks kualitas suara-ke-suara yang dinilai oleh manusia"; "memimpin τ-Voice dengan skor 68,6% dalam tingkat penyelesaian tugas agen"; "mencetak 35,1% pada τ-Voice-banking Sierra"; "menunjukkan kemampuan penalaran yang kuat, dengan skor 97,7% pada Big Bench Audio, sambil mempertahankan harga yang sangat kompetitif dibandingkan model-model frontier lainnya."
Gemini 3.8 Live Menyajikan Kecerdasan Percakapan yang Lebih Baik
Sementara itu, model dasar Gemini 3.8 Live menawarkan "kecerdasan percakapan dengan dialog yang lancar dan landasan visual". Model ini dapat memproses "masukan visual" secara nyaris seketika dan menjalankan panggilan alat serta API di latar belakang sambil percakapan terus berlangsung. Pengguna dapat mengharapkan model ini "merespons permintaan dan melanjutkan percakapan" saat tugas latar belakang selesai. Selain itu, model ini mampu mendeteksi dan beralih di antara 97 bahasa yang didukung selama percakapan. Model ini "dirancang untuk skalabilitas dan efisiensi biaya", serta "menduduki peringkat kedua di voice agent arena".
Gemini 3.8 Live akan mendukung pengalaman Search Live dalam mode AI.

