Google ประกาศเปิดตัว Gemini 3.8 Live และ Gemini 3.8 Live Extended Thinking ซึ่งบริษัทระบุว่าเป็น "โมเดลการสนทนาแบบเรียลไทม์ที่ล้ำสมัยที่สุด" หลังจากเปิดตัว 3.1 Flash Live เมื่อเดือนมีนาคม โมเดลใหม่เหล่านี้มุ่งทำให้การสนทนากับปัญญาประดิษฐ์เป็นไปอย่างเป็นธรรมชาติและชาญฉลาดมากขึ้น ตามชื่อที่สื่อถึง Gemini 3.8 Live Extended Thinking มอบ "ความฉลาดที่เพิ่มขึ้นและการให้เหตุผลแบบหลายขั้นตอน" เหมาะสำหรับงานที่มีความซับซ้อนสูง เช่น Gmail Live (การค้นหาแบบสนทนา), Docs Live (การร่างและแก้ไข) และ Keep Live (การสร้างบันทึก) ที่เพิ่งเปิดตัวไปก่อนหน้านี้
โมเดลดังกล่าวยังเริ่มเปิดให้ใช้งานบน Gemini Live โดย 3.8 Live Extended Thinking สามารถ "ให้เหตุผลและพูดไปพร้อมกันได้"
โมเดลนี้มอบความฉลาดที่เพิ่มขึ้นสำหรับเวิร์กโฟลว์ที่ซับซ้อน พร้อมทั้งรักษาการไหลของบทสนทนาให้ต่อเนื่อง โดยใช้สัญญาณวาจาเบื้องต้น เช่น "ขอตรวจสอบให้หน่อยนะ..." เพื่อตอบสนองต่อพรอมต์อย่างเป็นธรรมชาติ และใช้การบรรยายความคืบหน้าแบบเรียลไทม์เพื่อพาผู้ใช้ไปตามขั้นตอนต่าง ๆ ในงานเบื้องหลังที่มีหลายขั้นตอน ในด้านการทดสอบมาตรฐาน "ครองอันดับหนึ่งโดยรวมในดัชนีคุณภาพเสียงพูดต่อเสียงพูดที่วิเคราะห์โดยมนุษย์ (82.6)"; "ทำคะแนนนำในอัตราความสำเร็จของงานตัวแทนที่ 68.6% เหนือกว่า τ-Voice"; "ทำคะแนน 35.1% ในเกณฑ์มาตรฐาน τ-Voice-banking ของ Sierra"; "มีความสามารถในการให้เหตุผลที่แข็งแกร่ง ทำคะแนน 97.7% ใน Big Bench Audio ขณะเดียวกันก็รักษาราคาที่แข่งขันได้สูงเมื่อเปรียบเทียบกับโมเดลระดับแนวหน้าอื่น ๆ"
Gemini 3.8 Live มอบความฉลาดในการสนทนาที่เพิ่มขึ้น
ในขณะเดียวกัน โมเดลพื้นฐาน Gemini 3.8 Live ให้ "ความฉลาดในการสนทนาที่มาพร้อมการสนทนาลื่นไหลและการยึดโยงกับภาพ" โมเดลนี้สามารถประมวลผล "อินพุตด้านภาพ" ได้เกือบจะทันที และทำการเรียกเครื่องมือและ API ในเบื้องหลังไปพร้อมกับที่การสนทนายังดำเนินต่อไป ผู้ใช้สามารถคาดหวังได้ว่าโมเดลจะ "ตอบสนองต่อคำขอและสนทนาต่อเนื่อง" ได้พร้อมกับที่งานเบื้องหลังเสร็จสิ้น นอกจากนี้ยังสามารถตรวจจับและสลับระหว่างภาษาที่รองรับ 97 ภาษาได้ระหว่างการสนทนา โมเดลนี้ "ออกแบบมาเพื่อการขยายขนาดและความคุ้มค่า" และ "อยู่ในอันดับที่สองในสนามประลองตัวแทนด้านเสียง"
Gemini 3.8 Live จะเป็นแกนหลักของประสบการณ์ Search Live ในโหมด AI

