أعلنت Google اليوم عن إطلاق Gemini 3.8 Live وGemini 3.8 Live Extended Thinking، واصفةً إياهما بأنهما «نموذجاها الأكثر تطورًا للحوار الفوري». وبعد إطلاق 3.1 Flash Live في شهر مارس، تهدف هذه النماذج الجديدة إلى جعل الحوارات مع الذكاء الاصطناعي أكثر بديهية وذكاءً. وكما يوحي اسمه، يوفر Gemini 3.8 Live Extended Thinking «ذكاءً معززًا واستدلالًا متعدد الخطوات»، وهو مناسب للمهام عالية التعقيد، مثل Gmail Live (البحث الحواري) وDocs Live (إنشاء وتحرير المسودات) وKeep Live (إنشاء الملاحظات) التي أُطلقت مؤخرًا.
بدأ النموذج أيضًا في الانتشار عبر Gemini Live، حيث يستطيع 3.8 Live Extended Thinking «الاستدلال والتحدث في الوقت ذاته».
يوفر النموذج ذكاءً معززًا لسير العمل المعقد، مع الحفاظ في الوقت ذاته على تدفق حواري متّسق، إذ يستخدم إشارات شفهية مبكرة مثل «دعني أتحقق...» للاستجابة للمطالب بشكل طبيعي، ويرشد المستخدمين خطوة بخطوة عبر المهام الخلفية متعددة المراحل من خلال سرد التقدم في الوقت الفعلي. وفيما يتعلق بمعايير الأداء، حلّ «في المرتبة الأولى إجمالًا (82.6) في مؤشر جودة الصوت البشري المُحلَّل بشريًا»؛ و«تصدّر نسبة إكمال المهام الوكيلية بنسبة 68.6% متفوقًا على τ-Voice»؛ و«حقق نسبة 35.1% في معيار τ-Voice-banking من Sierra»؛ و«يتمتع بقدرات استدلال قوية، حيث حقق 97.7% في Big Bench Audio، مع الحفاظ في الوقت ذاته على أسعار تنافسية عالية مقارنة بالنماذج المتقدمة الأخرى».
يوفر Gemini 3.8 Live ذكاءً حواريًا معززًا
في الوقت ذاته، يوفر النموذج الأساسي Gemini 3.8 Live «ذكاءً حواريًا يتميز بحوار سلس وأساس بصري». يستطيع النموذج معالجة «المدخلات البصرية» بشكل شبه فوري، وتنفيذ الأدوات واستدعاءات واجهات البرمجة (API) في الخلفية بينما الحوار مستمر. ويمكن للمستخدمين أن يتوقعوا أن يستجيب النموذج للطلبات ويواصل الحوار «أثناء إنجاز المهام الخلفية». إضافة إلى ذلك، يستطيع النموذج اكتشاف التبديل بين 97 لغة مدعومة أثناء الحوار. صُمّم النموذج «لتحقيق قابلية التوسع وفعالية التكلفة»، وحلّ «في المرتبة الثانية في ساحة وكلاء الصوت».
سيدعم Gemini 3.8 Live تجربة Search Live في وضع الذكاء الاصطناعي.

