Google lanza Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking para mejorar la experiencia de conversación con IA

·por Henderson·Gemini
Google lanza Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking para mejorar la experiencia de conversación con IA

Google anunció hoy el lanzamiento de Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, a los que describe como sus "modelos de conversación en tiempo real más avanzados". Tras la presentación de 3.1 Flash Live en marzo, estos nuevos modelos buscan hacer que las conversaciones con inteligencia artificial resulten más intuitivas e inteligentes. Como su nombre indica, Gemini 3.8 Live Extended Thinking ofrece "mayor inteligencia y razonamiento en múltiples pasos", pensado para tareas de alta complejidad, como las recién lanzadas Gmail Live (búsqueda conversacional), Docs Live (generación y edición de borradores) y Keep Live (creación de notas).

El modelo también comenzó a desplegarse en Gemini Live, donde 3.8 Live Extended Thinking es capaz de "razonar y hablar al mismo tiempo".

El modelo ofrece una inteligencia reforzada para flujos de trabajo complejos, al tiempo que mantiene un diálogo fluido. Emplea indicaciones verbales tempranas como "déjame comprobarlo..." para responder de forma natural a los prompts y, a través de narraciones de progreso en tiempo real, guía a los usuarios en tareas de fondo de varios pasos. En cuanto a los benchmarks, "ocupa el primer puesto general en el índice humano de calidad voz a voz (82,6)"; "lidera la tasa de finalización de tareas agentivas con un 68,6%, por delante de τ-Voice"; "obtiene un 35,1% en el benchmark τ-Voice-banking de Sierra"; y "demuestra una sólida capacidad de razonamiento, con un 97,7% en Big Bench Audio, manteniendo al mismo tiempo precios altamente competitivos frente a otros modelos de frontera".

Gemini 3.8 Live ofrece una inteligencia conversacional mejorada

Por su parte, el modelo base Gemini 3.8 Live ofrece "inteligencia conversacional con diálogo fluido y anclaje visual". Es capaz de procesar "entradas visuales" casi al instante y de ejecutar llamadas a herramientas y APIs en segundo plano mientras la conversación sigue su curso. Los usuarios pueden esperar que el modelo "responda a las solicitudes y mantenga el diálogo" a la vez que completa tareas en segundo plano. Además, puede detectar y alternar entre los 97 idiomas compatibles durante la conversación. El modelo está "diseñado para la escalabilidad y la rentabilidad" y "ocupa el segundo puesto en el Voice Agent Arena".

Gemini 3.8 Live será el motor de la experiencia Search Live en el modo IA.

H
Sobre el autor
Henderson