Google presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos nuevos modelos de diálogo en tiempo real que incorporan mejoras en razonamiento e inteligencia para sus agentes de voz. La compañía apunta a que estas herramientas permitan mantener conversaciones más intuitivas y abordar tareas complejas mediante comandos de voz, tanto en la aplicación Gemini como en la experiencia de Búsqueda.
Gemini Live es la función de chat de voz del asistente de inteligencia artificial Gemini. El sistema permite mantener intercambios dinámicos con los usuarios para resolver consultas o realizar tareas sin necesidad de utilizar texto. Con los nuevos modelos, Google busca reforzar la capacidad conversacional de esta experiencia y ofrecer respuestas más útiles durante las interacciones.
En particular, Gemini 3.8 Live fue diseñado para favorecer la escalabilidad y la eficiencia de costes, combinando inteligencia conversacional, diálogo fluido y capacidades visuales. Según explicó Google en un comunicado publicado en su blog, el modelo procesa las entradas visuales prácticamente en tiempo real, lo que le permite sumar contexto a las conversaciones. Además, puede detectar y cambiar automáticamente entre los 97 idiomas compatibles durante el diálogo.
La compañía también presentó Gemini 3.8 Live Extended Thinking, una variante orientada a incorporar mayores capacidades de razonamiento. Ambos modelos forman parte de la estrategia de Google para mejorar sus experiencias de inteligencia artificial conversacional y facilitar la ejecución de tareas a través de la voz.



