Google presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking el 15 de septiembre de 2026. Ambos modelos están orientados a agentes de voz capaces de razonar durante conversaciones casi en tiempo real. El anuncio lleva la firma de Tom Ouyang, Principal Engineer, y Malini Jaganathan, Member of Technical Staff, en representación del Gemini Audio Team.
Gemini 3.8 Live está diseñado para funcionar a escala con un uso eficiente de los recursos. Combina inteligencia conversacional, diálogo fluido y comprensión del contexto visual. El modelo ocupó el segundo puesto en Speech Agent Arena de Artificial Analysis. En EVA-Bench de ServiceNow, Google afirma que ambos modelos alcanzan la frontera de Pareto en flujos de trabajo complejos al equilibrar precisión y calidad conversacional. La prueba utilizó la Live API en Gemini Enterprise Agent Platform.
Gemini 3.8 Live Extended Thinking consiguió el primer puesto general en Speech to Speech Quality Index de Artificial Analysis, con una puntuación de 82,6. Logró un 68,6 % en τ-Voice para completar tareas agenticas y un 35,1 % en el benchmark τ-Voice-banking de Sierra. Su resultado en Big Bench Audio es del 97,7 %. Google sitúa el modelo en tareas empresariales complejas y describe su precio como competitivo frente a otros modelos de frontera.
Gemini 3.8 Live procesa entradas visuales casi en tiempo real y cambia automáticamente entre 97 idiomas compatibles durante una conversación. Ejecuta herramientas y llamadas a API en segundo plano mientras el diálogo continúa. Las demostraciones muestran asistencia para la incorporación de empleados en directo y una partida de ajedrez basada en contexto visual. Extended Thinking puede razonar y hablar al mismo tiempo, responder a una petición con una señal inicial como «Let me check that…» y narrar el progreso de tareas de fondo con varios pasos. Otras demostraciones muestran cómo convierte bocetos en componentes React funcionales, coordina reservas con llamadas de funciones asíncronas y crea planes de negocio y kits de marketing personalizados mediante la voz.
Google afirma que los modelos mejoran las interacciones de voz en la aplicación Gemini, Google Workspace y Search. Gemini 3.8 Live Extended Thinking está disponible en Docs Live, Gmail Live y Keep Live. Gemini 3.8 Live ofrece asistencia paso a paso para resolver problemas dentro de Search Live.
La Gemini Live API cuenta con integraciones de Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel y Vision Agents. Estas plataformas gestionan la infraestructura de transmisión multimedia en tiempo real para que los desarrolladores puedan crear interfaces de voz. Google también menciona a Salesforce, Genspark y Lumeris como socios interesados en la latencia, la fluidez conversacional y las capacidades de llamadas a herramientas de los modelos.
El audio generado por los productos de IA de Google incluye una marca de agua imperceptible de SynthID. Google indica que permite detectar el contenido generado y ayuda a limitar la desinformación. La información adicional sobre seguridad aparece en la ficha de modelo Gemini 3.8 Audio.
Los dos modelos empiezan a desplegarse el 15 de septiembre de 2026. Los desarrolladores pueden acceder a ellos mediante Gemini API y Google AI Studio. Para empresas, el acceso comienza en versión preliminar privada dentro de Gemini Enterprise. Gemini Enterprise for Customer Experience llegará más adelante. Gemini 3.8 Live también se incorpora a Search Live. Extended Thinking está disponible en Gemini Live, en Workspace Docs para suscriptores de Google AI Pro y Ultra, y en Gmail y Keep para todos los suscriptores de Google AI. Google también ha anunciado su llegada para clientes empresariales de Google Workspace.




Comentarios
Aún no hay comentarios — escribe el primero.
Inicia la conversación
Sin cuenta ni contraseña — introduce tu correo y te enviamos un enlace de acceso de un solo uso. ¿Primera vez? Todo se configura automáticamente.
Tu valoración se aplicará automáticamente al iniciar sesión.
Revisa tu bandeja de entrada
Hemos enviado un enlace de acceso a …. Ábrelo en este dispositivo — esta pestaña te conectará automáticamente.
¿No llega nada? Mira en la carpeta de spam — y marca el correo como «No es spam» para que la próxima vez llegue directo.