Google presenta Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking
Google acaba de mover ficha con Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, sus dos modelos de diálogo en vivo más avanzados hasta la fecha. La compañía asegura que ambos llegan con mejoras notables en el razonamiento paralelo casi en tiempo real, y lo interesante es que ya están disponibles desde hoy mismo para desarrolladores, empresas y usuarios a través de distintas vías de acceso.
Quienes firman el anuncio, Tom Ouyang y Malini Jaganathan, explican que estos dos modelos suponen un salto importante en inteligencia y en ese razonamiento paralelo del que tanto se habla. En la práctica, según detallan, esto los vuelve más intuitivos a la hora de colaborar con ellos y de ejecutar tareas complejas usando solo la voz. La idea de fondo es que los agentes de voz trabajen con más eficacia y que conversar con la inteligencia artificial resulte, sencillamente, más natural.
Con este movimiento, Google actualiza a la vez sus dos variantes. Por un lado la pensada para uso masivo, por otro la orientada a tareas que piden varios pasos de razonamiento antes de dar una respuesta. Las dos amplían las opciones para hablar con Gemini desde su aplicación, desde Google Workspace y desde el buscador.
Gemini 3.8 Live apuesta por la escala y el control de costes
Aquí la clave está en la escalabilidad y en mantener a raya el coste de cada interacción. Google explica que Gemini 3.8 Live combina inteligencia conversacional, diálogo fluido y anclaje visual, aunque, todo hay que decirlo, no ha entrado en detalles técnicos sobre cómo funciona esta última capacidad.
Ese equilibrio entre coste y prestaciones está pensado precisamente para los agentes de voz que deben atender un volumen alto de conversaciones, tanto dentro de la aplicación de Gemini como en el buscador. Lo que no ha aclarado la compañía es si habrá diferencias de disponibilidad según el idioma o la región, ni ha soltado cifras de rendimiento que permitan comparar esta versión con otras variantes de sus modelos Live.
El anclaje visual, según la propia Google, forma parte de las herramientas que buscan que la conversación por voz sea más natural cuando entra en juego contenido visual. Eso sí, no hay ejemplos concretos de la función en marcha ni una explicación clara sobre qué tipo de contenido visual es capaz de procesar el modelo.
Extended Thinking para los problemas más complicados
Gemini 3.8 Live Extended Thinking está construido con otra filosofía, la de las tareas de alta complejidad. Google señala que incorpora mayor inteligencia y un razonamiento en varios pasos, lo que le permite trabajar sobre problemas que requieren distintas etapas de análisis antes de ofrecer la respuesta final.
Con estos dos modelos, la compañía persigue que hablar con Gemini a través de la aplicación, de Workspace y de Search sea más fluido y colaborativo. Según Google, todo esto ayudará a los usuarios a resolver tareas complejas usando únicamente la voz, un objetivo que la empresa conecta directamente con las mejoras de razonamiento paralelo anunciadas para ambos modelos.
Fuente
Imagen: softzone.es
