Gemini 3.8 Live: los nuevos modelos de voz de Google que hablan español y cambian de idioma a mitad de charla (y ya los probás gratis)
Google lanzó dos modelos de voz en tiempo real: hablan, escuchan y hasta ejecutan tareas mientras conversan. Ya están en la API y en AI Studio, funcionan desde Argentina y soportan español. Te muestro qué podés armar esta semana y dónde todavía no llegan.

El 15 de septiembre Google presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos modelos pensados para conversar por voz en tiempo real. No es un chatbot que te contesta y espera: hablan mientras piensan, entienden lo que ven por la cámara y pueden disparar acciones en segundo plano sin cortar la conversación. Lo interesante para nosotros es que ya se pueden usar desde acá y que soportan español dentro de un pool de 97 idiomas.
Qué cambió
Google sacó dos modelos, no uno (anuncio oficial):
- Gemini 3.8 Live: el pensado para escala y costo bajo. Mantiene una charla fluida, procesa video en tiempo casi real (o sea, "ve" lo que le mostrás), detecta y cambia entre 97 idiomas en medio de la conversación y ejecuta herramientas o llamadas a una API en segundo plano mientras te sigue hablando.
- Gemini 3.8 Live Extended Thinking: para tareas más complejas. Razona y habla al mismo tiempo, y va narrando el progreso de una tarea de varios pasos en vez de dejarte esperando en silencio.
Dónde están disponibles hoy: la versión Live y la Extended Thinking están generales en la Gemini API y en Google AI Studio (para desarrolladores), y en Search Live y la app de Gemini Live para cualquier usuario. En cambio, Gemini Enterprise y Google Workspace están en preview privado — ahí todavía no entrás vos solo.
El precio del modo audio ronda los US$0,005 por minuto de entrada y US$0,018 por minuto de salida según la documentación de precios de la API. Traducido: escucharte sale casi nada, y que te hable es lo que suma. Y para probar, AI Studio es gratis con una cuenta de Google.
Qué podés hacer con esto hoy
Lo más aprovechable no es "hablar con Gemini" desde el celu (eso ya existía). Es que ahora podés armar tu propio agente de voz que atienda en español y se adapte solo si el cliente arranca en inglés o portugués. Un camino concreto para probarlo sin escribir una línea de código todavía:
- Entrá a aistudio.google.com con tu cuenta de Google (gratis).
- Elegí Gemini 3.8 Live en el selector de modelos y abrí el modo Live / Stream.
- Dale permiso al micrófono y hablale en español rioplatense, con tus muletillas. Escuchá cómo suena.
- A mitad de una frase, cambiá al inglés. Fijate si sigue el hilo sin trabarse — ese es el diferencial que promete.
- Si sos técnico o tenés a alguien que lo sea, conectá una función (function calling) para que, por ejemplo, consulte tu stock o tu agenda mientras conversa. Ahí es donde el "ejecuta tareas en segundo plano" deja de ser marketing y te sirve.
Caso real de uso: una recepción o un preventa por voz que atienda 24/7, responda en el idioma del que llama y, en el mismo turno, chequee disponibilidad contra tu sistema sin dejar al cliente escuchando silencio.
Qué NO resuelve
- No es un call center llave en mano. El modelo es el motor; para que atienda tu teléfono o tu WhatsApp necesitás integrarlo con tu canal a través de la API. Eso es laburo de desarrollo, no un botón.
- Enterprise y Workspace están en preview. Si esperabas que esto apareciera dentro de tu Gmail o Docs corporativo, todavía no llegó. Por ahora es API, AI Studio y las apps de consumidor.
- El precio por minuto se acumula. Parece barato, pero un agente de voz con tráfico real muchas horas por día deja de ser "casi gratis". Medí el costo con tu volumen antes de escalar.
- Los benchmarks no miden tu caso. Google dice que lidera en calidad de voz, pero eso no te garantiza que entienda bien tu acento, tus modismos o tu vocabulario técnico. Probalo con tu propio uso antes de ponerlo frente a un cliente.
Para cerrar
La novedad no es que la IA hable: es que ahora podés construir un agente de voz que cambia de idioma solo y hace cosas mientras conversa, y que lo probás gratis en AI Studio en diez minutos. Empezá por ahí, medí si te sirve para un flujo real tuyo, y recién después pensá en integrarlo y pagarlo. Como siempre: la demo es fácil, lo que separa es lo que ponés en producción.