Google lanza Gmail Live: ahora podés hacerle preguntas en voz alta a tu bandeja de entrada
Más de 85 idiomas y una conversación que se transcribe sola: así es Gemini 3.5 Transcribe, el modelo que da vida a las nuevas funciones de voz en Gmail, Docs y Keep. Pero eso no es todo: la herramienta también ordena discursos desordenados y distingue hasta tres voces.
Google activó esta semana un paquete de funciones con inteligencia artificial que promete cambiar la forma de interactuar con las aplicaciones de uso diario. Se trata de Gmail Live, Docs Live y Keep Live, herramientas conversacionales que permiten hacer consultas hablando, con lenguaje natural, en lugar de tipear comandos o usar buscadores tradicionales.
Las novedades habían sido anunciadas en mayo, durante la conferencia para desarrolladores I/O 2026, y ahora comienzan a desplegarse entre los usuarios. Según consignó TechCrunch, la propuesta central es que la gente pueda preguntarle a su correo electrónico, a sus documentos o a sus notas, directamente con la voz, apoyándose en los avances del modelo Gemini.
¿Cómo funcionan las nuevas herramientas?
En Gmail, la función bautizada Gmail Live permite hacer preguntas sobre el contenido de la bandeja de entrada, como si uno le hablara a un asistente. La conversación se transcribe en tiempo real, lo que facilita repasar lo consultado.
En Docs, en tanto, la novedad apunta a la creación de borradores mediante dictado. Y en Keep, la app de notas, se pueden registrar ideas y recordatorios sin necesidad de escribir ni una palabra.
¿Quiénes pueden acceder?
La disponibilidad varía según el plan. Gmail Live está pensado para los suscriptores de Google AI Plus, Pro y Ultra, mientras que Docs Live y Keep Live se lanzan para los usuarios de los niveles Pro y Ultra. Por ahora, las funciones se ofrecen únicamente en inglés y para dispositivos iOS y Android.
El salto en el reconocimiento de voz
Estas mejoras llegan de la mano de un nuevo modelo de audio presentado por Google, que promete un avance notable en la comprensión del habla. Se trata de Gemini 3.5 Transcribe, un sistema capaz de detectar automáticamente más de 85 idiomas, con sus acentos y dialectos.
Uno de sus puntos fuertes es que puede transformar discursos desordenados en texto con un formato coherente. Además, tiene la capacidad de atribuir la voz a hasta tres hablantes distintos, con marcas de tiempo, algo especialmente útil para transcribir reuniones o podcasts.
La versión 3.5 de Gemini Transcribe ya está disponible en la app del modelo para MacOS, en inglés; en Rambler para Android, una función de dictado con IA integrada en el teclado Gboard, en regiones seleccionadas; y en una vista previa para desarrolladores.