Gemini Live ahora recuerda conversaciones por voz

Rene Fraga
9 minutos de lectura

Principales destacados

  • Gemini Live ahora puede recordar información compartida en conversaciones anteriores por voz.
  • La integración con nuevas Aplicaciones Conectadas amplía las capacidades del asistente durante interacciones en tiempo real.
  • La actualización acerca la experiencia de voz de Gemini a su versión en texto y refuerza la apuesta de Google por la inteligencia artificial contextual.

Google está ampliando significativamente las capacidades de Gemini Live, su asistente de inteligencia artificial enfocado en conversaciones por voz.

La empresa anunció una actualización que permite al sistema acceder a memorias de interacciones anteriores y utilizar información proveniente de Aplicaciones Conectadas durante sesiones en vivo. La novedad representa uno de los cambios más importantes implementados hasta ahora en la función, acercando la experiencia de voz al nivel de personalización que los usuarios ya encuentran en el chat de texto de Gemini.

La actualización comenzó a llamar la atención tras ser identificada por el sitio especializado 9to5Google y posteriormente confirmada por el propio Google en su documentación oficial. Con ella, Gemini Live deja de tratar cada conversación como un evento aislado y pasa a construir un historial continuo de interacciones, algo considerado esencial para hacer que los asistentes virtuales sean más naturales, útiles e inteligentes.

En la práctica, el objetivo es simple: reducir la necesidad de repetir información y permitir que el asistente comprenda mejor quién está hablando con él. El resultado esperado es una experiencia mucho más cercana a una conversación humana, en la que el contexto acumulado a lo largo del tiempo forma parte de la interacción.

Conversaciones más naturales gracias a la memoria contextual

Antes de esta actualización, los usuarios que utilizaban Gemini Live necesitaban proporcionar repetidamente cierta información personal al iniciar nuevas sesiones de voz. Incluso después de numerosas conversaciones, el sistema no lograba aprovechar ese conocimiento acumulado para enriquecer futuras interacciones.

Con la llegada de la memoria a Gemini Live, este escenario comienza a cambiar. El asistente pasa a ser capaz de recordar información compartida anteriormente, como hábitos del usuario, preferencias alimentarias, intereses personales, actividades favoritas, compromisos importantes y muchos otros detalles relevantes para la conversación.

Imagina a alguien que previamente informó ser vegetariano. En una conversación futura sobre recetas o restaurantes, Gemini podrá considerar automáticamente esa preferencia. Del mismo modo, si el usuario ha comentado sobre un viaje planeado, un hobby específico o un evento familiar importante, el sistema podrá utilizar esa información como contexto para ofrecer respuestas más útiles y personalizadas.

Este tipo de memoria contextual se considera uno de los pilares de la próxima generación de asistentes de inteligencia artificial. Al fin y al cabo, cuanto más un sistema logra comprender el historial de una persona, más relevante tiende a ser su capacidad para ayudar en el día a día.

Según Google, la función sigue las mismas configuraciones de privacidad ya existentes en Gemini. Esto significa que los usuarios continúan teniendo control sobre qué información puede almacenarse y utilizarse posteriormente. La empresa refuerza que la memoria no funciona de manera automática e irrestricta, sino que respeta los permisos elegidos individualmente.

Otro punto importante es que la funcionalidad se está liberando inicialmente solo para usuarios que utilizan Gemini en inglés en Estados Unidos. Por el momento, no existe una previsión oficial para la expansión del recurso a otros idiomas o mercados internacionales.

Las Aplicaciones Conectadas amplían el poder de Gemini Live

La memoria no es la única novedad anunciada por Google. Gemini Live también está recibiendo acceso a un conjunto mucho más amplio de Aplicaciones Conectadas, aumentando significativamente las tareas que pueden realizarse durante una conversación por voz.

Hasta ahora, las integraciones disponibles eran relativamente limitadas. Los usuarios podían interactuar principalmente con servicios como Agenda, Tareas, Keep y Maps, además de algunas integraciones específicas ofrecidas por fabricantes de dispositivos asociados.

Ahora, la lista crece de forma considerable. Gemini Live pasa a trabajar con herramientas como YouTube, YouTube Music, Google Workspace, recursos de generación de imágenes y diversos utilitarios adicionales del ecosistema de Google.

Esta expansión permite que el asistente acceda a información más variada y ejecute acciones más complejas sin interrumpir el flujo de la conversación. En lugar de alternar constantemente entre aplicaciones, los usuarios pueden resolver múltiples demandas directamente por voz.

Por ejemplo, una persona puede pedir recomendaciones de videos, buscar información en documentos almacenados en Workspace, crear contenido visual mediante herramientas de generación de imágenes o interactuar con servicios de productividad, todo dentro de la misma experiencia conversacional.

El cambio forma parte de una estrategia más amplia de Google para transformar Gemini en un centro unificado de interacción con sus servicios. En lugar de funcionar solo como un chatbot avanzado, la plataforma pasa a actuar como una capa inteligente que conecta diferentes productos de la empresa.

Google acelera la evolución de Gemini en 2026

La llegada de la memoria a Gemini Live no ocurre de forma aislada. Forma parte de una serie de avances que Google ha venido implementando a lo largo de 2026 para fortalecer su posición en la competencia por el mercado de la inteligencia artificial.

Durante el Google I/O 2026, celebrado en mayo, la empresa presentó una serie de novedades orientadas a la integración entre las experiencias de texto y voz. Uno de los principales cambios fue la posibilidad de alternar libremente entre escritura y habla dentro de una misma conversación, sin perder contexto ni continuidad.

La propuesta es permitir que los usuarios utilicen el formato más conveniente en cada momento. En situaciones silenciosas, el texto puede ser la mejor opción. En momentos más dinámicos, la voz ofrece una experiencia más práctica. Independientemente del formato elegido, el historial permanece conectado.

Poco antes, en marzo, Google lanzó una actualización importante para los modelos que impulsan Gemini. La empresa anunció mejoras de rendimiento, mayor velocidad de procesamiento y una capacidad ampliada de memoria contextual, permitiendo que el sistema comprenda conversaciones más largas y complejas.

En mayo, otra actualización incorporó la tecnología Neural Expressive a Gemini Live. El recurso fue desarrollado para hacer que las voces sintéticas sean más naturales, expresivas y emocionalmente convincentes. El objetivo es reducir la sensación de artificialidad frecuentemente asociada a los asistentes virtuales tradicionales.

En conjunto, estas mejoras muestran que Google está invirtiendo fuertemente en la construcción de una experiencia conversacional más fluida y humana. La memoria, en este contexto, surge como una pieza fundamental para consolidar esta visión.

Aunque la novedad ya está llegando a parte de los usuarios, aún existen indicios de una implementación gradual. Algunos informes señalan que ciertas configuraciones de Android siguen mostrando mensajes indicando que la memoria en Gemini Live estará disponible «próximamente», incluso después del anuncio oficial.

Esta inconsistencia sugiere que Google está adoptando una distribución controlada, una práctica común en grandes actualizaciones de software. El proceso permite monitorear posibles problemas antes de poner la funcionalidad a disposición de una base más amplia de usuarios.

Independientemente del calendario de expansión, la llegada de la memoria a las conversaciones por voz representa un hito importante para Gemini. Más allá de responder preguntas, los asistentes de inteligencia artificial avanzan hacia convertirse en compañeros digitales capaces de comprender contexto, historial y preferencias individuales.

Si esta visión se concreta, el futuro de las interacciones con IA será cada vez menos basado en comandos aislados y cada vez más cercano a un diálogo continuo, natural y personalizado. Con la nueva actualización de Gemini Live, Google demuestra que pretende estar a la vanguardia de esta transformación.

Seguir:
Renê Fraga es fundador de Google Discovery y editor en jefe de Eurisko, un ecosistema editorial independiente dedicado a la tecnología, la ciencia y la innovación. Profesional del marketing digital, con posgrado por la ESPM, sigue de cerca a Google desde la década de 2000 y escribe desde hace más de 20 años sobre tecnología, productos digitales e inteligencia artificial. Fundó Google Discovery en 2006, convirtiéndolo en uno de los principales sitios especializados en Google en Brasil, y fue columnista de TechTudo (Globo.com).
No hay comentarios