Google presentó la actualización Gemini 2.5 Flash Native Audio, su avanzada tecnología de inteligencia artificial conversacional, con mejoras en naturalidad, precisión y eficiencia de las interacciones por voz. El sistema está diseñado tanto para usuarios como para empresas que buscan experiencias más cercanas a la conversación humana real.
La actualización incorpora tres avances clave: llamadas a funciones más precisas, seguimiento más eficiente de instrucciones y diálogos más fluidos. Gemini 2.5 puede recabar información en tiempo real durante la conversación, integrándola sin perder coherencia, lo que resulta especialmente útil en asistencia telefónica o flujos de trabajo complejos.
MIRÁ TAMBIÉN | X enfrenta una demanda por abandonar la icónica marca Twitter
Entre sus mejoras, el modelo destaca por la recuperación de contexto en conversaciones de varios turnos, lo que permite retomar temas previos manteniendo cohesión. Además, Gemini ahora admite traducción simultánea de voz a voz, permitiendo interacciones fluidas entre personas que hablan distintos idiomas. La IA soporta más de 70 idiomas y 2.000 combinaciones de traducción.
Empresas como Shopify y United Wholesale Mortgage ya reportan resultados positivos, destacando la capacidad de la herramienta para gestionar interacciones complejas, mantener naturalidad en ambientes ruidosos y generar eficiencia en la atención al cliente. La opción de traducción en vivo facilita el contacto global, preservando ritmo, entonación y tono de la conversación original.
MIRÁ TAMBIÉN | Hyrox: el deporte viral que es tendencia en TikTok y gimnasios
Actualmente, Gemini 2.5 está disponible en beta pública a través de Google Translate en dispositivos Android en Estados Unidos, México e India, con planes de expansión a otros países y sistemas iOS. Google planea integrar progresivamente estas funciones en otras plataformas y APIs durante 2026, consolidando a Gemini como referente en inteligencia artificial aplicada a la interacción humana.
Fuente: Infobae.


