Google Lanza los Modelos de Texto a Voz Gemini 3.8 para Mejorar Aplicaciones de Voz
Google ha introducido sus nuevos modelos de texto a voz Gemini 3.8, mejorando las capacidades de creadores y desarrolladores para producir voces expresivas, naturales y multilingües a gran escala. Este lanzamiento forma parte de la familia de audio Gemini, que incluye modelos como Gemini 3.8 Live y Gemini 3.8 Flash, destinados a interacciones de voz en tiempo real y tareas de codificación, respectivamente.
La introducción de los modelos de texto a voz Gemini 3.8 parece fortalecer la posición competitiva de Google en el desarrollo de tecnología de IA. Este lanzamiento es parte de una estrategia más amplia para expandir la pila de audio Gemini, sugiriendo un enfoque integral hacia aplicaciones de audio impulsadas por IA. Los participantes del mercado interpretan este desarrollo como un indicativo de los avances continuos de Google en IA, lo que podría influir en las percepciones sobre el rendimiento de los modelos de IA de la compañía.
Características Clave de Gemini 3.8
- Personalización de voz mejorada con tres niveles de selección de voz.
- Soporta hasta 130 idiomas, atendiendo a mercados globales.
- Incluye generación de audio tanto de un solo hablante como de múltiples hablantes.
- Cuenta con un sistema de diseño de voz personalizado que permite indicaciones en lenguaje natural para la creación de voces.
El lanzamiento de TTS sigue a la presentación de los modelos Gemini 3.8 Live, diseñados para interacciones de habla en tiempo real, lo que demuestra el compromiso de Google con el avance de las tecnologías de voz impulsadas por IA. Es probable que los participantes del mercado monitoreen cómo se desempeñan estos modelos en comparación con los competidores, como los de Anthropic y OpenAI, así como su impacto en el Chatbot Arena LLM Leaderboard.
Actualizado 17:32 UTC
Últimas Actualizaciones sobre ChatGPT Voice
- ChatGPT Voice se ha actualizado para incluir soporte de plugins y tres nuevos modelos GPT-6: Astra, Sol y Luna.
- Astra es el modelo más capaz de OpenAI, diseñado para codificación y razonamiento complejo, mientras que Sol y Luna están optimizados para casos de uso cotidianos.
- A partir del 10 de septiembre de 2026, los usuarios del plan Pro pueden elegir entre GPT-5.6 Sol o GPT-6 Astra para interacciones de voz.
- GPT-6 Sol y GPT-6 Luna se lanzaron el 22 de septiembre de 2026, con precios de API significativamente reducidos: Sol a $2 por millón de tokens de entrada y $10 por millón de tokens de salida, y Luna a $0.10/$0.50.
- OpenAI ha ajustado los límites de uso diario para GPT-Live, permitiendo a los suscriptores Plus hasta 3 horas de interacción de voz y a los usuarios Pro 15 horas por día.
- Luna está disponible para usuarios de los niveles Free y Go a través de la aplicación de escritorio, que ganó soporte para GPT-Live en julio de 2026.
- La nueva estrategia de precios para Sol y Luna tiene como objetivo remodelar el comportamiento de los desarrolladores al ofrecer soluciones más rentables para diversas tareas.
FAQ
¿Cuáles son las características clave de los modelos de texto a voz Gemini 3.8?
Las características clave incluyen una personalización de voz mejorada con tres niveles de selección de voz, soporte para hasta 130 idiomas, generación de audio de un solo hablante y múltiples hablantes, y un sistema de diseño de voz personalizado que permite comandos en lenguaje natural para la creación de voces.
¿Cómo se compara Gemini 3.8 con modelos anteriores?
Gemini 3.8 se basa en modelos anteriores al ofrecer una mayor expresividad, naturalidad y capacidades multilingües, lo que lo hace más adecuado para una gama más amplia de aplicaciones en tecnología de voz.
¿Cuál es la importancia de la familia de audio Gemini?
La familia de audio Gemini, que incluye modelos como Gemini 3.8 Live y Gemini 3.8 Flash, representa el enfoque integral de Google hacia aplicaciones de audio impulsadas por IA, mejorando las interacciones de voz en tiempo real y las tareas de codificación.
¿Cuántos idiomas soporta Gemini 3.8?
Gemini 3.8 soporta hasta 130 idiomas, atendiendo a un diverso mercado global.
¿Qué impacto podría tener Gemini 3.8 en el mercado de IA?
Se espera que el lanzamiento de Gemini 3.8 mejore la posición competitiva de Google en el desarrollo de tecnología de IA, potencialmente influyendo en las percepciones sobre el rendimiento del modelo de IA de la compañía e impactando el panorama competitivo frente a empresas como Anthropic y OpenAI.
Comentarios
Los comentarios se moderan antes de publicarse.
Aún no hay comentarios — sé el primero.