Gradium AI lanza un nuevo modelo TTS predeterminado: 81,0% de tasa de aprobación en estuche rígido a 216 ms de tiempo hasta el primer audio

Los agentes de voz fallan exactamente en las partes de una llamada que más importan: el número de pedido, los dígitos de devolución de llamada, la dirección de correo electrónico que la persona que llama debe escribir. Gradium AI lanzó un nuevo modelo de conversión de texto a voz y lo convirtió en el predeterminado en su API y Studio. La compañía reporta una tasa de aprobación humana del 81,0% en un conjunto de 500 oraciones en cinco idiomas, por delante de Cartesia Sonic 3.6 con un 75,1% y ElevenLabs v3 Conversational con un 65,4%. El tiempo hasta el primer audio es de 216 ms en P50 en Coval, 170 ms más rápido que el modelo al que reemplaza.

¿Es desplegable?

Sí, hoy, sin migración. Gradium activó el modelo como predeterminado en su API y Studio el 31 de agosto de 2026. Las voces existentes, incluidos los clones personalizados, siguen funcionando sin cambios.