voz a voz
2 published articles
Agentes de voz
Por qué Grok 4.1 Fast supera a modelos más inteligentes en una llamada telefónica
Las clasificaciones generales eligen los LLM equivocados para las llamadas de voz. La clasificación de 2026 de BenchLM pone la latencia primero: Grok 4.1 Fast responde en 0.54s, mientras que Claude Opus 4.6, el mejor puntuado, necesita 1.78s. Los modelos rápidos se llevan la conversación; los modelos de razonamiento se quedan en las llamadas a herramientas en segundo plano.
2026-08-05
IA de voz
La IA de voz mejora en palabras, pero sigue sin escuchar cómo se dicen
El benchmark Real World VoiceEQ de Hume, basado en más de un millón de valoraciones humanas, evalúa más de 40 modelos de voz en dimensiones que los benchmarks estándar ignoran: emoción, identidad del hablante y contexto acústico. Los hallazgos muestran que los modelos de voz a voz varían enormemente, y que incluso los sistemas líderes a menudo ignoran las señales auditivas que los humanos usan instintivamente.
2026-07-20