ASR
2 published articles
PLN y ML4 min read
Investigación en IA
Voice Memory: un archivo de 776 bytes que le dice al reconocimiento de voz cuándo no hacer nada
Un nuevo esquema de solo inferencia para el reconocimiento de voz aprende a contenerse: un corrector congelado lee un archivo de memoria por dominio y decide cuándo abstenerse. La corrección sin restricciones rompe tokens correctos en hasta el 64 % de las ediciones; Voice Memory lo reduce al 35 % y baja el WER ponderado del 8,36 % al 7,52 %.
2026-08-06
IAFeatured2 min read
Inteligencia Artificial
480 ms de latencia, precisión a nivel de Whisper, una receta abierta: Nvidia Canary redefine el ASR en tiempo real
Los modelos Nemo Canary de Nvidia alcanzan la precisión de Whisper en LibriSpeech y Common Voice mientras transmiten con una latencia de 480ms. El lanzamiento de código abierto incluye scripts de entrenamiento y pesos, convirtiéndolo en un raro contendiente reproducible en ASR en tiempo real.
2026-07-26