ONNX Runtime
2 published articles
Hugging Face5 min read
IA en el navegador: kernels y benchmarks de WebGPU
La mejora de velocidad de 2,57x en WebGPU de Hugging Face viene con 176 derrotas a cuestas
Hugging Face ha publicado 207 kernels de WebGPU bajo licencia Apache-2.0, un cargador para ejecutarlos desde JavaScript y una herramienta de benchmarking para el navegador. Su mejora de velocidad destacada de 2,57x frente a ONNX Runtime Web conservó 809 de 1.756 casos de prueba y registra 176 derrotas.
2026-09-16
IA4 min read
IA en el borde
El runtime solo para CPU de Audio8 permite que la clonación de voz quepa en aproximadamente 1 GiB de RAM
El ONNX Runtime de Audio8 ejecuta la vista previa de TTS de 0,6B enteramente en CPU: pesos autorregresivos INT4, un códec de 44,1 kHz incluido, PCM en streaming y un endpoint compatible con OpenAI. El servicio ocupa aproximadamente 1 GiB de RAM en una laptop, y no se necesitan PyTorch ni Transformers en tiempo de ejecución.
2026-08-05