ONNX Runtime
2 published articles
Hugging Face5 min read
IA dans le navigateur : noyaux WebGPU et benchmarks
L'accélération WebGPU de 2,57x de Hugging Face s'accompagne de 176 pertes
Hugging Face a publié 207 noyaux WebGPU sous Apache-2.0, un chargeur pour les exécuter depuis JavaScript et un outil de benchmarking pour navigateur. Son accélération phare de 2,57x face à ONNX Runtime Web a retenu 809 des 1 756 cas de test et enregistre 176 pertes.
2026-09-16
IA4 min read
Edge AI
Le runtime exclusivement CPU d'Audio8 fait tenir le clonage vocal dans environ 1 Gio de RAM
Le runtime ONNX d'Audio8 exécute la préversion TTS 0.6B entièrement sur CPU : poids autorégressifs INT4, codec 44,1 kHz intégré, PCM en streaming et endpoint compatible OpenAI. Le service occupe environ 1 Gio de RAM sur un ordinateur portable, et ni PyTorch ni Transformers ne sont nécessaires à l'exécution.
2026-08-05