IA embarquée
7 published articles
Edge AI
Le runtime exclusivement CPU d'Audio8 fait tenir le clonage vocal dans environ 1 Gio de RAM
Le runtime ONNX d'Audio8 exécute la préversion TTS 0.6B entièrement sur CPU : poids autorégressifs INT4, codec 44,1 kHz intégré, PCM en streaming et endpoint compatible OpenAI. Le service occupe environ 1 Gio de RAM sur un ordinateur portable, et ni PyTorch ni Transformers ne sont nécessaires à l'exécution.
2026-08-05
TTS Open Source
Le nouveau modèle TTS d'Audio8 clone les voix en 11 langues gratuitement
Audio8 publie Audio8-TTS Preview sous licence Apache 2.0, un modèle de 0,6B prenant en charge 11 langues, le clonage vocal zero-shot, et un codec 44,1 kHz intégré. Cette version cible les applications vocales en périphérie nécessitant rapidité et confidentialité.
2026-07-30
IA physique
Le modèle à 4 milliards de paramètres pour périphériques Edge de Nvidia fait ce que la plupart des petits VLM ne font pas
Le Cosmos 3 Edge de Nvidia intègre la modélisation du monde en 4 milliards de paramètres, se classant premier au VANTAGE-Bench parmi sa catégorie de taille. Sa conception à double transformateur mêle raisonnement et prédiction d'action en temps réel pour les robots, le tout déployable sur le matériel Jetson et RTX.
2026-07-28
IA en périphérie
Mistral Nano fonctionne sur des appareils avec moins de 1 Go de RAM, atteignant 85 % des scores de raisonnement de son grand frère
Le nouveau Mistral Nano de Mistral AI cible les appareils en périphérie avec moins de 1 Go de RAM, atteignant 85 % des performances de raisonnement de son modèle plus grand Mistral Small sur les benchmarks standards.
2026-07-25
IA d'entreprise
Mistral positionne sa plateforme IA d'entreprise comme la rampe d'accès vers des opérations native-IA
Mistral AI dévoile une plateforme d'entreprise complète adaptée aux ventes, à l'ingénierie, à la conformité, au support et aux opérations, avec des solutions sectorielles pour la finance, la santé, la logistique, le commerce électronique, l'administration publique et la défense. L'entreprise met en avant des clients existants comme BNP Paribas, AXA, CMA CGM et France Travail.
2026-07-18
LLMs & Modèles
La recette de cascade de Mistral réduit les LLMs sans tuer le raisonnement
La distillation en cascade de Mistral réduit les grands modèles en petits tout en préservant le raisonnement et la vision. La variante 3B offre des capacités qui nécessitaient auparavant dix fois plus de paramètres, et le tout sous licence Apache 2.0.
2026-07-17
rapport spécial / edge AI
Nvidia DeepStream passe en open source : ce que la version 9.1 signifie pour l'edge AI
Le code source complet du SDK d'analyse vidéo DeepStream de Nvidia est désormais sur GitHub sous les licences Apache 2.0 et CC-BY-4.0, ouvrant le développement de l'edge AI à un public plus large. La version 9.1 apporte des agents de codage basés sur des LLM, l'intégration du serveur d'inférence Triton et des dépôts consolidés pour des pipelines de bout en bout.
2026-07-16