IA embarquée
4 published articles
Agents IA embarqués
LFM2.5-2.6B : le petit agent qui distance des modèles 4 fois plus gros
Le LFM2.5-2.6B de Liquid AI fait tenir un modèle agentique dans 2,6 milliards de paramètres et moins de 2,5 Go de mémoire, et domine tous les benchmarks de suivi d'instructions sur lesquels il a été testé. Il tourne à 220 tokens/s sur un ordinateur portable ; le code est la seule lacune claire.
2026-08-12
IA open source
Muse Glimmer : l'agent 30B de Meta tient sous 20 Go, cloud en option
Meta a open-sourcé Muse Glimmer, un modèle agentique de 30B qui fonctionne hors ligne sur un seul GPU grand public. La quantification le maintient sous 20 Go, un drafter DFlash offre un décodage jusqu'à 3,1x plus rapide sur un RTX 5090, et les poids sont sur Hugging Face sous licence Apache 2.0.
2026-08-10
Intelligence Artificielle
Le modèle 7B qui surpasse les plus grands, tourne sur un téléphone et change l'équation des coûts de l'IA
Le Qwen2.5-Omni d'Alibaba Cloud est un modèle 7B qui gère le texte, les images, l'audio et la vidéo, générant de la parole et du texte en temps réel. Son architecture Thinker-Talker et l'encodage positionnel TMRoPE permettent une interaction en streaming, et la variante 3B fonctionne sur des SoC mobiles comme le Snapdragon 8 Gen 1 à des vitesses utilisables.
2026-07-23
IA mobile
Gemma 4 fonctionne désormais entièrement hors ligne sur mobile, sans cloud requis
Les développeurs React Native peuvent désormais intégrer Gemma 4 pour une inférence hors ligne avec accélération matérielle sur Android et iOS. Le modèle gère localement des tâches de vision et d’utilisation d’outils, comme le montre la lecture d’un dépliant et la planification d’un événement de calendrier entièrement sur l’appareil.
2026-07-09