SevenTnewS

IA embarquée

4 published articles

LLM & Modèles4 min read

Agents IA embarqués

LFM2.5-2.6B : le petit agent qui distance des modèles 4 fois plus gros

Le LFM2.5-2.6B de Liquid AI fait tenir un modèle agentique dans 2,6 milliards de paramètres et moins de 2,5 Go de mémoire, et domine tous les benchmarks de suivi d'instructions sur lesquels il a été testé. Il tourne à 220 tokens/s sur un ordinateur portable ; le code est la seule lacune claire.

2026-08-12

Meta AIFeatured4 min read

IA open source

Muse Glimmer : l'agent 30B de Meta tient sous 20 Go, cloud en option

Meta a open-sourcé Muse Glimmer, un modèle agentique de 30B qui fonctionne hors ligne sur un seul GPU grand public. La quantification le maintient sous 20 Go, un drafter DFlash offre un décodage jusqu'à 3,1x plus rapide sur un RTX 5090, et les poids sont sur Hugging Face sous licence Apache 2.0.

2026-08-10

Qwen / Alibaba2 min read

Intelligence Artificielle

Le modèle 7B qui surpasse les plus grands, tourne sur un téléphone et change l'équation des coûts de l'IA

Le Qwen2.5-Omni d'Alibaba Cloud est un modèle 7B qui gère le texte, les images, l'audio et la vidéo, générant de la parole et du texte en temps réel. Son architecture Thinker-Talker et l'encodage positionnel TMRoPE permettent une interaction en streaming, et la variante 3B fonctionne sur des SoC mobiles comme le Snapdragon 8 Gen 1 à des vitesses utilisables.

2026-07-23

AndroidFeatured1 min read

IA mobile

Gemma 4 fonctionne désormais entièrement hors ligne sur mobile, sans cloud requis

Les développeurs React Native peuvent désormais intégrer Gemma 4 pour une inférence hors ligne avec accélération matérielle sur Android et iOS. Le modèle gère localement des tâches de vision et d’utilisation d’outils, comme le montre la lecture d’un dépliant et la planification d’un événement de calendrier entièrement sur l’appareil.

2026-07-09