IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Infrastructure et politique de l'IA
Groq parie son avenir sur l'American AI Stack
Groq a approuvé le plan d'action sur l'IA de la Maison-Blanche le jour de son lancement, se désignant comme couche de calcul de l'American AI Stack. Le communiqué révèle une entreprise qui parie que la politique nationale et l'inférence domestique bon marché la mèneront sur le marché mondial.
2026-08-08
Infrastructure d'inférence
L'inférence IA devient un problème de localisation : Groq ouvre un centre de données au Royaume-Uni
Groq a ouvert un centre de données au Royaume-Uni avec Equinix alors que GroqCloud dépasse les 3,5 millions de développeurs et que le trafic IA en production ne cesse de croître. Ce choix est un pari : l'inférence est désormais un problème de géographie, la latence et la proximité décidant où l'IA en temps réel peut s'exécuter.
2026-08-08
Génération vidéo
MiniMax a abandonné son architecture éprouvée pour que H3 fasse tout
MiniMax affirme que H3 unifie la génération de texte, d'image, de vidéo et d'audio dans un seul modèle, facture la sortie 2K à moins d'un tiers du prix des modèles grand public, et prévoit d'ouvrir les poids dans les prochains jours. Les petites lignes sont la véritable histoire : l'entreprise a abandonné l'architecture qui lui donnait un avantage pour y parvenir.
2026-08-07
Vision par ordinateur
CABiNet reste à moins de 2 points de YOLO26x pour un huitième de la puissance de calcul
Le VDD Semantic Segmentation Model Zoo apporte sur Hugging Face des modèles YOLO26 et CABiNet entraînés sur des images de drones variées. YOLO26x-sem mène avec 78.83% de mIoU, mais les 77.76% de CABiNet-Large à 54.8 GFLOPs plaident en faveur de l'efficacité.
2026-08-07
Sécurité de l'IA
Pourquoi Microsoft ouvre les tests de sécurité de l'IA au monde
Microsoft a financé 18 laboratoires universitaires sur six continents pour effectuer indépendamment des tests de type 'red team' sur les systèmes d'IA, reconnaissant que les équipes internes ne peuvent pas détecter tous les risques.
2026-08-07
Recherche RAG
BM25 bat le RAG agentique lorsque les corpus dépassent 10 millions de tokens
La recherche agentique gagne sur les petits corpus, mais une étude de muset-ai sur 28 niveaux imbriqués montre BM25 la dépassant vers 10 millions de tokens. L’agent consomme 39 fois plus de tokens de requête, et le RAG par graphe plafonne à la construction.
2026-08-07
IA générative
Pippa verse 0,005 $ par image aux artistes. Ses modèles s'entraînent toujours sur de l'art récupéré
Pippa promet aux artistes une part de chaque génération réalisée dans leur style : 0,005 $ par image, 0,003 $ par seconde de vidéo, plus une part d'un pool de redevances de 5 %. Avec environ 800 abonnés et quatre artistes sous contrat, et des modèles de base toujours entraînés sur du contenu récupéré, le discours éthique a un problème de calcul.
2026-08-07
UI agentique
Qoder Canvas : un système de conception conçu pour les agents, pas pour les humains
L'équipe Qoder d'Alibaba affirme que la fenêtre de chat n'est pas le bon contenant pour les sorties complexes des agents. Qoder Canvas applique la pensée des systèmes de conception aux interfaces des agents, apprenant aux agents à créer des artefacts interactifs et conscients du codebase plutôt que des murs de Markdown.
2026-08-07
Qwen / Alibaba Cloud
Qwen2.5-Omni surpasse Gemini-1.5-Pro sur OmniBench et tient en moins de 12 Go
Le Qwen2.5-Omni open source d'Alibaba a surclassé Gemini-1.5-Pro sur OmniBench et a pris la tête du classement MMAU de raisonnement audio. Les versions quantifiées réduisent la VRAM sous 12 Go et la prise en charge de MNN apporte le chat vocal en temps réel sur les téléphones.
2026-08-07
Codage IA
OpenCode parie que l'efficacité des tokens gagnera, en ajoutant Ling 3.0 Flash gratuitement
OpenCode propose désormais gratuitement Ling 3.0 Flash d'inclusionAI, quelques jours après sa sortie. Cette décision prolonge une stratégie attentive aux coûts, qui parie que l'efficacité des tokens gagnera la course du codage IA.
2026-08-07
Génération vidéo par IA
Wan3.0-Video facturé à la seconde : un clip de 30 secondes coûte 6 $
Le Wan3.0-Video d'Alibaba est facturé à la seconde sur DashScope, un clip de 30 secondes en 1080P coûtant 6 $ par génération. Nous décomposons les paliers de prix, le flux de travail multi-entrées et les questions que la fiche laisse sans réponse.
2026-08-07
Recherche en IA
Voice Memory : un fichier de 776 octets qui dit à la reconnaissance vocale quand ne rien faire
Un nouveau schéma d'inférence seule pour la reconnaissance vocale apprend la retenue : un correcteur figé lit un fichier mémoire par domaine et décide quand s'abstenir. La correction non contrainte casse les jetons corrects dans jusqu'à 64 % des modifications ; Voice Memory réduit ce taux à 35 % et abaisse le WER pondéré de 8,36 % à 7,52 %.
2026-08-06