SevenTnewS

IA

Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.

565 published articles

4 min read

Infrastructure et politique de l'IA

Groq parie son avenir sur l'American AI Stack

Groq a approuvé le plan d'action sur l'IA de la Maison-Blanche le jour de son lancement, se désignant comme couche de calcul de l'American AI Stack. Le communiqué révèle une entreprise qui parie que la politique nationale et l'inférence domestique bon marché la mèneront sur le marché mondial.

2026-08-08

3 min read

Infrastructure d'inférence

L'inférence IA devient un problème de localisation : Groq ouvre un centre de données au Royaume-Uni

Groq a ouvert un centre de données au Royaume-Uni avec Equinix alors que GroqCloud dépasse les 3,5 millions de développeurs et que le trafic IA en production ne cesse de croître. Ce choix est un pari : l'inférence est désormais un problème de géographie, la latence et la proximité décidant où l'IA en temps réel peut s'exécuter.

2026-08-08

5 min read

Génération vidéo

MiniMax a abandonné son architecture éprouvée pour que H3 fasse tout

MiniMax affirme que H3 unifie la génération de texte, d'image, de vidéo et d'audio dans un seul modèle, facture la sortie 2K à moins d'un tiers du prix des modèles grand public, et prévoit d'ouvrir les poids dans les prochains jours. Les petites lignes sont la véritable histoire : l'entreprise a abandonné l'architecture qui lui donnait un avantage pour y parvenir.

2026-08-07

4 min read

Vision par ordinateur

CABiNet reste à moins de 2 points de YOLO26x pour un huitième de la puissance de calcul

Le VDD Semantic Segmentation Model Zoo apporte sur Hugging Face des modèles YOLO26 et CABiNet entraînés sur des images de drones variées. YOLO26x-sem mène avec 78.83% de mIoU, mais les 77.76% de CABiNet-Large à 54.8 GFLOPs plaident en faveur de l'efficacité.

2026-08-07

Featured3 min read

Sécurité de l'IA

Pourquoi Microsoft ouvre les tests de sécurité de l'IA au monde

Microsoft a financé 18 laboratoires universitaires sur six continents pour effectuer indépendamment des tests de type 'red team' sur les systèmes d'IA, reconnaissant que les équipes internes ne peuvent pas détecter tous les risques.

2026-08-07

3 min read

Recherche RAG

BM25 bat le RAG agentique lorsque les corpus dépassent 10 millions de tokens

La recherche agentique gagne sur les petits corpus, mais une étude de muset-ai sur 28 niveaux imbriqués montre BM25 la dépassant vers 10 millions de tokens. L’agent consomme 39 fois plus de tokens de requête, et le RAG par graphe plafonne à la construction.

2026-08-07

4 min read

IA générative

Pippa verse 0,005 $ par image aux artistes. Ses modèles s'entraînent toujours sur de l'art récupéré

Pippa promet aux artistes une part de chaque génération réalisée dans leur style : 0,005 $ par image, 0,003 $ par seconde de vidéo, plus une part d'un pool de redevances de 5 %. Avec environ 800 abonnés et quatre artistes sous contrat, et des modèles de base toujours entraînés sur du contenu récupéré, le discours éthique a un problème de calcul.

2026-08-07

5 min read

UI agentique

Qoder Canvas : un système de conception conçu pour les agents, pas pour les humains

L'équipe Qoder d'Alibaba affirme que la fenêtre de chat n'est pas le bon contenant pour les sorties complexes des agents. Qoder Canvas applique la pensée des systèmes de conception aux interfaces des agents, apprenant aux agents à créer des artefacts interactifs et conscients du codebase plutôt que des murs de Markdown.

2026-08-07

4 min read

Qwen / Alibaba Cloud

Qwen2.5-Omni surpasse Gemini-1.5-Pro sur OmniBench et tient en moins de 12 Go

Le Qwen2.5-Omni open source d'Alibaba a surclassé Gemini-1.5-Pro sur OmniBench et a pris la tête du classement MMAU de raisonnement audio. Les versions quantifiées réduisent la VRAM sous 12 Go et la prise en charge de MNN apporte le chat vocal en temps réel sur les téléphones.

2026-08-07

Featured1 min read

Codage IA

OpenCode parie que l'efficacité des tokens gagnera, en ajoutant Ling 3.0 Flash gratuitement

OpenCode propose désormais gratuitement Ling 3.0 Flash d'inclusionAI, quelques jours après sa sortie. Cette décision prolonge une stratégie attentive aux coûts, qui parie que l'efficacité des tokens gagnera la course du codage IA.

2026-08-07

Featured3 min read

Génération vidéo par IA

Wan3.0-Video facturé à la seconde : un clip de 30 secondes coûte 6 $

Le Wan3.0-Video d'Alibaba est facturé à la seconde sur DashScope, un clip de 30 secondes en 1080P coûtant 6 $ par génération. Nous décomposons les paliers de prix, le flux de travail multi-entrées et les questions que la fiche laisse sans réponse.

2026-08-07

4 min read

Recherche en IA

Voice Memory : un fichier de 776 octets qui dit à la reconnaissance vocale quand ne rien faire

Un nouveau schéma d'inférence seule pour la reconnaissance vocale apprend la retenue : un correcteur figé lit un fichier mémoire par domaine et décide quand s'abstenir. La correction non contrainte casse les jetons corrects dans jusqu'à 64 % des modifications ; Voice Memory réduit ce taux à 35 % et abaisse le WER pondéré de 8,36 % à 7,52 %.

2026-08-06

← PreviousPage 6 / 48 · 565 articlesNext →