IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Intelligence artificielle
AutoVSR : un cadre IA qui relie les schémas de circuits aux expressions symboliques avec une approche de vérification prioritaire
AutoVSR utilise la perception visuelle, une représentation intermédiaire exécutable et des solveurs symboliques augmentés d'outils pour convertir de manière fiable des schémas de circuits en expressions symboliques valides. Les expériences sur cinq types de circuits montrent qu'il surpasse à la fois les VLM généralistes et les méthodes spécialisées, avec des améliorations de précision respectives de 30 à 59 % et de 42 à 52 %.
2026-08-04
Agents IA
Le bot Slack de Hugging Face interroge les données de production. Le LLM ne voit jamais les clés
Hugging Face opère un agent de codage Slack interne, Moon Bot, capable d'interroger des bases de données de production et d'ouvrir des PR. Sa conception de la sécurité maintient les identifiants hors de portée du modèle grâce à des niveaux Okta, un bash sandboxé et des proxys inverses locaux qui injectent les clés côté serveur.
2026-08-04
Infrastructure IA
Faire payer les agents est facile. Les rendre dignes de confiance ne l'est pas.
L'Agent Stack de Circle fournit les rails financiers de l'économie agentique : paiements en USDC, politiques de dépenses et registre de services. Mais le véritable obstacle n'est pas la technologie, c'est la gouvernance. Sans pistes d'audit transparentes et de garde-fous programmables, la promesse du commerce autonome reste théorique.
2026-08-04
IA japonaise
Sakana Namazu parie sur le keigo contre l'ère de l'IA la plus puissante
Sakana AI a présenté Namazu, un modèle spécialisé dans les documents professionnels japonais, les e-mails et le keigo. Il arrive alors que les entreprises asiatiques signalent que la rareté et la mauvaise qualité des modèles en langues locales freinent l'adoption de l'IA.
2026-08-03
Intelligence artificielle
Le mème IA « accurate » de Musk a raison sur le passé et tort sur le présent
Musk a republié un mème divisant l'IA en une ère théorique noble et une ère de mise à l'échelle par des brainlets. Les deux moitiés relèvent d'une histoire réelle, mais le dualisme s'effondre : les kernels reviennent comme ingénierie, les petits modèles rivalisent avec l'échelle, et DeepMind reconstruit la rigueur pour l'apprentissage profond.
2026-08-03
IA open source
Qwen3.8-Max a battu 458 équipes humaines en 24 heures, en travaillant seul
Qwen3.8-Max a battu 458 des 526 équipes humaines lors d'un concours de 24 heures en travaillant seul, et Alibaba mettra ses poids en open source la semaine prochaine. Chaque chiffre est pour l'instant auto-déclaré, ce qui explique précisément pourquoi les affirmations d'autonomie méritent d'être examinées de près.
2026-08-03
Agents IA
La promesse d'agents 24/7 de Zuckerberg se heurte au problème de confiance de Meta
Zuckerberg promet des agents grand public 24/7 pour la santé, les relations et les finances, les qualifiant de prochaine vague de revenus de Meta. La distribution est réelle à l'échelle de WhatsApp, mais un déficit de confiance et l'absence d'écosystèmes de données se dressent entre la vision et les milliards d'utilisateurs nécessaires.
2026-08-03
Recherche sur l'alignement de l'IA
L'alignement pluraliste n'a aucune place dans l'IA de production, selon des chercheurs
Un article soumis en juillet 2026 audite les laboratoires de pointe et ne trouve aucune mention du pluralisme dans leurs documents publics. Il identifie trois raisons pour cet écart et propose une feuille de route vers l'adoption.
2026-08-03
Stratégie produit
Sakana AI parie contre l'ère de l'« IA la plus puissante » : orchestration et lancements rapides
Sakana AI a lancé Sakana Chat, Marlin, Fugu et Translate en succession rapide. Le responsable produit Sota Omura explique pourquoi le lancement rapide est la méthode de l'ère de l'IA, et pourquoi l'entreprise parie contre une « IA la plus puissante » unique.
2026-08-03
Recherche IA
Pourquoi la log-probabilité des tokens est le mauvais indicateur pour surveiller les modèles de raisonnement IA
Novelis Research montre que la log-probabilité des tokens échoue en tant que moniteur de décodeur pour les modèles de raisonnement quantifiés, étant aveugle aux boucles confiantes. Ils introduisent un contrôleur e-CUSUM calibré qui combine l'incertitude et les signaux de répétition, atteignant une sélectivité sur GSM8K avec DeepSeek-R1-Distill-Qwen-1.5B.
2026-08-03
Développement IA
Les agents de codage quittent votre machine locale : Alibaba et Mistral passent à distance
Qoder d'Alibaba Cloud introduit la délégation à distance pour les agents de codage, permettant aux développeurs de décharger les tâches longues vers des sandbox cloud. Cette fonctionnalité, associée à un nouveau moteur de connaissances, oppose directement Qoder aux agents distants de Mistral dans une course pour découpler le développement assisté par IA du terminal local.
2026-08-03
Intelligence Artificielle
Comment un système à double mémoire a appris à l'IA à diagnostiquer les pannes qu'elle oublie sans cesse
OpsMem couple une mémoire à court terme (MCT) pour l'état de diagnostic en évolution avec une mémoire à long terme (MLT) pour l'expérience opérationnelle réutilisable. Grâce à un mécanisme appelé résonance inter-mémoire, le système active l'expérience pertinente à l'état à partir de la MLT pour guider le diagnostic multi-agents. Sur un ensemble de données de microservices de Huawei, il a surpassé les références basées sur le raisonnement agentique et la connaissance augmentée avec des marges significatives.
2026-08-03