IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Google AI
Désactiver le filigrane de Gemini ne rend pas le contenu intraçable
Les contenus IA de Gemini et Flow peuvent désormais abandonner leur badge étincelle visible. Les marqueurs invisibles SynthID et C2PA restent en place, la vérification fonctionne donc toujours. Le hic : cela ne fonctionne que pour ceux qui pensent à vérifier.
2026-08-23
Génération musicale par IA
Music 3.0 remplace la consigne à balise unique par une chronologie qui garde les chansons IA sur la bonne voie
Les pistes IA ont tendance à s'écarter de la consigne au fil de leur déroulement : les instruments disparaissent, l'émotion s'aplatit, le style vocal va et vient. Music 3.0 remplace la description à balise unique par une Structured Caption séquentielle dans le temps, soutenue par un Hybrid-LM 8B/0,6B qui sépare la structure du détail.
2026-08-21
Outils de design
Open Design 0.18.0 met fin à la réunion « Est-ce la dernière version ? »
Open Design 0.18.0 propose un espace de travail d'équipe partagé avec des miroirs en lecture seule en direct et permet à Codex d'appeler le moteur de design sans interface. 115 pull requests de 22 contributeurs ont été fusionnées en deux jours. Voici ce qui a changé et la tendance des outils d'agents à laquelle cela correspond.
2026-08-21
Transparence IA
Le filigrane invisible de Claude arrive. Une réécriture complète l'efface
Anthropic ajoute un filigrane invisible aux futurs modèles Claude pour respecter les règles de l'AI Act européen sur le marquage des contenus générés par l'IA. Il est gratuit et intraçable, mais il ignore le code exact, les passages courts et les textes entièrement réécrits.
2026-08-21
IA à poids ouverts
dots3-note de Xiaohongshu : un MoE ouvert de 280B qui n'active que 16B
Le studio dots de Xiaohongshu a publié dots3-note preview, son premier modèle à poids ouverts : un MoE multimodal de 280B de paramètres, 16B actifs et une fenêtre de contexte de 512K. La conception sparse vise un faible coût d'inférence sur un nœud de 8 GPU, mais la fiche technique n'a pas encore publié de chiffres de benchmarks.
2026-08-20
Codage IA
Le C++ généré par IA consomme 5 à 8 % de calcul en plus et allonge les revues. Le correctif se trouve dans les invites
Une étude de 12 mois portant sur 3,52 millions de modifications de code dans une base de code C++ d'entreprise constate que le code IA est mesurablement moins bon en matière de couplage, d'allocations et de style de boucles, coûtant 5 à 8 % de calcul en plus. Des retours au niveau des invites ont permis de récupérer 11,1 % des avertissements d'analyse statique.
2026-08-19
Mémoire des agents
TEPA : pour les agents IA, une mémoire obsolète est pire que l'absence de mémoire
La mémoire des agents a un problème de falsifiabilité, soutient un nouveau préprint arXiv : les faits obsolètes restent récupérables et polluent le prompt. Son mécanisme TEPA révoque les mémoires dépassées, et lors des tests de dérive, la mémoire naïve a obtenu un score inférieur à celui de l'absence de mémoire (0.210 contre 0.309), tandis que TEPA a atteint 0.950.
2026-08-19
Scaling au moment du test
Le routage CoBa égalise le vote majoritaire best-of-16 avec 58,9 % de jetons en moins
CoBa, une politique de routage à calcul équilibré issue d'un nouvel article arXiv, égalise le vote majoritaire best-of-16 à moins de 0,01 point près tout en réduisant de 58,9 % les jetons pondérés par paramètres. Sur 3 129 évaluations couvrant MATH-500, AIME et AMC, elle bat également nettement le décodage à échantillon unique, même si un léger avantage du best-of-16 subsiste lorsque le budget n'est pas une contrainte.
2026-08-19
Recherche en IA
Muon grokke l'addition modulaire plus vite, puis ses solutions s'effondrent
Les transformeurs entraînés par Muon grokkent l'addition modulaire plus vite que AdamW, puis perdent la solution dans toutes les configurations testées. L'article attribue l'effondrement à l'interface représentation-lecture, où geler l'un ou l'autre groupe de paramètres l'empêche. L'analyse de Fourier montre que le circuit de la tâche survit et se trouve simplement mis en minorité.
2026-08-19
Fisher-R1 | Test d'hypothèses
Les agents IA produisent des statistiques sans faille et tirent pourtant de mauvaises conclusions
Les agents qui automatisent les tests d'hypothèses peuvent exécuter des analyses sans faille tout en parvenant à de mauvaises conclusions, car la plupart des benchmarks ne vérifient jamais si la valeur p est valide. Un benchmark de 425 tâches quantifie cet écart, et un modèle open-weight entraîné par RL en comble une partie.
2026-08-19
IA / Recherche en codage agentique
Blast Radius enterre le contexte mort. Aucun des 450 corps n'est revenu.
Un nouvel article arXiv, Blast Radius, traite le contexte agentique gaspillé comme de la matière morte et l'enterre de manière réversible : 17 à 26 % d'économies de jetons sur sept modèles OpenAI, 450 contextes archivés, zéro rappel. L'objectif plus ambitieux de l'article est de rendre le codage agentique durable, un jeton récupéré à la fois.
2026-08-19
Agents IA
PsychoAgent a doté les agents d'IA d'une mémoire émotionnelle. Les évaluateurs n'ont trouvé aucun avantage
PsychoAgent donne aux agents LLM une mémoire affective distincte, de sorte que les traces conflictuelles et chargées d'émotion peuvent l'emporter sur celles simplement thématiques. Dans trois scénarios de conflit, il a récupéré plus de mémoires critiques pour le conflit que les deux références (0.933 contre 0.500 et 0.667), mais cinq évaluateurs en aveugle n'ont trouvé aucun avantage qualitatif significatif.
2026-08-19