SevenTnewS

IA

Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.

565 published articles

4 min read

Détection de fraude dans les graphes

Ce que révèle un nouvel article sur la détection de fraude dans les graphes à propos du sale petit secret de l'IA : la fuite d'étiquettes

L'article PREF-Gate formalise un contrat de provenance des étiquettes pour les preuves relationnelles dans la détection de fraude dans les graphes. Il montre que sur deux des trois ensembles de données, le meilleur modèle est celui qui évite entièrement les preuves dérivées des étiquettes d'entraînement, un résultat qui remet en question les hypothèses courantes dans la recherche sur les réseaux neuronaux de graphes.

2026-07-26

Featured5 min read

Coalition de rivaux

OpenAI, Meta et 40 autres signent une lettre sur la politique de l'IA. Voici pourquoi c'est important.

Quarante et une organisations de tout l'écosystème de l'IA ont signé conjointement une lettre ouverte affirmant que les modèles à poids ouverts sont essentiels au leadership américain en IA. La coalition inhabituelle comprend des rivaux comme OpenAI et Meta, des géants du cloud et des startups, signalant un rare consensus politique.

2026-07-26

4 min read

Outils de développement

La mise à jour ennuyeuse qui compte : pourquoi la finition a gagné la course des outils de développement

La version de la Grok Build CLI de xAI s'est concentrée sur des corrections de bugs et des tutoriels, tandis que Xcode 27 d'Apple prend en charge plusieurs fournisseurs d'IA via un protocole de modèle de langage. Ces mouvements indiquent que les outils développeurs sont entrés dans une phase de maturité où le polish et l'intégration transparente définissent l'avantage concurrentiel.

2026-07-26

4 min read

WWDC

Apple ouvre son jardin clos aux modèles d'IA tiers dans Xcode 27

Xcode 27 apporte le codage agentique avec les modèles d'Anthropic, Google et OpenAI, ainsi que de nouvelles infrastructures d'intelligence permettant aux applications d'utiliser les modèles d'Apple, Claude, Gemini et d'autres. Core AI permet aux développeurs d'exécuter des LLM à grande échelle sur l'appareil.

2026-07-25

Featured3 min read

Outils de développement

Grok Build CLI a corrigé 20 bugs et prouvé que la finition l'emporte sur les fonctionnalités

La dernière version de Grok Build CLI se concentre sur la stabilité et la convivialité : plus de 20 correctifs de bugs, un nouveau tour d'onboarding, des options de configuration étendues et des améliorations de workflow. Pas de fonctionnalités tape-à-l'œil, juste le genre de finition qui signale un produit en phase de maturation.

2026-07-25

Featured1 min read

Un modèle à 158 ms vient de réécrire le livre de jeu vitesse-qualité

Le modèle à 158 ms qui a brisé la règle vitesse-qualité

Celeris-1 obtient 75.9% sur MMLU-Pro avec une latence de 158 ms, huit fois plus rapide que GPT-5 mini tout en ne perdant que 2.6 points de précision. L'analyse examine la méthodologie du benchmark et ce que ce compromis vitesse-qualité signifie pour les applications d'IA en temps réel.

2026-07-25

Featured3 min read

Coût vs. capacité

Le modèle à $1.40 qui a écrasé son homologue à $2.82 en physique

Quatre modèles d'IA ont été invités à construire des scènes HTML avec une physique réaliste. Opus 5 a réussi les trois au coût le plus bas parmi les meilleurs performeurs, tandis que Fable 5 a échoué à chacune au double du prix.

2026-07-25

3 min read

Raisonnement ouvert

Nemotron-4 de Nvidia est rapide, ouvert, et vise directement l’écart entre Llama et GPT

La gamme Nemotron-4 de Nvidia défie Llama 3.3 et Mistral Large avec des scores MMLU compétitifs et une économie d’inférence annoncée de 30 %. La licence ouverte et la stratégie en deux tailles en font une alternative pratique pour les équipes exécutant des charges de travail agentiques à grande échelle.

2026-07-25

3 min read

Références en biosécurité

Les agents IA ont échoué à un test de surveillance des pathogènes. Cela devrait nous inquiéter

BioSecBench-Surveillance a testé seize configurations d'agents IA sur 100 tâches de surveillance génomique. Les meilleurs performants n'ont atteint qu'environ 50 % de précision. Les erreurs ne provenaient pas d'un mauvais choix de workflow mais des choix contextuels, références, seuils, filtres, que les humains prennent pour acquis.

2026-07-25

3 min read

Apprentissage par renforcement

Des chercheurs de Meta et de l'UIUC entraînent des modèles vision-langage à vérifier leur propre travail et à repenser les mauvaises réponses

SVR-R1 transforme l'auto-verdict binaire d'un modèle vision-langage en un signal d'apprentissage. Testé sur des benchmarks de raisonnement sur graphiques et tableaux, il surpasse largement le GRPO standard tandis que le modèle réduit progressivement le nombre de tours de vérification, indiquant qu'il internalise l'auto-correction.

2026-07-25

Featured1 min read

Agents IA

Votre Mac vient de devenir un agent Gemini à distance, sauf si vous êtes en Europe

Google met à jour Gemini Spark avec le contrôle à distance du Mac, des intégrations d'applications tierces et des notifications plus intelligentes. Mais l'expansion de l'agent ignore l'EEE, le Royaume-Uni, la Suisse et le Nigéria, soulignant la tension entre le déploiement rapide de l'IA et la réglementation régionale.

2026-07-25

4 min read

IA incarnée

La pile de simulation robotique se fragmente et se recompose à vue d'œil

La simulation robotique est devenue le pilier de l'entraînement de l'IA incarnée. Alors que les moteurs se multiplient et se spécialisent, la question n'est plus de savoir lequel est le plus rapide, mais quelles abstractions survivront en tant qu'infrastructure partagée. NVIDIA, DeepMind et Newton, soutenu par Disney, pointent vers un avenir ouvert et en couches.

2026-07-25

← PreviousPage 20 / 48 · 565 articlesNext →