SevenTnewS

IA

Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.

565 published articles

4 min read

Intelligence Artificielle

Pourquoi la chaîne de pensée de votre IA gaspille des jetons, et comment l'arrêt optimal y remédie

Des chercheurs du MIT proposent OS-Pruner, un plug-in qui arrête dynamiquement le raisonnement par chaîne de pensée lorsque des calculs supplémentaires ne valent pas le coût en jetons. Les tests montrent une réduction de longueur de 20 à 60 % avec un sacrifice de précision minime.

2026-07-29

3 min read

Intelligence Artificielle

Avant de demander à une IA de réfléchir, essayez d'abord de nettoyer son entrée

Les chercheurs du CRIL démontrent que les techniques de pré-traitement préservant le nombre de modèles accélèrent considérablement l'échantillonnage, l'énumération et les requêtes d'accès direct lorsque les formules sont compilées en circuits d-DNNF. L'étude teste 1 425 benchmarks et montre que la suppression des variables définies avec des ordres compatibles résout jusqu'à 47 instances de plus que sans pré-traitement.

2026-07-29

3 min read

Interprétabilité mécaniste

Ce que gemma-4 sait réellement de la physique : un nouvel article révèle que les représentations sont réelles

De nouvelles recherches sur gemma-4-E4B-it révèlent que les représentations internes des mécanismes de science des matériaux du modèle sont liées de manière causale à ses réponses. L'étude combine plusieurs techniques de sondage et d'intervention pour montrer que la connaissance de la physique est encodée dans les transformations d'état, et pas seulement dans des motifs statiques.

2026-07-29

2 min read

Qwen / Alibaba

Qwen3-2507 arrive avec un modèle de réflexion et un modèle d'instructions, la séparation revient à la mode

L'équipe Qwen d'Alibaba a publié Qwen3-2507, divisant sa gamme de modèles en variantes dédiées aux instructions et à la réflexion. La mise à jour apporte des améliorations substantielles en raisonnement, suivi d'instructions, et support de contexte 256K, extensible à 1 million de tokens.

2026-07-29

6 min read

Ingénierie IA

Le playbook Claude Code devient un wiki communautaire : 83 astuces et ça continue

Un dépôt GitHub communautaire collecte 83 astuces pour Claude Code, documentant le passage du « vibe coding » à l'ingénierie agentique. La ressource couvre les agents, les commandes, les compétences, les workflows et l'orchestration entre modèles.

2026-07-29

6 min read

Recherche en IA

Les affirmations de risque des têtes de RL distributionnel sont en grande partie fausses, selon un nouvel audit

Un audit à grande échelle montre que les agents de RL distributionnel fabriquent systématiquement des compromis de risque dans les états mêmes où les praticiens leur feraient le plus confiance. Pour QR-DQN, C51 et IQN sur MinAtar, zéro des affirmations les plus fortes étaient confirmables, et agir sur les conseils CVaR des agents donnait parfois des résultats significativement pires que le hasard.

2026-07-29

Featured3 min read

Microsoft AI

Microsoft égalise GPT-5.6 dans Excel avec un modèle moins cher et sur GPU plus ancien

Le modèle MAI de Microsoft dans Excel égalise GPT-5.6 pour les tâches courantes à moindre coût, utilise moins de jetons que ses concurrents dans Copilot, et fonctionne sur des GPU H100 et A100, abaissant la barrière pour un déploiement à grande échelle.

2026-07-29

3 min read

Architecture IA

La course aux modèles a désormais une deuxième piste : l'orchestration l'emporte sur la taille brute

Le plafonnement par Anthropic des compétences cyber de Claude Opus 5, l'orchestration par Fugu de Sakana de nuées de modèles, et le nouveau routage multi-modèle de Claude Code pointent tous vers le même changement : le prochain avantage concurrentiel des systèmes d'IA est l'orchestration, et non la seule taille brute des modèles.

2026-07-28

1 min read

Modèles IA

OpenAI publie une mise à jour mineure de GPT pour la gestion des longs contextes

OpenAI a déployé aujourd'hui une mise à jour mineure de GPT, portant sur la gestion des longs contextes. Ce changement vise à aider le modèle à traiter les entrées étendues plus efficacement.

2026-07-28

3 min read

Intelligence Artificielle

Le pari de 360 millions d'euros de la France sur l'IA : neuf clusters pour former la prochaine génération

La France alloue 360 millions d'euros à neuf clusters IA dans le cadre de France 2030, visant à renforcer la formation et la recherche. Deux nouveaux projets de formation reçoivent 11 millions d'euros pour requalifier les travailleurs dans les domaines liés à l'IA.

2026-07-28

3 min read

Partenariat

ElevenLabs signe avec le gouvernement britannique pour intégrer l'IA vocale dans les services publics

ElevenLabs a signé un protocole d'accord avec le DSIT du gouvernement britannique pour tester l'IA vocale dans les services publics, en se concentrant sur l'accessibilité pour les personnes malvoyantes, âgées et les communautés linguistiquement diverses. L'entreprise agrandit son siège londonien et double ses effectifs au Royaume-Uni pour atteindre 200 personnes.

2026-07-28

3 min read

Intelligence Artificielle

Une nouvelle attaque en boîte noire révèle que les agents de navigation vision-langage sont facilement déviés par un bruit semblable à celui d'une lentille

AdvNav est une attaque adversarial en boîte noire qui utilise un bruit de Perlin ressemblant à une lentille pour confondre les agents de navigation vision-langage. En observant uniquement le comportement de l'agent, sans ses poids internes, la méthode a atteint jusqu'à 87 % de taux de succès d'attaque. Le cadre révèle une large vulnérabilité dans les systèmes VLN actuels.

2026-07-28

← PreviousPage 16 / 48 · 565 articlesNext →