SevenTnewS

IA

Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.

424 published articles

4 min read

Données Synthétiques

Pas de patron, pas de goulot d'étranglement : pourquoi un cadre pair-à-pair repense la génération de données synthétiques

Matrix est un cadre décentralisé qui utilise des messages sérialisés transmis via des files d'attente distribuées pour la génération multi-agents de données synthétiques. En éliminant l'orchestrateur central, il atteint un débit 2 à 15 fois supérieur sur du matériel identique.

2026-06-06

Featured3 min read

IA locale

Ollama 0.30 apporte une inférence GPU plus rapide et une prise en charge native des modèles GGUF

Ollama 0.30 booste l'inférence NVIDIA jusqu'à 20 %, active la prise en charge GPU Vulkan par défaut pour les appareils AMD et Intel, et étend la compatibilité des modèles GGUF, y compris les modèles affinés de Hugging Face et la prise en charge des appels d'outils avec des agents de codage.

2026-06-05

Featured5 min read

Infrastructure IA

Le nouveau Nemotron 3 Ultra de Nvidia bouleverse l'équation des coûts des workflows agentiques

Nemotron 3 Ultra, le modèle dense-creux agentique de Nvidia, promet de réduire les coûts d'inférence jusqu'à 30 % par rapport aux modèles ouverts équivalents tout en conservant un raisonnement de pointe. Avec une fenêtre de contexte d'un million de jetons et une quantification NVFP4 native, il est positionné comme le cheval de bataille pour les charges de travail d'appel d'outils en entreprise.

2026-06-04

4 min read

Intelligence artificielle

OpenJarvis propose une alternative locale-first aux agents IA basés sur le cloud

OpenJarvis 1.0 des laboratoires Hazy Research et Scaling Intelligence de Stanford permet aux agents IA personnels de fonctionner localement via Ollama, avec un accès optionnel au cloud. Il inclut des présélections pour les briefings matinaux, la recherche dans des documents et les assistants de codage locaux, en priorisant l'efficacité et la confidentialité tout en suivant l'énergie, le coût et la latence.

2026-05-28

7 min read

Infrastructure Cloud

Qu'est-ce qui fait tourner un agent ? ANOLISA d'Alibaba Cloud réécrit la couche OS

ANOLISA d'Alibaba Cloud est une mise à niveau OS en trois couches pour l'ère des agents, réduisant l'utilisation de tokens de 30 % et améliorant le temps d'exécution d'une marge similaire. Conçu pour un déploiement d'agents à haute densité, il aborde la sécurité, l'observabilité et l'inefficacité au niveau du noyau.

2026-05-26

Featured1 min read

Model Studio

Les tarifs hors pointe de Qwen3.7 réduisent les coûts API de 80 %, et les développeurs américains bénéficient des meilleures heures

Les tarifs hors pointe de Qwen3.7 d'Alibaba offrent jusqu'à 80 % de réduction sur les appels API pendant les heures couvrant la journée de travail américaine et européenne. Voici comment cela se compare à GPT-5.5, Claude et Gemini, et quelles charges de travail en bénéficient le plus.

2026-05-20

Featured2 min read

Qwen3.7

La faille de fuseau horaire qui réduit les coûts d'inférence IA de 80%

Model Studio réduit automatiquement les coûts des API Qwen3.7-Max et Qwen3.7-Plus jusqu'à 80% pendant une fenêtre nocturne qui coïncide avec les heures de travail aux États-Unis et en Europe. Pas d'inscription, pas de changement de code, juste une inférence moins chère pour ceux qui synchronisent leurs appels.

2026-05-20

4 min read

Alibaba Cloud

Anolisa v0.3 offre aux agents IA un filet de sécurité et un bouton d'annulation

L'OS agentique d'Alibaba Cloud, Anolisa, atteint la version 0.3 avec un module de sécurité dédié appelé AgentSecCore, une visualisation des coûts en temps réel et des instantanés d'espace de travail qui permettent d'annuler les actions des agents en quelques millisecondes.

2026-05-07

1 min read

Paiements en stablecoins

Stablecoins, pas de crypto : Circle cible les entreprises avec des paiements gérés

Circle launches a managed stablecoin payments service that lets banks and enterprises process crypto transactions without managing digital assets. The service handles wallet infrastructure, aiming to simplify stablecoin adoption for institutions wary of direct crypto exposure.

2026-03-31

Featured4 min read

Inférence IA locale

Ollama vient de réécrire son moteur Apple silicon. La génération M5 est la véritable histoire

Ollama présente en aperçu l'inférence basée sur MLX sur Apple silicon, poussant Qwen3.5-35B-A3B à 1 851 tok/s en préremplissage sur M5. Le passage apporte également la quantification NVFP4 pour une parité de production et un cache plus intelligent pour les workflows agentiques.

2026-03-30

Featured3 min read

Architectures multi-agents

Pourquoi Qoder donne un chef à chaque agent IA

Le mode Experts de Qoder remplace la messagerie multi-agents pair-à-pair par un Leader unique qui coordonne des experts spécialisés de manière asynchrone. L'architecture réduit l'explosion d'état, améliore la qualité sur quatre dimensions et extrait des compétences réutilisables après chaque tâche.

2026-03-11

4 min read

Recherche sur la sécurité de l'IA

Les modèles d'IA ne peuvent pas s'empêcher de penser à voix haute. C'est à la fois une bonne nouvelle et un cauchemar pour la sécurité.

Claude Sonnet 4.5 ne peut contrôler son raisonnement en chaîne que 2,7 % du temps, contre 61,9 % pour les sorties finales. L'écart soulève des questions ouvertes sur la robustesse de la surveillance par CoT en tant que mécanisme de sécurité, et personne ne sait pourquoi il existe.

2026-03-09

← PreviousPage 35 / 36 · 424 articlesNext →