Contexte 1M
3 published articles
Modèles d'IA | NVIDIA Nemotron 3.5 Lightning
Pourquoi Nemotron 3.5 Lightning parie que la plupart des étapes d'un agent n'ont pas besoin d'un gros modèle
Le nouveau modèle ouvert de Nvidia fonctionne localement avec 3 milliards de paramètres actifs et un contexte d'un million de jetons, conçu pour les agents qui restent actifs. Nvidia revendique jusqu'à 4 fois le débit et une exécution des tâches 30 % plus rapide que les modèles ouverts comparables.
2026-08-14
Lancement d'un modèle
Anthropic dévoile Claude Sonnet 5 : un modèle de raisonnement hybride pour les agents en temps réel et les charges de travail élevées
Le Claude Sonnet 5 d'Anthropic offre un raisonnement hybride avec une fenêtre de contexte de 1M de tokens, excellent pour le codage, les flux d'agents et les tâches professionnelles. Disponible à un prix d'introduction de 2 $ par million de tokens en entrée, promettant de compresser des projets de codage de plusieurs jours en quelques heures.
2026-07-09
Laboratoires et recherche en IA
Le M3 de MiniMax vient d’écrire son propre noyau CUDA et a ouvert le code
Le MiniMax M3 obtient 83,5 sur BrowseComp, dépasse Opus 4,7 de justesse et gère jusqu’à 1 million de jetons en natif. Dans un test d’autonomie remarquable, il a auto-optimisé un noyau GPU de 7,6 % à 71,3 % d’utilisation maximale sans intervention humaine.
2026-07-09