NVIDIA
20 published articles
Infrastructure IA
Nemotron 3 Embed de Nvidia expose la taxe cachée que chaque agent IA paie
Nvidia a publié Nemotron 3 Embed, une famille de modèles d'embedding open-weight qui atteignent une qualité de récupération de pointe tout en réduisant les coûts en tokens des agents en aval. La variante 8B se classe n°1 sur RTEB ; les modèles plus petits de 1B offrent une efficacité prête pour la production.
2026-07-16
Matériel et infrastructure IA
L'accord de Groq avec Nvidia compte plus que sa levée de 750 millions de dollars
Groq a signé un accord de licence non exclusif avec Nvidia pour la technologie d'inférence, signalant un pivot stratégique, passant de la compétition sur le silicium à l'alimentation de l'infrastructure IA mondiale. L'accord, associé à une levée de 750 millions de dollars et à une collaboration avec le DOE, positionne Groq comme un hyperscaler émergent, et non seulement un fabricant de puces.
2026-07-16
Stratégie de données synthétiques
L'atlas de données de Nvidia montre pourquoi les données synthétiques importent plus que les poids des modèles
L'Atlas de prompts Nemotron Post-Training v3 de Nvidia fournit une carte interactive de milliards d'échantillons de données synthétiques, soulignant comment les données synthétiques ouvertes constituent la couche manquante pour construire des agents IA fiables. L'entreprise affirme que le comportement des agents doit être inspectable et que les données synthétiques, publiées ouvertement, sont le seul moyen de préserver les signaux propriétaires sans exposer les secrets commerciaux.
2026-07-12
Recherche IA
Ces chercheurs ont trouvé un moyen de faire penser les agents IA sans parler, et c'est 2,4 fois plus rapide
RecursiveMAS introduit un module appelé RecursiveLink qui permet aux agents d'échanger des pensées non formulées sans les traduire en texte. Le cadre met à l'échelle la collaboration via la récursion et offre des gains constants dans des benchmarks en mathématiques, sciences, médecine, code et recherche.
2026-07-11
Apprentissage robotique
Nvidia vient d'offrir à chaque laboratoire de robotique le même coup de pouce de 10 points
Le modèle VLA GR00T 1.7 de Nvidia s'intègre à LeRobot pour un apprentissage robotique de bout en bout, de la collecte de données par VR ou bras leader au réglage fin et au déploiement. Les benchmarks montrent un bond de 87 % à 96,5 % de succès sur les tâches LIBERO, et le pipeline ouvert fonctionne sur du matériel standard.
2026-07-10
Intelligence artificielle
Le nouveau modèle audio de Nvidia fait cinq choses à la fois et bat les spécialistes sur leur propre terrain
Audex de Nvidia unifie la compréhension audio, la génération et le raisonnement textuel en un seul modèle, égalant ou battant les systèmes spécialisés dans les benchmarks de parole et d'audio sans sacrifier les performances textuelles.
2026-07-09
Infrastructure IA
Groq lève 750 M$ alors que la demande d'inférence explose, en partenariat avec le DOE et l'Arabie saoudite pour une expansion mondiale
Groq obtient 750 M$ de financement face à la demande croissante d'inférence, s'associe avec le Département de l'Énergie des États-Unis et l'Arabie saoudite, et étend ses centres de données à l'échelle mondiale, se positionnant comme un acteur de l'infrastructure IA de nouvelle génération.
2026-07-01
Infrastructure IA
Le nouveau Nemotron 3 Ultra de Nvidia bouleverse l'équation des coûts des workflows agentiques
Nemotron 3 Ultra, le modèle dense-creux agentique de Nvidia, promet de réduire les coûts d'inférence jusqu'à 30 % par rapport aux modèles ouverts équivalents tout en conservant un raisonnement de pointe. Avec une fenêtre de contexte d'un million de jetons et une quantification NVFP4 native, il est positionné comme le cheval de bataille pour les charges de travail d'appel d'outils en entreprise.
2026-06-04