NVIDIA
20 published articles
Modèles d'IA | NVIDIA Nemotron 3.5 Lightning
Pourquoi Nemotron 3.5 Lightning parie que la plupart des étapes d'un agent n'ont pas besoin d'un gros modèle
Le nouveau modèle ouvert de Nvidia fonctionne localement avec 3 milliards de paramètres actifs et un contexte d'un million de jetons, conçu pour les agents qui restent actifs. Nvidia revendique jusqu'à 4 fois le débit et une exécution des tâches 30 % plus rapide que les modèles ouverts comparables.
2026-08-14
IA & Robotique
La formation des robots chirurgicaux s'accélère : le Cosmos-H-Dreams de Nvidia tourne à 160 ips
Le Cosmos-H-Dreams de Nvidia transforme la simulation chirurgicale en une expérience interactive en temps réel. Tournant à 160 ips sur un seul GPU, il permet aux chirurgiens, stagiaires et politiques IA de s'entraîner dans une boucle fermée de vidéo générée sans avoir besoin d'un robot physique.
2026-08-01
Recherche en IA
La génération vidéo devient 120 fois plus rapide sur un seul GPU : au cœur de l'avancée de Nvidia sur l'attention hybride
La SANA-Video 2.0 de Nvidia Research combine l'attention linéaire et softmax périodique dans un ratio 3:1 pour fonctionner 120 fois plus vite que Wan 2.2 sur un seul H100. La conception hybride retrouve une expressivité de plein rang tout en maintenant une inférence à 13 secondes pour un clip 720p. Les réserves : les benchmarks s'arrêtent à 720p et intègrent le changement d'attention avec des optimisations propriétaires.
2026-07-31
IA Open Source
L'AV-Flamingo de Nvidia s'attaque à la compréhension des longues vidéos là où la plupart des modèles échouent
Nvidia publie AV-Flamingo, un grand modèle de langage audiovisuel open source conçu pour la compréhension de vidéos longues et complexes. Il utilise un programme d'apprentissage en trois étapes et un cadre de chaîne de pensée horodatée pour gérer le raisonnement temporel et cross-modal qui fait trébucher la plupart des modèles.
2026-07-28
IA physique
Le modèle à 4 milliards de paramètres pour périphériques Edge de Nvidia fait ce que la plupart des petits VLM ne font pas
Le Cosmos 3 Edge de Nvidia intègre la modélisation du monde en 4 milliards de paramètres, se classant premier au VANTAGE-Bench parmi sa catégorie de taille. Sa conception à double transformateur mêle raisonnement et prédiction d'action en temps réel pour les robots, le tout déployable sur le matériel Jetson et RTX.
2026-07-28
Infrastructure & Financement
Le pari de 800 millions de dollars de Together AI sur les mathématiques de l'inférence ouverte
Together AI a levé 800 millions de dollars pour une valorisation de 8,3 milliards de dollars, soutenu par Aramco Ventures, NVIDIA et d'autres. La société affirme que les réservations annuelles ont dépassé 1,15 milliard de dollars le trimestre dernier, portées par des clients comme Decagon, Eleven Labs et Cursor, qui signalent des réductions de coûts de 6 à 20 fois en passant à l'inférence ouverte.
2026-07-27
Raisonnement ouvert
Nemotron-4 de Nvidia est rapide, ouvert, et vise directement l’écart entre Llama et GPT
La gamme Nemotron-4 de Nvidia défie Llama 3.3 et Mistral Large avec des scores MMLU compétitifs et une économie d’inférence annoncée de 30 %. La licence ouverte et la stratégie en deux tailles en font une alternative pratique pour les équipes exécutant des charges de travail agentiques à grande échelle.
2026-07-25
Des modèles ouverts coordonnés
Sakana AI intègre NVIDIA Nemotron dans son système d'orchestration multi-agents Fugu
Sakana AI intègre la famille de modèles ouverts Nemotron de NVIDIA dans le système d'orchestration multi-agents Fugu. Fugu sélectionne et combine dynamiquement des modèles spécialisés. La collaboration vise à montrer que des modèles ouverts coordonnés peuvent égaler les systèmes monolithiques de pointe.
2026-07-23
Recherche agentielle gouvernée
Le nouvel IA scientifique de Nvidia travaille sans jamais toucher aux données des patients
Le Nvidia AI Technology Center dévoile NAIS, un système de recherche agentielle gouverné qui orchestre des workflows biomédicaux de bout en bout sur des données hospitalières protégées. Dans un déploiement réel de GWAS sur l'hypertension impliquant 286 422 individus, le système a produit des résultats comparables à des analyses menées par des experts tout en préservant la vie privée et en permettant une supervision humaine.
2026-07-19
Modèles IA & Infrastructure
Les nouveaux modèles d'embedding de Nvidia dominent le classement, mais la vraie histoire réside dans les économies de coûts des agents
La collection Nemotron 3 Embed de Nvidia revendique la première place sur le benchmark RTEB et introduit des variantes 1B qui conservent 99 % de la précision du modèle 8B. Les données de l'entreprise montrent qu'une récupération plus forte réduit les coûts en tokens aval dans les systèmes agentiques.
2026-07-18
Dynamique du marché
La capitalisation boursière de Nvidia signale que la demande en IA est loin de se refroidir
La capitalisation boursière de Nvidia a franchi les 3 000 milliards de dollars alors que la demande pour les infrastructures d'IA continue de croître. Cette étape souligne que les achats de GPU par les entreprises restent solides malgré la concurrence croissante d'AMD et de startups proposant des puces d'inférence moins chères.
2026-07-16
rapport spécial / edge AI
Nvidia DeepStream passe en open source : ce que la version 9.1 signifie pour l'edge AI
Le code source complet du SDK d'analyse vidéo DeepStream de Nvidia est désormais sur GitHub sous les licences Apache 2.0 et CC-BY-4.0, ouvrant le développement de l'edge AI à un public plus large. La version 9.1 apporte des agents de codage basés sur des LLM, l'intégration du serveur d'inférence Triton et des dépôts consolidés pour des pipelines de bout en bout.
2026-07-16