NVIDIA
20 published articles
Modelos de IA | NVIDIA Nemotron 3.5 Lightning
Por qué Nemotron 3.5 Lightning apuesta a que la mayoría de los pasos de un agente no necesitan un modelo grande
El nuevo modelo abierto de Nvidia se ejecuta localmente con 3B de parámetros activos y un contexto de 1M de tokens, diseñado para agentes que permanecen en ejecución. Nvidia afirma hasta 4 veces más rendimiento y un 30 % más rápido en la finalización de tareas que los modelos abiertos comparables.
2026-08-14
IA y Robótica
El entrenamiento de robots quirúrgicos se vuelve más rápido: Cosmos-H-Dreams de Nvidia funciona a 160 fps
Cosmos-H-Dreams de Nvidia convierte la simulación quirúrgica en una experiencia interactiva en tiempo real. Funcionando a 160 fps en una sola GPU, permite a cirujanos, aprendices y políticas de IA practicar dentro de un bucle cerrado de video generado sin necesidad de un robot físico.
2026-08-01
Investigación en IA
La generación de video se vuelve 120 veces más rápida en una GPU: el avance de Nvidia en atención híbrida
El SANA-Video 2.0 de Nvidia Research combina atención lineal y softmax periódica en una proporción 3:1 para funcionar 120 veces más rápido que Wan 2.2 en una H100. El diseño híbrido recupera la expresividad de rango completo mientras mantiene la inferencia en 13 segundos para un clip en 720p. Las advertencias: los benchmarks se detienen en 720p y combinan el cambio de atención con optimizaciones propietarias.
2026-07-31
IA de código abierto
AV-Flamingo de Nvidia aborda la comprensión de videos largos donde la mayoría de los modelos fallan
Nvidia lanza AV-Flamingo, un modelo de lenguaje grande audiovisual abierto diseñado para la comprensión de videos largos y complejos. Utiliza un plan de estudios de tres etapas y un marco de cadena de pensamiento con marcas de tiempo para manejar el razonamiento temporal y multimodal que desconcierta a la mayoría de los modelos.
2026-07-28
IA Física
El modelo de borde de 4 mil millones de parámetros de Nvidia hace algo que la mayoría de los VLM pequeños no hacen
Cosmos 3 Edge de Nvidia alberga modelado del mundo en 4B parámetros, ocupando el primer lugar en VANTAGE-Bench entre su clase de tamaño. Su diseño de transformador dual combina razonamiento con predicción de acciones en tiempo real para robots, todo desplegable en hardware Jetson y RTX.
2026-07-28
Infraestructura y financiación
La apuesta de 800 millones de dólares de Together AI por las matemáticas de la inferencia abierta
Together AI recaudó 800 millones de dólares con una valoración de 8.300 millones, respaldada por Aramco Ventures, NVIDIA y otros. La compañía afirma que las reservas anuales superaron los 1.150 millones de dólares el último trimestre, impulsadas por clientes como Decagon, Eleven Labs y Cursor, que reportan reducciones de costos de 6 a 20 veces al cambiar a inferencia abierta.
2026-07-27
Razonamiento de pesos abiertos
Nemotron-4 de Nvidia es rápido, abierto y apunta directamente a la brecha entre Llama y GPT
La línea Nemotron-4 de Nvidia desafía a Llama 3.3 y Mistral Large con puntuaciones MMLU competitivas y un ahorro del 30 % en inferencia. La licencia abierta y la estrategia de doble tamaño la posicionan como una alternativa práctica para equipos que ejecutan cargas de trabajo agénticas a escala.
2026-07-25
Modelos abiertos coordinados
Sakana AI integra NVIDIA Nemotron en su sistema de orquestación multiagente Fugu
Sakana AI integra la familia de modelos abiertos Nemotron de NVIDIA en el sistema de orquestación multiagente Fugu. Fugu selecciona y combina dinámicamente modelos especializados. La colaboración pretende demostrar que modelos abiertos coordinados pueden igualar a los sistemas monolíticos de frontera.
2026-07-23
Investigación Agéntica Gobernada
El nuevo científico de IA de Nvidia trabaja sin tocar nunca los datos de los pacientes
Nvidia AI Technology Center presenta NAIS, un sistema de investigación agéntica gobernado que orquesta flujos de trabajo biomédicos de extremo a extremo sobre datos hospitalarios protegidos. En una implementación real de GWAS de hipertensión que involucró a 286,422 individuos, el sistema produjo resultados comparables a análisis dirigidos por expertos, preservando la privacidad y permitiendo la supervisión humana.
2026-07-19
Modelos e Infraestructura de IA
Los nuevos modelos de embedding de Nvidia lideran la clasificación, pero la verdadera historia es el ahorro en costos de agentes
La colección Nemotron 3 Embed de Nvidia reclama el puesto #1 en el benchmark RTEB e introduce variantes de 1B que retienen el 99% de la precisión del modelo de 8B. Los datos de la empresa muestran que una recuperación más sólida reduce los costos downstream de tokens en sistemas de agentes.
2026-07-18
Impulso del mercado
El repunte de la capitalización de mercado de Nvidia señala que la demanda de IA no se está enfriando
La capitalización de mercado de Nvidia superó los 3 billones de dólares mientras la demanda de infraestructura de IA continúa creciendo. El hito subraya que las compras empresariales de GPU se mantienen sólidas a pesar de la creciente competencia de AMD y startups que ofrecen chips de inferencia más baratos.
2026-07-16
reporte especial / IA en el borde
Nvidia DeepStream se vuelve código abierto: qué significa el lanzamiento 9.1 para la IA en el borde
El código fuente completo del SDK de análisis de video DeepStream de Nvidia ya está en GitHub bajo licencias Apache 2.0 y CC-BY-4.0, abriendo el desarrollo de IA en el borde a una audiencia más amplia. La versión 9.1 trae agentes de codificación basados en LLM, integración con Triton Inference Server y repositorios consolidados para pipelines de extremo a extremo.
2026-07-16