Contexto 1M
3 published articles
Modelos de IA | NVIDIA Nemotron 3.5 Lightning
Por qué Nemotron 3.5 Lightning apuesta a que la mayoría de los pasos de un agente no necesitan un modelo grande
El nuevo modelo abierto de Nvidia se ejecuta localmente con 3B de parámetros activos y un contexto de 1M de tokens, diseñado para agentes que permanecen en ejecución. Nvidia afirma hasta 4 veces más rendimiento y un 30 % más rápido en la finalización de tareas que los modelos abiertos comparables.
2026-08-14
Lanzamiento de modelo
Anthropic presenta Claude Sonnet 5: un modelo de razonamiento híbrido para agentes en tiempo real y trabajos de alto volumen
Claude Sonnet 5 de Anthropic ofrece razonamiento híbrido con una ventana de contexto de 1M, destacándose en codificación, flujos de trabajo de agentes y tareas empresariales. Disponible a un precio introductorio de $2 por millón de tokens de entrada, promete comprimir proyectos de codificación de varios días en horas.
2026-07-09
Laboratorios de IA e Investigación
MiniMax M3 acaba de escribir su propio kernel CUDA y abrió el código
MiniMax M3 obtiene 83.5 en BrowseComp, supera a Opus 4.7 por 4.7 puntos y maneja hasta 1 millón de tokens de forma nativa. En una prueba de autonomía notable, auto-optimizó un kernel de GPU desde un 7.6% hasta un 71.3% de utilización máxima sin intervención humana.
2026-07-09