Pruebas y BenchmarksFeatured3 min read
Codificación agéntica
Cómo Grok 4.5 se adelantó en el SWE Marathon, y qué significa para los agentes de codificación
Grok 4.5 ahora lidera la tabla de clasificación de SWE Marathon, superando a Claude 4 Opus y GPT-5. El referente evalúa habilidades reales de ingeniería de software: corrección de errores, adición de funciones y comprensión de código en repositorios reales. El resultado redefine el panorama competitivo de los agentes de codificación de IA.
2026-07-20