Juego de ecosistema
La noticia más grande de Grok 4.5 podría ser cómo fue construido
El Grok 4.5 de xAI ahora está en grok.com, X, iOS, Android, y dentro de Microsoft 365, Google Workspace, GitHub Copilot y Cursor. El modelo, construido con datos de entrenamiento creados por agentes, lidera el benchmark SWE Marathon e introduce una actualización de voz.
Emmanuel Fabrice Omgbwa Yasse Asistido por IA
2026-08-01 · 3 min de lectura

Esta mañana, xAI implementó Grok 4.5 en casi todas las superficies que un desarrollador o profesional toca: grok.com, X, iOS, Android, Microsoft 365, Google Workspace, GitHub Copilot y Cursor. El anuncio se lee como un catálogo de integraciones, cada una agregando Grok a una herramienta familiar. Pero la verdadera historia no es en cuántos lugares se ejecuta el modelo. Es que este modelo fue construido, a escala, por versiones anteriores de sí mismo.
Cursor, que entrenó a Grok 4.5 junto con xAI, reveló que los entornos de entrenamiento fueron construidos por agentes de IA autónomos, no por ingenieros humanos. Un equipo de ingenieros definió tipos de problemas y métodos de verificación; luego los agentes construyeron, probaron y refinaron cada entorno de entrenamiento. Algunos de esos entornos, señala la empresa, habrían requerido meses de trabajo de cientos de ingenieros para crearlos manualmente. El pipeline de aprendizaje por refuerzo luego usó esos entornos para enseñar al modelo razonamiento de múltiples pasos en ingeniería de software, ciencia de datos, finanzas y derecho.
Este bucle de auto-refuerzo es el tipo de avance que tiende a acumularse. Si un modelo puede ayudar a construir la infraestructura de entrenamiento para su sucesor, cada generación tiene el potencial de acelerar la siguiente. xAI no profundizó en este punto en su propio anuncio, pero Cursor lo mencionó explícitamente. El resultado es un modelo que ahora lidera la tabla de clasificación SWE Marathon, aunque por un margen estrecho sobre Claude 4 Opus y GPT-5. El benchmark prueba correcciones de código y adiciones de funciones del mundo real, lo que se alinea con el enfoque de entrenamiento.
El despliegue en sí es inusualmente amplio. Grok 4.5 aparece como el modelo predeterminado en Grok Build, el entorno de codificación dentro del chat de la plataforma. Los complementos para Microsoft Word, Excel, PowerPoint y Outlook permiten a los usuarios hacer preguntas en lenguaje natural, generar fórmulas, resumir hilos y redactar respuestas. Google Workspace recibe un complemento similar para Sheets, Slides y Docs. Los usuarios de GitHub Copilot pueden seleccionar Grok 4.5 desde el selector de modelos en VSCode. La API tiene un precio de $2 por millón de tokens de entrada y $6 por millón de tokens de salida, y la empresa afirma que tiene aproximadamente el doble de eficiencia de tokens que modelos líderes comparables.
Por separado, xAI anunció Grok Voice Think Fast 2.0, un modelo mejorado de voz a voz que obtiene un 82.9% en un índice de calidad general, frente al 75.7% de la versión anterior. Puede razonar las consultas mientras habla, lo que mantiene bajos los tiempos de respuesta. El modelo de voz se convertirá en el predeterminado el 5 de agosto de 2026 y cuesta $0.08 por minuto de audio.
Los flujos de trabajo en Grok Build agregan otra capa: los usuarios describen una tarea en lenguaje natural, y el sistema la distribuye hasta 1,024 agentes en paralelo, verificando resultados y produciendo un solo informe. El comando integrado /deep-research automatiza investigaciones de múltiples fuentes. Estos no son juguetes. Reflejan una estrategia que trata a Grok como una capa de infraestructura, no como una ventana de chat.
La amplitud del lanzamiento hace que sea fácil pasar por alto el titular más silencioso: el modelo que impulsa todas estas integraciones fue producido, en parte, por sus propios predecesores. Ese hecho es más trascendental que cualquier puntuación individual de benchmark. Sugiere un futuro en el que cada nueva generación de modelos ayuda a construir la siguiente, y el trabajo del ingeniero humano pasa de construir datos de entrenamiento a diseñar la lógica de verificación que ejecutan los agentes. Por ahora, Grok 4.5 está en todas partes. La pregunta es cómo será la versión posterior y quién la construye.
Lo esencial de la tecnología en 3 minutos cada mañana
Un correo, cada día laborable, con lo que realmente importa en IA y tecnología.