IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
565 published articles
Juego de ecosistema
La noticia más grande de Grok 4.5 podría ser cómo fue construido
El Grok 4.5 de xAI ahora está en grok.com, X, iOS, Android, y dentro de Microsoft 365, Google Workspace, GitHub Copilot y Cursor. El modelo, construido con datos de entrenamiento creados por agentes, lidera el benchmark SWE Marathon e introduce una actualización de voz.
2026-08-01
IA industrial
AgentRCA: análisis de causa raíz zero-shot que explica su propio razonamiento
Un framework agéntico zero-shot llamado AgentRCA utiliza un gemelo digital y un LLM para diagnosticar fallos en plantas sin datos etiquetados, logrando una precisión a nivel supervisado con total transparencia.
2026-08-01
IA y Robótica
El entrenamiento de robots quirúrgicos se vuelve más rápido: Cosmos-H-Dreams de Nvidia funciona a 160 fps
Cosmos-H-Dreams de Nvidia convierte la simulación quirúrgica en una experiencia interactiva en tiempo real. Funcionando a 160 fps en una sola GPU, permite a cirujanos, aprendices y políticas de IA practicar dentro de un bucle cerrado de video generado sin necesidad de un robot físico.
2026-08-01
Modelos Fundacionales de Grafos
La transferencia zero-shot en grafos tiene un punto ciego multimodal. CHARM ofrece una solución
CHARM reemplaza las características aisladas de los nodos con contextos de grafos estructurados que capturan semántica multimodal y relaciones entre modalidades. Al mapear patrones específicos de dominio a conceptos compartidos de alto nivel, el modelo logra transferencia zero-shot a través de grafos con texto, imágenes y otras modalidades.
2026-08-01
IA empresarial
Claude de Anthropic encuentra su puente empresarial: 30,000 ingenieros de Cognizant
A medida que la capacidad de la IA supera la adopción empresarial, Cognizant amplía su asociación con Anthropic, capacitando a 30,000 empleados en Claude y generando ganancias de productividad medibles, como revisiones de contratos un 40% más rápidas y un ahorro semanal de ocho horas para los suscriptores. El acuerdo señala una estrategia para integrar la IA de frontera a través de los sistemas empresariales existentes.
2026-08-01
Integridad de la IA
El pipeline de IA tiene tres fugas silenciosas, y cada solución empeora una de ellas
Un estudio de envenenamiento por spam de comentarios, un artículo que muestra que los detectores de IA pueden resultar contraproducentes, y un modelo de detección de fraude atrapado explotando la fuga de etiquetas describen la misma falla subyacente: las medidas proxy en los pipelines de IA se manipulan en el momento en que se vuelven portantes, y arreglar una no arregla el patrón.
2026-07-31
Herramientas para desarrolladores
Nadie lanzó un avance esta semana. Esa es la noticia real.
La corrección de errores de xAI, la apertura de Xcode a modelos rivales de IA por parte de Apple, y la renovación de Bruno con su propia clave omiten características llamativas en favor de la fiabilidad y la confianza en los datos. Juntos indican que el mercado de herramientas de desarrollo de IA está pasando de una carrera de funciones a una carrera de confianza.
2026-07-31
IA de investigación profunda
El nuevo agente de investigación de BAAI no solo busca más tiempo, sino que revisa su propia tarea
Los agentes AREX de BAAI utilizan un bucle de auto-mejora recursiva que comprime historiales de investigación largos, permitiendo un refinamiento eficiente impulsado por la verificación. Entrenados con una novedosa receta de RL de horizonte largo, superan a las líneas base comparables en BrowseComp, DeepSearchQA y HLE.
2026-07-31
Razonamiento 3D
SceneActBench: Por qué incluso los mejores VLM fallan en acciones 3D
SceneActBench evalúa once configuraciones de VLM en cinco tareas 3D en un bucle de agente unificado. Las puntuaciones generales van de 38.6 a 50.2, sin que ningún modelo se desempeñe de manera consistente. El benchmark expone un punto ciego en los agentes de visión-lenguaje: actuar en escenas completas, no solo describirlas.
2026-07-31
Pruebas de juego automatizadas
El gráfico que venció a la cuadrícula: por qué los modelos GAT ganan en las pruebas de juego de Candy Crush
Investigadores compararon modelos GAT, BERT y CNN para pruebas de juego automatizadas en Candy Crush Saga. Los modelos GAT igualaron o superaron a las CNN en predicción de movimientos y estimación de dificultad, especialmente en niveles difíciles, además de manejar nuevas mecánicas de juego sin ingeniería de características.
2026-07-31
MÚSICA CON IA
El truco de priorizar la melodía que permite a Qwen-Music vencer a Suno en 13 métricas
Qwen-Music separa la planificación de la melodía de la generación completa de canciones mediante Melody-CoT. El modelo de 3 mil millones de parámetros, entrenado con más de 5 millones de horas de datos multilingües, logra resultados de última generación frente a Suno V5 y MiniMax Music 2.6 tanto en métricas objetivas como en preferencia humana.
2026-07-31
Investigación en IA Médica
Un modelo de 4 mil millones de parámetros aborda datos clínicos irregulares con respuestas en 0.15 segundos
ClinPRISM es un marco de razonamiento multimodal LLM rentable diseñado para responder preguntas sobre series temporales clínicas irregulares. Usando solo 16 tokens y una base de 4 mil millones de parámetros, alcanza un rendimiento de vanguardia con una latencia promedio de 0.15 segundos por pregunta.
2026-07-31