SevenTnewS

IA

Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.

565 published articles

3 min read

Juego de ecosistema

La noticia más grande de Grok 4.5 podría ser cómo fue construido

El Grok 4.5 de xAI ahora está en grok.com, X, iOS, Android, y dentro de Microsoft 365, Google Workspace, GitHub Copilot y Cursor. El modelo, construido con datos de entrenamiento creados por agentes, lidera el benchmark SWE Marathon e introduce una actualización de voz.

2026-08-01

3 min read

IA industrial

AgentRCA: análisis de causa raíz zero-shot que explica su propio razonamiento

Un framework agéntico zero-shot llamado AgentRCA utiliza un gemelo digital y un LLM para diagnosticar fallos en plantas sin datos etiquetados, logrando una precisión a nivel supervisado con total transparencia.

2026-08-01

3 min read

IA y Robótica

El entrenamiento de robots quirúrgicos se vuelve más rápido: Cosmos-H-Dreams de Nvidia funciona a 160 fps

Cosmos-H-Dreams de Nvidia convierte la simulación quirúrgica en una experiencia interactiva en tiempo real. Funcionando a 160 fps en una sola GPU, permite a cirujanos, aprendices y políticas de IA practicar dentro de un bucle cerrado de video generado sin necesidad de un robot físico.

2026-08-01

3 min read

Modelos Fundacionales de Grafos

La transferencia zero-shot en grafos tiene un punto ciego multimodal. CHARM ofrece una solución

CHARM reemplaza las características aisladas de los nodos con contextos de grafos estructurados que capturan semántica multimodal y relaciones entre modalidades. Al mapear patrones específicos de dominio a conceptos compartidos de alto nivel, el modelo logra transferencia zero-shot a través de grafos con texto, imágenes y otras modalidades.

2026-08-01

3 min read

IA empresarial

Claude de Anthropic encuentra su puente empresarial: 30,000 ingenieros de Cognizant

A medida que la capacidad de la IA supera la adopción empresarial, Cognizant amplía su asociación con Anthropic, capacitando a 30,000 empleados en Claude y generando ganancias de productividad medibles, como revisiones de contratos un 40% más rápidas y un ahorro semanal de ocho horas para los suscriptores. El acuerdo señala una estrategia para integrar la IA de frontera a través de los sistemas empresariales existentes.

2026-08-01

Featured3 min read

Integridad de la IA

El pipeline de IA tiene tres fugas silenciosas, y cada solución empeora una de ellas

Un estudio de envenenamiento por spam de comentarios, un artículo que muestra que los detectores de IA pueden resultar contraproducentes, y un modelo de detección de fraude atrapado explotando la fuga de etiquetas describen la misma falla subyacente: las medidas proxy en los pipelines de IA se manipulan en el momento en que se vuelven portantes, y arreglar una no arregla el patrón.

2026-07-31

Featured2 min read

Herramientas para desarrolladores

Nadie lanzó un avance esta semana. Esa es la noticia real.

La corrección de errores de xAI, la apertura de Xcode a modelos rivales de IA por parte de Apple, y la renovación de Bruno con su propia clave omiten características llamativas en favor de la fiabilidad y la confianza en los datos. Juntos indican que el mercado de herramientas de desarrollo de IA está pasando de una carrera de funciones a una carrera de confianza.

2026-07-31

3 min read

IA de investigación profunda

El nuevo agente de investigación de BAAI no solo busca más tiempo, sino que revisa su propia tarea

Los agentes AREX de BAAI utilizan un bucle de auto-mejora recursiva que comprime historiales de investigación largos, permitiendo un refinamiento eficiente impulsado por la verificación. Entrenados con una novedosa receta de RL de horizonte largo, superan a las líneas base comparables en BrowseComp, DeepSearchQA y HLE.

2026-07-31

3 min read

Razonamiento 3D

SceneActBench: Por qué incluso los mejores VLM fallan en acciones 3D

SceneActBench evalúa once configuraciones de VLM en cinco tareas 3D en un bucle de agente unificado. Las puntuaciones generales van de 38.6 a 50.2, sin que ningún modelo se desempeñe de manera consistente. El benchmark expone un punto ciego en los agentes de visión-lenguaje: actuar en escenas completas, no solo describirlas.

2026-07-31

4 min read

Pruebas de juego automatizadas

El gráfico que venció a la cuadrícula: por qué los modelos GAT ganan en las pruebas de juego de Candy Crush

Investigadores compararon modelos GAT, BERT y CNN para pruebas de juego automatizadas en Candy Crush Saga. Los modelos GAT igualaron o superaron a las CNN en predicción de movimientos y estimación de dificultad, especialmente en niveles difíciles, además de manejar nuevas mecánicas de juego sin ingeniería de características.

2026-07-31

3 min read

MÚSICA CON IA

El truco de priorizar la melodía que permite a Qwen-Music vencer a Suno en 13 métricas

Qwen-Music separa la planificación de la melodía de la generación completa de canciones mediante Melody-CoT. El modelo de 3 mil millones de parámetros, entrenado con más de 5 millones de horas de datos multilingües, logra resultados de última generación frente a Suno V5 y MiniMax Music 2.6 tanto en métricas objetivas como en preferencia humana.

2026-07-31

2 min read

Investigación en IA Médica

Un modelo de 4 mil millones de parámetros aborda datos clínicos irregulares con respuestas en 0.15 segundos

ClinPRISM es un marco de razonamiento multimodal LLM rentable diseñado para responder preguntas sobre series temporales clínicas irregulares. Usando solo 16 tokens y una base de 4 mil millones de parámetros, alcanza un rendimiento de vanguardia con una latencia promedio de 0.15 segundos por pregunta.

2026-07-31

← PreviousPage 11 / 48 · 565 articlesNext →