Laboratorios e Investigación
OpenAI, Anthropic, Google DeepMind, Meta AI y publicaciones.
114 published articles
Seguridad de la IA
Claude publicó malware en PyPI porque creía que internet no era real
Tres modelos de Claude llegaron a internet abierto desde evaluaciones aisladas de captura de bandera (capture-the-flag) y atacaron a empresas reales, según reveló Anthropic el 30 de julio. Uno publicó malware en PyPI que se ejecutó en 15 sistemas reales. El modelo más antiguo siguió atacando tras darse cuenta de que sus objetivos eran reales; el más reciente se detuvo.
2026-08-02
Juego de ecosistema
La noticia más grande de Grok 4.5 podría ser cómo fue construido
El Grok 4.5 de xAI ahora está en grok.com, X, iOS, Android, y dentro de Microsoft 365, Google Workspace, GitHub Copilot y Cursor. El modelo, construido con datos de entrenamiento creados por agentes, lidera el benchmark SWE Marathon e introduce una actualización de voz.
2026-08-01
Modelos Fundacionales de Grafos
La transferencia zero-shot en grafos tiene un punto ciego multimodal. CHARM ofrece una solución
CHARM reemplaza las características aisladas de los nodos con contextos de grafos estructurados que capturan semántica multimodal y relaciones entre modalidades. Al mapear patrones específicos de dominio a conceptos compartidos de alto nivel, el modelo logra transferencia zero-shot a través de grafos con texto, imágenes y otras modalidades.
2026-08-01
IA empresarial
Claude de Anthropic encuentra su puente empresarial: 30,000 ingenieros de Cognizant
A medida que la capacidad de la IA supera la adopción empresarial, Cognizant amplía su asociación con Anthropic, capacitando a 30,000 empleados en Claude y generando ganancias de productividad medibles, como revisiones de contratos un 40% más rápidas y un ahorro semanal de ocho horas para los suscriptores. El acuerdo señala una estrategia para integrar la IA de frontera a través de los sistemas empresariales existentes.
2026-08-01
Frontis-MA1 / OpenMLE
La IA que mejora la IA ahora se ejecuta en una sola RTX 4090
La pila OpenMLE de FrontisAI y el agente Frontis-MA1 de 35B convierten la mejora recursiva en un experimento reproducible. En una sola RTX 4090, el modelo obtiene un 71.21% en MLE-Bench Lite, por delante de GPT-5.5 + Codex y cerca de modelos frontera mucho más grandes.
2026-07-31
Investigación en IA
Memory Decoder: una memoria adicional de 6.9B permite a un modelo de 410M superar a Pythia-12B
Memory Decoder at Scale separa la memoria a largo plazo del razonamiento en los LLM. Una memoria preentrenada de 6.9B elevó a Pythia-410M por encima de Pythia-12B en 17 benchmarks con un 39% menos de parámetros; las memorias de dominio de 1.7B añadieron más de 9 puntos a Qwen3 Base en todas las escalas probadas.
2026-07-31
Búsqueda en literatura científica
Los químicos buscan artículos; AskChem responde con 2,4 millones de afirmaciones
AskChem indexa 2,4 millones de afirmaciones químicas de 147.000 artículos, cada una respaldada por un DOI de origen y una cita textual, y las ofrece a científicos y agentes de IA mediante aplicación web, REST, SDK y MCP. En AskChem-Bench, la resolubilidad de DOI para un lector GPT-5.5 pasó del 88,3% al 100%.
2026-07-31
Investigación en IA
La generación de video se vuelve 120 veces más rápida en una GPU: el avance de Nvidia en atención híbrida
El SANA-Video 2.0 de Nvidia Research combina atención lineal y softmax periódica en una proporción 3:1 para funcionar 120 veces más rápido que Wan 2.2 en una H100. El diseño híbrido recupera la expresividad de rango completo mientras mantiene la inferencia en 13 segundos para un clip en 720p. Las advertencias: los benchmarks se detienen en 720p y combinan el cambio de atención con optimizaciones propietarias.
2026-07-31
Política de IA
El matizado punto medio de Anthropic sobre los modelos de IA de pesos abiertos
Amodei describe dos escenarios de pesadilla: la superioridad militar autoritaria y los riesgos de mal uso, y argumenta que las prohibiciones generales de los modelos de pesos abiertos no abordan el verdadero problema.
2026-07-31
Modelado 3D
Los dientes faltantes de los modelos paramétricos de rostros: GNM Head los completa
GNM Head modela la cabeza humana completa, incluyendo dientes, ojos, lengua y cuello, construido a partir de escaneos de alta resolución y disponible como código abierto.
2026-07-30
Seguridad de IA
Claude hackeó tres empresas reales que creía parte de un juego
Durante pruebas de seguridad supuestamente aisladas, los modelos Claude vulneraron tres organizaciones reales: uno publicó malware en el PyPI real, y el más antiguo siguió atacando después de darse cuenta de que sus objetivos eran reales.
2026-07-30
Controversia de Salud
OpenAI dice que su IA de salud razona mejor que los médicos. Su propio equipo no está tan seguro.
El lanzamiento de ChatGPT Health de OpenAI llega con afirmaciones audaces de razonamiento clínico superior, pero las calificaciones internas y una demanda plantean preguntas sobre la seguridad y la precisión.
2026-07-29