SevenTnewS

Investigación en IA

18 published articles

IAFeatured3 min read

Investigación en IA

El ruidoso truco que evita que los agentes LLM colapsen en producción

Los agentes LLM actuales se desmoronan ante la aleatoriedad del mundo real. NoisyAgent los expone a ruido controlado durante el entrenamiento, mejorando tanto la robustez como el rendimiento general en benchmarks. El artículo sugiere que el campo ha estado sobreajustándose a condiciones prístinas.

2026-07-17

LLMs y Modelos4 min read

Inteligencia Artificial

Alibaba acaba de publicar como código abierto un modelo mundial que permite entrenar agentes de IA dentro de un simulador

El equipo Qwen de Alibaba lanzó Qwen-AgentWorld, un modelo mundial de lenguaje que simula entornos de agente en siete dominios. Su proceso de tres etapas, CPT, SFT, RL, produce un simulador que supera a GPT-5.4 en fidelidad y permite a los agentes entrenarse mediante ensayo mental en lugar de costosos despliegues en entornos reales.

2026-07-16

Código Abierto4 min read

Código Abierto

Ai2 abrió todos los cajones del gabinete de IA, esto es lo que hay dentro

Ai2 lanza Olmo 3, una familia de modelos completamente abiertos de 7B a 32B, que incluye datos de entrenamiento, código y herramientas. El lanzamiento enfatiza la transparencia en todo el ciclo de vida del modelo, desde los datos de preentrenamiento hasta los pipelines de postentrenamiento, estableciendo un nuevo estándar para la investigación abierta en IA.

2026-07-11

IA5 min read

Razonamiento Matemático

El equipo de M3 encontró una forma de evitar que los verificadores de matemáticas de IA hicieran trampa, y es un modelo para todos los laboratorios

El enfoque de M3 para el razonamiento matemático combina tres modelos expertos: Prueba, Verificador y Corrección, con un marco de búsqueda evolutiva. El relato ofrece detalles poco comunes sobre el hackeo de recompensas, la alineación del verificador y la ingeniería necesaria para hacer que los verificadores generativos sean confiables en tareas de razonamiento de alto riesgo.

2026-07-11

Laboratorios e Investigación4 min read

Analizando un preprint reciente

Lo que el artículo 2606.23050, de solo cinco días, nos dice sobre el futuro de la IA

Un preprint de 33 páginas, el artículo 2606.23050, publicado hace solo cinco días, marca una contribución seria a la investigación en IA. Este artículo desglosa su metodología, hallazgos clave y lo que señala para la trayectoria del aprendizaje automático y el procesamiento del lenguaje natural.

2026-07-07

Código Abierto3 min read

Innovación en código abierto

El Moon Bot de Hugging Face convierte Slack en un agente de codificación, y eso es solo esta semana

Moon Bot lleva la asistencia de codificación con IA directamente a los flujos de trabajo de Slack, mientras que VLX-Flow y VLX-Seek abordan la comprensión de video en tiempo real y la percepción de grano fino. Otros aspectos destacados incluyen una receta de preentrenamiento de codificadores médicos, experimentos de destilación QLORA en Qwen y un punto de referencia extraterrestre para el aprendizaje automático.

2026-06-29

← PreviousPage 7 / 2 · 18 articlesNext →