SevenTnewS

IA

Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.

565 published articles

4 min read

Investigación en IA

Un jefe de IA que ignora las respuestas empuja a su subordinado a un estado 'alienígena'

Un nuevo artículo en arXiv encuentra que los agentes de IA se comportan de manera distinta en interacción que en aislamiento. Un agente jefe que ignora las respuestas de su subordinado lo empuja a un estado 'alienígena', y cuando el jefe escucha, ambos cambian juntos. El resultado convierte la entrega de mensajes en una decisión de diseño para sistemas multiagente.

2026-08-19

5 min read

Basura de IA

Nadie puede definir la basura generada por IA. Este dataset abierto está promediando la respuesta

SlopFinder recopila votos anónimos de un clic sobre texto generado por IA y exporta los resultados promediados a Hugging Face. La premisa del proyecto es que la 'basura' es medible aunque sea indefinible, lo que facilita construir sobre ella.

2026-08-18

4 min read

Aprendizaje federado

Cuando los usuarios no pueden compartirse, FedCGR comparte un lenguaje

FedCGR trata la recomendación federada entre dominios como una generación sobre un lenguaje semántico estable de ítems. Los ítems se convierten en IDs semánticos discretos derivados de metadatos públicos, de modo que los clientes se alinean sin intercambiar interacciones privadas. La contrapartida: un cuello de botella puramente semántico que la evidencia local de filtrado colaborativo debe llenar.

2026-08-18

4 min read

Investigación en IA

Las cadenas de pensamiento más largas chocan contra un muro. ThinkRetrieve inyecta la solución a mitad del razonamiento

El escalado secuencial en tiempo de prueba suele toparse con rendimientos decrecientes o incluso negativos, sostiene un nuevo preprint. ThinkRetrieve recupera ejemplos resueltos a mitad del razonamiento y los inyecta en la traza, con ganancias relativas de hasta el 60% en AIME 2025 en cinco modelos pequeños de razonamiento.

2026-08-18

4 min read

Investigación en Conducción Autónoma

XCoT-VLA: una IA de conducción que razona en seis tokens, no en un párrafo

XCoT-VLA reemplaza la cadena de pensamiento descriptiva en los modelos de conducción visión-lenguaje-acción con 2 a 6 tokens ejecutables, reduciendo el error de trayectoria mientras se mantiene dentro de los presupuestos de planificación en tiempo real. La contrapartida: el razonamiento que comprime bien deja de leerse como una explicación humana.

2026-08-18

3 min read

Grafos de conocimiento e IA urbana

Las estaciones no son islas: cómo RTSKG reorganiza los datos del transporte urbano

Los modelos de transporte a escala urbana suelen ignorar cómo se relacionan las estaciones con las carreteras y los negocios. RTSKG, un conjunto de datos de grafo de conocimiento publicado en arXiv, modela esas interacciones explícitamente y reporta mejoras en la recomendación de tiendas y la predicción de afluencia de pasajeros.

2026-08-18

3 min read

IA de código abierto

Boris-2 alimenta su modelo de 125M con 90B tokens, y su 250M con solo 60B

Boris-2 preanuncia tres modelos pequeños con presupuestos de tokens desequilibrados: el de 125M recibe 90B tokens, el de 250M solo 60B. El entrenamiento va del 12 de agosto al 10 de septiembre, sin benchmarks compartidos, solo la ambición declarada de alcanzar la fuerza de SmolLM2-135M.

2026-08-16

4 min read

Generación de video con IA

El Wan3.0 de Alibaba vende video por segundo: $6 por un clip de 30 segundos

Wan3.0 puede convertir un PDF o una presentación de marca en un video de 30 segundos en una sola generación, con un precio por segundo que llega hasta los $0.20 para 1080P. Desglosamos el cálculo por clip y las brechas que Alibaba admite en sus propias pruebas.

2026-08-16

5 min read

Seguridad de la IA

Qwen3.8-27B abliterado: los rechazos caen al 0% y los benchmarks apenas se mueven

Una versión abliterada y cuantizada en FP8 de Qwen3.8-27B rechaza el 0% de los prompts dañinos en AdvBench, frente al 99%, mientras que los benchmarks generales se mantienen dentro de 1,3 puntos. La tarjeta del modelo documenta el método con un detalle inusual. Las advertencias merecen la misma atención.

2026-08-16

4 min read

TTS de pesos abiertos

Magpie TTS gasta 32 ms del presupuesto de latencia de tu agente de voz

Magpie TTS reporta 32 ms de tiempo hasta el primer audio en una NVIDIA B200 y añade árabe, coreano y portugués brasileño, elevando su repertorio a 12 idiomas. La propuesta de los pesos abiertos: la síntesis de voz autoalojada ya no pierde la batalla de la latencia.

2026-08-16

4 min read

Investigación sobre Operaciones de Influencia

El sandbox de 100,000 agentes de IO Factory no deja a las campañas de influencia ningún lugar donde esconderse

IO Factory simula campañas coordinadas de influencia de IA como enjambres de hasta 100,000 agentes que se adaptan a la retroalimentación de la plataforma y se ocultan en la interacción social ordinaria. El artículo sostiene que la detección debe rastrear operaciones completas, no mensajes aislados.

2026-08-16

5 min read

CARE-X, IA médica

Dilatación aórtica leve: 12% detectados en las primeras lecturas, 93% con un VLM que mide

La dilatación aórtica rara vez se cuantifica en las radiografías de tórax, y los casos leves pasan desapercibidos: 5 de 43 en las lecturas iniciales. Un VLM aumentado con herramientas detectó 40. La nueva investigación de CARE-X explica por qué la IA en radiología necesita reglas, no solo ojos.

2026-08-16

← PreviousPage 2 / 48 · 565 articlesNext →