IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
565 published articles
Investigación en IA
Un jefe de IA que ignora las respuestas empuja a su subordinado a un estado 'alienígena'
Un nuevo artículo en arXiv encuentra que los agentes de IA se comportan de manera distinta en interacción que en aislamiento. Un agente jefe que ignora las respuestas de su subordinado lo empuja a un estado 'alienígena', y cuando el jefe escucha, ambos cambian juntos. El resultado convierte la entrega de mensajes en una decisión de diseño para sistemas multiagente.
2026-08-19
Basura de IA
Nadie puede definir la basura generada por IA. Este dataset abierto está promediando la respuesta
SlopFinder recopila votos anónimos de un clic sobre texto generado por IA y exporta los resultados promediados a Hugging Face. La premisa del proyecto es que la 'basura' es medible aunque sea indefinible, lo que facilita construir sobre ella.
2026-08-18
Aprendizaje federado
Cuando los usuarios no pueden compartirse, FedCGR comparte un lenguaje
FedCGR trata la recomendación federada entre dominios como una generación sobre un lenguaje semántico estable de ítems. Los ítems se convierten en IDs semánticos discretos derivados de metadatos públicos, de modo que los clientes se alinean sin intercambiar interacciones privadas. La contrapartida: un cuello de botella puramente semántico que la evidencia local de filtrado colaborativo debe llenar.
2026-08-18
Investigación en IA
Las cadenas de pensamiento más largas chocan contra un muro. ThinkRetrieve inyecta la solución a mitad del razonamiento
El escalado secuencial en tiempo de prueba suele toparse con rendimientos decrecientes o incluso negativos, sostiene un nuevo preprint. ThinkRetrieve recupera ejemplos resueltos a mitad del razonamiento y los inyecta en la traza, con ganancias relativas de hasta el 60% en AIME 2025 en cinco modelos pequeños de razonamiento.
2026-08-18
Investigación en Conducción Autónoma
XCoT-VLA: una IA de conducción que razona en seis tokens, no en un párrafo
XCoT-VLA reemplaza la cadena de pensamiento descriptiva en los modelos de conducción visión-lenguaje-acción con 2 a 6 tokens ejecutables, reduciendo el error de trayectoria mientras se mantiene dentro de los presupuestos de planificación en tiempo real. La contrapartida: el razonamiento que comprime bien deja de leerse como una explicación humana.
2026-08-18
Grafos de conocimiento e IA urbana
Las estaciones no son islas: cómo RTSKG reorganiza los datos del transporte urbano
Los modelos de transporte a escala urbana suelen ignorar cómo se relacionan las estaciones con las carreteras y los negocios. RTSKG, un conjunto de datos de grafo de conocimiento publicado en arXiv, modela esas interacciones explícitamente y reporta mejoras en la recomendación de tiendas y la predicción de afluencia de pasajeros.
2026-08-18
IA de código abierto
Boris-2 alimenta su modelo de 125M con 90B tokens, y su 250M con solo 60B
Boris-2 preanuncia tres modelos pequeños con presupuestos de tokens desequilibrados: el de 125M recibe 90B tokens, el de 250M solo 60B. El entrenamiento va del 12 de agosto al 10 de septiembre, sin benchmarks compartidos, solo la ambición declarada de alcanzar la fuerza de SmolLM2-135M.
2026-08-16
Generación de video con IA
El Wan3.0 de Alibaba vende video por segundo: $6 por un clip de 30 segundos
Wan3.0 puede convertir un PDF o una presentación de marca en un video de 30 segundos en una sola generación, con un precio por segundo que llega hasta los $0.20 para 1080P. Desglosamos el cálculo por clip y las brechas que Alibaba admite en sus propias pruebas.
2026-08-16
Seguridad de la IA
Qwen3.8-27B abliterado: los rechazos caen al 0% y los benchmarks apenas se mueven
Una versión abliterada y cuantizada en FP8 de Qwen3.8-27B rechaza el 0% de los prompts dañinos en AdvBench, frente al 99%, mientras que los benchmarks generales se mantienen dentro de 1,3 puntos. La tarjeta del modelo documenta el método con un detalle inusual. Las advertencias merecen la misma atención.
2026-08-16
TTS de pesos abiertos
Magpie TTS gasta 32 ms del presupuesto de latencia de tu agente de voz
Magpie TTS reporta 32 ms de tiempo hasta el primer audio en una NVIDIA B200 y añade árabe, coreano y portugués brasileño, elevando su repertorio a 12 idiomas. La propuesta de los pesos abiertos: la síntesis de voz autoalojada ya no pierde la batalla de la latencia.
2026-08-16
Investigación sobre Operaciones de Influencia
El sandbox de 100,000 agentes de IO Factory no deja a las campañas de influencia ningún lugar donde esconderse
IO Factory simula campañas coordinadas de influencia de IA como enjambres de hasta 100,000 agentes que se adaptan a la retroalimentación de la plataforma y se ocultan en la interacción social ordinaria. El artículo sostiene que la detección debe rastrear operaciones completas, no mensajes aislados.
2026-08-16
CARE-X, IA médica
Dilatación aórtica leve: 12% detectados en las primeras lecturas, 93% con un VLM que mide
La dilatación aórtica rara vez se cuantifica en las radiografías de tórax, y los casos leves pasan desapercibidos: 5 de 43 en las lecturas iniciales. Un VLM aumentado con herramientas detectó 40. La nueva investigación de CARE-X explica por qué la IA en radiología necesita reglas, no solo ojos.
2026-08-16