SevenTnewS

PLN y ML

Procesamiento del lenguaje natural, aprendizaje automático y aprendizaje profundo.

15 published articles

4 min read

Aprendizaje federado

Cuando los usuarios no pueden compartirse, FedCGR comparte un lenguaje

FedCGR trata la recomendación federada entre dominios como una generación sobre un lenguaje semántico estable de ítems. Los ítems se convierten en IDs semánticos discretos derivados de metadatos públicos, de modo que los clientes se alinean sin intercambiar interacciones privadas. La contrapartida: un cuello de botella puramente semántico que la evidencia local de filtrado colaborativo debe llenar.

2026-08-18

3 min read

Grafos de conocimiento e IA urbana

Las estaciones no son islas: cómo RTSKG reorganiza los datos del transporte urbano

Los modelos de transporte a escala urbana suelen ignorar cómo se relacionan las estaciones con las carreteras y los negocios. RTSKG, un conjunto de datos de grafo de conocimiento publicado en arXiv, modela esas interacciones explícitamente y reporta mejoras en la recomendación de tiendas y la predicción de afluencia de pasajeros.

2026-08-18

3 min read

Investigación sobre RAG

BM25 supera al RAG agéntico cuando los corpus superan los 10 millones de tokens

La búsqueda agéntica gana en corpus pequeños, pero un estudio de muset-ai en 28 niveles anidados muestra que BM25 la supera cerca de los 10 millones de tokens. El agente consume 39 veces más tokens de consulta y el RAG gráfico se estanca en la construcción.

2026-08-07

4 min read

Investigación en IA

Voice Memory: un archivo de 776 bytes que le dice al reconocimiento de voz cuándo no hacer nada

Un nuevo esquema de solo inferencia para el reconocimiento de voz aprende a contenerse: un corrector congelado lee un archivo de memoria por dominio y decide cuándo abstenerse. La corrección sin restricciones rompe tokens correctos en hasta el 64 % de las ediciones; Voice Memory lo reduce al 35 % y baja el WER ponderado del 8,36 % al 7,52 %.

2026-08-06

3 min read

Investigación

La memoria compartida tiene doble filo: escalar algoritmos actor-crítico más allá de cinco agentes muestra rendimientos decrecientes

Investigadores compartieron búferes de reproducción entre agentes actor-crítico en tareas de acciones parametrizadas. GAC saltó en rendimiento, pero SAC y TQC solo avanzaron lentamente. Más allá de cinco agentes, el costo computacional se dispara sin un retorno significativo. El artículo ofrece un límite práctico sobre hasta dónde pueden estirarse los métodos de experiencia compartida antes de estancarse.

2026-07-27

6 min read

IA y Neurociencia

Las neuronas revueltas de un modelo de lenguaje acaban de recrear los efectos de un derrame cerebral en el habla

Investigadores perturbaron LLaVA 1.6 para simular errores de denominación de imágenes afásicos y coincidieron con perfiles de pacientes individuales en hasta siete categorías de error en el 79.5% de los casos. Seis de los siete tipos de error surgieron de forma natural en diferentes configuraciones de perturbación, lo que sugiere que los modelos multimodales de uso general pueden funcionar como gemelos digitales para los déficits del lenguaje posteriores a un accidente cerebrovascular.

2026-07-24

6 min read

IA Encarnada

El cerebro robótico de Xiaomi es de código abierto y cuenta con 38 mil millones de parámetros. Eso cambia el cuello de botella de los datos

Con un modelo de 38 mil millones de parámetros que unifica cuatro tareas robóticas y abre todo el proceso, Xiaomi busca romper el cuello de botella de datos en la IA encarnada. Los primeros benchmarks muestran una mejora del 26% en las tasas de finalización de tareas al entrenar con datos aumentados por el modelo.

2026-07-15

Featured4 min read

IA Física

El Qwen de Alibaba es ahora el cerebro dentro de 150.000 robots, coches, gafas y drones

La familia de IA Qwen de Alibaba ahora impulsa más de 150.000 dispositivos hardware, desde robots humanoides hasta cámaras infantiles, mientras la empresa gira de los chatbots a la IA Física, integrando modelos multimodales en robots, coches, gafas y drones.

2026-07-14

Featured4 min read

Investigación en IA

Por qué GPT-5.5 domina un benchmark que prueba cómo los agentes se mejoran a sí mismos

EvoPolicyGym aísla una capacidad crítica pero poco estudiada: la capacidad de un agente para refinar una política ejecutable mediante ediciones repetidas con retroalimentación limitada. El benchmark revela a GPT-5.5 como el mejor intérprete en 16 entornos, y proporciona diagnósticos a nivel de trayectoria que exponen cómo diferentes agentes asignan presupuesto y convierten la retroalimentación en parámetros ajustados.

2026-07-11

5 min read

Gestión de memoria

El secreto de 12.000 líneas detrás de la velocidad de Bing: cómo mimalloc venció la compensación del asignador de memoria

El asignador mimalloc de Microsoft Research utiliza miles de listas libres por página y una ingeniosa técnica de robo de páginas para lograr tanto alta concurrencia como baja sobrecarga de memoria, según detalla el grupo RiSE en un nuevo blog técnico.

2026-07-10

5 min read

Historia del PLN

El benchmark que hizo hablar a los modelos de lenguaje: cómo GLUE de 2018 cambió la IA para siempre

El benchmark GLUE, lanzado en 2018, transformó el procesamiento del lenguaje natural al proporcionar un estándar unificado para la comprensión del lenguaje. Su legado perdura en cada benchmark moderno de LLM, desde SuperGLUE hasta las últimas evaluaciones en formato de arena que definen la carrera actual de la IA.

2026-07-08

2 min read

Investigación en Aprendizaje Automático

Fast-LeWM: Predicción Paralela de Prefijos de Acción Reduce los Costos de Planificación en Modelos de Mundo Latentes

Investigadores presentan Fast-LeWM, un modelo de mundo latente que acelera la planificación visual al predecir estados futuros a partir de prefijos de acción en paralelo. El enfoque reduce los costos computacionales y la acumulación de errores, superando a modelos previos de transición de un solo paso.

2026-07-07

← PreviousPage 1 / 2 · 15 articlesNext →