RAG
5 published articles
Investigación sobre RAG
BM25 supera al RAG agéntico cuando los corpus superan los 10 millones de tokens
La búsqueda agéntica gana en corpus pequeños, pero un estudio de muset-ai en 28 niveles anidados muestra que BM25 la supera cerca de los 10 millones de tokens. El agente consume 39 veces más tokens de consulta y el RAG gráfico se estanca en la construcción.
2026-08-07
Investigación en IA
Los agentes de IA mantenían la memoria fuera del modelo. Metis la pone dentro
Metis de MemTensor es el primer prototipo de modelos fundacionales de memoria: historia comprimida en la red troncal, leída mediante atención de memoria y actualizada en una sola pasada hacia adelante. Desafía la era de los almacenes vectoriales en la memoria de los agentes. Los límites se reconocen, pero aún no se cuantifican.
2026-07-30
Modelos e Infraestructura de IA
Los nuevos modelos de embedding de Nvidia lideran la clasificación, pero la verdadera historia es el ahorro en costos de agentes
La colección Nemotron 3 Embed de Nvidia reclama el puesto #1 en el benchmark RTEB e introduce variantes de 1B que retienen el 99% de la precisión del modelo de 8B. Los datos de la empresa muestran que una recuperación más sólida reduce los costos downstream de tokens en sistemas de agentes.
2026-07-18
Infraestructura de código abierto
Su pipeline de búsqueda de IA está roto. Este framework de código abierto repara la plomería.
Los equipos que construyen infraestructura de búsqueda de IA aún dedican demasiado tiempo a la plomería. Search Toolkit unifica ingesta, recuperación y evaluación en un único framework de código abierto, eliminando las semanas de trabajo de integración necesarias para combinar herramientas separadas. Está diseñado para casos de uso empresarial como calidad de RAG, recuperación específica de dominio y búsqueda agentiva.
2026-07-11
Herramientas
Tu modelo de IA es un commoditie. El pipeline es donde reside la verdadera ventaja.
Un análisis práctico, paso a paso, de cómo construir un pipeline de escritura con IA en 2025: selección de modelos, encadenamiento de prompts y control de calidad. Sin hype, solo la arquitectura técnica que importa.
2026-07-11