IA
Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.
565 published articles
Infraestructura de IA y Política
Groq apuesta su futuro por la "American AI Stack"
Groq respaldó el Plan de Acción de IA de la Casa Blanca el mismo día de su lanzamiento, nombrándose a sí misma la capa de cómputo de la American AI Stack. El comunicado revela a una empresa que apuesta a que la política nacional y la inferencia nacional barata la llevarán al mercado global.
2026-08-08
Infraestructura de inferencia
La inferencia de IA se está convirtiendo en un problema de ubicación: Groq abre un centro de datos en el Reino Unido
Groq abrió un centro de datos en el Reino Unido con Equinix mientras GroqCloud supera los 3,5 millones de desarrolladores y el tráfico de IA en producción sigue aumentando. La medida es una apuesta a que la inferencia ahora es un problema de geografía, donde la latencia y la localidad deciden dónde puede ejecutarse la IA en tiempo real.
2026-08-08
Generación de video
MiniMax descartó su arquitectura probada para que H3 lo haga todo
MiniMax afirma que H3 unifica la generación de texto, imagen, video y audio en un solo modelo, fija la salida 2K por debajo de un tercio del precio de los modelos convencionales y planea abrir los pesos en cuestión de días. La letra pequeña es la verdadera historia: la empresa abandonó la arquitectura que le dio una ventaja para conseguirlo.
2026-08-07
Visión por Computadora
CABiNet se mantiene a menos de 2 puntos de YOLO26x con la octava parte del cómputo
El VDD Semantic Segmentation Model Zoo trae a Hugging Face modelos YOLO26 y CABiNet entrenados con metraje variado de drones. YOLO26x-sem lidera con 78.83% de mIoU, pero el 77.76% de CABiNet-Large a 54.8 GFLOPs plantea el caso de la eficiencia.
2026-08-07
Seguridad de IA
Por qué Microsoft está abriendo las pruebas de seguridad de IA al mundo
Microsoft ha financiado 18 laboratorios universitarios en seis continentes para realizar pruebas de penetración independientes a sistemas de IA, reconociendo que los equipos internos no pueden detectar todos los riesgos.
2026-08-07
Investigación sobre RAG
BM25 supera al RAG agéntico cuando los corpus superan los 10 millones de tokens
La búsqueda agéntica gana en corpus pequeños, pero un estudio de muset-ai en 28 niveles anidados muestra que BM25 la supera cerca de los 10 millones de tokens. El agente consume 39 veces más tokens de consulta y el RAG gráfico se estanca en la construcción.
2026-08-07
IA generativa
Pippa paga a los artistas $0.005 por imagen. Sus modelos aún se entrenan con arte extraído de la web
Pippa promete a los artistas una parte de cada generación realizada en su estilo: $0.005 por imagen, $0.003 por segundo de video, más una parte de un fondo de regalías del 5 por ciento. Con alrededor de 800 suscriptores y cuatro artistas firmados, y modelos base aún entrenados con contenido extraído de la web, el discurso ético tiene un problema matemático.
2026-08-07
UI agéntica
Qoder Canvas: un sistema de diseño creado para agentes, no para humanos
El equipo de Qoder de Alibaba sostiene que la ventana de chat es el contenedor equivocado para la salida compleja de los agentes. Qoder Canvas aplica el pensamiento de los sistemas de diseño a las interfaces de los agentes, y enseña a los agentes a construir artefactos interactivos y conscientes del código base en lugar de muros de Markdown.
2026-08-07
Qwen / Alibaba Cloud
Qwen2.5-Omni supera a Gemini-1.5-Pro en OmniBench y cabe en menos de 12GB
El Qwen2.5-Omni de código abierto de Alibaba superó a Gemini-1.5-Pro en OmniBench y encabezó la tabla de clasificación de razonamiento de audio MMAU. Las versiones cuantizadas reducen la VRAM a menos de 12GB y la compatibilidad con MNN lleva el chat de voz en tiempo real a los teléfonos.
2026-08-07
Codificación con IA
OpenCode apuesta por la eficiencia de tokens y añade Ling 3.0 Flash gratis
OpenCode ahora ofrece el Ling 3.0 Flash de inclusionAI de forma gratuita, días después de su lanzamiento. La medida amplía una estrategia consciente de los costos que apuesta a que la eficiencia de tokens gana la carrera de la codificación con IA.
2026-08-07
Generación de video con IA
Wan3.0-Video se cobra por segundo: un clip de 30 segundos asciende a $6
El Wan3.0-Video de Alibaba factura por segundo en DashScope, con un clip de 30 segundos en 1080P que cuesta $6 por generación. Desglosamos los niveles de precios, el flujo de trabajo de múltiples entradas y las preguntas que la publicación deja sin responder.
2026-08-07
Investigación en IA
Voice Memory: un archivo de 776 bytes que le dice al reconocimiento de voz cuándo no hacer nada
Un nuevo esquema de solo inferencia para el reconocimiento de voz aprende a contenerse: un corrector congelado lee un archivo de memoria por dominio y decide cuándo abstenerse. La corrección sin restricciones rompe tokens correctos en hasta el 64 % de las ediciones; Voice Memory lo reduce al 35 % y baja el WER ponderado del 8,36 % al 7,52 %.
2026-08-06