SevenTnewS

IA

Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.

565 published articles

4 min read

Infraestructura de IA y Política

Groq apuesta su futuro por la "American AI Stack"

Groq respaldó el Plan de Acción de IA de la Casa Blanca el mismo día de su lanzamiento, nombrándose a sí misma la capa de cómputo de la American AI Stack. El comunicado revela a una empresa que apuesta a que la política nacional y la inferencia nacional barata la llevarán al mercado global.

2026-08-08

3 min read

Infraestructura de inferencia

La inferencia de IA se está convirtiendo en un problema de ubicación: Groq abre un centro de datos en el Reino Unido

Groq abrió un centro de datos en el Reino Unido con Equinix mientras GroqCloud supera los 3,5 millones de desarrolladores y el tráfico de IA en producción sigue aumentando. La medida es una apuesta a que la inferencia ahora es un problema de geografía, donde la latencia y la localidad deciden dónde puede ejecutarse la IA en tiempo real.

2026-08-08

5 min read

Generación de video

MiniMax descartó su arquitectura probada para que H3 lo haga todo

MiniMax afirma que H3 unifica la generación de texto, imagen, video y audio en un solo modelo, fija la salida 2K por debajo de un tercio del precio de los modelos convencionales y planea abrir los pesos en cuestión de días. La letra pequeña es la verdadera historia: la empresa abandonó la arquitectura que le dio una ventaja para conseguirlo.

2026-08-07

4 min read

Visión por Computadora

CABiNet se mantiene a menos de 2 puntos de YOLO26x con la octava parte del cómputo

El VDD Semantic Segmentation Model Zoo trae a Hugging Face modelos YOLO26 y CABiNet entrenados con metraje variado de drones. YOLO26x-sem lidera con 78.83% de mIoU, pero el 77.76% de CABiNet-Large a 54.8 GFLOPs plantea el caso de la eficiencia.

2026-08-07

Featured3 min read

Seguridad de IA

Por qué Microsoft está abriendo las pruebas de seguridad de IA al mundo

Microsoft ha financiado 18 laboratorios universitarios en seis continentes para realizar pruebas de penetración independientes a sistemas de IA, reconociendo que los equipos internos no pueden detectar todos los riesgos.

2026-08-07

3 min read

Investigación sobre RAG

BM25 supera al RAG agéntico cuando los corpus superan los 10 millones de tokens

La búsqueda agéntica gana en corpus pequeños, pero un estudio de muset-ai en 28 niveles anidados muestra que BM25 la supera cerca de los 10 millones de tokens. El agente consume 39 veces más tokens de consulta y el RAG gráfico se estanca en la construcción.

2026-08-07

4 min read

IA generativa

Pippa paga a los artistas $0.005 por imagen. Sus modelos aún se entrenan con arte extraído de la web

Pippa promete a los artistas una parte de cada generación realizada en su estilo: $0.005 por imagen, $0.003 por segundo de video, más una parte de un fondo de regalías del 5 por ciento. Con alrededor de 800 suscriptores y cuatro artistas firmados, y modelos base aún entrenados con contenido extraído de la web, el discurso ético tiene un problema matemático.

2026-08-07

5 min read

UI agéntica

Qoder Canvas: un sistema de diseño creado para agentes, no para humanos

El equipo de Qoder de Alibaba sostiene que la ventana de chat es el contenedor equivocado para la salida compleja de los agentes. Qoder Canvas aplica el pensamiento de los sistemas de diseño a las interfaces de los agentes, y enseña a los agentes a construir artefactos interactivos y conscientes del código base en lugar de muros de Markdown.

2026-08-07

4 min read

Qwen / Alibaba Cloud

Qwen2.5-Omni supera a Gemini-1.5-Pro en OmniBench y cabe en menos de 12GB

El Qwen2.5-Omni de código abierto de Alibaba superó a Gemini-1.5-Pro en OmniBench y encabezó la tabla de clasificación de razonamiento de audio MMAU. Las versiones cuantizadas reducen la VRAM a menos de 12GB y la compatibilidad con MNN lleva el chat de voz en tiempo real a los teléfonos.

2026-08-07

Featured1 min read

Codificación con IA

OpenCode apuesta por la eficiencia de tokens y añade Ling 3.0 Flash gratis

OpenCode ahora ofrece el Ling 3.0 Flash de inclusionAI de forma gratuita, días después de su lanzamiento. La medida amplía una estrategia consciente de los costos que apuesta a que la eficiencia de tokens gana la carrera de la codificación con IA.

2026-08-07

Featured3 min read

Generación de video con IA

Wan3.0-Video se cobra por segundo: un clip de 30 segundos asciende a $6

El Wan3.0-Video de Alibaba factura por segundo en DashScope, con un clip de 30 segundos en 1080P que cuesta $6 por generación. Desglosamos los niveles de precios, el flujo de trabajo de múltiples entradas y las preguntas que la publicación deja sin responder.

2026-08-07

4 min read

Investigación en IA

Voice Memory: un archivo de 776 bytes que le dice al reconocimiento de voz cuándo no hacer nada

Un nuevo esquema de solo inferencia para el reconocimiento de voz aprende a contenerse: un corrector congelado lee un archivo de memoria por dominio y decide cuándo abstenerse. La corrección sin restricciones rompe tokens correctos en hasta el 64 % de las ediciones; Voice Memory lo reduce al 35 % y baja el WER ponderado del 8,36 % al 7,52 %.

2026-08-06

← PreviousPage 6 / 48 · 565 articlesNext →