SevenTnewS

IA

Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.

565 published articles

4 min read

IA soberana en Europa

Mistral promete soberanía en IA, y su apuesta de computación de 1 GW muestra la trampa

La apuesta de soberanía de Mistral ahora tiene productos concretos: endpoints regionales, un nivel con SLA y alojamiento de modelos de terceros que comienza con GLM-5.2. La parte difícil es la computación, que descansa sobre una coalición de compromisos y un objetivo de 1 GW para 2030.

2026-08-13

Featured4 min read

Inteligencia Artificial

Grok 4.6 empata con GPT-5.6 Sol en 61, pero las puntuaciones por componente se dividen

El Grok 4.6 de xAI empata con GPT-5.6 Sol en 61 en el Artificial Analysis Intelligence Index, un compuesto de nueve benchmarks. El desglose es desigual: victorias en trabajo de conocimiento y en la mayoría de las pruebas de código, pérdidas en DeepSWE y Terminal-Bench. Disponible ahora en Cursor y Grok Build, desde $2 por millón de tokens de entrada.

2026-08-13

3 min read

Inteligencia artificial de código abierto

El Muse Glimmer de 30B de Meta llega primero a Apple Silicon; el soporte para NVIDIA sigue después

Meta lanzó Muse Glimmer, un modelo multimodal de pesos abiertos de 30B diseñado para cargas de trabajo de agentes, y Ollama lo publicó para Apple Silicon el mismo día. DFlash lo hace de 1.5x a 1.8x más rápido en hardware Mac. El soporte para NVIDIA y AMD llegará en los próximos días.

2026-08-13

7 min read

Seguridad de terminal

La trampa de '$HOME': los agentes de codificación de IA necesitan sandboxes, no avisos de '¿permitir?'

El sandbox de terminal de Qoder bloquea cerca de un centenar de comandos destructivos de agentes cada día. Los casos detrás de esos bloqueos explican por qué fallan los avisos de '¿permitir?': una carpeta de proyecto llamada $HOME, una limpieza que apuntaba a /root, y un clic que casi cuesta un disco entero.

2026-08-13

3 min read

Seguridad de la IA

OpenAI pausó Astra por temores de que pueda hackear sistemas endurecidos sin ayuda

OpenAI pausó el trabajo interno en Astra, su modelo en desarrollo, después de que las evaluaciones concluyeran que la empresa no puede descartar 'capacidades cibernéticas críticas' según su Marco de Preparación. El umbral completo describe un modelo que encuentra exploits de día cero en sistemas endurecidos sin intervención humana.

2026-08-13

4 min read

IA clínica

nMAS automatiza las características de EHR para insuficiencia cardíaca, probado solo con 500 pacientes simulados

nMAS, un pipeline multiagente, generó 132 características estructuradas y 70 puntuadas mediante rúbrica a partir de 500 registros de pacientes simulados, elevando el AUROC de fenotipado de HFrEF en el conjunto reservado de 0,895 a 0,963. El preprint no ha sido validado con datos reales de pacientes.

2026-08-13

7 min read

Qoder Computer Use

Un ingeniero lanzó un agente macOS sin saber Swift

Un ingeniero que no sabía leer Swift lanzó software macOS de calidad de producción con Computer Use de Qoder. Su enfoque: juzgar el código por el comportamiento, hacer que el Agente genere sus propias pruebas y guardar cada lección en el sistema de archivos para que ninguna ronda comience desde cero.

2026-08-12

4 min read

Comprensión de video

Gemini 3.6 Flash cuenta cambios de estado pero no detecta parpadeos

Los modelos de lenguaje de video fallan en el registro simple de eventos, según muestra un nuevo estudio de arXiv. Gemini 3.6 Flash cuenta cambios de estado persistentes hasta 12 eventos, pero no tiene una región confiable para los parpadeos transitorios; los fotogramas adicionales inflan la precisión sin una recuperación fiel, con solo el 0.2% de los conteos finales correctos en el régimen de conteo alto.

2026-08-12

4 min read

Agentes de IA on-device

LFM2.5-2.6B: el diminuto agente que deja atrás a modelos cuatro veces más grandes

El LFM2.5-2.6B de Liquid AI comprime un modelo agéntico en 2.6B parámetros y menos de 2,5 GB de memoria, liderando todos los benchmarks de seguimiento de instrucciones en los que fue probado. Corre a 220 tokens/s en un portátil; el código es la única brecha clara.

2026-08-12

4 min read

Anthropic / Claude

La Founder House de Anthropic en Londres ahora es solo de observación

Las solicitudes para la Claude Founder House London de Anthropic están cerradas, y la transmisión en vivo del 23 de septiembre es la única puerta que queda. La agenda muestra a un laboratorio cortejando a los mejores fundadores de IA del Reino Unido con su manual interno, horarios de oficina y una propuesta de que las startups y Anthropic ganan juntos.

2026-08-11

5 min read

Guerra de precios de IA

El precio viral de $0.07 del GLM-5.2 de Zhipu ya se multiplicó por 10, afirma una respuesta

El GLM-5.2 de Zhipu se volvió viral a $0.07 por millón de tokens, un recorte del 95% que los usuarios llamaron "casi gratis". Una respuesta dice que el precio rebotó 10x como un truco para atraer miradas. Los profesionales añaden que el GLM-5.2 nunca demostró ser de nivel frontera.

2026-08-10

Featured4 min read

IA de código abierto

Muse Glimmer: el agente de 30B de Meta cabe en menos de 20GB, la nube es opcional

Meta ha publicado como código abierto Muse Glimmer, un modelo agéntico de 30B que se ejecuta sin conexión en una sola GPU de consumo. La cuantización lo mantiene por debajo de 20 GB, un drafter DFlash ofrece una decodificación hasta 3,1x más rápida en una RTX 5090, y los pesos están en Hugging Face bajo Apache 2.0.

2026-08-10

← PreviousPage 4 / 48 · 565 articlesNext →