SevenTnewS

IA

Inteligencia artificial: LLMs, agentes, difusión, visión, PLN y lo último de los principales laboratorios.

565 published articles

5 min read

Herramientas de detección de IA

Un acuerdo de libro de 2 millones de dólares se derrumbó por una acusación de IA

Editores y escuelas actúan sobre las señales de los detectores de IA de formas que arruinan carreras: un acuerdo de libro de 2 millones de dólares cancelado, suspensiones, demandas. Los propios fabricantes de las herramientas admiten que no son lo bastante precisas para actuar en consecuencia. Bienvenidos a la era de la desconfianza.

2026-08-16

4 min read

Agentes de IA · Código abierto

DeepSeek lanza un harness de agentes donde incluso el modelo es un plugin

DeepSeek publicó DeepSeek Harness, un runtime de agentes de código abierto donde los modelos, las herramientas, los sandboxes y la interfaz de usuario son todos plugins de Cordis. Los registros de sesión de solo añadidura y un modo mínimo de dos herramientas apuntan a una ambición más discreta: ejecuciones de agentes auditables y reproducibles.

2026-08-16

Featured3 min read

El caballo de batalla de Google, más grande en la actualización 3.7

Gemini 3.7 Flash reduce su precio a la mitad y luego lo justifica

El Gemini 3.7 Flash de Google llega a la mitad del precio introductorio del 3.6 Flash mientras afirma mejoras en los puntos de referencia de programación, desarrollo web y trabajo del conocimiento. El lanzamiento se produce tres semanas después del Flash anterior y trae consigo un nuevo argumento de relación precio-rendimiento para desarrolladores de agentes.

2026-08-16

5 min read

IA de código abierto: Alibaba abre el nivel Max

Qwen 3.8-Max: el modelo más potente de Alibaba ya se puede descargar gratis

Alibaba está publicando como código abierto Qwen 3.8-Max, su modelo más capaz hasta la fecha: un MoE de 2,4 billones de parámetros que supera a GPT-5.6 Sol en SWE-bench Pro, PaperBench e IFBench. Analizamos las salvedades de los benchmarks y lo que significa un modelo insignia abierto con 95 mil millones de parámetros activos para los desarrolladores.

2026-08-16

4 min read

Codificación agéntica e hinchazón de prompts

Recuerdo catastrófico: por qué los archivos CLAUDE.md crecen un 226% y nunca se reducen

Un estudio de arXiv sobre 1.867 repositorios revela que los archivos de instrucciones de codificación agéntica como CLAUDE.md triplican su tamaño a lo largo de su vida, porque eliminar una línea arriesga regresiones una vez que se pierde su razonamiento. Los autores lo llaman recuerdo catastrófico y demuestran que documentar el razonamiento reduce las instrucciones excesivas en un 99,3%.

2026-08-15

4 min read

Investigación en IA

Basta de copiar y pegar habilidades: la solución sin evaluación de SkillZip para agentes inflados

Los agentes autoevolutivos añaden correcciones hasta que la misma regla aparece en varias ramas. SkillZip comprime sus habilidades sin rollouts de evaluación, al encontrar la explicación estructural fiel más corta. Modos One-shot y Zip-on-Write, y lo que el resumen deja sin demostrar.

2026-08-15

4 min read

Multimodal / Código abierto

El paquete de plugins de Qwen le da a tu agente de código ojos, manos y memoria de video

El equipo de Qwen de Alibaba lanzó Qwen-MM-Plugins, un kit de herramientas Apache-2.0 que brinda a los agentes de código habilidades multimodales nativas: lectura de imágenes y video con resolución dinámica, OCR, grounding, ASR, memoria de video largo, generación de video y control de cliente ligero de Blender y FreeCAD. Un solo script lo instala en Claude Code, Codex, Qoder, OpenClaw, Qwen Code y Gemini CLI.

2026-08-15

4 min read

Agentes de IA

Cuando las habilidades de los agentes fallan, SkillProx las poda como el descenso de gradiente

Se suponía que las habilidades harían más inteligentes a los agentes, pero cada corrección que acumulan puede hacerlos más torpes. SkillProx ejecuta un bucle hacia adelante y hacia atrás inspirado en el gradiente proximal que diagnostica, revierte y elimina. Resultado: una ganancia media de precisión de 3.0 puntos sobre la línea base basada en gradiente más sólida.

2026-08-14

4 min read

Agentes de IA

Grok Bot va tras el último 10% del trabajo que la mayoría de la IA deja sin terminar

Grok Bot, el nuevo producto de agente de xAI, funciona en su propia computadora en la nube, se conecta a las herramientas que ya usas, aprende flujos de trabajo al verte hacerlos una vez y termina el trabajo de principio a fin. La idea detrás: la mayoría de la IA se detiene al 90%.

2026-08-14

4 min read

Economía de la IA

El plan de $18 de Alibaba ejecuta Qwen y DeepSeek dentro de Claude Code

El Token Plan Individual de Alibaba Cloud agrupa Qwen y modelos de terceros como DeepSeek en un único fondo de créditos, desde $6 al mes, utilizable dentro de Claude Code y Cursor. La compañía afirma un ahorro de aproximadamente el 40% frente al pago por uso, pero el plan solo funciona desde Singapur y solo dentro de las herramientas aprobadas.

2026-08-14

4 min read

Modelos de IA | NVIDIA Nemotron 3.5 Lightning

Por qué Nemotron 3.5 Lightning apuesta a que la mayoría de los pasos de un agente no necesitan un modelo grande

El nuevo modelo abierto de Nvidia se ejecuta localmente con 3B de parámetros activos y un contexto de 1M de tokens, diseñado para agentes que permanecen en ejecución. Nvidia afirma hasta 4 veces más rendimiento y un 30 % más rápido en la finalización de tareas que los modelos abiertos comparables.

2026-08-14

Featured5 min read

Investigación en IA de video

Cómo Context-Matched Distillation impide que los maestros de video vean el futuro

Durante mucho tiempo, la destilación de video ha entrenado a estudiantes causales con profesores que puntúan clips completos usando conocimiento futuro. CMD reemplaza esa puntuación con un profesor causal, añade objetivos puntuados por prefijo y reporta resultados de vanguardia entre los métodos autorregresivos.

2026-08-14

← PreviousPage 3 / 48 · 565 articlesNext →