SevenTnewS

Apache 2.0

9 published articles

LLMs y Modelos5 min read

IA de pesos abiertos

dots3-note de Xiaohongshu: un MoE abierto de 280B que solo activa 16B

El estudio dots de Xiaohongshu ha lanzado dots3-note preview, su primer modelo de pesos abiertos: un MoE multimodal con 280B de parámetros, 16B activos y una ventana de contexto de 512K. El diseño disperso apunta a un bajo coste de inferencia en un único nodo de 8 GPU, pero la ficha aún no ha publicado cifras de benchmarks.

2026-08-20

Meta AIFeatured4 min read

IA de código abierto

Muse Glimmer: el agente de 30B de Meta cabe en menos de 20GB, la nube es opcional

Meta ha publicado como código abierto Muse Glimmer, un modelo agéntico de 30B que se ejecuta sin conexión en una sola GPU de consumo. La cuantización lo mantiene por debajo de 20 GB, un drafter DFlash ofrece una decodificación hasta 3,1x más rápida en una RTX 5090, y los pesos están en Hugging Face bajo Apache 2.0.

2026-08-10

Mistral AIFeatured4 min read

Seguridad de IA

Shieldstral, de Mistral, pone tu política de moderación en el prompt, no en los pesos

Shieldstral plantea la moderación como una pregunta binaria: una instrucción, una consulta de sí/no y el contenido a evaluar. Mistral afirma que el modelo de 3B iguala a los guardarraíles abiertos hasta siete veces su tamaño en seguridad de texto, con pesos Apache 2.0 que se ejecutan en una GPU de 16GB.

2026-08-05

IAFeatured1 min read

TTS de código abierto

El nuevo modelo TTS de Audio8 clona voces en 11 idiomas de forma gratuita

Audio8 lanza Audio8-TTS Preview bajo Apache 2.0, un modelo de 0.6B que admite 11 idiomas, clonación de voz zero-shot y un códec de 44.1 kHz incluido. El lanzamiento apunta a aplicaciones de habla en el borde que necesitan velocidad y privacidad.

2026-07-30

IA4 min read

IA en el borde

Mistral Nano se ejecuta en dispositivos con menos de 1 GB de RAM, igualando el 85% de las puntuaciones de razonamiento de su hermano mayor

El nuevo Mistral Nano de Mistral AI está dirigido a dispositivos periféricos con menos de 1 GB de RAM, logrando el 85% del rendimiento de razonamiento de su modelo más grande Mistral Small en pruebas comparativas estándar.

2026-07-25

Código AbiertoFeatured3 min read

IA de código abierto

480 milisegundos y código abierto: Voxtral Realtime desafía a Whisper en su propio terreno

Voxtral Realtime iguala la calidad de transcripción fuera de línea con una latencia inferior al segundo y es de código abierto. El modelo de 13 idiomas utiliza un codificador de audio causal novedoso y se entrena de extremo a extremo para streaming en lugar de adaptarse de sistemas offline.

2026-07-17

LLMs y Modelos2 min read

IA multimodal

Un modelo de 12B supera a uno de 90B. La ortodoxia del escalado está en aprietos

Pixtral-12B iguala o supera a modelos siete veces más grandes en benchmarks multimodales, sin sacrificar el rendimiento lingüístico. Mistral también publica un nuevo benchmark abierto para la evaluación práctica de lenguaje visual, desafiando la idea de que más grande siempre es mejor.

2026-07-17

LLMs y ModelosFeatured5 min read

LLMs y Modelos

La receta de cascada de Mistral reduce los LLM sin eliminar el razonamiento

La destilación en cascada de Mistral reduce modelos grandes a pequeños conservando el razonamiento y la visión. La variante de 3B tiene capacidades que antes requerían diez veces los parámetros, y todo es Apache 2.0.

2026-07-17

LLMs y ModelosFeatured4 min read

Google DeepMind

Gemma 4 acaba de hacer que todos los demás modelos de peso abierto parezcan 10 veces demasiado grandes

La familia de peso abierto nativamente multimodal Gemma 4 de Google DeepMind introduce modo de pensamiento, arquitectura sin codificador y opciones MoE. El modelo de 2.3B iguala el rendimiento del Gemma 3 de 27B. El modelo de 31B lidera las tablas de clasificación de peso abierto.

2026-07-13