SevenTnewS

LLMs y Modelos

Grandes modelos de lenguaje: GPT, Claude, Gemini, Mistral y pesos abiertos.

93 published articles

4 min read

Generación de música con IA

Music 3.0 cambia el prompt de una sola etiqueta por una línea de tiempo que mantiene las canciones de IA en el camino

Las pistas de IA tienden a desviarse del prompt mientras se desarrollan: los instrumentos desaparecen, la emoción se aplana, el estilo vocal va y viene. Music 3.0 cambia la descripción de una sola etiqueta por un Subtítulo Estructurado secuencial en el tiempo, respaldado por un Hybrid-LM de 8B/0.6B que separa la estructura del detalle.

2026-08-21

5 min read

IA de pesos abiertos

dots3-note de Xiaohongshu: un MoE abierto de 280B que solo activa 16B

El estudio dots de Xiaohongshu ha lanzado dots3-note preview, su primer modelo de pesos abiertos: un MoE multimodal con 280B de parámetros, 16B activos y una ventana de contexto de 512K. El diseño disperso apunta a un bajo coste de inferencia en un único nodo de 8 GPU, pero la ficha aún no ha publicado cifras de benchmarks.

2026-08-20

3 min read

IA de código abierto

Boris-2 alimenta su modelo de 125M con 90B tokens, y su 250M con solo 60B

Boris-2 preanuncia tres modelos pequeños con presupuestos de tokens desequilibrados: el de 125M recibe 90B tokens, el de 250M solo 60B. El entrenamiento va del 12 de agosto al 10 de septiembre, sin benchmarks compartidos, solo la ambición declarada de alcanzar la fuerza de SmolLM2-135M.

2026-08-16

4 min read

Generación de video con IA

El Wan3.0 de Alibaba vende video por segundo: $6 por un clip de 30 segundos

Wan3.0 puede convertir un PDF o una presentación de marca en un video de 30 segundos en una sola generación, con un precio por segundo que llega hasta los $0.20 para 1080P. Desglosamos el cálculo por clip y las brechas que Alibaba admite en sus propias pruebas.

2026-08-16

4 min read

TTS de pesos abiertos

Magpie TTS gasta 32 ms del presupuesto de latencia de tu agente de voz

Magpie TTS reporta 32 ms de tiempo hasta el primer audio en una NVIDIA B200 y añade árabe, coreano y portugués brasileño, elevando su repertorio a 12 idiomas. La propuesta de los pesos abiertos: la síntesis de voz autoalojada ya no pierde la batalla de la latencia.

2026-08-16

4 min read

Agentes de IA on-device

LFM2.5-2.6B: el diminuto agente que deja atrás a modelos cuatro veces más grandes

El LFM2.5-2.6B de Liquid AI comprime un modelo agéntico en 2.6B parámetros y menos de 2,5 GB de memoria, liderando todos los benchmarks de seguimiento de instrucciones en los que fue probado. Corre a 220 tokens/s en un portátil; el código es la única brecha clara.

2026-08-12

5 min read

Guerra de precios de IA

El precio viral de $0.07 del GLM-5.2 de Zhipu ya se multiplicó por 10, afirma una respuesta

El GLM-5.2 de Zhipu se volvió viral a $0.07 por millón de tokens, un recorte del 95% que los usuarios llamaron "casi gratis". Una respuesta dice que el precio rebotó 10x como un truco para atraer miradas. Los profesionales añaden que el GLM-5.2 nunca demostró ser de nivel frontera.

2026-08-10

3 min read

Investigación

Tu modelo de IA que usa herramientas está dificultando las preguntas fáciles

Un nuevo artículo de KlingTeam mide cuándo los modelos multimodales realmente necesitan herramientas y cuándo estas perjudican. El modelo propuesto, Beacon, entrenado con recompensas sensibles a la necesidad, mejora tanto la precisión como la disciplina en el uso de herramientas.

2026-08-09

5 min read

Generación de video

MiniMax descartó su arquitectura probada para que H3 lo haga todo

MiniMax afirma que H3 unifica la generación de texto, imagen, video y audio en un solo modelo, fija la salida 2K por debajo de un tercio del precio de los modelos convencionales y planea abrir los pesos en cuestión de días. La letra pequeña es la verdadera historia: la empresa abandonó la arquitectura que le dio una ventaja para conseguirlo.

2026-08-07

4 min read

Carrera de modelos pequeños

BananaMind 2 Micro: 2.9M de parámetros, 75B de tokens y una apuesta extrema por el sobreentrenamiento

BananaMind 2 Micro tendrá 2.9M de parámetros y se entrenará con 75B de tokens, aproximadamente 25,900 tokens por parámetro. El entrenamiento comienza el 3 de agosto, el lanzamiento está estimado del 4 al 6 de agosto, y una vista previa pública de BananaMind 2 Pro llega el mismo día. No se han compartido benchmarks.

2026-08-06

Featured4 min read

Seguridad de IA

Shieldstral, el clasificador de 3B que supera a modelos siete veces más grandes

Un clasificador de seguridad de 3B iguala a los modelos de texto casi siete veces más grandes y establece un nuevo estado del arte en moderación multimodal, según un artículo de arXiv de julio de 2026. El truco: la moderación reformulada como respuesta a preguntas binarias, entrenada con aproximadamente 54,1 millones de muestras.

2026-08-05

5 min read

Inteligencia Artificial

Los LFM2.5-Encoders abogan por los modelos pequeños: 3,7× más rápidos que ModernBERT en CPU

Los LFM2.5-Encoders de pesos abiertos de Liquid AI defienden que el NLP de producción pertenece a los modelos pequeños. Un encoder de 230M supera a ModernBERT-base en los benchmarks y escanea documentos completos en unos 28 segundos en una CPU de portátil, aproximadamente 3,7× más rápido.

2026-08-05

← PreviousPage 1 / 8 · 93 articlesNext →