LLMs y Modelos
Grandes modelos de lenguaje: GPT, Claude, Gemini, Mistral y pesos abiertos.
93 published articles
Generación de música con IA
Music 3.0 cambia el prompt de una sola etiqueta por una línea de tiempo que mantiene las canciones de IA en el camino
Las pistas de IA tienden a desviarse del prompt mientras se desarrollan: los instrumentos desaparecen, la emoción se aplana, el estilo vocal va y viene. Music 3.0 cambia la descripción de una sola etiqueta por un Subtítulo Estructurado secuencial en el tiempo, respaldado por un Hybrid-LM de 8B/0.6B que separa la estructura del detalle.
2026-08-21
IA de pesos abiertos
dots3-note de Xiaohongshu: un MoE abierto de 280B que solo activa 16B
El estudio dots de Xiaohongshu ha lanzado dots3-note preview, su primer modelo de pesos abiertos: un MoE multimodal con 280B de parámetros, 16B activos y una ventana de contexto de 512K. El diseño disperso apunta a un bajo coste de inferencia en un único nodo de 8 GPU, pero la ficha aún no ha publicado cifras de benchmarks.
2026-08-20
IA de código abierto
Boris-2 alimenta su modelo de 125M con 90B tokens, y su 250M con solo 60B
Boris-2 preanuncia tres modelos pequeños con presupuestos de tokens desequilibrados: el de 125M recibe 90B tokens, el de 250M solo 60B. El entrenamiento va del 12 de agosto al 10 de septiembre, sin benchmarks compartidos, solo la ambición declarada de alcanzar la fuerza de SmolLM2-135M.
2026-08-16
Generación de video con IA
El Wan3.0 de Alibaba vende video por segundo: $6 por un clip de 30 segundos
Wan3.0 puede convertir un PDF o una presentación de marca en un video de 30 segundos en una sola generación, con un precio por segundo que llega hasta los $0.20 para 1080P. Desglosamos el cálculo por clip y las brechas que Alibaba admite en sus propias pruebas.
2026-08-16
TTS de pesos abiertos
Magpie TTS gasta 32 ms del presupuesto de latencia de tu agente de voz
Magpie TTS reporta 32 ms de tiempo hasta el primer audio en una NVIDIA B200 y añade árabe, coreano y portugués brasileño, elevando su repertorio a 12 idiomas. La propuesta de los pesos abiertos: la síntesis de voz autoalojada ya no pierde la batalla de la latencia.
2026-08-16
Agentes de IA on-device
LFM2.5-2.6B: el diminuto agente que deja atrás a modelos cuatro veces más grandes
El LFM2.5-2.6B de Liquid AI comprime un modelo agéntico en 2.6B parámetros y menos de 2,5 GB de memoria, liderando todos los benchmarks de seguimiento de instrucciones en los que fue probado. Corre a 220 tokens/s en un portátil; el código es la única brecha clara.
2026-08-12
Guerra de precios de IA
El precio viral de $0.07 del GLM-5.2 de Zhipu ya se multiplicó por 10, afirma una respuesta
El GLM-5.2 de Zhipu se volvió viral a $0.07 por millón de tokens, un recorte del 95% que los usuarios llamaron "casi gratis". Una respuesta dice que el precio rebotó 10x como un truco para atraer miradas. Los profesionales añaden que el GLM-5.2 nunca demostró ser de nivel frontera.
2026-08-10
Investigación
Tu modelo de IA que usa herramientas está dificultando las preguntas fáciles
Un nuevo artículo de KlingTeam mide cuándo los modelos multimodales realmente necesitan herramientas y cuándo estas perjudican. El modelo propuesto, Beacon, entrenado con recompensas sensibles a la necesidad, mejora tanto la precisión como la disciplina en el uso de herramientas.
2026-08-09
Generación de video
MiniMax descartó su arquitectura probada para que H3 lo haga todo
MiniMax afirma que H3 unifica la generación de texto, imagen, video y audio en un solo modelo, fija la salida 2K por debajo de un tercio del precio de los modelos convencionales y planea abrir los pesos en cuestión de días. La letra pequeña es la verdadera historia: la empresa abandonó la arquitectura que le dio una ventaja para conseguirlo.
2026-08-07
Carrera de modelos pequeños
BananaMind 2 Micro: 2.9M de parámetros, 75B de tokens y una apuesta extrema por el sobreentrenamiento
BananaMind 2 Micro tendrá 2.9M de parámetros y se entrenará con 75B de tokens, aproximadamente 25,900 tokens por parámetro. El entrenamiento comienza el 3 de agosto, el lanzamiento está estimado del 4 al 6 de agosto, y una vista previa pública de BananaMind 2 Pro llega el mismo día. No se han compartido benchmarks.
2026-08-06
Seguridad de IA
Shieldstral, el clasificador de 3B que supera a modelos siete veces más grandes
Un clasificador de seguridad de 3B iguala a los modelos de texto casi siete veces más grandes y establece un nuevo estado del arte en moderación multimodal, según un artículo de arXiv de julio de 2026. El truco: la moderación reformulada como respuesta a preguntas binarias, entrenada con aproximadamente 54,1 millones de muestras.
2026-08-05
Inteligencia Artificial
Los LFM2.5-Encoders abogan por los modelos pequeños: 3,7× más rápidos que ModernBERT en CPU
Los LFM2.5-Encoders de pesos abiertos de Liquid AI defienden que el NLP de producción pertenece a los modelos pequeños. Un encoder de 230M supera a ModernBERT-base en los benchmarks y escanea documentos completos en unos 28 segundos en una CPU de portátil, aproximadamente 3,7× más rápido.
2026-08-05