SevenTnewS

generación de video

12 published articles

LLMs y Modelos4 min read

Generación de video con IA

El Wan3.0 de Alibaba vende video por segundo: $6 por un clip de 30 segundos

Wan3.0 puede convertir un PDF o una presentación de marca en un video de 30 segundos en una sola generación, con un precio por segundo que llega hasta los $0.20 para 1080P. Desglosamos el cálculo por clip y las brechas que Alibaba admite en sus propias pruebas.

2026-08-16

Visión y DifusiónFeatured5 min read

Investigación en IA de video

Cómo Context-Matched Distillation impide que los maestros de video vean el futuro

Durante mucho tiempo, la destilación de video ha entrenado a estudiantes causales con profesores que puntúan clips completos usando conocimiento futuro. CMD reemplaza esa puntuación con un profesor causal, añade objetivos puntuados por prefijo y reporta resultados de vanguardia entre los métodos autorregresivos.

2026-08-14

LLMs y Modelos5 min read

Generación de video

MiniMax descartó su arquitectura probada para que H3 lo haga todo

MiniMax afirma que H3 unifica la generación de texto, imagen, video y audio en un solo modelo, fija la salida 2K por debajo de un tercio del precio de los modelos convencionales y planea abrir los pesos en cuestión de días. La letra pequeña es la verdadera historia: la empresa abandonó la arquitectura que le dio una ventaja para conseguirlo.

2026-08-07

Visión y DifusiónFeatured3 min read

Generación de video con IA

Wan3.0-Video se cobra por segundo: un clip de 30 segundos asciende a $6

El Wan3.0-Video de Alibaba factura por segundo en DashScope, con un clip de 30 segundos en 1080P que cuesta $6 por generación. Desglosamos los niveles de precios, el flujo de trabajo de múltiples entradas y las preguntas que la publicación deja sin responder.

2026-08-07

IA4 min read

Generación de video con IA

MiniMax H3 fija el precio del video en un tercio del de los rivales y ocupa el puesto n.º 1 en edición

MiniMax H3 integra texto, imagen, video y audio en un solo modelo, fija el precio de salida en un tercio de las tarifas por segundo habituales y ocupa el primer puesto en edición de video en Artificial Analysis. Los pesos se prometen para los próximos días. La pregunta abierta es cómo se comporta la salida fuera de las demos propias de la empresa.

2026-08-06

Visión y Difusión4 min read

Visión por computadora, modelos del mundo e investigación en IA

PhiZero: enseñar a la IA de video a pensar en física antes de renderizar

PhiZero, un modelo del mundo de CASIA, aprende un compacto "lenguaje físico" discreto a partir de video sin procesar y lo usa para razonar sobre cómo evolucionará una escena antes de renderizar fotogramas. Los autores sostienen que este diseño de razonar-luego-renderizar produce video más físicamente coherente que la predicción directa de píxeles.

2026-07-31

NVIDIA Research3 min read

Investigación en IA

La generación de video se vuelve 120 veces más rápida en una GPU: el avance de Nvidia en atención híbrida

El SANA-Video 2.0 de Nvidia Research combina atención lineal y softmax periódica en una proporción 3:1 para funcionar 120 veces más rápido que Wan 2.2 en una H100. El diseño híbrido recupera la expresividad de rango completo mientras mantiene la inferencia en 13 segundos para un clip en 720p. Las advertencias: los benchmarks se detienen en 720p y combinan el cambio de atención con optimizaciones propietarias.

2026-07-31

IA4 min read

Generación de vídeo

MiniMax H3 subcotiza a los rivales de vídeo y planea liberar sus pesos

MiniMax agrupa la generación de imagen, vídeo y audio en un solo modelo, fija el precio de la salida en menos de un tercio de las tarifas por segundo convencionales y planea liberar los pesos en cuestión de días. Hasta qué punto los resultados se sostienen fuera de sus propias demos es la cuestión abierta.

2026-07-30

Visión y Difusión4 min read

Investigación en IA

VideoCoCo corrige la física rota de los videos de IA pensando en código de Blender

VideoCoCo trata el código ejecutable de Blender como una cadena de pensamiento: un agente de codificación programa una escena, un simulador la reproduce y un motor de video hace que el resultado sea fotorrealista. Esta división ataca el problema de la física del texto a video y logra las mejores puntuaciones medias en PhyGenBench y VBench-2.0.

2026-07-30

LaboratorioFeatured3 min read

Investigación en IA

Kling publica dos benchmarks que exponen lo deficiente que es realmente la generación de video

KlingTeam presenta MultiRef-Compass y KeyFrame-Compass, dos benchmarks que llevan a los modelos de generación de video más allá del texto a video y hacia tareas de múltiples referencias y condicionamiento por fotogramas clave. Las pruebas iniciales en ocho y nueve sistemas respectivamente muestran fallos consistentes en la vinculación de entidades, la preservación del orden temporal y el manejo de restricciones densas.

2026-07-26

IAFeatured1 min read

Generación de video y motores de juego

Lo que un motor de juegos puede enseñar a la IA sobre cómo mantener su mundo coherente

Los modelos generativos de video son a menudo llamados la próxima generación de motores de juego. Pero sin un seguimiento sólido del estado, olvidan lo que sucedió hace dos fotogramas. Un nuevo artículo analiza el problema y ofrece un conjunto de datos de más de 90 horas de juego de Black Myth: Wukong como recurso para solucionarlo.

2026-07-23

IAFeatured3 min read

Inteligencia Artificial

La avalancha de productos de MiniMax: nuevos modelos para código, música y video en una amplia actualización

La startup china de IA MiniMax lanza MiniMax M3, Hailuo 2.3, MiniMax Code y nuevos modelos de voz/música, ampliando su cartera de productos en un panorama competitivo.

2026-07-06