generación de video
7 published articles
Visión por computadora, modelos del mundo e investigación en IA
PhiZero: enseñar a la IA de video a pensar en física antes de renderizar
PhiZero, un modelo del mundo de CASIA, aprende un compacto "lenguaje físico" discreto a partir de video sin procesar y lo usa para razonar sobre cómo evolucionará una escena antes de renderizar fotogramas. Los autores sostienen que este diseño de razonar-luego-renderizar produce video más físicamente coherente que la predicción directa de píxeles.
2026-07-31
Investigación en IA
La generación de video se vuelve 120 veces más rápida en una GPU: el avance de Nvidia en atención híbrida
El SANA-Video 2.0 de Nvidia Research combina atención lineal y softmax periódica en una proporción 3:1 para funcionar 120 veces más rápido que Wan 2.2 en una H100. El diseño híbrido recupera la expresividad de rango completo mientras mantiene la inferencia en 13 segundos para un clip en 720p. Las advertencias: los benchmarks se detienen en 720p y combinan el cambio de atención con optimizaciones propietarias.
2026-07-31
Investigación en IA
VideoCoCo corrige la física rota de los videos de IA pensando en código de Blender
VideoCoCo trata el código ejecutable de Blender como una cadena de pensamiento: un agente de codificación programa una escena, un simulador la reproduce y un motor de video hace que el resultado sea fotorrealista. Esta división ataca el problema de la física del texto a video y logra las mejores puntuaciones medias en PhyGenBench y VBench-2.0.
2026-07-30
Generación de vídeo
MiniMax H3 subcotiza a los rivales de vídeo y planea liberar sus pesos
MiniMax agrupa la generación de imagen, vídeo y audio en un solo modelo, fija el precio de la salida en menos de un tercio de las tarifas por segundo convencionales y planea liberar los pesos en cuestión de días. Hasta qué punto los resultados se sostienen fuera de sus propias demos es la cuestión abierta.
2026-07-30
Investigación en IA
Kling publica dos benchmarks que exponen lo deficiente que es realmente la generación de video
KlingTeam presenta MultiRef-Compass y KeyFrame-Compass, dos benchmarks que llevan a los modelos de generación de video más allá del texto a video y hacia tareas de múltiples referencias y condicionamiento por fotogramas clave. Las pruebas iniciales en ocho y nueve sistemas respectivamente muestran fallos consistentes en la vinculación de entidades, la preservación del orden temporal y el manejo de restricciones densas.
2026-07-26
Generación de video y motores de juego
Lo que un motor de juegos puede enseñar a la IA sobre cómo mantener su mundo coherente
Los modelos generativos de video son a menudo llamados la próxima generación de motores de juego. Pero sin un seguimiento sólido del estado, olvidan lo que sucedió hace dos fotogramas. Un nuevo artículo analiza el problema y ofrece un conjunto de datos de más de 90 horas de juego de Black Myth: Wukong como recurso para solucionarlo.
2026-07-23
Inteligencia Artificial
La avalancha de productos de MiniMax: nuevos modelos para código, música y video en una amplia actualización
La startup china de IA MiniMax lanza MiniMax M3, Hailuo 2.3, MiniMax Code y nuevos modelos de voz/música, ampliando su cartera de productos en un panorama competitivo.
2026-07-06