๐—™๐—น๐˜‚๐˜… ๐Ÿฏ – ๐—ฉรญ๐—ฑ๐—ฒ๐—ผ๐˜€ ๐—ฐ๐—ผ๐—ป ๐—ฎ๐˜‚๐—ฑ๐—ถ๐—ผ๐˜€ ๐˜€๐—ถ๐—ป๐—ฐ๐—ฟ๐—ผ๐—ป๐—ถ๐˜‡๐—ฎ๐—ฑ๐—ผ๐˜€

julio 27, 2026


Presentan FLUX 3, y no es “otro generador de vรญdeo” mรกs. Es un modelo multimodal entrenado desde cero con imagen, vรญdeo Y audio a la vez, en una sola arquitectura.

ยฟQuรฉ significa esto en la prรกctica?
โ†’ Genera clips de hasta 20 segundos con audio nativo sincronizado: pasos, golpes, diรกlogo, todo cae exactamente donde toca la acciรณn en pantalla
โ†’ Soporta texto a vรญdeo, imagen a vรญdeo, vรญdeo a vรญdeo y transiciones por keyframes
โ†’ Diรกlogo multilingรผe y expresiones faciales mรกs naturales
โ†’ Se pueden encadenar varios clips para crear secuencias mรกs largas

Lo mรกs curioso: el mismo “cerebro” que genera vรญdeo tambiรฉn estรก entrenando robots. Audi ya lo estรก probando en producciรณn para tareas de manipulaciรณn fรญsica.

Por ahora, FLUX 3 Video y Action estรกn en acceso anticipado (API y partners). La parte de imagen llega en las prรณximas semanas, y habrรก una versiรณn “Dev” de pesos abiertos mรกs adelante este aรฑo.

ยฟYa has probado algรบn generador de vรญdeo con audio sincronizado? ยฟCuรกl te ha sorprendido mรกs este aรฑo?

UP