Qué es
Wan2.2 es la familia de modelos de video generativo publicada por el equipo Wan (Alibaba) con pesos abiertos bajo Apache-2.0. Incluye tres variantes: T2V-A14B (texto a video), I2V-A14B (imagen a video) y TI2V-5B, un modelo híbrido de 5 mil millones de parámetros construido sobre el Wan2.2-VAE, con una compresión de 16×16×4.
El dato que lo vuelve relevante para un creativo independiente, y no solo para un laboratorio: según el propio repositorio, TI2V-5B genera video 720P a 24fps y corre en tarjetas de consumo como una RTX 4090.
Para qué usarlo
- Generar clips cortos desde un prompt o animar una imagen fija, en tu equipo, sin pasar por una API de pago.
- Prototipar dirección de arte: iterar encuadres, luz y movimiento antes de comprometer un rodaje o una pieza final.
- Base local de un flujo mayor: Wan2.2 ya está integrado en ComfyUI y en Diffusers, así que puedes conectarlo a lo que ya usas en vez de empezar de nuevo.
Cómo empezar
``sh git clone https://github.com/Wan-Video/Wan2.2.git cd Wan2.2 pip install -r requirements.txt # requiere torch >= 2.4.0 ``
Descarga de pesos (ejemplo con ModelScope; también están en Hugging Face):
``sh modelscope download Wan-AI/Wan2.2-T2V-A14B --local_dir ./Wan2.2-T2V-A14B ``
Generación en una sola GPU:
``sh python generate.py --task t2v-A14B --size 1280*720 --ckpt_dir ./Wan2.2-T2V-A14B \ --offload_model True --convert_model_dtype --prompt "tu prompt aquí" ``
Advertencia que el README declara sin adornos: ese comando con A14B pide una GPU de al menos 80GB de VRAM. Si tu equipo es de consumo, empieza por TI2V-5B; para eso existe. Las opciones --offload_model True, --convert_model_dtype y --t5_cpu bajan el consumo de memoria cuando aparecen errores de falta de VRAM.
Licencia y atribución
Autor: equipo Wan (Alibaba) · Fuente: https://github.com/Wan-Video/Wan2.2 · Licencia: Apache-2.0 (permisiva, uso comercial permitido).
Datos verificados el 2026-07-16 vía la API de GitHub: 16.703 estrellas, 2.081 forks, último push el 2026-03-17. El repositorio no publica releases etiquetados. Los pesos se distribuyen en Hugging Face y ModelScope bajo los términos de cada ficha de modelo: revísalos antes de un uso comercial, porque la licencia del código y la de los pesos no siempre coinciden.