SkyReels-V3
Genera video a 24 fps con SkyReels-V3, el modelo abierto de video basado en Wan2.1 de Kunlun, en GPUs de Clore.ai.
SkyReels-V3 es un modelo de generación de video de código abierto de Kunlun (SkyWork AI) construido sobre la arquitectura de video Wan2.1. Genera clips fluidos de 24 fps con capacidades tanto de texto a video (T2V) como de imagen a video (I2V). El modelo hereda la fuerte coherencia de movimiento y consistencia temporal de Wan2.1, al tiempo que añade los refinamientos de entrenamiento de SkyWork para mejorar la calidad visual y el cumplimiento de los prompts.
Ejecutar SkyReels-V3 en Clore.ai te permite acceder a los 24 GB de VRAM que necesita sin comprar hardware — alquila una RTX 4090 por unos pocos dólares y empieza a generar.
Características clave
Salida a 24 fps — una tasa de fotogramas fluida y de calidad de emisión desde el primer momento.
Texto a video — genera clips a partir de descripciones en lenguaje natural con un gran seguimiento del prompt.
Imagen a video — anima una imagen de referencia con movimiento de cámara y movimiento del sujeto controlables.
Basado en Wan2.1 — hereda la probada atención temporal y el modelado de movimiento de la arquitectura Wan.
Multirresolución — admite generación en 480p y 720p según el presupuesto de VRAM.
Pesos abiertos — disponible bajo una licencia abierta para investigación y uso comercial.
Chino + inglés — soporte bilingüe de prompts desde el codificador de texto Wan2.1.
Requisitos
VRAM de GPU
16 GB (480p con descarga)
24 GB
RAM del sistema
32 GB
64 GB
Disco
25 GB
50 GB
Python
3.10+
3.11
CUDA
12.8+
12.8+
Recomendación de GPU de Clore.ai: Un RTX 4090 (24 GB, $0.14–0.42/h) es el punto óptimo — suficiente VRAM para generación a 720p con precisión completa. Un RTX 3090 (24 GB, $0.07–0.21/h) funciona para 480p y ofrece la mejor relación precio por clip en el mercado.
Inicio rápido
Ejemplos de uso
Texto a video
Imagen a video
Vista previa rápida de menor resolución
Consejos para usuarios de Clore.ai
Usa las clases de la canalización Wan — SkyReels-V3 está basado arquitectónicamente en Wan2.1, por lo que usa
WanPipeline/WanImageToVideoPipelinede diffusers.Empieza en 480p — itera sobre los prompts primero a menor resolución y luego genera los clips finales en 720p una vez que estés satisfecho con la composición.
Descarga a CPU —
enable_model_cpu_offload()se recomienda en tarjetas de 24 GB para generación a 720p para evitar OOM.Almacenamiento persistente — establece
HF_HOME=/workspace/hf_cacheen un volumen persistente de Clore.ai; el modelo pesa ~15–20 GB.24 fps nativo — no cambies los fps de exportación; la atención temporal del modelo fue entrenada para salida a 24 fps.
Prompts bilingües — el codificador de texto Wan2.1 maneja tanto inglés como chino; puedes mezclar idiomas si es necesario.
Escala de guía — 4.0–6.0 funciona mejor. Los valores más altos (>8) pueden causar sobresaturación.
tmux es obligatorio — ejecuta siempre la generación en una
tmuxsesión en Clore.ai para sobrevivir a desconexiones SSH.
Solución de problemas
OutOfMemoryError a 720p
Habilita pipe.enable_model_cpu_offload(); reduce a 480p si aún se agota la memoria
Modelo no encontrado en HuggingFace
Comprueba el nombre exacto del repositorio en la página HF de SkyworkAI — puede que aparezca bajo un nombre variante
Movimiento entrecortado o parpadeante
Aumenta num_inference_steps a 40; reduce guidance_scale a 4.0
Generación lenta
~1–3 min por clip de 4 s en una RTX 4090 es normal para 720p; 480p es aproximadamente 2× más rápido
Desplazamiento de color / sobresaturación
Reduce guidance_scale a 4.0–5.0
ImportError: imageio
pip install imageio[ffmpeg]
Los pesos se vuelven a descargar al reiniciar
Monta almacenamiento persistente y establece HF_HOME la variable de entorno
Última actualización
¿Te fue útil?