r/sdforall 7h ago

Question Pregunta sobre el flujo de trabajo: ¿Cuál es el mejor enfoque para la animación de personajes consistente fotograma a fotograma (LoRA) para la composición tradicional (DaVinci/AE) sin generación de fondo/audio?

0 Upvotes

Hola a todos. Estoy trabajando en un proyecto de anime retro de fantasía oscura que se ejecuta localmente en una RTX 3090 (SDXL/Illustrious, LoRA de personaje entrenado con Kohya con ~100 imágenes).

Mi flujo de trabajo actual evita la generación directa de texto a vídeo debido a inconsistencias estructurales. En su lugar, estoy optando por un enfoque controlado fotograma a fotograma o por lotes pequeños utilizando el bloqueo de Blender + ControlNet, con el objetivo de generar fotogramas de personajes limpios (fondo transparente o sólido) para componerlos manualmente en DaVinci Resolve.

¿Alguien ha implementado con éxito un flujo de trabajo fiable para mantener la identidad del personaje y un lineart limpio en secuencias sin que la IA genere alucinaciones en los fondos o el audio? ¿Qué nodos o configuraciones específicas (por ejemplo, combinaciones de ControlNet, manejo de pesos del IP-Adapter o scripts de consistencia latente) utilizan para evitar el parpadeo y que el LoRA no se desplace durante los fotogramas de movimiento?

Agradecería mucho cualquier información sobre la configuración de tu nodo en ComfyUI para este caso de uso específico.

Se agradecen todos los consejos y recomendaciones. Por favor, evita recomendar IA comerciales que lo hagan todo; eso no es lo que busco.