Nuevo juguetito en mi set de herramientas para ComfyUI. Esta tecnología dio bastante de qúe hablar hará un año y medio, pero se quedó algo obsoleta al no actualizarse a las nuevas resoluciones. Sin embargo, siempre la he usado para obtener una base controlada de expresión para cualquier rostro. Después, con modelos más modernos como Klein puedo recuperar el detalle y hacerla viable.
Era un coñazo de utilizar, pero ahora funciona directamente en tiempo real y con los controles que tendríamos con un rig facial.
Si ya está la comunidad como loca generando mil maravillas a su pedo, lo que pueda salir de este Hackathon no lo puedo ni imaginar!!!
#MiniMaxH3#MMH3#MH3
A streaming video LoRA adapter for MiniMax H3? This is a wild initiative, thank you!😲 But reaching real-time generation will require further inference acceleration.
Would anyone be interested in joining an online hackathon we’re hosting for H3?
Any ideas are welcome!
@ltx_io El mayor problema lo estoy teniendo en que me haga bien la transición entre la imagen panorámica y la de detalle de las marismas, y eso que parten de la misma base.
Se empeña en crear cortes en vez de hacer transición suave.
Probando MiniMax H3 en ComfyUI en local con una RTX 3060 12GB VRAM y 32GB RAM.
Clip de 5 segs generado en algo menos de 10 minutos (580 segs) utilizando el workflow #MiniMaxH3 Ref2Vid de serie que ofrece #ComfyUI + el nodo #EasyCache y el modelo "Pruned Int8 Convrot"
@ltx_io Otra prueba con #LTX2_5, esta vez para un clip de 10", generación nativa a 0,5Mpx (960x512) y ampliación con #LTXVLatentUpsampler a 2Mpx (1920x1088).
El tiempo de ejecución total ha sido de 757" (algo más de 12 minutos y medio)
Esto de #Higgsfield es impresionante.
No solo ha hecho una peli de acción Scyfi de hora y media completa, que vale que no es la mejor del mundo, si no que han publicado el proyecto como código abierto incluyendo todos los Prompts y recursos utilizados🤩