La reproduction vidéo par IA, aujourd'hui, c'est deux options. Les deux sont cassées.
Soit tu écris un prompt à l'aveugle. Soit tu demandes à une IA de regarder ta vidéo et d'en tirer un prompt. Dans les deux cas : one-shot. Un seul coup, aucune repasse.
Et le one-shot sur de la vidéo, ça rate. Ça copie mal. Ça perd le rythme, hallucine la structure, oublie ce qui faisait marcher la vidéo.
Un monteur humain ne bosse jamais comme ça. Il regarde. Il découpe. Plan par plan. Il comprend le tempo, les transitions, l'intention derrière chaque coupe. Puis il reconstruit.
Chez @argildotai on a reproduit ce schéma exactement. Une IA qui décompose ta vidéo comme un humain, avant de reconstruire. Pas un prompt balancé d'un coup — un pipeline, avec un harness vidéo qui vérifie et corrige à chaque étape.
C'est brutalement dur à faire. Ce harness, ce qui permet au modèle de vraiment voir la vidéo et de se corriger seul, c'est exactement ce qui manque à tout le monde.
On a craqué un truc que personne n'a cracké.
Cloner une ad qui performe. Re-purpose une vidéo que tu adores. Repartir d'une base saine plutôt que d'une feuille blanche.
On arrête de générer à l'aveugle. On copie comme un humain — en mieux.