Modèles de génération
Text to video
Aussi appelé : T2V, texte vers vidéo
Le text to video désigne la génération d'un plan vidéo à partir d'une description écrite, sans image de départ.
C'est le mode le plus rapide et le moins contrôlable. Tu écris une phrase, le modèle invente le cadrage, la lumière, le casting et le mouvement. Utile pour explorer une direction artistique, insuffisant dès qu'un film demande de la continuité.
En pratique, le text to video sert surtout aux plans d'ambiance et aux décors : une rue sous la pluie, une crête enneigée, une foule au large. Dès qu'un personnage identifiable revient d'un plan à l'autre, il faut basculer en image to video.
Garde le text to video pour la phase de recherche. Une fois la direction trouvée, fige une image et repasse en image to video.
Notions liées
Image to video
L'image to video anime une image fixe fournie en entrée, ce qui verrouille le cadrage, le décor et le personnage avant même la génération.
Consistance de personnage
La consistance de personnage est la capacité à faire réapparaître le même visage, la même morphologie et le même costume sur tous les plans d'un film généré.
Prompt vidéo
Un prompt vidéo est la description écrite qui pilote la génération d'un plan : sujet, action, cadrage, lumière, mouvement de caméra et style.
Les films de DelgadoWorks montrent ces choix appliqués, avec le détail de fabrication sur chaque page.
Même catégorie
Modèles de génération
Image to video
L'image to video anime une image fixe fournie en entrée, ce qui verrouille le cadrage, le décor et le personnage avant même la génération.
Interpolation d'images
L'interpolation crée des images intermédiaires entre deux frames existantes pour augmenter la fluidité ou fabriquer un ralenti.
Modèle de diffusion
Un modèle de diffusion génère une image ou une vidéo en partant d'un bruit aléatoire qu'il débruite progressivement jusqu'à obtenir le résultat demandé.
Seed
La seed est le nombre qui initialise le hasard d'une génération : à prompt et paramètres identiques, la même seed redonne le même résultat.
Start frame et end frame
Le start frame et le end frame sont les deux images fournies au modèle pour qu'il fabrique la transition entre elles.
Upscaling vidéo
L'upscaling vidéo augmente la définition d'un plan généré en reconstruisant les détails manquants par apprentissage.