Comment créer des effets visuels mêlant prises de vues réelles et animation dessinée à la main | ChatGPT x Seedance 2.0

@genel_ai
JAPONAISil y a 13 heures · 27 juil. 2026
112K
118
10
1
230

TL;DR

Ce tutoriel révèle un workflow précis pour créer des vidéos hybrides mêlant prises de vues réelles et animation dessinée à la main, en utilisant ChatGPT pour structurer des prompts horodatés destinés au générateur vidéo Seedance 2.0.

Bonjour ! Je suis GENEL.

Cette fois, j'ai créé une vidéo en prise de vue réelle x animation, où des dessins animés surgissent dans une vraie pièce et s'amusent !

https://x.com/genel_ai/status/2081307056838263052

Dans cet article, je vais vous présenter :

  • Comment réaliser cette vidéo
  • Les prompts réellement utilisés

Écrire des prompts au hasard mène à l'échec

Avec ce type de vidéo, si vous commencez à écrire des prompts au hasard, cela ne donne presque jamais le résultat souhaité.

Voici ce qui a été généré avec un prompt du genre « Animation dessinée à la main fusionnant avec un parc d'attractions nocturne en prise de vue réelle, et la caméra la suit » :

GENEL | AIを用いた動画制作 - inline image

Il y a quelques bons points, mais certaines parties ne ressemblent pas à une animation dessinée à la main, et j'ai trouvé que ça manquait de justesse.

Alors cette fois, j'ai réfléchi en détail au déroulement de la scène, seconde par seconde, et je l'ai transformé en prompt.

D'abord, réduire la structure à 4 points

Avant de décider les secondes exactes, j'ai défini grossièrement ce qui allait se passer pendant les 15 secondes. Si on devient trop gourmand ici, ça risque de s'effondrer, j'ai donc réduit le cœur de l'histoire à seulement quatre points.

  1. L'animation naît de la main
  2. Elle entre dans l'écran du PC
  3. Elle sort du PC et se déplace dans la pièce
  4. Elle se transforme en monstre

C'est un flux unique où « les gribouillis empiètent sur une vraie pièce ».

GENEL | AIを用いた動画制作 - inline image

Il y avait beaucoup d'autres choses que je voulais qu'elle fasse, mais elles ne tenaient pas en 15 secondes. C'est là qu'il faut être patient.

Assigner les segments temporels

Une fois la structure décidée, il faut la répartir dans le temps.

0-3 secondes : Une ligne blanche naît de la main, devient une étoile jaune et vole vers le PC.

3-6 secondes : À l'intérieur de l'écran du PC, elle passe d'une ligne rouge à un cœur, puis à un vortex bleu, et elle en sort.

6-10 secondes : Elle se déplace dans la pièce en se transformant : papillon -> serpent rose -> monstre poulpe.

10-13 secondes : En ouvrant le réfrigérateur, un personnage hamburger apparaît -> se transforme en monstre.

13-15 secondes : Un œil géant apparaît sur le mur, cligne des yeux et se transforme en un sourire.

Comme je l'ai écrit dans mon précédent article sur les VFX, diviser par le temps et écrire dans l'ordre rend le résultat stable.

[Cliquez ici pour l'article précédent]

https://note.com/genel/n/nb2c4b89fa1d8?sub_rt=share_sb

Les instructions semblent passer plus facilement lorsqu'on les divise en segments plutôt que de donner une longue description décousue de la situation !

Outils utilisés : ChatGPT et Seedance 2.0

Une fois cela décidé, il ne reste plus qu'à le transformer en vidéo. Je n'ai utilisé que ces deux outils d'IA.

1. ChatGPT | Convertit le plan en un prompt 2. Seedance 2.0 | Transforme ce prompt en vidéo

La clé est de ne pas tout balancer à ChatGPT en lui demandant de « trouver une vidéo cool ».

Si vous lui donnez le plan que vous avez créé vous-même, cela prendra forme presque exactement comme prévu. Inversement, si vous laissez l'IA faire, vous obtiendrez quelque chose de générique, comme l'exemple du parc d'attractions.

Cependant, si vous jetez simplement ce que vous avez décidé à ChatGPT, il renverra un texte décousu et difficile à lire. Si vous le passez directement à Seedance, ce ne sera toujours pas stable.

J'ai donc même spécifié l'ordre de la sortie.

1. La ligne d'ouverture (durée, ratio d'aspect, ce qui est fusionné avec quoi) 2. L'atmosphère de l'espace en prise de vue réelle et la texture d'un enregistrement avec smartphone 3. Mouvement par seconde (0-3s / 3-6s / 6-10s / 10-13s / 13-15s) 4. Un résumé final de la texture dessinée à la main, du suivi de caméra, des prompts négatifs et du son ambiant

Voici le texte d'instruction que j'ai réellement donné à ChatGPT :

text
1[Instructions pour ChatGPT]
2Je vais créer un prompt pour une génération vidéo de 15 secondes.
3Veuillez convertir le plan suivant en un prompt à passer à une IA de génération vidéo.
4
5Plan
6Cadre : Une pièce sombre et habitée, éclairée uniquement par un éclairage indirect chaud et de petites lumières décoratives.
7Type de vidéo : Prise de vue réelle x animation dessinée à la main lumineuse
8Événements :
90-3s : Une ligne blanche naît d'une main, devient une étoile jaune et vole vers un PC.
103-6s : À l'intérieur de l'écran du PC, ligne rouge -> cœur -> vortex bleu, puis en sort.
116-10s : Se transforme en papillon -> serpent rose -> monstre poulpe en se déplaçant dans la pièce.
1210-13s : En ouvrant le frigo, un personnage hamburger apparaît -> se transforme en monstre.
1313-15s : Un œil géant apparaît sur le mur, cligne des yeux et se transforme en un sourire.
14
15Règles d'écriture :
16- Lorsque les formes changent, écrivez « se transforme en s'effondrant dans la forme suivante » au lieu de « disparaît et la suivante apparaît ».
17- À la fin de chaque segment, décrivez toujours le mouvement de la caméra. L'animation bouge en premier, et la caméra suit avec un délai.
18- Maintenez la continuité de la marche et du suivi dans le même espace sans coupure.
19- Pour le côté prise de vue réelle, simulez un filmage avec un smartphone tenu à une main. Incluez des tremblements de caméra, une légère recherche de mise au point, du bruit en faible luminosité et des fluctuations d'exposition automatique.
20- Pour l'animation dessinée à la main, utilisez des textures comme le crayon, la craie, le crayon de couleur ou des pinceaux rugueux. Les lignes doivent trembler à chaque image avec un coloriage irrégulier et flou.
21
22Ordre de sortie :
231. Une ligne : « 15 secondes, vidéo horizontale 16:9. Une vidéo fusionnant la prise de vue réelle [lieu] avec une animation dessinée à la main lumineuse. »
242. Atmosphère de l'espace en prise de vue réelle et texture de type smartphone.
253. Chaque segment : 0-3s / 3-6s / 6-10s / 10-13s / 13-15s.
264. Résumé final de la texture de l'animation dessinée à la main, du suivi de caméra, des prompts négatifs et des sons ambiants.
27
28Prompts négatifs à inclure :
293DCG trop précis, lignes vectorielles trop lisses, expressions de type tube néon, plans stabilisés parfaitement, éclairage trop cinématographique, photographie commerciale parfaitement composée, sous-titres, logos, BGM.
30
31Pas de titres ni d'explications. Sortez uniquement le texte du prompt.
GENEL | AIを用いた動画制作 - inline image

Écran de chat ChatGPT réel

Voici le prompt qui a été créé :

text
115 secondes, vidéo horizontale 16:9. Une vidéo fusionnant un intérieur sombre en prise de vue réelle avec une animation dessinée à la main lumineuse.
2Une pièce légèrement en désordre et habitée, éclairée uniquement par un éclairage indirect chaud et de petites guirlandes lumineuses décoratives. Fort tremblement de caméra comme si filmé à une main avec un smartphone, légère recherche de mise au point, bruit en faible luminosité et fluctuations d'exposition automatique. Texture réelle, pas polie comme une publicité, mais comme capturée accidentellement par un individu dans sa chambre.
30-3s :
4Une main réelle levée sur la gauche de l'écran. Une ligne blanche dessinée à la main naît du bout des doigts, s'accroche à la main réelle et devient la forme d'une autre main blanche. Les lignes sont floues comme dessinées à la craie ou au crayon et tremblent finement à chaque image. La main blanche s'effondre en se transformant en une petite étoile jaune, qui vole vers un ordinateur portable en bas à droite avec une traînée. La caméra suit l'étoile avec un léger délai, en panoramique brusque vers le bas à droite.
53-6s :
6L'étoile jaune entre dans l'écran de l'ordinateur portable. Des lignes rouges dessinées à la main griffonnent violemment sur l'écran du PC, se transformant instantanément en un cœur rouge. Le cœur tremble et se change en un vortex bleu, puis sort vigoureusement de l'écran du PC. La ligne bleue s'étire comme quelque chose entre le liquide et la flamme, et la caméra s'incline rapidement vers le haut pour la suivre. Flou de mouvement naturel dû au mouvement soudain de la caméra.
76-10s :
8Le vortex bleu se transforme en un papillon bleu clair sur le mur et vole vers le fond de la pièce. La caméra suit le papillon en marchant. Le papillon se transforme en une ligne rose serpentine, rampant le long du mur, de la porte et du sol. Au centre de la porte, la ligne rose tourbillonne et se transforme en un petit monstre ressemblant à une pieuvre dessiné à la main. Le monstre regarde la caméra un instant puis fuit vers le réfrigérateur. La caméra le suit précipitamment.
910-13s :
10Des rayons lumineux jaunes dessinés à la main et des flèches apparaissent sur la porte du réfrigérateur, et la porte s'ouvre. À l'intérieur du réfrigérateur bleuté se trouve un mignon personnage hamburger avec des yeux et des membres fins. L'instant d'après, la bouche du hamburger s'ouvre grand, se transformant en un monstre comique avec un intérieur rouge et des crocs triangulaires. La caméra tremble violemment comme si le filmeur était surpris, et la porte du réfrigérateur est rapidement fermée.
1113-15s :
12La caméra recule pour montrer toute la pièce. Le contour d'un œil blanc géant est dessiné sur le mur du haut, et une pupille bleue vif apparaît à l'intérieur. Immédiatement après, l'œil cligne lentement une fois, puis se transforme en un sourire géant rose et blanc avec de nombreuses dents triangulaires. La caméra s'incline de surprise, et l'écran devient noir pour terminer.
13L'animation dessinée à la main est une animation image par image grossière, pas une CG lisse. L'épaisseur des lignes, les contours et le coloriage tremblent légèrement en permanence, conservant la texture de la craie, du crayon, des crayons de couleur et des pinceaux rugueux. Des couleurs lumineuses vives centrées sur le blanc, le jaune, le bleu clair, le rose et l'orange. Il y a une faible lueur autour de l'animation, mais elle n'éclaire pas trop fortement l'espace en prise de vue réelle.
14La caméra suit toujours légèrement en retard sur l'animation. L'animation sort d'abord du cadre, et la caméra tenue à la main effectue un panoramique, un tilt ou un mouvement vers l'avant dans cette direction avec un délai. Les plans stabilisés parfaitement sont interdits. N'utilisez pas de 3DCG trop précis, de lignes vectorielles trop lisses, d'éclairage cinématographique, de profondeur de champ excessive, de photographie commerciale parfaitement composée, de sous-titres, de logos ou de BGM. Incluez uniquement les sons intérieurs, les vêtements qui bruissent, les pas, les petits bruits d'utilisation du PC, l'ouverture et la fermeture du frigo, ainsi que des sons électroniques légers et des cris comiques des créatures dessinées à la main.
GENEL | AIを用いた動画制作 - inline image

Écran de chat ChatGPT réel

Maintenant, prenez ce prompt et utilisez la fonctionnalité « Texte vers Vidéo » dans l'IA de génération vidéo « Seedance 2.0 » !

Pour en savoir plus sur Seedance 2.0, consultez cet article Note :

[Cliquez ici pour l'article Seedance 2.0]

https://note.com/genel/n/n3aac3300f211?sub_rt=share_sb

Après avoir copié-collé le prompt, réglé le temps de génération sur 15 secondes et généré la vidéo, voici le résultat !

GENEL | AIを用いた動画制作 - inline image

C'est super réussi ! J'ai ajouté un BGM généré avec SUNO après.

Comment créer différentes versions

C'est la partie que je veux le plus recommander cette fois-ci 💡

Vous vous dites peut-être :

« Je peux désormais réaliser exactement la même vidéo que GENEL, mais que faire si je veux créer une vidéo différente ? »

📢 J'ai donc préparé des instructions qui vous permettent de créer des variantes et de les produire en masse !!

Il suffit de copier-coller ces instructions pour générer les unes après les autres des vidéos comme celles-ci !

GENEL | AIを用いた動画制作 - inline image
GENEL | AIを用いた動画制作 - inline image

Je les présente dans cet article Note, alors n'hésitez pas à y jeter un œil si vous êtes intéressé ✨

https://note.com/genel/n/nd1b5b0129ab5?sub_rt=share_sb

Remixer dans YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Pour les créateurs

Transformez votre Markdown en un article 𝕏 impeccable

Quand vous publiez vos propres textes longs, la mise en forme 𝕏 des images, tableaux et blocs de code est pénible. YouMind transforme un brouillon Markdown complet en un article 𝕏 impeccable, prêt à publier.

Essayer Markdown vers 𝕏

D'autres patterns à décoder

Articles viraux récents

Explorer plus d'articles viraux