So erstellen Sie Live-Action- und handgezeichnete Animations-VFX | ChatGPT x Seedance 2.0

@genel_ai
JAPANISCHvor 2 Tagen · 27. Juli 2026
360K
282
41
3
564

TL;DR

Dieses Tutorial zeigt einen präzisen Workflow zur Erstellung hybrider Videos aus Live-Action und handgezeichneten Animationen. Erfahren Sie, wie Sie ChatGPT nutzen, um zeitcodierte Prompts für den Video-Generator Seedance 2.0 zu strukturieren.

Hallo! Ich bin GENEL.

Dieses Mal habe ich ein Live-Action x Animationsvideo erstellt, in dem handgezeichnete Animationen in einem echten Raum auftauchen und herumspielen!

https://x.com/genel_ai/status/2081307056838263052

In diesem Beitrag stelle ich vor:

  • Wie man dieses Video erstellt
  • Die tatsächlich verwendeten Prompts

Zufälliges Schreiben von Prompts führt zum Scheitern

Bei dieser Art von Video führt es fast nie zum gewünschten Ergebnis, wenn man einfach wahllos Prompts schreibt.

Hier ist, was mit einem Prompt wie „Handgezeichnete Animation, die mit einem nächtlichen Live-Action-Vergnügungspark verschmilzt & die Kamera folgt ihr“ generiert wurde:

GENEL | AIを用いた動画制作 - inline image

Es hat einige gute Ansätze, aber einige Teile sehen nicht wie handgezeichnete Animation aus, und ich fand es etwas daneben.

Deshalb habe ich dieses Mal die Bühnenbilder Sekunde für Sekunde im Detail durchdacht und in einen Prompt umgewandelt.

Zuerst die Struktur auf 4 Punkte eingrenzen

Bevor ich die genauen Sekunden festlegte, habe ich grob entschieden, was innerhalb der 15 Sekunden passieren soll. Wenn man hier zu gierig wird, fällt es definitiv auseinander, also habe ich den Kern der Geschichte auf nur vier Punkte eingegrenzt.

  1. Animation wird aus der Hand geboren
  2. Sie tritt in den PC-Bildschirm ein
  3. Sie springt aus dem PC und bewegt sich durch den Raum
  4. Sie verwandelt sich in ein Monster

Es ist ein einziger Ablauf, bei dem „Kritzeleien in einen echten Raum eindringen“.

GENEL | AIを用いた動画制作 - inline image

Es gab viele andere Dinge, die ich tun wollte, aber sie passten nicht in 15 Sekunden. Hier muss man geduldig sein.

Aufteilung in Zeitabschnitte

Sobald die Struktur festgelegt ist, wird sie zeitlich aufgeteilt.

0–3 Sekunden: Eine weiße Linie wird aus der Hand geboren, wird zu einem gelben Stern und fliegt zum PC.

3–6 Sekunden: Im PC-Bildschirm verwandelt es sich von einer roten Linie zu einem Herzen zu einem blauen Wirbel und springt dann heraus.

6–10 Sekunden: Bewegt sich durch den Raum und verwandelt sich dabei: Schmetterling -> rosa Schlange -> Krakenmonster.

10–13 Sekunden: Öffnen des Kühlschranks offenbart einen Hamburger-Charakter -> verwandelt sich in ein Monster.

13–15 Sekunden: Ein riesiges Auge erscheint an der Wand, blinzelt und verwandelt sich in ein Lächeln.

Wie ich bereits in meinem vorherigen VFX-Artikel geschrieben habe, wird es stabil, wenn man nach Zeit unterteilt und der Reihe nach schreibt.

[Hier geht es zum vorherigen Artikel]

https://note.com/genel/n/nb2c4b89fa1d8?sub_rt=share_sb

Anweisungen scheinen leichter durchzukommen, wenn man sie in Segmente unterteilt, anstatt eine lange, ausufernde Beschreibung der Situation zu geben!

Verwendete Tools: ChatGPT und Seedance 2.0

Sobald das festgelegt ist, muss es nur noch in ein Video umgewandelt werden. Ich habe nur diese beiden KI-Tools verwendet.

1. ChatGPT | Wandelt den Bauplan in einen Prompt um 2. Seedance 2.0 | Macht aus diesem Prompt ein Video

Der Schlüssel ist, nicht alles auf ChatGPT zu werfen und es zu bitten, „sich ein cooles Video auszudenken“.

Wenn man ihm den selbst erstellten Bauplan gibt, nimmt es fast genau wie geplant Gestalt an. Umgekehrt bekommt man etwas Generisches wie das Vergnügungspark-Beispiel, wenn man es einfach der KI überlässt.

Wenn man jedoch das, was man festgelegt hat, einfach in ChatGPT wirft, liefert es einen zusammenhanglosen, schwer lesbaren Text zurück. Wenn man diesen direkt an Seedance weitergibt, wird es immer noch nicht stabil.

Deshalb habe ich sogar die Reihenfolge der Ausgabe festgelegt.

1. Die Eröffnungszeile (Dauer, Seitenverhältnis, was mit was verschmilzt) 2. Die Atmosphäre des Live-Action-Raums und die Textur einer Smartphone-Aufnahme 3. Bewegung pro Sekunde (0–3s / 3–6s / 6–10s / 10–13s / 13–15s) 4. Eine abschließende Zusammenfassung der handgezeichneten Textur, der Kameranachführung, der Negativ-Prompts und der Umgebungsgeräusche

Hier ist der Anweisungstext, den ich ChatGPT tatsächlich gegeben habe:

text
1[Anweisungen für ChatGPT]
2Ich werde einen Prompt für eine 15-sekündige Videogenerierung erstellen.
3Bitte konvertieren Sie den folgenden Bauplan in einen Prompt, der an eine Videogenerierungs-KI übergeben werden soll.
4
5Bauplan
6Umgebung: Ein dunkler, bewohnter Raum, der nur von warmer indirekter Beleuchtung und kleinen Dekolichtern beleuchtet wird.
7Videotyp: Live-Action x handgezeichnete leuchtende Animation
8Ereignisse:
90–3s: Eine weiße Linie wird aus einer Hand geboren, wird zu einem gelben Stern und fliegt zu einem PC.
103–6s: Im PC-Bildschirm: rote Linie -> Herz -> blauer Wirbel, springt dann heraus.
116–10s: Verwandelt sich in Schmetterling -> rosa Schlange -> Krakenmonster, während es sich durch den Raum bewegt.
1210–13s: Öffnen des Kühlschranks offenbart einen Hamburger-Charakter -> verwandelt sich in ein Monster.
1313–15s: Ein riesiges Auge erscheint an der Wand, blinzelt und verwandelt sich in ein Lächeln.
14
15Schreibregeln:
16- Wenn sich Formen ändern, schreiben Sie „verwandelt sich, während es in die nächste Form zusammenfällt“ anstelle von „verschwindet und die nächste erscheint“.
17- Beschreiben Sie am Ende jedes Segments immer die Kamerabewegung. Die Animation bewegt sich zuerst, und die Kamera folgt mit Verzögerung.
18- Bewahren Sie die Kontinuität des Gehens und Folgens im selben Raum ohne Schnitt.
19- Für die Live-Action-Seite simulieren Sie eine einhändige Smartphone-Aufnahme. Fügen Sie Kameraverwacklungen, leichte Fokussuche, Rauschen bei schwachem Licht und Schwankungen der automatischen Belichtung ein.
20- Für die handgezeichnete Animation verwenden Sie Texturen wie Kreide, Kreide, Buntstift oder raue Pinsel. Linien sollten in jedem Bild zittern mit ungleichmäßiger Färbung und Unschärfe.
21
22Ausgabereihenfolge:
231. Eine Zeile: „15 Sekunden, 16:9 horizontales Video. Ein Video, das Live-Action [Ort] mit handgezeichneter leuchtender Animation verschmilzt.“
242. Atmosphäre des Live-Action-Raums und Smartphone-ähnliche Textur.
253. Jedes Segment: 0–3s / 3–6s / 6–10s / 10–13s / 13–15s.
264. Abschließende Zusammenfassung der handgezeichneten Animationstextur, Kameranachführung, Negativ-Prompts und Umgebungsgeräusche.
27
28Negativ-Prompts, die eingeschlossen werden sollen:
29Zu präzises 3DCG, zu glatte Vektorlinien, neonröhrenartige Ausdrücke, perfekt stabile Gimbal-Aufnahmen, übermäßig filmische Beleuchtung, perfekt komponierte Werbefotografie, Untertitel, Logos, Hintergrundmusik.
30
31Keine Überschriften oder Erklärungen nötig. Geben Sie nur den Prompt-Text aus.
GENEL | AIを用いた動画制作 - inline image

Tatsächlicher ChatGPT-Chat-Bildschirm

Hier ist der Prompt, der erstellt wurde:

text
115 Sekunden, 16:9 horizontales Video. Ein Video, das ein dunkles Live-Action-Interieur mit handgezeichneter leuchtender Animation verschmilzt.
2Ein leicht unordentlicher, bewohnter Raum, der nur von warmer indirekter Beleuchtung und kleinen dekorativen Lichterketten beleuchtet wird. Starkes Kameraverwackeln, als ob es einhändig mit einem Smartphone gefilmt wurde, leichte Fokussuche, Rauschen bei schwachem Licht und Schwankungen der automatischen Belichtung. Echte Textur, nicht poliert wie eine Werbung, sondern als ob sie zufällig von einer Person in ihrem Raum aufgenommen wurde.
30–3s:
4Eine Live-Action-Hand, die auf der linken Seite des Bildschirms hochgehalten wird. Eine weiße handgezeichnete Linie wird aus den Fingerspitzen geboren, klammert sich an die Live-Action-Hand und wird zur Form einer anderen weißen Hand. Die Linien sind unscharf, als ob sie mit Kreide oder Kreide gezeichnet wurden, und zittern in jedem Bild fein. Die weiße Hand fällt zusammen, während sie sich in einen kleinen gelben Stern verwandelt, der mit einer Spur zu einem Laptop unten rechts fliegt. Die Kamera folgt dem Stern mit einer leichten Verzögerung und schwenkt scharf nach unten rechts.
53–6s:
6Der gelbe Stern tritt in den Laptop-Bildschirm ein. Rote handgezeichnete Linien kritzeln heftig auf dem PC-Bildschirm und verwandeln sich sofort in ein rotes Herz. Das Herz zittert und verwandelt sich in einen blauen Wirbel, der dann kräftig aus dem PC-Bildschirm springt. Die blaue Linie dehnt sich aus wie etwas zwischen Flüssigkeit und Flamme, und die Kamera neigt sich schnell nach oben, um ihr zu folgen. Natürliche Bewegungsunschärfe durch die plötzliche Kamerabewegung.
76–10s:
8Der blaue Wirbel verwandelt sich an der Wand in einen hellblauen Schmetterling und fliegt in den hinteren Teil des Raums. Die Kamera folgt dem Schmetterling, während sie geht. Der Schmetterling verwandelt sich in eine rosa schlangenartige Linie, die an der Wand, der Tür und dem Boden entlangkriecht. In der Mitte der Tür wirbelt die rosa Linie und verwandelt sich in ein kleines krakenartiges handgezeichnetes Monster. Das Monster schaut einen Moment lang in die Kamera und flieht dann zum Kühlschrank. Die Kamera folgt hastig.
910–13s:
10Gelbe handgezeichnete Lichtstrahlen und Pfeile erscheinen auf der Kühlschranktür, und die Tür schwingt auf. Im bläulichen Kühlschrank ist ein niedlicher Hamburger-Charakter mit Augen und dünnen Gliedmaßen zu sehen. Im nächsten Moment reißt der Mund des Hamburgers weit auf und verwandelt sich in ein komisches Monster mit einem roten Inneren und dreieckigen Fangzähnen. Die Kamera wackelt heftig, als ob der Filmer erschrocken ist, und die Kühlschranktür wird schnell geschlossen.
1113–15s:
12Die Kamera bewegt sich rückwärts, um den ganzen Raum zu zeigen. Der Umriss eines riesigen weißen Auges wird an der oberen Wand gezeichnet, und eine lebendige blaue Pupille erscheint darin. Unmittelbar nachdem das Auge einmal langsam geblinzelt hat, verwandelt es sich in ein riesiges rosa-weißes Lächeln mit vielen dreieckigen Zähnen. Die Kamera neigt sich überrascht, und der Bildschirm wird dunkel, um zu enden.
13Die handgezeichnete Animation ist eine grobe Frame-für-Frame-Animation, kein glattes CG. Linienstärke, Umrisse und Färbung zittern ständig leicht und bewahren die Textur von Kreide, Kreide, Buntstiften und rauen Pinseln. Lebendige leuchtende Farben, zentriert auf Weiß, Gelb, Hellblau, Rosa und Orange. Es gibt ein schwaches Leuchten um die Animation, aber es beleuchtet den Live-Action-Raum nicht zu stark.
14Die Kamera folgt immer etwas hinter der Animation. Die Animation bewegt sich zuerst aus dem Bild, und die Handkamera schwenkt, neigt oder bewegt sich mit Verzögerung in diese Richtung. Perfekt stabile Gimbal-Aufnahmen sind verboten. Verwenden Sie kein zu präzises 3DCG, keine zu glatten Vektorlinien, keine filmische Beleuchtung, keine übermäßige Tiefenschärfe, keine perfekt komponierte Werbefotografie, keine Untertitel, keine Logos und keine Hintergrundmusik. Fügen Sie nur Innengeräusche, raschelnde Kleidung, Schritte, kleine PC-Bedienungsgeräusche, das Öffnen und Schließen des Kühlschranks sowie leichte elektronische Geräusche und komische Rufe der handgezeichneten Kreaturen ein.
GENEL | AIを用いた動画制作 - inline image

Tatsächlicher ChatGPT-Chat-Bildschirm

Jetzt einfach diesen Prompt nehmen und die „Text zu Video“-Funktion der Videogenerierungs-KI „Seedance 2.0“ verwenden!

Mehr über Seedance 2.0 erfahren Sie in diesem Note-Artikel:

[Hier geht es zum Seedance 2.0 Artikel]

https://note.com/genel/n/n3aac3300f211?sub_rt=share_sb

Nachdem der Prompt kopiert und eingefügt, die Generierungszeit auf 15 Sekunden eingestellt und das Video generiert wurde, sieht es so aus!

GENEL | AIを用いた動画制作 - inline image

Es ist großartig geworden! Ich habe danach mit SUNO generierte Hintergrundmusik hinzugefügt.

Wie man verschiedene Versionen arrangiert

Dies ist der Teil, den ich dieses Mal am meisten empfehlen möchte 💡

Sie denken vielleicht:

„Ich kann jetzt das exakt gleiche Video wie GENEL machen, aber was soll ich tun, wenn ich ein anderes Video machen möchte?“

📢 Also habe ich Anweisungen vorbereitet, mit denen Sie Versionen arrangieren und in Massen produzieren können!!

Einfach durch Kopieren und Einfügen dieser Anweisungen können Sie solche Videos nacheinander generieren!

GENEL | AIを用いた動画制作 - inline image
GENEL | AIを用いた動画制作 - inline image

Ich stelle sie in diesem Note-Artikel vor, also schauen Sie vorbei, wenn Sie interessiert sind ✨

https://note.com/genel/n/nd1b5b0129ab5?sub_rt=share_sb

In YouMind remixen

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken