第一幕:【参考锁定】 参考图1 hf_20260730_044943_833909d3-0181-4d86-b4ad-8fdd91945fbd Für die Besitzerin #1 Kleidung hf_20260730_045132_8f945ce1-0e33-4e9c-86c6-5b5bdb0b0185 Die höchste Priorität liegt auf dem Verhältnis der Beine und Füße, der Textur der dünnen Strümpfe, der Sitzhaltung auf dem Sofa und der Position der schwarzen High Heels; die voreingestellten Gesichtsmerkmale, Frisur, Make-up und Kleidung von #1 beibehalten. Das Referenzvideo hat höchste Priorität für den Raum des kleinen Restaurants, das Aussehen, den Körperbau, die Kleidung und den lebensechten Darstellungsrhythmus von Mann #2 und Gast #3 . #1, #2 und #3 sind alle erwachsen und dürfen nicht per Gesichtstausch, Kopieren, Zusammenführen oder Identitätsaustausch dargestellt werden. 【Gesamteinstellung】 Realistische Komödie im kleinen Restaurant. Die Besitzerin #1 sitzt auf dem Sofa im hinteren linken Ruhebereich und scrollt auf ihrem Handy, in einer zurückhaltenden, natürlichen "Sirenen-Pose": Der Körper lehnt sich an das Sofa, eine Schulter ist leicht gesunken, der Rücken bildet eine natürliche, weiche S-Kurve; die Beine sind elegant gekreuzt und leicht nach vorne gestreckt, die Zehen sind entspannt; der Kopf ist leicht geneigt, das schwarze lange Haar fällt natürlich über eine Schulter. Die Haltung strahlt eine ruhige, lässige und attraktive Aura aus, provoziert aber die Gäste nicht aktiv, leckt nicht an den Lippen, zwinkert nicht und verdreht den Körper nicht absichtlich. Mann #2 sitzt am ersten grünen, alten Tisch vorne rechts und isst Nudeln. Gast #3 sitzt an einem anderen separaten Tisch hinten rechts und isst Nudeln. Zwischen den beiden Tischen befindet sich ein deutlicher Gang. Die beiden sitzen auf keinen Fall am selben Tisch. Mann #2 starrt kurz auf die Besitzerin #1, während er Nudeln isst, und bittet sie dann, ein orangefarbenes Getränk zu holen. Gast #3 sitzt vom ersten Erscheinen des Esstisches an einem anderen Tisch und isst Nudeln, um den Raum für die spätere Wendung zu schaffen. 【Realistisches Filmen】 Unbearbeitetes iPhone-Handy-Video. 9:16 Hochformat, 1080×1920, 30fps, 26-28mm äquivalente Brennweite, normale Gäste filmen aus ca. 1-1,5 Metern Entfernung. Automatische Belichtung, automatischer Fokus, automatischer Weißabgleich. Leichte Handbewegungen, Atembewegungen, eine halbe Sekunde Verzögerung bei der Neukomposition, kurze Fokus-Suche, Bewegungsunschärfe, partielle Überbelichtung am Fenster und Rauschen in dunklen Bereichen beibehalten. Keine Filter, keine Schönheitskorrekturen, kein Hautglätten, keine Kino-Beleuchtung, keine Gimbal-Bewegung, keine künstliche geringe Tiefenschärfe. Realistische Hauttextur, vereinzelte Haare, Falten in der Kleidung und natürliche Reflexionen dünner Strümpfe beibehalten. 【Position der Charaktere】 Besitzerin #1: Links hinten auf dem cremefarbenen Zweisitzer-Sofa. Lehnt sich an das Sofa und scrollt auf ihrem Handy, in einer natürlichen Sirenen-Sitzhaltung, bemerkt die Gäste vorerst nicht. Mann #2: Rechts vorne am ersten grünen, alten Esstisch, isst allein Nudeln, ist die Person, die um ein Getränk bittet. Gast #3: Rechts hinten am zweiten separaten alten Esstisch, etwa einen Meter von Mann #2 entfernt, mit einem deutlichen Gang dazwischen. Er isst allein Nudeln, synchronisiert sich nicht mit den Bewegungen von Mann #2 und spricht nicht im Voraus. 【Raum und Requisiten】 Links hinten: Cremefarbenes Sofa, Handy der Besitzerin, ein Paar schwarze High Heels, die am Boden stehen, eine davon näher an der Kamera. Mitte hinten: Getränkekühlschrank, Servicetheke, cremefarbenes Notizbuch. Rechts vorne am ersten Tisch: Mann #2, eine Schüssel Nudeln, ein Paar Essstäbchen, eine kleine Schale mit Gewürzen. Rechts hinten am zweiten Tisch: Gast #3, eine weitere Schüssel Nudeln, ein weiteres Paar Essstäbchen, eine weitere kleine Schale mit Gewürzen. Die Tische, Nudelschalen, Essstäbchen und Gewürze der beiden männlichen Gäste sind völlig unabhängig, werden nicht geteilt, nicht kopiert und nicht ausgetauscht. Im Kühlschrank befindet sich nur eine Flasche orangefarbenes Getränk: Eine ca. 500 ml transparente Hartplastikflasche, innen eine natürlich durchscheinende orange-gelbe Flüssigkeit, ein bunter manipulationssicherer Schraubverschluss. Nur diese eine Flasche erscheint im gesamten Film und darf nicht vorzeitig auf dem Tisch erscheinen. 【15 Sekunden strenges Storyboard】 → 0-2 Sekunden: Etablierung der Kameraeinstellung aus niedriger Perspektive auf die Füße Die Kamera beginnt mit den gekreuzten Beinen der Besitzerin #1, die am Rand des Sofas liegen. Sie behält die zurückhaltende Sirenen-Sitzhaltung bei: Beine natürlich gekreuzt, leicht nach vorne gestreckt, dünne Strümpfe mit einer feinen, aber nicht übertriebenen, realistischen Reflexion, Zehen natürlich entspannt. Ein Paar schwarze High Heels stehen auf dem Holzboden, eine davon näher im Vordergrund. Nach einer kurzen automatischen Fokussuche liegt der Fokus auf dem vorderen Fuß und dem Sofarand. Die Kamera dient nur einer schnellen, lebensechten Etablierung, nicht einem langsamen Scannen der Beine. → 2-4 Sekunden: Mittlere Einstellung der Besitzerin auf dem Sofa Der Fotograf hebt natürlich die Arme, die Kamera bewegt sich schnell nach oben zum Oberkörper der Besitzerin. Sie lehnt sich an das Sofa, eine Schulter ist leicht gesunken, der Rücken bildet eine weiche S-Kurve, der Kopf ist leicht geneigt, das lange Haar fällt über eine Schulter. Sie scrollt auf ihrem Handy nach unten, ein leichtes Lächeln erscheint auf ihren Lippen aufgrund des Inhalts des Handys, ihr Ausdruck ist ruhig und lässig, sie bemerkt die beiden Gäste nicht. Der Fokus verschiebt sich natürlich vom Vordergrund auf ihr Gesicht. → 4-6,8 Sekunden: Beide Tische im selben Bild Harter Schnitt zu einer etwas weiteren mittleren Einstellung des Essbereichs rechts. Mann #2 sitzt am ersten Tisch vorne rechts; Gast #3 erscheint deutlich am zweiten Tisch hinten rechts. Zwischen den beiden Tischen befindet sich ein deutlicher Gang. Mann #2 schlürft einen Schluck Nudeln, blickt dann über die Nudelschale hinweg zur Besitzerin links hinten. Die Essstäbchen bleiben am Mund, die restlichen Nudeln hängen kurz zwischen Essstäbchen und Schale, er ist natürlich abgelenkt. Gast #3 bleibt immer an einem anderen Tisch und schaut beim Greifen, Pusten und Kauen der Nudeln nach unten, ohne aufzublicken und ohne sich mit Mann #2 zu synchronisieren. → 6,8-8,5 Sekunden: Mann #2 bestellt Getränk Mann #2 blinzelt, kommt wieder zu sich, isst die restlichen Nudeln und ruft mit erhobener Hand in Richtung der Besitzerin: „Chefin, noch eine Flasche Getränk!“ Gast #3 isst immer noch an seinem Tisch hinten rechts, macht nur eine sehr leichte Pause, wenn er die Stimme hört, blickt aber nicht auf und sagt nichts. → 8,5-10,5 Sekunden: Besitzerin reagiert und steht auf Harter Schnitt zur mittleren Einstellung der Besitzerin. Sie hört auf, auf ihrem Handy zu scrollen, blickt zu Mann #2 auf und antwortet ruhig: „Ja, komme gleich.“ Sie sperrt ihr Handy, legt es mit dem Bildschirm nach unten auf die Sofalehne. Dann beendet sie die schräge Haltung, beugt sich natürlich nach vorne, gleitet mit den Füßen in die schwarzen High Heels am Boden und steht auf. Das Handy muss auf der Sofalehne bleiben. → 10,5-12,5 Sekunden: Getränk aus dem Kühlschrank holen Harter Schnitt zur mittleren Einstellung der Kühlschrankseite. Sie öffnet den alt
Urbane heldenhafte Netzschwung-Sequenz
Eine durchgehende, filmische Aufnahme zeigt eine Figur, die von einem Fensterbrett fällt und nahtlos in eine akrobatische Netzschwung-Actionsequenz über New York City übergeht. Das Video betont realistische Physik, dynamische Kameraführung und ein starkes Gefühl der Freiheit vor einem Sonnenuntergang in der goldenen Stunde.
Prompt
Verwenden Sie das beigefügte Referenzbild für den Charakter. Behalten Sie in jedem Frame genau das gleiche Gesicht, die gleiche Frisur, das gleiche Outfit, die gleichen Körperproportionen und die gleiche Identität bei. Verändern Sie niemals das Aussehen der Person. Erstellen Sie eine einzige, kontinuierliche, 15-sekündige Kinosequenz ohne Schnitte, Übergänge oder Teleportation. Das Video beginnt in einem unaufgeräumten Jugendzimmer. Der Charakter sitzt mittig auf einem breiten Fensterbrett, symmetrisch gerahmt von einem großen Fenster, das einen dunstigen, rotsteinigen Stadthorizont unter weichem, bedecktem Tageslicht überblickt. Die Kamera ist eine völlig statische, auf Augenhöhe aufgenommene Weitwinkelaufnahme ohne Zoom oder Bewegung. Das Zimmer hat eine filmische Indie-Film-Ästhetik mit gedämpften, leicht entsättigten Farben, natürlichem Fensterlicht, subtilem 35-mm-Filmkorn, geringer Schärfentiefe, während die Stadt draußen scharf bleibt. Der Charakter blickt zunächst seitlich im Profil, dreht sich dann langsam zur Kamera, lächelt, hebt eine Hand, um ein Friedenszeichen zu machen, hebt beide Arme über den Kopf und setzt sich einen Over-Ear-Kopfhörer auf die Ohren. Nach einer kurzen Pause lehnt er sich lässig zurück und fällt aus dem offenen Fenster. Anstatt auf dem Boden aufzuschlagen, geht der Fall nahtlos in eine Action-Sequenz über, in der sich der Charakter bereits mit einem Netz hoch über dem Wohnviertel von New York City während der goldenen Stunde abfängt. Von diesem Punkt an verwandelt sich die Kamera in eine kontinuierliche Luftverfolgungsaufnahme, die physisch neigt, kippt und rollt, während sie sowohl den Charakter als auch die umgebende Stadt immer sichtbar hält. Der Charakter ist groß, athletisch (188 cm, 90 kg), schlank und kräftig, bewegt sich wie ein Elite-Traceur gemischt mit Spider-Man. Jede Aktion gehorcht realistischer Physik mit glaubwürdiger Dynamik, Muskelbeanspruchung, Gewichtsverlagerung, Stoffsimulation und Aufprallkräften. Keine schwebenden, rag-doll-artigen Bewegungen, steifen Animationen oder unrealistischen Körpermechaniken. Der Charakter schwingt nur wenige Meter über Straßen, die von Backsteinwohnungen, Feuerleitern, Reihenhäusern, geparkten Autos, Tante-Emma-Läden, gelben Taxis und Fußgängern gesäumt sind. Die Arme bleiben beim Halten des Netzes über dem Kopf ausgestreckt, der Rumpf ist angespannt, die Beine gestreckt. Die Füße berühren kurz das Dach eines geparkten Autos, um die Dynamik natürlich umzulenken, bevor der Schwung fortgesetzt wird. Am höchsten Punkt des nächsten Schwungbogens lässt der Charakter das Netz los, spreizt beide Arme, landet auf einem Backsteingebäude und rennt für vier bis fünf realistische Schritte vertikal die Wand hoch, wobei der Oberkörper etwa 45 Grad in die Wand gelehnt ist. Ein kräftiger Absprung mit beiden Füßen schleudert ihn über eine Kreuzung, während ein weiteres Netz auf ein entferntes Dach schießt. Der Charakter schwingt tief durch den fahrenden Verkehr, webt zwischen gelben Taxis und einem roten Feuerwehrauto mit blinkenden Lichtern und Sirenen hindurch. Er lässt das Netz los, landet direkt in einem Sprint, rennt natürlich zwischen den Fahrzeugen hindurch, lacht, nachdem eine Taxihupe ertönt, setzt einen Fuß auf die Seite eines Taxis, springt über dessen Dach, feuert ein weiteres Netz ab und schießt schreiend „WOOHOO!“ nach oben. Die Sequenz endet mit einem atemberaubenden Schwung auf Dachhöhe vor einem leuchtend orange-rosa Sonnenuntergangshimmel voller dramatischer, beleuchteter Wolken. Am höchsten Punkt des Schwungs hängt der Charakter einen einzigen stillen Moment lang mit geöffneten Armen, zurückgelehntem Kopf und geschlossenen Augen, was ein Gefühl völliger Freiheit ausdrückt. Die Stadt erstreckt sich weit unter ihm mit Dächern, Wassertürmen, Straßen und einem entfernten Horizont, bevor der Charakter absteigt, während die Aufnahme endet. Visual Style: Ultra-photorealistisch, Großformat-Kinokamera, anamorphes Objektiv, filmische Beleuchtung, authentische Bewegungsunschärfe, realistische Stoffsimulation, subtiler atmosphärischer Dunst, filmische Farbkorrektur, hoher Dynamikbereich, Premium-VFX-Qualität, kontinuierliche Luftkinematografie. Audio (No Music): Natürlicher Wind, Geräusche von Netzabfeuerung und Spannung, Schritte an Wänden, Stoffbewegung, Aufprall auf Autodach, Taxihupen, Feuerwehrsirenen, realistische Stadtgeräusche, echtes Lachen, widerhallendes „WOOHOO!“, gefolgt von fast völliger Stille am höchsten Punkt des Schwungs.
So nutzt du diesen Prompt
Prompt kopieren
Kopiere den aufbereiteten Prompt in deiner Sprache oder schick ihn mit einem Klick in den Editor.
Modell wählen
Das Modell hinter diesem Ergebnis ist vorausgewählt – du kannst jedes von Vorla unterstützte Modell wählen.
Generieren und verfeinern
Zuerst unverändert ausführen, um den Look zu reproduzieren, dann den Text anpassen.
Mehr von Seedance 2.0
Alle Videokategorien
Grok Imagine
Ostäsiatische Frau in der Stadt
Bild oder Video wählen
Image
3 Modelle4.312 Prompts
Mehr ansehenVideo
2 Modelle1.945 Prompts
Mehr ansehenFinde deinen nächsten KI-Prompt
Eine Suche deckt jedes Modell und beide Medien ab, und das Kopieren kostet dich nichts.

















