Text-zu-Video-Generator

Beschreibe die Szene, Bewegung, Stimmung und Kameraführung und generiere dann ein Video mit einem Modell und Parametersatz, der zur Aufgabe passt.

Prompt zu BewegungDauersteuerungVideomodellauswahl
0 / 2,000
~75 cr

Text-to-Video-KI — schreib die Szene, erhalte das Filmmaterial

Beschreibe Motiv, Bewegung, Stimmung und Kamera und generiere filmische Clips mit nativem Audio. Angetrieben von Seedance 2.0 — dem Modell, das derzeit die Blind-Präferenz-Abstimmungen gewinnt — neben Veo 3.1 Fast.

Filmisches KI-Filmstandbild eines Segelboots in einem Sturm

Filmische Szenen aus einfachen Sätzen

Ein Sturm auf See, eine Verfolgungsjagd durch Neonstraßen, ein stilles nächtliches Diner — schreib es so, wie du es einem Freund erzählen würdest, und das Modell übernimmt die Kameraführung. Veo-Ausgaben werden immer wieder als "inszeniert, nicht generiert" beschrieben: gezieltes Licht, glaubwürdige Physik, echte Kameragrammatik.

Zeitraffer-Sequenz einer Blume, die über drei Frames erblüht

Bewegung und Timing, die du festlegen kannst

Langsames Heranzoomen, Zeitraffer-Blüte, Handkamera-Energie — die Bewegungsrichtung im Prompt wird befolgt, und die Dauer legst du selbst fest (4–15 Sekunden je nach Modell). Der Clip entspricht dem Briefing, statt es nur anzunähern.

Produktvideo-Frame im Werbestil eines rotierenden Smartphones

Produkt- und Markenclips in Minuten

Rotierende Hero-Aufnahmen, Pour-Shots, Unboxings — Filmmaterial im Werbestil, das früher eine Studiosession brauchte, wird aus einem Absatz generiert. Preisgestaltung pro Sekunde mit vorab angezeigten genauen Kosten hält Kampagnen budgetierbar.

Zeitraffer der Stadtsilhouette mit Lichtspuren in der Dämmerung

Ton inklusive, hochformatbereit

Nativer Dialog, Atmosphäre und Effekte kommen mit dem Bildmaterial; 9:16 Hochformat und 16:9 Breitbild sind beide erstklassig. Die Ausgabe ist ein veröffentlichbarer Clip, kein stummer Entwurf.

Text-to-Video-Clips, die auf dieser Seite entstanden sind

Jeder davon begann als geschriebener Text und sonst nichts. Der Prompt, der ihn erzeugt hat, steht darunter.

PromptSeedance 2.5 · 480p · 16:9 · 4-s-Clip · 440 Credits

A ceramicist in a sunlit workshop looks up from the wheel and speaks warmly to camera: "This one finally came out right." Clay-dusted hands, natural skin texture, shallow depth of field, soft window light, ambient studio room tone.

PromptSeedance 2.0 Mini · 720p · 16:9 · 5-s-Clip · 150 Credits

A golden retriever puppy sprinting across a sunlit meadow toward the camera, ears flapping, slow-motion feel, backlit grass glowing, joyful energy.

PromptKling 3.0 Turbo · 1080p · 16:9 · 5 s · 350 Credits

A parkour athlete vaulting across rooftop gaps at golden hour, dynamic tracking camera, accurate body mechanics and momentum, dust kicked up on landings, cinematic sports energy.

PromptSeedance 2.0 Mini · 720p · 9:16 · 5 s · 150 Credits

Handheld vertical walk through a neon night market, steam rising from food stalls, lanterns swaying, people passing in soft motion blur, lively street ambience.

PromptKling 3.0 Turbo · 720p · 16:9 · 5 s · 275 Credits

Close-up of an elderly fisherman laughing warmly at dusk on a boat deck, wrinkles and windblown hair rendered naturally, genuine expressive performance, handheld documentary feel.

PromptSeedance 2.0 Mini · 480p · 16:9 · 4 s · 60 Credits

Two tiny paper boats racing down a rain-gutter stream after a storm, water rushing over pebbles, playful close follow shot.

PromptKling 3.0 Turbo · 720p · 9:16 · 5 s · 275 Credits

Vertical fashion film: a model in a flowing emerald dress walking toward camera down a rain-slick runway, fabric rippling naturally with each step, confident stride, editorial lighting.

PromptSeedance 2.5 · 480p · 16:9 · 4 s · 440 Credits · die Tafel kam als „SOUPE DU JWIN“ zurück

Close-up of a chef\'s hands rapidly julienning a carrot on a wooden board, knife tapping fast, a handwritten chalkboard menu reading "SOUPE DU JOUR" visible behind, busy kitchen sounds.

Text-zu-Video-Modelle, zwischen denen du wechseln kannst

Eine geschriebene Szene, mehrere Engines – nimm die, deren Bewegung dir gefällt.

Spezifikationen für Text-zu-Video

EingabeNur ein Text-Prompt – kein Bild nötig.
Prompt-SprachenAlle 27 Oberflächensprachen; nicht-englische Prompts werden vor der Generierung angereichert.
Dauer4 bis 30 Sekunden, je nach Modell. Längere Stücke entstehen, indem du einen Clip verlängerst, der dir gefällt.
Auflösung480p und 720p im gesamten Angebot; 1080p und 4K bei Seedance 2.0 standard.
AudioManche Engines erzeugen im selben Durchgang nativ synchronisiertes Audio; andere liefern stumme Clips. Im Panel gekennzeichnet.
KostenPro Sekunde Output, ab 15 Credits/Sekunde in 480p – vollständig angezeigt, bevor du generierst.
Fehlgeschlagene GenerierungenKeine Abrechnung – die Credits bleiben auf deinem Guthaben.

So nutzt du den Text-zu-Video-Generator

Szene schreiben, Engine wählen, generieren.

  1. 1

    Szene schreiben

    Beschreib Motiv, Handlung, Schauplatz und Kamerabewegung. Text-zu-Video-Modelle reagieren auf Kamerasprache – „langsame Dollyfahrt“, „Handkamera“, „Totale“ – weit stärker als Bildmodelle.

  2. 2

    Modell, Dauer und Auflösung wählen

    Jede Text-zu-Video-Engine hat eigene Stärken bei Bewegung und Ton. Abgerechnet wird pro Sekunde, angezeigt vor der Generierung.

  3. 3

    Generieren und weiterarbeiten

    Lad den Clip herunter, verlänger ihn oder bearbeite ihn weiter. Prompt und Einstellungen bleiben im Verlauf hinterlegt.

So schreibst du einen Text-zu-Video-Prompt

Text-zu-Video-Modelle lesen Einstellungsbeschreibungen, keine Szenenzusammenfassungen. Vier Bestandteile, in dieser Reihenfolge.

1

Motiv

Wer oder was im Bild ist, mit einem unterscheidenden Detail.

ein Koch in einer fleckigen weißen Jacke

2

Aktion

Eine Aktion, beschrieben in ihrem Ablauf.

richtet einen Teller an, die Pinzette setzt das letzte Kraut

3

Kamera

Position und Bewegung. Sag es auch dann, wenn die Antwort „keine Bewegung“ lautet.

feststehende Aufsicht von oben

4

Look

Licht, Farbe und Finish.

hartes Küchenlicht, hoher Kontrast, dokumentarisch

Vage

eine Frau geht im Regen

Konkret

eine Frau im langen Mantel geht durch den Abendregen auf die Kamera zu, Schirm nach hinten geneigt, Ladenlichter unscharf hinter ihr, langsame Rückfahrt auf Augenhöhe, geringe Schärfentiefe, kühles Blau mit warmem Fensterlicht

Warum es funktioniert

Die kurze Version nennt ein Motiv und eine Wetterlage und sonst nichts – Kamera, Richtung, Licht und Optik bleiben dem Modell überlassen. Die lange Version legt jedes davon fest, und deshalb liefert sie zweimal dieselbe Einstellung.

Vage

Produktvideo für eine Hautpflege-Flasche

Konkret

eine Serumflasche aus Milchglas dreht sich langsam auf nassem Stein, Kamera feststehend auf Produkthöhe, ein weiches Führungslicht von rechts, Wassertropfen fangen Glanzlichter, Makro, klarer kommerzieller Look

Warum es funktioniert

Produktvideos scheitern weit häufiger am Bildausschnitt und am Licht als am Objekt. Die Kamera festzusetzen, ein Licht zu benennen und Makro zu wählen, gibt dem Modell die drei Entscheidungen, die es sonst raten müsste.

Angewohnheiten, die du ablegen solltest

  • Zu viel Bewegung verlangen. Jede zusätzliche Bewegung ist eine weitere Gelegenheit für das Modell, ein Gesicht oder eine Hand zu verzerren. Eine klare Aktion pro Clip hält viel besser als drei.
  • Die Kamera offenlassen. Wenn du nicht sagst, wie sich die Kamera verhält, entscheidet das Modell – und es entscheidet sich meist fürs Driften. „Feststehende Kamera“ ist eine gültige und nützliche Anweisung.
  • Direkt auf die maximale Dauer gehen. Abweichungen summieren sich mit der Zeit. Generiere erst eine kurze Aufnahme, die dir gefällt, und verlängere sie dann – statt gleich beim ersten Versuch 30 Sekunden zu verlangen.

Über Text-zu-Video hinaus

Prompt-gesteuertes Video ist ein Weg. Referenzbilder, Avatare und Bearbeitung sind die anderen.

Nützliche Ressourcen zu Text-zu-Video-KI

Text-zu-Video: Preise und kostenlose Tages-Credits

Text-zu-Video wird pro Ausgabesekunde abgerechnet. Kostenlose Konten erhalten 80 Credits pro Tag; bezahlte Tarife öffnen die Premium-Engines und längere Laufzeiten.

Kostenlos

$0

Perfekt für den Einstieg

  • 200 Willkommens-Credits, bis zu 80/Tag
  • Z Image Turbo entwirft zu 0 Credits
  • Standard-Generierungsgeschwindigkeit
  • Generierungsverlauf inklusive
Loslegen

Premium

Am beliebtesten
$29/month

Jährliche Abrechnung · 240 $/Jahr

  • 8.000 Credits/Monat, keine Tageslimits
  • Alle Premium-Modelle — GPT Image 2, Nano Banana, Seedream, Seedance, Veo, Kling
  • 5x schnellere Generierung, Prioritäts-Warteschlange
  • KI-Prompt-Verbesserung
Upgrade auf Premium

Ultimate

$49/month

Jährliche Abrechnung · 380 $/Jahr

  • 18.000 Credits/Monat, keine Tageslimits
  • HD-Generierung bis zu 4K-Auflösung
  • Priorisierter Support
  • Schnellste Warteschlange und früher Zugang zu neuen Modellen
Upgrade auf Ultimate

Text-zu-Video – häufige Fragen

1

Wie funktioniert Text-to-Video?

Du beschreibst die Szene — Motiv, Bewegung, Stimmung, Kamera — und ein KI-Videomodell generiert einen Clip von Grund auf, einschließlich nativem Audio. Es wird kein Quellmaterial benötigt.

2

Welches Modell soll ich verwenden?

Seedance 2.0 Fast für erschwingliche Iteration, Seedance 2.0 für Multi-Shot-Geschichten, Veo 3.1 Fast für filmischen Feinschliff in Einzelaufnahmen, Seedance 1.5 Pro, wenn du exakte 1080p-/Dauer-Kontrolle brauchst.

3

Wie lang können die Videos sein?

Etwa 4 bis 15 Sekunden pro Generierung je nach Modell, mit verfügbarer Szenenerweiterung auf Seedance 2.0, um Sequenzen fortzusetzen.

4

Enthalten Clips Audio?

Ja — Seedance und Veo generieren Dialog, Atmosphäre und Effekte nativ. Audio kann bei Seedance für einen niedrigeren Sekundentarif deaktiviert werden.

5

Wie viel kostet es?

Pro Sekunde, variierend mit Modell, Auflösung und Audio — immer vor der Generierung angezeigt, mit automatischer Erstattung bei Fehlschlägen.

6

Wie schreibe ich einen guten Video-Prompt?

Benenne das Motiv, die Aktion, die Kulisse, die Stimmung und die Kamerabewegung. Der integrierte Prompt-Enhancer erweitert kurze Ideen automatisch zu gut strukturierten Video-Briefings.

7

Kann ich Hochformat-Videos für TikTok und Reels machen?

Ja — wähle 9:16 pro Generierung für vertikale Plattformen oder 16:9 für YouTube und Web.

8

Wie schreibe ich einen guten Text-zu-Video-Prompt?

Trenn Motiv, Handlung und Kamera. „Ein Koch richtet ein Gericht an“ ist ein Motiv; „langsame Fahrt auf einen Koch, der ein Gericht anrichtet, geringe Schärfentiefe, warmes Küchenlicht“ ist eine Einstellung. Text-zu-Video-Modelle folgen dem Zweiten weit zuverlässiger.

9

Kann Text-zu-Video Dialoge und Ton erzeugen?

Bei den Engines mit nativem Ton ja – einschließlich synchroner Sprache. Andere liefern stumme Clips. Was wozu gehört, ist im Modellpanel markiert, bevor du Credits ausgibst.

10

Warum entfernt sich mein Text-zu-Video-Clip vom Prompt?

Längere Laufzeiten driften stärker ab, weil das Modell mehr Frames füllen muss und weniger Halt hat. Kürzere Clips folgen dem Prompt enger; wenn du Länge brauchst, generier lieber eine kurze gelungene Aufnahme und verlänger sie, statt gleich 30 Sekunden zu verlangen.

Schreib einen Absatz — premiere einen Clip

Beginne mit dem Generieren von Videos

Entdecke unsere Ein-Klick-KI-Videotools

Ein-Klick-Tools für alles rund um die Generierung — verfeinern, umstylen, teilen.