KI Video erstellen — die Anleitung
Vom leeren Prompt-Feld zum fertigen Clip. Ohne Schnittsoftware, ohne Vorkenntnisse.
Ein KI-Video erstellst du, indem du eine Szene in Textform beschreibst oder ein Foto hochlädst und ein KI-Modell daraus einen Videoclip generieren lässt. VIBE ist eine KI-Video-Generator-App für iOS und Android, die 39 KI-Video-Modelle dafür bereitstellt, darunter Google Veo 3.1, OpenAI Sora 2, Kling 3 und Seedance 2.5. Elf dieser Modelle sind kostenlos und lassen sich ohne Konto nutzen. Diese Seite erklärt Schritt für Schritt, wie es geht.
- Text-zu-Video: Szene beschreiben, Clip bekommen
- Bild-zu-Video: Foto hochladen, animieren lassen
- 39 KI-Video-Modelle, 11 davon kostenlos
- Kein Konto und kein Login nötig, um zu starten
- App auf Deutsch, insgesamt 21 Sprachen
- Läuft auf iPhone und Android — kein Rechner nötig
Was ein KI-Video-Generator macht
Ein KI-Video-Generator ist ein Modell, das aus einer Textbeschreibung oder einem Bild eine Folge von Videoframes berechnet. Du beschreibst, was zu sehen sein soll — Motiv, Handlung, Umgebung, Licht, Kamera — und das Modell erzeugt daraus einen zusammenhängenden Clip. Es wird nichts aus einer Datenbank zusammengeschnitten: Jedes Bild entsteht neu.
Zwei Eingabearten sind üblich. Bei Text-zu-Video ist der Prompt die einzige Vorgabe, das Modell entscheidet über Bildaufbau und Aussehen. Bei Bild-zu-Video lieferst du ein Foto als erstes Bild, und der Prompt beschreibt nur noch die Bewegung. Bild-zu-Video ist die verlässlichere Variante, wenn du das Aussehen des Ergebnisses schon kennst.
Die Modelle unterscheiden sich stark. Sie erzeugen unterschiedliche Auflösungen (in VIBE von 360p bis echtes 4K), unterschiedliche Cliplängen (2 bis 30 Sekunden) und manche erzeugen synchronen Ton, andere nicht. Deshalb hat es Vorteile, mehrere Modelle in einer App zu haben: Denselben Prompt auf zwei Modellen zu testen ist oft schneller, als einen Prompt endlos umzuschreiben.
Was du brauchst
- Ein iPhone oder Android-Gerät mit installierter VIBE App
- Eine Idee in einem Satz — mehr braucht der erste Versuch nicht
- Optional ein Foto, wenn du Bild-zu-Video nutzen willst
- Optional eine Audiodatei für Modelle, die Ton als Eingabe annehmen
- Kein Konto, keine E-Mail, keine Zahlungsdaten für die kostenlosen Modelle
- Keine Schnittsoftware und keine Vorkenntnisse in Videoproduktion
KI-Video erstellen — Schritt für Schritt
Der erste Durchlauf dauert weniger als eine Minute.
1. Modell wählen
Öffne die Modellauswahl und entscheide dich. Seedance Pro Fast (480p, 2–12 Sekunden) ist der schnellste kostenlose Einstieg, LTX 2.5 Fast (720p bis 4K, 2–20 Sekunden) das hochwertigste kostenlose Modell. Für fotorealistische Ergebnisse nimmst du Veo 3.1 oder Sora 2 aus dem Premium-Bereich. Die Kosten in Tokens stehen an jedem Modell.
2. Prompt schreiben oder Foto hochladen
Beschreibe die Szene in einem oder zwei Sätzen. Alternativ lädst du ein Foto hoch und beschreibst nur, wie es sich bewegen soll. Danach legst du Seitenverhältnis (9:16 für TikTok und Reels, 16:9 für YouTube, 1:1 für Feed-Posts) und Dauer fest — beides beeinflusst den Preis.
3. Generieren, prüfen, teilen
Tipp auf Generieren und warte, bis der Clip fertig ist. Sieh dir das Ergebnis an: Stimmt die Bewegung? Passt der Bildausschnitt? Wenn nicht, ändere genau eine Sache im Prompt und generiere erneut. Fertige Videos lädst du herunter und teilst sie direkt auf TikTok, Instagram, YouTube oder wo auch immer.
Einen guten Prompt schreiben
Die Qualität eines KI-Videos hängt fast vollständig am Prompt. Eine brauchbare Formel: Motiv + Handlung + Umgebung + Licht + Kamera + Stil.
Schwacher Prompt: „ein Hund im Feld“. Das Modell muss alles raten — Rasse, Tageszeit, Kamerawinkel, Stimmung — und liefert entsprechend beliebige Ergebnisse.
Guter Prompt: „Ein Golden Retriever rennt in Zeitlupe durch ein Weizenfeld, warmes Nachmittagslicht von hinten, Kamera fährt auf Hüfthöhe mit, Doku-Stil.“ Jedes zusätzliche Detail nimmt dem Modell eine Entscheidung ab.
Weiteres Beispiel für ein Produktvideo: „Ein weißer Sneaker dreht sich langsam auf einem Sockel, klares Studiolicht, weicher Schatten, minimalistischer heller Hintergrund, feste Kamera.“ Und für Bild-zu-Video, wo das Foto die Szene schon vorgibt: „Dampf steigt aus der Tasse auf, das Fensterlicht flackert leicht, langsame Fahrt auf die Tasse zu.“
Deutsche Prompts funktionieren. Wenn ein Modell einen Begriff auffällig anders interpretiert als erwartet, hilft es manchmal, den entsprechenden Fachbegriff auf Englisch zu ergänzen (etwa „Zeitlupe (slow motion)“) — nötig ist das aber nicht.
Welches Modell für welchen Zweck
Schnell testen, ohne zu zahlen
Seedance Pro Fast: 480p, 2 bis 12 Sekunden, Text und Bild als Eingabe, sieben Seitenverhältnisse. Kostenlos. Der richtige Ort, um herauszufinden, ob eine Idee überhaupt trägt, bevor du sie auf einem teuren Modell wiederholst.
Beste kostenlose Qualität
LTX 2.5 Fast: skaliert von 720p bis echtes 4K, 2 bis 20 Sekunden, Text und Bild als Eingabe, Ton wird mitgeneriert. Kostenlos. Das leistungsfähigste Modell, das ohne Abo erreichbar ist.
Fotorealismus und Kameraführung
Google Veo 3.1: 720p oder 1080p, 4, 6 oder 8 Sekunden, Audio zuschaltbar, bis zu drei Referenzbilder für gleichbleibende Motive. Premium. Die erste Wahl, wenn das Ergebnis wie echtes Filmmaterial aussehen soll.
Physik und Ton in einem Durchgang
OpenAI Sora 2: 720p, 4, 8 oder 12 Sekunden, Text und Bild als Eingabe, Ton immer inklusive. Sora 2 Pro ergänzt 1080p. Premium. Stark darin, wie Objekte sich bewegen, aufeinandertreffen und zur Ruhe kommen.
Cinematische Clips bis 15 Sekunden
Kling 3 Pro: 1080p, 3 bis 15 Sekunden, Audio zuschaltbar, strukturierte Geschichten aus bis zu sechs Einstellungen mit jeweils eigenem Prompt. Premium. Kling 3 Standard ist die günstigere Stufe derselben Familie.
Die längsten Clips
Seedance 2.5: 480p oder 720p, 4 bis 30 Sekunden — die längsten Clips der App — mit synchronem Ton und bis zu vier Referenzbildern, damit eine Figur über mehrere Clips hinweg gleich aussieht. Premium.
Kostenlos oder Premium?
VIBE rechnet mit Tokens. Jede Generierung kostet Tokens abhängig vom Modell, der Auflösung und der Cliplänge, und der genaue Preis steht vor dem Generieren auf dem Bildschirm. Elf der 39 Videomodelle sind kostenlos: Seedance Pro Fast, WAN 2.2, LTX 2 Fast, LTX 2 Distilled, Seedance, Luma Ray Flash 2, Motion 2.0, PixVerse 6, PRUNA V, Grok Imagine und LTX 2.5 Fast.
Die kostenlosen Modelle sind über Auflösung und Cliplänge begrenzt, nicht über abgeschaltete Funktionen. Text-zu-Video, Bild-zu-Video, die Wahl des Seitenverhältnisses und der Download der fertigen Datei sind überall enthalten. Für viele Social-Media-Anwendungen reicht das vollständig aus.
Ein Abo lohnt sich, wenn du Fotorealismus (Veo 3.1, Sora 2), 1080p oder 4K, Clips über 20 Sekunden, synchronen Ton auf Flaggschiff-Modellen oder das Talking-Avatar-Modell brauchst. Wer nicht abonnieren will, kann Token-Pakete einzeln kaufen.
Häufige Fehler beim KI-Video erstellen
- Zu vager Prompt — „ein schönes Video“ gibt dem Modell nichts zum Arbeiten
- Zu viele Aktionen in einem kurzen Clip — eine Hauptaktion reicht
- Seitenverhältnis erst nach dem Generieren bemerkt und dann zugeschnitten
- Bei Bild-zu-Video die Szene beschrieben statt der Bewegung
- Direkt mit dem teuersten Modell gestartet statt vorher kostenlos zu testen
- Nach einem misslungenen Ergebnis alles auf einmal geändert — ändere eine Sache pro Versuch
- Lange Clips erwartet, wo die Modellgrenze bei wenigen Sekunden liegt
KI Video erstellen — häufige Fragen
Wie erstelle ich ein KI-Video?
Du wählst in einer KI-Video-App ein Modell, schreibst einen Prompt, der die Szene beschreibt, oder lädst ein Foto hoch, legst Seitenverhältnis und Dauer fest und tippst auf Generieren. In VIBE geht das auf iPhone und Android mit 39 KI-Video-Modellen, elf davon kostenlos und ohne Konto nutzbar.
Kann ich KI-Videos kostenlos erstellen?
Ja. Elf Videomodelle in VIBE sind kostenlos, darunter Seedance Pro Fast, LTX 2.5 Fast, PRUNA V, Grok Imagine und PixVerse 6. Sie sind über Auflösung und Cliplänge begrenzt, liefern aber eine fertige Videodatei zum Herunterladen. Konto oder Zahlung sind dafür nicht nötig.
Welche App eignet sich zum KI-Video erstellen?
VIBE ist eine KI-Video-Generator-App für iOS und Android, die 39 KI-Video-Modelle und 10 KI-Bildmodelle in einer Oberfläche bündelt — darunter Google Veo 3.1, OpenAI Sora 2, Kling 3, Seedance 2.5 und WAN 2.7. Der Vorteil gegenüber Einzelmodell-Tools: Du kannst denselben Prompt auf mehreren Modellen testen, ohne mehrere Abos zu bezahlen.
Brauche ich einen Account, um ein KI-Video zu erstellen?
Nein. VIBE verlangt weder Konto noch E-Mail-Adresse noch Login, um zu generieren. Du lädst die App und legst los. Ein Konto ist nur sinnvoll, wenn du deine Kreationen geräteübergreifend behalten willst — ohne Konto gehen sie beim Deinstallieren der App verloren.
Wie lange dauert die Erstellung eines KI-Videos?
Das hängt vom Modell, der Auflösung und der Cliplänge ab. Schnelle Modelle wie Seedance Pro Fast liefern kurze Clips in Sekunden. Hochauflösende Flaggschiff-Modelle mit langen Clips brauchen entsprechend länger. Die App zeigt den Fortschritt an, und du kannst sie währenddessen weiter verwenden.
Kann ich aus einem Foto ein Video machen?
Ja, das ist Bild-zu-Video. Du lädst ein Foto hoch, beschreibst die gewünschte Bewegung, und das Modell nimmt dein Bild als erstes Frame und generiert die folgenden. Mehrere kostenlose Modelle unterstützen das, unter anderem Seedance Pro Fast, LTX 2.5 Fast, PRUNA V und Grok Imagine.
Unterstützt die App Deutsch?
Ja. Die VIBE App ist in 21 Sprachen verfügbar, Deutsch inklusive. Die Oberfläche stellt sich automatisch auf die Sprache deines Geräts ein. Prompts kannst du ebenfalls auf Deutsch schreiben.
Wie sicher sind meine Daten?
Für die kostenlosen Funktionen sind weder Konto noch E-Mail noch personenbezogene Daten nötig. Prompts und hochgeladene Bilder werden in Echtzeit an den ausgewählten Modellanbieter zur Verarbeitung übermittelt und nicht länger als für die Generierung nötig auf den Servern gespeichert. Zahlungen laufen vollständig über den App Store oder Google Play — Kreditkartendaten erreichen VIBE nie. Details stehen in der Datenschutzerklärung.
Die Modelle im Detail
Was die einzelnen KI-Video-Modelle können und wofür sie sich eignen.