Prompt schreiben
Beschreiben Sie Motiv, Kamerabewegung, Licht und Stimmung.

Noch kein Video erstellt
Gib einen Prompt ein und starte die Generierung
Beschreiben Sie Motiv, Kamerabewegung, Licht und Stimmung.
Optional bis zu zwei Bilder für ersten und letzten Frame anhängen.
5, 10 oder 15 Sekunden wählen, dazu eines von fünf Seitenverhältnissen.
Ergebnis prüfen, Prompt anpassen und erneut generieren.
4
Eingabemodalitäten
Text · Bild · Video · Audio
2K
Native Modellausgabe
Offizielle Modellfähigkeit
24
Bilder pro Sekunde
Filmischer Bewegungsrhythmus
5–15s
Clips mit Ton
Site-Vorgaben: 5 / 10 / 15 s
Modell / 01
MiniMax H3 ist MiniMax offenes, allgemein einsetzbares multimodales Videomodell. Es nimmt Text, Bilder, Video und Audio entgegen und erzeugt im selben Durchgang natives 2K-Material mit 24 fps, inklusive Dialog, Soundeffekten und Umgebungsgeräuschen.
Fertigstellen / 02
Ein Ergebnis direkt an ein Bearbeitungswerkzeug übergeben oder einen Clip hochladen, um ihn zu verbessern, zu tauschen oder umzulenken.
KI-Videos verbessern und schärfen, bis in höhere Auflösung.
Ein Gesicht für autorisierte kreative oder Lokalisierungsarbeiten ersetzen.
Einen Kopf bei erhaltener Quellbewegung austauschen.
Bewegung und Kamerasprache mithilfe eines Referenzclips umlenken.
Den Gesichtstausch-Workflow auf Standbilder anwenden.
Omni-Reference / 03
MiniMax H3 kann Identität, Bewegung, visuellen Stil und Klangrichtung in einer einzigen Generation kombinieren.
Natives 2K-Video + synchronisierter Ton
Beispiele / 04
Sechs MiniMax-H3-Beispiele aus Markenfilm, Mixed-Media-Kreativität, Narrativ, Produktwerbung, Interface-Motion und stilisierter Animation.
Ein filmisches Modekonzept, das Figur, Produkt, Setting und Kamerasprache aufeinander abstimmt.
Realfilm-Aufnahmen verschmelzen mit leuchtender Handzeichnung und Umgebungsgeräuschen.
Ein vertikaler Trailer baut Charakterkontinuität, Spannung und eine shotübergreifende Dramaturgie auf.
Ein schneller Mode-Edit hält das Produkt lesbar, während Gesichter und Kadrierung variieren.
Ein Produktinterface wird mit räumlichen Übergängen zu einer polierten Interaktionsdemo.
Markante englische Typografie und ein Graphic-Novel-Heldenauftritt ergeben einen kompakten Trailer-Beat.
Technische Daten / 05
Anwendungsfälle / 06
Cinematics, Charakter-PVs und animierte UI-Konzepte mit stabiler visueller Identität.
Ton, Pixel Art, Anime und 3D-Fantasy mit konsistentem Look über alle Shots.
Produktstillleben in Demonstrationen, Erklärvideos und Kampagnenkonzepte verwandeln.
Kurze Konzepte für Social, Display- und Connected-TV-Kampagnen.
Trailer, Markenfilme und Kurzdramen mit Kamerasprache und Ton inszenieren.
Hochformatige Clips für Shorts, Reels und TikTok-taugliches Storytelling.
Vergleich / 07
| Fähigkeit | MiniMax H3 | Hailuo 2.3 |
|---|---|---|
| Maximale Auflösung | Nativ 2K | 1080P |
| Maximale Länge | 15 Sekunden | 10 Sekunden |
| Nativer Ton | Ja | Nein |
| Referenzeingaben | Bilder + Video + Audio | Erster Frame |
| Prompt-Limit | 7.000 Zeichen | 2.000 Zeichen |
| Gewichte | Offen | Geschlossene API |
Prompt-Labor / 08
Einen Prompt kopieren und oben in den Generator einfügen. MiniMax H3 ist bereits ausgewählt.
Ein einsamer Reisender steigt auf einer Wüstenautobahn aus einem Vintage-Coupé und hebt eine Ledertasche in den Wind. Beginn mit einer weiten Verfolgungsfahrt, Übergang zu taktilen Produktdetails, warmes Abendlicht, zurückhaltendes Motorengeräusch und Wüstenatmosphäre.
In einer ruhigen Küche stellt eine Hand ein Glas auf die Arbeitsplatte, und leuchtend handgezeichnete Ranken breiten sich vom Berührungspunkt aus. Handykadrierung, natürliches Morgenlicht, dezente Raumstimme und ein weiches Glitzern, während die Skizzenanimation wächst.
Ein junger Vampir und ein menschlicher Ermittler treffen unter einer regennassen Bahnhofsuhr aufeinander, während in der Ferne ein Zug einfährt. Von einer unruhigen Zweieraufnahme zu Nahaufnahmen, blauer Mondschein und rote praktische Lichter, Regen- und Bahngeräusche, endend auf ihrem festen Blick.
Erstellen Sie eine vertikale Brillenkampagne mit drei selbstbewussten Models, die ein Paar silberne Brillen durch Match Cuts weiterreichen. Klares Studiolicht, schnelle Push-ins, rhythmische Auslösergeräusche und cleanes Grafikdesign; Enden mit einem zentrierten Produkt-Hero-Shot.
Verwandeln Sie eine schwebende KI-Assistenten-Karte in eine hochwertige Website-Interaktionsdemo. Die Karte expandiert zu einem mehrschichtigen Workspace, Panels rasten mit sanftem Parallax ein, kühle Farbverläufe und leise Interface-Sounds, endend mit dem fertigen Dashboard.
Ein Schwertkultivierender überquert eine Wolkenbrücke, während Geisterkraniche einen fernen Bergtempel umkreisen. Ein schwingender Kranschwenk in eine schnelle Seitwärtsfahrt, leuchtender Nebel, 3D-Fantasy in Teal und Gold, Wind- und Glockenatmosphäre, endend, wenn das Tempeltor aufgeht.
Regie / 09
H3 reagiert am besten, wenn ein Prompt Veränderung über die Zeit steuert – nicht nur ein Standbild. Geben Sie jedem dieser sechs Elemente eine klare Aufgabe.
Motiv und Absicht
Benennen Sie das Hauptmotiv, sein Ziel und die Details, die erkennbar bleiben müssen.
Aktion über die Zeit
Beschreiben Sie den Anfangszustand, die zentrale Bewegung oder Veränderung und wie der Shot enden soll.
Szene und Reaktion
Legen Sie Ort, Wetter und Atmosphäre fest und erklären Sie, wie die Umgebung auf die Aktion reagiert.
Kamerasprache
Wählen Sie Kadrierung und Bewegung – Weit, Nah, Handheld, Verfolgung, Kran oder einen bewussten Übergang.
Look und Ton
Steuern Sie Licht, Palette und Textur zusammen mit Dialog, Atmosphäre, Effekten oder musikalischem Rhythmus.
Referenzkonsistenz
Sagen Sie, was jede Referenz steuert – Identität, Produkt, Komposition, Bewegung oder Stil – und was nicht verändert werden darf.
FAQ / 10
MiniMax H3 ist ein allgemein einsetzbares multimodales Videomodell von MiniMax. Es kann Text und Referenzmedien interpretieren, Bewegung über einen Shot hinweg planen und Video mit synchronisiertem Dialog, Effekten und Atmosphäre generieren.
Im üblichen Produktgebrauch beziehen sich beide auf dieselbe Modellfamilie. MiniMax H3 ist der offizielle Modellname; Hailuo 3 ist der Name, den viele Nutzer und Drittanbieter-Tools verwenden, um die Verbindung zu früheren Hailuo-Versionen herzustellen.
Dieser Generator bietet Clips mit 5, 10 und 15 Sekunden. Beschreiben Sie für einen kurzen Clip einen einzigen klaren Handlungsbogen statt mehrere unzusammenhängende Szenen hineinzupacken.
Ja. H3 kann Dialog, Soundeffekte und Umgebungsgeräusche gemeinsam mit den Bildern generieren. Geben Sie im Prompt Sprecher, exakte gesprochene Zeile, Umgebung und gewünschte Klangtextur an, wenn der Ton wichtig ist.
Dieser Generator bietet 480P, 720P und 1080P mit den Verhältnissen 16:9, 9:16, 4:3, 3:4 und 1:1. Wählen Sie 9:16 für vertikale Social-Videos, 16:9 für horizontales Storytelling und 1:1, wenn das Zielformat ein Quadrat verlangt.
Omni-Reference ist die Fähigkeit von H3, Bilder, Video und Audio als koordinierte Leitplanken für Identität, Bewegung, visuellen Stil und Ton zu nutzen. Diese Seite bietet aktuell Text-zu-Video plus Führung über Erst- und Letztframe-Bilder – einen fokussierten Teilbereich des vollen Modells.
MiniMax beschreibt H3 als Modell mit offenen Gewichten. Selbst-Hosting erfordert weiterhin passende GPU-Kapazität, Modelldateien und einen kompatiblen Inferenz-Stack; diese Seite ist der einfachere gehostete Weg für gelegentliche Generierung.
Gegenüber Hailuo 2.3 bringt H3 nativen synchronisierten Ton, reichere multimodale Referenzsteuerung, längere Anweisungen, eine höhere native Auflösung und offene Gewichte mit. Der praktische Vorteil: mehr Kontrolle über einen kompletten Shot, nicht nur über einen besseren ersten Frame.
Sie können einen Prompt schreiben und Referenzbilder vorbereiten, ohne sich anzumelden. Ein Klick auf „Video kostenlos generieren“ öffnet den Konto-Dialog; neue Konten erhalten 20 Credits, genug für zwei Standard-Generierungen mit 480P und 5 Sekunden.
Schreiben Sie zuerst Motiv und Ziel, dann die Handlung der Reihe nach, die Umgebung, Kamerabewegung, Licht und Ton sowie den Schlussframe. Eine kohärente Abfolge gibt dem Modell meist klarere Richtung als eine Liste unzusammenhängender visueller Adjektive.
Verwenden Sie einen ersten Frame, wenn Eröffnungskomposition, Figur oder Produkt präzise sein müssen. Fügen Sie einen letzten Frame hinzu, wenn der Shot an einer bestimmten Komposition ankommen soll; Ihr Prompt sollte die Bewegung erklären, die beide Bilder verbindet.
Die Generierungszeit variiert mit Cliplänge, Auflösung und Auslastung der Warteschlange. Nach Annahme der Aufgabe wird ihr Status in Ihrem Kontoverlauf gespeichert; halten Sie die Seite für den Live-Fortschritt offen oder rufen Sie später die Verlaufsseite auf.
Eine fehlgeschlagene Aufgabe zeigt einen konkreten Fehler, wenn der Anbieter einen zurückgibt. Für eine nicht erfolgreiche Aufgabe reservierte Credits werden automatisch erstattet; bleibt ein Status hängen, verwenden Sie beim Support die Aufgaben-ID.
Die kommerzielle Nutzung hängt von den Modell- und Dienstbedingungen sowie den Rechten an jedem Prompt, Logo, Gesicht, jeder Stimme und jedem Referenz-Asset ab, die Sie bereitstellen. Generierung räumt automatisch keine Urheber-, Marken-, Persönlichkeits- oder Stimmrechte ein.
Verwenden Sie nur Medien, die Ihnen gehören oder deren Bearbeitung Ihnen erlaubt ist. Nicht autorisierte Identitätstäuschung und irreführende Nutzung sind untersagt.
Registrieren Sie sich, sichern Sie sich 20 Credits und generieren Sie auf dieser Seite Ihr erstes Video mit Ton.