Hailuo nimmt die Kameraführung als Befehl in eckigen Klammern entgegen, aus einer geschlossenen Liste von fünfzehn, gesetzt an die Stelle, an der die Bewegung passiert. Das Modell erzeugt nur Bild: Jedes Wort über Ton ist verschenkt. Sechs Sekunden beginnen bei 380 Credits.
Wan 3.0 liest eine Formel, die sich aufbaut: Motiv, Schauplatz, Bewegung, dann die Optik, dann der Ton. Den Ton generiert es im selben Durchgang. Benennst du die Kamera nicht in jeder Einstellung, schneidet das Modell mitten in den Clip, den du als eine Einstellung wolltest.
In den Bild-zu-3D-Modi von Hunyuan3D wird das Textfeld gar nicht gelesen: Der Modellvertrag sagt, dass kein Prompt angenommen wird. Deine gesamte Kontrolle steckt darin, wie du das Eingabebild vorbereitest. Meshes starten bei 600 Credits auf Rapid und 1000 auf Pro.
Seedream 5.0 Pro hat keinen Parameter für das Seitenverhältnis. Die Form steckt in size, geschrieben als BREITE*HÖHE mit Sternchen; ein Verhältnis im Text wird ignoriert. Hier stehen die dreizehn gültigen Größen, der thinking-Schalter und der Satzbau, den das Modell belohnt.
Eine Multi-Modell-KI-Plattform bündelt Video-, Bild-, Audio- und 3D-Modelle vieler Anbieter in einem Arbeitsbereich mit einem Guthaben. Worauf es bei der Wahl ankommt: genaue Modellversionen, ein Preis vor jeder Generierung und Hilfe beim Prompten für jedes einzelne Modell.
Nano Banana Pro erzeugt bei jeder Bearbeitung das ganze Bild neu. Eine Anweisung ohne Erhaltungssatz verändert deshalb Dinge, nach denen du nie gefragt hast. Sag, was sich ändert und was bleibt, und sprich Referenzen als Image 1 an. Bearbeitung ab 175 Credits in 1k.
HappyHorse erzeugt Bild und Ton zusammen, leitet den Ton aber nicht aus dem Bild ab: Ein Prompt ohne Audiozeile liefert ein fast stummes Video. Außerdem gehört das Modell zu den wenigen, die Zeitmarken pro Einstellung einhalten – genau umgekehrt zu Seedance 2.5.
FLUX 3 Video erzeugt Bild und Ton in einem Durchgang. Der Ton wird deshalb in den Prompt geschrieben und nicht per Schalter zugeschaltet. Setz jede Replik in Anführungszeichen und gib ihr jemanden im Bild, der sie sagt, sonst kann sie als Text im Bild erscheinen. Ab 1870 Credits auf LUVI.
Eine Einstellung schreibst du bei Kling 3 in dieser Reihenfolge: Subjekt, Bewegung, Schauplatz, danach Kamera, Licht und Atmosphäre. 60 bis 100 Wörter, eine Kamerabewegung, eine Handlung. Der ganze Prompt ist bei 2.500 Zeichen gedeckelt, und darüber scheitert schon das Absenden.
Kommt bei Veo 3.1 kein Ton, ist auf LUVI meist die Audiogenerierung aus: standardmäßig deaktiviert, bei Veo 3.1 Lite gar nicht vorhanden. Den Prompt baust du von der Kamera her auf, Dialog und Geräusche gehören in die Szene. Ein 8-Sekunden-Clip in 720p kostet ab 800 Credits.
Seedance 2.5 liest Zeitmarken in ganzen Sekunden, typisierte Audiokanäle und eine Kamerabewegung pro Einstellung. Die meisten schlechten Ergebnisse entstehen, weil das Modell wie Seedance 2.0 gepromptet wird. Hier ist die Struktur, die funktioniert – aus dem Leitfaden, den wir in LUVI einsetzen.