Workflows
Vom Skript zur sprechenden Moderation: erst die Stimme, dann die Lippensynchronität
Aus einem Skript eine Moderation zu machen sind zwei Generierungen: Ein Stimmmodell liest den Text, ein Lipsync-Modell legt diesen Ton auf ein Gesicht. Der Stimmschritt ist billig genug für zehn Versuche, der Gesichtsschritt nicht. Hier steht die Reihenfolge, die Credits spart.

