Hailuo reçoit sa direction de caméra sous forme de commande entre crochets, prise dans une liste fermée de quinze et posée là où le mouvement a lieu. Le modèle ne produit que l’image : chaque mot consacré au son est perdu. Six secondes démarrent à 380 crédits.
Wan 3.0 lit une formule qui s’additionne : entité, décor, mouvement, puis l’optique, puis le son. L’audio est généré dans le même passage. Sans caméra nommée à chaque plan, le modèle coupe au milieu du clip. Cinq secondes démarrent à 400 crédits en 480p.
Sur les modes image vers 3D de Hunyuan3D, le champ de texte n'est pas lu : le contrat du modèle indique qu'il n'accepte aucun prompt. Tout votre contrôle tient à la préparation de l'image d'entrée. Les maillages démarrent à 600 crédits sur Rapid et 1 000 sur Pro.
Seedream 5.0 Pro n'a pas de paramètre de format. La forme de l'image se règle dans size, écrit LARGEUR*HAUTEUR avec une astérisque, et un format tapé dans le texte est ignoré. Voici les treize tailles valides, l'interrupteur thinking et la phrase que le modèle récompense. À partir de 144 crédits.
Une plateforme IA multi-modèles réunit dans un seul espace de travail, sur un seul solde, des modèles vidéo, image, audio et 3D issus de nombreux laboratoires. Pour la choisir, regardez les versions exactes proposées, le prix affiché avant chaque génération et l’aide au prompt pour chaque modèle.
Nano Banana Pro régénère l'image entière à chaque retouche : une consigne sans clause de préservation modifie donc des choses que vous n'avez jamais demandées. Dites ce qui change et ce qui reste, et désignez les références par Image 1. La retouche démarre à 175 crédits en 1k.
HappyHorse fabrique l'image et le son ensemble, mais il ne déduit pas le son de ce qu'il voit : un prompt sans ligne audio renvoie une vidéo quasi muette. C'est aussi l'un des rares modèles vidéo à respecter les repères temporels des plans, exactement l'inverse de Seedance 2.5.
FLUX 3 Video fabrique l'image et le son en une seule passe : l'audio s'écrit donc dans le prompt au lieu de s'activer. Mettez chaque réplique entre guillemets et donnez-lui quelqu'un de visible pour la dire, sinon elle peut s'afficher en texte sur l'image. Sur LUVI, à partir de 1 870 crédits.
Seedance 2.5 lit des repères en secondes entières, des canaux audio typés et un seul mouvement de caméra par plan. La plupart des mauvais résultats viennent d’un prompt écrit comme pour Seedance 2.0. Voici la structure qui fonctionne, tirée du guide que nous appliquons dans LUVI.
Un plan Kling 3 s'écrit dans cet ordre : sujet, mouvement, décor, puis caméra, lumière et atmosphère. Comptez 60 à 100 mots, un seul mouvement de caméra et une seule action. Le prompt entier est plafonné à 2 500 caractères, et un dépassement fait échouer l'envoi.
Un prompt Veo 3.1 efficace commence par la caméra, puis le sujet, l’action, le décor et le style, avec le son décrit dans la scène. Sur LUVI, la Génération audio est désactivée par défaut et absente de Veo 3.1 Lite. Un clip de 8 secondes en 720p coûte à partir de 800 crédits.