Des guides de modèles écrits à partir de nos mesures, des comparatifs honnêtes, des workflows qui tiennent la route et des notes de l’intérieur de LUVI.
LUVI Creator est une plateforme web où vous générez vidéos, images, audio et 3D avec 223 modèles d’IA de 30 familles, depuis un seul compte, en crédits. Générations en parallèle, références réutilisables et workflows font gagner du temps ; des guides de prompt pour 18 familles veillent au résultat.
Hailuo reçoit sa direction de caméra sous forme de commande entre crochets, prise dans une liste fermée de quinze et posée là où le mouvement a lieu. Le modèle ne produit que l’image : chaque mot consacré au son est perdu. Six secondes démarrent à 380 crédits.
Transformer un script en présentateur demande deux générations : un modèle de voix lit le texte, puis un modèle de lip-sync pose cet audio sur un visage. L'étape voix est assez peu chère pour être refaite dix fois, l'étape visage non. Voici l'ordre qui économise les crédits.
Wan 3.0 lit une formule qui s’additionne : entité, décor, mouvement, puis l’optique, puis le son. L’audio est généré dans le même passage. Sans caméra nommée à chaque plan, le modèle coupe au milieu du clip. Cinq secondes démarrent à 400 crédits en 480p.
LUVI compte six familles de lip-sync, et elles font deux métiers : quatre animent un portrait fixe à partir d'une piste audio, deux resynchronisent la bouche d'une vidéo que vous avez déjà. Le métier décide aussi de l'horloge facturée, secondes d'audio ou secondes de vidéo.
Sur les modes image vers 3D de Hunyuan3D, le champ de texte n'est pas lu : le contrat du modèle indique qu'il n'accepte aucun prompt. Tout votre contrôle tient à la préparation de l'image d'entrée. Les maillages démarrent à 600 crédits sur Rapid et 1 000 sur Pro.
Le bouton plume à côté du prompt passe le manuel de la famille sur ce que vous avez écrit, gratuitement. Il a deux couches : huit vérifications déterministes qui ne se déclenchent que sur ce que le manuel peut prouver, et une réécriture de dialecte pour ce qui relève du jugement.
Seedream 5.0 Pro n'a pas de paramètre de format. La forme de l'image se règle dans size, écrit LARGEUR*HAUTEUR avec une astérisque, et un format tapé dans le texte est ignoré. Voici les treize tailles valides, l'interrupteur thinking et la phrase que le modèle récompense. À partir de 144 crédits.
Quatre des 224 modèles du catalogue LUVI exposent un champ de prompt négatif, et tous sont des Qwen Image. Le champ a disparu avec la méthode d'échantillonnage dont il dépendait. Voici ce qui le remplace dans chaque famille et les trois endroits où « no X » fonctionne encore.
Une plateforme IA multi-modèles réunit dans un seul espace de travail, sur un seul solde, des modèles vidéo, image, audio et 3D issus de nombreux laboratoires. Pour la choisir, regardez les versions exactes proposées, le prix affiché avant chaque génération et l’aide au prompt pour chaque modèle.
Higgsfield, Krea, OpenArt et LUVI Creator ont tous un connecteur MCP hébergé qui permet à Claude ou à ChatGPT de générer sur votre compte. Ce qui les distingue : le prix affiché ou non avant la génération, le nombre de modèles et l’accès de l’assistant au guide de prompt de chaque modèle.
Nano Banana Pro régénère l'image entière à chaque retouche : une consigne sans clause de préservation modifie donc des choses que vous n'avez jamais demandées. Dites ce qui change et ce qui reste, et désignez les références par Image 1. La retouche démarre à 175 crédits en 1k.
La plupart des modèles vidéo de LUVI fabriquent désormais leur son en même temps que l'image, mais ils divergent sur tout le reste : interrupteur activé ou non, surcoût ou non, et façon d'écrire l'audio. Voici l'interrupteur et la syntaxe de chaque famille, vérifiés sur leurs schémas.
HappyHorse fabrique l'image et le son ensemble, mais il ne déduit pas le son de ce qu'il voit : un prompt sans ligne audio renvoie une vidéo quasi muette. C'est aussi l'un des rares modèles vidéo à respecter les repères temporels des plans, exactement l'inverse de Seedance 2.5.
FLUX 3 Video fabrique l'image et le son en une seule passe : l'audio s'écrit donc dans le prompt au lieu de s'activer. Mettez chaque réplique entre guillemets et donnez-lui quelqu'un de visible pour la dire, sinon elle peut s'afficher en texte sur l'image. Sur LUVI, à partir de 1 870 crédits.
Seedance 2.5 lit des repères en secondes entières, des canaux audio typés et un seul mouvement de caméra par plan. La plupart des mauvais résultats viennent d’un prompt écrit comme pour Seedance 2.0. Voici la structure qui fonctionne, tirée du guide que nous appliquons dans LUVI.
Un plan Kling 3 s'écrit dans cet ordre : sujet, mouvement, décor, puis caméra, lumière et atmosphère. Comptez 60 à 100 mots, un seul mouvement de caméra et une seule action. Le prompt entier est plafonné à 2 500 caractères, et un dépassement fait échouer l'envoi.
Un prompt Veo 3.1 efficace commence par la caméra, puis le sujet, l’action, le décor et le style, avec le son décrit dans la scène. Sur LUVI, la Génération audio est désactivée par défaut et absente de Veo 3.1 Lite. Un clip de 8 secondes en 720p coûte à partir de 800 crédits.
Les trois génèrent image et son en un seul passage, et aucun ne lit le prompt comme les autres : H3 attend un document à champs, Omni une légende avec une clause de continuité, Wan une formule additive. Les prix, les limites, et la règle qui fait échouer chacun d’eux.
Une photo de bouteille prise au téléphone devient un visuel studio propre avec Nano Banana Pro, puis un clip de cinq secondes avec mouvement et son sur Seedance 2.5. Le tout câblé dans un seul workflow, estimé avant de tourner, à partir d’environ 3 200 crédits.
Avant chaque génération, LUVI affiche une estimation en crédits. Depuis la mi-septembre, le débit est calé sur ce que le travail a réellement consommé, et plafonné à l’estimation. Ce qui a changé, ce que nous avons mesuré, et pourquoi un modèle est passé de 15 à 7 crédits.
Les photos HEIC d’iPhone échouaient dans Chrome, le WebP déroutait la moitié des modèles, et un décodeur navigateur mettait 27 secondes sur une photo de 12 mégapixels. Conversion déplacée côté serveur, avec une règle : chaque image est stockée en JPEG ou en PNG, couleur et orientation intactes.