- il y a 10 minutes
Découvre les offres Pollo AI : https://cutt.ly/zyxCfmSo
Seedance 2.5, Wan 3.0 et MiniMax H3 Max : j'ai soumis exactement le même prompt aux trois modèles vidéo IA, sur six tests, pour voir lequel s'en sort le mieux et surtout à quel prix.
Même prompt, mêmes références, 15 secondes, 1080p, first try à chaque fois. Les six séquences mises bout à bout racontent une histoire, et vous retrouvez le montage complet de chaque modèle à la fin de la vidéo.
Le coût pour une vidéo de 15 secondes en 1080p au moment du tournage :
Seedance 2.5 : 360 crédits
Wan 3.0 : 180 crédits
MiniMax H3 Max : 150 crédits
Tous les tests ont été réalisés sur Pollo AI, partenaire de cette vidéo. Les trois modèles y sont disponibles, ainsi que les générateurs d'images utilisés pour les références (Nano Banana Pro et GPT Image 2.5).
Voir les offres Pollo AI : https://cutt.ly/zyxCfmSo
Vidéo sponsorisée par Pollo AI. Le protocole de test et les classements sont les miens, aucun modèle n'a été favorisé.
Seedance 2.5, Wan 3.0 et MiniMax H3 Max : j'ai soumis exactement le même prompt aux trois modèles vidéo IA, sur six tests, pour voir lequel s'en sort le mieux et surtout à quel prix.
Même prompt, mêmes références, 15 secondes, 1080p, first try à chaque fois. Les six séquences mises bout à bout racontent une histoire, et vous retrouvez le montage complet de chaque modèle à la fin de la vidéo.
Le coût pour une vidéo de 15 secondes en 1080p au moment du tournage :
Seedance 2.5 : 360 crédits
Wan 3.0 : 180 crédits
MiniMax H3 Max : 150 crédits
Tous les tests ont été réalisés sur Pollo AI, partenaire de cette vidéo. Les trois modèles y sont disponibles, ainsi que les générateurs d'images utilisés pour les références (Nano Banana Pro et GPT Image 2.5).
Voir les offres Pollo AI : https://cutt.ly/zyxCfmSo
Vidéo sponsorisée par Pollo AI. Le protocole de test et les classements sont les miens, aucun modèle n'a été favorisé.
Catégorie
🤖
TechnologieTranscription
00:02ça c'est du sitdance 2.5 c'est beau c'est précis et ça coûte cher
00:17ça c'est du one 3.0
00:27et ça c'est du minimax h3 max
00:34ces deux derniers modèles ils sont peut-être un cran en dessous de sitdance 2.5
00:39mais au niveau du prix ça n'a rien à voir
00:41donc si on prend d'un côté le coût de création et de l'autre les résultats
00:46il y a une vraie question qui se pose pour les créateurs spécialisés dans la vidéo IA
00:50quel modèle, pour quel projet, à quel prix
00:53c'est ce qu'on va voir dans cette vidéo
00:55pour cette vidéo on va travailler sur une séquence de film IA
00:58et c'est dans la lignée de la séquence qu'on a vue en introduction
01:01à chaque génération on va soumettre exactement la même chose à nos trois modèles
01:05mais d'abord un petit rappel sur les caractéristiques de chacun
01:07sitdance 2.5 jusqu'à 30 secondes en une seule génération
01:11jusqu'à 50 références en entrée
01:1330 images, 10 vidéos, 10 pistes audio
01:16pour l'instant on monte à 1080p en résolution maximale
01:19avec un audio en natif
01:20WAN 3.0 jusqu'à 30 secondes
01:231080p en résolution maximum audio natif
01:27il accepte lui aussi de l'image de la vidéo et de l'audio en référence
01:3110 images, 5 vidéos, 5 pistes audio
01:33et une fonction que les deux autres n'ont pas
01:35tu peux lui mettre en référence une page web ou un document
01:39il existe aussi une version WAN 3.0 Prime
01:42c'est exactement le même modèle avec une meilleure vitesse de génération
01:45Prime est plus rapide mais il coûte aussi plus cher en crédit
01:48donc pour ce test on va rester sur la version classique
01:51Minimax H3 Max
01:52là c'est 15 secondes maximum
01:54H3 Max c'est en fait le modèle Minimax H3 classique
01:58qui a été réentraîné pour qu'il suive mieux les consignes
02:01et qu'il soit plus rapide à la génération
02:03on l'a choisi à la place du H3 classique car il affiche de meilleures performances
02:07selon les plateformes où il est présent
02:09il peut monter jusqu'à 1080p avec l'audio en natif
02:1312 fichiers max au total en référence
02:16ça sera 9 images maximum
02:173 vidéos maximum
02:193 audio maximum
02:20et donc un mélange avec 12 fichiers au maximum en référence
02:24et pour la réalisation de tous mes tests avec ces modèles
02:26je suis passé par la plateforme Polo AI
02:29c'est d'ailleurs le partenaire de cette vidéo
02:31sur Polo AI les 3 modèles sont disponibles
02:33et il y a en plus tous les autres modèles vidéo et images IA
02:38pour la vidéo on a donc du Seed Dance, du One et du Minimax
02:42à chaque fois les versions les plus récentes
02:44celles qu'on va tester
02:44mais aussi les versions antérieures
02:47et je peux citer encore d'autres modèles
02:48comme Vio de Google ou Kling
02:50comme je le disais il y a aussi tous les modèles pour la génération d'images
02:53CipDream, Nano Banana Pro ou encore le dernier GPT-Image 2.5
02:58et dès qu'un modèle est mis à jour
03:00il est immédiatement disponible sur Polo AI
03:02sur la plateforme plein d'autres fonctionnalités
03:04et même la possibilité d'utiliser Polo AI en MCP
03:07mais ici on va se concentrer sur la génération vidéo
03:09Niveau tarif, si je prends le détail des offres
03:12en Lite on a 400 crédits
03:13l'accès à tous les modèles
03:15et jusqu'à 2 générations en simultané
03:17en Pro ça va de 800 à 3000 crédits
03:19jusqu'à 5 générations en simultané
03:21l'abonnement Ultra démarre à 5000 crédits
03:23jusqu'à 6 générations simultané
03:26je te remets le lien pour accéder à Polo AI
03:28et consulter les offres d'abonnement
03:30en description et commentaire épinglé
03:32Voilà à toi de faire ton choix niveau abonnement
03:34et pour le nombre de vidéos qu'il est possible
03:36de générer avec les crédits il y a une indication à chaque fois sur la grille de tarifs
03:41sachant que ça va dépendre avant tout des modèles que tu vas utiliser
03:44et justement dans ce test on va détailler le coût en crédit de chaque modèle
03:48on reviendra un peu plus tard sur cette donnée
03:50voici les règles pour qu'on soit au niveau d'équité maximum
03:54même prompt sur les trois modèles
03:56à chaque fois je me suis aidé de Claude pour écrire des promptes précis
04:00sans jamais lui demander de favoriser un modèle
04:03les images de référence qu'on va utiliser ont été générées
04:06avec Nano Banana Pro et GPT Image 2.5
04:10on l'a fait d'ailleurs depuis Polo AI
04:12on va se limiter à 6 références par vidéo
04:15et pareil pour la durée ça va être 15 secondes maximum
04:18tous les modèles savent le faire
04:19et on aura une résolution de 1080p pour toutes les vidéos
04:23et j'ai pensé mes tests pour que les vidéos mises bout à bout racontent une histoire
04:27donc à la fin de la vidéo je te mettrai les résultats complets
04:30pour voir ainsi quel modèle s'en sort le mieux dans la globalité du projet
04:33premier test
04:34est-ce que nos modèles savent écrire ?
04:37on va le voir avec un prompt où plusieurs plans s'enchaînent
04:40la façade extérieure avec une lettre du néon qui doit grésiller
04:44Solène notre serveuse qui prépare un meal check
04:47l'horloge digitale au mur qui doit passer de 11h32 à 11h33
04:52un plan sur le néon à l'intérieur du dîner
04:54et le client qui tapote avec ses doigts en gros plan
04:56pour la création de vidéos sur PoloAI c'est très simple
05:00tu te rends dans vidéos
05:01nous on va travailler en référence en vidéos
05:04avec plus on va directement voir nos créations
05:08pour mettre les images qu'on a créées depuis PoloAI
05:10et on peut aussi importer des médias extérieurs si on en a
05:14donc des vidéos, des sons ou des images
05:16donc là je te donne un exemple rapide pour notre premier prompt
05:18je vais dans mes créations
05:19je vais avoir besoin de l'extérieur du dîner
05:22de l'intérieur
05:24de la serveuse Solène
05:26et de notre client Henri
05:28je sélectionne
05:29je vais récupérer le prompt que j'ai préparé sur Cloud
05:33et par contre je vais faire en sorte de bien indiquer mes références
05:36donc à chaque fois que je parle d'une des références
05:39arrobas
05:39et là je peux choisir l'image de référence
05:45pour Solène on sélectionne bien Solène
05:47pour l'intérieur du dîner pareil
05:49on sélectionne bien la référence
05:52voilà une fois que notre prompt est prêt
05:55on peut sélectionner ici le modèle
05:58donc on va commencer sur Seed Dance 2.5
06:00le format on va être en 16 neuvième
06:02le nombre de secondes à 15 secondes
06:05pour une résolution à 1080p
06:06et un seul résultat
06:08une fois que c'est prêt on valide
06:09sachant qu'ici on a le nombre de crédits
06:12qui va être dépensé pour notre génération
06:14et qui est calculé par rapport à nos paramètres
06:16donc pour du Seed Dance 2.5
06:1816 neuvième, 15 secondes et 1080p
06:21on est à 360 crédits
06:23voilà je valide
06:24et ça ça va être notre résultat pour Seed Dance 2.5
06:43voyons ce que ça donne cette fois-ci avec One
07:00et maintenant avec Minimax H3 Max
07:18Pour ce premier test j'ai envie de proposer ce classement
07:21One 3.0 arrive à faire clignoter le haut de l'enseigne au début
07:24mais il bloque sur la scène de l'horloge en revenant en arrière
07:28Minimax H3 Max s'en sort bien
07:30mais ce qui me dérange le plus c'est les personnages assez statiques
07:33sur le premier plan à travers la vitrine
07:35le reste c'est très cool
07:36même si on le constate
07:38le modèle est en dessous niveau qualité d'image
07:41Seed Dance 2.5 loupe la lettre qui clignote à l'entrée
07:45mais le reste est maîtrisé
07:47et mention spéciale pour la préparation du milkshake
07:49très propre surtout par rapport à ce que les deux autres ont proposé
07:53Deuxième scène, deuxième test
07:55cette fois on se concentre sur la physique
07:57et on va ajouter une contrainte de caméra bien précise
08:00ce qu'on attend
08:01ouverture sur un gros plan sur le milkshake
08:03effet tracking parfait sur le milkshake
08:05on le voit tomber et s'éclater au sol en slow motion
08:08et on finit par un peu d'humour
08:10voyons ce que ça donne
08:11le résultat d'abord avec Seed Dance 2.5
08:28Apportez-moi un café à la place
08:29avec WAN 3.0
08:44Apportez-moi un café à la place
08:46avec Minimax H3 Max
08:59Apportez-moi un café à la place
09:01Pour le deuxième test, le classement est sans appel
09:04la maîtrise est parfaite sur Seed Dance
09:06le cadrage, la chute au ralenti
09:08et l'éclatement au sol c'est parfait
09:11et la réplique à la fin marche bien aussi
09:13WAN c'est pas mal aussi
09:14mais l'attitude de la serveuse n'est pas très naturelle
09:17par contre Minimax H3 Max
09:19il a clairement échoué
09:20je précise pour ces tests
09:21je suis en first try
09:23donc un seul essai chacun
09:25après ce genre de problème
09:26peut tout à fait disparaître
09:28après plusieurs générations
09:29cette fois-ci c'est les dialogues en français
09:31avec l'audio natif des modèles qu'on va tester
09:34on ne donne aucune voie de référence
09:36on va voir comment les acteurs jouent
09:38et si le français est maîtrisé
09:40ce qu'on attend
09:40le respect du texte
09:42le jeu des acteurs
09:43on a donné des indications de jeu dans le prompt
09:45la cohérence de la scène
09:46par rapport au test précédent
09:48et notamment la présence du Milchek par terre
09:51voyons ce que ça donne
09:52d'abord le résultat avec Seed Dance 2.5
09:59et voilà mon bon prince
10:06merci princesse ton café n'est pas dégueulé
10:08bon maintenant il faut que je nettoie ce foutage
10:10avec One 3.0
10:16et voilà mon bon prince
10:21merci princesse ton café n'est pas dégueulé
10:24bon maintenant il faut que je nettoie ce foutoir
10:28avec Minimax H3 Max
10:42bon là niveau classement Seed Dance 2.5 déçoit par rapport aux français
10:47dommage car le reste était très bien
10:49One c'est vraiment bien
10:51mais niveau cohérence il m'oublie un bout de comptoir
10:54et là pour le coup c'est Minimax H3 Max
10:56qui fait un sans faute
10:57alors encore une fois
10:58c'est pas la plus belle qualité d'image
11:00mais il fait moins d'erreurs que les autres
11:02nouveau test avec une scène clé
11:05la scène la plus importante de notre séquence
11:07et ça va également être le plan le plus chargé de tout le test
11:106 références en tout
11:123 personnages sur le plan
11:13on a beaucoup d'indications sur le jeu des acteurs
11:15les effets présents
11:16il va y avoir un gros plan en ouverture
11:19un mouvement de tête rapide de notre client Henry
11:21un ralenti sur l'entrée de l'intrus
11:24avec un retour à vitesse normale
11:26et on finit par une réplique de Solène
11:28ce qu'on attend
11:29compréhension de la complexité du prompt
11:31bon positionnement des personnages
11:33respect de la variation du rythme
11:35cohérence globale pour une scène complexe
11:38voyons ce que ça donne
11:39ça c'est le résultat avec Seed Dance 2.5
11:53bon je vais refaire du café
11:56avec WAN 3.0
12:10bon je vais refaire du café
12:13avec Minimax H3 Max
12:31alors là sans surprise
12:32dès qu'il y a de la complexité
12:34c'est Seed Dance qui s'en sort le mieux
12:36l'effet est maîtrisé
12:38la scène est vraiment réussie
12:39Minimax H3 Max c'est pas mal encore
12:42avec notamment ce coup de tonnerre
12:44au bon moment
12:44et WAN 3.0
12:46c'est encore trop fouillis
12:48avec trop d'erreurs
12:49si esthétiquement WAN rivalise quand même
12:51avec Seed Dance 2.5
12:53il produit quand même
12:54beaucoup d'incohérences
12:56pour ce test
12:57j'ai voulu refaire la scène
12:58mais dans un style différent
12:59donc j'ai testé le style animé
13:01sur les trois modèles
13:02ce qu'on attend de notre test
13:04une adaptation parfaite
13:06en style animé
13:07de la fluidité
13:08et le respect des références
13:09sachant qu'en référence
13:11on a nos personnages
13:13mais en mode animé
13:14voyons ce que ça donne
13:15ici le résultat
13:16avec Seed Dance 2.5
13:30Bon
13:30je vais refaire du café
13:32avec WAN 3.0
13:49avec Minimax H3 Max
14:04Bon
14:05je vais refaire du café
14:07alors là
14:07il y a vraiment débat
14:08parce que
14:09les trois sont bien
14:10mais celui qui m'a procuré
14:11le plus d'émotion
14:12c'est Minimax H3 Max
14:14ce coup de tonnerre
14:15au moment du climax
14:16il est vraiment top
14:17et je ne l'ai pas vraiment indiqué
14:19dans le prompt
14:19c'est à l'initiative du modèle
14:21vraiment super
14:22les deux autres
14:23j'ai du mal à les départager
14:24mais je pense que je mettrai
14:25WAN avant Seed Dance
14:26après il reste très proche
14:28enfin
14:29dernier test
14:30je vais donner
14:30un audio de référence
14:32qu'on a créé en amont
14:33sur Eleven Labs
14:36ça va nous permettre
14:38de tester le lip sync
14:39et surtout
14:40voir comment chaque modèle
14:42traite un audio de référence
14:44et là ce qu'on attend
14:45c'est tout simplement
14:45la bonne utilisation
14:46de l'audio de référence
14:47le respect du texte
14:49du tempo
14:49et de la voix
14:50ça c'est le résultat
14:51avec Seed Dance 2.5
14:56ça c'est le résultat
14:57avec WAN 3.0
15:08c'est tellement dommage
15:10parce qu'en fait
15:10Seed Dance ne va pas
15:12reprendre l'audio
15:12il va cloner la voix
15:14et du coup
15:14il tente de prononcer
15:16le texte
15:17que j'ai donné
15:17tout en gardant
15:18l'ambiance sonore
15:19de la scène
15:20le problème
15:21c'est qu'il maîtrise mal
15:23le français
15:23le fait de cloner
15:24l'échantillon de la voix
15:26c'est pourtant
15:26la bonne méthode
15:27parce qu'on conserve vraiment
15:28l'ambiance de la scène
15:30sauf que vraiment
15:30avec Seed Dance
15:31le français ça passe pas
15:33j'espère que les prochaines versions
15:34connaîtront une amélioration
15:36sur ce point
15:36en attendant
15:37c'est parfaitement maîtrisé
15:39par WAN et Minimax H3
15:41sauf que du coup
15:41quand on donne les références
15:42cette fois-ci
15:43ils coupent tous les bruits
15:44d'arrière-plan
15:45et utilisent la référence
15:47telle qu'elle
15:47du coup c'est beaucoup moins naturel
15:49alors quelle conclusion faire
15:50sur ces trois modèles
15:51en fait tout dépend du projet
15:53si je veux faire un truc quali
15:55et que je suis prêt
15:55à retravailler
15:56sur les dialogues
15:57tous les jours
15:58je choisis
15:59Seed Dance 2.5
16:00WAN 3.0
16:02lui tente de rivaliser
16:03en qualité d'image
16:04avec Seed Dance
16:05et gère de son côté
16:06plutôt bien
16:07les dialogues
16:07directement inscrits
16:08dans le prompt
16:09mais trop d'incohérence
16:10et un manque de précision
16:12par rapport à son concurrent
16:13Minimax H3 Max
16:14sur l'ensemble de ce test
16:16il se plante vraiment uniquement
16:18sur la scène de la serveuse
16:20avec le mille check
16:20pour le reste
16:21il m'a plutôt bluffé
16:22par contre
16:23c'est pas un modèle
16:24que je choisirais
16:25pour sa qualité d'image
16:26mais pour un projet
16:27par exemple
16:27pour les réseaux sociaux
16:28on va chercher
16:29la rentabilité
16:31ça devient un modèle
16:32très intéressant
16:33à utiliser
16:34pour 15 secondes
16:35et 1080p
16:36j'en ai eu
16:36pour 360 crédits
16:38pour Seed Dance 2.5
16:40comparé aux 180 crédits
16:41pour WAN 3.0
16:43et 150 pour Minimax H3 Max
16:45ça laisse à réfléchir
16:47n'hésite pas
16:48à aller consulter
16:48les offres Polo AI
16:49je te mets le lien
16:50en description
16:51et commentaire épinglé
16:52j'espère que ce test
16:53t'aura permis
16:54de mieux voir
16:54ce que tous ces modèles
16:56avaient dans le ventre
16:57pour moi
16:57chacun a un usage
16:58selon le calibre
17:00de ton projet
17:01et pour finir
17:01voici l'ensemble
17:03des séquences
17:04assemblées par modèle
17:05une bonne façon
17:06d'observer
17:06la cohérence
17:07et la qualité
17:08de chacun
17:08merci
17:09et à bientôt
17:10sur le Labo des Résons
17:44apportez-moi un café
17:45à la place
17:51et voilà mon bon prince
17:57merci princesse
17:58ton café n'est pas déguré
17:59bon maintenant
18:00il faut que je nettoie
18:00ce foutage
18:13bon je vais refaire du café
18:19elle est où la malaise
18:20Henry
18:37il faut que je n'aime
18:40tué
18:49Galaxy
18:50je suis
19:07Apportez-moi un café à la place.
19:13Et voilà, mon bon prince.
19:18Merci, princesse. Ton café n'est pas dégueu.
19:21Bon, maintenant, il faut que je nettoie ce foutoir.
19:36Bon, je vais refaire du café.
19:40Elle est où, la mallette, Henri ?
19:43Bon, c'est parti.
19:46Bon, c'est parti.
19:53Bon, c'est parti.
19:56Bon, c'est parti.
20:30Apportez-moi un café à la place.
20:37Et voilà, mon bon prince.
20:42Merci, princesse. Ton café n'est pas dégueu.
20:44Bon, maintenant, il faut que je nettoie ce foutoir.
21:01Bon, je vais refaire du café.
21:08Elle est où, la mallette, Henri ?
21:10Bon, c'est parti.
21:10Bon.
Commentaires