Une idée → un court-métrage
Créer un film

Meilleure IA image-vidéo en 2026 : 10 modèles et apps comparés

Comparatif honnête des meilleures IA image-vidéo en 2026 : Seedance 2.5, Kling 3.0, Wan 3.0, Veo 3.1, Runway, Luma… avec prix à la seconde, prompts de mouvement et solutions aux défauts.

Guide42 min de lecture

Créez votre Influenceur IA

Rejoignez plus de 300 000 créateurs qui gagnent avec du contenu généré par IA. Aucune compétence technique requise.

Commencer à créer

La meilleure IA image-vidéo est celle qui garde ta photo intacte en la mettant en mouvement. Cela paraît évident, mais c'est le critère que la plupart des comparatifs oublient. Un modèle texte-vidéo se juge à son imagination ; un modèle image-vidéo se juge à sa retenue. Tu as déjà choisi le visage, le produit, la lumière et le cadrage quand tu as créé la photo. Le rôle du modèle est d'ajouter un mouvement crédible sans rien redessiner.

Ce guide compare dix options : six modèles de pointe facturés à la seconde (Seedance 2.5 et son niveau Turbo de ByteDance, Kling 3.0 de Kuaishou, Wan 3.0 et Wan 2.6 Flash d'Alibaba, Veo 3.1 et Gemini Omni 1.1 Flash de Google) et quatre applications grand public souvent comparées à eux (Runway, Luma, Pika et Hailuo). Pour chaque modèle que nous hébergeons, les durées, résolutions, options audio et la prise en charge de l'image de fin proviennent des définitions de modèles qui font tourner le produit, et les prix sont les tarifs publics des fournisseurs tirés de notre manifeste de tarification, vérifiés le 29 septembre 2026 sauf mention contraire. Les plans des applications tierces ont été vérifiés sur la page tarifaire publique de chaque éditeur et sont marqués « vérifié en septembre 2026 ». Quand nous n'avons pas pu confirmer un chiffre sur la page de l'éditeur, nous le disons plutôt que de deviner.

Une photographie portrait imprimée sur un bureau à côté d'un moniteur montrant le même cadre animé en séquence vidéo

Illustration éditoriale du workflow image-vidéo, et non une capture d'écran d'un produit réel.

Transparence de l'éditeur

MakeInfluencer.ai publie ce guide et héberge sept des modèles comparés ici (Seedance 2.5, Seedance 2.5 Turbo, Kling 3.0, Wan 3.0, Wan 2.6 Flash, Veo 3.1 Fast et Gemini Omni 1.1 Flash) dans son studio et son API. Nous ne créons aucun de ces modèles : ils sont conçus par ByteDance, Kuaishou, Alibaba et Google. Nous décrivons les applications tierces uniquement d'après ce que disent leurs pages publiques, et nous citons leurs points forts même quand elles nous concurrencent. Garde cela en tête en lisant nos recommandations, et utilise le test d'un après-midi vers la fin de la page pour les vérifier toi-même.

Un mot sur Sora 2 : OpenAI a arrêté son API Vidéo le 24 septembre 2026, donc Sora 2 et Sora 2 Pro ne sont recommandés nulle part dans ce guide. Si un comparatif que tu lis classe encore Sora 2 parmi les options image-vidéo de production, il a été écrit avant cet arrêt.

En bref

Si tu n'as qu'une minute, voici le classement du secteur en septembre 2026 :

  • Meilleure qualité et meilleur contrôle globaux : Seedance 2.5 de ByteDance. Jusqu'à 30 secondes par génération, du 480p à la 4K, audio natif, images de début et de fin. C'est aussi le plus cher à la seconde.
  • Meilleure façon d'itérer sur Seedance : Seedance 2.5 Turbo, la même plage de 4 à 30 secondes en 720p ou 1080p pour 0,20 à 0,22 $ la seconde au lieu de 0,36 à 0,90 $.
  • Meilleur prix à la seconde avec audio : Wan 3.0 d'Alibaba. 2 à 30 secondes, audio natif, contrôle de l'image de fin, 0,10 $ la seconde en 720p.
  • Mouvement le moins cher : Wan 2.6 Flash d'Alibaba, 0,025 $ la seconde en 720p sans audio. C'est le moyen le moins cher de vérifier qu'une image s'anime bien, dans le studio image-vidéo.
  • Idéal pour les plans courts de personnages, très dirigés : Kling 3.0 de Kuaishou, avec des durées de 3, 5, 10 et 15 secondes, des prompts négatifs et une couche son optionnelle.
  • Idéal pour les clips soignés de 8 secondes avec son : Veo 3.1 Fast de Google, 4, 6 ou 8 secondes en 720p ou 1080p.
  • Meilleur brouillon économique : Gemini Omni 1.1 Flash de Google en 360p à 0,03 $ la seconde, puis nouveau rendu du meilleur essai en 720p, 1080p ou 4K.
  • Meilleure application de montage bâtie autour de son propre modèle : Runway, qui associe Gen-4.5 à un éditeur et à une allocation de départ gratuite.
  • Meilleurs abonnements multi-modèles : Luma et Pika proposent désormais d'autres modèles, dont Seedance 2.5, en plus des leurs.
  • À tester pour la danse et les mouvements expressifs : Hailuo de MiniMax, dont le site met désormais en avant le modèle MiniMax H3.
$0.125
5 s en 720p, Wan 2.6 Flash $1.00 5 s en 720p, Seedance 2.5 Turbo 30 s Clip unique le plus long, Seedance 2.5 et Wan 3.0 $0.025 Par seconde, Wan 2.6 Flash en 720p sans audio

Comment nous avons comparé les IA image-vidéo

Chaque outil de cette liste sait animer une photo. Les différences qui comptent en pratique sont plus fines que ne le laisse croire le marketing : nous avons donc jugé chaque option selon six critères.

  1. Préservation de l'identité. Le visage, l'étiquette produit ou le logo restent-ils les mêmes de la première à la dernière image ? C'est la qualité la plus importante en image-vidéo, et celle qui échoue le plus souvent.
  2. Qualité du mouvement. Les mains, les tissus et les cheveux sont-ils physiquement plausibles ? La caméra se déplace-t-elle comme une vraie caméra, ou flotte-t-elle ?
  3. Durée par génération. Les clips courts sont peu coûteux à corriger. Les clips longs font gagner du temps de montage, mais multiplient le coût d'une erreur.
  4. Résolution et rapport d'aspect. 9:16 pour TikTok, Reels et Shorts ; 16:9 pour YouTube et le web ; 1:1 ou 4:5 pour les flux et pages produit.
  5. Audio. L'audio natif (ambiance, bruits de pas, dialogue) évite une étape de sound design, mais il a un coût, et tu le remplaces souvent de toute façon.
  6. Contrôle de l'image de fin. Fournir à la fois une image de début et une image de fin transforme la génération, de loterie, en interpolation. C'est la fonction la plus sous-exploitée de la catégorie.

Le prix est un septième critère, et le plus facile à mesurer. Les modèles de pointe sont facturés à la seconde de sortie : nous indiquons donc le tarif public du fournisseur à la seconde et le coût d'un clip représentatif. MakeInfluencer.ai convertit ces prix en crédits et affiche le coût exact en crédits avant chaque génération ; le détail complet se trouve dans le guide des tarifs des modèles vidéo IA.

Tableau de comparaison image-vidéo

Les lignes de modèles reprennent le tarif public du fournisseur vérifié le 29 septembre 2026 (les prix de Kling 3.0 et de Veo 3.1 Fast ont été vérifiés pour la dernière fois le 21 mai 2026). Les lignes d'applications indiquent le plan payant le moins cher affiché sur la page tarifaire de l'éditeur, vérifié en septembre 2026.

OptionÉditeurDurée du clip (i2v)RésolutionAudioImage de finPrix
Seedance 2.5ByteDance4 à 30 s480p, 720p, 1080p, 4KNatif, activé par défautOui0,18 $ / 0,36 $ / 0,90 $ / 1,80 $ par s
Seedance 2.5 TurboByteDance4 à 30 s720p, 1080pNatif, activé par défautOui0,20 $ / 0,22 $ par s
Kling 3.0 Standard et ProKuaishou3, 5, 10 ou 15 sNiveaux Standard et ProSon optionnel, coûte 1,5xOuiStandard 0,084 $ par s sans audio, Pro 0,112 $ par s sans audio
Wan 3.0Alibaba2 à 30 s480p, 720p, 1080pNatif, activé par défautOui0,05 $ / 0,10 $ / 0,20 $ par s
Wan 3.0 PrimeAlibaba2 à 30 s480p, 720p, 1080pNatifOui0,075 $ / 0,15 $ / 0,30 $ par s
Wan 2.6 FlashAlibaba2 à 15 s720p, 1080pOptionnel, double le prixNon0,025 $ par s en 720p sans audio
Veo 3.1 FastGoogle4, 6 ou 8 s720p, 1080pOptionnelOui0,10 $ par s sans audio, 0,15 $ avec audio
Gemini Omni 1.1 FlashGoogle3 à 10 s360p, 720p, 1080p, 4KToujours activéOui0,03 $ / 0,10 $ / 0,15 $ / 0,30 $ par s
RunwayRunwayDépend du modèleDépend du modèleDépend du modèleDépend du modèleGratuit : 125 crédits uniques. Standard 15 $/mois
LumaLuma AIDépend du modèleDépend du modèleDépend du modèleDépend du modèleAucun plan gratuit affiché. Plus 30 $/mois
PikaPikaDépend du modèleDépend du modèleDépend du modèleDépend du modèlePlan gratuit avec packs de crédits uniquement. Starter 10 $/mois
HailuoMiniMaxNon indiqué sur la page d'accueilNon indiqué sur la page d'accueilNon indiquéNon indiquéPlans illisibles sur la page de l'éditeur lors de la vérification

Trois tendances se dégagent. D'abord, l'écart de prix est énorme : un clip de 5 secondes en 720p coûte 0,125 $ sur Wan 2.6 Flash et 1,80 $ sur Seedance 2.5, soit 14 fois plus pour la même durée. Ensuite, seuls Seedance 2.5 et Wan 3.0 atteignent 30 secondes en une seule passe image-vidéo. Enfin, les applications grand public revendent de plus en plus les modèles d'autres sociétés : les pages tarifaires de Luma et de Pika listent toutes deux Seedance 2.5, et celle de Runway liste Seedance 2.0 et Kling 3.0 à côté de son propre Gen-4.5. En choisissant une application, tu choisis souvent autant une couche de facturation et une interface qu'un modèle.

1. Seedance 2.5 (ByteDance) : le meilleur choix global

Seedance 2.5 est le modèle que nous choisirions en premier quand le plan compte. En mode image-vidéo, il prend une image de début et une image de fin optionnelle, génère 4 à 30 secondes en une seule passe et produit en 480p, 720p, 1080p ou 4K. L'audio natif est activé par défaut. Le format d'image suit celui de ton image d'entrée.

Ce qu'il fait mieux que tous les autres de cette liste, c'est conserver une composition sur un long clip. Sur un plan de 20 secondes d'une personne qui marche vers la caméra dans une rue animée, le visage, la veste et l'arrière-plan ont bien plus de chances de tenir jusqu'à la dernière image qu'avec les modèles d'entrée de gamme, alors que c'est précisément là que les longs clips image-vidéo décrochent. Il gère aussi une action en plusieurs étapes décrite dans un seul prompt (« elle prend la tasse, boit une gorgée, la repose et regarde par la fenêtre ») sans écraser les étapes les unes sur les autres.

Prix. Le tarif public du fournisseur est de 0,18 $ la seconde en 480p, 0,36 $ en 720p, 0,90 $ en 1080p et 1,80 $ en 4K. Un clip de 5 secondes en 720p coûte 1,80 $ ; un clip de 10 secondes en 1080p coûte 9,00 $. Seedance 2.5 est facturé uniquement sur la sortie : l'audio n'ajoute donc rien au prix.

Images de référence. Seedance 2.5 accepte jusqu'à 30 images de référence, appelées dans le prompt par @Image 1, @Image 2, etc. Sur MakeInfluencer.ai, ces références alimentent le mode texte-vidéo ; dès que tu importes une image de début, c'est elle (et l'image de fin optionnelle) qui ancre l'identité. Si un personnage doit apparaître dans une nouvelle scène dont tu n'as pas de photo, génère d'abord la scène avec des références, ou crée la photo avec GPT Image 2.5 puis anime-la.

Points faibles. Le coût. En 1080p, c'est l'option la plus chère à la seconde de cette liste, et itérer sur un prompt à plein tarif fait vite fondre le budget. Plusieurs fournisseurs décrivent aussi les niveaux 1080p et 4K comme un upscale à partir d'une résolution native inférieure : considère donc le 720p comme la résolution de travail naturelle pour les réseaux sociaux.

Idéal pour. Les plans héros, les longs plans-séquences, les scènes centrées sur des personnages et tout ce qui sera vu en plein écran. Le guide de l'API Seedance 2.5 couvre les cinq modes de Seedance 2.5, dont Video Extend et Talking Avatar.

Un clip image-vidéo Seedance 2.5 Turbo animé à partir d'une image de storyboard créée avec GPT Image 2.5.

2. Seedance 2.5 Turbo (ByteDance) : le meilleur rapport qualité-prix de Seedance

Seedance 2.5 Turbo utilise la même interface image-vidéo que le modèle standard : image de début, image de fin optionnelle, 4 à 30 secondes, audio natif activé par défaut. Les différences portent sur la résolution (720p ou 1080p uniquement) et sur le prix : 0,20 $ la seconde en 720p et 0,22 $ en 1080p. En 1080p, cela représente environ un quart du tarif du modèle standard.

En pratique, Turbo est la façon dont la plupart des gens devraient utiliser Seedance. Fais le brouillon de chaque idée sur Turbo en 720p et 5 secondes, ce qui coûte 1,00 $ par essai. Quand le mouvement, le rythme et la préservation de l'identité te semblent justes, garde le rendu Turbo (souvent largement suffisant pour les réseaux sociaux) ou relance le prompt gagnant sur Seedance 2.5 standard à la durée finale.

Brouillon d'abord, rendu final ensuite

C'est dans les itérations que part le budget image-vidéo. Si un plan demande six essais pour être réussi, six brouillons Turbo en 720p et 5 secondes coûtent 6,00 $. Six essais Seedance 2.5 standard en 1080p et 10 secondes coûteraient 54,00 $. Brouillon économique, puis un seul rendu coûteux.

Idéal pour. Les pubs de style UGC, les clips sociaux et tout projet en volume. C'est le modèle que nous choisirions pour un rythme de publication quotidien.

3. Kling 3.0 (Kuaishou) : idéal pour les plans courts de personnages dirigés

Kling 3.0 existe en deux niveaux, Standard et Pro, et génère sur MakeInfluencer.ai 3, 5, 10 ou 15 secondes à partir d'une image de début avec une image de fin optionnelle, en 16:9, 9:16 ou 1:1. Il accepte aussi un prompt négatif en image-vidéo, utile pour supprimer des artefacts précis (« doigts en trop, tremblement de caméra, texte »). Le son est optionnel et facturé en supplément.

La force de Kling, c'est le mouvement physique dirigé chez les personnes : un tour de tête, un mouvement de cheveux, une main levée pour saluer, un pas en avant. C'est aussi la famille de modèles derrière l'outil dédié de contrôle de mouvement, qui transfère le mouvement d'une vidéo de référence sur ta photo, et c'est le bon outil quand tu as besoin d'une danse ou d'un geste précis plutôt que de le décrire.

Prix. Standard coûte 0,084 $ la seconde sans audio et 0,126 $ avec son ; Pro coûte 0,112 $ sans audio et 0,168 $ avec son (vérifiés le 21 mai 2026). Un clip de 5 secondes en Standard coûte 0,42 $ sans audio. Kling 3.0 Standard est ainsi l'option la moins chère de cette liste avec contrôle de l'image de fin, après le niveau brouillon de Gemini Omni et Wan 3.0 en 480p.

Points faibles. Quinze secondes est le plafond, et la couche son est un supplément plutôt qu'une partie native du rendu. Kling a tendance à ajouter des mouvements expressifs que tu n'as pas demandés, surtout sur les clips plus longs : sois donc explicite sur la retenue.

Idéal pour. L'animation de personnages, les clips mode et beauté, et les courtes boucles pour les réseaux sociaux. Le guide vidéo Kling 3.0 détaille les types de plans et les prompts.

4. Wan 3.0 (Alibaba) : le meilleur prix à la seconde avec audio

Wan 3.0 est le champion discret du rapport qualité-prix de cette liste. Il génère 2 à 30 secondes à partir d'une image de début avec une image de fin optionnelle, en 480p, 720p ou 1080p, avec audio natif activé par défaut. Le format peut être fixé à 16:9, 9:16, 1:1, 4:3 ou 3:4, ou suivre celui de l'image d'entrée.

Prix. 0,05 $ la seconde en 480p, 0,10 $ en 720p et 0,20 $ en 1080p, audio inclus. Un clip de 10 secondes en 720p avec son coûte 1,00 $. Le même clip sur Seedance 2.5 standard coûte 3,60 $. Wan 3.0 Prime est le même modèle sur une file d'attente plus rapide (environ moitié moins d'attente) pour 0,075 $, 0,15 $ et 0,30 $ la seconde.

Points faibles. Sur les plans difficiles, comme l'action rapide, les scènes très animées et les gros plans de mains, il s'éloigne plus facilement de l'image de début que Seedance 2.5. Pour les plans calmes et bien composés, l'écart est faible ; pour une chorégraphie complexe, il se voit.

Idéal pour. Les clips longs à petit prix, le B-roll, les plateaux tournants produit, les arrière-plans de talking-head et tout workflow qui demande de nombreux clips de 10 à 30 secondes. C'est pour cette raison le modèle vidéo par défaut du studio MakeInfluencer.ai. Le guide vidéo Wan IA couvre les modèles de prompts de la famille Wan.

5. Wan 2.6 Flash (Alibaba) : l'image-vidéo la moins chère

Wan 2.6 Flash est un niveau réservé à l'image-vidéo. Il génère 2 à 15 secondes en 720p ou 1080p, avec audio généré optionnel et une entrée audio optionnelle pour guider le résultat. Il n'a pas de contrôle de l'image de fin.

Prix. 0,025 $ la seconde en 720p sans audio et 0,05 $ avec audio ; 0,0375 $ et 0,075 $ en 1080p. Un clip de 5 secondes en 720p sans audio coûte 0,125 $, soit environ un quatorzième du même clip sur Seedance 2.5 standard.

Points faibles. C'est un modèle Flash, et cela se voit sur les prompts difficiles : le mouvement est plus simple, les détails fins s'adoucissent et les clips longs perdent en cohérence plus tôt. Il est excellent pour vérifier qu'une photo s'anime correctement, et pour le mouvement d'ambiance (cheveux dans la brise, vapeur d'une tasse, lent zoom avant), mais plus faible pour l'action complexe.

Idéal pour. Tester des idées de mouvement à moindre coût, produire des clips d'ambiance en gros volume et réaliser de courts brouillons avant de te lancer dans un rendu plus long sur un modèle premium.

Meilleure IA image-vidéo gratuite

« Gratuit » recouvre trois réalités différentes dans cette catégorie, et il vaut la peine de les distinguer.

Gratuit sans compte. Nous ne proposons pas de génération vidéo gratuite sur MakeInfluencer.ai : chaque clip du studio consomme des crédits, et le coût est affiché avant le rendu. Ce que nous offrons sans compte, c'est un aperçu d'image gratuit dans le générateur d'images IA, qui utilise notre propre modèle d'image ouvert avec une petite limite quotidienne par visiteur. C'est utile pour faire le brouillon de la photo que tu comptes animer, mais cela ne produit pas de vidéo, et ce n'est pas l'un des modèles de pointe comparés ici. Parmi les applications que nous avons vérifiées, aucune ne proposait de génération image-vidéo gratuite et récurrente sans compte.

Crédits de départ gratuits dans une application payante. Le plan gratuit de Runway inclut 125 crédits uniques et une sélection de modèles (vérifié en septembre 2026). Pika liste un plan à 0 $ sans crédits mensuels, où tu achètes des packs de crédits selon tes besoins et où les sorties n'ont pas de filigrane (vérifié en septembre 2026). L'application Kling annonce des crédits gratuits quotidiens pour les utilisateurs connectés ; sa page indique que les sorties de l'offre gratuite portent un filigrane, mais l'allocation quotidienne exacte n'était pas précisée sur la page que nous avons consultée : confirme-la dans l'application.

Gratuit dans un abonnement plus large. Google propose Veo via l'application Gemini et Flow, avec un accès gratuit ou d'essai qui varie selon le pays et le type de compte. Nous n'avons pas pu confirmer d'allocation Veo 3.1 gratuite stable sur une page Google : considère donc tout chiffre précis lu ailleurs comme provisoire.

Pour la plupart des gens, le moyen honnête et le moins cher de savoir si l'image-vidéo fonctionne avec ta photo est un court brouillon payant : un clip de 4 secondes en 720p sans audio sur Wan 2.6 Flash coûte 0,10 $ au tarif public et te dira si le visage tient et si le prompt de mouvement se lit bien. Si tu as ensuite besoin d'audio, de clips plus longs ou de 1080p, passe à Wan 3.0 ou à Seedance 2.5 Turbo.

Ce que coûte vraiment un clip de test

Deux clips brouillons de 4 secondes en 720p coûtent 0,20 $ au tarif public de Wan 2.6 Flash. Vois-y un banc d'essai, pas un budget de production : valide la photo et le prompt de mouvement sur des brouillons économiques avant de payer pour la durée et la résolution.

6. Veo 3.1 Fast (Google) : le meilleur clip soigné de 8 secondes avec son

Veo 3.1 Fast génère 4, 6 ou 8 secondes en 720p ou 1080p, en 16:9 ou 9:16, à partir d'une image de début avec une image de fin optionnelle. L'audio est optionnel. La réputation de Veo repose sur la finition : éclairage propre, mouvements de caméra convaincants, ambiance sonore et dialogues bien synchronisés. Le guide du prompting Veo 3 explique comment formater les dialogues.

Prix. 0,10 $ la seconde sans audio et 0,15 $ la seconde avec audio, quelle que soit la résolution (vérifiés le 21 mai 2026). Un clip de 8 secondes en 1080p avec audio coûte 1,20 $.

Points faibles. Huit secondes est le plafond : pas de plan-séquence de 30 secondes. Il n'y a pas de format carré. Veo a aussi tendance à réinterpréter l'image de début plus librement que Seedance, ce qui est un atout pour un rendu cinématographique, mais un défaut quand l'étiquette de ton produit ou le visage du personnage doivent rester fidèles au pixel près.

Idéal pour. Les courts moments cinématographiques, les répliques de dialogue et les accroches publicitaires où le son compte et où 8 secondes suffisent.

7. Gemini Omni 1.1 Flash (Google) : le meilleur niveau brouillon

Gemini Omni 1.1 Flash génère 3 à 10 secondes en 360p, 720p, 1080p ou 4K, en 16:9 ou 9:16, avec un audio synchronisé toujours activé et une image de fin optionnelle pour l'interpolation.

Prix. 0,03 $ la seconde en 360p, 0,10 $ en 720p, 0,15 $ en 1080p et 0,30 $ en 4K. Un brouillon de 5 secondes en 360p coûte 0,15 $. C'est le moyen le moins cher de prévisualiser un plan avec audio.

Points faibles. Dix secondes est le maximum, l'audio ne peut pas être désactivé (impossible donc d'économiser sur du B-roll muet), et le 360p ne sert qu'à juger le mouvement, pas à publier.

Idéal pour. Les aperçus rapides du mouvement et du timing avant de lancer un rendu plus coûteux, et les courts clips 4K pour lesquels Seedance 2.5 en 4K coûterait six fois plus cher à la seconde.

8. Runway : le meilleur éditeur bâti autour de son propre modèle

Runway vend une suite créative plutôt qu'un seul modèle. Sa page tarifaire (vérifiée en septembre 2026) liste Gen-4.5 et Aleph 2.0 comme ses propres modèles vidéo, ainsi que Seedance 2.0 Pro, Seedance 2.0 Fast et Kling 3.0. Plans : Gratuit avec 125 crédits uniques et 5 Go de stockage ; Standard à 15 $ par mois (12 $ par mois en facturation annuelle) avec 625 crédits ; Pro à 35 $ par mois (28 $ en annuel) avec 2 250 crédits ; Max à 95 $ par mois (76 $ en annuel) avec 9 500 crédits.

Points forts. Un éditeur abouti, des outils vidéo-vers-vidéo et un workflow cohérent pour les équipes qui montent déjà dans Runway. Si tu veux animer une photo puis la monter, la prolonger et la composer sans quitter une seule application, Runway est l'offre la plus complète de cette liste.

Points faibles. La conversion crédits-secondes dépend du modèle et des réglages : le coût par clip est donc plus difficile à prévoir qu'avec une facturation à la seconde par modèle. La page tarifaire listait Seedance 2.0 et non 2.5 lors de la vérification.

Idéal pour. Les monteurs et petits studios qui veulent générer et faire la post-production au même endroit.

9. Luma et Pika : abonnements multi-modèles

Luma (vérifié en septembre 2026) n'a pas de plan gratuit sur sa page tarifaire. Plus coûte 30 $ par mois (25 $ en annuel) avec 10 000 crédits, Pro 90 $ par mois (75 $ en annuel) avec 40 000 crédits et Ultra 300 $ par mois (250 $ en annuel) avec 150 000 crédits. Outre ses propres modèles Ray3, la page liste Seedance 2.0 et 2.5, Kling 3.0, Veo 3.1, MiniMax H3 et Gemini Omni Flash. Les modèles propres de Luma sont depuis longtemps réputés pour le mouvement d'ambiance et cinématographique.

Pika (vérifié en septembre 2026) liste un plan Gratuit sans crédits mensuels (packs de crédits uniquement), Starter à 10 $ par mois avec 900 crédits, Creator à 35 $ par mois avec 3 150 crédits et une licence commerciale, et un niveau Fancy à partir de 95 $ par mois. Les packs de crédits se vendent à 60 crédits par dollar. La page liste Seedance 2.5 et Wan 3.0 parmi les modèles disponibles, et indique que les sorties n'ont de filigrane sur aucun plan.

Points faibles. Les deux sont des couches d'abonnement autour d'un assortiment de modèles. C'est pratique, mais tu paies un plan que tu l'utilises ou non, et tu es à un cran de distance de la facturation à la seconde. Vérifie que le modèle et la résolution que tu veux sont inclus dans le niveau choisi : les pages tarifaires ne listent pas les limites de résolution par modèle.

Idéal pour. Les créateurs qui veulent une seule facture mensuelle et une seule interface pour plusieurs familles de modèles.

10. Hailuo (MiniMax) : à tester pour le mouvement expressif

Hailuo est l'application vidéo grand public de MiniMax. Lors de notre vérification en septembre 2026, sa page d'accueil mettait en avant MiniMax H3 et des modèles photo-vidéo comme la danse et les effets de clip musical. Sa page d'abonnement n'affichait pas de détails de plans lisibles, et les résumés tarifaires tiers se contredisent : nous ne reproduisons donc pas de prix ici. Consulte directement la page des plans avant de fixer ton budget.

Idéal pour. Essayer l'animation de photos pilotée par des modèles et les mouvements humains énergiques. La page tarifaire de Luma liste aussi MiniMax H3, ce qui offre une autre voie pour le tester.

Autres applications que nous n'avons pas classées

Higgsfield est une grande plateforme multi-modèles qui propose Seedance 2.5, Kling 3.0 et Wan 3.0 aux côtés de son propre modèle image-vidéo DoP, et qui a lancé une API publique en septembre 2026. Ses prix varient selon les sources et nous n'avons pas pu les lire sur sa page tarifaire le jour de la vérification : elle est donc traitée à part dans notre guide des alternatives à Higgsfield. Adobe, Canva et CapCut intègrent aussi des fonctions image-vidéo dans des suites de montage plus larges ; c'est raisonnable si tu les paies déjà, mais aucune ne publie clairement de limites par clip permettant une comparaison ici.

Comment écrire des prompts de mouvement efficaces en image-vidéo

L'erreur la plus fréquente en image-vidéo est d'écrire un prompt de texte-vidéo. Le modèle voit déjà la scène. Si tu décris de nouveau la femme, la robe rouge, le café et la lumière dorée, tu l'invites à les redessiner, et c'est là que naît la dérive d'identité. Un prompt image-vidéo doit décrire ce qui change, comment la caméra bouge et ce qui doit rester identique, dans cet ordre.

Anatomie d'un prompt de mouvement image-vidéo, présentée sous forme de fiches annotées à côté d'une image de début imprimée

Un bon prompt de mouvement décrit le changement, la caméra et les contraintes, pas la scène que le modèle voit déjà.

1

Mouvement du sujet

Une ou deux actions concrètes, avec une vitesse. « Elle tourne lentement la tête vers la caméra et sourit légèrement » vaut mieux que « elle bouge naturellement ».

2

Mouvement secondaire

Ce qui bouge autour du sujet : cheveux dans une légère brise, vapeur qui monte de la tasse, feuilles à l'arrière-plan, circulation floue qui passe.

3

Caméra

Une seule consigne de caméra : statique, léger zoom avant, léger zoom arrière, caméra à l'épaule avec léger balancement, orbite vers la gauche, inclinaison vers le haut. Deux mouvements à la fois donnent généralement un effet flottant.

4

Contraintes

Ce qui ne doit pas changer : garde le visage, la tenue et le cadrage inchangés ; garde l'étiquette lisible ; aucune nouvelle personne n'entre dans le cadre.

Voici les prompts de mouvement que nous utilisons, regroupés par type de travail. Ils sont écrits pour une image de début qui contient déjà le sujet : ils évitent donc de le redécrire.

Portrait ou créateur qui parle à la caméra (accroche UGC)

Rendu de caméra de téléphone tenue à la main, avec un léger balancement naturel. Elle regarde l'objectif, hausse légèrement les sourcils et se met à parler en faisant un geste de la main droite. Ses cheveux bougent légèrement. Garde son visage, sa tenue et l'arrière-plan inchangés. Pas de zoom.

Produit sur une table (e-commerce)

Caméra statique. La bouteille tourne lentement dans le sens des aiguilles d'une montre sur la surface en marbre, environ un quart de tour sur l'ensemble du clip. Une lumière douce scintille à travers le verre pendant la rotation. Garde l'étiquette nette et lisible et l'arrière-plan inchangé. Aucune main n'entre dans le cadre.

Plan lifestyle avec vie ambiante

Léger zoom avant vers le sujet. La vapeur monte de la tasse de café, le rideau derrière elle bouge doucement dans la brise, et elle soulève la tasse et boit une gorgée. Tout le reste reste immobile. Garde son identité et le cadrage inchangés.

Défilé mode

La caméra recule en travelling à la cadence de sa marche tandis qu'elle avance vers l'objectif sur le trottoir, les bras balançant naturellement, l'ourlet du manteau oscillant à chaque pas. Les piétons à l'arrière-plan passent, flous. Garde son visage et sa tenue identiques à la première image.

Moment de clip musical

Lente orbite vers la gauche autour de la chanteuse. Les lumières de scène pulsent et balaient l'espace derrière elle, la brume dérive à travers les faisceaux, et elle renverse la tête en arrière sur le rythme. Garde son visage et son costume inchangés. Pas de texte ni de nouvelles personnes.

Animation de personnage, boucle d'attente calme

Caméra statique. Le personnage respire lentement, cligne des yeux une fois et déplace légèrement son poids d'un pied sur l'autre. Les cheveux et le tissu bougent doucement. Termine sur la même pose que la première image. Garde le style et les proportions inchangés.

Pour la boucle d'attente, fournis de nouveau l'image d'entrée comme image de fin sur tout modèle qui le permet (Seedance 2.5, Kling 3.0, Wan 3.0, Veo 3.1 Fast, Gemini Omni 1.1 Flash). La boucle se referme proprement, ce qui est bien plus fiable que de demander une boucle parfaite avec des mots.

Les mots de vitesse comptent plus que les adjectifs

« Lentement », « environ un quart de tour », « une fois » et « à la cadence de la marche » font plus de travail que « cinématographique », « magnifique » ou « beau ». Les modèles image-vidéo en font trop par défaut ; ce sont les mots de quantité qui gardent le mouvement proportionné à la durée du clip.

Laisse l'image de début faire le travail

L'image de début pèse plus lourd que le prompt dans le résultat. Voici quelques règles que nous appliquons avant d'animer n'importe quelle photo :

  • Respecte le format final. Recadre en 9:16 avant d'animer un clip vertical. Laisser le modèle compléter la zone manquante invente du contenu sur les bords, et le contenu inventé dérive.
  • Laisse de la place au mouvement. Si le sujet lève la main, la main a besoin d'espace pour aller quelque part. Un gros plan serré sur la tête qui doit « saluer » sera coupé ou fera surgir une main de nulle part.
  • Montre les mains clairement, ou pas du tout. Les mains à moitié cachées sont la première source de déformations. Cadre-les entièrement et détendues, ou recadre-les hors champ.
  • Privilégie une lumière douce et directionnelle. La lumière dure de midi et les températures de couleur mélangées scintillent davantage quand le modèle rééclaire un visage en mouvement.
  • Limite le texte au minimum. Les étiquettes et les panneaux résistent le mieux au mouvement quand ils sont grands, de face et peu nombreux.

Si tu génères tes photos, GPT Image 2.5 est notre choix par défaut pour les images de départ photoréalistes, car il suit de près les consignes de cadrage ; le guide de cohérence des personnages explique comment garder la même personne sur toute une série de photos avant de les animer, et le workflow du storyboard au film montre comment planifier une suite d'images de début et de fin pour une réalisation multi-plans.

Comment choisir son IA image-vidéo selon l'usage

Les classements ont leurs limites. Le bon modèle dépend de l'usage du clip. Voici les choix que nous ferions pour les quatre cas qui suscitent le plus de questions.

Pubs UGC

Notre choix : Seedance 2.5 Turbo en 720p, 9:16, 5 à 10 secondes, audio activé pour les brouillons.

Les pubs UGC ont besoin d'une personne crédible, d'une accroche dans les deux premières secondes et de volume : tu testeras beaucoup de variantes d'un même concept. À 0,20 $ la seconde en 720p, une variante de 10 secondes avec Turbo coûte 2,00 $, et il tient assez bien un visage pour un visionnage sur téléphone. Si la pub comporte une réplique parlée, génère l'image animée en image-vidéo et ajoute la voix avec l'outil de lip sync pour contrôler le script au mot près. Le guide des pubs UGC IA couvre les accroches, les scripts et la mention du contenu synthétique, et le générateur de pubs IA est un point de départ sans inscription pour les visuels publicitaires.

Alternative économique : Wan 3.0 en 720p, 1,00 $ pour 10 secondes avec audio.

Plans produit

Notre choix : Wan 3.0 ou Seedance 2.5 Turbo avec une image de début et une image de fin.

Un clip produit se joue sur l'étiquette. Utilise une caméra statique ou une orbite lente, une rotation d'environ un quart de tour, et une image de fin qui montre le produit sous son dernier angle : le modèle interpole ainsi au lieu d'inventer l'arrière de l'emballage. Garde les clips à 4 à 6 secondes ; les rotations plus longues donnent au modèle plus d'occasions de redessiner le texte. Pour un visuel héros en page d'accueil, relance le meilleur essai sur Seedance 2.5 standard en 1080p.

Animation de personnage

Notre choix : Kling 3.0 pour les actions courtes et dirigées ; Seedance 2.5 pour les longs plans.

Pour un personnage IA cohérent, préserver l'identité est tout le travail. Kling 3.0 est solide sur une action unique et délibérée de 5 à 10 secondes, et son prompt négatif aide à supprimer les artefacts récurrents. Pour les prises de 15 à 30 secondes, Seedance 2.5 tient le visage de façon plus fiable. Si tu as besoin d'un mouvement chorégraphié précis, utilise le contrôle de mouvement avec une vidéo de référence au lieu de le décrire. Le guide pour créer un influenceur IA à partir d'une photo explique comment construire le personnage lui-même.

Clip musical

Notre choix : Seedance 2.5 ou Wan 3.0 pour des plans de 15 à 30 secondes, sans audio, puis montage sur ta piste.

Considère tout audio natif sur un clip musical comme jetable : tu le remplaceras par la chanson ; désactive donc l'audio quand le modèle le permet et n'en tiens pas compte pour juger les versions. Planifie l'ensemble comme une série d'images de début, génère chaque plan à la durée d'une phrase musicale et coupe sur le rythme dans ton logiciel de montage. À 0,10 $ la seconde en 720p, Wan 3.0 permet de produire une vidéo de 20 plans de 10 secondes chacun pour 20 $ de génération, avant les nouveaux essais. Notre page du générateur de clips musicaux IA est construite autour de ce workflow.

Feature
Seedance 2.5 Turbo
Seedance 2.5
Pour les brouillons et la plupart des contenus sociaux, Turbo offre la même plage de 4 à 30 secondes et l'audio natif pour 0,20 $ la seconde en 720p contre 0,36 $. Seedance 2.5 standard garde l'avantage pour la sortie en 480p et en 4K et pour les plans héros où chaque image est examinée.
Feature
Wan 3.0
Veo 3.1 Fast
Pour tout ce qui dépasse 8 secondes, Wan 3.0 l'emporte d'office : 2 à 30 secondes avec audio natif à 0,10 $ la seconde en 720p. Veo 3.1 Fast garde l'avantage sur les courts clips cinématographiques avec dialogue.
Feature
Kling 3.0
Wan 2.6 Flash
Les deux sont économiques. Kling 3.0 Standard coûte plus cher (0,084 $ contre 0,025 $ la seconde sans audio) mais ajoute le contrôle de l'image de fin, un prompt négatif et un mouvement nettement meilleur chez les personnes. Wan 2.6 Flash l'emporte pour les clips d'ambiance en volume et pour les tests à petit prix.

Défauts courants et comment les corriger

Tous les modèles de cette liste échouent de la même poignée de façons. Identifier le défaut te dit sur quel levier agir.

Planche-contact d'images vidéo avec des cercles au crayon gras autour d'une main déformée et d'un visage qui dérive

Repère la première image où le clip se casse : elle te dit s'il faut changer le prompt, l'image de début ou la durée.

Dérive d'identité

Symptôme. Le visage de la dernière seconde ressemble à une personne légèrement différente de celle de la première image. La mâchoire, la forme des yeux ou la racine des cheveux se décalent peu à peu, souvent après un mouvement de tête.

Solutions.

  1. Retire du prompt les mots décrivant l'apparence. Décrire la personne invite le modèle à la redessiner.
  2. Ajoute une contrainte explicite : « Garde son visage identique à la première image. »
  3. Raccourcis le clip. La dérive s'accumule avec le temps ; deux clips de 8 secondes montés ensemble valent souvent mieux qu'un clip de 16 secondes.
  4. Fournis une image de fin de la même personne. Les deux extrémités étant fixées, le modèle a beaucoup moins de marge pour dériver.
  5. Réduis la rotation de la tête. Un tour de plus d'environ 45 degrés oblige le modèle à inventer la partie cachée du visage.
  6. Monte d'un niveau. Sur les plans difficiles, Seedance 2.5 tient mieux l'identité que les modèles d'entrée de gamme.

Déformation des mains et des objets

Symptôme. Les doigts fusionnent, se multiplient ou se plient de façon impossible ; une tasse se fond dans une main ; les bijoux changent de forme.

Solutions.

  1. Corrige d'abord l'image de début. Des mains partiellement cachées, qui se chevauchent ou qui touchent le bord du cadre en sont généralement la cause.
  2. Donne aux mains une tâche simple : « soulève la tasse et boit une gorgée », pas « fait des gestes en parlant tout en ajustant ses cheveux ».
  3. Sur Kling 3.0, ajoute un prompt négatif : « doigts en trop, doigts fusionnés, mains déformées ».
  4. Ralentis l'action. C'est dans les mouvements rapides des mains que commencent le flou de bougé et la déformation.
  5. Recadre les mains hors de l'image de début si elles n'ont pas besoin d'apparaître dans le plan.

Trop de mouvement

Symptôme. Tout bouge à la fois : la caméra fonce, le sujet danse alors que tu as demandé un sourire, l'arrière-plan ondule. Le clip ressemble à une démo d'IA plutôt qu'à des images filmées.

Solutions.

  1. Donne une seule consigne de caméra, ou « caméra statique ».
  2. Ajoute des quantités : « lentement », « une fois », « légèrement », « un quart de tour ».
  3. Indique ce qui reste immobile : « tout le reste reste immobile ».
  4. Adapte la durée à l'action. Un simple sourire n'a pas besoin de 10 secondes ; le modèle remplit le temps supplémentaire avec du mouvement supplémentaire. Prends 4 à 5 secondes.
  5. Désactive l'expansion de prompt quand elle existe. Sur MakeInfluencer.ai, elle est désactivée par défaut pour Wan 3.0 : ton prompt n'est donc pas réécrit en quelque chose de plus animé.

Résultat figé ou presque statique

Symptôme. Le contraire : le clip est une photo avec un léger zoom.

Solutions. Donne un verbe d'action concret et une source de mouvement secondaire (« la vapeur monte », « les cheveux bougent dans le vent »). Évite les prompts composés uniquement de contraintes. Si un modèle fige régulièrement une image donnée, essaie un autre modèle ; certaines photos (aplats graphiques, cadrages très serrés) ne donnent tout simplement rien à animer au modèle.

Étiquettes et texte abîmés

Symptôme. Une étiquette produit floue, des lettres qui s'échangent, des logos qui s'étalent pendant la rotation.

Solutions. Limite la rotation, garde l'étiquette face caméra à la fois dans l'image de début et dans l'image de fin, utilise des clips de 4 à 6 secondes et fais le rendu final en 1080p. Si un clip est parfait à part une étiquette qui ondule, il est souvent plus rapide de recomposer l'étiquette d'origine au montage que de régénérer.

Audio qui ne convient pas

Symptôme. L'audio natif ajoute de la musique, un bruit de foule ou de la parole dont tu ne voulais pas.

Solutions. Décris le son voulu dans le prompt (« ambiance sonore calme, une seule tasse posée sur la table »), ou désactive l'audio sur les modèles qui le permettent (Seedance 2.5, Wan 3.0, Wan 2.6 Flash, Kling 3.0, Veo 3.1 Fast) et ajoute le son au montage. Gemini Omni 1.1 Flash génère toujours l'audio.

Fais un test d'un après-midi avant de t'engager

Les classements ne sont qu'un point de départ. Ce sont tes photos, ton sujet et ta plateforme qui désignent le gagnant. Ce test prend environ deux heures et quelques dollars.

  1. Choisis trois photos représentatives de ton vrai travail : une personne, un produit, une scène large. Recadre chacune au format dans lequel tu publieras.
  2. Écris un prompt de mouvement par photo avec la structure en quatre parties décrite plus haut.
  3. Passe chaque photo dans trois modèles, en 720p et 5 secondes : un d'entrée de gamme (Wan 2.6 Flash ou Wan 3.0), un de milieu de gamme (Seedance 2.5 Turbo ou Kling 3.0 Standard) et un premium (Seedance 2.5 ou Veo 3.1 Fast). Lance d'abord le niveau d'entrée de gamme dans le studio image-vidéo : c'est le moyen le moins cher de comparer le mouvement.
  4. Note chaque clip selon trois critères : préservation de l'identité (la dernière image ressemble-t-elle à la première ?), qualité du mouvement (mains, tissu, caméra) et utilité (le publierais-tu ?).
  5. Divise le coût par le nombre de clips utilisables. Un modèle deux fois plus cher mais deux fois plus souvent exploitable coûte le même prix par clip publiable.
  6. Relance une dernière fois le meilleur prompt sur le modèle gagnant. La régularité d'un essai à l'autre compte plus qu'un seul rendu chanceux.

Sur MakeInfluencer.ai, tout le test se fait au même endroit : le générateur vidéo IA propose chaque modèle de ce guide, affiche le coût en crédits avant chaque rendu et garde l'historique de tes prompts. Les développeurs peuvent lancer la même comparaison via l'API, où chaque modèle correspond à une requête POST ; le guide de l'API image-vidéo la détaille pas à pas.

Questions fréquentes

Quelle est la meilleure IA image-vidéo en 2026 ?

Pour la qualité et le contrôle globaux : Seedance 2.5 de ByteDance, de 4 à 30 secondes, jusqu'en 4K, avec audio natif et images de début et de fin. Pour le travail de tous les jours, Seedance 2.5 Turbo donne des résultats proches en 720p ou 1080p pour 0,20 à 0,22 $ la seconde. Pour le meilleur prix à la seconde avec audio : Wan 3.0 d'Alibaba à 0,10 $ la seconde en 720p.

Quelle est la meilleure IA image-vidéo gratuite ?

MakeInfluencer.ai ne propose pas de vidéo gratuite ; son studio fonctionne avec des crédits, et le brouillon le moins cher est Wan 2.6 Flash d'Alibaba à 0,025 $ la seconde en 720p sans audio. Tu peux réaliser l'image de début gratuitement avec notre générateur d'images IA, qui ne demande aucun compte. Côté applications, le plan gratuit de Runway inclut 125 crédits uniques, et l'application Kling offre des crédits gratuits quotidiens avec sortie filigranée (les deux vérifiés en septembre 2026).

Puis-je animer une photo d'une vraie personne ?

Techniquement oui, et la plupart des outils le feront. La question de savoir si tu dois le faire dépend du consentement et des règles de la plateforme. N'anime que des photos de personnes qui y ont consenti, ne présente jamais comme authentique une vidéo synthétique d'une vraie personne, et respecte les règles de mention des contenus synthétiques de la plateforme où tu publies. Notre studio modère aussi les images importées et rejette celles qu'il ne peut pas animer.

Quelle IA image-vidéo tient le visage le plus cohérent ?

Seedance 2.5 tient généralement le mieux l'identité sur les longs clips, suivi de Kling 3.0 sur les plans courts dirigés. Quel que soit le modèle, la préservation de l'identité progresse surtout quand tu cesses de décrire la personne dans le prompt, que tu raccourcis les clips et que tu fixes une image de fin.

Quelle est la durée maximale d'un clip image-vidéo ?

Seedance 2.5, Seedance 2.5 Turbo et Wan 3.0 atteignent 30 secondes en une génération. Kling 3.0 et Wan 2.6 Flash atteignent 15 secondes, Gemini Omni 1.1 Flash 10 secondes et Veo 3.1 Fast 8 secondes. Seedance 2.5 Video Extend peut continuer un clip au-delà d'une génération.

Combien coûte l'IA image-vidéo ?

Aux tarifs publics des fournisseurs, un clip de 5 secondes en 720p va de 0,125 $ (Wan 2.6 Flash, sans audio) à 1,80 $ (Seedance 2.5), en passant par 0,42 $ (Kling 3.0 Standard, sans audio), 0,50 $ (Wan 3.0 avec audio) et 1,00 $ (Seedance 2.5 Turbo). Le tableau complet se trouve dans le guide des tarifs des modèles vidéo IA.

Sora 2 est-il encore une option pour l'image-vidéo ?

Non. OpenAI a retiré l'API Vidéo de Sora le 24 septembre 2026. Utilise plutôt Seedance 2.5, Veo 3.1 Fast ou Wan 3.0.

Quelle différence entre l'image-vidéo et le texte-vidéo ?

Le texte-vidéo invente toute la scène à partir de mots. L'image-vidéo part de ta photo : tu contrôles donc exactement le sujet, la composition et l'éclairage, et le modèle n'ajoute que le mouvement. C'est pourquoi l'image-vidéo est le workflow de référence pour des personnages et des produits cohérents : tu verrouilles l'apparence dans une photo, puis tu l'animes.

Ai-je besoin d'une image de fin ?

Non, mais c'est le contrôle le plus fiable dont tu disposes. Une image de fin transforme la génération en interpolation entre deux images connues, ce qui réduit la dérive, évite l'excès de mouvement et rend les boucles possibles. Seedance 2.5, Kling 3.0, Wan 3.0, Veo 3.1 Fast et Gemini Omni 1.1 Flash l'acceptent tous ; Wan 2.6 Flash non.

Quel format d'image utiliser ?

Utilise le format dans lequel tu vas publier et recadre l'image de début à ce format avant d'animer : 9:16 pour TikTok, Reels et Shorts, 16:9 pour YouTube et le web, 1:1 pour les fils d'actualité. Veo 3.1 Fast et Gemini Omni 1.1 Flash n'offrent que le 16:9 et le 9:16.

À retenir

Pour la plupart des gens, la meilleure IA image-vidéo en 2026 n'est pas un modèle mais une habitude en deux temps : tester à petit prix, puis ne faire qu'un seul rendu sur le modèle adapté au plan. Prépare la photo avec le générateur d'images IA gratuit, vérifie qu'elle s'anime avec un clip Wan 2.6 Flash peu coûteux dans le studio image-vidéo, fais tes brouillons sur Seedance 2.5 Turbo ou Wan 3.0, et réserve Seedance 2.5 standard ou Veo 3.1 Fast aux clips qui portent la pièce. Les plans actuels figurent sur la page tarifaire, et le tarif à la seconde de chaque modèle se trouve dans le guide des tarifs. Pour toute question sur un workflow précis, écris à [email protected].

Les capacités des modèles et les tarifs publics des fournisseurs ont été relevés dans le registre de modèles et le manifeste de tarification de MakeInfluencer.ai le 29 septembre 2026 (les prix de Kling 3.0 et de Veo 3.1 Fast ont été vérifiés pour la dernière fois le 21 mai 2026). Les plans de Runway, Luma et Pika ont été relevés sur la page tarifaire publique de chaque éditeur et sont marqués « vérifié en septembre 2026 ». Les chiffres de l'application Kling, de Hailuo et de Google qui n'ont pas pu être confirmés sur une page d'éditeur sont signalés comme non vérifiés. Ce guide n'est affilié ni à ByteDance, Kuaishou, Alibaba, Google, Runway, Luma AI, Pika ni MiniMax.

Prêt à essayer vous-même ?

Commencez à créer des influenceurs IA et à générer du contenu en quelques minutes.