Choisissez le niveau selon l'étape
Explorez sur Mini, affinez sur Fast et gardez Standard pour le rendu que vous livrerez. Le même brief passe d'un niveau à l'autre : changer de niveau n'oblige donc pas à tout réécrire.
BestAIVideo
Seedance 2.0 est le modèle vidéo multimodal de ByteDance Seed, proposé ici en niveaux Standard, Fast et Mini pour que le coût suive l'avancement de votre projet. Partez d'un texte, ancrez un plan avec des images clés, ou confiez-lui jusqu'à neuf images, trois clips vidéo et trois clips audio, et consultez le prix exact en crédits avant de lancer la génération.
ByteDance Seed décrit Seedance 2.0 comme un modèle unifié qui accepte du texte, des images, de la vidéo et de l'audio, avec un son synchronisé dans le résultat. Voici les réglages que propose le générateur.
Standard offre le détail le plus fin et reste le seul niveau à proposer la 1080p et la 4K. Fast itère plus vite, et Mini est le choix léger pour les aperçus et l'exploration en série. Fast et Mini s'arrêtent à la 720p.
Choisissez n'importe quel nombre entier de secondes dans cette plage. La valeur par défaut est 5. L'audio est généré avec l'image, et un interrupteur dans les options avancées le désactive quand vous voulez un clip muet.
Texte vers vidéo, génération par images clés avec une première image obligatoire et une dernière image facultative, ou Référence Omni, qui accepte jusqu'à 9 images, 3 clips vidéo et 3 fichiers audio dans une seule requête.
En mode texte vers vidéo, vous pouvez activer la recherche web pour qu'un prompt sur un sujet d'actualité s'appuie sur des informations récentes. Elle est désactivée par défaut et ne change pas le prix.
Dans les recommandations de ByteDance pour Seedance 2.0, chaque fichier importé forme une partie numérotée du brief. Les habitudes ci-dessous gardent lisible une requête chargée.
Parlez d'Image 1, de Vidéo 2 et d'Audio 1, en numérotant chaque type à partir de un dans l'ordre d'importation. Précisez ce qu'il faut retenir de chacun, par exemple la tenue de l'Image 1 ou le mouvement de caméra de la Vidéo 1.
Écrivez chaque réplique entre guillemets doubles, dites qui parle et indiquez un fichier audio de référence quand vous voulez une voix précise. Décrivez la musique par le moment où elle entre.
Si un clip part d'une photo, réglez le format sur adaptatif ou recadrez la photo à la forme visée. Un décalage est la cause habituelle des déformations et des sauts au début du clip.
ByteDance recommande de rester sous environ 1 000 mots anglais, car les prompts trop longs perdent des détails. Dans ce budget, une liste minutée, comme les deux premières secondes puis les trois suivantes, fonctionne bien.
Une femme en robe rouge épingle des chemises blanches sur un fil, pendant que le soleil bas embrase les toits et qu'un panier en bois attend à côté d'elle. C'est un modèle de brief calme, à un seul sujet, où la lumière et le son ambiant font le travail.
Deux combattants, l'un en robe blanche et l'autre en cape de paille et chapeau conique, tournent et s'affrontent sur un sol boueux, dans la brume. Un combat de ce genre se contrôle mieux quand le prompt énumère chaque échange dans l'ordre, avec la position de la caméra pour chacun.
Une vue de dessus de doigts qui caressent de la fausse fourrure à côté de plaques d'acrylique et de papier bulle, sur une table beige, avec un son proche et tactile. Elle montre comment Seedance 2.0 peut bâtir un clip autour de la matière et de l'audio plutôt qu'autour d'une histoire.
Explorez sur Mini, affinez sur Fast et gardez Standard pour le rendu que vous livrerez. Le même brief passe d'un niveau à l'autre : changer de niveau n'oblige donc pas à tout réécrire.
La génération par images clés et la Référence Omni sont des modes distincts. Si un plan exige une première et une dernière image précises, utilisez les images clés, et décrivez les références supplémentaires avec des mots.
ByteDance indique que la sortie 4K utilise un encodage que certains lecteurs et navigateurs ne savent pas ouvrir directement : vérifiez donc la lecture sur votre appareil cible avant de prévoir une livraison en 4K.
Faites vos brouillons en 480p sur Mini, où un clip de 5 secondes coûte 38 crédits, et ne gardez que les idées qui méritent un meilleur rendu.
Standard est le niveau de livraison, avec 408 crédits pour un clip de 5 secondes en 1080p et 832 en 4K.
Fournissez jusqu'à neuf images pour qu'une personne, un produit ou un décor reste reconnaissable d'un clip à l'autre.
Importez un clip de référence et décrivez le mouvement à emprunter, à un tarif en crédits plus bas que pour une requête sans vidéo.
Ajoutez jusqu'à trois fichiers audio à une image ou à une vidéo pour orienter la voix, le tempo ou l'ambiance.
Utilisez une première et une dernière image pour décider d'où le clip part et où il atterrit.
Seedance 2.0 est le modèle vidéo multimodal de ByteDance Seed, annoncé en février 2026. Il accepte du texte, des images, de la vidéo et de l'audio en entrée, et produit une vidéo dont le son est généré avec l'image.
Standard offre le plus de détail et propose la 480p, la 720p, la 1080p et la 4K. Fast est plus rapide et Mini est le plus léger, et tous deux s'arrêtent à la 720p. Les trois niveaux partagent les mêmes modes et les mêmes réglages.
Le prix dépend de la durée et de la résolution. Pour un clip de 5 secondes en 720p, il est de 164 crédits sur Standard, 132 sur Fast et 82 sur Mini. En 480p, il passe à 76, 62 et 38. Le générateur affiche le montant exact avant l'envoi.
Oui. Quand une requête comprend une vidéo de référence, un tarif plus bas par seconde s'applique aux secondes générées. Un clip de 5 secondes en 720p sur Standard coûte 100 crédits avec une vidéo de référence, contre 164 sans.
N'importe quel nombre entier de secondes de 4 à 15, avec 5 par défaut. Pour des scènes plus longues, Seedance 2.5 sur ce site dépasse les 15 secondes.
En mode Référence Omni, jusqu'à 9 images, 3 vidéos et 3 fichiers audio. Il faut au moins un fichier, et les images doivent peser moins de 30 Mo, les vidéos moins de 50 Mo et les fichiers audio moins de 15 Mo.
1:1, 4:3, 3:4, 16:9, 9:16, 21:9 et adaptatif, le 16:9 étant présélectionné. Pour les clips partant d'une image, adaptatif suit votre image.
Oui. L'audio est activé par défaut et un interrupteur dans les options avancées le retire. Ce réglage ne change pas le prix.
Seedance 2.0 réalise des clips de 4 à 15 secondes à partir de 9 images, 3 vidéos et 3 fichiers audio au maximum. Seedance 2.5 va jusqu'à 30 secondes et accepte bien plus de références. Sur ce site, la 1080p et la 4K ne sont proposées que sur Seedance 2.0 Standard.
Mettez chaque réplique entre guillemets doubles, nommez la personne qui parle et, si vous avez importé un échantillon de voix, indiquez quel fichier audio la voix doit suivre. Gardez des phrases assez courtes pour la durée du clip.
En mode texte vers vidéo, elle permet au modèle de chercher des informations récentes pendant qu'il interprète votre prompt. Elle est facultative, désactivée par défaut et indisponible dans les modes images clés et référence.
Choisissez un niveau, décidez comment commencer et consultez le prix en crédits avant de lancer la génération.