Scegli il livello in base alla fase
Esplora con Mini, rifinisci con Fast e riserva Standard al render che consegnerai. Lo stesso brief vale per tutti e tre, quindi cambiare livello non significa riscriverlo.
BestAIVideo
Seedance 2.0 è il modello video multimodale di ByteDance Seed e qui è disponibile nei livelli Standard, Fast e Mini, così il costo segue la fase del tuo progetto. Parti dal testo, ancora una ripresa con i fotogrammi oppure dagli fino a nove immagini, tre clip video e tre clip audio, e consulta il prezzo esatto in crediti prima di generare.
ByteDance Seed descrive Seedance 2.0 come un modello unificato che accetta testo, immagini, video e audio e restituisce un suono sincronizzato. Queste sono le impostazioni che il generatore mette a tua disposizione.
Standard offre il massimo dettaglio ed è l'unico livello con 1080p e 4K. Fast itera più in fretta e Mini è la scelta leggera per anteprime ed esplorazioni in serie. Fast e Mini si fermano a 720p.
Scegli un numero intero di secondi in questo intervallo, con 5 come valore predefinito. L'audio viene generato insieme alle immagini e un interruttore nelle opzioni avanzate lo disattiva quando vuoi una clip muta.
Da testo a video, generazione da fotogrammi con primo fotogramma obbligatorio e ultimo fotogramma facoltativo, oppure Omni Reference, che accetta fino a 9 immagini, 3 clip video e 3 file audio in un'unica richiesta.
Nella modalità da testo a video puoi attivare la ricerca sul web, così un prompt su un tema d'attualità può attingere a informazioni recenti. È disattivata per impostazione predefinita e non cambia il prezzo.
Le indicazioni di ByteDance per Seedance 2.0 trattano ogni file caricato come una parte numerata del brief. Le abitudini che seguono mantengono leggibile una richiesta affollata.
Richiama Immagine 1, Video 2 e Audio 1, numerando ogni tipo a partire da uno nell'ordine di caricamento. Specifica cosa prendere da ciascuno, per esempio l'abito dall'Immagine 1 o il movimento di camera dal Video 1.
Scrivi ogni battuta tra virgolette doppie, indica chi parla e rimanda a un riferimento audio quando vuoi una voce precisa. Descrivi la musica in base al momento in cui entra.
Se una clip parte da una foto, imposta le proporzioni su adattivo oppure ritaglia la foto nel formato di destinazione. Una discordanza è la causa abituale di deformazioni e scatti all'inizio.
ByteDance consiglia di restare sotto circa 1.000 parole inglesi, perché i prompt lunghi perdono dettagli. Con questo limite funziona bene un elenco con i tempi, per esempio i primi due secondi e poi i tre successivi.
Una donna con un vestito rosso appende camicie bianche a uno stendino mentre il sole basso accende i tetti e un cesto di legno sta accanto a lei. È un esempio di brief tranquillo, con un solo soggetto, in cui luce e suoni d'ambiente fanno il lavoro.
Due combattenti, uno con vesti bianche e uno con un mantello di paglia e un cappello conico, si girano intorno e si scontrano su un terreno fangoso tra la nebbia. Un combattimento così si controlla meglio quando il prompt elenca ogni scambio in ordine, con la posizione della camera per ciascuno.
Una ripresa dall'alto di dita che accarezzano pelliccia sintetica accanto a lastre di acrilico e pluriball su un tavolo beige, registrata con un suono ravvicinato e tattile. Mostra come Seedance 2.0 possa costruire una clip attorno alla texture e all'audio, più che a una storia.
Esplora con Mini, rifinisci con Fast e riserva Standard al render che consegnerai. Lo stesso brief vale per tutti e tre, quindi cambiare livello non significa riscriverlo.
La generazione da fotogrammi e Omni Reference sono modalità distinte. Se una ripresa richiede un primo e un ultimo fotogramma esatti, usa la generazione da fotogrammi e descrivi a parole i riferimenti aggiuntivi.
ByteDance segnala che l'output 4K usa una codifica che alcuni lettori e browser non riescono ad aprire direttamente, quindi verifica la riproduzione sul dispositivo di destinazione prima di pianificare una consegna in 4K.
Prepara le bozze a 480p con Mini, dove una clip di 5 secondi costa 38 crediti, e conserva solo le idee che meritano un render migliore.
Standard è il livello per la consegna, con 408 crediti per una clip di 5 secondi in 1080p e 832 in 4K.
Carica fino a nove immagini perché una persona, un prodotto o un ambiente restino riconoscibili in più clip.
Carica una clip di riferimento e descrivi il movimento da riprendere, con una tariffa in crediti più bassa rispetto a una richiesta senza video.
Aggiungi fino a tre file audio insieme a un'immagine o a un video per orientare voce, battito o atmosfera.
Usa un primo e un ultimo fotogramma per stabilire da dove parte la clip e dove arriva.
Seedance 2.0 è il modello video multimodale di ByteDance Seed, presentato a febbraio 2026. Accetta testo, immagini, video e audio come input e produce video con il suono generato insieme alle immagini.
Standard offre il massimo dettaglio e propone 480p, 720p, 1080p e 4K. Fast è più veloce e Mini è il più leggero, e entrambi si fermano a 720p. Tutti e tre condividono le stesse modalità e impostazioni.
Il prezzo cresce con la durata e la risoluzione. Per una clip di 5 secondi a 720p sono 164 crediti con Standard, 132 con Fast e 82 con Mini. A 480p sono 76, 62 e 38. Il generatore mostra la cifra esatta prima dell'invio.
Sì. Quando una richiesta include un video di riferimento, ai secondi generati si applica una tariffa al secondo più bassa. Una clip di 5 secondi a 720p con Standard costa 100 crediti con un video di riferimento contro 164 senza.
Qualsiasi numero intero di secondi da 4 a 15, con 5 come valore predefinito. Per scene più lunghe, Seedance 2.5 su questo sito supera i 15 secondi.
Nella modalità Omni Reference, fino a 9 immagini, 3 video e 3 file audio. Serve almeno un file e le immagini devono pesare meno di 30 MB, i video meno di 50 MB e l'audio meno di 15 MB.
1:1, 4:3, 3:4, 16:9, 9:16, 21:9 e adattivo, con 16:9 preselezionato. Per le clip basate su un'immagine, adattivo segue la tua immagine.
Sì. L'audio è attivo per impostazione predefinita e un interruttore nelle opzioni avanzate lo rimuove. Questa impostazione non cambia il prezzo.
Seedance 2.0 crea clip da 4 a 15 secondi con fino a 9 immagini, 3 video e 3 file audio. Seedance 2.5 arriva a 30 secondi e accetta molti più riferimenti. Su questo sito, 1080p e 4K sono disponibili solo con Seedance 2.0 Standard.
Metti ogni battuta tra virgolette doppie, indica chi parla e, se hai caricato un campione di voce, specifica quale file audio la voce deve seguire. Mantieni le battute abbastanza brevi da stare nella durata della clip.
Nella modalità da testo a video permette al modello di cercare informazioni recenti mentre interpreta il tuo prompt. È facoltativa, disattivata per impostazione predefinita e non disponibile nelle modalità con fotogrammi e riferimenti.
Scegli un livello, decidi come iniziare e controlla il prezzo in crediti prima di generare.