依階段選擇版本
用 Mini 探索,用 Fast 打磨,把 Standard 留給要交付的那一支。同一份簡報可以在三個版本之間沿用,換版本不代表要重寫。
BestAIVideo
Seedance 2.0 是字節跳動 Seed 團隊的多模態影片模型,在這裡分成 Standard、Fast 和 Mini 三種版本,讓成本能跟著專案的階段走。你可以從文字開始,用幀固定一個鏡頭,或一次放入最多九張圖片、三段影片和三段音訊,而且生成之前就能看到確切的積分花費。
字節跳動 Seed 把它定位為統一的模型,可輸入文字、圖片、影片和音訊,並在輸出中同步生成聲音。以下是生成器提供給你的設定。
Standard 的細節最細緻,也是唯一提供 1080p 和 4K 的版本。Fast 迭代更快,Mini 則是適合預覽和批次探索的輕量選擇。Fast 與 Mini 最高只到 720p。
可以在這個範圍內挑選任何整數秒的長度,預設是 5 秒。聲音會隨畫面一起生成,想要無聲的片段時,可以在進階選項裡用開關把它關掉。
可以用文生影片、必須提供首幀且可選尾幀的幀生成,或是全能參考,後者在一次請求中最多接受 9 張圖片、3 段影片和 3 個音訊檔案。
在文生影片模式中,你可以開啟聯網搜尋,讓關於時事話題的提示詞能參考最新的資訊。它預設是關閉的,也不會改變價格。
字節跳動為它提供的指引,是把每一份上傳的素材都當成簡報裡有編號的一部分。下面這些習慣,能讓內容繁雜的請求仍然清楚易讀。
用圖片 1、影片 2 和音訊 1 來指稱素材,每一種類型都依上傳順序從一開始編號。並說明要從每一份素材取用什麼,例如取圖片 1 的服裝,或取影片 1 的運鏡。
每一句說出口的話都用雙引號包起來,說明是誰在說,想要特定的聲音時,就指向某一份音訊參考。音樂則以它進入的時間點來描述。
如果影片從一張照片開始,請把比例設為自適應,或把照片裁成目標的形狀。比例不一致,通常就是開頭畫面被拉伸、出現跳動的原因。
字節跳動建議把長度控制在大約 1,000 個英文單字以內,因為過長的提示詞會遺漏細節。在這個範圍內,採用附時間碼的清單效果很好,例如前兩秒,接著的三秒。
一位穿紅色洋裝的女子把白襯衫夾上曬衣繩,低垂的太陽在屋頂上閃出光暈,身旁放著一個木籃。它是安靜、單一主體簡報的範例,光線和環境聲就足以撐起畫面。
兩位劍客在薄霧籠罩的泥地上繞圈、交鋒,一位身穿白袍,另一位披著蓑衣、戴著斗笠。像這樣的打鬥場面,只要提示詞依序列出每一次交手,並標出每一次的攝影機位置,就更容易掌控。
從正上方拍攝手指撫摸米色桌面上的人造毛皮,旁邊放著壓克力板和氣泡紙,並錄下貼近而有觸感的聲音。這顯示 它可以圍繞質感和聲音來建立影片,而不是圍繞一個故事。
用 Mini 探索,用 Fast 打磨,把 Standard 留給要交付的那一支。同一份簡報可以在三個版本之間沿用,換版本不代表要重寫。
幀生成和全能參考是各自獨立的模式。如果某個鏡頭需要精確的首幀和尾幀,就使用幀生成,並用文字描述其餘的參考素材。
字節跳動指出,4K 輸出採用的編碼,有些播放器和瀏覽器無法直接開啟,所以在規劃 4K 交付之前,請先在目標裝置上確認播放正常。
在 Mini 以 480p 打草稿,5 秒的影片只要 38 積分,只留下值得用更好畫質重新生成的想法。
Standard 是用於交付的版本,5 秒的 1080p 影片是 408 積分,4K 則是 832 積分。
放入最多九張圖片,讓人物、產品或場景在多支影片中都保持可辨識。
上傳一段參考影片,並描述要借用的動態,積分費率比沒有影片的請求更低。
在圖片或影片之外,再加上最多三個音訊檔案,來引導人聲、節拍或氛圍。
用首幀和尾幀決定影片從哪裡開始,又在哪裡收尾。
它是字節跳動 Seed 團隊推出的多模態影片模型,於 2026 年 2 月發表。它接受文字、圖片、影片和音訊作為輸入,並生成聲音與畫面同步產出的影片。
Standard 的細節最多,提供 480p、720p、1080p 和 4K。Fast 速度較快,Mini 最為輕量,兩者最高都只到 720p。三種版本共用相同的模式和設定。
價格隨長度和解析度而變。5 秒、720p 的影片,Standard 是 164 積分,Fast 是 132,Mini 是 82;在 480p 則分別是 76、62 和 38。生成器會在你提交之前顯示確切的數字。
會。當請求中包含參考影片時,你所生成的秒數會套用較低的每秒費率。Standard 的 5 秒、720p 影片,有參考影片是 100 積分,沒有則是 164。
從 4 到 15 秒之間的任何整數秒,預設是 5 秒。如果需要更長的場景,本站的 Seedance 2.5 可以超過 15 秒。
在全能參考模式中,最多可上傳 9 張圖片、3 段影片和 3 個音訊檔案。至少需要一個檔案,而且圖片須小於 30 MB,影片小於 50 MB,音訊小於 15 MB。
有 1:1、4:3、3:4、16:9、9:16、21:9 和自適應,預設選取 16:9。對以圖片為主的影片,自適應會依照你的畫面。
可以。聲音預設為開啟,在進階選項裡用一個開關就能移除。這個設定不會改變價格。
2.0 可用最多 9 張圖片、3 段影片和 3 個音訊檔案,做出 4 到 15 秒的影片。Seedance 2.5 最長可達 30 秒,也能接受多得多的參考素材。在本站,1080p 和 4K 只在 Seedance 2.0 Standard 提供。
把每一句台詞放進雙引號,說明是誰在說;如果你上傳了聲音樣本,就指明聲音要依照哪一個音訊檔案。台詞的長度要配合影片的時長,保持簡短。
在文生影片模式中,它讓模型在解讀提示詞時查詢最新的資訊。它是選用功能,預設為關閉,在幀生成和參考模式中無法使用。