段階に合わせてティアを選ぶ
探索はMini、磨き込みはFast、納品する最終版にはStandardを使います。同じ企画書を3つのティアでそのまま使えるので、ティアを変えても書き直しは要りません。
BestAIVideo
Seedance 2.0はByteDance Seedのマルチモーダル動画モデルで、ここではStandard、Fast、Miniの3ティアから選べるため、制作の段階に合わせてコストを調整できます。テキストから始めても、フレームでショットを固定しても、最大9枚の画像と3本の動画クリップ、3つの音声クリップを渡してもかまいません。生成の前に、正確なクレジット料金も確認できます。
ByteDance Seedは、このモデルをテキスト・画像・動画・音声を入力でき、出力にも同期した音が付く統合モデルと説明しています。以下は、ジェネレーターで設定できる項目です。
Standardは最も細部まで描けるティアで、1080pと4Kを選べるのもこのティアだけです。Fastは試行の回転が速く、Miniはプレビューや大量の試作に向く軽量版です。FastとMiniは720pまでです。
この範囲で好きな整数の秒数を選べます。初期設定は5秒です。音声は映像と一緒に生成され、無音のクリップにしたいときは詳細オプションのスイッチでオフにできます。
テキストから動画、必須の最初のフレームと任意の最後のフレームを使うフレームから生成、そして1回のリクエストで最大9枚の画像、3本の動画クリップ、3つの音声ファイルを受け付けるOmni Referenceから選べます。
テキストから動画のモードでは、ウェブ検索をオンにして、最新の話題を扱うプロンプトが新しい情報を参照できるようにできます。初期設定ではオフで、料金は変わりません。
ByteDanceのガイダンスでは、アップロードした素材のひとつひとつを、番号のついた企画書の一部として扱います。次の習慣を守れば、素材の多いリクエストでも読みやすさを保てます。
画像1、動画2、音声1のように、種類ごとにアップロードした順に1から番号を振って呼びます。そのうえで、画像1から衣装を、動画1からカメラの動きを、というように、各素材から何を取り入れるかを書き添えます。
話す内容は一行ずつ二重引用符で囲み、誰が話すのかを明記します。特定の声にしたいときは、音声の参照素材を指定します。音楽は、いつ入るかのタイミングで説明します。
写真からクリップを始めるなら、比率をアダプティブにするか、写真を目的の形に切り抜いておきます。冒頭で映像が引き伸ばされたり飛んだりするのは、たいてい比率の不一致が原因です。
ByteDanceは、長いプロンプトでは細部が抜け落ちるため、英語で約1,000語以内にとどめるよう勧めています。最初の2秒、次の3秒というように時間で区切って箇条書きにすると、その範囲でうまくまとまります。
赤いドレスの女性が白いシャツを物干しロープに留めていくと、低い夕日が屋根の上でまぶしく光り、傍らには木のかごが置かれています。被写体がひとつで静かな企画書の見本で、光と環境音が場面を引っ張ります。
白い装束の剣士と、蓑と笠をまとった剣士が、霧のかかったぬかるみの地面でにらみ合い、斬り結びます。このような戦闘は、やり取りを順番に書き出し、そのたびのカメラ位置も添えると、制御しやすくなります。
ベージュのテーブルの上で、アクリル板とプチプチのそばにあるフェイクファーを指でなでる様子を真上から撮影し、近くで触れるような音を収録しています。このモデルなら、物語ではなく質感と音を軸にクリップを組み立てられることがわかります。
探索はMini、磨き込みはFast、納品する最終版にはStandardを使います。同じ企画書を3つのティアでそのまま使えるので、ティアを変えても書き直しは要りません。
フレームから生成とOmni Referenceは別々のモードです。最初と最後のフレームをきっちり決めたいショットにはフレームから生成を使い、追加の参照素材は言葉で説明します。
ByteDanceによると、4Kの出力は一部のプレーヤーやブラウザーでは直接開けないエンコードを使っています。4Kで納品する前に、再生先の機器で再生できるかを確かめてください。
Miniで480pの下書きを作れば、5秒のクリップが38クレジットです。そこから、きれいに仕上げる価値のあるアイデアだけを残します。
納品用のティアはStandardで、5秒の1080pクリップは408クレジット、4Kは832クレジットです。
最大9枚の画像を渡せば、人物や商品、舞台設定が、複数のクリップにわたって見分けのつく状態で保たれます。
参照用のクリップをアップロードし、借りたい動きを言葉で説明します。動画なしのリクエストよりも低いクレジットレートが適用されます。
画像や動画に加えて最大3つの音声ファイルを入れ、声やビート、雰囲気を方向づけられます。
最初のフレームと最後のフレームを使い、クリップの出発点と着地点を自分で決められます。
Seedance 2.0は、2026年2月に発表されたByteDance Seedのマルチモーダル動画モデルです。テキスト、画像、動画、音声を入力として受け付け、映像と同時に生成された音声つきの動画を出力します。
Standardは最も細部まで描け、480p、720p、1080p、4Kに対応します。Fastはより速く、Miniは最も軽量で、どちらも720pまでです。3つとも、使えるモードと設定は共通です。
料金は長さと解像度に応じて変わります。5秒の720pクリップは、Standardが164クレジット、Fastが132クレジット、Miniが82クレジットです。480pでは順に76、62、38クレジットになります。正確な金額は、送信する前にジェネレーターに表示されます。
はい。リクエストに参照動画が含まれる場合は、生成する秒数に対して1秒あたりの低いレートが適用されます。Standardで5秒の720pクリップは、参照動画なしだと164クレジットですが、ありなら100クレジットです。
4秒から15秒までの整数の秒数で、初期設定は5秒です。それより長い場面には、このサイトのSeedance 2.5が15秒を超える長さに対応しています。
Omni Referenceモードでは、画像が最大9枚、動画が3本、音声ファイルが3つまでです。少なくとも1つのファイルが必要で、画像は30 MB未満、動画は50 MB未満、音声は15 MB未満という上限があります。
1:1、4:3、3:4、16:9、9:16、21:9、アダプティブから選べ、初期設定は16:9です。画像から始めるクリップでは、アダプティブを選ぶと元の画像の比率に合わせます。
はい。音声は初期設定でオンで、詳細オプションのスイッチを切ると音声がなくなります。この設定で料金は変わりません。
こちらは、最大9枚の画像と3本の動画、3つの音声ファイルから、4〜15秒のクリップを作ります。Seedance 2.5は30秒まで届き、さらに多くの参照素材を受け付けます。このサイトで1080pと4Kを使えるのは、Seedance 2.0のStandardだけです。
一行ずつ二重引用符で囲み、話す人を明記します。声のサンプルをアップロードしたなら、どの音声ファイルの声に従うかも書いてください。セリフはクリップの長さに収まる短さにとどめます。
テキストから動画のモードで、プロンプトを解釈するあいだにモデルが最新の情報を調べられるようにする機能です。任意で、初期設定はオフ、フレームから生成と参照のモードでは使えません。