鮮明な参照画像を使う
ぼやけた顔や、一部が隠れた顔では、モデルが手がかりを得にくくなります。均一に照らされ、被写体がフレームの大きな割合を占める画像を選んでください。
BestAIVideo
Qwen Image 2.1 は、画像の生成と、手元の画像の編集を1つにまとめたAlibabaのモデルです。絵を言葉で説明するか、最大10枚の参照画像をアップロードして変更点を伝え、1Kか2Kを選べば、送信前に消費クレジットを確認できます。
Qwenは、このモデルをコンパクトながら高性能で、文字表現が改善され、編集での人物の同一性の保持が強化されたものだと説明しています。ジェネレーターで使える機能は次のとおりです。
新しい画像にはテキストモード、すでにある画像を変えるには、1〜10枚の参照画像を使う編集モードを使います。
Qwenによると、人物や商品は編集しても見分けがつく状態が保たれます。一致する可能性を高めるには、鮮明で正面を向いた参照画像を選んでください。
1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:9、9:21から選べます。編集モードでは、参照画像の形に合わせる自動の選択肢も加わります。
1Kは4クレジット、2Kは7クレジットで、テキストでも編集でも同じです。参照画像の枚数で料金が変わることはありません。
Qwenの例は、短く素直な指示と、画像に表示したい文字を引用符で囲む書き方でできています。このパターンを土台に、役に立つところだけ細部を足していきましょう。
被写体、場面、雰囲気を挙げます。たとえば、雨の夜、濡れた舗道に映るネオンの店の看板、のように書きます。細部は、最初の結果を見てから足してください。
Qwenは、書体とレイアウトを考慮したタイポグラフィを特長に挙げています。正確な文言を引用符で囲み、言葉だけでなく文字のスタイルも説明してください。
編集では、背景を夕日のビーチに変える、のように変更したい内容を書き、変えてはいけないものも伝えます。
複数の画像を使うときは、どれがキャラクター、どれが背景、どれがスタイルなのかを書いておきます。そうすれば、モデルが推測せずに済みます。
図のブロック、棒グラフ、表、キャプションが、密度の高い1ページに収まっています。小さなラベルとレイアウトの耐久テストであり、生成後にすべての文字を確かめる場面でもあります。
赤い衣装のカートゥーンのドラゴンが、提灯と紙吹雪に囲まれた祝祭の獅子にまたがり、背景は清潔な白です。ステッカーのプロンプトは、太い輪郭線とシンプルな背景を頼むと、うまくいきます。
あいさつ文、サントリーニ島のメインカード、4つのプラン用アイコン、旅のリストを備えたスマートフォン画面が、縦長の1枚の画像に構成されています。画面のモックアップが、1つの指示で下書きできることが分かります。
ぼやけた顔や、一部が隠れた顔では、モデルが手がかりを得にくくなります。均一に照らされ、被写体がフレームの大きな割合を占める画像を選んでください。
縦長のストーリー形式には9:21、映画的なヘッダーには21:9を使います。編集モードの自動は、最初の参照画像の形を保ちます。
生成された文字が最も崩れやすいのは、密度の高い図と小さなキャプションです。資料に画像を置く前に、等倍まで拡大して確認してください。
ある商品のカットを何枚かアップロードし、形と色は見分けがつく状態のまま、新しい場面に置きます。
見出しを引用符で指定してポスターを生成し、縦長やパノラマにするなら、9:21や21:9に切り替えます。
チャットのスタンプ、パッケージ、イベントの資料に使える、背景のすっきりしたキャラクターアートを作ります。
デザインチームが作り込む前に、アプリの画面やランディングページのラフを描きます。
顔写真を軽いタッチで編集します。同一性を保つため、元の写真を参照画像にします。
最大10枚のアップロードからパーツを取り出して1つの構図にまとめ、各ファイルがどの要素を提供するのかを書きます。
これは、Alibabaの Qwen チームが2026年9月にリリースしたモデルです。テキストから画像の生成と、画像編集を1つのモデルにまとめています。
編集モードで最大10枚で、1枚以上が必須です。テキストモードでは使いません。
サイズは1Kと2Kです。テキストモードでは、1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:9、9:21を選べ、編集モードには、初期設定となる自動が加わります。
1Kの画像は4クレジット、2Kは7クレジットです。テキストモードと編集モードは同じ料金で、送信前にジェネレーターが金額を表示します。
最大5,000文字まで入力できます。詳しい場面の描写と、引用符で囲んだ複数行の文字を書くには十分です。
背景を夕日のビーチに変える、のような素直な指示を書き、そのまま残すものを添えます。できるだけ、1回のリクエストで変更は1つにします。
Qwenは、書体とレイアウトを考慮した、改善されたタイポグラフィを特長に挙げています。正確な文言を引用符で囲み、文字のスタイルを説明し、小さな文字は校正してください。
Qwenはこのモデルにネイティブの透過出力があると説明していますが、このジェネレーターには透過の設定がありません。無地の背景を指定し、切り抜きは自分で行ってください。
こちらは、独自の料金と、1K・2Kのサイズを持つ、新しい別のモデルです。以前のQwenのモデルには、それぞれの設定と料金が残っています。
4クレジットと7クレジットなので、3クレジットのSeedream 5.0 Flashと、5・8・13クレジットのGPT Image 2.5の中間に位置します。