生成AIツール

Qwen-Image-2.1が公開。7Bで2K画像、商用利用は別ライセンスに

Alibabaが画像の生成と編集を1つで行うQwen-Image-2.1を2026年9月20日に公開。生成部分は7Bで2048×2048をネイティブ出力し、背景透過(RGBA)や参照画像10枚までの編集に対応します。一方でライセンスはApache 2.0から研究用途限定に変わりました。

Alibabaが2026年9月20日、画像の生成と編集を1つのモデルで行う「 Qwen-Image-2.1 」の重みを公開しました。生成部分は7Bと小さく、2048×2048をネイティブで出力し、背景が透明なRGBA画像も直接作れます。ただし気をつけたいのはライセンスで、初代Qwen-ImageとQwen-Image-2.0のApache 2.0から、商用利用を禁じる「Qwen Research License Agreement」に変わりました。すでに業務のパイプラインにQwen-Imageを組み込んでいるチームは、差し替える前にここを確認する必要があります。

7Bで2Kを出す構成

モデルカードによると、生成部分は32層のSingle-Stream DiT(Diffusion Transformer、拡散モデルをトランスフォーマーで構成したもの)で7B。テキストエンコーダにはQwen3-VLの8Bを使います。混合粒度のアテンションとプレフィックスKVキャッシュの再利用を組み合わせ、「低い計算コストで高い画質を出す」ことを設計の狙いとして挙げています。

対応するアスペクト比は7種類で、1:1が2048×2048、16:9が2752×1536、3:2が2528×1696です。小さく作ってから拡大するのではなく、この解像度をそのまま出せる点が2.0からの実用的な差になります。

編集側では、参照画像を最大10枚まで同時に渡せます。公式は集合写真、バーチャル試着、部屋のレイアウトを例に挙げています。局所的な修正は、画像に丸を描く・塗る・マスクを付けるといった指示で位置を伝えられ、人物の同一性を保ったまま直せるとしています。

初代Qwen-Imageからの変化
出典: Qwen 公式モデルカードおよび各モデルのLICENSE(2026年9月20日時点)

ライセンスの何が変わったか

LICENSE には「You shall not use the Materials for any commercial purpose without obtaining a separate commercial license from us.(当社から個別の商用ライセンスを取得せずに、本モデルを商用目的で使用してはならない)」と明記されています。商用で使う場合は、LICENSEに記載された問い合わせ窓口へ個別に申請する運用です。あわせて、このモデルを使って学習・ファインチューニングした別のモデルを配布する際は「Built with Qwen」または「Improved using Qwen」の表示が求められます。

紛らわしいのは、Qwenの画像モデルがいま3種類の公開度で並んでいることです。初代と2.0はApache 2.0で重み公開、7月に出たQwen-Image 3.0は重みを出さないクローズド、そして今回の2.1が「重みは出すが研究用途のみ」。バージョン番号が大きいほど新しくオープン、という読み方ができない状態になっています。

導入前に確認したい3点
出典: Qwen-Image-2.1 の LICENSE(Qwen Research License Agreement)

日本の読者にとっての使いどころ

日本語の文字入れを考えている場合、設計としては期待が持てます。プロンプトを書き直すPE-I2Iリライターには、画像に描き込む文字の言語をどう決めるかの規則が組み込まれており、ユーザーの明示指定、画像内の既存の文字、指示文の言語という優先順で判断します。英語に引っ張られない作りです。ただし日本語の描画品質を独立に検証した結果はまだ見当たらないため、自分のユースケースで試す前提で考えてください。

手元で動かす場合のサイズ感は、一式でおよそ33GB、うちテキストエンコーダが17.5GBを占めるという報告があります( OrcaRouter の検証記事 )。VRAMが足りない環境ではCPUオフロードが用意されています。ComfyUIは公開当日からの対応を表明しているので、ローカルで試す導線自体は整っています。一方、執筆時点では主要な推論APIでの提供が確認できておらず、クラウド経由で手軽に試す選択肢は限られます。

商用前提のプロジェクトでは、無理に2.1へ寄せる必要はありません。Apache 2.0の初代Qwen-Image(20B)を使い続ける、あるいは同じAlibabaでも Qwen3.8-Omni-Flash のようにAPI提供されていて利用規約が明確なモデルを選ぶ、という分け方が現実的だと考えられます。

次に動くなら、この順番が早いはずです。まず自社のパイプラインが使っているQwen-Imageのバージョンを確認する(2.0までならApache 2.0のままです)。次に2.1を試すなら社内検証に限定し、成果物を顧客に出す可能性があるかを法務と一緒に整理する。そのうえで商用の見込みがあるなら、LICENSE記載の窓口に条件を早めに問い合わせておく。ライセンスの確認を後回しにすると、動くものができてから戻れなくなります。

出典

関連記事

生成AIツールの記事 →