IT Post

by Rice Studio Lab


記事を検索
文字サイズ
ふりがな
AI・生成AI

アリババの新画像AI「Qwen-Image-2.1」、7Bで最強を名乗るが商用利用できない理由を見定める

アリババがオープンウェイトの画像生成AI「Qwen-Image-2.1」を公開。透過画像に対応した7Bモデルの実力と、商用利用不可というライセンスの中身を見た

30秒で分かる結論

  • 中国アリババグループのAI開発チームQwenは2026年9月20日、画像生成と画像編集を1つのモデルで行える新しいオープンウェイト(重みデータを公開する)AIモデル「Qwen-Image-2.1」を公開しました。画像生成を担う部分のパラメータ数は約70億(7B)で、前モデル「Qwen-Image」の約200億(20B)から大きく削減されています。
  • 新モデルは、背景が透明な画像(透過画像、RGBA形式)を直接生成・編集できる点、最大10枚の参照画像を使って人物や商品の同一性を保ったまま画像を合成・編集できる点、ネイティブで2K解像度の出力に対応する点が特徴だとQwenは説明しています。
  • 公開と同時に、画像生成ツール「ComfyUI」や、AIモデル向けライブラリ「Diffusers」など複数の開発者向けツールが即座に対応(Day-0対応)しましたが、ライセンスは「非商用目的のみ」に限定した「Qwen Research License Agreement」が採用されており、商用利用には別途アリババ側との契約が必要だとしています。
この記事の目次 7項目
出典を確認する(4件)
記事のテーマを表した生成イメージ
生成AIによるイメージ。実物や実際の画面ではありません。

まず初めに

*パラメータ数を3分の1近くまで削って「性能は上がりました」と言われると、AI業界の常識的にはにわかに信じがたい話だが、そこはひとまず置いておこう。*本当に引っかかるのは看板の「オープン」という言葉の使い方の方だ。重みデータを無料で公開しておきながら、実際に商売に使おうとした瞬間に「それはライセンス違反です」と釘を刺してくる仕組みは、無料試食コーナーに「気に入ったら買ってね」の札を立てるのとはわけが違う。※個人の感想です

この記事の内容にちなんだ挿絵
生成AIによるイメージ。実物や実際の画面ではありません。

何が起きているのか

中国アリババグループ傘下のAI開発チームQwenは2026年9月20日、画像生成モデルの最新版「Qwen-Image-2.1」を公開しました。米Hugging Face、中国ModelScopeといったAIモデル公開プラットフォームでモデルの重みデータ(パラメータ)が配布されているほか、ソースコードもGitHub上で公開されています。

新モデルの特徴は、テキストからの画像生成と、既存画像の編集を1つのモデルで行える点に加え、背景が透明な画像(透過とうか画像、専門的にはRGBA形式と呼ばれる4チャンネルの画像)を、別途の切り抜き処理を挟まずに直接生成・編集できる点です。ロゴ・アイコン・商品写真など、透明な背景が必要な素材を作る場合に、後工程の手間を省ける設計だとQwenは説明しています。また、最大10枚の参照画像を入力として与えることができ、人物や商品の見た目の同一性を保ったまま、画像の合成や部分的な編集(円で囲む・手描きの注釈・マスク指定など)ができるとしています。出力解像度は、ネイティブで2K(高精細な解像度)に対応するとしています。

モデルの規模については、画像生成を担う中核部分のパラメータ数が約70億(7B)にとどまり、前モデル「Qwen-Image」の約200億(20B)から大幅に削減されています。Qwenは、演算の一部を効率化する設計(注意機構の工夫やキャッシュの再利用)により、少ないパラメータ数でも高い画質を保てるとしており、自社が実施した公開の評価(ベンチマーク)では、他のオープンウェイトモデルの中で最上位の評価を得たと説明しています。ただし、この性能評価はQwen自身によるものであり、独立した第三者による検証は今回参照した情報源の範囲では確認できていません。

公開と同時に、画像生成ツール「ComfyUI」、AIモデル向けライブラリ「Diffusers」、AIモデルの実行を高速化するソフトウエア「vLLM」など、複数の開発者向けツールが即日対応(Day-0対応)しました。一方で、モデルのライセンスには「Qwen Research License Agreement」が採用されており、利用・改変・再配布が認められるのは非商用の研究・評価目的に限られ、商用目的での利用には、モデルの開発元である杭州通義実験室(アリババのAI研究部門)との別途契約が必要だと明記されています。

なぜ重要なのか

今回の発表が注目されるのは、パラメータ数を大幅に削減しながら性能を高めるという、AI開発競争における「小型・高効率化」の流れを、画像生成モデルの分野でも示した点です。文章生成AIの分野では、DeepSeekなど中国勢が同様に「少ないアクティブパラメータで高い性能を狙う」設計を相次いで打ち出しており、画像生成AIの分野でも同じ方向性の開発が進んでいることがうかがえます。

一方で、「オープンウェイト」を掲げるAIモデルの多くが、実際には商用利用を制限するライセンスを採用している点も、あらためて注目に値します。重みデータやコードが無料で公開されているからといって、それがそのまま自由に商用利用できることを意味するとは限らず、利用者側がライセンス条件を確認する必要性が、AIモデルの選択においてますます重要になっています。

私たちへの影響

一般の利用者が今回のモデルを直接使う場面は限られますが、画像生成・編集サービスを開発・提供している日本国内の企業や個人開発者にとっては、無視できない話題です。透過画像への対応や複数参照画像による編集機能は、ECサイトの商品画像作成やデザイン制作の現場で実用的な機能であり、性能次第では既存の有料画像生成サービスの選択肢の一つになり得ます。

ただし、ライセンスが非商用限定である以上、こうした用途に組み込む場合は、アリババ側との別途契約が必要になる点に注意が必要です。「無料で公開されているから自社サービスに組み込んでよい」と誤解したまま利用してしまうと、ライセンス違反につながる恐れがあります。

初心者が知っておくべきこと

「オープンウェイト」とは、AIモデルの学習済みパラメータ(重みデータ)が公開され、誰でもダウンロードして自分の環境で動かせる状態を指す言葉です。よく似た言葉に「オープンソース」がありますが、オープンソースは本来、利用・改変・再配布に関する制限が少ない、より自由なライセンスを指すことが多く、今回のQwen-Image-2.1のように重みは公開されていても商用利用が制限されているモデルは、厳密には「オープンソース」ではなく「オープンウェイト」と呼んで区別されることがあります。

また、「透過画像(RGBA形式)」とは、通常の色情報(赤・緑・青)に加えて、画素ごとの透明度の情報を持たせた画像形式のことです。背景を透明にできるため、他の画像やウェブページの上に重ねて使う素材(ロゴ・アイコン・商品画像など)によく使われます。

IT Postの見方――「オープン」の看板と、契約書の中身は別物と考えた方がいい

IT Postでは、無料で試せるAIモデルが増えること自体は歓迎すべき流れだと考えますが、「オープン」という言葉の響きだけで商用利用の可否を判断するのは危ういと考えます。

看板に「オープンウェイト」と大きく書いてあっても、細かい契約条件を読めば「商売に使うなら別途連絡してください」と小さく書いてある、というのはこの手のモデルにありがちなパターンだ。特に日本の中小事業者やフリーランスのクリエイターが、コストを抑えたい一心で無料モデルに飛びついた結果、後になってライセンス違反を指摘されるような事態は避けたい。IT Postでは、こうした「オープン」を掲げるAIモデルをビジネスに組み込む前に、ライセンス条文を実際に確認する習慣を持つことを勧めたいと考えます。※個人の感想です

今後どうなりそうか

Qwen-Image-2.1は公開されたばかりで、今回参照した情報源の範囲では、独立した第三者による性能検証の結果はまだ確認できていません。IT Postでは、実際の開発者コミュニティによる評価や、商用ライセンスの提供条件が明らかになり次第、あらためて取り上げます。

情報源

この記事を共有する

用語辞典へ