アリババクラウド (Alibaba Cloud) は10月2日(現地時間)、画像生成モデル「クウェン・イメージ2.1プロ (Qwen-Image-2.1-Pro)」の提供を開始した。クウェン (Qwen) ファミリーに属するこのモデルは、生成品質、推論効率、コストのバランスに優れ、70億パラメータの視覚生成コンポーネントを搭載。単一モデルで透過画像の生成から編集までを一貫して実現する。
クウェン・イメージ2.1プロ (Qwen-Image-2.1-Pro) は、以下の4つの主要な改善点を特徴としている。
まず、Compact and efficientとして、軽量なアーキテクチャと推論の最適化により、画像品質と計算コストの効率的なバランスが図られている。次に、Native transparency, unified creation and editingでは、プロンプトからの透過画像または通常画像の生成、透過レイヤーの編集、写真からの被写体抽出が可能になった。三つ目に、Versatile editingとして、最大10枚の参照画像の使用、ローカル編集の指定、人物や製品の保持など、幅広い編集タスクに対応する。最後に、Realistic textures and refined aestheticsにより、タイポグラフィ、ポートレートライティング、微細なディテールが改善され、生成される画像の視覚的魅力が高まっている。
アリババクラウド (Alibaba Cloud) は、同時期に複数のモデルもリリースしている。9月24日(現地時間)には、高頻度ビジネス意思決定向けの構造化意思決定モデルデシジョンモデルプレビュー (decision-model-preview)が公開された。これはテキストまたはビジネスコンテキストに基づき、分類、イエス・ノー判断、スコアリングを並行して実行する。
9月21日(現地時間)には、リアルタイムオーディオおよびビデオインタラクションをサポートするクウェン3.8オムニフラッシュ・リアルタイム (qwen3.8-omni-flash-realtime)が加わった。さらに9月17日(現地時間)には、リアルタイムインタラクティブなオープンワールドモデルであるハッピーオイスター・アドベンチャー (HappyOyster Adventure)、ハッピーオイスター・ディレクティング (HappyOyster Directing)、ハッピーオイスター・アクティング (HappyOyster Acting)が発表された。また同日には、テキスト、画像、オーディオ、ビデオ入力をサポートするクウェン3.8オムニフラッシュ (Qwen3.8-Omni-Flash)も公開されている。
9月14日(現地時間)には、ビデュー (Vidu) シリーズからビデューQ3ミックス_リファレンス2ビデオ (viduq3-mix_reference2video)、ビデューQ3アド_リファレンス2ビデオ (viduq3-ad_reference2video)、ビデューQ3ドラマ_リファレンス2ビデオ (viduq3-drama_reference2video)、およびビデューQ2プロファスト_イメージ2ビデオ (viduq2-pro-fast_img2video)といった複数のビデオ生成モデルがリリースされた。同日には参照画像生成モデルビデューイメージ_リファレンス2イメージ (vidu-image_reference2image)も提供開始されている。9月13日(現地時間)には、ディープシーク (DeepSeek) の新たなアーキテクチャファミリーの軽量フラッグシップであるディープシークV4.1フラッシュ (DeepSeek-V4.1-Flash)が加わった。これは552BのMoEパラメータと1Mトークンのコンテキストウィンドウを特徴とする。9月2日(現地時間)には、クウェン3.8マックス (Qwen3.8-Max)のアップグレード版であるクウェン3.8マックス-0902 (qwen3.8-max-0902)が公開され、コーディング機能と協調エージェント性能が強化されている。
参考: alibabacloud.com — 2026年10月3日 15:48 (JST)