AIモデルとプラットフォーム
アリババ、Qwen3.8を世界のフロンティアシステムで2位と主張

アリババは、Qwenシリーズで最も能力の高いモデルをプレビューし、世界のフロンティアシステムで2位にランクインしていると述べています。ただし、この主張は、ベンチマークスコア、モデルカード、独立した評価なしで発表されました。
このモデル、Qwen3.8-Max-Previewは、2026年7月19日に上海で開催された世界人工知能会議中に、QwenチームのアカウントXの投稿で公開されました。2.4兆パラメータを搭載し、テキストだけでなく画像、ビデオ、ドキュメントも処理できる最初のQwenモデルです。これは、Qwenをテキストエンジンから、米国のライバルがすでに提供しているような汎用システムにシフトさせるものです。
プレビューは、現在、アリババのToken Planサブスクリプションと、QoderおよびQoderWork開発ツールを介して、通常料金の10%で利用可能です。オープンウェイトは約束されていますが、リリース日やライセンス条件は公開されていません。
スコアカードのないランキング
パラメータ数はモデルのサイズを示すものですが、Qwen3.8がどのように推論したり計画したりするかについては何も示しません。ベンチマークや評価が必要なのは、まさにアリババが省略した部分です。
会社はモデルカード、各クエリでアクティブなパラメータ数、タスクレベルの結果を公開しませんでした。Qwen3.8-Maxは「継続的に進化している」とのみ説明されました。これらのギャップはすべて、購入者にとって重要です。アクティブ化されたパラメータ数は、クエリがどれだけの計算リソースを消費するかを示し、モデルカードはトレーニングデータとセーフティテストを文書化し、タスクレベルのスコアはモデルが強い点と弱い点を示します。
これは、アリババが直前にトップモデルをリリースした方法から逸脱しています。Qwen3.7-Maxは、2026年5月に独立したArtificial Analysis Intelligence Indexで56.6のスコアを含む、完全な数字セットとともにリリースされました。ベンダーのベンチマークテーブルは、独立した測定ではなく主張ですが、少なくとも外部評価者にチェックできるものを提供します。Fable 5との比較では、チェックできるものは何もありません。
存在する独立した評価は、反対の方向を示しています。外部のリーダーボードはまだQwen3.8をランク付けしていません。最近スコア付けされたQwenモデルであるQwen3.7-Maxは、LMArenaのリストのトップから遠く離れています。Fable 5は現在、クラウドベースのリーダーボードで1位です。アリババは、購入者に、独自の言葉だけで、世界で2位にランクインする大きなジャンプを受け入れるよう求めています。
中国のフロンティアレース
タイミングは偶然ではありません。Moonshot AIは、3日前に2.8兆パラメータのモデル、Kimi K3を発表し、中国の開発者を、米国最大の研究所が以前独占していたマルチトリリオンパラメータクラスに引き上げました。ライバルは、一部が自社内で行われています。アリババはMoonshotの出資者の一つであり、自社の2つのベットが、中国で最も強力なオープンモデルのタイトルを争っています。両方のリリースは、米国研究所が現在追いかけているオープンウェイト戦略にも依存しています。
2つのリリースの対比は、証拠についてのポイントを強調しています。Kimi K3は、第三者によるスクラッチが付いています。Artificial Analysisは、それをインテリジェンスインデックスで3位にランク付けし、AnthropicのClaude Opus 4.8と比較しています。Qwen3.8には、まさにそのような外部チェックが欠けています。
中国製モデルは、米国の開発者の中で地位を築いてきました。なぜなら、それらは米国トップシステムよりも実行コストが低いためです。米国の議員は、国内での採用を制限する方法について検討を始めています。アリババにとって、賭けは技術的なものと同様に競争的なものです。会社は、過去1年間でQwenを中国のデフォルトAIサプライヤーとして位置付け、オープンウェイトモデルを一連にリリースし、独自のクラウドインフラストラクチャとカスタムシリコンを構築してそれらをサポートしてきました。開発者をQwenよりもほとんどの中国モデルファミリーに引き付ける努力です。
Bank of America (BAC ) のアナリスト、アレックス・リュー氏は、Kimi K3が中国モデルの能力上限を引き上げたとし、アリババのオープンソースリーダーとしての立場が新たなテストに直面する可能性があると書いています。投資家は無関心でした。アリババの株価は、プレビューの翌日、最大5.4%上昇しました。
ランキングは、友好的チャネルを通じて広まりました。アリババが所有するSouth China Morning Postは、Fable 5との比較と、Qwen3.8を現在利用可能な最も強力なモデルの一つとして説明する会社の説明を繰り返しました。アリババがベンチマークまたは約束したオープンウェイトを公開するまで、それはマーケティングラインであり、測定された結果ではありません。現在、テストできるのは、割引プレビューレートを支払う開発者だけです。












