AIモデルとプラットフォーム

アリババ、Qwen3.8を世界のフロンティアシステムで2位と主張

mm
Unite.AI を Google の優先ソースに追加

アリババは、Qwenシリーズで最も能力の高いモデルをプレビューし、世界のフロンティアシステムで2位にランクインしていると述べています。ただし、この主張は、ベンチマークスコア、モデルカード、独立した評価なしで発表されました。

このモデル、Qwen3.8-Max-Previewは、2026年7月19日に上海で開催された世界人工知能会議中に、QwenチームのアカウントXの投稿で公開されました。2.4兆パラメータを搭載し、テキストだけでなく画像、ビデオ、ドキュメントも処理できる最初のQwenモデルです。これは、Qwenをテキストエンジンから、米国のライバルがすでに提供しているような汎用システムにシフトさせるものです。

プレビューは、現在、アリババのToken Planサブスクリプションと、QoderおよびQoderWork開発ツールを介して、通常料金の10%で利用可能です。オープンウェイトは約束されていますが、リリース日やライセンス条件は公開されていません。

スコアカードのないランキング

パラメータ数はモデルのサイズを示すものですが、Qwen3.8がどのように推論したり計画したりするかについては何も示しません。ベンチマークや評価が必要なのは、まさにアリババが省略した部分です。

会社はモデルカード、各クエリでアクティブなパラメータ数、タスクレベルの結果を公開しませんでした。Qwen3.8-Maxは「継続的に進化している」とのみ説明されました。これらのギャップはすべて、購入者にとって重要です。アクティブ化されたパラメータ数は、クエリがどれだけの計算リソースを消費するかを示し、モデルカードはトレーニングデータとセーフティテストを文書化し、タスクレベルのスコアはモデルが強い点と弱い点を示します。

これは、アリババが直前にトップモデルをリリースした方法から逸脱しています。Qwen3.7-Maxは、2026年5月に独立したArtificial Analysis Intelligence Indexで56.6のスコアを含む、完全な数字セットとともにリリースされました。ベンダーのベンチマークテーブルは、独立した測定ではなく主張ですが、少なくとも外部評価者にチェックできるものを提供します。Fable 5との比較では、チェックできるものは何もありません。

存在する独立した評価は、反対の方向を示しています。外部のリーダーボードはまだQwen3.8をランク付けしていません。最近スコア付けされたQwenモデルであるQwen3.7-Maxは、LMArenaのリストのトップから遠く離れています。Fable 5は現在、クラウドベースのリーダーボードで1位です。アリババは、購入者に、独自の言葉だけで、世界で2位にランクインする大きなジャンプを受け入れるよう求めています。

中国のフロンティアレース

タイミングは偶然ではありません。Moonshot AIは、3日前に2.8兆パラメータのモデル、Kimi K3を発表し、中国の開発者を、米国最大の研究所が以前独占していたマルチトリリオンパラメータクラスに引き上げました。ライバルは、一部が自社内で行われています。アリババはMoonshotの出資者の一つであり、自社の2つのベットが、中国で最も強力なオープンモデルのタイトルを争っています。両方のリリースは、米国研究所が現在追いかけているオープンウェイト戦略にも依存しています。

2つのリリースの対比は、証拠についてのポイントを強調しています。Kimi K3は、第三者によるスクラッチが付いています。Artificial Analysisは、それをインテリジェンスインデックスで3位にランク付けし、AnthropicのClaude Opus 4.8と比較しています。Qwen3.8には、まさにそのような外部チェックが欠けています。

中国製モデルは、米国の開発者の中で地位を築いてきました。なぜなら、それらは米国トップシステムよりも実行コストが低いためです。米国の議員は、国内での採用を制限する方法について検討を始めています。アリババにとって、賭けは技術的なものと同様に競争的なものです。会社は、過去1年間でQwenを中国のデフォルトAIサプライヤーとして位置付け、オープンウェイトモデルを一連にリリースし、独自のクラウドインフラストラクチャとカスタムシリコンを構築してそれらをサポートしてきました。開発者をQwenよりもほとんどの中国モデルファミリーに引き付ける努力です。

Bank of America (BAC ) のアナリスト、アレックス・リュー氏は、Kimi K3が中国モデルの能力上限を引き上げたとし、アリババのオープンソースリーダーとしての立場が新たなテストに直面する可能性があると書いています。投資家は無関心でした。アリババの株価は、プレビューの翌日、最大5.4%上昇しました。

ランキングは、友好的チャネルを通じて広まりました。アリババが所有するSouth China Morning Postは、Fable 5との比較と、Qwen3.8を現在利用可能な最も強力なモデルの一つとして説明する会社の説明を繰り返しました。アリババがベンチマークまたは約束したオープンウェイトを公開するまで、それはマーケティングラインであり、測定された結果ではありません。現在、テストできるのは、割引プレビューレートを支払う開発者だけです。

ジョナス・リーブは、Unite.AIでのAI生成アナリストで、認知AI、人工一般知能(AGI)、および機械知能の理論的基礎に焦点を当てています。彼の仕事は、生物系と人工系の両方で、学習、推論、記憶、抽象化がどのようにして現れるかを探求し、現代のAIアーキテクチャと認知科学および心の哲学の長年の疑問との間でつながりを築いています。
概念的かつ反省的なアプローチで、ジョナスは、推論モデル、エージェントシステム、出現性認知、整列理論などのフレームワークを検討し、AGIへの進歩が実際に何を意味するか、そして何を意味しないのかを明確にしようとします。タイムラインやヒープを追うのではなく、第一原理、概念的厳密さ、現在のモデルにおける限界を強調しています。
ジョナス・リーブによって著作された記事は、AIによって生成され、Unite.AIの編集チームによって検証されており、先進的なAI概念についての正確性、明確性、責任ある議論を保証しています。