AI 模型与平台
阿里巴巴声称Qwen3.8仅次于Anthropic的Fable 5

阿里巴巴预览了其Qwen系列中最强大的模型,并称它在世界前沿系统中排名第二,仅次于Anthropic的Claude Fable 5。然而,这一声明没有提供任何可以验证的信息:没有基准测试成绩,没有模型卡,也没有独立评估。
该模型,即Qwen3.8-Max-Preview预览版,在2026年7月19日于上海举行的世界人工智能大会期间在Qwen团队的X账户上发布,描述为“仅次于Fable 5”,并与领先的前沿系统相当。它具有2.4万亿参数,是第一个处理图像、视频和文档(而不仅仅是文本)的Qwen模型,标志着Qwen从文本引擎向美国竞争对手已经提供的通用系统转变。
预览版目前通过阿里巴巴的Token Plan订阅和其Qoder和QoderWork开发者工具以10%的标准费率提供,开放权重已被承诺,但尚未公布发布日期或许可条款。
没有评分卡的排名
参数数量描述了模型的大小,而不是其技能。2.4万亿参数的数字本身并不能说明Qwen3.8如何推理、规划或在实际工作中表现——这正是基准测试和评估的目的,而阿里巴巴恰恰省略了这些信息。
公司没有发布模型卡、没有每个查询的激活参数数量、没有任务级结果,甚至没有与其自己的上一代旗舰模型进行比较。它仅将Qwen3.8-Max描述为“不断演化”。每一个缺失的信息对于买家来说都很重要:激活参数数量表明查询需要多少计算资源,模型卡记录了训练数据和安全测试,任务级成绩显示模型在哪里强、哪里弱。
这种沉默与阿里巴巴发布其上一代顶级模型的方式有所不同。Qwen3.7-Max于2026年5月发布,附带了一组完整的已发布数字,包括在独立的人工智能分析指数上获得的56.6分。供应商自己的基准测试表格是一种声明,而不是独立测量,但至少为外部评估者提供了可以核实的信息——这种审查反复颠覆了人们对这些系统实际能力的假设。Fable 5的比较没有提供任何可验证的信息。
现有的独立信息指向相反的方向。没有外部排行榜将Qwen3.8列为首位,最近被评分的Qwen模型Qwen3.7-Max在LMArena的榜单中排名靠后,Fable 5目前占据首位。阿里巴巴要求买家仅凭其声明接受从中游到世界第二的飞跃。
中国前沿竞赛
时机并非偶然。Moonshot AI在阿里巴巴预览三天前发布了其自己的2.8万亿参数模型Kimi K3,将中国开发者推入了多万亿参数级别,这一级别曾经属于美国最大的实验室。竞争部分是内部的——阿里巴巴是Moonshot的投资者之一,这使得其两个自己的赌注竞争中国最强开源模型的称号。两个发布都依赖于美国实验室现在正在争相匹配的开源权重策略。
两个发布之间的对比凸显了证据的重要性。Kimi K3附带了第三方审查:人工智能分析将其排在其智能指数的第三位,相当于Anthropic的Claude Opus 4.8。正是这种外部核实是Qwen3.8所缺乏的。
中国模型之所以能在西方开发者中获得关注,部分原因是它们的运行成本低于顶级美国系统,美国立法者已经开始考虑如何在国内限制其采用。对于阿里巴巴来说,赌注不仅是技术上的,也是竞争上的。该公司过去一年一直将Qwen定位为中国的默认AI供应商,发布了一系列开源模型,并建立了自己的云基础设施和定制芯片来支持它们——这吸引了比几乎任何其他中国模型家族都多的开发者使用Qwen。
由Alex Liu领导的Bank of America分析师表示,Kimi K3提高了中国模型的能力上限,阿里巴巴作为中国开源领军者的地位可能面临新的考验。投资者似乎并不担心:阿里巴巴的股价在预览发布后一天内最高涨了5.4%。
排名也通过友好渠道传播。阿里巴巴拥有的《南华早报》转发了Fable 5的比较和公司对Qwen3.8的描述,称其为“目前最强大的模型之一”。在阿里巴巴发布基准测试或承诺的开源权重之前,这一排名更像是一条营销宣传,而不是一个衡量结果——目前,只有支付折扣预览费率的开发者才能测试它。












