阿里巴巴集团今日在上海世界人工智能大会上,发布了其Qwen系列迄今最强大的大语言模型Qwen3.8,并以预览版形式命名为Qwen3.8-Max-Preview正式亮相。阿里巴巴声称,该模型在全球前沿模型中的综合能力仅次于Anthropic的Claude Fable 5。

Qwen3.8-Max-Preview拥有2.4万亿参数规模,是Qwen系列中首个参数量突破1万亿且同时支持图像、视频、文档与文本多模态处理的模型。阿里巴巴Qwen团队在X平台发帖表示,该模型"仅次于Fable 5",但并未提供任何基准测试数据,也尚未经过第三方机构的独立验证。

这一信息缺失颇为引人关注。阿里巴巴此前的旗舰模型Qwen3.7-Max于今年5月发布时,附带了完整的评测结果,包括在Artificial Analysis智能指数上的56.6分。而本次Qwen3.8预览版的发布则未附带任何模型说明文档、激活参数数量统计,也没有任何基准测试数据。

阿里巴巴未公布Qwen3.8与Qwen3.7-Max的任务级对比数据,仅将新模型描述为"持续演进中"。官方承诺"即将"开放模型权重,但具体日期与许可条款均未披露。

目前,该预览版已可通过阿里巴巴的Token Plan订阅服务及面向开发者的Qoder、QoderWork平台访问,试用期间定价为标准费率的10%。

此次发布的时间节点颇具竞争意味,与国内竞争对手直接形成对峙。中国AI创业公司北京月之暗面科技有限公司(Moonshot AI)在三天前刚刚发布了参数规模达2.8万亿的Kimi K3模型。两款模型的相继推出,标志着中国开发者正式进入万亿参数量级竞争阵列,而这一规模此前主要与美国顶尖AI实验室相关联。

近年来,阿里巴巴持续将Qwen系列作为其"中国默认AI供应商"战略定位的核心支撑。过去一年间,该公司接连发布多个开放权重模型,并持续扩建云计算基础设施与自研芯片。开放权重策略帮助Qwen积累了中国模型家族中规模最大的开发者社区之一,阿里巴巴正寄望于将这一生态优势延伸至万亿参数量级竞争。

对于正在评估此次发布的企业客户而言,目前"仅次于Fable 5"的说法仍仅来自阿里巴巴自身。目前尚无独立排行榜对Qwen3.8进行评分,而此前获得评级的Qwen3.7-Max在LMArena榜单上的排名并不靠前,Claude Fable 5则高居该榜第一。基准测试数据和承诺开放的模型权重才能给出真正的答案,但阿里巴巴目前两者均未兑现。

Q&A

Q1:Qwen3.8-Max-Preview有哪些核心能力?

A:Qwen3.8-Max-Preview是阿里巴巴Qwen系列目前最强的模型,拥有2.4万亿参数,是该系列首个参数量超过1万亿、同时支持图像、视频、文档与文本多模态处理的模型。目前以预览版形式在阿里巴巴的Token Plan订阅服务及Qoder、QoderWork开发者平台上提供访问,试用期间定价为标准费率的10%。

Q2:阿里巴巴说Qwen3.8仅次于Claude Fable 5,这个说法可信吗?

A:目前这一说法可信度存疑。阿里巴巴发布Qwen3.8时未附带任何基准测试数据,也没有模型说明文档,第三方机构尚未对其进行独立评分。此前获得评级的Qwen3.7-Max在LMArena榜单上排名并不靠前,而Claude Fable 5则高居该榜第一位。Qwen3.8的真实能力需等待独立基准测试和开放权重发布后才能得到验证。

Q3:Qwen3.8和Kimi K3有什么区别?

A:两者都是近期发布的万亿参数级中国大语言模型。Qwen3.8-Max-Preview拥有2.4万亿参数,由阿里巴巴发布;Kimi K3拥有2.8万亿参数,由北京月之暗面科技发布,比Qwen3.8早三天上线。目前两款模型均缺乏完整的独立评测数据,无法做出全面客观的性能比较。

SiliconANGLE