阿里巴巴Qwen3.8-Max来袭,参数2.4万亿,开放权重
阿里巴巴的 Qwen3.8-Max 包含 2.4 万亿个参数、100 万代币上下文窗口和开放权重。以下是 2026 年 8 月发布的实际内容。
阿里巴巴宣布了什么
2026年8月3日,阿里巴巴Qwen团队发布了Qwen3.8-Max,这是其有史以来发货的最大型号。总体数字为 2.4 万亿个参数,这将使其成为迄今为止最大的公开描述的语言模型之一。阿里巴巴称其为Qwen家族的新旗舰,并已在其阿里云模型工作室平台上通过API开放访问,该模型还连接到该公司的工作场所人工智能产品QwenWork。
此次发布的重要性超出了原始规模。阿里巴巴表示,将公布该模型的权重供公众下载,这是该公司首次针对 Max 级 Qwen 模型这样做。正是这个决定将例行的旗舰更新变成了本周的人工智能故事。

模型内部
Qwen3.8-Max 建立在 Qwen 3.5 基础上,并使用稀疏专家混合设计和混合注意力机制。 2.4万亿数字是参数总数;对于任何给定的代币,只有大约 950 亿个被激活。这就是每个大型 MoE 模型背后的技巧:您可以获得大型网络的知识容量,同时支付接近中型网络的推理成本。
上下文窗口运行至 100 万个令牌。阿里巴巴表示,实际上,这可以扩展到内存中一次保存的 100 多页文档、完整的电视剧或 100 小时的直播。该模型本质上是多模式的,可以处理文本、图像和视频,并且演示非常依赖于此:从屏幕截图进行 Web 重建、平面图到 3D 的转换、动画生成和短游戏构建。

这些功能本身都不是独一无二的。自 2026 年初以来,前沿上下文窗口和多模式输入一直是赌注。新鲜的是看到它们以这种规模聚集在一起,来自一个打算放弃权重的实验室。
得分如何
在阿里巴巴自己的基准表上,Qwen3.8-Max 在文本竞技场排名第五,在视觉竞技场排名第二,在前端代码竞技场排名第四。这些都是值得尊敬的排名,而不是一网打尽,而且视觉效果非常出色。已公布的评估分数包括 PaperBench 上的 93.0 分、OmniDocBench 1.5 上的 92.1 分、带字幕的 VideoMME 上的 90.4 分、OSWorld-Verified 上的 86.1 分和 MMMU-Pro 上的 82.3 分。健康和金融推理较弱,HealthBench 为 60.2,PRBench-Finance 为 58.3。
更有趣的主张是自主主张。阿里巴巴表示,该模型自行运行了一个软件工程项目超过 16 天,产生了 265 次提交和 127 次拉取请求,并构建了一个在 GitHub 上开源的命令行框架。据报道,在一项单独的研究任务中,它连续工作了 125 个小时,编写了 7,600 多行代码。它还在多模式对话竞赛中排名大约第 87%,击败了 526 个人类团队中的 458 个。
在独立评估落地之前,将所有这些视为供应商数据。自我报告的基准测试会奖励实验室选择展示的测试,而 16 天的自主运行比排行榜分数更难重现。开放权重一旦发布,将让外部研究人员检查工作,这正是该发布值得关注的部分。
开放重量承诺
Qwen 团队写道:“这也标志着我们首次开源 Qwen-Max 级模型的权重。”阿里巴巴表示,Hugging Face 和 ModelScope 的权重将在发布当周增加。截至 2026 年 8 月 5 日发布,它们尚未出现,因此公告中最重要的细节仍然是等待文件上传,而不是可下载模型。

如果发布的内容如描述的那样,它将改变竞争的数学。可下载的 2.4 万亿参数模型不是业余爱好者在笔记本电脑上运行的东西,而是资金雄厚的初创公司、研究实验室或竞争对手的云可以在无需征求阿里巴巴许可的情况下托管和微调的东西。这是 Qwen 全年用来赢得开发者对封闭的美国模型的关注度的杠杆,而将其应用于顶级模型是一种故意升级。
为何市场如此关注
投资者将此次发布视为阿里巴巴在人工智能竞赛中地位的声明,而不仅仅是产品说明。据市场报道,其在香港上市的股票 8 月 3 日收盘上涨约 6% 至 7%,其在美国上市的存托凭证在盘前交易中上涨。阿里巴巴将该模型描述为可与最强大的西方系统竞争,并有评论将其与 Anthropic 的前沿模型进行对抗。

国内的竞争同样激烈。 Qwen3.8-Max 比 Moonshot AI 的 Kimi K3 稍小,据报告参数为 2.8 万亿,激活数为 1040 亿,阿里巴巴声称它在多项测试中超过了 Kimi K3。中国实验室现在按月交付前沿规模的模型,主要在成本和开放性上展开竞争,这一策略对美国制造的封闭模型的定价和许可条款持续施加压力。
接下来看什么
三件事将决定 Qwen3.8-Max 能否如期推出。首先是权重:它们是否发货、依据什么许可证,以及一旦任何人都可以探索完整模型而不是阅读阿里巴巴的基准表,完整模型的表现如何。其次,独立评估,特别是对易于陈述但难以验证的自主编码声明。第三,价格。阿里巴巴的优势来自于降低西方 API 费率,运行 2.4 万亿参数模型的每个代币成本将告诉你它愿意采取多么积极的行动。
目前,Qwen3.8-Max 是迄今为止最明显的迹象,表明最有能力的开放式重量模型可能来自杭州而不是旧金山。这是否成立取决于文件上传,截至撰写本文时,文件上传尚未发生。
