Moonshot AI 的 Kimi K3 是有史以来最大的开放式重量模型 - 它正在缩小与美国实验室的差距
Moonshot AI 的 Kimi K3 是一款 2.8T 参数开放重量模型,首次亮相时在前端代码竞技场上排名第一,并在价格上低于美国实验室。规格、基准、定价及其重要性。
发生了什么
开 2026 年 7 月 16 日,中国初创公司 登月人工智能 揭幕 基米K3,它称其为迄今为止最强大的模型,并且完全处于前沿领域。与 总参数 2.8 万亿,它将成为 有史以来发布的最大的开放重量模型 一旦 Moonshot 发布了权重 7月27日。这次发布立即引起了人们的关注,因为 K3 不仅发布了可观的数字;它首次亮相于 前端代码竞技场排名第一,在美国封闭实验室占据主导地位的领域中超越了 Anthropic 的克劳德寓言 5。
此次发布的重要原因很简单:中国实验室的一个可免费下载的模型首次在公共排行榜上与 OpenAI 和 Anthropic 的最佳专有系统展开激烈竞争,而价格仅为其一小部分。这是迄今为止最明确的信号,表明开放式人工智能和封闭式人工智能之间的距离(长期以来被认为是多年领先优势)实际上以几个月为单位。
基米K3内部
Kimi K3 是作为 混合专家 (MoE) 模型,同样的架构允许模型携带大量参数,而无需支付每个代币的全部成本。标题规格:
- 总参数 2.8 万亿 — 是所有已发布模型中最大的,无论是开放式还是封闭式。
- 896 名专家,每个代币 16 名活跃专家 - 对于任何给定的令牌,只有一小部分网络会触发,从而使推理成本相对于原始参数计数而言是可控的。
- 100 万个令牌上下文窗口 — 足以在单个提示中保存整个代码库、长文档集或扩展代理会话。
- 多模态输入 — K3 可以跨文本和图像工作,而不仅仅是文本。
- 专为长期工作而打造 Moonshot 将模型定位于多步骤工作流程,包括规划、编码、测试和迭代自我修正,这种“代理”任务比单次答案更能奖励耐力。
这种组合——一个带有百万代币窗口和代理调整的巨大稀疏模型——直接针对美国实验室所宣传的企业工作负载:编码助手、自主代理和大容量自动化。
如何进行基准测试
令人瞩目的结果来自 前端代码竞技场,前端编码任务的公共排行榜。在其隐形检查站被揭开后, K3 首次亮相时以 1679 Elo 评级排名第一,通过克劳德寓言 5 — a 17位跳跃 与之前排名第 18 的 Kimi K2.6 相比。它获得了第一名 七中之六 已测试前端域。

在其他公开测试中,情况虽然不错,但并没有横扫一切。 K3得分 终端工作台 2.1 上为 88.3,基本上与 GPT-5.6 Sol 的 88.8 并驾齐驱,并放置在 总成绩第9名 在更广泛的文本领域排名中。 Moonshot 本身就坦白说 K3 整体性能仍落后于 Claude Fable 5 和 GPT-5.6 Sol,即使它的表现始终优于与之对比的其他模型。
换句话说,K3 并不是全面最好的专有系统的决定性跨越,但它足够接近,并且在编码方面足够主导,“开放模型落后一代”不再是一个笼统的说法。
定价和何时可以运行
K3与美国实验室最鲜明的对比在于成本。 Moonshot 的 API 定价为 每百万输入代币 3 美元,每百万输出代币 15 美元 - 质量远低于其竞争对手的顶级专有型号。对于运行大量编码或代理工作负载的团队来说,代币支出会快速增加,这种差距就是整个争论的焦点。
- 现已提供 API: 开发者可以立即通过Moonshot的平台调用K3。
- 2026 年 7 月 27 日重量: Moonshot 表示,它将发布该模型的开放权重,这意味着团队将能够下载、检查、微调和自行托管该模型。在此之前,该模型可以使用,但不能独立运行或审核。
这种区别值得强调。 “开放权重”与完全开源不同——Moonshot 发布的是经过训练的参数,不一定是训练数据或完整的配方。但对于大多数实际目的来说,可下载的权重可以让公司在自己的硬件上运行前沿级模型,将数据保存在内部,并完全避免每个代币的 API 费用。
开放与封闭的差距正在缩小
K3 的到来为分析师提供了一个罕见的硬数据,说明了他们一直在猜测的趋势。的 英国人工智能安全研究所在衡量其前沿网络范围的开放模型与封闭模型时,发现能力差距已经 缩小到四到七个月 — 到 2025 年的大部分时间,这一时间将从 6 个月减少到 10 个月。这是迄今为止最清晰的公开量化,表明开放版本赶上专有前沿的速度有多快。
这种压缩会产生直接后果。以年为单位的差距可以让封闭的实验室建立起持久的护城河并相应地定价。以几个月为单位的差距意味着企业可以等待几个发布周期并免费获得类似的功能 - 或者通过中国 API 以三分之一的价格获得。 K3 是迄今为止开放权重模型将前沿人工智能转变为更接近商品的最鲜明例子。
登月人工智能是谁?
Moonshot AI(月之暗面,“月亮的暗面”)是中国最受关注的人工智能初创公司之一,以其 基米 聊天机器人和模型系列。该公司在长上下文系统方面建立了良好的声誉,最近还推出了大型开放式模型,这些模型远高于开放版本的预期——在 K3 进一步提高上限之前,早期的 Kimi K2 系列已经跻身最强的免费模型之列。
通过 K3,Moonshot 正在推行一项深思熟虑的策略:在能力上与专有实验室匹敌,在价格和开放性上击败他们,并使用可下载的权重来赢得对供应商锁定持谨慎态度的开发人员和企业。 DeepSeek 等竞争对手也曾使用同样的开放优先策略来迫使美国实验室做出回应,同时也提醒人们,人工智能前沿现在已经真正成为全球性的,而不是一个国家的两三个公司之间的竞赛。
为什么它很重要
对于任何选择建造地点的人来说,Kimi K3 改变了计算方式。可下载的前沿级模型具有百万代币上下文窗口和顶级编码性能,价格为每百万代币 3 美元/15 美元,对于关心成本、数据控制或在自己的基础设施上运行模型的能力的团队来说是一个重要的选择。主要的警告是任何中国前沿模型都会带来的警告——许多西方企业仔细权衡的数据治理、合规性和地缘政治考虑因素——加上权重要到 7 月 27 日才会真正落地。
更大的故事是结构性的。 Kimi K3 表明,开放重量前沿现在落后于最好的封闭模型几个月,而不是几年,而且美国以外资源充足的实验室可以在发布之日占据公共排行榜的榜首。这并没有取代 OpenAI 或 Anthropic——两者在整体能力上仍然领先——但它削弱了“最强大的人工智能将被锁定在少数专有 API 后面”的假设。随着开放式与封闭式差距的不断缩小,杠杆转向买家,他们越来越多地根据自己的条件选择前沿能力。 Moonshot 的模型卡和访问详细信息可在其 官方网站。
