Aiignitions
科技新闻

Claude Sonnet 5 来了:Anthropic 迄今为止最代理的中层模型

Anthropic 的 Claude Sonnet 5 作为迄今为止最具代理性的 Sonnet 推出——接近旗舰的性能、100 万代币的上下文窗口以及截至 2026 年 8 月的降价介绍费。

Claude Sonnet 5 来了:Anthropic 迄今为止最代理的中层模型

发生了什么

2026 年 7 月 1 日,Anthropic 开始推出 克劳德十四行诗 5,其中端模型的最新版本,面向 Claude.ai 全球每一位免费版和专业版用户。该模型也成为默认模型 克劳德·科德,Anthropic 的命令行编码代理,附带本机 1M 令牌上下文窗口。

Anthropic 将 Sonnet 5 描述为“有史以来最有活力的 Sonnet”。该模型不是简单地回答问题,而是旨在制定计划、使用浏览器和终端等工具,并通过多步骤工作流程自主运行——就在几个月前,此类工作还需要像 Opus 这样更大、更昂贵的模型。

有多好?

此版本的标题是中端型号现在与 Anthropic 的旗舰产品有多接近。在多项基准测试中,Sonnet 5 几乎缩小了与价格高得多的 Opus 4.8 的差距:

  • 代理编码(SWE-bench): 63.2%,落后于 Opus 4.8 的 69.2%,但远远领先于之前的 Sonnet 版本。
  • 终端/命令行工作: 80.4% — 比 Sonnet 4.6 的 59.7% 提高了 20.7 个百分点。
  • 桌面自动化(OSWorld): 81.2%,对于计算机使用任务来说是一个很好的结果。
  • 网络搜索/代理检索: 84.7%。
  • 专业知识工作: 中端 Sonnet 首次领先于 Opus 4.8。

模式很明确:最大的收益在于 代理自主权 ——规划、工具使用和长期任务——而不是原始的单轮答案。这正是 2026 年行业注意力转移的地方。

定价和供货情况

Sonnet 5 可立即在 Anthropic 的表面上使用:

  • 克劳德.ai: 全球所有免费和专业用户的默认模型(免费访问有使用限制)。
  • 克劳德代码: 新的默认值,带有 1M 令牌上下文窗口。
  • 应用程序编程接口: 开发者可以通过 Anthropic 的平台使用。

在价格方面,Anthropic 正在进行积极的促销活动。通过 2026 年 8 月 31 日,API 使用费用按 每百万输入代币 2 美元,每百万输出代币 10 美元。从9月1日起,标准价格上涨至 $3 / $15 每百万代币。即使按标准价格计算,这也大大削弱了旗舰级机型的价格——这就是为什么一些观察家称这是“人工智能代理价格战”的开局。

开发人员需要了解什么

Sonnet 5 并不是旧版 Claude 型号的直接替代品。 Anthropic 标记了在迁移生产工作负载之前需要注意的三个重大更改:

  • 扩展思维始终存在。 默认响应前模型原因;您不能再禁用它。
  • 温度和采样参数被删除。 调整这些设置的代码需要更新。
  • 一个新的标记器。 现在,相同的文本会产生大约 1.0–1.35 倍的标记,这会影响上下文预算和成本估算。

Sonnet 5 也是首款搭载 Sonnet 级别的型号 实时网络安全保障。涉及禁止或高风险网络安全主题的请求可能会被彻底拒绝——这是 Anthropic 加强其模型防止滥用的努力的一部分。

克劳德·科学

除了模型之外,Anthropic 还推出了 克劳德·科学,一个专门针对药物发现、蛋白质分析和计算生物学的研究应用程序。它作为一个工作台提供,为研究人员提供了数十种预配置工具。

该计划建立在 Anthropic 收购 Coefficient Bio 和该领域显着招聘推动的基础上,并伴随着针对被忽视疾病的内部药物发现计划。这表明 Anthropic 希望 Claude 不仅仅是一个聊天助手,它将该技术定位为科学研究中的积极合作者。

为什么它很重要

Sonnet 5 最引人注目的不是任何单一的基准,而是“中端”和“旗舰”之间的距离不断缩小。一年前需要支付额外费用的功能现在已成为免费用户的默认选项,并且 API 访问比以往任何时候都便宜。这一趋势比任何一种模式都更能重塑企业对人工智能的预算方式。

对于构建代理的开发人员来说,始终在线的推理、百万个令牌上下文和强大的工具使用分数使 Sonnet 5 成为编码、计算机使用和研究自动化方面引人注目的默认设置。随着竞争对手在 2026 年中期发布自己的前沿更新,人工智能竞赛的步伐没有显示出放缓的迹象。

阅读原始来源

前往原始来源查看完整公告和详细信息。

阅读原始来源