OpenAI 将其下一个模型系列命名为“Astra”,并通过解决十个数学问题来支持它
OpenAI 于 2026 年 8 月 1 日推出了 Astra 模型系列,其中有 10 项声称的数学证明以 Lean 形式正式化,并确认这是第一个接受美国政府预发布审查的模型。
OpenAI 宣布了什么
2026 年 8 月 1 日,OpenAI 为其暗示数月的模型起了一个名字: 阿斯特拉,被描述为它的下一个主要车型系列。此次披露并没有伴随通常的发布日基准幻灯片。相反,研究人员诺姆·布朗发布了十个声称的数学和理论计算机科学长期存在问题的解决方案,每个解决方案都附有手稿、机器可检查的证书以及模型如何实现的演练。
没有公开发布。你无法注册 Astra,OpenAI 也没有给出具体日期。它给出的是证据,而证据的选择就是故事。

十个问题,一件神器
Astra 的内部版本针对 10 个问题生成了新结果,根据 OpenAI 的说法,这些问题的主要结果至少在十年内没有取得任何进展,在某些情况下甚至更长时间。该列表涵盖高维几何、编码理论、算术电路复杂性、群论、算子代数、量子复杂性、晶格密码学和极值组合。声称的结果之一是涉及非 sof 群体的证明,非 sof 群体是纯数学的一个角落,开放问题往往保持开放状态。
对于任何权衡主张的人来说最重要的细节是:证明在 Lean 中形式化,这是一个证明助手,可以机械地检查每个逻辑步骤。精益证书不会告诉你一个问题是否值得解决,但它确实消除了人工智能数学主张的常见失败模式,这是一个中间步骤被破坏的自信论证。 OpenAI 也为逃跑定价。按 API 费率计算,生成所有 10 个解决方案的成本约为 2,000 美元,布朗用这个数字认为,结果会随着计算量的增加而不是减少而扩展。

阿斯特拉到底是什么
Astra 不像 GPT-4 那样是单一模型。报告将其描述为一个系统,可以协调多个代理处理同一问题数小时,或者在最困难的任务上数天。推介是一个模型,可以制定计划、运行自己的测试、注意到某个分支失败、进行修改并继续前进,而无需人在每一步都推动它。据 The Decoder 报道,Astra 加入了 OpenAI 现有的内部家族 Sol、Terra 和 Luna。
这种设计也是诚实的警告所在。众所周知,多代理设置在长期运行中会加剧自身的错误,并且协调本身会消耗计算资源。一个思考一天的系统可能会花一天的时间走上错误的道路。数学结果是 OpenAI 希望您牢记的反论点:证明,至少在形式上可验证的问题上,长期方法产生了一些可检查的东西。

因政府审查而受阻
你不能尝试《Astra》的原因并不是它尚未完成。这是第一个通过美国新的预发布审查程序的模型,该程序需要联邦政府在公开发布前批准。首席执行官萨姆·奥尔特曼(Sam Altman)已经向华盛顿的政策制定者演示了该系统。实际上,OpenAI 所描述的最强大的模型现在就位于政府大门后面,该公司正在利用自己的发布来展示该大门所持有的内容。
这是一个真正的转变。之前的每一款前沿型号都首先发货,然后才受到审查。 Astra 推翻了该命令,这使得时间表取决于监管机构而不是 OpenAI 自己的发布日历。

疑点在哪里
一些数学家对此印象深刻。曼彻斯特大学的托马斯·布鲁姆称这些建筑“很大”。其他人在等待,他们的谨慎是合理的。十个经过精益验证的结果是十个数据点,而不是跟踪记录,并且该公告来自将从该框架中获益的公司。这些问题是由 OpenAI 选择的,计算也是 OpenAI 的,独立研究人员还没有时间研究手稿或询问循环中的人类是否影响了获胜的尝试。
这些都不会导致证明错误。精益要么检查,要么不检查。但“该模型解决了十大著名问题”和“该模型可以进行原创性研究”是不同的说法,今天只有第一个有证据。
接下来会发生什么
OpenAI 表示,希望在 2026 年 9 月之前建立一个研究实习生级别的系统,并在 2028 年初之前建立一个完全自主的人工智能研究员。Astra 正是根据这些日期来定位自己的公司。近期的问题范围更窄:当政府审查通过时,谁可以以什么价格以及在什么限制下获得访问权限。在那之前,这十个证明是 OpenAI 之外的任何人都可以实际检查的 Astra 的唯一部分。
更值得关注的是预发布评论是否会成为模板。如果最有能力的模型现在只有在联邦检查后才能向公众开放,那么定义过去三年人工智能的发布节奏就会发生变化。 Astra 是对此的第一个测试,并且它正在公开运行,一次一个证明。
