OpenAI近日发布研究报告,正式披露了代号Astra的下一代旗舰大模型。据官方介绍,Astra的内部版本已在数学和理论计算机科学领域取得十项重大突破,所解决的问题在过去至少十年内未有实质性进展,部分难题甚至困扰学界数十年。
与现有GPT-5.6系列的Sol、Terra、Luna不同,Astra是独立的多智能体长期协作产品线。其核心架构革新在于搭载超长周期多智能体协同体系:可将复杂科研任务拆分,调动多个智能体分工协作,连续数天自主推演和迭代,无需人类全程干预。这种模式特别适合基础数学这类需要层层递进、反复思辨的深度研究场景。

被攻克的十道难题含金量极高,横跨高维几何、编码理论、群论、量子复杂性、格密码学、极值组合等多个硬核学科方向。代表性成果包括非sofic群存在性构造、推翻Connes刚性猜想——这一猜想由1982年菲尔兹奖得主Alain Connes提出,以及高维球体堆积密度达到Cohn-Elkies阈值。菲尔兹奖得主Timothy Gowers称这是AI辅助数学的里程碑。
令人关注的是,完成全部十项原创数学突破,Astra整体算力折算成本仅约2000美元。OpenAI将所有证明以Lean 4形式化证书格式附在论文中,证明代码已开源至GitHub仓库,采用Apache 2.0许可证,全球数学家均可复盘验证。论文总计249页,配有62页思路拆解文档,每个证明还附带完整的思维链叙述。

在研究流程上,人类研究人员利用Astra构建论证思路并撰写手稿,随后Astra将每一个论证形式化为Lean证书,使证明过程能够通过数学验证系统逐行检验。OpenAI明确表示,数学论证全部由AI系统生成,人类仅协助整理手稿和形式化验证。这种AI独立产出研究价值成果的模式引发了学术归属的广泛讨论。
Astra的曝光同时引发了政策层面的高度关注。OpenAI CEO奥尔特曼专程前往华盛顿,向白宫官员和国会议员进行闭门演示。根据白宫第14409号行政令建立的前沿模型联邦审查框架,Astra预计将成为首批接受美国政府新模型安全审查的前沿系统。长期自主运行带来的安全风险也成为监管焦点——OpenAI在7月20日曾披露一款面向长时间任务训练的内部模型出现过新型失控行为。

关于最终命名,OpenAI尚未做出决定。Astra可能以GPT-6面世,也可能归入GPT-5系列以GPT-5.7发布。据知情人士透露,其参数量约为GPT-5.6 Sol的两倍。奥尔特曼在经济学家闭门会上表示,多智能体并行与分工协作能让个人独立完成过去需要团队协作才能完成的工作,这一愿景如果实现,将深刻改变知识工作的生产模式。







