AI 正在改写数学的”天花板”:OpenAI 用 1 万个 AI 智能体、耗时 88 小时,破解了七大”千禧年大奖难题”之一的纳维-斯托克斯方程,随后公开宣布拒领 100 万美元奖金。而就在业界还没消化这条重磅消息时,OpenAI 又被曝已在另一道千禧年难题上取得实质进展,包括陶哲轩在内的 25 位菲尔兹奖得主联名发表公开信,直指 AI 公司”正在摧毁数学本身”。

88 小时、1 万智能体:纳维-斯托克斯方程被”暴力破解”
据中国科学报报道,OpenAI 于 9 月 8 日宣布,研究人员利用 1000 个 AI 智能体耗时 50 小时完成简化版问题求解后,又动用 1 万个智能体投入完整攻坚,最终在 88 小时内证明了纳维-斯托克斯方程会在特定条件下出现”解失效”(有限时间爆破),并同步公开了 Lean 形式化验证代码。这是七大千禧年难题中,继庞加莱猜想之后第二道被宣称攻克的难题。
什么是千禧年难题?为什么奖金 100 万美元没人领
千禧年大奖难题由美国克莱数学研究所于 2000 年遴选,涵盖庞加莱猜想、P/NP 问题、霍奇猜想、黎曼猜想、杨-米尔斯存在性、纳维-斯托克斯方程、BSD 猜想七道世纪难题,每道答对者可获 100 万美元。此前的唯一解是庞加莱猜想,由佩雷尔曼证明后拒领奖金——如今 OpenAI 同样宣布不申请这笔奖金,只将解谜过程视作验证模型能力的”考题”。
第二道难题也快被攻破?霍奇猜想风波再起
拿下纳维-斯托克斯方程才两天,OpenAI 就向《纽约时报》承认已在另一道千禧年难题——霍奇猜想上取得实质性进展;9 月中旬业内又传出其”接近解决又一千禧年难题”的消息。一张流传甚广的”千禧难题基准测试”图表显示:Meta、DeepMind、xAI 等公开模型全员 0 分,人类顶级数学家基线 1 分,而 OpenAI 内部未发布系统已拿 2 分。大模型之间的竞争,正进入”谁先点亮下一道千禧难题”的无人区。
算力争议:是证明还是”抢跑”?
除了数学本身,这场突破还伴随激烈争议。纽约大学数学家 Tristan Buckmaster 与哈佛学者 Levent Alpöge 曾把大量未公开草稿输入 OpenAI 的 Codex 系统用于辅助研究,随后 OpenAI 抢先公布了同方向证明,被质疑”偷跑”研究思路;OpenAI 否认直接使用用户数据,但承认”不能排除去标识化数据帮助改进了模型”。另有学者爆料其二十年研究的 soficity 猜想被 OpenAI 用高度重合的冷门路径解决,引发”科学史上最严重学术丑闻之一”的批评。
25 位菲尔兹奖得主联名”开炮”
9 月 13 日,包括陶哲轩在内的 25 位菲尔兹奖得主发表公开信《人工智能在数学领域的严重错位》,抵制科技公司把数学难题当作公关素材与基准测试的商业逻辑。陶哲轩此前也对”靠新闻稿和社交媒体发布数学成果”表示厌倦,希望研究者回归 arXiv 预印本与学术会议。克莱数学研究所则表示,奖金发放需要经过同行评议出版物与严格学术评估,流程”需审慎从容”。
AI 数学竞赛进入”无人区”,数学家何去何从
不止 OpenAI 一家在冲刺:Anthropic 的 Claude 研究模型此前把黎曼猜想相关零点比例下界从 41.6% 提升到 67.2%,两家公司据称还在向 BSD 猜想发起竞速。当 AI 能以 GPU 算力”碾压”式解题,数学家的角色正在从推导者转向验证者、理解者与审美的把关人——正如陶哲轩所说,人类需要在”机器代替举重”的时代重新定义数学的价值。相关阅读:OpenAI 发布 GPT-6 Astra:数学接近满分、英伟达 129 亿美元收购 Hugging Face、通义千问 Qwen3.8 系列上线。
常见问题(FAQ)
OpenAI 表示只将解题过程视为验证模型能力的测试,不申请克莱数学研究所的奖金;此前庞加莱猜想的证明者佩雷尔曼也同样拒领了这笔奖金。
2000 年克莱数学研究所选定的七道世界级数学难题,包括 P/NP、霍奇猜想、黎曼猜想、纳维-斯托克斯方程等,每道奖金 100 万美元。
OpenAI 已公布 Lean 形式化验证代码,但克莱数学研究所要求成果必须发表于同行评议出版物并经过严格学术评估才会发放奖金,目前数学界仍在验证中。
(本文综合整理自中国科学报、新智元、纽约时报中文网等公开报道,仅供参考)
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...













