OpenAI称新模型解出100多道数学难题
9月22日,OpenAI宣布其内部新模型解决了100多道长期未解的数学难题,并成立了一个独立的数学与人工智能顾问小组(AGMAI),负责审核研究成果的评估与发布流程。
100道题意味着什么
需要冷静看待的是,OpenAI并未公布这100多道题目的具体清单,也没有公开解答过程。已披露的细节包括:欧拉正则性问题动用了约100个智能体、耗时约50小时;纳维-斯托克斯方程的攻关则动用了10000个智能体,交换了270万条消息,消耗约1300亿输出token。
这种“智能体集群协作解题”的模式本身,比解题结果更值得关注。它展示了一种新的科研范式:AI不再是单个模型的单打独斗,而是成百上千个智能体分工协作、互相验证的“虚拟研究所”。
验证是唯一的试金石
数学界的反应谨慎而克制:未经同行评议的宣称,无论来自人类还是AI,都只是宣称。OpenAI成立独立顾问小组的举动,恰恰说明公司自己也意识到了公信力问题。AGMAI声称独立运作、不接受公司资助,并将公开发布评估建议。
值得玩味的是,就在同一周,Anthropic的生物实验室也宣称取得了类似CRISPR的发现,同样等待同行验证。AI for Science的竞赛,正在从“算力军备”进入“公信力军备”阶段。
影响与展望
如果100道难题的宣称最终被证实,这将是AI推理能力的里程碑——数学是检验真正推理能力的试金石,因为它无法靠记忆和模式匹配蒙混过关。但在那之前,保持怀疑是最好的态度:科学史上,被证伪的“突破”远比被证实的更多。