10月6日,OpenAI在GitHub开了一个叫openai/math的仓库,一次性放进去722份数学手稿,归成372个问题族。这些东西全部出自一个尚未发布的内部模型。
第二天,数量变成了719。更新日志写得很直白:一处符号错误推翻了一个论证,连带依赖它的两篇一起撤回。
仓库README自己标注,顶层结果里大约42%已经用Lean形式化验证,其余处于不同的验证阶段,“未形式化的结果可能存在问题”。换句话说,超过一半的结论目前靠的是模型写的自然语言证明,等人来查。
OpenAI给的另一个数字是成本:模型总共处理了大约4000个问题,平均每个结果消耗的算力相当于ChatGPT Pro思考三个小时。注意是平均值,不是某一个具体定理的用时。
其中最受关注的一篇,是宣称证明了四维挂谷集合具有满豪斯多夫维数,不附加紧致性或正则性假设。三维版本的挂谷猜想是王虹和Zahl在2025年2月解决的,王虹今年因此拿了菲尔兹奖。OpenAI这篇等于往上走了一维,同时在三维上还宣称做出了更强的版本。
数学界的反应没有像预期那样欢呼。
人类数学协会(AHM)发了一份声明,核心一句话是:一次性发布700多个文件,展示的不是学术,是力量。声明呼吁数学家终止与OpenAI的合作,理由之一是此前数学与人工智能顾问小组曾建议,不要用前沿模型去批量刷开放问题,OpenAI的回应是“不受这些建议约束”。
陶哲轩在自己的博客上以客座文章形式转发了这份声明。他另外说过一个更具体的担忧:开放问题被工业化“收割”之后,传统研究里伴随而来的交流、简化、提炼新理论的过程全没了,整个分支的土壤会变贫瘠。他管这叫“证明消化不良”。
MIT的Andrew Sutherland的态度更技术一点:在模型公开、结果能被复现之前,“单个智能体一次做出”这类说法只能算未经验证。
也不是所有人站在AHM一边。有评论认为OpenAI的发布方式确实该改,但“抵制”这个诉求本身站不住。
719份手稿已经在那里了。对数学家来说,接下来的工作不是讨论该不该,而是一篇一篇去读。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






OpenAI一夜放出722份数学手稿,陶哲轩转发抵制声明,三篇已因符号错误撤回