OpenAI 在 10 月 6 日公开一批由内部前沿模型产生的数学结果。与只给出结论的论文摘要不同,这次发布把结果、版本修订和引用协议放进 GitHub 仓库,并同步提供多项 Lean 形式化证明,便于社区用计算机检查其中一部分推导。
官方还公开了十份模型推理摘要、问题尝试数量,以及按 ChatGPT Pro 使用量换算的计算估计。平均每项结果使用的算力约相当于 ChatGPT Pro 思考三小时。OpenAI 表示,这些信息用于帮助读者判断结果是怎样得到的,而不是宣称摘要等同于完整思维过程或数学证明。
发布采用研究社区咨询后的做法,后续会继续补充引用、数学说明和版本修订。对研究人员,仓库材料比单一新闻标题更值得读:可以查看形式化程度、哪些结论仍待同行复核,以及模型产出和人工论文之间的差距。当前不应把内部结果直接当成已被普遍接受的数学定理。