官方将结果放入 GitHub 仓库,提供修订和引用规范,并公开部分证明的 Lean 形式化材料,后续计划继续补充。

公开信息包含10份模型推理摘要、尝试问题数量及计算量估计;OpenAI 称平均每项结果耗用的计算量约相当于 ChatGPT Pro 思考3小时。

影响与意义

对数学研究与模型评估团队,形式化证明和尝试次数比单个成功案例更便于检查结果与投入规模。

可用性与限制

研究材料已公开;生成这些结果的内部模型仍在评估和筹备开放。

官方来源