我们正在发布由一个 内部前沿模型.
在我们努力改进与数学界分享成果的方式时,我们一直与独立的 高等研究院数学与人工智能咨询小组(在新窗口中打开) 进行磋商,以制定最佳实践,并且我们采纳了他们的建议和 公开建议(在新窗口中打开) 来指导这些成果的发布方式。
在本次发布中,我们在一个 GitHub 仓库中发布这些成果,并附带了论文修订和引用的协议。我们仍在继续探索符合委员会准则的其他社区托管替代方案。对于未来的发布,我们承诺通过引用、数学阐述以及更好的成果呈现方式来进一步提高论文质量,以便于理解。
作为我们 GitHub 仓库的一部分,我们正在分享许多证明在 Lean 中的形式化,Lean 是一种可以让计算机检验数学证明的编程语言。我们将在获得更多形式化结果后更新该仓库。
为了促进科学透明度和开放性,我们还在仓库中发布了关于我们如何获得这些成果的更多细节。其中包括模型推理的 10 份摘要、以 ChatGPT Pro 用量计算的算力消耗估算,以及尝试解题数量的统计数据。平均每个成果使用的算力大约相当于三个小时的 ChatGPT Pro 思考时间。
我们希望这一进展能够推动人类知识的前沿,并促进数学领域的进一步发展。我们将资助一系列围绕理解 AI 产出的重大成果的研讨会、会议和专项计划——我们将在不久的将来分享更多相关信息。
我们希望以最先进的能力直接赋能科学家,并正在努力负责任地发布产生这些成果的模型。这就是为什么继续在数学和其他科学领域评估我们的内部前沿模型非常重要,这样我们才能加速开发推进这些领域的工具。我们将继续根据社区的反馈采取行动,并更新我们未来重大科学进展披露的标准。
