The Verge AI更新于

OpenAI 又发布了一批数学领域的突破性成果

OpenAI公布由未发布前沿模型产出的数学成果,称以722篇手稿覆盖372个结果族,AGMAI称其中包含“hundreds”个开放问题的解答。OpenAI表示“average result”约相当于三小时ChatGPT Pro思考算力,并称在GitHub发布并探索符合委员会指南的社区托管方式。AGMAI则呼吁勿把数学成果发布当作推广模型的营销手段,实际影响仍待数学界消化评估。

配图来源 · The Verge AI

OpenAI 已 揭示解决方案 一些由未发布的前沿模型产生的长期数学问题 一组包含 722 份手稿,涵盖 372 个结果家族 那些相关论文群。它延续了一系列突破性成果,这些成果既给数学界的部分人留下了深刻印象,也引发了困惑;同时,也引发了关于研究伦理和学术行为的问题。根据AGMAI的说法, 新成立的独立精英数学家咨询小组 共同努力以负责任的方式传播结果,该发布内容包含了针对“数百个”未解问题的解决方案。

这些结果已经预期了好几周,不过直到现在,OpenAI 仍未提供关于模型解决了哪些问题以及这些成果何时发布的具体信息。9月时,该公司宣布其模型“解决了数学领域大多数领域中的100多个长期未解决的问题”。发布的论文和其他细节还包括对模型推理过程的概述、使用的计算时间的估计,以及尝试解决的问题数量的统计信息。OpenAI 声称“平均结果”相当于使用 ChatGPT Pro 思考了三个小时的时间。

AGMAI,即数学与人工智能咨询小组,于9月下旬在发布了首批建议。该小组敦促人工智能实验室尽快通过成熟的学术渠道公布数学结果,并公开相关细节,如所用模型的名称、提示信息以及计算成本。同时,该小组也呼吁人工智能公司“不要将公布数学结果视为推广其模型的营销手段”,认为这种做法对数学界造成显著伤害。

这是 OpenAI 对此次发布的过程描述:

对于此次发布,我们将在 GitHub 仓库中公布结果,并提供论文修改和引用相关的规范。我们将继续探索符合委员会指南的、由社区主导的其他替代方案。对于未来的发布,我们承诺通过引用、数学表述以及结果呈现的优化来进一步提升论文的质量,以方便读者更好地理解。

这些结果所产生的影响完全显现可能需要一些时间,因为数学家们正在评估并理解它们。它们进一步增加了…… 快速增长的数学成果体系 来自 OpenAI 和 Anthropic 等竞争对手实验室的研究仍在进行中,其中也包括与“千年大奖”问题相关的结果,这是该领域最著名的开放问题之一。今年,AI 实验室进入这一领域的速度非常快。 尤其是他们对公告的处理方式 — 有 引发了激烈的争论 over 研究方法,伦理和 公司如何承认债务 那些人类数学家,他们的研究成果正是这些系统所基于的基础,并且这些系统也可能被用来产生结果。

关注这个故事中的主题和作者,即可在您的个性化主页动态中看到更多类似内容,并接收电子邮件更新。
原始出处

The Verge AI

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准