IT之家 10월 7일 소식에 따르면, OpenAI는 722개의 원고와 372개의 결과 계통을 포함한 문서 중에서 아직 출시되지 않은 첨단 모델이 해결한 여러 장기간 지속된 수학 난제들을 공개했습니다.

IT之家는 이 조치가 일련의 획기적인 성과를 이어나간다고 지적했습니다. 이러한 성과들은 수학계의 일부 사람들에게 깊은 인상을 주었지만 불안감도 야기했으며, 연구 윤리와 학문적 행동에 대한 의문도 제기되었습니다. 이러한 성과들을 책임 있게 전달하는 새로운 정규적인 수학자 독립 자문단인 AGMAI의 설명에 따르면, 이번에 공개된 내용에는 “수백 개”의 해결되지 않은 문제에 대한 답변이 포함되어 있습니다.
수 주 동안 외부에서는 이 결과에 대한 기대가 있었지만, 그 전까지 OpenAI는 모델이 구체적으로 어떤 문제를 해결했는지, 그리고 정확한 출시 시기도 밝히지 않았습니다. 이 회사는 9월에 자사 모델이 “수백 개의 오랫동안 해결되지 않은 공개적인 난제를 해결했으며, 수학의 대부분 분야를 포함한다”고 발표했습니다. 이번에 공개된 문서와 관련 자료에는 모델 추론 과정의 요약, 연산 능력 소비량 추정치, 그리고 해결을 시도한 문제의 수 통계 데이터도 포함되어 있습니다. OpenAI에 따르면, 일반적인 성과를 달성하는 데 필요한 연산력은 ChatGPT Pro가 3시간 동안 계속해서 생각하는 수준에 해당한다고 합니다.
수학과 인공지능 자문 그룹(Advisory Group on Mathematics and Artificial Intelligence, AGMAI)은 9월 하순에 첫 번째 권고안을 발표했습니다. 이 그룹은 인공지능 연구소가 성숙한 학술 채널을 통해 수학 연구 결과를 적시에 공개할 것을 요청했으며, 사용된 모델의 이름, 프롬프트, 연산 비용 등의 상세 정보도 공개해야 한다고 지적했습니다. 팀은 인공지능 기업들에게도 “수학적 성과를 발표하는 것을 자사 모델을 홍보하는 마케팅 수단으로 삼지 말라”고 간곡히 조언했습니다. 해당 기관은 이러한 방식이 전체 수학 커뮤니티에 심각한 손상을 줄 것이라고 생각합니다.
OpenAI는 이번 발표의 작업 프로세스를 다음과 같이 설명했습니다:
이번 발표에 대해, 우리는 결과물을 하나의 GitHub 코드 저장소에 게시할 예정이며, 문서 수정 및 인용과 관련된 처리 규정을 마련했습니다. 또한 학술 커뮤니티가 관리하는 다른 발표 방식을 찾아내어 이 자문위원회에서 제시한 다양한 지침을 준수하도록 할 것입니다. 향후 버전의 결과물 발표에서는 문서의 품질을 더욱 개선하고, 인용 상황, 수학 내용 설명, 결과물 전시 형식을 최적화하여 모든 사람이 이해하기 쉽게 만들겠습니다.
수학자들은 이 연구 성과에 대한 평가와 소화 흡수가 필요하므로, 이 연구가 가져오는 전체적인 영향이 드러나기까지는 아마도 시간이 걸릴 것입니다.
이전에 OpenAI와 Anthropic 등 경쟁 연구소들이 빠르게 증가하는 수의 수학적 성과를 발표했으며, 전체 수학계는 여전히 그 결과를 소화하는 단계에 있다. 그 중에는 밀레니엄 상의 어려운 문제와 관련된 결과도 포함되어 있는데, 이 문제는 수학 분야에서 가장 유명한 미해결 문제 중 하나이다.
올해 여러 인공지능 연구소들이 수학 분야에 빠르게 진입하고 있으며, 특히 그들이 공개하는 정보 방식으로 인해 격렬한 논쟁이 일고 있다. 이 논쟁의 주제는 과학 연구 패러다임, 윤리 규범, 그리고 기업이 인간 수학자들에게 어떻게 감사해야 하는지에 관한 것이다. 인공지능 시스템은 바로 인간 수학자들의 기존 연구를 바탕으로 만들어지며, 이러한 기존 연구를 통해 새로운 결과를 도출할 가능성도 있다.
