OpenAIは今週、解決済みと主張する数百の数学問題を公開しましたが、その証明方法は、プリンストン高等研究所が招集した数学・AI諮問委員会(AGMAI)が設定したガイドラインから逸脱していると指摘されています。AGMAIは9月末に数学問題解決に関するガイドラインを発表し、OpenAIの公開は、同社が独自のモデルを評価するために未解決の研究問題を使用していることを明確に示しており、これはAGMAIの「独自のモデルで高度な数学問題をテストするのをやめる」という最優先の要求に反すると述べました。さらに、OpenAIは719の原稿のうち、モデルの思考連鎖を含む公開はわずか10件であり、証明の形式化は42%に過ぎず、人間の理解と形式化に関するAGMAIの提言を完全に遵守していません。一部の数学者は、OpenAIの解決策には自然言語と形式表現の間に差異があると指摘しており、人間の介入なしにモデルが自身の解決策を形式化する信頼性について疑問を呈しています。