OpenAI本周发布了数百个声称已解决的数学难题,但其证明方法被指偏离了由位于普林斯顿的高等研究院(Institute for Advanced Study,IAS)召集的数学与人工智能咨询小组(AGMAI)设定的指导方针。AGMAI在9月底发布了解决数学问题的指导原则,并表示OpenAI的发布明确指出其正在使用开放研究问题评估其专有模型,这与AGMAI“停止在专有模型上测试高级数学问题”的首要要求相悖。此外,OpenAI在719份手稿中仅有10份包含了模型思维链的发布,且仅有42%的证明经过了形式化处理,未能完全遵循AGMAI关于人类理解和形式化的建议。有数学家指出,OpenAI的解决方案在自然语言和形式化表达之间存在差异,引发了对模型在无人为参与下形式化自身解决方案可靠性的质疑。