OpenAI本周发布了数百份声称解决世界级数学难题的解答,但这些成果未能满足数学咨询团体AGMAI制定的相关标准。AGMAI在9月底发布的指导原则首项建议为"停止在专有模型上测试高级数学问题",然而OpenAI明确表示正在使用专有模型进行评估。剑桥大学和伦敦国王学院的研究论文指出,OpenAI模型在将自然语言证明翻译…