OpenAI 数百份数学证明未达数学界标准,AGMAI 指南执行不足
TechCrunch 报道,OpenAI 本周发布数百道高难度数学问题的 AI 解法,但未达到 AGMAI(数学与人工智能咨询小组)制定的标准。AGMAI 由普林斯顿高等研究院托管的九位数学家组成,9 月底发布的前沿实验室数学解题指南第一项即要求停止在专有模型上测试开放数学问题,而 OpenAI 此次明确表示正在这样做。
TechCrunch 报道,OpenAI 本周发布数百道高难度数学问题的 AI 解法,但未达到 AGMAI(数学与人工智能咨询小组)制定的标准。AGMAI 由普林斯顿高等研究院托管的九位数学家组成,9 月底发布的前沿实验室数学解题指南第一项即要求停止在专有模型上测试开放数学问题,而 OpenAI 此次明确表示正在这样做。
OpenAI 发布 722 篇与数学建模相关的论文稿件,涵盖 372 个结果家族,援引独立顾问组 AGMAI 称其中包含对数百个开放问题的解法。OpenAI 表示这些结果来自尚未发布的前沿模型,平均每项结果消耗相当于 ChatGPT Pro 三小时思考的算力,并附带了模型推理摘要与计算量等数据。