跳到正文
原文
TechCrunch · AI· Tim Fernholz·· 2 小时前AI 评分62

OpenAI 的数学解答尚未达到学界标准

OpenAI’s math solutions aren’t meeting the field’s standards yet

AI 导读

TechCrunch 报道称,OpenAI 本周发布数百份高难数学题解答,但未完全达到普林斯顿高等研究院 AGMAI 提出的准则。AGMAI 的首要建议是停止在闭源模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其闭源模型;719 份手稿中仅 10 份公布了模型的思维链,42% 的证明未经过形式化。

来源:TechCrunch · AI · techcrunch.com