以前:AI 连数学题都做不对。
现在:AI 开始批量交论文,人类还在审。🫠

10 月 6 日,OpenAI 公布了 700 多篇数学研究稿件、372 组成果。官方估算,平均每项成果的计算投入,相当于内部模型在 ChatGPT Pro 中思考约 3 小时。

注意:这是计算量口径,不是“三小时完成全部科研流程”。这些稿件也不等于 700 多个难题全部被攻克,部分结果仍待验证。

我的感受是,这场景程序员太熟了:
AI 的产出越来越快,人类得证明它到底对不对。

以前担心 AI 不会做。
现在担心:它做完了,我验不明白。😂

你觉得以后最贵的能力,是「给出答案」,还是「判断答案靠不靠谱」?
展开
10