FEATUREDDwarkesh Patel 播客· rssEN15:53 · 06·30
Grant Sanderson 谈 AI 与数学:IMO 金牌不是 AGI,但数学会最先撞上超级智能
Grant Sanderson 跟 Dwarkesh 聊了聊为什么 AI 拿了国际奥数金牌却没变成 AGI。几何题能被暴力穷举 19 秒搞定,但组合数学题还是会把模型绊倒,能力边界是锯齿状的。他指出,一个概念性突破的验证周期可能长达一个世纪,就算 AI 证出了黎曼猜想,人类也可能根本看不懂。把文献里已有的想法串联起来,这里藏着巨大的潜力还没挖,但现实世...
#Reasoning#Grant Sanderson#3Blue1Brown#Dwarkesh Patel
精选理由
精选 · 重要度 78 · 吸引力 + 知识量 + 共鸣
一句话点评
IMO 金牌没变成 AGI,因为几何题能暴力穷举 19 秒搞定,组合数学照样绊倒模型,能力边界是锯齿状的。Grant 提醒,就算 AI 证出黎曼猜想,人类也可能看不懂,验证周期可能长达一个世纪。
锐评
Grant Sanderson 跟 Dwarkesh 聊的核心判断很直白:别把数学竞赛当 AGI 进度条。2024 年 AI 在 IMO 上差一点拿金,原因是那年几何题多——几何能用暴力搜索 19 秒解掉,但组合数学题一多就露怯。这说明模型的能力不是平滑的,而是像锯齿一样,有些地方突得厉害,有些地方还陷着。
他点出了一个容易被忽略的“文献串联红利”:把数学文献里已有的想法系统地连起来,还有巨大潜力没挖。但现实世界的任务不像强化学习环境那样有清晰的奖励信号,AI 写不出好文章,因为它缺“心智理论”——不知道读者脑子里在想什么。这点先别太激动,正文没给出具体串联成果的案例,更多是方向判断。
另一个关键提醒是验证周期。一个概念性突破从提出到被人类消化,可能拖上百年。就算 AI 真把黎曼猜想证了,如果人类看不懂,那它在数学共同体里的“生效”时间会极长。这对“AI 一夜颠覆某领域”的叙事是个实在的降温。信息缺口在于:他没展开 AI 目前到底串联出了什么,以及人类看不懂的证明该怎么验收。
HKR 分解
hook ✓knowledge ✓resonance ✓