FEATUREDHacker News 首页· rssEN10:32 · 07·26
陶哲轩 ICM 2026 演讲:假设 AI 能做研究级数学,数学界该重新审视什么
陶哲轩在 2026 年国际数学家大会的公开演讲里,没有去争 AI 到底能不能做研究级数学。他直接假设一个“强能力版本”成立——AI 工具在不久后能以合理的成本、成功率、质量和人工监督,完成相当一部分研究级数学任务——然后反过来问数学界:我们的目标和价值观到底是什么。他把当下比作 20 世纪初的数学基础危机,认为这次是对“数学实践与价值观的基础”的一次冲...
#Benchmarking#Terence Tao#First Proof#International Congress of Mathematicians
精选理由
精选 · 重要度 82 · 吸引力 + 知识量 + 共鸣
一句话点评
陶哲轩没去争 AI 能不能做数学,而是假设它能,然后问数学界:我们的价值观是什么。他把这比作百年前的基础危机,角度很刁。
锐评
陶哲轩在 2026 年国际数学家大会的演讲,跳过了“AI 到底行不行”的辩论,直接假设一个强能力版本成立,反过来逼数学界审视自己的目标和价值观。他把当下比作 20 世纪初的数学基础危机,认为这次是对“数学实践与价值观的基础”的一次冲击。演讲里引用了 First Proof 基准测试 5 月 28 日的结果:10 道全新研究级问题里,至少有一个 AI 工具组合解出了 7 道,且达到发表质量,每道题的计算成本在 10 到 1000 美元之间。这个数字说明,在某些限定条件下,AI 做研究级数学的成本已经低到可以批量尝试了。
不过,陶哲轩自己也在演讲里打了预防针:这些数据不是在严格受控的科学条件下收集的,公开证据存在严重的报告偏差和非科学动机,一些关键成本和变量也没披露。所以 First Proof 的结果更像一个存在性证明,而不是全面评测。演讲全文是 PDF 幻灯片,正文没展开讲具体是哪些问题被解决、失败的三道卡在哪、人工监督介入多深。这些缺口让“强能力猜想”到底多强,还很难下判断。
HKR 分解
hook ✓knowledge ✓resonance ✓