FEATUREDHacker News 首页· rssEN19:12 · 05·25
Anthropic 联合创始人 Chris Olah 在梵蒂冈回应教皇 AI 通谕:实验室自己也受商业和地缘压力,需要外部声音来挑刺
Chris Olah 在教皇 Leo XIV 发布 AI 通谕《Magnifica humanitas》的现场做了发言。他先承认,包括 Anthropic 在内的前沿 AI 实验室都困在商业竞争、地缘政治和野心里,光靠内部自觉不够,必须有不受这些利益捆绑的外部批评者来推动安全。他把现在的 AI 模型比作“让虚构角色活过来”,说它们不是传统意义上被精确设...
#Safety#Interpretability#Anthropic#Chris Olah
精选理由
精选 · 重要度 73 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 联合创始人跑到梵蒂冈承认自家公司困在商业和地缘政治压力里,光靠内部自觉不够,需要外部批评者盯着。他把 AI 模型比作“让虚构角色活过来”,这个比喻挺直观,但没解释这种“活过来”具体怎么控制。
锐评
Chris Olah 在教皇 AI 通谕发布现场的发言,姿态放得很低。他直接点出包括 Anthropic 在内的前沿实验室都受制于商业竞争、地缘政治和野心,内部自觉靠不住,必须有不被这些利益捆绑的外部声音来推动安全。这个判断本身不新鲜,但从 AI 公司创始人口中说出来,而且是在梵蒂冈这种场合,至少说明他们意识到单靠行业自律已经说服不了公众了。
他把现在的 AI 模型描述成“让虚构角色活过来”,不是传统意义上被精确设计的工程系统,而是用人类语言“喂养”出来的、连训练者自己都觉得神秘的东西。这个说法有助于打破“AI 就是精密机器”的刻板印象,但正文没展开讲这种“神秘性”对安全具体意味着什么——是行为不可预测,还是内部机制不可解释,这两者差别很大。
他提了三个需要教会帮忙的问题:全球穷人怎么办、人类繁荣长什么样、AI 模型到底是什么。前两个是分配和价值观问题,实验室确实答不了;第三个是本体论问题,但他说得比较抽象。整篇发言更像是一次公开站队和求助,而不是给出任何具体方案。缺的是:Anthropic 自己打算在哪些具体机制上接受外部监督,以及这种监督怎么落地。
HKR 分解
hook ✓knowledge ✓resonance ✓