FEATUREDHacker News 首页· rssEN06:19 · 07·05
Simon Willison 用 Claude Fable 修了个丢数据的致命 bug,花了 149.25 美元把 sqlite-utils 4.0 推到稳定版
Simon Willison 在发布 sqlite-utils 4.0 稳定版前,让 Claude Fable 做了一次最终审查。模型发现了一个会丢数据的严重 bug:delete_where() 方法执行后从不提交事务,导致后续所有写入操作都会被静默回滚。整个修复过程用了 37 次提示、34 次提交,改了 30 个文件,总共花了 149.25 美元。...
#Code#Simon Willison#Anthropic Claude Fable#OpenAI GPT-5.5
精选理由
精选 · 重要度 78 · 吸引力 + 知识量 + 共鸣
一句话点评
Simon Willison 让 Claude Fable 做最终审查,模型揪出一个会静默丢数据的严重 bug,修复全程花了 149.25 美元。
锐评
这条新闻最值得看的是 AI 编程的实际成本与效果。Simon 在发布 sqlite-utils 4.0 前,让 Claude Fable 做了一次最终审查,结果模型发现了一个会静默丢数据的严重 bug:delete_where() 方法执行后从不提交事务,导致后续所有写入操作都会被悄悄回滚。这个 bug 如果没发现,用户数据丢了都不知道。整个修复过程用了 37 次提示、34 次提交,改了 30 个文件,总共花了 149.25 美元。这个价格对于一次全面的代码审查和 bug 修复来说相当便宜。
之后他又让 GPT-5.5 交叉审查了一遍,又发现两个问题。这种多模型交叉验证的做法很务实,也说明当前 AI 编程还不能完全信任单一模型的输出。新版本把事务处理的文档重写了,核心逻辑是:所有写入操作默认自动提交,只有用 db.atomic() 或手动 begin() 时才需要操心事务。这个设计思路是对的,把复杂的事务管理藏起来,减少用户犯错的可能。
不过正文没披露 GPT-5.5 审查花了多少钱,也没说那 37 次提示中有多少次是无效或需要重试的。如果只看最终成功的那条路径,成本数字可能偏乐观。另外,模型是在 iPhone 上通过 Claude Code for web 操作的,这种移动端编程体验本身也是个有趣的点,但文章没展开讲。
HKR 分解
hook ✓knowledge ✓resonance ✓