FEATUREDHacker News 首页· rssEN21:35 · 07·04
一个不会 Rust 的人,靠 AI 从零写了个 PHP 引擎,跑通了 17% 的官方测试,还渲染出了 WordPress
作者完全不会 Rust,让 Claude 写了一个叫 Phargo 的 PHP 解释器。他的工作就是看 AI 写的代码,然后说“看起来不错,继续”或者“这个退步了,再看看”。项目用 PHP 官方 22,000 个测试用例当裁判,目前通过了 3,844 个,占 17.4%。这个通过率没法注水,过就是过,不过就是不过。过程中踩了不少坑:测试工具因为没处理 ...
#Code#Phargo#Claude#WordPress
精选理由
精选 · 重要度 78 · 吸引力 + 知识量 + 共鸣
一句话点评
一个不会 Rust 的人让 AI 从零写 PHP 解释器,用官方 2.2 万测试当裁判,过了 17.4%,还跑起了 WordPress。这点先别太激动,正文没披露模型版本和总花费。
锐评
这条新闻最值得看的地方不是 AI 又写了什么,而是作者把评判权完全交给了第三方——PHP 官方那套写了三十年的 22,000 个测试用例。过就是过,不过就是不过,没法注水。目前通过率 17.4%(3,844 个),作者自己说天花板大概在 40-45%,因为剩下的大头是 C 扩展的测试,不在项目范围内。
过程里踩的坑比结果更有意思。测试工具因为没处理 Windows 换行符,静默判错了上百个测试好几周,修了一行代码就绿了一片。还有个生成器测试直接把开发机内存吃干抹净导致强制重启,后来只好给引擎上了 6 GiB 内存硬上限和步数限制。这些细节说明:让 AI 写代码不难,难的是搭一个不会骗你的裁判系统。
不过文章没提用的是哪个版本的 Claude,也没说总共烧了多少钱的 API 调用。如果成本很低,那这套“人只管说继续或退步”的工作流确实挺省心;如果烧了几千美金才跑到 17%,就得掂量一下性价比了。
HKR 分解
hook ✓knowledge ✓resonance ✓