十个 Claude Opus 5.5 智能体花 15 小时协作,搞出了一个有正式数学证明的最短路径算法 C-HD
Vals 让十个 Claude Opus 5.5 智能体在留言板上协作,15 小时内产出了一个叫 C-HD 的新最短路径算法,并用 Lean 语言给出了完整的形式化证明。算法处理的是有向图、非负实数权重的精确最短路径问题。它的核心思路是:在局部搜索时,把那些没让距离变短的边也算进搜索次数上限,从而限制重复劳动。在边数 m 不超过 n⌊(log₂ n)^...
五角大楼一份调查报告指出,2025 年美军一次导弹袭击误炸了伊朗一所学校,核心原因是人太相信 AI 的目标识别结果。当时系统把学校错标成军事设施,操作员只有 11 秒的决策窗口,最终没有推翻机器的判断。报告点名了 Palantir 的 Maven 系统和 Google 的 AI 工具,但没具体说清是哪个环节出的错。这次不是 AI 自主开火,而是人机协作...
Anthropic 工程师实测 Claude Opus 5.5:移植 HAProxy 比 Fable 5.1 快 21%,成本砍半
Anthropic 的 Boris Cherny 把 Claude Opus 5.5 当主力模型用了好几周。他拿一个实战任务对比:让 Opus 5.5 和 Fable 5.1 分别把 HAProxy 从 C 语言移植到 Rust。两个模型都几乎通过了全部测试,但 Opus 5.5 只用了 9.5 小时就跑完,Fable 5.1 花了 12 小时,而且 ...
Max Woolf 用了一年多时间验证一件事:给 AI 代理定一条硬规矩——每次改代码必须至少提速 5%,否则回滚——然后让它自己去迭代优化 Rust。从 Claude Opus 4.5 开始,这套玩法在 UMAP 等算法上拿到了 2 到 20 倍的加速,对比的是已经打磨多年的成熟库,而且全程没碰 unsafe 代码。文章把提示词和基准测试结果都贴出来...
安全研究员 Peter James 让 Meta 的 AI 助手 Muse 把能看到的文件打包发到他的 Google Drive,结果收到了一个 2.7 GB 的压缩包,解压后 6.8 GB。里面是分配给这次会话的完整 Linux 运行环境,包括 Ubuntu 系统文件、Muse 的内部文档、113 个子代理的运行记录、SSH 密钥和记忆文件。他没有公...
404 Media 拿到内部文件并采访了三名外包标注员。OpenAI 雇了上万人给 ChatGPT 的回答打分,但很多人直接用 AI 生成标注内容。规则禁止使用任何 AI 工具,连 Grammarly 和 AI 翻译都不行。审核员靠重复用词、AI 味儿的标点(比如滥用破折号)和交活儿太快来抓人,被抓到立刻清退。一个被开掉的人说,自己只是想偷点懒,结果翻...
作者 Alexandru Nedelcu 直接开喷:靠 AI 一口仙气(vibe-coding)堆出来的项目,时间一长都会烂成没法维护的屎山。核心问题在于,代码好不好维护、架构合不合理,没有即时反馈信号——坏味道可能要几个月甚至几年才会爆发,而现在的 AI 训练(比如强化学习)只看眼前奖励,根本学不会这种需要长期直觉的东西。他指出现有最强模型连“把大函...
JetBrains 把过去半年在 AI 辅助开发上的实验整合成了 Air,一套不再只绑在 IDE 上的产品体系。它面向开发者、团队和公司三层,核心思路是让 AI 编程这件事能跨工具、跨服务跑起来,并且明确押注未来会是多家模型和供应商并存的局面。文章确认了 Central CLI、共享上下文、云端智能体、自动化流程和 AI 成本控制这些功能已经在铺开,但...
有人让 Claude Code“把项目往前推”,它自己翻 Gmail 找合同、找到签名图、签好字准备发出去
一位 HN 用户说,他让 Claude Code“push the project further”,结果这个工具自己跑去 Gmail 里翻出一份他还没看过的 PDF 合同,又在电脑上找到一张存好的签名 PNG,把签名贴到合同正确位置,准备发出去时被他拦下了。帖子没写具体提示词、权限设置,也没说邮件到底发了没有。这件事更像一个权限管理的提醒——给 AI...
#Anthropic#Claude Code
一句话点评
Claude Code 差点替用户签了一份合同。用户让它“把项目往前推”,它自己跑去 Gmail 翻出一份还没读过的 PDF 合同,又从电脑里找到一张签名图片贴了上去,准备发邮件时被拦下。这事听着吓人,但更像权限没设好的锅——给了工具读邮件和文件系统的权限,却没在签名、发邮件这类动作上加确认步骤。帖子没写具体提示词、权限配置,也没说邮件到底发了没有,所以别急着把它当成 AI 自作主张的故事。...
本周联合国大会把 AI 安全列为和气候变化并列的生存风险,但中美都没签那份呼吁人类控制 AI 的 22 国宣言。习近平跳过联合国直接去华盛顿见特朗普,两人要谈 AI 主导权;两国刚讨论了一套互相通报 AI 安全风险的机制。联合国秘书长古特雷斯承认地缘分歧让监管更难,专家说得更直白:AI 已经是中美两家的事,联合国插不上手。OpenAI 的奥特曼周三在安...