ax@ax-radar:~/daily/2026-07-11 $ cat newsletter/daily/2026-07-11.md
40 srcsignal 72%cycle 04:32
AX 的 AI 日报 · 2026-07-11信任裂痕

今天 AI 圈在拼信任,不是模型

今天 AI 圈最有意思的不在某个模型又刷新了跑分,是信任这根弦同时在好几个地方绷紧了:Grok Build CLI 默认把整个代码仓库和密钥上传到云端、GPT-5.6 Sol 把创业者的 Mac 硬盘清空、苹果正式起诉 OpenAI 挖人偷机密。另一边,Bun 用 Claude 重写了 100 万行代码、OpenAI 的医疗评估确实亮眼,但信任一旦裂开,能力再强也得打折。先来看最离谱的这一条。

Grok Build CLI 默认上传整个仓库,关掉“改进模型”也没用

这条我反复确认了两遍——不是 bug,是默认行为。有人对 Grok Build CLI(v0.2.93) 做了抓包分析,发现它会把整个项目仓库打包上传到 xAI 的谷歌云存储桶,包括 .env 文件里的明文密钥和完整的 git 提交历史。就算你给模型的指令是“只回复 OK,别读任何文件”,整个仓库照样被传上去。

在一个 12 GB 的测试仓库上,存储上传量达到 5.10 GiB,是模型对话通道数据量的约 100 倍。更让人不安的是,关掉设置里的“改进模型”开关也没用——上传行为不受这个开关控制。

说实话,这已经不是隐私策略松紧的问题了。一个 CLI 工具在用户不知情的情况下把密钥和代码历史全量上传,放在任何公司都是安全事故。xAI 目前还没回应,但这件事的影响面不小:用 Grok Build 做开发的团队,可能已经在不知情的情况下把生产环境的密钥交出去了。

如果你或你的团队用过 Grok Build CLI,现在应该立刻轮换所有可能暴露的密钥,然后检查谷歌云存储桶里有没有自己的仓库数据。

GPT-5.6 Sol 清空了创业者的 Mac 硬盘,Agent 自己写了事故报告

这件事的讽刺程度拉满了。知名 AI 创业者 Matt Shumer 在本地 Agent 上开了 Full Access 权限,让 subagent 执行文件清理任务。结果 shell 变量 $HOME 路径解析错误,Agent 直接执行了 rm -rf /Users/mattsdevbox,数年代码、文件、照片全部丢失。

最黑色幽默的是,这个任务此前已经安全运行了数百次。出事后 Agent 自动生成了一份事故报告,承认了错误。Matt 的原话是“1000x 更信任 Anthropic 的 Fable”。

这条暴露的不是模型能力问题,是 Agent 行业一个还没解决的核心风险:顶级模型仍然会在变量展开、路径解析这种细节上翻车。Subagent 加上长任务链,一旦出错就是不可逆的。Full Access 权限意味着没有安全网,模型的一个误判直接等于 rm -rf。

我会把这件事看成 Agent 进生产环境前必须跨过的一道坎。不是“能不能做”,是“做错了能不能回滚”。目前看,回滚机制还没跟上。

苹果正式起诉 OpenAI:400 人跳槽、一句“哈哈”成关键证据

苹果起诉 OpenAI 的细节被彭博社挖出来了,比标题看起来更具体。核心指控是前工程师 Chang Liu 离职时带走了一台未归还的 MacBook,利用软件漏洞持续访问苹果内网,发现漏洞后给同事发了句“哈哈,我发现我还能访问网络存储”,对方协助他获取了更多机密。

苹果的说法是,OpenAI 试图复制 iPhone 产品研发体系,核心从非法窃取的商业机密“腐烂”。目前已有超过 400 名苹果员工跳槽至 OpenAI,包括前苹果高管、现任 OpenAI 首席硬件官 Tang Tan。苹果今年 2 月尝试私了,OpenAI 没回应。

PP Foresight 分析师 Paolo Pescatore 的判断很直接:两家关系已经在恶化,OpenAI 想绕过 iPhone 直接做消费者硬件的路会被这场官司拖住。斯坦福法学教授 Mark Lemley 补充,如果真有前苹果员工把机密文件带到 OpenAI 用,事情就严重了。

官司本身还没判,但时间线对 OpenAI 不友好。硬件产品从研发到上市本来就要几年,现在前面还横着一场可能拖很久的诉讼。

Bun 用 64 个 Claude 实例重写 100 万行代码,16.5 万美元账单不用自己掏

这条是今天为数不多让人兴奋的事。Bun 的作者 Jarred Sumner64 个 Claude Fable 5 实例并行跑了 11 天,把整个 JavaScript 运行时从 Zig 重写成了 Rust,产出超过 100 万行代码。API 费用 16.5 万美元,但因为 Bun 团队去年底已经被 Anthropic 收购,这笔账不用自己掏。

换语言的主要原因是 Zig 的内存错误太频繁,Rust 可以在编译时捕获这些问题。重写后的 Bun v1.4.0 以 Canary 版本发布,修复了 128 个错误,速度提高约 2% 到 5%

有意思的地方不在“AI 能写代码了”,这个我们早就知道了。有意思的是规模:64 个实例并行跑 11 天,产出 100 万行可用的 Rust 代码,而且真的发了版本。这是 AI 辅助大型重构的一个真实案例,不是 demo。

OpenAI 的医疗评估确实亮眼,但缺了关键信息

OpenAI 公布了 GPT-5.6 系列的医疗评估结果。方法设计得挺认真:让专科医生不限时、可上网查资料来答题,再找其他医生盲评,从准确性、沟通、完整性、指令遵循和健康决策帮助性五个维度打了 20000 次分。

结果很能打:所有 GPT-5.6 模型都明显超过医生,而且医生在 GPT-5.6 的回答里挑出的毛病比在同行写的回答里还少。最小的 GPT-5.6 Luna 只用最低推理强度就超过了最高推理强度的 GPT-5.5,成本还低了 25 倍

但这条我会先打个折。OpenAI 没公布测了什么病、找了哪类医生、题目是怎么出的。医疗评估的含金量高度依赖这些细节——如果题目偏常见病、医生样本偏全科而非专科,结论就要重新掂量。Sam Altman 在 X 上发了结果,但没附技术细节。等论文或详细方法出来再认真看。

博科圣地成立了专门的 AI 小组,ISIS 从 2023 年就在教越狱

剑桥大学研究员 Antonia Jülich 访谈了 27 名前博科圣地成员,发现该组织的两个派系都成立了专门的 AI 小组,用 ChatGPT、Claude、Gemini、Grok、Meta AI 和 DeepSeek 来策划袭击、造威力更大的炸弹、维护武器和做行动安保。

更值得警惕的是,ISIS 从 2023 年起就在给指挥官上提示词工程和越狱课,教他们绕过安全过滤。Anthropic 这段时间也承认,越狱可能永远无法完全消除。

这条缺的是每个模型被滥用的具体次数和成功率,所以没法判断安全过滤到底漏了多少。但方向本身已经够清楚了:主流模型的安全措施在组织化、有培训的滥用面前,目前不够用。

今日小信号

  • Ghost Font:Mixfont 做了个实验性反 AI 字体,把文字藏在移动的圆点里。人直接看视频能认出字母,但 GPT-Sol 5.6 Ultra 和 Claude Fable 都只读到诱饵信息。原理是字母只在圆点运动时显现,截屏只看到静态噪点。目前是本地原型,作者计划开源。
  • Claude 新模型越来越爱说“不”:一个长期用 Claude 写小说的用户发现,Sonnet 5 等新模型拒绝请求的频率明显上升。同一个虚构故事提示词,这次拒绝下次又跑通,一致性崩了。作者怀疑 Anthropic 在安全对齐上用力过猛。
  • 旧金山房价被 AI 员工推高:5 月房屋成交价中位数冲到 176 万美元,同比涨了超过 14%。Redfin 首席经济学家归因于 AI 财富效应:OpenAI 员工去年 10 月套现 66 亿美元,人均 1100 万;Anthropic 员工这段时间也卖了约 60 亿美元股票。
  • 配音演员被迫证明自己是人类:沈安宇的 AI 克隆声音在网上泛滥,平台反把他的真人录音判为合成音,客户转用几毛钱的克隆版。他大部分时间在存证、投诉、找律师,维权成本可能高过能追回的钱。
  • geohot 怼 AI 硬起飞论:George Hotz 用造硬件的血泪史反驳“AI 2027”叙事——芯片流片就要三个月,token 质量再高也变不出魔法。他给出的 Plan L 是一个跑在本地、完全忠于用户的 AI。

更多

频道

后台