ax@ax-radar:~/daily/2026-06-21 $ cat newsletter/daily/2026-06-21.md
33 srcsignal 72%cycle 04:32
AX 的 AI 日报 · 2026-06-21安全从四面八方炸开

今天 AI 圈在拼安全,不是模型

今天 AI 圈最有意思的不在某个模型又刷榜了,是安全这个词从不同方向同时炸开:NSA 局长说有个叫 Mythos 的团队几小时打穿了他几乎所有机密系统,George Hotz 炮轰 AI 安全圈靠末日论撑估值,Meta 员工联名反对公司收集键盘鼠标数据训 AI。另一边,美团 tabbit 把 GPT-5.5 和 Claude Opus 4.8 打包免费开放了,三星把 ChatGPT 推给全球员工。先来看 NSA 这条,信息缺口不小,但数字很吓人。

NSA 局长说机密系统被几小时打穿,但 Mythos 是谁还没人说得清

这条我会先打个折——NSA 局长说有个叫 Mythos 的团队,几小时内就打穿了他手下几乎所有机密系统。同一拨人之前 5 天破解了 MacOS,而 Google Project Zero 这种顶级漏洞团队完成同等攻击要 6 个月。一个 MacOS 零日漏洞在黑市上大概值 200 万美元,苹果原本估计全球只有 10 到 20 个团队有这个能力,Mythos 的出现可能把这个数字推到几千。全球 20 亿活跃苹果设备里,Mac 用户多是记者、高管、政府官员这类高价值目标。

但问题来了:正文没说是谁、什么时候、在哪说的。NSA 局长亲口承认自家系统被打穿,这事如果是真的,严重性不用多说。但 Mythos 到底是什么——是一个国家行为体、一个漏洞经纪商、还是一个研究团队——现在完全没信息。

有意思的是时间对比:5 天 vs 6 个月。如果这个数字属实,说明 Mythos 手里有系统性的漏洞发现能力,不是碰运气找到一个洞。但同样,这个对比的来源和验证方式也没说。先记下,等更多信息出来再判断。

George Hotz 炮轰 AI 安全圈:末日叙事撑估值,技术根本跟不上

George Hotz 在伯克利待了两周,回来直接开喷:当地的 AI 安全圈子像个"无神论享乐主义者的邪教",必须靠 AI 末日论来给自己的职业选择找理由。

他拿 GLM-5.2 的技术博客和 Anthropic 的公关文章做对比:前者老老实实讲模型怎么慢慢变好,后者全是"指数级增长""递归自我改进"这类炒作。他的判断很直接——现有技术根本撑不起估值,所以只能靠末日叙事来填。他还引用了一篇 schizoposting 风格的文章,说这种炒作模式在硅谷已经成套路了。

这条跟上面 NSA 那条放一起看挺有意思:一边是政府真的在出手管制模型(Anthropic 两款新模型被出口管制令逼到下线),一边是 Hotz 说安全圈在夸大危险来撑估值。两件事不一定矛盾——危险可能真实存在,同时有人拿它当融资工具。但 Hotz 点出的那个对比确实扎心:技术博客在讲怎么慢慢变好,公关文章在讲指数级增长。

Meta 员工自己先炸了:1600 人联名反对公司收集键盘鼠标数据训 AI

Meta 内部搞了个叫"模型能力计划"(MCI)的项目,打算收集员工的键盘输入、鼠标轨迹、点击位置和屏幕内容来训练 AI。超过 1600 名员工签了公开信反对。

信里列了几个具体问题:隐私审查没做完就推,高管自己可以豁免不参加,也没说清楚怎么保护社保号这类敏感信息。还翻出旧账——Meta 之前因为明文存密码被欧盟罚了 9100 万欧元,今年 3 月又出过一次 AI 助手给错信息的事。

这事有意思在,不是外部隐私组织在抗议,是员工自己先炸了。1600 人联名在内部不是小数目。而且高管豁免这个细节很要命——如果数据收集真的安全无害,为什么高管自己不参加?这条先别太激动,要看 Meta 怎么回应,但员工用脚投票本身已经说明问题了。

美团 tabbit 把 GPT-5.5 和 Claude Opus 4.8 打包免费了,但免费到哪天没说

美团上线了 tabbit 国际版,一口气接入了 GPT-5.5Claude Opus 4.8Gemini 3.5 Flash,外加国内的 **Kimi-2.

6**、GLM-5.1MiniMax-M3,不用单独订阅就能用。国内版只给国内模型,海外模型是国际版独占。

对想尝鲜多模型但不想分别付费的用户,这个打包确实友好。但正文没提免费到什么时候、以后怎么收费,也没说是否限频次或限上下文窗口。如果是真免费且不限量,那挺省钱;但推广期一过可能就变脸。价格、窗口和速率限制都还没说,现在只能看到调用方式,看不到成本边界。

三星把 ChatGPT 和 Codex 推给全球员工,OpenAI 说是最大企业部署之一

三星电子要把 ChatGPT 企业版Codex 推给韩国所有员工,以及全球 DX(设备体验)部门的员工,覆盖研发、制造、营销等业务线。OpenAI 说这是他们至今最大的企业部署之一。

Codex 现在每周有超过 500 万活跃用户,在韩国的周活从 2026 年 2 月 1 日起涨了近 800%。但缺少这笔交易的金额和具体上线时间表。我会先打个折:大企业宣布部署和实际用起来是两回事,三星之前对 AI 工具的态度偏保守,这次全面铺开是真用还是先签个合同,要看后续。

Steve Yegge:超级智能模型将在两三代内被政府锁死

Steve Yegge 的判断很直接:Fable 模型被美国政府短暂关停是一个转折点——模型智能已经危险到需要像核武器一样被管制。他预测,最多再过两三代模型,超级智能就会被锁死,只有极少数人能接触。

开源模型目前落后前沿大约 七个月,受算力墙和政府封锁影响,很难突破 Fable 这个级别。对大多数公司和个人来说,现在这批模型的质量可能就是未来能用到的最好水平了。

这个判断跟 Hotz 的炮轰放一起看有个张力:Yegge 说危险到要锁死,Hotz 说危险被夸大了。两边的共同点是都认为管制在加速,分歧在于管制的合理性。Yegge 的七个月落后判断如果准确,那开源和闭源的差距确实在被锁死之前就已经拉开了。

今日小信号

  • Sakana 发布 Fugu:把多模型协同打包成一个 API,让系统自己学会怎么组队干活。基准跑分能打平 Fable 5 和 Mythos Preview,但目前只是他们自家公布的数据,等第三方验证。
  • AI 用得越猛,升职越没戏? 一位中厂工程师用 AI 把产出拉到全公司最高,VP 夸他"超人速度交付",结果连续两次升职被毙。复盘发现,交付太快让他在高管眼里从出主意的"脑"变成了干活的"手"。核心观点:别只响应公司给你的奖励机制,得主动设计你给别人的奖励机制。
  • Agent Skills 用错的人很多:Anson Biggs 吐槽,让模型自己写技能说明书等于白费力气,真正的技能应该来自它卡壳后的复盘。人工整理好的 Skills 平均能把通过率拉高 16.2 个百分点,但领域差异极大——软件工程只涨了 4.5 个百分点,医疗健康暴涨 51.9 个百分点。
  • AI 写书的真正指纹:lcamtuf 在亚马逊搜"十万个为什么",跳出约 150 本封面几乎一样的童书。不同人用类似提示词让模型生成内容时,约 80% 的输出几乎一模一样——这种"准确定性"才是 AI 文本真正的指纹,不是写得不像人,是写得都一样。
  • 瑞士高校开源合规模型 Apertus:数据、权重全公开,主打"主权 AI"和合规——会尊重数据退出请求、清洗掉个人身份信息。但缺少跑分,性能先打个折。

更多

频道

后台