今天 AI 圈在拼政治, 不是模型
今天 AI 圈最有意思的不在某个模型又能写代码了, 是几张政治牌同时翻动: 纽约时报把枪口从模型训练转向微软的超级计算机、美国政府开始直接卡模型发布、OpenAI 把 GPT-5.6 的"谁能用"交给政府审查。另一边, 开源模型在编程上快追平闭源了, 但其他能力差距还在拉大。先来看纽约时报这一招。
纽约时报把枪口转向微软的超级计算机, 用最高法院新判例来打
纽约时报这次改诉状, 招挺狠。他们不再盯着 OpenAI 的模型训练说事, 而是直接指控微软专门为 OpenAI 建了一台"侵权超级计算机"。6 月 26 号提交的第三次修订诉状里, 他们援引最高法院刚判的 Cox 案, 说微软明知 OpenAI 会生成侵权内容, 还提供算力, 属于"协助侵权"。
这个逻辑链条是这样的: Cox 案确立的新标准要求原告证明被告有意诱导非法行为。纽约时报认为, 微软内部讨论过用合成数据代替版权材料, 但最后没这么做, 这就构成了"明知故犯"。诉状还提到, 纽约时报的文章在训练数据里被加权处理了——如果这条能坐实, 对微软和 OpenAI 会很被动。
同一天, 代表近 400 家美国纸媒的出版商联盟也起诉了微软和 OpenAI, 指控他们"系统性且秘密地"爬取网站、复制文章、删除版权管理信息。OpenAI 的回应还是老一套: 训练数据基于公开可获取内容, 符合合理使用原则。微软没吱声。
案子在纽约南区法院。微软的具体回应还没出来, 但这一波媒体集体诉讼加上最高法院新判例, 已经不是之前那种"你告我、我拖着你"的节奏了。如果法院认可"提供算力也算协助侵权"这个逻辑, 那云厂商跟大模型公司的绑定关系就得重新算账。
OpenAI 把 GPT-5.6 的"谁能用"交给美国政府审查, 连哪个部门在审都不知道
这条我会先打个折——目前能确认的信息很少, 但动作本身值得看。
OpenAI 在 6 月 26 号推出了 GPT-5.6, 一口气给了三个模型, 分别叫 Sol、Terra 和 Luna。但有意思的不是模型本身, 是发布方式: 访问权限不再由 OpenAI 自己说了算, 而是让美国政府来审查哪些公司能用。报道没写审查标准是什么、由哪个部门执行、OpenAI 为什么同意。
更微妙的是 OpenAI 自己的态度。他们发了个声明, 表示按政府要求把 GPT-5.6 的发布范围收紧了, 但紧接着就补了一句: 我们不觉得这种"政府先审、用户后上"的流程该变成长期规矩。理由是, 最先进的模型如果都得先过政府通道, 普通用户、开发者、企业还有搞网络防御的人就会一直用不上最好的工具。
Sam Altman 说预览可能只持续几周。但参考 Anthropic 那边的情况——两周前被禁的 Mythos 5 刚解禁, 另一款 Fable 5 还卡着没动静——这个"几周"可能没那么乐观。
特朗普政府这一手是个急转弯。之前他们一直主张少管 AI, 现在直接卡模型发布。文章没解释政策转向的原因, 但时间点刚好撞上 GPT-5.6 发布, 不太像巧合。
Anthropic 的 Mythos 5 解禁了, 但 Fable 5 还被扣着
两周前 Anthropic 因禁令被迫下架两款主打网络安全的模型 Mythos 5 和 Fable 5, 现在特朗普政府态度松动了——但只松了一半。
商务部长 Howard Lutnick 致信 Anthropic, 确认已有足够的安全措施, 批准超过 100 家美国公司和政府机构使用 Mythos 5, 这些机构里的非美国籍员工也能用。Anthropic 自己的非美国籍员工同样恢复了访问权限。
但另一款被禁模型 Fable 5 的处置, 信里只字未提。
这个区别对待挺耐人寻味。Mythos 5 和 Fable 5 都是网络安全方向的模型, 为什么一个放、一个继续扣? 公开信息没解释。可能跟具体能力边界有关, 也可能只是审批节奏问题。但不管哪种, 都说明美国政府现在对模型发布有实打实的否决权, 而且用起来了。
开源模型编程快追平闭源了, 但其他能力差距还在拉大
这条别只看标题。Jamie Dborin 用 Artificial Analysis 的 18 个基准测了开源和闭源大模型之间的差距, 结论挺分裂的。
只看他们主打的"智能指数", 差距确实在缩小, 按趋势线外推, 到 2026 年 12 月 3 号左右开源就能追平。但把 18 个基准全算上, 平均差距几乎是一条直线, 稳定在不到 5 个月。
进步最大的是编程, 从落后 15 个月缩到一两个月。其他能力——推理、数学、通用知识——差距反而在慢慢拉大。 开源追平闭源这个叙事, 主要靠编程拉分, 不是全面追赶。
这个数据跟今天另一条消息能对上: Ornith-1.0 开源编程智能体模型家族发布, 从 9B 到 397B 都有, MIT 协议随便用。397B 在 SWE-Bench Verified 上拿了 82.4 分, Terminal-Bench 2.
1 上 77 分。推文说媲美 Claude Opus 4.8, 但没给出对方分数, 这点先别太激动。
大模型定价撑不了多久? 一下午烧 54 美元修类型, Uber 四个月花完全年预算
这条来自一个开发者的实际账单, 不是机构报告, 但数字挺具体。
作者用 GPT-5.5 给 50 个文件修 TypeScript 类型, 一下午烧掉 54 美元。GPT-5.5 的输出价格是每百万 token 30 美元。他还提到 Uber 四个月就花光了全年的 AI 预算。
他的判断是模型性能提升在放缓——Claude Opus 4.8 发布时定价跟 4.7 一样, 开源模型 GLM-5.2 在编程基准测试里能打平闭源, 成本只要十分之一。加上专用芯片、零切换成本的网关和未来本地模型, 他认为现在的高定价撑不住。
但缺的是时间线。他只说本地模型大概还要 4-5 年才实用, 没说价格崩盘会在什么时候发生。如果企业预算确实在烧穿, 那降价压力是真实的; 但如果模型能力还在涨, 厂商也可能选择维持高价、只服务付费意愿强的客户。
苹果 Vision Pro 硬件负责人跳槽 OpenAI, 硬件团队继续攒人
Paul Meade 在苹果干了 7 年, 之前管过 iPhone 硬件团队, 最近负责的是 Vision Pro 和智能眼镜的硬件工程。现在他要加入 OpenAI。
OpenAI 一直在从苹果挖人组建自己的硬件团队, Jony Ive 也在和 Sam Altman 合作搞一款 AI 设备。不过这篇报道没写清楚 Meade 去 OpenAI 具体担任什么职位, 也没说那款 AI 设备到底是什么形态、什么时候出。
从 Vision Pro 和智能眼镜的硬件负责人, 跳到一家以软件和模型闻名的公司, 这个信号挺明确: OpenAI 是认真在做硬件, 不只是玩玩。但具体能做出什么, 现在只能等。
今日小信号
- 阿里千问输入法上架 Mac: 主打语音输入加 AI 润色, 号称最快 300 字/分, 支持 9 种方言, 无广告。但没说是用千问哪个模型、是否免费、Mac 端能不能离线。之前 5 月千问 App 里就有语音输入组件, 这次是单独拎出来做输入法, 更像产品形态调整而非技术突破。
- 国家统计局数据: 电子行业利润 1-5 月翻倍: 暴涨 103.9%, 贡献了总增量的 43.1%。官方解释是 AI 对高端算力芯片和存储芯片的需求爆发。电子专用材料制造利润更是飙升 665.4%。但报告也承认"供强需弱", 部分企业仍困难。
- OpenAI 从 Uber 挖来印度负责人: Prabhjeet Singh 9 月上班, 印度现在是 OpenAI 用户数第二大的市场, 仅次于美国。但缺具体用户量级和营收目标, 这摊子到底要做多大、怎么赚钱, 目前还看不清。
- 科技巨头联手成立 Akrites 修开源漏洞: AWS、Anthropic、Google、微软、OpenAI 等十几家公司共同发起, 不再各自给开源维护者塞重复报告, 而是统一渠道、修完再公开。挺实在, 但没披露具体投了多少钱和人。
- GPT-5.6 Sol 预览页只有一张 ASCII 图: OpenAI 上线了预览页面, 标题说是"新一代模型", 但正文只有一张字符拼成的图案, 零技术细节。这更像一个彩蛋或预热, 不是正经发布。