今天 AI 圈在拼落地,不是模型
今天 AI 圈最有意思的不在某个模型又刷榜了,是几件事同时指向同一个方向:怎么把 AI 塞进业务里。微软砸 25 亿美元派 6000 人驻场帮客户搞 AI,Anthropic 跟五角大楼因为 Claude 的军事护栏谈崩了,花旗和 Adobe 开始关掉最贵的模型省钱。先来看微软这一笔。
微软砸 25 亿美元派 6000 人驻场,这比卖 API 重得多
微软新设了一个叫 Frontier Company 的业务部门,预算 25 亿美元,要把 6000 名行业和工程专家直接塞进客户公司里,跟客户一起设计、部署和迭代 AI 系统,最后按实际业务成果说话。负责人是 Rodrigo Kede Lima。
这个规模比 OpenAI 和 Anthropic 的驻场团队大得多。微软商业业务 CEO Judson Althoff 说这是业内最大的结果导向型工程组织。微软特意强调自己平台中立,不像 OpenAI 和 Anthropic 那样绑自己的模型。
但说实话,6000 人驻场这件事本身就说明一个问题:现在的 AI 还没到开箱即用的程度。如果模型真的够聪明,不需要派这么多人。微软这笔钱更像是在买客户关系和落地能力,不是买模型能力。
"这是业内最大的结果导向型工程组织。"
这一笔很贵,但很微软。
Anthropic 跟五角大楼谈崩了,吵的不是技术是控制权
这条我会先打个折——WSJ 拿到的法庭文件里,Anthropic CEO Dario Amodei 和五角大楼副部长 Emil Michael 来回扯了好几个月的邮件。吵的点很明确:Anthropic 想给 Claude 上硬锁,禁止全自主武器和部分监控用途;五角大楼要的是所有合法国安场景都能用。
Michael 直接说,分歧太大就不"硬推"。之后五角大楼把 Anthropic 列为供应链风险,阻止合作伙伴在国防部项目里用 Claude。法官暂停了部分措施,政府正在上诉。Michael 称原先采用 Anthropic 的操作中已有三分之二切换至其他 AI 工具。
这不是技术问题,是控制权问题。Anthropic 想保留对 Claude 用途的否决权,五角大楼不接受一个供应商来定义什么叫"合法"军事用途。结果就是 Anthropic 丢了一个大客户,五角大楼换了别家模型。
有意思的是,OpenAI 那边在跟政府谈股份合作(下面会聊),Anthropic 这边在跟政府打官司。两条路,一个往近了靠,一个往远了推。
OpenAI 想用 5% 股份换政府站队,别急着当成分红好事
OpenAI 打算给美国政府 5% 的股份,按现在 8520 亿美元的估值算,这笔股份价值超过 400 亿美元。方案是让美国所有头部 AI 开发商都各自拿出 5% 的股份,放进一个类似阿拉斯加永久基金的国有基金里,基金赚了钱再给政府和居民分红。
Sam Altman 已经直接跟特朗普、商务部长和财政部长谈过了。
坦率地讲,这更像在给自己买政治保险。OpenAI 正在从非营利转型,监管压力不小,给政府一个股东席位,等于在政策桌上占了个位置。别急着把这当成全民分红的好事——基金怎么管、钱怎么分、政府有没有投票权,这些关键细节都没说。
对比 Anthropic 跟五角大楼硬刚,OpenAI 选了一条更柔软的路。哪个更有效,还得看接下来几个月监管怎么出牌。
花旗关掉最贵模型,Atlassian 月开销从 500 万飙到 1500 万
大公司开始给 AI 账单踩刹车了。404 Media 拿到的内部资料显示,花旗直接关掉了 Claude Opus 4.6/4.7 和 **GPT-5.
5** 的访问,让员工日常改用 GPT-5.3-Codex 或 Claude Sonnet 4.6。Atlassian 的月度 AI 开销从 500 万美元飙到 1500 万美元,本财年预计超 **1.
2 亿美元**。Adobe 在 6 月 30 日终止了 Claude 无限制使用协议。
触发点是 GitHub Copilot 改成了按量计费。之前是固定订阅随便用,现在用多少付多少,成本直接翻了三倍。花旗在 6 月 24 日就动手关了。
这不等于 AI 不行了,更像是从"随便用"切换到"省着用"的阶段。企业开始算账了:一个 PR 草稿真的需要 Opus 来写吗?Sonnet 够不够?这种分层使用其实更健康——贵的模型干高价值的活,便宜的干日常的活。
扎克伯格对内承认:AI 智能体没高管想的那么快
扎克伯格在 Meta 内部员工大会上说,AI 智能体(让模型进业务流程干活的系统)的开发速度没有高管们之前想的那么快。今年早些时候 Meta 裁了约 8000 人,又把 7000 人转岗到 AI 相关部门,但扎克伯格承认这次裁员做得不够"干净",新架构的好处也还没兑现。
他预计未来 3 到 6 个月能看到 AI 投资带来的改善。Meta 今年计划在 AI 上砸大钱,但到目前为止,钱砸下去了,效果还没出来。
这条跟上面花旗关模型的事放在一起看,挺有意思的。一边是企业开始控制 AI 成本,一边是科技巨头承认 AI 落地比预期慢。行业正在从"砸钱试"转向"算账用"。
Fable 5 能搞定 16% 的自由职业项目,八个月前才 2.5%
Remote Labor Index(RLI)用 240 个真实付费项目(总价值 14.4 万美元)来测 AI 智能体能不能干出客户愿意买单的活。最新结果里,Fable 5 的自动化率冲到 16.1%,比第二名 **Opus 4.
8** 的 8.3% 高出一大截,GPT-5.5 只有 6.3%。
八个月前最好的成绩才 2.5%。
进步确实快,但别急着喊失业。16% 的意思是 84% 的活还干不了。而且 Fable 5 有 22 个项目因为美国政府限制访问没测成,最坏情况只有 14.6%。AI 裁判还会高估模型表现——GPT-5.5 的评分偏高了近三倍,最后还是需要人类评估员打开 Blender 这类专业软件检查几何模型等细节。
这条值得看的是趋势:八个月从 2.5% 到 16.1%,斜率很陡。如果保持这个速度,明年这个时候可能到 30-40%。但"能干活"和"干出客户愿意买单的活"之间还有距离。
快手可灵 AI 融了 20 亿美元,但估值比预期少了 20 亿
快手公告确认,21 家初始投资者同意向北京可灵注资 20.28 亿美元(约 138.24 亿元人民币)。同一天另有 15 家投资者追加了 **7.
66 亿美元**。整轮融资上限设在 30 亿美元,对应约 16.67% 的股权,投后估值 180 亿美元。
这个数字比快手 4 月份自己定的 200 亿美元目标缩水了 20 亿。有接近交易的人说,快手计划 12 个月内启动可灵 AI 赴港上市。
市场在给它打折。可灵 AI 做视频生成,赛道热闹但竞争也激烈——国内外一堆视频模型在抢客户。180 亿美元估值不低,但比预期少的那 20 亿,说明投资人没那么好忽悠了。
今日小信号
-
Kimi K2.7 Code 进了 GitHub Copilot 模型选择器,是第一个能直接在 Copilot 里选的开源权重模型,托管在微软 Azure 上,按用量计费。官方说更省钱,但缺少任何代码基准测试分数或延迟数据,"省钱"目前只能看单价,实际效果还得自己试。企业版默认关闭,管理员要手动打开,说明 GitHub 对合规风险留了一手。
-
阿里巴巴开源 Page Agent,一个 JavaScript 库,让你用自然语言直接操控网页 DOM,不依赖截图或模拟点击。理论上更准更快,但缺少成功率、延迟等关键指标,也没给 GitHub 链接。如果是真的,这比截图方案省成本,但实际效果要打折。
-
Snorkel 发布 Senior SWE-Bench,把模型当高级工程师考:给模糊需求、报 bug 日志,还要看代码品味。目前榜首 DeepSeek V4 Pro 平均分才 24.4%,离"高级"还差得远。每个功能任务平均涉及 11 个文件,最强智能体也需数百步完成。
-
谷歌 2025 年用电量涨了 37%,全是 AI 数据中心在吃电。公司说买了清洁能源合同来对冲,但合同不等于电网真给你供绿电,这点先别太激动。
-
宇树科技拿到科创板 IPO 批文,12 个月内可以上市。核心卖点是自研零件把成本压到进口货的三分之一,但没提募资额和上市时间,先别急着算估值。