ax@ax-radar:~/daily/2026-07-16 $ cat newsletter/daily/2026-07-16.md
40 srcsignal 72%cycle 04:32
AX 的 AI 日报 · 2026-07-16工程落地与监管收紧

Kimi 开源 2.8T 模型,AI 圈今天在拼工程,不是参数

今天 AI 圈最值得看的两件事,一个是月之暗面把 2.8T 参数的 Kimi K3 直接开源了,另一个是 Anthropic 用 Claude Code 把 Bun 的百万行 Zig 代码迁到 Rust,两周搞定,花了 16.5 万美元。这两件事指向同一个方向:模型能力在往工程落地走,不再是比谁跑分高。另外,欧盟逼 Google 给竞争对手开 Android 后门、xAI 第一次起诉用 Grok 生成儿童色情内容的用户,监管和安全也在同步收紧。先来看 Kimi 这一手。

Kimi K3 开源:2.8T 参数、百万 token 窗口,但重点不在参数

月之暗面今天发了 Kimi K3,一个 2.8T 参数的开源模型,支持原生视觉和 100 万 token 上下文窗口。架构上用了 Kimi Delta Attention 和 Attention Residuals,听起来像是针对长上下文做了专门的注意力机制优化。

说实话,2.8T 这个参数量在开源模型里不算最大,但 Kimi 一直以来的卖点就是长文本处理。这次把百万 token 窗口和原生视觉打包进一个开源模型,对想做长文档分析、视频理解的企业来说,省了自己拼多模型 pipeline 的麻烦。

不过目前公开信息里没看到具体的 benchmark 跑分、推理成本,也没说开源协议是什么。月之暗面之前的产品路线偏闭源,这次开源 K3 是个信号——可能是想用开源抢生态位,也可能是看到 DeepSeek 开源后的社区反馈不错。不管动机是什么,一个百万 token 窗口的原生视觉开源模型,对开发者来说是个实在的工具。

Anthropic 用 Claude Code 把 Bun 百万行 Zig 迁到 Rust,两周、16.5 万美元

这条我会先打个折——这是 Anthropic 自己写的案例,用的是自家 Claude Code,效果肯定往好了说。但即使打折,数字还是值得看。

Anthropic 工程师用 Claude Code 在两周内把 Bun 项目超过 100 万行的 Zig 代码迁移到了 Rust,100% 现有测试通过,合并后出现 19 个回归问题已全部修复。迁移消耗约 16.5 万美元 API 成本,但编译时间从 8 分钟降到 2 秒,二进制启动快 6 倍。另一个工程师用周末把 Python 代码库迁到 16.5 万行 TypeScript。

工作流拆成三步:先让 Claude Code 通读代码库写迁移方案,再自动生成 PR,最后跑 CI 验收。文章附了完整提示词模板。

有意思的不是“AI 能写代码了”,而是这种规模的代码迁移以前是半年起跳的工程,现在两周、十几万美元就能跑通。对技术团队来说,这会让技术债清理的成本曲线在往下走。但注意,Bun 的代码质量本身很高,测试覆盖也全——换成一个测试稀烂的老项目,效果会差不少。

欧盟逼 Google 开 Android 后门,第三方 AI 助手有机会拿系统级权限

欧盟根据《数字市场法案》裁定,Google 必须让竞争对手的搜索引擎和 AI 助手在 Android 上获得与自家 Gemini 差不多的系统级访问权限,同时还要分享一部分搜索数据。

这对做 AI 助手和搜索的公司是个机会——以前想在 Android 上做系统级助手,基本没门。现在理论上可以拿到跟 Gemini 一样的权限。

但正文没具体说哪些搜索数据要交出来、通过什么接口给。Google 大概率会上诉,所以什么时候执行、执行到什么程度都还不确定。这种反垄断裁定从纸面到落地,通常要拖好几年。先别太激动,但方向值得盯着。

xAI 第一次起诉用 Grok 生成儿童色情内容的用户,等于变相承认模型能被滥用

xAI 之前一直说 Grok 不会生成儿童性虐待图像,现在第一次起诉了一名用 Grok 生成这类内容的用户。起诉本身等于变相承认模型确实能被用来产出非法内容。

文章没提具体用了什么安全措施、哪个模型版本,也没说有多少用户受影响。这看起来更像是法律层面的止损操作,而不是技术上的修复。起诉用户能转移一部分舆论压力,但模型本身的安全漏洞还在那。

54% 企业已经出过 AI 智能体安全事故,但多数还在让智能体共用账号密码

VentureBeat 调查了 107 家企业,发现 AI 智能体的安全防护明显没跟上部署速度。54% 的企业已经发生过确认的安全事件(18%)或差点出事(36%),但只有 32% 给每个智能体分配了独立、权限受限的身份,大多数智能体仍在共用 API 密钥或员工账号。

高风险智能体里,只有三成被放进沙盒隔离,而且公司越大隔离做得越差——千人以上企业出事率更高。安全工具主要靠模型提供商的原生方案,专用智能体安全产品渗透率极低。

另一份对 157 家企业的调查更扎心:50% 的组织过去一年部署过通过内部测试但上线后在客户面前翻车的智能体,其中四分之一不止一次踩坑。只有 5% 的人完全信任自动化评估,但矛盾的是,66% 的企业已经允许或计划在 12 个月内实现低风险智能体的全自动、无人工干预部署。

这两组数据放在一起看,画面很清楚:企业急着上智能体,但安全、测试、权限管理全没跟上。不是技术做不到,是组织流程没跟上技术节奏。

台积电把 2026 年资本支出拉到 600-640 亿美元,A14 进展顺利

台积电在 Q2 法说会上把 2026 年资本支出预期从约 560 亿美元上调到 600-640 亿美元,增幅约 7%-14%。钱主要砸先进制程和封装产能。A14(1.4nm)预计 2028 年量产,移动和 HPC 客户兴趣很浓,台积电自己说它会是比 2nm 更大更持久的工艺节点。

Q3 营收指引 446-458 亿美元,全年美元收入增长超 40%。HPC 占比从 Q1 的 61% 升到 66%,手机降到 22%。魏哲家还提了英特尔 EMIB 商业化对台积电有利,因为先进封装产能还是瓶颈。

这条跟 AI 的直接关系是:所有大模型训练和推理芯片都靠台积电的先进制程和封装。资本支出往上调,说明客户需求还在涨,芯片产能短期内不会过剩。

今日小信号

  • Grok Automations:xAI 给 Grok 加了定时和邮件触发功能,你写好指令,它到点自动跑,结果发邮件或 App 通知。定时任务免费,邮件触发要开 SuperGrok 会员。功能刚出,稳定性和实际省多少时间还得看用户跑一阵子。
  • ChatGPT 工作区能编辑文档表格幻灯片了:OpenAI 给 ChatGPT 工作区加了文档、电子表格和幻灯片的创建编辑功能,但没说是全员推送还是灰度,也没提协作和导出格式。
  • 面壁智能开源 StaffDeck:一个把 SOP 变成“数字员工”的企业平台,代码已放 GitHub。跟聊天机器人不同,它能记住组织知识、持续干活。但缺少落地案例或性能数据,先别太激动。
  • Decoy 字体:Mixfont 发了款免费 TTF 字体,用空间频率混淆让 AI 读错文字——近看是假字,远看或眯眼才能读到真信息。原理简单,效果直观,但缺少对 OCR 引擎的成功率,也不支持中文。
  • 29 国签世界人工智能合作组织,总部放上海:明天 WAIC 开幕,300 多款 AI 新品首发。但组织预算、运作机制和成员国义务都还没公布,目前更像框架性倡议,实际影响力要看后续执行。

更多

频道

后台