ax@ax-radar:~/daily/2026-08-03 $ cat newsletter/daily/2026-08-03.md
33 srcsignal 72%cycle 04:32
AX 的 AI 日报 · 2026-08-03开源与合规并行

今天 AI 圈在拼开源和合规,不是模型

今天 AI 圈最有意思的不在某个模型又能写代码了,是几条线同时翻动:Qwen 把 2.4T 参数的 Max 级模型开源了,MiniMax H3 视频模型权重也放出来了,商汤拿 8B 小模型叫板闭源。另一边,欧盟 AI 法案的透明度规则今天正式生效,违规最高罚 1500 万欧元。先来看 Qwen 这一手。

Qwen 把 Max 级模型开源了,2.4T 参数,下周放权重

这条我先不打折——Qwen 今天正式发布了 Qwen3.8-Max2.4T 总参数,95B 激活参数,而且明确说开放权重下周发布。这是 Qwen 家族第一次把 Max 级模型开源。

之前 Qwen-Max 一直是闭源的,只在 API 里用。这次直接放权重,意味着你可以在自己的硬件上跑一个跟 Qwen 最强模型同级别的家伙。95B 激活参数不算小,但比起 GPT-4 或 Claude 的体量,本地部署的门槛不是完全不可逾越。

有意思的是时机。OpenAI 刚把 5.5 接进 API,Anthropic 在推 Claude 连接器,Google 在砸 400 亿绑 Anthropic——大家都在往上堆能力、锁生态。Qwen 选择在这个节点把最强模型开源,像是在说:你们锁你们的,我把钥匙发给大家。

当然,开源只是第一步。权重放出来之后,社区能不能在消费级硬件上跑起来、推理速度怎么样、有没有人做量化版本,这些才是决定它能不能真正"用起来"的关键。下周权重落地后再看。

MiniMax H3 开源:一张 3060 就能跑 2K 视频,ComfyUI 当天就接上了

MiniMax 今天把第三代视频模型 H3 的权重也开源了。它能根据文字、图片或视频直接生成最长 15 秒、分辨率到 2K 的视频,而且音频是跟画面一起生成的立体声,不是后期贴上去的。

比较实用的是动作迁移功能——你拿一段参考视频,让模型把动作套到另一张图上。官方说一张 RTX 3060 就能本地跑,这点先别太激动,等社区实测。但 ComfyUI 当天就接入了,说明社区对接速度很快,这对实际可用性是好事。

把 Qwen3.8-Max 和 H3 放在一起看,今天开源这条线挺清晰的:大语言模型那边 Qwen 在放 Max 级权重,视频生成这边 MiniMax 在放 H3。都不是小模型,都不是阉割版。

商汤拿 8B 小模型叫板闭源,但跑分和协议都还没给

商汤放出了一个叫 SenseNova U1.5-Lite-Preview 的开源模型,走 NEO-Unify 架构,参数量只有 8B-MoT。MoT 可以理解成把多个小专家模型拼在一起干活,用更少的计算量撑起多模态能力。

官方说它的图片生成和编辑效果能跟商业闭源模型掰手腕。但缺少具体跑分、开源协议和需要的显卡配置,这个说法先打个折。如果是真的,低成本跑多模态挺香——但"如果是真的"这四个字现在还挺重。

欧盟 AI 法案透明度规则今天生效,违规最高罚 1500 万欧元

从今天起,在欧盟运营的科技公司必须给 AI 生成的文字、音频、视频和深度伪造内容打上标签,并告诉用户他们正在跟机器对话。违规罚款最高 1500 万欧元,或者全球年营业额的 3%

欧盟还发布了一套官方标签图标,公司可以直接用,不用自己设计。8 月 2 日前推出的模型有 4 个月宽限期

这条规则的核心不是"不许用 AI",而是"用了得说"。对在欧盟有业务的公司来说,合规成本是实打实的——内容审核流程要改、产品界面要加标注、用户交互要加提示。1500 万欧元的罚款上限不算低,够让法务部门紧张起来。

跟今天开源那条线放在一起看,有点意思:一边是模型能力在往下放、门槛在降低,另一边是监管在往上收、合规要求在变严。两条线同时在走。

GPT-Live 修了实时语音的老毛病,但延迟和成本还没说

OpenAI 公布了 GPT-Live,一套从客户端到模型全部重写的实时音频方案。核心变化是模型能在说话的同时继续听你说话,音频流不会断。

以前一调用工具或做深度推理,对话就会卡住——这个中断现在被干掉了。Greg Brockman 的说法是"为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈"。

但价格、延迟和上线时间都没给。实时音频对延迟极其敏感,如果推理成本太高或者响应不够快,体验还是会打折扣。这条先当技术预告看,实际体验等上线再说。

Palantir 单季赚了 10 亿美元,CEO 转头骂 AI 行业是"马克思主义"

Palantir 刚交出一份季度利润 10 亿美元的成绩单,CEO Alex Karp 就在股东信里开炮,说那些做前沿大模型的公司是"马克思主义者"——不管有意还是无意,都在夺取合作伙伴的"生产资料"。

他的逻辑是:这些实验室把企业数据和业务逻辑吸进自己的模型里,客户就失去了控制权。Palantir 的对策是把模型部署在客户自己的环境里,做模型无关的 AI 与分析软件。

Karp 说话一向猛,但这次他有个硬数字撑腰:季度营收 19 亿美元,同比增长 93%。你可以不买账他的"马克思主义"说法,但 Palantir 确实在赚钱,而且赚得越来越多。

Cloudflare 给 AI 智能体配了台虚拟电脑,不是容器

Cloudflare 在 Agents Week 发布了 @cloudflare/computer 预览版。它给 AI 智能体提供了一个虚拟文件系统、浏览器和终端,让智能体能像人一样读写文件、跑命令、操控浏览器。

官方强调这不是容器,而是专门为智能体设计的虚拟电脑。同时,Workers 和 Containers 现在能直接接收 TCP 和 gRPC 连接了,不用再绕 WebSocket 或挂代理,边缘跑长连接服务方便很多。

两条都是预览阶段,没定价没上线时间。方向是对的——智能体需要一个"身体"来干活,不只是个 API 端点。但生产环境用之前得自己测冷启动延迟和成本边界。

今日小信号

  • AirLLM 让一张 4GB 显卡跑 70B 大模型:用分层加载把模型拆开、一层层往显存里搬,GitHub 上 26.7k 星。能跑和能流畅对话是两码事,瓶颈大概率在生成速度上,别指望当实时聊天工具用。
  • JFrog 发现一批 SQLite 高危漏洞是 AI 编出来的:6 个 CVE 里提到的函数在对应版本里根本不存在,PoC 跑起来也不会崩溃。其中一个最初被 Red Hat 打了 10.0 满分,后来悄悄降到 7.6。用 AI 做安全研究的人得留个心眼。
  • Epoch AI 搞了个新基准 MirrorCode:让 AI 不看源码复刻完整软件,最贵一次烧了 2600 美元、跑了 19 天。但缺少具体成功率,先当方法论看。
  • AI 公司的债务狂欢快撑不住了:2026 上半年,微软、亚马逊这类算力巨头一共发了 2250 亿美元债券,比去年同期暴增 973.7%。更隐蔽的风险在表外——美国前五大科技公司签下的长期 GPU 采购、数据中心租赁等承诺加起来 1.65 万亿美元。债主已经开始犹豫了。
  • 用好大模型的关键不是提示词技巧,而是你本来就懂行:作者用陶哲轩跟 ChatGPT 聊数学的例子说明,模型越强,人的专业判断反而越值钱。瓶颈已经从"模型会不会"变成了"你能不能说清楚到底要什么"。

更多

频道

后台