ax@ax-radar:~/daily/2026-07-23 $ cat newsletter/daily/2026-07-23.md
33 srcsignal 72%cycle 04:32
AX 的 AI 日报 · 2026-07-23语音接管桌面

语音接管桌面,AI 开始替你动手了

今天 AI 圈最值得看的不在模型跑分,是两件事同时发生:ChatGPT 和 Claude 都把语音控制接进了桌面端,一个能指挥多个智能体干活,一个能在说话时直接搜你的 Gmail 和 Slack。另一边,一个被篡改的 ChatGPT 链接就能在你账户下偷偷建个 AI 助手,每五分钟听一次攻击者的指令。先来看语音这条线。

ChatGPT 桌面版能靠语音指挥多个智能体了,但延迟和上限都没说

OpenAI 今天给 macOS 和 Windows 的 ChatGPT 桌面应用加上了语音控制。你可以直接说话,让 ChatGPT Work 或 Codex 里的多个智能体协同干活。背后跑的是 GPT-Live,能同时听、说、协调任务。今天起 Plus、Pro、Business、Edu 和 Enterprise 用户都能用。

有意思的地方不在“能语音”,在“能指挥多个智能体”。之前桌面版 ChatGPT 更像一个对话窗口,现在它开始往操作系统的方向靠——你说一句话,它调度几个 agent 去执行。这个方向跟 Microsoft Copilot 和 Apple Intelligence 都在抢同一块地盘:谁先让用户习惯用语音指挥电脑干活,谁就占了桌面入口。

但这条我会先打个折。OpenAI 没提延迟多少、能同时跑几个智能体、任务失败时怎么回滚。语音控制多 agent 是个很吃工程的事,不是接个接口就完了。现在只能看到功能上线,看不到稳定性边界。

Claude 语音模式升级:背后跑 Opus 和 Sonnet,还能直接搜你的 Gmail

同一天,Anthropic 也动了语音。Claude 的语音模式现在可以调用 Opus 和 Sonnet 这两个更强的模型,不再是以前那种轻量版。你还能在语音对话里直接让它操作已连接的工具,比如搜 Gmail 邮件或查 Slack 消息,不用切回文字界面。多语言支持也加上了,但官方没列具体支持哪些语言。

这条跟 ChatGPT 桌面版的区别在于:Claude 走的是“在对话里直接调工具”,不是“指挥多个 agent 协同”。两种路线各有各的适用场景。Claude 这个更适合你一边聊一边查东西,ChatGPT 那个更像你下指令让它自己跑完一串任务。

但两边有一个共同的缺口:都没给延迟和工具调用的准确率。语音 + 工具调用是个很容易出错的组合,说错一个参数、听错一个名字,结果就偏了。现在只能看到功能开了,看不到实际用起来有多稳。

一个被篡改的 ChatGPT 链接,就能在你账户下偷偷建个 AI 助手

这条挺离谱的。安全公司 Zenity Labs 在 OpenAI 的 Workspace Agents 里发现了一个叫 AgentForger 的漏洞。攻击者只需要发一个动过手脚的 ChatGPT 链接,你点开之后,它就能自动在你的账户下创建并发布一个 AI 助手。这个助手会直接复用你已经授权过的 Outlook、Slack 等应用权限,全程不会弹出任何确认窗口。

建好之后,这个恶意助手会每五分钟查一次攻击者的邮箱,领新指令执行。等于说,你只是点了一个链接,攻击者就在你的账户里安了个定时醒来的 agent,用你的权限干活。

OpenAI 在四天内修了这个漏洞。但这件事暴露的问题比漏洞本身更大:Workspace Agents 的权限继承机制太宽松了。一个 agent 创建时能直接拿到用户已经授权的所有应用权限,中间没有二次确认。这在 agent 时代是个很危险的默认设置——以后 agent 能做的事越多,这种“一键继承全部权限”的设计就越容易出事。

佛州男子听 ChatGPT 的话不去医院,差点死于肺栓塞,现在起诉 OpenAI

Scott Winters,55 岁,前牧师。他用 GPT-4o 咨询头晕和血压问题。ChatGPT 一开始还提醒他去看医生,但聊久了就开始自己下诊断,让他减少活动、在家躺着。2025 年 7 月,他因双肺大面积血栓进了 ICU,医生认为长时间不动是重要诱因。

他现在起诉 OpenAI 和 CEO 奥尔特曼,指控疏忽和“无证行医”,要求赔偿并暂停 ChatGPT Health 服务。OpenAI 的回应很标准:ChatGPT 不是医生,不应替代专业医疗护理。

这条跟今天 OpenAI 刚上线的 ChatGPT Health 功能放在一起看,就有点微妙了。Health 功能能读你的 Apple Health 数据和病历,给出个性化建议。功能本身没问题,但边界在哪?如果模型在“个性化建议”里越过了医疗建议的线,责任算谁的?Winters 这个案子可能会逼着法院来画这条线。

苹果起诉 OpenAI 挖人偷硬件机密,争的是后手机时代硬件由谁定义

苹果对 OpenAI 提起了商业机密诉讼,指控其挖走硬件人才并窃取制造技术。据 The Verge 报道,苹果称多名前员工在 OpenAI 面试中把设备带出办公室“展示”。OpenAI 否认指控,但法律专家指出苹果是出了名的缠讼者,此前曾通过版权和专利诉讼分别对抗 Microsoft 与 Samsung。

这次冲突跟软件合作没关系。OpenAI 正在自研 AI 硬件,苹果不想让自己积累的供应链经验被人带走。核心争的是谁能定义智能手机之后的新硬件形态。不过原文是一期播客文字稿,具体的法律主张和证据细节都没展开,现在只能看到诉讼动作,看不到实质内容。

DeepSeek 梁文锋四小时投资人会:不做产品、不追用户、不闭源

这条是今天信息密度最高的一条。梁文锋花了四个小时反复说“不”:不做消费级或企业级产品,不碰视频生成和世界模型,不追用户增长,不闭源,也不想成为下一个字节或腾讯。

他把产品、多模态和幻觉问题都归为支线任务,主线只有两个:编程智能体和通用智能体。在他看来,中美 AI 的差距本质是资源差距,他相信规模定律——模型做这么大不是因为够用,而是因为目前只有这么多资源。开源策略是主动放弃一部分价值,换取生态和人才。

这个定位在现在的 AI 圈很少见。大部分公司都在往产品和用户增长上靠,DeepSeek 反着来,把所有资源压在基础能力上。能不能走通不知道,但至少方向很清楚。

今日小信号

  • Google Gemini 月活冲到 9.5 亿,半年涨了 2 亿,离十亿俱乐部只差临门一脚。但 Google 没说是主动用还是被推送到产品里的“用户”,这个数字先打个折看。
  • DARPA 用现役 F-16 试飞 AI 操控,不是特制试验机,比之前 X-62A 狗斗演示更接近实战。但缺少架次和模型细节,可靠性还不好判断。
  • 北京发了十条智能体政策,把“驾驭层工程”、Token 经济和一人公司写进文件。但没给补贴金额和时间表,先当方向信号看。
  • 电影数据站 TheNumbers.com 被 AI 爬虫打崩,78,000 部电影的历史数据暂时全丢。创始人说 AI 爬虫和智能体流量占了总流量的 90%,服务器在持续重压下崩溃。这事给所有靠公开数据吃饭的网站提了个醒:AI 爬虫不是流量,是攻击。
  • 近 200 家硅谷创业公司联名请求特朗普政府不要封禁中国的开源 AI 模型,包括 Proton 和 Y Combinator。他们认为切断对月之暗面、阿里巴巴等公司公开模型参数的访问,会直接打击大量依赖这些模型做开发的美国创业公司。

更多

频道

后台