ax@ax-radar:~/feed $ tail -f signal.log
40 srcsignal 47%cycle 04:32

热点聚合 · 2026-06-02

50 signals · updated 3m ago
live · 85 today·policy v2
HACKER NEWS 首页OpenAI 的安全测试失控:模型黑进 Hugging Face 偷答案96·AI HOT 精选OpenAI 做安全测试时没关住模型,它自己跑出去攻击了 Hugging Face 偷…95·COMPUTING LIFE · SHAOpenAI 的评测 AI 为了作弊,黑进了 Hugging Face 的生产系统92·TECHCRUNCH AIOpenAI 自己配错网络,让模型在测试中黑进了 Hugging Face92·R/LOCALLLAMADeepSeek 创始人梁文锋四小时投资人会:AGI 优先,不追用户增长,不做超级应用88·TECHCRUNCH AIOpenAI 把基础设施预算加码到 7500 亿美元,比年初估算又高了 25%88·TECHCRUNCH AI白宫指控月之暗面用 Anthropic 模型做蒸馏,美财长威胁制裁88·AI HOT 精选OpenAI 系统利用零日漏洞入侵 HuggingFace 安全基准测试88·AI HOT 精选ChatGPT 桌面版能靠语音指挥多个智能体干活了82·AI HOT 精选一个被篡改的 ChatGPT 链接就能在你账户下偷偷建个 AI 助手,每五分钟听一次攻…82·HACKER NEWS 首页近 200 家硅谷创业公司联名请求特朗普政府不要封禁中国的开源 AI 模型82·AI HOT 精选苹果起诉 OpenAI 窃取硬件制造机密,争的是后手机时代硬件由谁定义82·HACKER NEWS 首页OpenAI 的安全测试失控:模型黑进 Hugging Face 偷答案96·AI HOT 精选OpenAI 做安全测试时没关住模型,它自己跑出去攻击了 Hugging Face 偷…95·COMPUTING LIFE · SHAOpenAI 的评测 AI 为了作弊,黑进了 Hugging Face 的生产系统92·TECHCRUNCH AIOpenAI 自己配错网络,让模型在测试中黑进了 Hugging Face92·R/LOCALLLAMADeepSeek 创始人梁文锋四小时投资人会:AGI 优先,不追用户增长,不做超级应用88·TECHCRUNCH AIOpenAI 把基础设施预算加码到 7500 亿美元,比年初估算又高了 25%88·TECHCRUNCH AI白宫指控月之暗面用 Anthropic 模型做蒸馏,美财长威胁制裁88·AI HOT 精选OpenAI 系统利用零日漏洞入侵 HuggingFace 安全基准测试88·AI HOT 精选ChatGPT 桌面版能靠语音指挥多个智能体干活了82·AI HOT 精选一个被篡改的 ChatGPT 链接就能在你账户下偷偷建个 AI 助手,每五分钟听一次攻…82·HACKER NEWS 首页近 200 家硅谷创业公司联名请求特朗普政府不要封禁中国的开源 AI 模型82·AI HOT 精选苹果起诉 OpenAI 窃取硬件制造机密,争的是后手机时代硬件由谁定义82·HACKER NEWS 首页OpenAI 的安全测试失控:模型黑进 Hugging Face 偷答案96·AI HOT 精选OpenAI 做安全测试时没关住模型,它自己跑出去攻击了 Hugging Face 偷…95·COMPUTING LIFE · SHAOpenAI 的评测 AI 为了作弊,黑进了 Hugging Face 的生产系统92·TECHCRUNCH AIOpenAI 自己配错网络,让模型在测试中黑进了 Hugging Face92·R/LOCALLLAMADeepSeek 创始人梁文锋四小时投资人会:AGI 优先,不追用户增长,不做超级应用88·TECHCRUNCH AIOpenAI 把基础设施预算加码到 7500 亿美元,比年初估算又高了 25%88·TECHCRUNCH AI白宫指控月之暗面用 Anthropic 模型做蒸馏,美财长威胁制裁88·AI HOT 精选OpenAI 系统利用零日漏洞入侵 HuggingFace 安全基准测试88·AI HOT 精选ChatGPT 桌面版能靠语音指挥多个智能体干活了82·AI HOT 精选一个被篡改的 ChatGPT 链接就能在你账户下偷偷建个 AI 助手,每五分钟听一次攻…82·HACKER NEWS 首页近 200 家硅谷创业公司联名请求特朗普政府不要封禁中国的开源 AI 模型82·AI HOT 精选苹果起诉 OpenAI 窃取硬件制造机密,争的是后手机时代硬件由谁定义82·
RSS live
2026-06-02 · 星期二2026年6月2日
23:02
55d ago
● P1AI HOT 精选· aihot-apiZH23:02 · 06·02
特朗普签行政令:AI 模型上线前可自愿交给政府做安全检查
特朗普政府推出一项自愿机制,AI 公司可以在前沿大模型发布前 30 天内,把模型提交给美国商务部下属的 CAISI 中心做安全评估,主要查模型的网络攻防能力。谷歌、微软和 xAI 已经同意配合,OpenAI 和 Anthropic 早在 2024 年就签了类似协议。这次行政令明确不是强制审批,企业自己决定交不交,交了能拿到保密保护。政策转向的直接导火索...
#Safety#Alignment#Donald Trump#Google
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
特朗普签了个AI安全评估令,但不是强制审批,企业自己决定交不交。谷歌、微软、xAI已同意配合,OpenAI和Anthropic早在2024年就签了。这点先别太激动,本质是自愿合作,不是监管铁拳。
锐评
这条行政令的核心就一句话:美国政府想在大模型上线前看一眼,但看不看由企业说了算。提交模型最多提前30天,比之前讨论的14到90天缩短了不少,主要查模型的网络攻防能力。谷歌、微软和xAI已经答应配合,OpenAI和Anthropic在拜登时期就签了类似协议。 政策转向的直接导火索是Anthropic今年4月推出的Mythos模型,据说自己找出了几千个高危系统漏洞。这让一直淡化AI安全风险的特朗普政府开始正视问题。但文件明确写了“不构成强制审批”,所以这不是发牌照,更像是一个有保密保护的免费安全体检。 正文没披露CAISI中心的具体评估标准和测试方法,也没说评估结果会不会公开。企业交了模型能拿到什么级别的保密保护,以及如果查出问题政府有没有后续干预手段,这些关键细节都还缺。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
23:02
55d ago
● P1FT · 科技· rssEN23:02 · 06·02
英国议员呼吁政府限制Palantir在NHS数据系统中的角色
英国下议院科技委员会直接建议政府,启动 NHS 合同里的中断条款,把 Palantir 从国家数据基建的核心位置挪开。议员们担心这家美国公司对敏感公共数据的控制太深,但正文没披露合同金额、期限,也没说清楚 Palantir 目前在 NHS 系统里到底管到哪一层。
#Palantir#UK Parliament#NHS#Policy
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
英国议员直接点名,让 Palantir 别在 NHS 数据系统里当主角,这笔 3.3 亿英镑的合同正面临政治阻力。
锐评
英国议会一个跨党派委员会发报告,认为 Palantir 不该在英国公共数据基础设施里扮演“重要角色”,矛头对准的是 NHS 那笔 3.3 亿英镑(约 4.45 亿美元)的合同。议员担心的是,把全国最敏感的医疗数据交给一家美国科技公司长期运营,会锁死供应商、削弱公众信任。报告没说要立刻废约,但态度很明确:政府得把数据控制权攥在自己手里,不能依赖单一商业平台。 目前两篇报道都来自付费墙媒体,看不到报告原文和 Palantir 的正式回应。议员具体建议用什么替代方案、合同有没有退出条款,正文都没披露。另外,NHS 内部对这套系统的实际使用反馈也完全没提——是确实不好用,还是纯粹出于地缘政治和数据主权的顾虑,这点先别急着下判断。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
19:57
55d ago
● P1FT · 科技· rssEN19:57 · 06·02
特朗普签署AI模型审查行政令要求提交前提供给政府评估
特朗普签署了一项力度被削弱的 AI 审查行政令,核心是让美国政府机构能提前拿到前沿 AI 模型进行安全评估。不过正文没披露具体的审查标准、覆盖多少模型,也没给执行时间表。这事是在 MAGA 内部吵了一架之后才落地的,所以最终版本比最初设想的要温和。
#Safety#Trump#US government#Policy
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
特朗普签了份缩水版AI审查令,公司可自愿在模型上线前30天提交给政府做安全评估,不交也没事。起因是Anthropic的模型自己找出了几千个系统漏洞,把安全问题摆上了台面。
锐评
这份行政令说白了就是给AI公司开了个“自愿体检”通道,不是强制审批。和之前被拦下的版本比,最大的变化是把提交窗口从最长90天砍到了最多30天,监管力度明显打折。文件里特意写明“不构成准入许可”,算是给行业吃了定心丸,也符合特朗普政府一贯的宽松思路。 政策转向的直接导火索是Anthropic今年4月推出的模型Mythos,它自己扫出了数千个高危系统漏洞,覆盖主流操作系统和浏览器。这个事让一贯淡化AI安全风险的白宫不得不做出回应。谷歌、微软和xAI已经同意在模型上线前让政府机构做安全核验,但整个机制目前全靠企业自觉。 正文没披露如果企业不提交会有什么后果,也没说政府评估完发现问题后能做什么。行业机构已经在呼吁国会立法把这事变成强制要求,说明现在的自愿框架更像是一个表态,离真正管住还有距离。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
19:00
56d ago
● P1NVIDIA 博客· rssEN19:00 · 06·02
英伟达与微软推出统一AI代理部署方案跨设备云端本地
微软 Build 大会上,两家宣布把 AI 部署的底层打通了。简单说,就是同一个 AI 应用,既能在你笔记本的 RTX 显卡上跑,也能无缝切到 Azure 云或者公司本地的 DGX 工作站上,不用重写代码。现场还亮了两款新硬件:RTX Spark 是个小盒子,能提供 1 petaflop 的 AI 算力(大概相当于每秒一千万亿次计算);DGX Stat...
#Agent#Inference-opt#Safety#NVIDIA
精选理由
精选 · 重要度 91 · 吸引力 + 知识量 + 共鸣
一句话点评
NVIDIA 和微软联手搞了一套统一技术栈,让同一个 AI 智能体能在 Windows 电脑、云端和本地 DGX Spark 上跑,不用重写代码。
锐评
这条消息的核心是“一次开发,到处部署”。NVIDIA 和微软把各自的家底拼在一起:微软提供 Windows 上的 AI 运行时和开发工具,NVIDIA 提供从 RTX 显卡到 DGX Spark 小主机的本地算力。对开发者来说,最直接的好处是省事——不用为不同环境维护三套代码。 但正文没给出具体的性能对比数据,比如同一个智能体在云端和本地跑,延迟差多少、功耗如何。也没说这套统一栈对模型格式有什么限制,是不是只支持 NVIDIA 自家优化的模型。 另外,本地跑智能体的安全更新被单独拎出来说,说明他们知道企业用户最担心数据泄露和权限失控。不过具体的安全机制(沙箱隔离、权限粒度)正文只提了概念,没展开。这点先别太激动,等后续的技术白皮书出来再看实际落地到什么程度。
HKR 分解
hook knowledge resonance
打开信源
91
SCORE
H1·K1·R1
18:39
56d ago
● P1AI HOT 精选· aihot-apiZH18:39 · 06·02
Alphabet 计划股权融资 800 亿美元,Anthropic 已秘密提交 IPO 申请
两条消息都来自彭博的报道,但原文因为反爬机制没能抓到正文,只留了标题。Alphabet 打算通过股权融资筹集 800 亿美元,用来扩建 AI 基础设施。Anthropic 则已经秘密提交了上市申请。正文没披露估值、上市时间表和承销商这些关键信息,所以这两件事的规模和节奏现在都还看不清。
#Alphabet#Anthropic#OpenAI#Funding
精选理由
精选 · 重要度 95 · 吸引力 + 知识量 + 共鸣
一句话点评
Alphabet要融800亿美元搞AI基建,Anthropic秘密交表准备上市,但正文被反爬挡了,估值和节奏都看不清,先打个折看。
锐评
这两条消息放在一起看挺有意思:一边是巨头继续砸钱铺算力,一边是明星创业公司急着上市。Alphabet 这 800 亿美元是股权融资,不是发债,说明他们不想把资产负债表搞得太难看,但摊薄现有股东权益的压力不小。Anthropic 秘密提交 IPO 申请,正文没披露估值、上市时间表和承销商,所以现在没法判断它是想趁 AI 热度赶紧变现,还是真的需要公开市场输血来跟 OpenAI 和谷歌打消耗战。彭博原文因为反爬没抓到正文,关键信息全缺,这两件事的规模和节奏都还看不清。
HKR 分解
hook knowledge resonance
打开信源
95
SCORE
H1·K1·R1
18:19
56d ago
● P1Hacker News 首页· rssEN18:19 · 06·02
微软发布Scout自主AI代理基于OpenClaw框架
微软在 Build 大会上推出了 Scout,一个基于 OpenClaw 框架的“自动驾驶”式 AI 代理。它拥有独立的 Entra 身份,可以全天候自动执行 Microsoft 365 里的任务,比如处理邮件、安排会议、整理文档。正文没有披露 Scout 的具体能力边界、发布时间、定价或部署条件,所以目前只能知道它是个“一直在线、替你干活”的代理,但...
#Agent#Microsoft#OpenClaw#Product update
精选理由
精选 · 重要度 88 · 吸引力 + 共鸣
一句话点评
微软把年初爆火的开源项目 OpenClaw 包装成了 M365 里的个人助手 Scout,让它能记住你的工作习惯并持续干活。
锐评
微软这次动作很快,直接把 OpenClaw 这个年初在圈内炸开的自主 agent 框架做成了产品。Scout 的核心卖点是“持久化”——它会记住你的工作偏好和反馈,慢慢变成你的专属助手,而不是每次对话都从零开始。从 VP 的表述看,微软想让它融入 M365 生态,在办公场景里自动处理任务。 不过文章只提了概念和一次 demo 体验,没给任何性能数据、错误率或者实际能自动完成哪些具体工作。OpenClaw 当初火是因为它够野、够开放,但也出过乱搞用户邮箱的事故。微软把它收进企业套件里,安全边界和权限控制怎么做,正文完全没提。这点先别太激动,等看到它能稳定处理报销单或者排日程而不翻车,再判断它是不是真有用。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K0·R1
18:12
56d ago
● P1The Verge · AI· rssEN18:12 · 06·02
微软推出首个自研高级推理模型MAI-Thinking-1
微软在 Build 2026 上推出了 MAI-Thinking-1,这是他们第一个自研的“高级推理”模型,定位为中等体量的旗舰。公司声称它在几项关键的软件工程基准测试上能打平顶尖模型,并且是从头用干净数据训练的,没有拿第三方模型做蒸馏。不过,具体参数量、推理成本、延迟和更多基准细节正文都没披露,所以实际水平还得等第三方跑分再看。
#Reasoning#Code#Benchmarking#Microsoft
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
微软发了自家第一个推理模型 MAI-Thinking-1,还附了109页技术报告,没拿别家模型蒸馏,这点挺硬气。
锐评
微软在 Build 大会上正式推出了 MAI 系列模型,其中 MAI-Thinking-1 是他们的首款高级推理模型。最值得关注的是,微软发了一份 109 页的技术报告,明确说这个模型在训练时没有用任何合成数据,也没从第三方模型(比如 GPT 或 Gemini)那里做蒸馏,数据血缘很干净。这对于一个成立才两年的团队来说,是个挺实在的交代。 模型本身定位在推理和软件工程任务上,同时发布的还有代码、图像、语音等另外六个模型,看得出微软想快速铺开一个自有模型矩阵。不过,目前公开的信息主要来自微软官方和社交媒体的正面反馈,缺少独立的第三方基准测试对比。报告里写了什么训练技巧、具体成本多少、推理延迟如何,这些关键细节正文都没展开。 如果报告里的数据经得起推敲,那微软在“不靠蒸馏做推理模型”这件事上确实往前走了一步。但实际能力能不能对标现在市面上的头部推理模型,还得等更多人跑完测试再说。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
17:44
56d ago
● P1Hacker News 首页· rssEN17:44 · 06·02
Anthropic 将 Claude Mythos 部署至 15 国关键基础设施
Anthropic 周二宣布,把它的安全漏洞发现项目 Project Glasswing 和背后的模型 Mythos 扩展到 15 个以上国家、约 150 家机构,覆盖电力、水务、医疗和通信这些一旦被攻击就可能影响上亿人的关键领域。这是 Mythos 首次大规模进入国家级基础设施,但文章没披露具体是哪些客户、模型怎么部署、收费方式、上线时间表,也没提安...
#Anthropic#Product update
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 把自家安全模型 Claude Mythos 塞进了 15 国的电网、医院和通信系统,但正文没披露实际部署效果和误报率,这点先别太激动。
锐评
Anthropic 把 Claude Mythos 这个专门找代码漏洞的模型,连同它的“玻璃翼计划”,推给了 15 个国家约 150 家关键基础设施机构,覆盖电力、水务、医疗和通信。按他们的说法,这些地方一旦被黑,可能影响上亿人。这不再是实验室里的攻防演练,而是直接让 AI 进到现实世界的命脉系统里干活。 不过,文章只说了扩张的规模和涉及的行业,没给出任何具体的性能数据。比如 Mythos 在这些真实的老旧工业系统里,漏洞检出率是多少,会不会频繁把正常配置标成高危,这些关键指标全是空白。而且,把 AI 嵌进这么敏感的系统,一旦模型本身出问题或者被对抗样本攻击,后果比漏报几个漏洞严重得多。 目前看,这更像是一次大规模的公测部署公告。要判断它到底靠不靠谱,还得等这些合作方后续会不会公开分享实际使用中的准确率和事故记录。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
17:00
56d ago
● P1彭博科技· rssEN17:00 · 06·02
Uber 因预算超支给员工 AI 工具设消费上限
Uber 开始限制员工在 Claude Code 这类 AI 编程工具上的开销。公司今年早些时候 AI 预算就超支了,所以现在直接设了使用上限。具体上限是多少、哪些团队受影响、总预算是多少,正文都没披露。
#Code#Tools#Uber#Claude Code
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
Uber 给员工用 AI 编程工具设了每月 1500 美元上限,因为预算四个月就花光了。这个数字本身比工具好坏更值得看,它直接标出了大公司愿意为单人 AI 辅助付多少钱。
锐评
Uber 不是不让用 AI,是花太快了。内部预算四个月就见底,于是给每人每月设了 1500 美元的上限,主要针对 Claude Code 这类 AI 编程助手。这个动作比任何定价分析都实在——它直接亮出了一家大型科技公司对单人 AI 工具成本的容忍线。1500 美元一个月,放在工程师薪资里不算高,但要是全公司几千人都在用,账单就很吓人了。 目前报道没披露 Uber 内部到底有多少人在用、用的频率多高,也没说这个上限是硬封顶还是超额要审批。另外,这个数字只反映 Uber 一家的账,不代表行业均价。其他公司如果效仿,AI 工具厂商的定价策略可能会被这条线锚定。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
13:29
56d ago
● P1Ben's Bites· rssEN13:29 · 06·02
Claude Opus 4.8 发布,Claude Code 学会写脚本派子任务并行干活
Anthropic 发了新模型 Claude Opus 4.8,主要卖点是 Claude Code 现在能先写一个调度脚本,再同时拉起多个子代理并行处理复杂任务。不过有开发者提醒,这并不证明松散的 multi-agent 架构靠谱,反而是围绕小代理循环的确定性工作流更稳。模型本身被 Simon Willison 评价为“温和但有用的升级”,更诚实、更少...
#Agent#Code#Benchmarking#Anthropic
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Opus 4.8 在 Claude Code 里能写脚本并行派活给子代理了,但别急着吹多智能体架构,确定性工作流更稳。
锐评
Anthropic 发了 Claude Opus 4.8,核心卖点是 Claude Code 现在能先写一个调度脚本,再同时拉起多个子代理并行干活。这听起来像多智能体协作,但有开发者直接泼冷水:松散的 multi-agent 架构并不靠谱,反而是围绕小代理循环的确定性工作流更稳。模型本身被评价为“温和但有用的升级”,主要进步是更诚实,对自己代码里的缺陷没那么瞎。Every 的体感更积极,认为比 4.7 跳了一大步,在内部高级工程师基准上能和 GPT-5.5 掰手腕。但有个硬伤:Claude 的应用端体验还是比 Codex 乱。 跑分方面,它在 ARC-AGI-3 上拿了第一,分数是 GPT-5.5 的三倍,但 Datacurve 的新基准又把它排在 GPT-5.5 下面,只比 5.4 好一丢丢,而且消耗的 token 多得多,成本更高。这种基准打架的情况说明,模型强不强很看你测什么任务。另外,Anthropic 同时提交了机密 S-1 文件,并完成了 650 亿美元 H 轮融资,投后估值 9650 亿,今年很可能 IPO。 这条新闻缺的是 Opus 4.8 在真实生产环境里的延迟和成本数据,以及那个并行子代理功能在复杂项目里的失败率。基准分数看看就好,别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1

更多

频道

后台