ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-06-02

50 items · updated 3m ago
RSS live
2026-06-02 · 星期二2026年6月2日
23:55
55d ago
Hacker News 首页· rssEN23:55 · 06·02
AXA报告:超六成人用AI做心理支持
AXA发布2026年心理健康报告,标题称超过60%的人会找AI做心理支持。这个数字来自一份全球调查,但正文没披露样本量、覆盖了哪些国家、以及具体怎么问的,所以可信度要打个问号。报告同时提到屏幕使用对心理健康有负面影响,但没展开说AI支持的效果如何——是聊天机器人、情绪追踪App还是别的形式?这点先别太激动,等完整报告出来再看细节。
#Safety#AXA#Commentary
一句话点评
AXA 报告称超六成人用 AI 做心理支持,但正文没披露样本量、覆盖国家和具体问题,可信度打折。屏幕对心理的负面影响是老生常谈,AI 支持的具体形式(聊天机器人、情绪追踪 App?)和效果都没展开。等完整报告再看,别急着信。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
23:54
55d ago
彭博科技· rssEN23:54 · 06·02
贝莱德基金经理:AI 正在引发一轮资本开支热潮
贝莱德投资组合经理 Jeffrey Rosenberg 在彭博纽约订阅者活动上说,AI 正在驱动一轮资本开支 boom,并产生财富效应。正文没披露具体投入规模、行业分布或时间跨度,所以这个判断目前更像一个方向性观点,缺少数据支撑。
#Jeffrey Rosenberg#BlackRock#Bloomberg#Commentary
一句话点评
贝莱德经理 Rosenberg 说 AI 正在引发资本开支 boom 和财富效应。但正文没披露具体投入规模、行业分布或时间跨度,目前更像一个方向性观点,缺少数据支撑。
HKR 分解
hook knowledge resonance
打开信源
43
SCORE
H0·K0·R1
23:43
55d ago
Hacker News 首页· rssEN23:43 · 06·02
斯坦福法学院研究:AI 表现超过法学教授
斯坦福法学院发布了一项研究,标题说 AI 在某个任务上比法学教授表现更好。但正文只给了 46 个点赞和 31 条评论,没交代具体任务、用了什么模型、样本量多大、怎么评估的。所以这个结论目前只是个标题,缺少支撑细节,先别急着下判断。
#Benchmarking#Stanford Law#Benchmark#Research release
一句话点评
标题说斯坦福法学院研究发现AI在某个任务上比法学教授表现更好,但正文只给了46个点赞和31条评论,没交代具体任务、用了什么模型、样本量多大、怎么评估的。结论目前只是个标题,缺少支撑细节,先别急着下判断。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
23:02
55d ago
● P1AI HOT 精选· aihot-apiZH23:02 · 06·02
特朗普签行政令:AI 模型上线前可自愿交给政府做安全检查
特朗普政府推出一项自愿机制,AI 公司可以在前沿大模型发布前 30 天内,把模型提交给美国商务部下属的 CAISI 中心做安全评估,主要查模型的网络攻防能力。谷歌、微软和 xAI 已经同意配合,OpenAI 和 Anthropic 早在 2024 年就签了类似协议。这次行政令明确不是强制审批,企业自己决定交不交,交了能拿到保密保护。政策转向的直接导火索...
#Safety#Alignment#Donald Trump#Google
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
特朗普签了个AI安全评估令,但不是强制审批,企业自己决定交不交。谷歌、微软、xAI已同意配合,OpenAI和Anthropic早在2024年就签了。这点先别太激动,本质是自愿合作,不是监管铁拳。
锐评
这条行政令的核心就一句话:美国政府想在大模型上线前看一眼,但看不看由企业说了算。提交模型最多提前30天,比之前讨论的14到90天缩短了不少,主要查模型的网络攻防能力。谷歌、微软和xAI已经答应配合,OpenAI和Anthropic在拜登时期就签了类似协议。 政策转向的直接导火索是Anthropic今年4月推出的Mythos模型,据说自己找出了几千个高危系统漏洞。这让一直淡化AI安全风险的特朗普政府开始正视问题。但文件明确写了“不构成强制审批”,所以这不是发牌照,更像是一个有保密保护的免费安全体检。 正文没披露CAISI中心的具体评估标准和测试方法,也没说评估结果会不会公开。企业交了模型能拿到什么级别的保密保护,以及如果查出问题政府有没有后续干预手段,这些关键细节都还缺。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
23:02
55d ago
● P1FT · 科技· rssEN23:02 · 06·02
英国议员呼吁政府限制Palantir在NHS数据系统中的角色
英国下议院科技委员会直接建议政府,启动 NHS 合同里的中断条款,把 Palantir 从国家数据基建的核心位置挪开。议员们担心这家美国公司对敏感公共数据的控制太深,但正文没披露合同金额、期限,也没说清楚 Palantir 目前在 NHS 系统里到底管到哪一层。
#Palantir#UK Parliament#NHS#Policy
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
英国议员直接点名,让 Palantir 别在 NHS 数据系统里当主角,这笔 3.3 亿英镑的合同正面临政治阻力。
锐评
英国议会一个跨党派委员会发报告,认为 Palantir 不该在英国公共数据基础设施里扮演“重要角色”,矛头对准的是 NHS 那笔 3.3 亿英镑(约 4.45 亿美元)的合同。议员担心的是,把全国最敏感的医疗数据交给一家美国科技公司长期运营,会锁死供应商、削弱公众信任。报告没说要立刻废约,但态度很明确:政府得把数据控制权攥在自己手里,不能依赖单一商业平台。 目前两篇报道都来自付费墙媒体,看不到报告原文和 Palantir 的正式回应。议员具体建议用什么替代方案、合同有没有退出条款,正文都没披露。另外,NHS 内部对这套系统的实际使用反馈也完全没提——是确实不好用,还是纯粹出于地缘政治和数据主权的顾虑,这点先别急着下判断。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
22:50
55d ago
TechCrunch AI· rssEN22:50 · 06·02
数据安全公司 Cyera 估值 120 亿美元,ARR 倍数高达 80 倍,但仍在亏损
Cyera 正在敲定一轮至少 3 亿美元的融资,由 Evolution Equity Partners 领投,估值 120 亿美元。这个估值对应的是 80 倍的年经常性收入(ARR),比很多高速增长的 AI 创业公司还贵。但公司还没盈利,花钱比赚钱快——今年已经新招了 500 个销售。正文没披露具体亏损金额和融资条款,Cyera 发言人说这些数字“严重...
#Cyera#Evolution Equity Partners#Funding
一句话点评
网络安全公司 Cyera 正以 80 倍 ARR 的估值融资 3 亿美元,比多数 AI 公司还贵。但公司仍在亏损,今年新招 500 名销售,烧钱速度不低。正文没披露具体 ARR 和亏损金额,这个倍数是否合理得看实际收入规模。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
22:42
55d ago
r/LocalLLaMA· rssEN22:42 · 06·02
本地RAG做网页抓取,哪个搜索API返回的Markdown最干净?
Reddit用户对比了7个搜索API(Brave Search、Parallel AI、You.com、Exa、Tavily、Firecrawl/Jina Reader、SearXNG)在本地RAG场景下返回Markdown的干净程度。核心需求是:抓回来的网页内容直接转成Markdown,省去自己清洗HTML的麻烦。帖子只列了选项,没披露每个API的实...
#RAG#Tools#Agent#Brave Search
一句话点评
Reddit 用户对比了 7 个搜索 API(Brave Search、Parallel AI、You.com 等)在本地 RAG 场景下返回 Markdown 的干净程度,核心需求是省去自己清洗 HTML 的麻烦。帖子只列了选项,没披露每个 API 的实际延迟、定价或信噪比结果,所以只能当个选型清单看,不能直接抄作业。如果你也在搭本地 RAG 的搜索管道,可以拿这个列表去逐个测,但别指望它...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R1
22:34
55d ago
Hacker News 首页· rssEN22:34 · 06·02
Paseo:一个开源、跨端的编程助手界面,手机、桌面、命令行都能用
Paseo 是一个开源的编程助手界面,主打“好看”和跨端——你可以在手机、桌面甚至命令行里跑同一个 coding agent。GitHub 上目前 7.2k star、701 fork,热度不低。但它本质上只是一个前端壳,不包含模型本身,你需要自己接后端模型(比如 GPT、Claude 或本地模型)。正文没披露它支持哪些模型协议、怎么定价、安装门槛多高...
#Agent#Code#Tools#Paseo
一句话点评
Paseo 是个开源的编程助手前端壳,主打手机、桌面、命令行都能跑同一个 agent,GitHub 7.2k star 热度不低。但它不包含模型,你得自己接 GPT、Claude 或本地模型。正文没披露支持哪些模型协议、安装门槛多高,这点先别太激动。短评:好看跨端的前端壳,但模型和协议全靠自己接,信息缺口大。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
22:00
55d ago
NVIDIA 博客· rssEN22:00 · 06·02
NVIDIA 发布 NemoClaw:让工业软件长出“安全自主的 AI 工程师”
NVIDIA 在 GTC 台北上展示了 NemoClaw,一个能让 AI 模型像安全的长跑代理一样,自动跑通 CAE(计算机辅助工程)和 EDA(电子设计自动化)工作流的框架。Cadence 用它演示了 RTL 验证——一个原本需要几周的芯片数字电路设计关键步骤,现在缩短到几小时。说白了,就是让模型进业务流程干活,而且能长时间稳定运行,不出安全岔子。
#Agent#Tools#Code#NVIDIA
一句话点评
Nvidia 在 GTC 台北推 NemoClaw,让模型当安全长跑代理,自动跑 CAE/EDA 流程。Cadence 演示 RTL 验证,从几周缩到几小时——这点先别太激动,演示场景可能挑过。框架开源,但正文没披露跑一个任务要多少算力、成本多高。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
21:35
55d ago
AI HOT 精选· aihot-apiZH21:35 · 06·02
Anthropic表态支持美国AI行政令
Anthropic发帖说支持一项美国AI行政令,并期待与白宫合作推进实施。但正文没披露行政令的具体条款、落地时间表,也没说Anthropic具体承诺了什么——比如是否涉及模型安全测试、出口管制或算力分配。目前只能确认这是一次公开站队,实际动作和影响还不清楚。
#Safety#Anthropic#White House#Policy
一句话点评
Anthropic公开站队支持一项美国AI行政令,但全文没提具体条款、落地时间或自家承诺了什么——比如是否涉及安全测试、出口管制或算力分配。目前只能确认是表态,实际动作和影响都不清楚。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R1
21:33
55d ago
r/LocalLLaMA· rssEN21:33 · 06·02
你的 AI 代理用哪种记忆系统?Reddit 上在聊这五个
一位 Reddit 用户在 LocalLLaMA 版发帖,问大家给自己的 AI 代理(agent)配了什么记忆系统。帖子里点名了五个方案:Claude Code、Hermes、OpenClaw、Memo0 和 Supermemory。不过正文没披露任何基准测试、架构细节、价格或实测效果,所以这更像一份候选名单,不是评测。如果你在选记忆方案,可以先拿这五...
#Agent#Memory#Tools#Claude
一句话点评
Reddit 用户问大家给 agent 配了什么记忆系统,点名 Claude Code、Hermes、OpenClaw、Memo0、Supermemory。正文被墙,没披露任何基准、架构、价格或实测效果,所以这只是一份候选名单,不是评测。如果你在选记忆方案,可以先拿这五个去试,但别当结论用。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K0·R1
21:14
55d ago
彭博科技· rssEN21:14 · 06·02
NYU 教授 Gary Marcus:今天美国 AI 政策迎来转折点
Gary Marcus(NYU 荣休教授、Robust.AI 和 Geometric.AI 创始人)在 Bloomberg 节目上说,美国刚签了一份 AI 监管行政令,跟前一届政府“放手不管”的态度完全相反。正文没披露这份行政令的具体条款、签署日期、怎么执行、哪个部门负责,所以目前只能听 Marcus 的个人判断,没法验证力度。
#Safety#Gary Marcus#NYU#Robust.AI
一句话点评
Gary Marcus 说美国刚签了一份 AI 监管行政令,跟前届政府放手不管的态度完全相反。但正文没披露具体条款、签署日期和执行部门,目前只能听 Marcus 个人判断,没法验证力度。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K0·R1
21:00
55d ago
彭博科技· rssEN21:00 · 06·02
马桶公司 Toto 加钱扩产陶瓷件,AI 芯片厂是它新客户
做马桶的 Toto 说未来几年资本开支里一半以上会花在芯片相关业务上,因为 AI 芯片厂需要它的精密陶瓷零件。正文没披露具体是什么陶瓷件、客户是谁、到底投多少钱,但一家传统卫浴厂把 AI 硬件当成增长点,这个转向本身值得留意。
#Toto Ltd.#Bloomberg#Product update
一句话点评
做马桶的Toto宣布未来几年资本开支一半以上砸向AI芯片用的精密陶瓷零件。正文没披露具体是什么陶瓷件、客户是谁、投多少钱,但一家传统卫浴厂把AI硬件当增长点,这个转向本身值得留意。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
20:41
55d ago
彭博科技· rssEN20:41 · 06·02
马斯克盟友出钱,前政府效率部员工想用AI帮企业砍成本
两位前美国政府效率部(DOGE)员工出来创业,计划收购公司后用AI来削减浪费。马斯克那边的人给了钱,但正文没披露具体金额、投资方名字、目标公司是谁,也没说AI到底怎么个砍法——是审计发票、优化供应链还是自动裁员,一概没提。目前能确认的就一个方向:用AI降本,但具体路径和验证都还缺,这点先别太激动。
#Department of Government Efficiency#Elon Musk#Funding
一句话点评
前DOGE员工拿马斯克系的钱创业,计划收购公司后用AI砍成本。但正文没披露投了多少、谁投的、要买谁、AI具体怎么砍——是审发票还是优化供应链?一概没提。目前能确认的就一个方向,路径和验证都缺,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
20:32
55d ago
彭博科技· rssEN20:32 · 06·02
三星靠AI芯片大笔奖金避免罢工,引发韩国科技行业财富分配争议
三星给芯片部门发了巨额AI奖金,才避免了一场可能瘫痪生产的罢工。但正文没披露具体发了多少钱、覆盖了多少员工、按什么标准分。这笔钱来自AI芯片需求带来的利润暴涨,但其他部门员工没份,已经在韩国科技圈引发公平性质疑。
#Samsung#Policy#Personnel
一句话点评
三星靠AI芯片利润暴涨给芯片部门发巨额奖金,才避免了一场罢工。但正文没披露发了多少钱、覆盖多少人、按什么标准分。其他部门员工没份,已在韩国科技圈引发公平性质疑。这笔钱来自AI需求,不是管理改革,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
20:15
55d ago
AI HOT 精选· aihot-apiZH20:15 · 06·02
NVIDIA DGX Station 开始发货,GB300 桌面级 AI 工作站来了
NVIDIA 的 DGX Station 桌面 AI 工作站开始向开发者和研究人员发货,搭载 GB300 芯片,性能对标数据中心级。华硕、戴尔、技嘉、惠普、微星和超微等厂商同步出货。这意味着你可以在办公桌上跑大模型训练或推理,不用再挤云端排队。不过正文没披露具体价格和配置细节,想买的话得等各家厂商公布。
#Inference-opt#NVIDIA#ASUS#Dell
一句话点评
NVIDIA DGX Station 开始发货,把数据中心级的 GB300 塞进桌面,华硕、戴尔等六家同步出货。对开发者来说,本地跑大模型训练或推理不用再挤云端排队,延迟更低、数据也更安全。但正文没披露价格和具体配置,参考上一代 DGX Station 要数万美元,这次大概率不便宜,个人开发者先别激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
20:10
55d ago
彭博科技· rssEN20:10 · 06·02
CoreWeave 关联数据中心靠垃圾债筹了 9 亿美元
一个跟 CoreWeave 绑定的数据中心通过发行高收益债(也就是垃圾债)融了 9 亿美元,用来建 AI 基础设施。9 亿不是小数目,说明建算力中心烧钱速度还在加速。但正文没披露具体发债主体是谁、债券期限多长、票面利率多少,也没说数据中心建在哪——这些细节对判断这笔债划不划算很关键。
#CoreWeave#Funding
一句话点评
CoreWeave 关联数据中心发垃圾债融了 9 亿美元,用来建 AI 算力。9 亿不是小数目,说明建算力中心烧钱速度还在加速。但正文没披露发债主体是谁、债券期限多长、票面利率多少,也没说数据中心建在哪——这些细节对判断这笔债划不划算很关键。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
20:00
55d ago
Product Hunt · AI· rssEN20:00 · 06·02
Devin Desktop:一个界面管一群本地和云端AI编程助手
Cognition 给他们的 AI 程序员 Devin 出了个桌面端,叫 Devin Desktop。核心卖点是一个界面同时管理多个本地和云端的 AI 编程 agent(让模型进业务流程干活),从规划、分配任务到审查代码和发布,不用离开编辑器。Devin 之前在 SWE-Bench 编程测试上拿了最高分,还通过了头部 AI 公司的面试,甚至真在 Upw...
#Agent#Tools#Devin#Cognition
一句话点评
Devin 出了桌面端,一个界面管多个本地和云端的 AI 编程 agent,从分配任务到审查代码都能干,不用切编辑器。它之前在 SWE-Bench 拿过最高分,还通过了头部 AI 公司面试。但这次发布没提价格、上线时间和最多能管多少个 agent,这些信息缺口让实际可用性打折扣。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
19:59
55d ago
AI HOT 精选· aihot-apiZH19:59 · 06·02
Claude Code 自查闭环:把人工检查写成代码,让模型自己改
这条推文讲的是让 Claude Code 在交活前先自我检查,方法是把你平时手动检查的步骤写成代码,让模型自己跑一遍反馈循环。正文没披露具体步骤、示例、参数或可复现条件,所以目前只是一个思路方向,没有实操细节。
#Code#Agent#Tools#Claude
一句话点评
思路不错,把人工检查步骤写成代码让模型自检。但正文没给任何具体步骤、示例或参数,目前只是个方向,别当教程用。
HKR 分解
hook knowledge resonance
打开信源
38
SCORE
H0·K0·R1
19:57
55d ago
● P1FT · 科技· rssEN19:57 · 06·02
特朗普签署AI模型审查行政令要求提交前提供给政府评估
特朗普签署了一项力度被削弱的 AI 审查行政令,核心是让美国政府机构能提前拿到前沿 AI 模型进行安全评估。不过正文没披露具体的审查标准、覆盖多少模型,也没给执行时间表。这事是在 MAGA 内部吵了一架之后才落地的,所以最终版本比最初设想的要温和。
#Safety#Trump#US government#Policy
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
特朗普签了份缩水版AI审查令,公司可自愿在模型上线前30天提交给政府做安全评估,不交也没事。起因是Anthropic的模型自己找出了几千个系统漏洞,把安全问题摆上了台面。
锐评
这份行政令说白了就是给AI公司开了个“自愿体检”通道,不是强制审批。和之前被拦下的版本比,最大的变化是把提交窗口从最长90天砍到了最多30天,监管力度明显打折。文件里特意写明“不构成准入许可”,算是给行业吃了定心丸,也符合特朗普政府一贯的宽松思路。 政策转向的直接导火索是Anthropic今年4月推出的模型Mythos,它自己扫出了数千个高危系统漏洞,覆盖主流操作系统和浏览器。这个事让一贯淡化AI安全风险的白宫不得不做出回应。谷歌、微软和xAI已经同意在模型上线前让政府机构做安全核验,但整个机制目前全靠企业自觉。 正文没披露如果企业不提交会有什么后果,也没说政府评估完发现问题后能做什么。行业机构已经在呼吁国会立法把这事变成强制要求,说明现在的自愿框架更像是一个表态,离真正管住还有距离。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
19:48
55d ago
FT · 科技· rssEN19:48 · 06·02
英国科技大臣被曝在AI演讲前按游说公司建议改口风
FT报道称,英国科技大臣Kyle在发表AI相关演讲前,接受了曼德尔森的建议,加入了“更积极的语言”。问题在于曼德尔森旗下的咨询公司同时代理多家大型AI公司,存在利益冲突嫌疑。正文目前被FT的付费墙挡住,没有披露具体涉及哪些公司、修改了多少处措辞、以及原始讲稿长什么样。
#Kyle#Mandelson#Financial Times#Policy
一句话点评
英国科技大臣Kyle在AI演讲前听了曼德尔森的建议,把措辞改得更积极。问题在于曼德尔森的咨询公司同时代理多家大型AI公司,这就有利益冲突嫌疑了。FT的报道被付费墙挡住,正文没披露具体涉及哪些公司、改了多少处、原始讲稿什么样。信息缺口很大,目前只能看到标题和摘要,没法判断修改幅度和实质影响。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
19:36
55d ago
AI HOT 精选· aihot-apiZH19:36 · 06·02
OpenRouter 上架微软三款新模型:图像、语音、转录
OpenRouter 今天上架了三款微软模型:MAI-Image-2.5(图像生成)、MAI-Transcribe-1.5(语音转文字)和 MAI-Voice-2(语音合成)。目前正文没披露定价、速率限制或使用条件,所以暂时没法判断性价比。如果你已经在用 OpenRouter 做多模型路由,可以试试看,但先别急着切流量——等具体价格和限速出来再说。
#Multimodal#Vision#Audio#OpenRouter
一句话点评
OpenRouter 上架了三款微软新模型:图像生成、语音转文字、语音合成。但正文没披露定价和速率限制,没法判断性价比。如果你在用 OpenRouter 做多模型路由,可以试试,但先别急着切流量——等具体价格和限速出来再说。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
19:26
55d ago
AI HOT 精选· aihot-apiZH19:26 · 06·02
Replit 与微软合作,应用可直接发布到 Fabric
Replit 宣布与微软合作,企业用户现在可以在 Replit 里搭建内部工具、工作流或数据看板,然后一键发布到微软的 Fabric 平台,自带安全、登录和权限管理。正文没披露定价和上线时间。
#Tools#Replit#Microsoft#Product update
一句话点评
Replit 和微软合作,让企业用户在 Replit 里搭内部工具、工作流或数据看板,然后一键发布到微软 Fabric 平台,自带安全、登录和权限管理。这对用微软生态的企业挺方便,省去自己部署和对接的麻烦。但正文没披露定价和上线时间,实际成本未知,而且 Fabric 本身有学习门槛,小团队可能用不上。短评:省掉部署对接,但定价和门槛未知。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R0
19:11
56d ago
AI HOT 精选· aihot-apiZH19:11 · 06·02
OpenAI Codex 推出团队专属插件
OpenAI 给 Codex 加了三个团队插件:数据分析、创意制作和产品设计,说是能直接生成报告、创意方向和原型。但正文没披露定价、上线时间或 API 细节,所以目前只能当个功能预告看。
#Code#Tools#OpenAI#Product update
一句话点评
OpenAI Codex 新增三个团队插件:数据分析、创意制作、产品设计,能直接生成报告、创意方向和原型。但正文没披露定价、上线时间或 API 细节,目前只能当功能预告看。短评:三个插件名听着像把现有能力打包,没新模型或架构变化,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
19:02
56d ago
AI HOT 精选· aihot-apiZH19:02 · 06·02
微软开源 ASSERT:写一句话就能生成 AI 行为测试
微软开源了一个叫 ASSERT 的框架,开发者用自然语言描述想要的行为,就能自动生成对应的评估测试。比如你想测“客服模型不能顺着用户骂人”,写一句描述就行,不用手写测试用例。这能省掉不少写评估脚本的功夫,但正文没披露它支持哪些模型、跑一次要多少算力、以及生成的测试集有多大——所以实际好不好用还得看实测。
#Benchmarking#Tools#Microsoft#Open source
一句话点评
微软开源了 ASSERT,开发者用自然语言描述就能自动生成 AI 行为测试,比如写一句“客服不能顺着用户骂人”就能出测试用例,省掉手写脚本的功夫。但正文没披露支持哪些模型、跑一次要多少算力、生成的测试集有多大——实际好不好用还得看实测。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
19:00
56d ago
● P1NVIDIA 博客· rssEN19:00 · 06·02
英伟达与微软推出统一AI代理部署方案跨设备云端本地
微软 Build 大会上,两家宣布把 AI 部署的底层打通了。简单说,就是同一个 AI 应用,既能在你笔记本的 RTX 显卡上跑,也能无缝切到 Azure 云或者公司本地的 DGX 工作站上,不用重写代码。现场还亮了两款新硬件:RTX Spark 是个小盒子,能提供 1 petaflop 的 AI 算力(大概相当于每秒一千万亿次计算);DGX Stat...
#Agent#Inference-opt#Safety#NVIDIA
精选理由
精选 · 重要度 91 · 吸引力 + 知识量 + 共鸣
一句话点评
NVIDIA 和微软联手搞了一套统一技术栈,让同一个 AI 智能体能在 Windows 电脑、云端和本地 DGX Spark 上跑,不用重写代码。
锐评
这条消息的核心是“一次开发,到处部署”。NVIDIA 和微软把各自的家底拼在一起:微软提供 Windows 上的 AI 运行时和开发工具,NVIDIA 提供从 RTX 显卡到 DGX Spark 小主机的本地算力。对开发者来说,最直接的好处是省事——不用为不同环境维护三套代码。 但正文没给出具体的性能对比数据,比如同一个智能体在云端和本地跑,延迟差多少、功耗如何。也没说这套统一栈对模型格式有什么限制,是不是只支持 NVIDIA 自家优化的模型。 另外,本地跑智能体的安全更新被单独拎出来说,说明他们知道企业用户最担心数据泄露和权限失控。不过具体的安全机制(沙箱隔离、权限粒度)正文只提了概念,没展开。这点先别太激动,等后续的技术白皮书出来再看实际落地到什么程度。
HKR 分解
hook knowledge resonance
打开信源
91
SCORE
H1·K1·R1
18:51
56d ago
Hacker News 首页· rssEN18:51 · 06·02
Rudus:给混凝土分包商用的 AI 算量报价平台
Rudus 是 YC P26 期项目,专门帮混凝土分包商做图纸算量和报价。传统做法是资深估算师打开 PDF,手动描图、算量、填 Excel,一个标可能要花几周甚至几个月。Rudus 上传结构 PDF 后自动分类图纸页(基础平面、节点详图、配筋表等),用计算机视觉识别混凝土构件,还能跨图纸页追踪尺寸和标注,把一套基础图纸展开成 80–120 条带价格的清...
#Vision#Tools#Rudus#Y Combinator
一句话点评
Rudus 专攻混凝土分包商的图纸算量,把一套基础图纸自动展开成 80–120 条带价清单,比传统手动描图快很多。亮点是只做混凝土这一个细分,用计算机视觉跨图纸页追踪尺寸,而不是像通用 AI 工具那样只当个复选框。但正文没披露准确率或实测对比,只说“多个模型”靠客户数据训练,验证强度未知。短评:细分场景选得准,但精度和落地效果还得看实测。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
18:39
56d ago
● P1AI HOT 精选· aihot-apiZH18:39 · 06·02
Alphabet 计划股权融资 800 亿美元,Anthropic 已秘密提交 IPO 申请
两条消息都来自彭博的报道,但原文因为反爬机制没能抓到正文,只留了标题。Alphabet 打算通过股权融资筹集 800 亿美元,用来扩建 AI 基础设施。Anthropic 则已经秘密提交了上市申请。正文没披露估值、上市时间表和承销商这些关键信息,所以这两件事的规模和节奏现在都还看不清。
#Alphabet#Anthropic#OpenAI#Funding
精选理由
精选 · 重要度 95 · 吸引力 + 知识量 + 共鸣
一句话点评
Alphabet要融800亿美元搞AI基建,Anthropic秘密交表准备上市,但正文被反爬挡了,估值和节奏都看不清,先打个折看。
锐评
这两条消息放在一起看挺有意思:一边是巨头继续砸钱铺算力,一边是明星创业公司急着上市。Alphabet 这 800 亿美元是股权融资,不是发债,说明他们不想把资产负债表搞得太难看,但摊薄现有股东权益的压力不小。Anthropic 秘密提交 IPO 申请,正文没披露估值、上市时间表和承销商,所以现在没法判断它是想趁 AI 热度赶紧变现,还是真的需要公开市场输血来跟 OpenAI 和谷歌打消耗战。彭博原文因为反爬没抓到正文,关键信息全缺,这两件事的规模和节奏都还看不清。
HKR 分解
hook knowledge resonance
打开信源
95
SCORE
H1·K1·R1
18:34
56d ago
r/LocalLLaMA· rssEN18:34 · 06·02
有人在本地跑过 MiMo-2.5 写代码吗?
Reddit 用户用 AesSedai--MiMo-V2.5-GGUF--IQ3_S 量化版在 llamacpp 上跑代码,结果模型很快就进入死循环。试了官方推荐参数和 qwen36-27b 风格参数都不行。正文没披露具体硬件配置和量化精度对结果的影响,所以这个失败案例的参考价值有限。
#Code#Inference-opt#Reddit#MiMo
一句话点评
Reddit 用户用 MiMo-2.5 量化版(IQ3_S)跑代码,模型很快进入死循环。官方推荐参数和 qwen36-27b 风格参数都试过,没用。正文没披露硬件配置和量化精度的影响,所以这个失败案例参考价值有限。短评:量化版跑代码死循环,参数调了也没救,但硬件和精度没交代,参考价值打折。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R1
18:19
56d ago
● P1Hacker News 首页· rssEN18:19 · 06·02
微软发布Scout自主AI代理基于OpenClaw框架
微软在 Build 大会上推出了 Scout,一个基于 OpenClaw 框架的“自动驾驶”式 AI 代理。它拥有独立的 Entra 身份,可以全天候自动执行 Microsoft 365 里的任务,比如处理邮件、安排会议、整理文档。正文没有披露 Scout 的具体能力边界、发布时间、定价或部署条件,所以目前只能知道它是个“一直在线、替你干活”的代理,但...
#Agent#Microsoft#OpenClaw#Product update
精选理由
精选 · 重要度 88 · 吸引力 + 共鸣
一句话点评
微软把年初爆火的开源项目 OpenClaw 包装成了 M365 里的个人助手 Scout,让它能记住你的工作习惯并持续干活。
锐评
微软这次动作很快,直接把 OpenClaw 这个年初在圈内炸开的自主 agent 框架做成了产品。Scout 的核心卖点是“持久化”——它会记住你的工作偏好和反馈,慢慢变成你的专属助手,而不是每次对话都从零开始。从 VP 的表述看,微软想让它融入 M365 生态,在办公场景里自动处理任务。 不过文章只提了概念和一次 demo 体验,没给任何性能数据、错误率或者实际能自动完成哪些具体工作。OpenClaw 当初火是因为它够野、够开放,但也出过乱搞用户邮箱的事故。微软把它收进企业套件里,安全边界和权限控制怎么做,正文完全没提。这点先别太激动,等看到它能稳定处理报销单或者排日程而不翻车,再判断它是不是真有用。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K0·R1
18:12
56d ago
● P1The Verge · AI· rssEN18:12 · 06·02
微软推出首个自研高级推理模型MAI-Thinking-1
微软在 Build 2026 上推出了 MAI-Thinking-1,这是他们第一个自研的“高级推理”模型,定位为中等体量的旗舰。公司声称它在几项关键的软件工程基准测试上能打平顶尖模型,并且是从头用干净数据训练的,没有拿第三方模型做蒸馏。不过,具体参数量、推理成本、延迟和更多基准细节正文都没披露,所以实际水平还得等第三方跑分再看。
#Reasoning#Code#Benchmarking#Microsoft
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
微软发了自家第一个推理模型 MAI-Thinking-1,还附了109页技术报告,没拿别家模型蒸馏,这点挺硬气。
锐评
微软在 Build 大会上正式推出了 MAI 系列模型,其中 MAI-Thinking-1 是他们的首款高级推理模型。最值得关注的是,微软发了一份 109 页的技术报告,明确说这个模型在训练时没有用任何合成数据,也没从第三方模型(比如 GPT 或 Gemini)那里做蒸馏,数据血缘很干净。这对于一个成立才两年的团队来说,是个挺实在的交代。 模型本身定位在推理和软件工程任务上,同时发布的还有代码、图像、语音等另外六个模型,看得出微软想快速铺开一个自有模型矩阵。不过,目前公开的信息主要来自微软官方和社交媒体的正面反馈,缺少独立的第三方基准测试对比。报告里写了什么训练技巧、具体成本多少、推理延迟如何,这些关键细节正文都没展开。 如果报告里的数据经得起推敲,那微软在“不靠蒸馏做推理模型”这件事上确实往前走了一步。但实际能力能不能对标现在市面上的头部推理模型,还得等更多人跑完测试再说。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
18:08
56d ago
r/LocalLLaMA· rssEN18:08 · 06·02
NVIDIA RTX Spark 笔记本:128GB 统一内存跑本地 AI,但价格和参数都没说
Reddit 用户发帖问 AI 从业者会不会买 NVIDIA RTX Spark 笔记本,核心卖点是 128GB 统一内存,适合本地跑大模型推理。帖子提到了 Windows on Arm 和游戏兼容性,但正文没披露价格、跑分、GPU 具体规格和发布时间。128GB 统一内存对本地跑 70B 以上模型挺有吸引力,但没价格和性能数据,这点先别太激动。
#Inference-opt#NVIDIA#Reddit#Commentary
一句话点评
Reddit 上有人问 AI 从业者会不会买 NVIDIA RTX Spark 笔记本,核心卖点是 128GB 统一内存,本地跑 70B 以上模型很诱人。但正文没披露价格、跑分、GPU 具体规格和发布时间,连原文都 403 了。128GB 统一内存对本地推理确实香,但没价格和性能数据,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K1·R1
18:00
56d ago
AI HOT 精选· aihot-apiZH18:00 · 06·02
英伟达发布自进化企业AI智能体,越用越聪明
英伟达推出名为“自进化Hermes”的企业AI智能体,核心卖点是能随着使用不断自我改进。正文没披露模型参数量、训练机制、上线时间和定价,所以目前只能当概念看。如果真能做到“越用越好”,对企业用户来说可能省去不少手动调优成本,但具体效果和落地门槛还得等更多细节。
#Agent#NVIDIA#Nemotron Labs#Product update
一句话点评
英伟达画了个“越用越好”的AI智能体大饼,叫自进化Hermes。但正文没披露参数量、训练机制、上线时间和定价,目前只能当概念看。如果真能做到,对企业用户来说省去手动调优成本挺诱人,但具体效果和落地门槛还得等更多细节。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
18:00
56d ago
FT · 科技· rssEN18:00 · 06·02
微软发新模型,直接对标 Anthropic
微软发布新模型,目标直指 Anthropic。AI 负责人 Mustafa Suleyman 说重点是企业用户。但正文被付费墙挡住,没披露模型名称、参数量、定价和发布时间,信息缺口很大。
#Microsoft#Anthropic#Mustafa Suleyman#Product update
一句话点评
微软发新模型对标Anthropic,AI负责人Suleyman说主攻企业用户。但正文被付费墙挡住,没披露模型名、参数量、定价和发布时间,信息缺口很大。这点先别太激动,等具体参数和价格出来再判断竞争力。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
18:00
56d ago
TechCrunch AI· rssEN18:00 · 06·02
Google 上线“假电话检测”,防 AI 换声冒充熟人诈骗
Google 给 Android 12 以上设备推了一个“假电话检测”功能,专门对付那种用 AI 换声冒充领导、家人或老板的诈骗电话。骗子会伪造来电显示(比如显示你妈的号码),接起来却是 AI 合成的声音。这个功能本月先从 Pixel 开始推,全球陆续上线。但正文没披露检测原理是什么(靠声纹?行为分析?)、支不支持非 Pixel 机型、要不要额外收费。
#Audio#Safety#Google#Product update
一句话点评
Google 给 Android 12+ 推了假电话检测,专门防 AI 换声冒充家人/领导的诈骗。骗子会伪造来电显示(比如你妈的号码),接起来却是 AI 合成声音。本月先从 Pixel 推,全球陆续上线。但正文没披露检测原理(声纹?行为分析?)、支不支持非 Pixel、要不要额外收费。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1

更多

频道

后台