ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-27

20 items · updated 3m ago
RSS live
2026-05-27 · 星期三2026年5月27日
02:47
62d ago
r/LocalLLaMA· rssEN02:47 · 05·27
Qwen3.6-35B-A3B 当子代理时,错误会悄悄往下传
一位用户在单张 RTX 4090 上跑了 Qwen3.6-35B-A3B 几周,发现它当子代理(让模型进业务流程干活)时有个坑:内容错了但格式对,下游根本发现不了,除非编排层有专门的校验环节。正文没披露具体用了什么编排框架和校验逻辑,所以这点先别太激动——如果你们团队已经上了严格的输出校验,这个风险可能已经被兜住了。
#Agent#Reasoning#Tools#Qwen
一句话点评
Qwen3.6-35B-A3B 当子代理时,内容错了但格式对,下游发现不了。单张 RTX 4090 跑了几周,编排层没校验就出事。正文没披露具体框架和校验逻辑,所以这点先别太激动——如果你们团队已经上了严格的输出校验,这个风险可能已经被兜住了。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
01:56
62d ago
AI HOT 精选· aihot-apiZH01:56 · 05·27
阿里云成为PyTorch基金会白金会员
阿里云宣布以白金会员身份加入PyTorch基金会,成为该基金会的最高级别企业会员。官方称已在多种硬件上大规模跑PyTorch,并强调自己是Qwen开源模型家族和AI基础设施的“全球领导者”。但正文没披露会员费金额、具体工程贡献或是否参与PyTorch核心开发,所以这个头衔的实际分量还不好判断。
#Inference-opt#Alibaba Cloud#PyTorch Foundation#Qwen
一句话点评
阿里云成了PyTorch基金会的白金会员,最高级别。官方说自己在多种硬件上大规模跑PyTorch,还是Qwen开源模型的“全球领导者”。但正文没披露会员费多少、具体贡献了什么工程代码、有没有参与核心开发,所以这个头衔的实际分量得打个问号。短评:头衔挺高,但没披露具体贡献和会费,分量得打折。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
01:30
62d ago
AI HOT 精选· aihot-apiZH01:30 · 05·27
Claude Code v2.1.152:代码审查意见能直接改文件了,还加了自动切换备用模型
Anthropic 给 Claude Code 打了个小版本更新。最实用的改动是 /code-review --fix:以前代码审查只给建议,现在可以直接把建议写到工作目录里,省掉手动改的步骤。另外加了 /reload-skills 命令,不用重启就能重载技能配置;SessionStart 也支持技能重载了。MessageDisplay hooks 和...
#Code#Agent#Tools#Anthropic
一句话点评
Claude Code 小版本更新,最实用的是 /code-review --fix 能把审查建议直接写进文件,省掉手动改的步骤。还加了 /reload-skills 不用重启就能重载技能配置,以及主模型不可用时自动切备用模型。都是工程体验优化,没有新能力。短评:代码审查从“只动嘴”变成“直接动手”,日常用挺省事。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H0·K1·R1
01:27
62d ago
彭博科技· rssEN01:27 · 05·27
三星芯片工人接受加薪方案,避免了一场可能冲击全球芯片供应的罢工
三星电子工会投票通过了一项补偿方案,给芯片工人平均约34万美元的奖金,从而避免了罢工。如果罢工真的发生,全球芯片供应可能会受影响。
#Samsung Electronics#Policy
一句话点评
三星芯片工人投票接受了补偿方案,平均每人拿到约34万美元奖金,罢工取消。这个数字很夸张——按韩国芯片工人平均年薪约8万美元算,这笔奖金相当于四年多的工资。三星显然不想让工厂停摆,全球存储芯片供应本就紧张,罢工一出价格肯定涨。但注意,这是Bloomberg单方面报道,三星官方和工会的具体投票率、反对票比例都没披露,实际内部矛盾未必完全化解。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
01:08
62d ago
彭博科技· rssEN01:08 · 05·27
瑞银高管:AI 会抢工作,但也能提效率
瑞银亚太区总裁 Iqbal Khan 说 AI 会释放产能、提高生产力,同时也会影响就业。正文没披露具体会裁哪些岗位、裁多少人、以及时间表,所以这点先别太激动,基本是高管级别的常规表态。
#UBS#Iqbal Khan#Commentary
一句话点评
瑞银亚太总裁说AI会提效也会影响就业,但全文没提具体裁哪些岗、裁多少人、时间表。基本是高管常规表态,信息量约等于零,不用太当回事。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K0·R1
00:38
62d ago
The Verge · AI· rssEN00:38 · 05·27
教皇用AI写了一份反对AI的教皇通谕?
The Verge 报道,分析工具 Pangram 检测出教皇方济各(Leo XIV)首份通谕《Magnifica Humanitas》的部分段落有 40% 到 100% 的概率是 AI 写的。通谕本身在讨论 AI 风险,结果写作工具疑似用了 AI,这事挺讽刺。不过正文没披露 Pangram 的完整检测方法,也没给出每个段落的具体评分,所以这个结论的可...
#Benchmarking#Safety#Pope Leo XIV#Linch Zhang
一句话点评
教皇方济各首份通谕《Magnifica Humanitas》部分段落被检测工具Pangram判定有40%-100%概率为AI生成,而通谕主题恰恰是讨论AI风险。检测由LessWrong社区成员Linch Zhang完成,但正文未披露Pangram的完整方法论和逐段评分,结论可信度要打折。讽刺效果拉满,但缺乏独立验证前,不宜过度解读。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
00:36
62d ago
Hacker News 首页· rssEN00:36 · 05·27
Erin Brockovich 做了张全美数据中心地图,让社区自己上报
环保活动家 Erin Brockovich 上线了一个数据中心追踪地图,目前标记了 33 个已运营、44 个在建和 27 个拟建的数据中心,还收到了 2,716 份社区报告。地图靠公众提交信息来更新,数据源和更新机制正文没披露,所以覆盖面和时效性要打个折。但它的价值在于把 AI 基建的选址争议——噪音、用水、电网压力——变成了一个可公开追踪的众包工具,...
#Erin Brockovich#Commentary
一句话点评
环保活动家Erin Brockovich上线了一个数据中心追踪地图,靠公众提交信息更新。目前标记了33个运营、44个在建和27个拟建的数据中心,还收到2716份社区报告。数据源和更新机制正文没披露,覆盖面和时效性要打折。但它的价值在于把AI基建的选址争议——噪音、用水、电网压力——变成了一个可公开追踪的众包工具。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
00:27
62d ago
r/LocalLLaMA· rssEN00:27 · 05·27
单张3090跑Qwen 27B,开投机解码后上下文从137k掉到14k
一位用户在单张RTX 3090上用llama.cpp跑Qwen3.6-27B的Q4量化版,开启MTP(多token预测)和spec-draft-n-max 2后,内置网页显示可用上下文从137k骤降到14k。投机解码本意是用小草稿模型加速生成,但这里代价是显存被草稿模型吃掉,长上下文直接缩水九成。正文没披露具体推理速度变化,也没说是否调过草稿模型大小或...
#Inference-opt#Qwen#llama.cpp#NVIDIA
一句话点评
单张3090跑Qwen3.6-27B Q4量化版,开MTP投机解码后可用上下文从137k暴跌到14k,缩水九成。原因是草稿模型占了显存,长上下文直接崩了。正文没提速度变化,也没说是否调过草稿模型大小。如果草稿模型能小一点,或许能平衡,但这点先别太激动——投机解码的显存代价比想象中大。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K1·R1
00:18
62d ago
Hacker News 首页· rssEN00:18 · 05·27
拆解AI Agent记忆:别被“记忆”这个词骗了
这篇博客把AI Agent记忆库拆成三个零件:提取器(从对话里抽事实)、存储器(数据库,要处理矛盾信息)、检索器(找相关记忆)。作者指出,市面上大部分记忆库只是给用户存了个“自传式资料夹”,根本不是真正的记忆系统。认知科学里的情景记忆、语义记忆、程序记忆、前瞻记忆,到了工程实现里基本都缩水成语义记忆——程序记忆只是改了个标签,前瞻记忆几乎没人做。正文没...
#Agent#Memory#Commentary
一句话点评
这篇博客把AI Agent记忆库拆成三个零件:提取器、存储器、检索器。作者指出,市面上大部分记忆库只是给用户存了个“自传式资料夹”,根本不是真正的记忆系统。认知科学里的情景记忆、语义记忆、程序记忆、前瞻记忆,到了工程实现里基本都缩水成语义记忆——程序记忆只是改了个标签,前瞻记忆几乎没人做。正文没披露具体库名或实验数据,但拆解框架对选型有参考价值。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K0·R1
00:07
62d ago
● P1彭博科技· rssEN00:07 · 05·27
SK Hynix 和 Micron 市值突破一万亿美元
两家内存大厂在同一天挤进了万亿美元俱乐部。SK 海力士靠的是 HBM(高带宽内存,直接贴在 GPU 旁边的那层高速缓存)几乎垄断了英伟达的订单,美光也在后面猛追。市场赌的是 AI 服务器建得越多,这种内存就越不够用,整个行业的估值逻辑都被重写了。不过正文没披露具体的营收拆分和客户占比,这个市值更多反映的是预期,不是已经落袋的利润。
#SK Hynix#Micron Technology#Bloomberg#Funding
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
两家内存厂靠卖 AI 专用内存(HBM)市值冲进万亿美元俱乐部,但正文没披露具体营收占比和客户集中度,先别急着喊“新王登基”。
锐评
SK 海力士和美光同时跨过万亿美元市值门槛,核心推手是 AI 服务器对高带宽内存(HBM,可以理解为把内存堆叠起来、让数据吞吐速度暴增的专用芯片)的疯狂采购。这件事的信号很直接:AI 的钱不再只是算力芯片(GPU)厂商在赚,上游的存储厂商也开始分到真金白银的大头。 不过,文章本身是 Bloomberg 的行情快讯,只给了市值数字和“AI 内存芯片主导”的定性,没有拆解两家公司 HBM 的具体出货量、毛利率变化,也没提它们对英伟达等大客户的依赖程度。这种集中度的风险其实不小——一旦 AI 资本开支节奏放缓,或者下一代 HBM 技术路线切换,高估值会跌得比谁都快。 还缺一个关键信息:传统内存(比如手机、PC 用的 DRAM 和 NAND)的周期现在走到哪了。如果万亿美元市值全靠 AI 一条腿撑着,而其他业务还在低谷,那这个“万亿”的底座就没那么稳。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
00:00
62d ago
Hugging Face 博客· rssEN00:00 · 05·27
万亿参数模型同步:TRL 用 Delta Weight Sync 只传几 MB 增量
Hugging Face 在 TRL 里加了个 Delta Weight Sync 功能,解决异步强化学习(async RL)里训练器和推理引擎之间传模型权重太慢的问题。以前每步都得传整个模型,7B 模型要 14 GB,万亿参数模型接近 1 TB。他们发现连续两步优化之间,bf16 权重有 99% 是完全一样的,最少也有 98%。于是只把变化的部分编码...
#Fine-tuning#Inference-opt#Tools#Hugging Face
一句话点评
Hugging Face 在 TRL 里加了 Delta Weight Sync,解决异步强化学习传模型权重太慢的问题。他们发现连续两步优化之间,bf16 权重有 99% 完全一样,最少也有 98%,于是只传变化的部分。7B 模型原来每步要传 14 GB,万亿参数模型接近 1 TB,现在只传差异,带宽压力小很多。但正文没披露具体压缩比、实测延迟降低多少、以及这个功能是否已合并到主分支。如果真...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
00:00
62d ago
AI HOT 精选· aihot-apiZH00:00 · 05·27
AI 时代不是软件时代的终结,而是给野马套上缰绳
一位 VC 认为,AI 像野马一样强大但不可控,真正落地需要一套“驯服”系统,包含七个组件:上下文与记忆(为不同场景定制检索,比如放射科医生和律师需要的资料库完全不同)、工具与动作(通过 MCP 协议暴露外部工具,并处理参数校验和失败回退)、编排与循环(思考-行动-观察-重复,支持子任务和重试)、状态与持久化(10 步任务在第 7 步崩溃后能从第 8 ...
#Agent#Tools#Memory#Commentary
一句话点评
一位 VC 把 AI 比作野马,落地需要一套“驯服系统”,拆了七个组件:上下文记忆(放射科医生和律师要的资料库不一样)、工具调用(MCP 协议暴露外部工具,处理参数校验和失败回退)、编排循环(思考-行动-观察-重复)、状态持久化(10 步任务在第 7 步崩溃后能从第 8 步恢复)、沙箱计算、可观测与治理、成本与工作流优化。观点不新,但框架清晰,适合给团队对齐认知。正文没披露具体落地案例或成本...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
00:00
62d ago
AI HOT 精选· aihot-apiZH00:00 · 05·27
OpenAI 发布 2026 年选举保障方案:接入美联社实时计票、给投票机厂商送安全工具
OpenAI 在 5 月 27 日发了一篇博客,讲他们为 2026 年全球大选做的三件事。第一,让 ChatGPT 能直接显示美联社的实时计票结果(今年秋天先在美国和巴西上线),还跟 Democracy Works 合作,用户问投票地点、注册截止日这类问题时直接给官方信息。第二,把他们的代码安全工具 Codex Security 和前沿模型访问权限 T...
#Safety#OpenAI#Policy#Safety/alignment
一句话点评
OpenAI 为2026年大选做了三件事:ChatGPT 直接显示美联社实时计票结果(今年秋天先在美国和巴西上线),跟 Democracy Works 合作给投票地点、注册截止日等官方信息;把代码安全工具 Codex Security 和前沿模型访问权限 TAC 提供给美国注册投票系统厂商;用 SynthID 水印 + C2PA 元数据标记 AI 图片,还上线了公开验证工具。 关键数字:2...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
00:00
62d ago
OpenAI 博客· rssEN00:00 · 05·27
OpenAI 公布 2026 年选举保障措施:提供实时计票、给投票系统厂商送安全工具
OpenAI 发了一篇 2026 年选举保障的博文,核心动作有三块:一是今年秋天开始在美国和巴西的 ChatGPT 里接入美联社的实时计票数据,美国用户还能查到投票地点等具体信息;二是把自家安全工具 Codex Security 和 TAC 提供给美国注册投票系统厂商,帮他们修代码漏洞、做网络防御;三是给图片加 SynthID 水印和 C2PA 元数据...
#Safety#OpenAI#Policy#Safety/alignment
一句话点评
OpenAI 2026 选举保障方案:ChatGPT 接入美联社实时计票数据(美国、巴西),并提供投票地点查询;向美国注册投票系统厂商开放 Codex Security 和 TAC 工具修漏洞、做防御;图片加 SynthID 水印和 C2PA 元数据,并推出公开验证工具。正文没披露具体执行时间表、覆盖国家范围、以及如何防止模型被用于生成误导性政治内容。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K0·R1

更多

频道

后台