ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-07

38 items · updated 3m ago
RSS live
2026-05-07 · 星期四2026年5月7日
07:53
82d ago
r/LocalLLaMA· rssEN07:53 · 05·07
llama.cpp 为什么不能同时用两种推测解码?
一位用户在 Reddit 上问 llama.cpp 能不能把 MTP(多头预测)和 n-gram 推测解码一起用。他实测了 Qwen3.6 27B 的 MTP,说在写代码的重复片段时 n-gram 更快。正文没披露维护者的回复、具体 benchmark 或限制原因,所以目前只能当用户经验看,不是官方结论。
#Agent#Code#Inference-opt#llama.cpp
一句话点评
用户实测Qwen3.6 27B的MTP,写重复代码时n-gram更快,但官方没确认能否混用。
锐评
一位用户实测了Qwen3.6 27B的MTP(多头预测,让模型一次猜多个后续token),发现写代码的重复片段时,n-gram推测解码(基于历史文本匹配)反而更快。这暗示两种加速方法可能冲突,但正文没披露llama.cpp维护者的回复、具体benchmark数据或限制原因,目前只能当用户经验看,不是官方结论。关键信息缺口:没说明MTP和n-gram能否在llama.cpp里同时启用,也没给延迟或吞吐量对比。如果真能混用,对长代码生成场景挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H0·K1·R0
07:25
82d ago
AI HOT 精选· aihot-apiZH07:25 · 05·07
GitHub Repo Stats:一个看仓库提交数的轻量工具
Simon Willison 写了个小工具,输入 GitHub 仓库名或 URL,就能看到提交数、贡献者、语言分布、版本发布等统计。他本人最在意的是提交数,但 GitHub 手机版不显示这个数字,所以自己动手用 REST 或 GraphQL API 抓了数据。工具在浏览器里直接跑,不经过后端。不登录的话每小时只能请求 60 次,登录后能到 5000 次...
#Tools#GitHub#Simon Willison#Product update
一句话点评
Simon Willison 写了个浏览器端小工具,输入 GitHub 仓库名就能看提交数、贡献者、语言分布等统计。他本人最在意提交数,但 GitHub 手机版不显示,所以自己动手用 API 抓。工具纯前端运行,不登录每小时只能请求 60 次,登录后 5000 次。对经常在手机上快速评估仓库的人来说挺实用,但功能本身不复杂,就是个 API 封装。
HKR 分解
hook knowledge resonance
打开信源
32
SCORE
H0·K0·R0
07:15
82d ago
Hacker News 首页· rssEN07:15 · 05·07
Unsloth 和 NVIDIA 合作,让消费级显卡微调大模型再快 25%
Unsloth 和 NVIDIA 联合宣布,在消费级 GPU 上微调大模型的速度能再提升约 25%。他们主要干了三件事:一是缓存打包序列的元数据,避免每层都重复算一遍;二是用双缓冲区做梯度检查点,让激活值重算和反向传播并行起来;三是优化了 MoE 路由,用 argsort 和 bincount 一次性分组 token。实测 Qwen3-14B 的 QL...
#Fine-tuning#Inference-opt#Unsloth#Nvidia
一句话点评
Unsloth 和 NVIDIA 合作,在消费级 GPU 上把大模型微调速度再提 25%,主要靠缓存元数据、并行计算和优化路由。
锐评
Unsloth 和 NVIDIA 联合宣布,在消费级 GPU 上微调大模型的速度能再提升约 25%。他们主要干了三件事:一是缓存打包序列的元数据,避免每层都重复算一遍;二是用双缓冲区做梯度检查点,让激活值重算和反向传播并行起来;三是优化了 MoE 路由,用 argsort 和 bincount 一次性分组 token。实测 Qwen3-14B 的 QLoRA SFT,前向加速 43%,反向加速 5.8%,整体每批快 14.3%。 不过正文没披露具体用的哪款消费级 GPU、训练超参和对比基线,25% 是峰值还是均值也不清楚。如果是真的,对个人开发者挺省钱,但复现门槛还在。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
07:11
82d ago
r/LocalLLaMA· rssEN07:11 · 05·07
Reddit 用户实测:GLM 在 77 道题里答对 58 道,但经常对空白输入过度解释
Reddit 用户 No_Run8812 自己搞了个 77 题的本地模型测试,分四类任务。zai-org/glm-4.7-flash 得了 58/77,低于 qwen3-coder-next 的 66/77。作者说 GLM 在 4 条审计提示上解释不足,但对空白和单字符输入反而过度解读,像“精神分裂”。正文没披露具体测试题和评分标准,所以这个对比只能当...
#Agent#Tools#Benchmarking#GLM
一句话点评
GLM 在空白输入上过度解读,像精神分裂,但测试只有77题,样本太少。
锐评
Reddit 用户自己搞了个77题本地模型测试,GLM-4.7-flash 得分58/77,低于 Qwen3-coder-next 的66/77。作者说 GLM 在4条审计提示上解释不足,但对空白和单字符输入反而过度解读,像“精神分裂”。这个测试样本量只有77题,且正文没披露具体题目和评分标准,所以对比只能当个参考,不能当真。另外,测试是个人行为,不是官方评测,权威性有限。如果真要做模型对比,建议用更大、更公开的基准,比如 MMLU 或 HumanEval。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
06:51
82d ago
AI HOT 精选· aihot-apiZH06:51 · 05·07
阿里千问 PC 端上线语音输入:按住说话、双击下指令,免费开放
阿里千问在 PC 端上线了 AI 语音输入功能,所有用户免费使用。核心操作就两套快捷键:按住右 Alt(Mac 是右 Command)说话,系统会自动去掉语气词、纠正口误,把语音转成规整的文字输出;双击同一个键则进入 AI 指令模式,可以直接说“帮我查资料”“写个文档”“翻译这段话”,不用切窗口。设计思路是把语音输入法做成一个跨应用的 AI 调度入口,...
#Audio#Agent#Tools#Alibaba
一句话点评
阿里千问PC端上线语音输入,按住右Alt说话能自动去语气词、纠口误,双击则进入AI指令模式,直接说“写文档”“查资料”不用切窗口。免费开放,但正文没披露延迟和模型规格,实际响应速度存疑。设计思路是把语音做成跨应用调度入口,比单纯语音打字更有想象力,但体验好坏取决于识别准确率和指令执行稳定性。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
06:50
82d ago
r/LocalLLaMA· rssEN06:50 · 05·07
试了 Pi 这个开源编程助手,5 个设计特点值得看
Reddit 用户 OrewaDeveloper 试了 Pi 编程助手,总结了 5 个设计特点。Pi 支持替换 system.md、树状会话,工具只有四个:读、写、编辑、跑 bash。登录 Anthropic 后按 token 额外计费,正文没披露具体价格。
#Agent#Code#Tools#Pi
一句话点评
Pi 编程助手开源,工具极简但依赖 Anthropic 按 token 计费,成本未知。
锐评
Pi 是一个开源编程助手,设计上刻意保持工具极简:只有读、写、编辑和跑 bash 四个工具,支持替换 system.md 和树状会话。这种设计让模型不容易跑偏,适合需要稳定执行简单编程任务的场景。但注意,Pi 登录 Anthropic 后按 token 额外计费,正文没披露具体价格,实际使用成本可能不低。另外,来源是 Reddit 用户个人体验,不是官方评测,验证强度弱。目前缺的是:Pi 在复杂项目或长链任务上的表现对比、与 Claude Code 等竞品的成本差异、以及是否支持本地模型替换。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
06:40
82d ago
AI 群聊日报· atomZH06:40 · 05·07
群聊日报:多Agent并行监控工具爆发,Anthropic拿下SpaceX 22万GPU
今天群聊围绕多Agent并行监控展开密集讨论,从Mac刘海岛应用Vibe Island到自建Dashboard,再到stdio redirect底层方案,覆盖同时跑上百个agent时的掌控问题。Anthropic宣布使用SpaceX Colossus数据中心超22万块NVIDIA GPU,Claude Code五小时速率限额翻倍,同时发布Managed...
#Agent#Tools#Safety#Anthropic
一句话点评
多Agent并行监控的实操讨论比Anthropic的算力新闻更有价值。
锐评
群聊日报的核心价值在于多Agent并行监控的实操讨论,从Mac刘海岛应用Vibe Island到自建Dashboard,再到stdio redirect底层方案,覆盖了同时跑上百个agent时的掌控问题。Vibe Island在超过100个subagent后会卡,这点先别太激动。Anthropic用SpaceX Colossus超22万块GPU,Claude Code五小时速率限额翻倍,但群友实测两天就用完,还得靠Codex续命。Wharton实验数据值得注意:AI给错误答案时用户接受率仍高达80%,说明复核不等于独立判断。正文没披露Vibe Island的具体定价和自建方案的代码开源情况。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
06:12
82d ago
Hacker News 首页· rssEN06:12 · 05·07
Agent Skills 评测工具:给模型加技能到底有没有用?
这个开源项目提供了一个测试框架,用来验证给 AI Agent 加上特定技能(比如调用工具、多步推理)后,输出质量是否真的提升了。作者没有公布具体的评测任务、指标和模型配置,所以目前只能看到工具本身,看不到任何实测结果。对于想评估 Agent 能力的团队来说,这个架子搭好了,但数据还没填上。
#Agent#Benchmarking#darkrishabh#GitHub
一句话点评
一个测 Agent 技能有没有用的空架子,代码开源但没跑出任何数据。
锐评
这个项目提供了一个测试框架,用来验证给 AI Agent 加上特定技能(比如调用工具、多步推理)后,输出质量是否真的提升了。作者没有公布具体的评测任务、指标和模型配置,所以目前只能看到工具本身,看不到任何实测结果。对于想评估 Agent 能力的团队来说,这个架子搭好了,但数据还没填上。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
04:40
82d ago
FT · 科技· rssEN04:40 · 05·07
三星市值破万亿美元,工会要求分AI红利
三星市值达到1万亿美元,韩国工会威胁罢工,要求将AI带来的利润增长用于提高奖金和工资。正文没披露具体奖金数额、谈判进展或罢工时间表,但这件事本身说明:AI赚钱了,员工也想分一杯羹。
#Samsung#South Korean unions#Incident
一句话点评
三星市值破万亿,工会拿AI利润当筹码要加薪。
锐评
三星市值达到1万亿美元,韩国工会威胁罢工,要求把AI带来的利润增长用于提高奖金和工资。这件事本身说明:AI赚钱了,员工也想分一杯羹。但正文没披露具体奖金数额、谈判进展或罢工时间表,所以目前更像一个信号——AI红利分配问题开始摆上台面,而不是马上要停产的危机。对AI从业者来说,这提醒你:技术落地后,利益分配是绕不开的议题,尤其在高人力成本的制造业。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
04:28
82d ago
Product Hunt · AI· rssEN04:28 · 05·07
Memoket Gem:全天候佩戴的 AI 录音笔,帮你记住每一句对话
Memoket Gem 是一款 AI 可穿戴设备,主打全天候记录对话,然后自动生成摘要、待办事项和后续跟进,还能把不同对话的上下文串起来。产品页没说价格、续航、存储方式和隐私怎么处理——这些是买这类设备前最该问清楚的事。目前开放了 50 个免费名额给创始人和小企业主做早期测试,算是个低成本尝鲜的机会,但样本量太小,验证意义有限。
#Audio#Memory#Memoket Gem#Product update
一句话点评
Memoket Gem 是一款全天候录音的 AI 可穿戴设备,能自动把对话转成摘要、待办和后续跟进,还能跨对话串上下文。目前开放 50 个免费名额给创始人和小企业主做早期测试,算是个低成本尝鲜的机会。但产品页没披露价格、续航、存储方式和隐私处理——这些是买这类设备前最该问清楚的事。50 人的样本量太小,验证意义有限,这点先别太激动。如果是真的,能省去手动记笔记的麻烦,但隐私和续航是硬伤。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
04:02
82d ago
● P1新智元 · 公众号· rssZH04:02 · 05·07
Claude 托管智能体新增“做梦”功能,Harvey 实测任务完成率暴涨约 6 倍
Anthropic 给 Claude 的托管智能体加了三个新能力:Dreaming(做梦)、Outcomes(结果校验)和多智能体协作。其中“做梦”是指让 Claude 在后台读取最多 100 段历史会话,自己总结规则来改进表现,一次演示里它把 530 万 token 的对话提炼成了 98 条规则。法律 AI 公司 Harvey 实测后,任务完成率比之...
#Agent#Memory#Benchmarking#Anthropic
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude 现在能自己翻聊天记录总结规则了,Harvey 实测任务完成率涨了约 6 倍,但正文没给具体基线和测试集,这点先别太激动。
锐评
Anthropic 给 Claude 的托管智能体加了三个新能力,最值得看的是“做梦”——让模型在后台读最多 100 段历史对话,自己提炼行为规则。一次演示里,它把 530 万 token 的对话压成了 98 条规则,相当于模型自己给自己写了个操作手册。法律 AI 公司 Harvey 实测后说任务完成率涨了约 6 倍,另一个叫“结果校验”的功能把成功率又拉了 10 个百分点。 不过 Harvey 的数据得打个折。正文没披露原来的完成率是多少,也没说测试任务长什么样、样本量多大。从 10% 提到 60% 和从 80% 提到 85% 完全是两回事,前者是能用,后者是锦上添花。另外,这些功能目前只开放给 Opus 4.7 和 Sonnet 4.6,还要额外收每小时 0.08 美元的运行时费,小团队用起来成本不低。 还缺几个关键信息:100 段历史对话够不够覆盖长尾场景?模型自己总结的规则会不会越学越偏?多智能体协作具体怎么分工、有没有冲突处理机制?这些都没说清楚。整体看,方向有意思,但离“睡一觉就进化”还差不少验证。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
04:02
82d ago
新智元 · 公众号· rssZH04:02 · 05·07
中国医疗AI登顶全球榜单,WiseDiag发布院外场景Agent OS
WiseDiag 发布 WiseClaw 2.0,一个面向体检、慢病、设备、家庭医生、保险/养老五个院外场景的医疗 Agent OS。系统分导诊、临床、评估三个阶段,并记录工具调用、知识版本和风险检查的 trace。模型 WiseDiag-v2 在 DoctorBench 上拿了第一,公司刚融了 6500 万人民币天使轮。正文没披露具体评测指标和对比基...
#Agent#Tools#Memory#WiseDiag
一句话点评
医疗Agent OS,但评测细节和对比模型都没说。
锐评
WiseDiag 把 WiseClaw 2.0 包装成面向体检、慢病、设备、家庭医生、保险/养老五个院外场景的医疗 Agent OS,思路清晰:让模型进业务流程干活,而不是只做问答。系统分导诊、临床、评估三个阶段,还记录工具调用、知识版本和风险检查的 trace,这对医疗合规和审计是加分项。模型 WiseDiag-v2 号称在 DoctorBench 上拿了全球第一,公司刚融了 6500 万人民币天使轮。但正文没披露具体评测指标和对比基线,也没说跟谁比、差多少,这个“第一”要打折。6500 万天使轮在医疗 AI 里不算小,但也没大到能烧出壁垒。缺的是:评测细节、对比模型、临床落地案例。如果是真的,这个架构比单点模型更值得关注。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
03:57
82d ago
彭博科技· rssEN03:57 · 05·07
阿里股价跑赢腾讯,因为投资者更看好它的芯片业务
阿里股价涨幅超过腾讯,原因是亚洲芯片股集体上涨,而阿里旗下有半导体业务,投资者更愿意押注有芯片概念的公司。正文没披露阿里芯片业务的具体涨幅、估值或收入,所以这点先别太激动,信息还不够判断实际价值。
#Alibaba#Tencent#Bloomberg#Commentary
一句话点评
阿里涨得比腾讯猛,因为市场在炒芯片概念,但正文没披露阿里芯片业务的具体收入或估值,这点先别太激动。
锐评
阿里股价跑赢腾讯,直接原因是亚洲芯片股集体上涨,而阿里旗下有半导体业务,投资者更愿意押注有芯片概念的公司。但正文没披露阿里芯片业务的具体涨幅、估值或收入,所以信息还不够判断实际价值。如果阿里芯片业务体量很小,这波涨幅可能只是情绪驱动,缺乏基本面支撑。对于AI从业者来说,这条新闻的参考价值有限——它更多是市场情绪和板块轮动的信号,而不是技术或业务层面的突破。需要关注的是阿里芯片业务后续是否有实质性进展披露,比如客户、订单或技术路线。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K0·R0
03:57
82d ago
彭博科技· rssEN03:57 · 05·07
数据中心老板:AI 热潮让我不用睡觉
澳大利亚数据中心运营商 NEXTDC 的老板说,AI 热潮让他忙到没空睡觉,但公司现金流充裕。正文没披露具体融资规模、客户名单或扩建计划,所以这点先别太激动——有钱和有地建数据中心是两回事。
#NEXTDC#Bloomberg#Funding#Commentary
一句话点评
NEXTDC 老板说 AI 忙到没空睡觉,但有钱。
锐评
NEXTDC 老板说 AI 热潮让他忙到没空睡觉,但公司现金流充裕。这句话本身没什么信息量——有钱和有地建数据中心是两回事。正文没披露具体融资规模、客户名单或扩建计划,所以这点先别太激动。Bloomberg 的报道通常有独家信源,但这篇更像高管软性表态,缺乏可验证的硬数据。对 AI 从业者来说,这条新闻的价值在于侧面印证数据中心需求确实在涨,但别拿它当投资或选址依据。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
03:46
82d ago
Hacker News 首页· rssEN03:46 · 05·07
ProgramBench:让语言模型从零重建整个程序,结果全军覆没
现有编程评测只测修一个 bug 或写一个函数,但实际场景里 agent 要自己搭整个项目的架构。ProgramBench 把 200 个任务(从命令行小工具到 FFmpeg、SQLite、PHP 解释器)扔给模型,只给源码和文档,要求重建出行为完全一致的程序。评测用 agent 自动生成测试用例,不限制实现方式。结果最好的模型也只让 3% 的任务通过了...
#Code#Benchmarking#ProgramBench#Research release
一句话点评
给模型源码和文档,让它从头重建出行为一致的程序,结果最好的模型也只让3%的任务全过。
锐评
ProgramBench 把编程评测从修 bug 或写函数升级到“搭整个项目架构”。200 个任务从命令行小工具到 FFmpeg、SQLite、PHP 解释器,只给源码和文档,要求模型重建出行为完全一致的程序。评测用 agent 自动生成测试用例,不限制实现方式。结果:9 个模型没有一个能完全解决任何任务,最好的模型也只让 3% 的任务通过了全部测试(95% 的测试用例)。模型倾向于写单文件、大而全的实现,跟人类写的代码结构差很远。 这个基准的难度确实高,但也要注意:它测的是“行为一致”,不是“代码质量一致”,而且 200 个任务里包含像 PHP 解释器这种大型项目,模型失败不意外。正文没披露每个任务的测试用例数量和质量,也没说 agent 生成测试用例的覆盖率,这点先别太激动。如果是真的,这个基准比 SWE-bench 更贴近“让 agent 独立干活”的终极场景。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
03:29
82d ago
● P1彭博科技· rssEN03:29 · 05·07
Moonshot AI 在美团领投融资轮中估值达 200 亿美元
月之暗面(Moonshot AI)又拿钱了,这次大约融了 20 亿美元,估值直接拉到 200 亿美元。标题说美团是领投方,但正文没披露具体投资人名单、各自投了多少、出让了多少股份,也没说钱打算怎么花。这个估值信号很直接——市场对中国 AI 创业公司的胃口还很大,但信息缺口也不小,先别急着下结论。
#Agent#Moonshot AI#Meituan#Kimi
精选理由
精选 · 重要度 97 · 吸引力 + 知识量 + 共鸣
一句话点评
Moonshot AI 拿了美团领投的新钱,估值冲到 200 亿美元,但两家报道都没说清楚这轮融了多少钱、钱要花在哪。
锐评
Moonshot AI 这轮融资由美团领投,估值到了 200 亿美元。TechCrunch 说融了 20 亿美元,但 Bloomberg 的正文没提具体金额,两边数字对不上,先别急着当定论。200 亿这个估值放在国内大模型创业公司里已经很高了,说明资本还在押注 Kimi 聊天机器人能跑出来。 不过两篇报道都没披露 Moonshot 现在的收入、用户规模或者模型性能对比,也没说美团这笔投资是纯财务还是带业务绑定。开源需求在涨这个说法来自 TechCrunch 的标题,正文里没有展开,缺细节支撑。 还缺的关键信息:这轮融资后 Moonshot 的现金流能撑多久,以及 Kimi 跟字节豆包、百度文心这些竞品相比到底差在哪、好在哪。
HKR 分解
hook knowledge resonance
打开信源
97
SCORE
H1·K1·R1
03:26
82d ago
AI HOT 精选· aihot-apiZH03:26 · 05·07
卡兹克公开自己的AI信息源,免费追踪平台上线
公众号顶流博主卡兹克(@Khazix0918)公开了他日常用的AI信息源,并上线了免费追踪平台 aihot.virxact.com,无需登录就能用。平台按时间线展示,分类整合了官方信源、优质博主、推友、公众号监测和AI日报。想跟顶流博主保持信息同步,直接看这个站就行。正文没披露具体收录了多少源、更新频率多快、以及维护规则。
#Khazix#Product update
一句话点评
卡兹克把他日常刷的AI信息源整理成了一个免费追踪站,不用登录就能看,按时间线排好,分了官方、博主、公众号和日报几类。对想省时间找高质量AI信息的人来说挺实用。但正文没披露收录了多少源、更新频率多快、以及维护规则,长期能不能保持质量还不确定。短评:信息源聚合站,省了你自己筛,但维护力度未知。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
02:59
82d ago
r/LocalLLaMA· rssEN02:59 · 05·07
Qwen3.6 27B 去审查版 v2 发布:拒绝率降到 6%,保留完整 15 步 MTP
一个基于 Qwen3.6 27B 的去审查微调版 v2 发布了,核心指标是 KLD 0.0021(分布偏移很小,基本没破坏原模型能力),拒绝回答敏感问题的比例只有 6/100(原版通常更高)。还保留了完整的 15 步 MTP(多 token 预测,生成速度更快)。格式有 Safetensors、GGUF 和 NVFP4(适合低显存推理)。但正文被 Re...
#Inference-opt#Safety#Qwen#Reddit
一句话点评
去审查版 Qwen3.6 27B,拒绝率仅 6%,能力几乎无损。
锐评
这是一个基于 Qwen3.6 27B 的去审查微调版 v2,核心卖点是 KLD 仅 0.0021(分布偏移极小,基本没破坏原模型能力),拒绝回答敏感问题的比例只有 6/100(原版通常更高)。还保留了完整的 15 步 MTP(多 token 预测,生成速度更快)。格式提供 Safetensors、GGUF 和 NVFP4(适合低显存推理)。 但正文被 Reddit 屏蔽(403),没有披露下载链接、训练数据、评估方法,也没说用了什么偏好算法。KLD 0.0021 这个数字很漂亮,但没说明是在什么测试集上算的,可能只是某个窄分布下的结果。6% 的拒绝率也需要看具体 prompt 集——如果全是简单问题,这个数字意义不大。 对本地部署玩家来说,如果真能保持原模型能力同时大幅降低拒绝率,那确实省事。但信息缺口太大,建议等第三方评测或作者补全细节再决定是否下载。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R1
02:59
82d ago
彭博科技· rssEN02:59 · 05·07
特朗普幕僚长表态:美国政府不会在AI竞赛里“选冠军”
白宫幕僚长苏西·威尔斯说,美国不会在AI竞赛中指定赢家或输家。文章提到有AI政策指令正在路上,但没披露具体内容、发布时间和执行机制——也就是说,目前只有一句表态,没有落地细节。对从业者来说,这意味着短期内美国政府不会用行政手段直接扶持某家公司或某个技术路线,但“不选冠军”不等于不监管,具体怎么管还得等后续文件。
#Susie Wiles#Donald Trump#White House#Policy
一句话点评
白宫表态不指定AI赢家,但没给具体政策,先别当利好。
锐评
白宫幕僚长苏西·威尔斯说美国不会在AI竞赛里指定赢家或输家,意思是短期内政府不会用行政手段直接扶持某家公司或某个技术路线。但这句话目前只有表态,正文没披露任何具体政策内容、发布时间和执行机制——信息缺口很大。对从业者来说,“不选冠军”不等于不监管,出口管制、芯片法案、反垄断这些工具都还在桌上。后续要看真正的政策指令长什么样,现在只能算一个方向性信号,落地细节为零。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
02:05
82d ago
● P1机器之心 · 公众号· rssZH02:05 · 05·07
马斯克宣布 xAI 解散,Grok 并入 SpaceXAI,22 万张 GPU 算力租给 Anthropic
马斯克确认 xAI 解散,Grok 和 X 平台相关业务全部并入新实体 SpaceXAI。同时,SpaceX 和 Anthropic 签了协议,Claude 将接入 Colossus 1 超算——超过 22 万张 Nvidia GPU、300 兆瓦的算力集群。对用户来说最直接的变化是配额:Claude Code 的五小时速率限制翻倍,Pro 和 Max...
#Code#Inference-opt#xAI#SpaceX
精选理由
精选 · 重要度 96 · 吸引力 + 知识量 + 共鸣
一句话点评
马斯克把 xAI 解散并入 SpaceXAI,22 万张 GPU 租给 Anthropic,Claude 用户配额直接翻倍。但正文被微信验证页挡了,具体条款和价格都没看到。
锐评
这条消息的核心就一件事:xAI 不玩了,家当全给了 SpaceXAI,而最值钱的家当——Colossus 1 超算那 22 万多张 GPU、300 兆瓦的算力——转手租给了 Anthropic。对 Claude 用户来说,最直接的好处是 Claude Code 的五小时速率限制翻倍,Pro 和 Max 套餐的高峰期限流也取消了。这等于 Anthropic 一夜之间拿到了顶级算力,不用自己建数据中心就能大幅提升服务容量。 但这条新闻有个硬伤:原文被微信的环境验证页挡住了,我只能看到摘要里的信息。摘要没提这笔租约的期限、价格,也没说 SpaceXAI 接手后 Grok 和 X 平台的业务会怎么调整。22 万张 GPU 是个很大的数字,但租出去多少、留多少自用,正文没披露。另外,xAI 解散是彻底关门还是换壳,人员怎么安置,这些关键细节都看不到。 我会先打个折:配额翻倍听起来不错,但得看实际高峰时段能不能稳住。算力租赁这种事,签了协议和真正跑起来是两码事。等看到完整条款和用户实测数据再下判断。
HKR 分解
hook knowledge resonance
打开信源
96
SCORE
H1·K1·R1
01:58
82d ago
r/LocalLLaMA· rssEN01:58 · 05·07
DeepSeek v4 Pro 搭 Roo Code 跑几小时烧掉 10 美元,跟 Opus 差不多贵了
Reddit 用户说 DeepSeek v4 Pro 配合 Roo Code(一个在 VS Code 里让模型自动写代码的工具),开了“高思考”模式,两三个小时就花了 10 美元,成本几乎赶上 Claude Opus。正文没披露具体用了多少 token、单价多少、跑的是什么任务,所以没法判断是模型本身贵还是调用太频繁。如果真是这个价,那 DeepSee...
#Code#Tools#Reasoning#DeepSeek
一句话点评
DeepSeek v4 Pro 开高思考模式,两三个小时烧掉10美元,成本直逼Opus。
锐评
Reddit 用户实测,DeepSeek v4 Pro 配合 Roo Code(VS Code 里让模型自动写代码的工具)并开启“高思考”模式,两三个小时就花了 10 美元,成本几乎赶上 Claude Opus。正文没披露具体用了多少 token、单价多少、跑的是什么任务,所以没法判断是模型本身贵还是调用太频繁。如果真是这个价,那 DeepSeek 的性价比优势就大打折扣了。目前信息缺口明显:没有 token 消耗量、没有任务类型、没有对比基准。建议等更多用户晒出账单明细再下结论,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
01:33
82d ago
AI HOT 精选· aihot-apiZH01:33 · 05·07
用 Chrome 调试 Codex App 的 3 步技巧
退出 Codex App,在命令行加参数 `--remote-debugging-port=8315` 启动,然后 Chrome 打开 `chrome://inspect` 就能连上调试工具。正文没提支持哪些版本或有没有安全限制,自己试的时候注意下。
#Code#Tools#dotey#Chrome
一句话点评
短评:给 Codex 套上 Chrome 调试器,适合想扒 AI 编程工具内部逻辑的人。 点评:dotey 分享了一个实用技巧:退出 Codex App 后,用命令行加参数 `--remote-debugging-port=8315` 启动,再在 Chrome 打开 `chrome://inspect` 就能连上 DevTools。这对想观察 Codex 如何调用模型、处理代码上下文的开发...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
01:29
82d ago
AI HOT 精选· aihot-apiZH01:29 · 05·07
Flue框架:用TypeScript写Claude Code风格智能体
Flue是一个新的TypeScript框架,帮你搭建类似Claude Code那种能自己跑流程的智能体。安装方式很特别:直接fetch一个start.md文件就能开始。但正文没披露许可证、版本号、维护者是谁,也没有跑分或对比数据,所以想用在生产环境还得再观望。
#Agent#Code#Flue#Claude
一句话点评
短评:安装方式很酷,但信息太少,生产慎用。 Flue 是一个新的 TypeScript 框架,号称能帮你搭出类似 Claude Code 那种能自己跑流程的智能体。亮点是安装方式:直接 fetch 一个 start.md 文件就能开始,挺有 Geek 范儿。但正文没披露许可证、版本号、维护者是谁,也没有任何跑分或对比数据,所以想用在生产环境还得再观望。如果是真的,对喜欢 TypeScrip...
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K0·R1
01:15
82d ago
彭博科技· rssEN01:15 · 05·07
韩国股市超越加拿大,升至全球第七
韩国股市总市值超过加拿大,成为全球第七大股票市场。彭博提到AI芯片需求是推手之一,但正文没披露具体市值数字、超越发生的时间点,也没点名哪些公司受益。
#South Korea#Canada#Bloomberg#Commentary
一句话点评
韩国股市总市值超过加拿大,升至全球第七,AI芯片需求是推手之一。
锐评
韩国股市总市值超过加拿大,升至全球第七,彭博把原因部分归到AI芯片需求上。这个排名变动本身不算意外——韩国半导体出口一直强劲,三星、SK海力士又是英伟达供应链上的关键角色。但正文没披露具体市值数字、超越发生的时间点,也没点名哪些公司受益,信息缺口不小。如果只看这个标题,容易误读成“韩国AI概念股全面爆发”,实际更可能是几家头部芯片厂撑起大盘。对关注亚太市场轮动的人是个信号:韩国正在吃掉一部分原本流向台湾或日本的半导体资金。但缺少数据支撑前,建议把它当趋势线索,别当交易依据。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K0·R0
01:05
82d ago
彭博科技· rssEN01:05 · 05·07
AI芯片需求推高股价,澜起科技超越宁德时代成最贵两地上市股
澜起科技(Montage Technology)在AI芯片需求推动下股价大涨,超越宁德时代成为A+H两地上市股中估值最贵的公司。正文没披露具体溢价幅度、股价涨幅和时间窗口,但信号很直接:AI芯片概念在A股的热度已经压过了新能源龙头。
#Montage Technology#CATL#Commentary
一句话点评
AI芯片概念在A股的热度已经压过了新能源龙头宁德时代。
锐评
澜起科技超越宁德时代,成为A+H两地上市股中估值最贵的公司。信号很直接:AI芯片概念在A股的热度已经压过了新能源龙头。正文没披露具体溢价幅度、股价涨幅和时间窗口,所以这个“最贵”到底贵多少、持续了多久,目前只能当风向标看,不能直接当交易信号。如果是真的,说明资金正在从确定性高的新能源切换到想象空间更大的AI芯片,但缺乏交易细节意味着短期情绪可能被放大。对从业者来说,这条信息更值得关注的是市场定价权的转移,而不是澜起本身的基本面变化。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R0
00:40
82d ago
r/LocalLLaMA· rssEN00:40 · 05·07
useknockout:开源去背景+超分API,MIT协议,跑在Modal上
useknockout 发了 v0.6.0,一个 FastAPI 服务包了 20 个接口。去背景用的是 BiRefNet 加 pymatting,超分支持 Swin2SR 或 Real-ESRGAN,能放大 2 倍或 4 倍。模型权重直接打包进 Docker 镜像,方便自己用 GPU 部署,还提供了一个免费测试接口。正文没披露具体延迟和成本,但跑在 M...
#Vision#Tools#useknockout#Modal
一句话点评
去背景和超分二合一的开源API,模型权重直接打包进Docker,适合自部署。
锐评
useknockout v0.6.0 把去背景(BiRefNet + pymatting)和超分(Swin2SR / Real-ESRGAN,2x/4x)打包成一个 FastAPI 服务,20 个接口,模型权重直接塞进 Docker 镜像,省去下载步骤。跑在 Modal 上,还提供了一个免费测试接口。对需要自建去背景/超分 API 的团队来说,省了整合多个模型的工作量。但正文没披露具体延迟和单次推理成本,跑在 Modal 上按秒计费,如果超分用 Real-ESRGAN 的 4x 模式,显存和耗时都不低。另外 BiRefNet 对复杂前景(头发丝、透明物体)的抠图效果不如商业方案,这点先别太激动。如果是高频调用,建议先压测再上生产。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
00:34
82d ago
r/LocalLLaMA· rssEN00:34 · 05·07
RTX 5090 vs M5 Max 128GB:本地跑智能体编程,选速度还是选内存?
Reddit 用户在纠结买 RTX 5090 还是 M5 Max 128GB 来本地跑 Qwen 3.6 27B 做智能体编程。5090 速度大约是 M5 Max 的三倍,但显存只有 32GB,只能塞下 Q4/Q5 量化模型,上下文窗口约 20 万 token;M5 Max 内存 128GB,可以跑更高精度的量化,还能同时驻留多个模型,但一次编码任务跑...
#Agent#Code#Inference-opt#Qwen
一句话点评
5090快三倍但显存小,M5 Max内存大但慢,选哪个看你要速度还是容量。
锐评
Reddit用户纠结本地跑Qwen 3.6 27B做智能体编程,在RTX 5090和M5 Max 128GB之间二选一。5090速度大约是M5 Max的三倍,但显存只有32GB,只能塞Q4/Q5量化模型,上下文窗口约20万token;M5 Max内存128GB,可以跑更高精度量化,还能同时驻留多个模型,但一次编码任务跑了1小时20分钟。 关键数字:速度差3倍、内存差4倍、32GB vs 128GB。这个对比对本地跑模型的开发者很实用——如果你主要跑单模型、追求响应速度,5090更合适;如果需要同时加载多个模型或跑长上下文,M5 Max的大内存是刚需。 缺什么:正文没披露具体任务复杂度、量化精度对比、功耗和散热表现,也没说M5 Max跑的是哪个量化等级。另外,5090的32GB显存跑27B模型,Q4量化下实际可用上下文长度可能比宣称的20万token更短,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
00:13
82d ago
彭博科技· rssEN00:13 · 05·07
Anthropic 想让 Claude 更讨消费者喜欢
Bloomberg 报道 Anthropic 正在把 Claude 从企业工具往日常消费场景推,说 Claude 在消费者端已经有了一些进展。但正文没披露具体功能、定价、上线时间或用户规模。关键看点其实是记忆、工具调用和移动端体验——这些才是决定一个聊天机器人能不能被普通人日常用起来的门槛。信息缺口挺大,目前只能当方向信号看。
#Agent#Tools#Memory#Anthropic
一句话点评
Anthropic 想把 Claude 从企业工具推向日常消费场景,但正文没披露具体功能、定价或上线时间。
锐评
Bloomberg 这条消息更像一个方向信号,不是产品公告。Anthropic 要做消费端,关键看三个门槛:记忆(Claude 能不能记住用户偏好)、工具调用(能不能替用户执行操作)、移动端体验(App 好不好用)。正文没披露任何用户规模或留存数据,也没说 Claude 目前在消费者端到底做了什么。如果是真的,这意味着 Anthropic 在跟 ChatGPT 抢日常使用场景,但信息缺口太大,目前只能当战略意图看,不能当产品判断。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
00:00
82d ago
● P1OpenAI 博客· rssEN00:00 · 05·07
OpenAI 在 ChatGPT 推出 Trusted Contact 安全功能
OpenAI 给 ChatGPT 加了一个可选的安全功能。成年人可以在设置里指定一位信任的联系人,比如家人或朋友。当系统自动监测和人工审核都判定你的对话里出现了严重的自我伤害倾向时,ChatGPT 会通知这位联系人。通知内容很克制,只说出现了需要关心的自伤话题,不会透露聊天细节。正文没披露具体的检测机制和误报率,只说审核团队会争取在一小时内完成判断。这...
#Safety#OpenAI#ChatGPT#Product update
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 给 ChatGPT 加了个“信任联系人”功能,用户可指定一位亲友,当系统判定对话涉及严重自伤风险时,经人工审核后会通知对方。
锐评
这个功能本质上是把危机干预里的“社会支持”做成产品开关。用户自愿设一个信任联系人,系统用自动化监控加人工复核来判断是否触发通知。通知内容很克制,只说可能涉及自伤,不给聊天记录,还附上怎么聊敏感话题的指南。OpenAI 说审核团队争取在一小时内完成复核,但正文没披露误报率、审核团队规模和实际响应时间的中位数。这点先别太激动——它不替代专业危机服务,只是多一层提醒。还缺的关键信息是:触发阈值怎么定、人工审核的标准一致性如何保证,以及用户会不会因为担心被通知而不敢在对话里说真话。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
00:00
82d ago
Computing Life · Share · 鸭哥调研· rssZH00:00 · 05·07
OpenAI 和 Cursor 都从 Skill 转向 Plugin,但一个想锁工作流,一个想防被替代
OpenAI 和 Cursor 在 2026 年 4-5 月几乎同时把重心从 Skill 转向 Plugin。Skill 的盈利死结在于:它是明文文件,买家付完就能贴到 GitHub 上,复制成本为零,定价权也为零;做成托管服务等于卖 AWS 转售;数据飞轮也走不通。Plugin 比 Skill 多了三样东西:运行环境绑定、认证凭证、分发渠道,本质是把...
#Agent#Tools#OpenAI#Cursor
一句话点评
OpenAI 和 Cursor 几乎同时从 Skill 转向 Plugin,但动机不同:OpenAI 怕模型变商品,想用 Codex 执行层锁住工作流;Cursor 怕被上游模型商(如 Anthropic)替代,想用 Plugin 生态建差异化。文章拆得清楚:Skill 是明文文件,复制零成本,没法收钱;Plugin 加了运行环境、认证和分发,把知识变成可收费的服务。关键数字:Codex 周...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1

更多

频道

后台