ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-16

50 items · updated 3m ago
RSS live
2026-05-16 · 星期六2026年5月16日
23:39
72d ago
r/LocalLLaMA· rssEN23:39 · 05·16
有人试过 MTP 预发布分支吗?速度能快 20%
一位用户在双路 Xeon 8268 CPU 加 Tesla T4 的机器上测试了 llama.cpp 的 MTP 预发布分支,输出速度约 38 tokens/s,比正式版的 30 tokens/s 快了约 20%。正式版还在轻量编码时崩溃过,预发布版反而没出问题。不过这只是单用户单配置的体验,正文没披露 MTP 分支的具体改动或稳定性测试,这点先别太激动。
#Inference-opt#Vision#Code#Reddit
一句话点评
一位用户在双路Xeon 8268加Tesla T4上测试llama.cpp的MTP预发布分支,输出速度约38 tokens/s,比正式版30 tokens/s快约20%。正式版轻量编码时崩溃,预发布版反而没出问题。不过这只是单用户单配置体验,正文没披露MTP分支的具体改动或稳定性测试,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H1·K1·R1
23:04
72d ago
AI HOT 精选· aihot-apiZH23:04 · 05·16
Figure人形机器人连续自主运行四天,仓库里干到第四天没停
Figure的F.03机器人在真实仓库里24小时不间断干活,抓取、搬运、分拣,已经连续跑了四天。测试目的是看它能撑多久、出什么故障、怎么恢复。之前人形机器人大多是演示单次动作,这次是测持续工作能力,离实用更近一步。正文没披露具体故障次数和维护间隔,所以这点先别太激动,但能连续跑四天本身是个信号。
#Robotics#Agent#Figure#Benchmark
一句话点评
Figure的F.03机器人在真实仓库里连续自主运行四天,抓取、搬运、分拣,测的是持续工作能力而非单次演示。正文没披露故障次数和维护间隔,这点先别太激动,但能跑四天本身是个信号——人形机器人从‘能动’往‘能干’迈了一步。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
22:23
72d ago
Hacker News 首页· rssEN22:23 · 05·16
Zerostack:一个纯 Rust 写的 Unix 风格编程代理
Zerostack 在 crates.io 上发布了 1.0.0 版本,自称是受 Unix 启发的编程代理,用纯 Rust 实现。正文没披露它的架构、工具接口或跑分结果,所以目前只能知道它是个新工具,具体能力还不清楚。
#Agent#Code#Tools#Zerostack
一句话点评
一个纯 Rust 写的编程代理,号称受 Unix 启发,但正文没披露架构、工具接口或跑分。目前只有 crates.io 上的包,0 条评论,15 个点赞,社区还没验证。如果是真的,纯 Rust 意味着低资源占用和强隔离,但没跑分前先打个折。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
22:19
72d ago
r/LocalLLaMA· rssEN22:19 · 05·16
Qwen 3.6 35B 在双 3090 上跑 MTP 后速度掉到 80 t/g,有人试出更好的方案吗?
Reddit 用户分享在双 RTX 3090 上跑 Qwen 3.6 35B 的实测:分两层部署时 prompt 处理速度 1500 token/秒,生成速度 120 token/秒;但 llama.cpp 合并 MTP(多 token 预测,让模型一次猜多个 token 来加速推理)后,生成速度降到 80 token/秒。该用户目前改用 CPU 溢出...
#Inference-opt#Qwen#llama.cpp#NVIDIA
一句话点评
双3090跑Qwen 3.6 35B,MTP合并后生成速度从120掉到80 token/秒,反而变慢了。用户改用CPU溢出方案,prompt处理冲到3500 token/秒,但生成还是80。MTP理论上能加速,实测却降速,说明当前实现或配置还有坑。正文没披露具体MTP参数和模型量化精度,这两点对结果影响很大。社区还在等优化,别急着上MTP。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R1
21:54
72d ago
r/LocalLLaMA· rssEN21:54 · 05·16
Qwen3.5-122B 量化版实测:Q5 跑出 20 tok/s,比 Q6 快 18%
Reddit 用户用 llama.cpp 的 MTP 模式跑了两个 Qwen3.5-122B 的量化版。Q5 版本在 4200 个评估 token 上达到 20.24 tok/s,Q6 版本在 3283 个 token 上跑到 17.17 tok/s。Q5 比 Q6 快了约 18%,但精度损失多少正文没披露。MTP 是让模型在生成时提前预测多个 tok...
#Inference-opt#Benchmarking#Qwen#Unsloth
一句话点评
Qwen3.5-122B 量化版在 llama.cpp 的 MTP 模式下跑出 20 tok/s,比 Q6 快 18%,但精度损失没披露。MTP 就是让模型生成时提前猜多个 token,类似投机解码。测试 token 数只有几千,参考价值有限。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
21:34
72d ago
r/LocalLLaMA· rssEN21:34 · 05·16
有人在 Mac mini 上跑通了 δ-mem 长记忆方案,LoCoMo 评分从 0.05 涨到 0.18
一位 Reddit 用户把 δ-mem(一种给大模型加长期记忆的新方法)移植到了 MLX 框架上,在 64GB 内存的 Mac mini 上跑 Qwen3-4B-Instruct。搭配 OpenClaw 历史记录后,LoCoMo-10 mini 长程记忆评分从 0.05 提升到 0.18(满分未知,但涨幅接近 3.7 倍),OpenClaw 回放测试的...
#Memory#Agent#Benchmarking#Apple
一句话点评
有人在64GB Mac mini上把δ-mem(一种给大模型加长期记忆的新方法)移植到了MLX框架,跑Qwen3-4B。长程记忆评分从0.05涨到0.18,涨了近3.7倍,延迟只多了30%。但注意:这是4B小模型,评分满分未知,且正文被屏蔽,没披露测试集规模和复现细节。如果是真的,低成本本地记忆方案挺省钱。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
19:58
72d ago
AI HOT 精选· aihot-apiZH19:58 · 05·16
彭博:美国AI相关岗位开始出现大规模裁员
彭博报道称,美国那些容易被AI替代的岗位已经开始出现大规模裁员。但正文没披露具体裁员人数、受影响行业以及衡量标准,所以这个结论的力度有多大还不好判断。
#Bloomberg#Commentary
一句话点评
彭博报道美国AI相关岗位开始大规模裁员,但正文没披露具体裁员人数、受影响行业以及衡量标准,所以这个结论的力度有多大还不好判断。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
19:51
72d ago
r/LocalLLaMA· rssEN19:51 · 05·16
本地跑 Qwen 3.6 写 HTML 动画,效果接近顶级模型,速度 2.7 token/秒
有人在 Reddit 上拿同一个“单文件 HTML Canvas 驾驶动画”的 prompt 测了 11 个模型,本地跑的 Qwen3.6-27B Q4_K_M 主观排名第二,仅次于 Kimi k2.6 Thinking,还超过了 Claude-opus-reasoning-distilled 的 27B 量化版。代价是速度只有 2.70 tok/s,...
#Code#Benchmarking#Qwen#Claude
一句话点评
本地跑 Qwen3.6-27B 量化版,写一个 HTML Canvas 驾驶动画,主观效果排第二,只输给 Kimi k2.6 Thinking,还压过了 Claude 蒸馏版。代价是速度只有 2.7 tok/s,几乎没法交互。测试只有一条 prompt,样本太少,排名参考价值有限。正文被 Reddit 屏蔽,没披露具体评分标准和硬件配置,量化对效果的影响也不清楚。如果是真的,说明小模型在特定...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
19:43
72d ago
AI HOT 精选· aihot-apiZH19:43 · 05·16
Codex 现在能自定义键盘快捷键了
Codex 更新了键盘快捷键自定义功能,你可以在设置里按自己的习惯改键位,不用再死记默认组合。正文没提版本号、支持哪些平台、以及什么时候推送给所有用户,所以想用的话得自己去设置里翻一翻。
#Code#Tools#Product update
一句话点评
Codex 终于能自定义快捷键了,不用再死记默认组合。正文没提版本号、支持哪些平台、以及什么时候推送给所有用户,想用的话得自己去设置里翻一翻。短评:改键位这种基础功能现在才加,说明之前团队优先级不在这。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K1·R0
18:58
73d ago
r/LocalLLaMA· rssEN18:58 · 05·16
一年后我换掉了IDE里的AI补全,改用命令行编码代理
Reddit用户/ievkz分享过去一年的编程习惯变化:不再用IDE里的AI自动补全,转而使用一个支持@引用文件的命令行编码代理。IDE现在只用来做Git对比、调试和导航,这部分工作估计只占他全部工作的5-10%。正文没披露他用的是哪个具体工具或模型,但核心判断是:补全式的AI辅助效率低,不如让代理在终端里直接操作文件。
#Agent#Code#Tools#JetBrains
一句话点评
一位Reddit用户说过去一年编程习惯变了:不再用IDE里的AI自动补全,改用命令行编码代理(@引用文件),IDE只用来做Git对比、调试和导航,这部分只占他工作的5-10%。正文没披露他用的是哪个工具或模型。核心判断是:补全式AI效率低,不如让代理在终端直接操作文件。这点先别太激动——这只是个人经验,样本量1,且没提具体工具和效果对比。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
18:31
73d ago
AI HOT 精选· aihot-apiZH18:31 · 05·16
Codex 现在支持自定义快捷键了
OpenAI Devs 说 Codex 现在可以在设置里自定义键盘快捷键,让你按自己的习惯来,不用硬记默认键位。正文没提支持哪些平台、什么时候上线、或者需要什么版本,所以想用的话得自己去设置里翻一翻。
#Code#Tools#OpenAI#Product update
一句话点评
Codex 现在能自定义快捷键了,不用硬记默认键位,按自己习惯来就行。不过正文没披露支持哪些平台、什么时候上线、需要什么版本,想用的话得自己去设置里翻一翻。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H0·K1·R1
18:12
73d ago
r/LocalLLaMA· rssEN18:12 · 05·16
OpenReader:开源文档朗读器,支持 EPUB/PDF 导出有声书
OpenReader v3.0.0 是一个开源的文档朗读服务器,支持 EPUB、PDF、DOCX、TXT 和 Markdown 格式。它可以用 OpenAI、Replicate、Deepinfra 或自托管的 OpenAI 兼容 API 来生成语音,还能通过 ffmpeg 导出带章节元数据的 m4b/mp3 有声书。简单说就是:你丢进去一本书或一篇文档...
#Audio#Tools#OpenReader#OpenAI
一句话点评
OpenReader v3.0.0 是一个开源文档朗读服务器,支持 EPUB、PDF、DOCX、TXT 和 Markdown 格式。它可以用 OpenAI、Replicate、Deepinfra 或自托管的 OpenAI 兼容 API 来生成语音,还能通过 ffmpeg 导出带章节元数据的 m4b/mp3 有声书。简单说就是:你丢进去一本书或一篇文档,它帮你读出来,还能导出成有声书。 短评...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
17:43
73d ago
Product Hunt · AI· rssEN17:43 · 05·16
CtrlOps:用自然语言管 Linux 服务器,部署从 60 分钟缩到 5 分钟
CtrlOps 是一个 AI 终端工具,让你用自然语言给 Linux 服务器下命令,比如部署、调试、监控。它内置脚本库、可视化文件管理、一键从 GitHub 仓库部署,号称原来 60 分钟的部署现在 5 分钟搞定。所有操作在本地执行,凭据不出机器,服务器上不需要装任何代理。目前支持 Mac、Windows、Linux,有免费选项。不过正文没披露定价细节...
#Agent#Code#Tools#CtrlOps
一句话点评
CtrlOps 让你用自然语言给 Linux 服务器下命令,部署、调试、监控一条龙,号称 60 分钟变 5 分钟。所有操作本地执行,凭据不出机器,服务器不用装代理,这点对安全敏感的用户挺友好。但正文没披露定价细节、权限控制粒度、支持哪些发行版,以及 AI 生成命令出错了怎么兜底。短评:省时间但缺安全细节,先别急着上生产。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R1
17:19
73d ago
r/LocalLLaMA· rssEN17:19 · 05·16
海盗船出AI工作站:Ryzen 395 + 128GB统一内存,能跑大模型吗?
Reddit 上有人贴了海盗船 AI Workstation 300 的配置单:Ryzen AI Max 395 处理器、128GB LPDDR5X 内存(最多可分 96GB 给显存用)、1TB 固态。统一内存意味着 CPU 和 GPU 共享这 128GB,跑大模型时显存上限比普通消费卡高不少,但正文没披露实际跑模型的速度、能跑多大参数量的模型,也没说...
#Inference-opt#Corsair#AMD#Reddit
一句话点评
海盗船这台工作站用 Ryzen AI Max 395 和 128GB 统一内存,最多能分 96GB 给显存,跑大模型显存上限比普通消费卡高不少。但正文没披露实际跑模型的速度、能跑多大参数量的模型,也没说价格。统一内存带宽有限,跑推理可能比不过独立显卡,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K1·R1
17:02
73d ago
r/LocalLLaMA· rssEN17:02 · 05·16
iOS 上跑本地大模型,哪个 App 能稳定调用自家后端?
Reddit 用户想找个 iOS App,能连自己电脑上的本地推理后端(兼容 OpenAI 接口)。他试了四个:Apollo、Locally AI、Noema、3 Sparks。3 Sparks 能用,但缺 MCP 和联网搜索;Noema 连 Mac Studio 跑 DeepSeek V4 Flash 直接卡死。正文没披露具体报错或硬件配置,所以问题...
#Agent#Tools#Inference-opt#3 Sparks
一句话点评
Reddit 用户想找个 iOS App 连本地推理后端,试了四个:Apollo、Locally AI、Noema、3 Sparks。3 Sparks 能用但缺 MCP 和联网搜索;Noema 连 Mac Studio 跑 DeepSeek V4 Flash 直接卡死。正文没披露具体报错或硬件配置,所以问题可能出在兼容性或资源占用上。目前没有完美方案,选型得看你对 MCP 和搜索的需求是否迫切。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H0·K1·R1
16:41
73d ago
r/LocalLLaMA· rssEN16:41 · 05·16
Strix Halo 跑 Llama.cpp:27B 模型靠 MTP 提速 22%,35B 反而变慢
有人在 Strix Halo 上测了 Llama.cpp 的 MTP(多 token 预测,即一次预测多个 token 来加速推理)。Qwen3.6-27B-MTP 在 5 轮对话、约 28.5k 上下文下,总耗时从 258.65 秒降到 200.55 秒,快了约 22%。但同设置下 Qwen3.6-35B-MTP 反而从 58.86 秒涨到 60.2...
#Inference-opt#Benchmarking#Qwen#Unsloth
一句话点评
AMD Strix Halo 上测了 Llama.cpp 的多 token 预测(MTP,一次预测多个 token 加速推理)。Qwen3.6-27B 快了约 22%,但 35B 反而慢了。好消息是 27B 在本地跑长对话能省点时间,坏消息是 35B 不升反降,说明 MTP 对模型大小和硬件很敏感。正文没披露具体硬件配置和功耗,这点先别太激动。如果是真的,对本地部署 27B 模型挺省钱。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
16:38
73d ago
AI HOT 精选· aihot-apiZH16:38 · 05·16
vLLM 宣布支持万亿参数模型,但正文没给细节
vLLM 团队发推说社区协作又成了,vLLM 现在能跑万亿参数模型。但正文只感谢了社区,没提具体模型名字、参数到底多少、怎么实现的、能不能复现。标题很猛,信息缺口也很大。
#Inference-opt#vLLM#Product update#Open source
一句话点评
短评:标题说能跑万亿参数,正文只感谢社区,没提模型名、参数数、实现方式。信息缺口太大,先别激动。 标题很猛,但正文只有一句“又一次Day0协作,又一次社区胜利”,连模型名字都没提。万亿参数是稀疏MoE还是稠密?用了多少卡、什么硬件、延迟多少?能不能复现?全没披露。vLLM团队一贯靠谱,但这条更像社区感谢信而非技术公告。建议等具体实现细节出来再评估,目前信息不足以判断这是真突破还是标题党。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K0·R1
15:37
73d ago
The Verge · AI· rssEN15:37 · 05·16
索尼解释 Xperia 1 XIII 的 AI 相机助手:不修图,只给建议
索尼澄清,Xperia 1 XIII 的 AI 相机助手不会自动修图,而是根据光线、景深和拍摄对象,给出曝光、色彩和背景虚化的四种调节建议。它还会推荐“最上镜的角度”,但演示视频里只是建议用户拉近镜头,跟真正找角度不是一回事。索尼之前发的宣传帖引发争议,现在赶紧出来解释。
#Vision#Sony#The Verge#Product update
一句话点评
索尼Xperia 1 XIII的AI相机助手不是自动修图,而是根据光线、景深给四种曝光/色彩/虚化建议,还会推荐“最上镜角度”——但演示里只是让用户拉近镜头,跟找角度两码事。索尼之前宣传翻车,现在赶紧澄清。实际效果存疑,建议等实测。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K1·R0
15:28
73d ago
r/LocalLLaMA· rssEN15:28 · 05·16
用 Apple Watch 录音,iPhone 本地转文字,还接入了 Notion 和 Obsidian
开发者发布了一款叫 Dictawiz 的 iOS 应用,核心卖点是 Apple Watch 录音后直接在 iPhone 上本地转文字,用的是 Parakeet 和 Whisper 模型,不需要联网。还做了一个自定义键盘,可以在任何 App 里语音输入。支持发送到 Notion、Obsidian,甚至通过自定义 webhook 和 Cloudflare ...
#Audio#Tools#Memory#Apple
一句话点评
Dictawiz 让 Apple Watch 录音后直接在 iPhone 本地转文字,用了 Parakeet 和 Whisper 模型,不联网。还做了自定义键盘,能在任何 App 里语音输入,支持发到 Notion、Obsidian 和自定义 webhook。亮点是本地运行,隐私好,但正文没披露延迟、定价、模型大小和准确率。如果是小模型,长录音或嘈杂环境可能翻车。适合快速记想法,但别当主力转...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
15:18
73d ago
r/LocalLLaMA· rssEN15:18 · 05·16
给 llama.cpp 加自定义采样器,有人写了个防重复循环的 demo
DeProgrammer99 给 llama-server 做了个自定义采样器扩展原型,附带一个 C++ 写的循环检测器——专门打断重度量化模型里常见的 1-3 token 重复循环。这个分支基于合并了 MTP(多 token 预测)后的 llama.cpp master,兼容推测解码,还提供了 Windows x64 Vulkan 编译版和一条示例命...
#Inference-opt#Code#Tools#DeProgrammer99
一句话点评
DeProgrammer99 给 llama.cpp 的 llama-server 做了个自定义采样器扩展原型,附带一个 C++ 写的循环检测器,专门打断重度量化模型里常见的 1-3 token 重复循环。这个分支基于合并了 MTP(多 token 预测)后的 llama.cpp master,兼容推测解码,还提供了 Windows x64 Vulkan 编译版和一条示例命令。 短评:量化...
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H0·K1·R1
14:54
73d ago
AI HOT 精选· aihot-apiZH14:54 · 05·16
烧吧,宝贝,烧吧:一个帮你销毁代币的开源工具
开发者 dtnewman 在 GitHub 上开源了一个叫“Burn, Baby, Burn”的工具,让用户自己销毁(burn)持有的代币,从而减少总供应量。这个项目在 Hacker News 上拿到了 100 个点赞。简单说,就是你想让某个代币变稀缺,可以用它把一部分代币永久打入黑洞。项目本身是命令行工具,代码量不大,适合懂点技术的用户自己操作。正文...
#GitHub#Hacker News#Open source
一句话点评
一个命令行工具,让你自己销毁持有的代币,减少总供应量。项目在 HN 上拿了 100 赞,但代码量不大,适合懂技术的用户自己操作。正文没披露支持哪些链、有没有合约验证,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
28
SCORE
H0·K0·R0
14:40
73d ago
r/LocalLLaMA· rssEN14:40 · 05·16
Lemonade 本地 AI 工具 macOS 版转正,一个 3MB 的二进制文件跑三大系统
Lemonade 宣布 macOS 支持结束测试,正式可用。这个本地 AI 工具只有一个 3MB 的便携二进制文件,就能在 Linux、Windows 和 macOS 上跑。目前开放了五大能力:OmniRouter(路由)、编程、图片生成、语音生成和语音转文字。3MB 的体积意味着几乎不占硬盘,启动快,适合随身带一个 U 盘跑本地模型。但正文没披露具体...
#Multimodal#Code#Audio#Lemonade
一句话点评
Lemonade 的 macOS 版正式上线,核心卖点是那个 3MB 的便携二进制文件,跨平台(Linux、Windows、macOS)都能跑,启动快,适合 U 盘随身带。目前开放了路由、编程、图片生成、语音合成和转写五大能力。但正文被屏蔽,没披露具体支持哪些模型、性能如何、是否依赖联网。3MB 体积确实轻量,但能力覆盖这么广,实际跑起来对硬件要求可能不低,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
14:15
73d ago
r/LocalLLaMA· rssEN14:15 · 05·16
同一个双摆模拟题,Claude 和 DeepSeek 选了相反的物理约定,一秒就能看出差异
作者用完全相同的提示词让 Claude 3.5 Sonnet 和 DeepSeek V3 模拟双摆运动,初始条件都是 θ1=π/2、θ2=π/2、角速度为零。在同一个渲染器下,两个模型输出的动画在一秒内就出现镜像行为——一个摆向左,另一个摆向右。这说明模型对物理约定(比如角度正方向的定义)有不同理解,而且这种差异在动态模拟中会立刻暴露。正文没披露具体用...
#Code#Reasoning#Benchmarking#Claude 3.5 Sonnet
一句话点评
同一个双摆提示词,Claude 3.5 Sonnet 和 DeepSeek V3 跑出镜像动画,一秒内就看出方向相反。问题出在模型对角度正负的默认约定不同,不是谁对谁错,而是物理模拟里这种隐性偏差会立刻暴露。正文没披露具体用了哪个渲染器、跑了多少次、是否复现,所以这点先别太激动——它更像一个有趣的观察,不是严谨评测。对做代码生成或物理仿真的团队有提醒价值:模型对物理常识的“默认值”可能不一致...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
13:46
73d ago
AI HOT 精选· aihot-apiZH13:46 · 05·16
杭州开了个国家级机器人训练基地,给具身智能搞“职业技能培训”
5月16日,国家人工智能应用中试基地(具身智能)在杭州挂牌启用,相当于给机器人建了一个国家级“职业技能训练场”。这个基地既展示已经落地的商业场景,也演示数据采集和技能训练过程,目的是帮机器人技术从实验室往真实应用走。杭州还从5月1日起施行了全国首部具身智能机器人地方性法规,要求建设中试和检测平台,并推动机器人在应急救援、医疗康养等领域落地。目前杭州已有...
#Robotics#Hangzhou#国家人工智能应用中试基地#Policy
一句话点评
杭州搞了个国家级机器人训练基地,5月16日挂牌,相当于给机器人建了个“职业技能训练场”。当地已有700多家机器人相关企业,2025年产业集群产值1068亿元。5月1日还施行了全国首部具身智能地方性法规,要求建中试和检测平台,推动机器人在应急救援、医疗康养等领域落地。基地展示商业场景和数据采集过程,帮技术从实验室走向应用。但正文没披露基地具体训练能力、开放时间或企业入驻细节,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R0
12:49
73d ago
r/LocalLLaMA· rssEN12:49 · 05·16
有人用开源模型做了个代码审查工具,声称比 CodeRabbit 便宜 6 倍
Reddit 用户 Axintwo 发帖说,他做的 PrixAI 用开源模型做 PR 代码审查,在一个测试 PR 里 10 个埋点问题全抓出来了。价格方面,CodeRabbit 标价每月 60 美元,PrixAI 声称便宜 6 倍,也就是大概 10 美元。不过正文没披露具体用了哪些开源模型、跑在什么硬件上、延迟怎么样,也没说是不是本地部署。如果真能 1...
#Code#Agent#CodeRabbit#PrixAI
一句话点评
Reddit 用户 Axintwo 用开源模型做了个 PR 代码审查工具 PrixAI,号称比 CodeRabbit 便宜 6 倍(月费约 10 美元 vs 60 美元),并在一个测试 PR 中 10 个埋点问题全抓出来了。但正文没披露具体用了哪些开源模型、跑在什么硬件上、延迟如何,也没说是否本地部署。如果真能 1/6 的价格做到同等效果,对个人开发者和小团队挺有吸引力,但验证太弱——一个测...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
12:11
73d ago
Product Hunt · AI· rssEN12:11 · 05·16
pixserp:一个API接口,让大模型直接查实时网页,支持10种答案格式
pixserp 是一个给大模型用的实时网页搜索API,一个接口就能查网页、新闻、图片、地点、购物、航班、酒店、YouTube、字幕和任意URL,结果自带引用。价格是每1000次请求1.5美元,作者说比Perplexity Sonar Pro(约19美元/千次)便宜很多。响应时间大约1.5秒,支持流式输出。可以直接替换OpenAI SDK的base_ur...
#RAG#Tools#pixserp#Product update
一句话点评
pixserp 是一个给大模型用的实时网页搜索API,一个接口就能查网页、新闻、图片、地点、购物、航班、酒店、YouTube、字幕和任意URL,结果自带引用。价格是每1000次请求1.5美元,作者说比Perplexity Sonar Pro(约19美元/千次)便宜很多。响应时间大约1.5秒,支持流式输出。可以直接替换OpenAI SDK的base_url,集成成本低。 短评:一个接口查十种...
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H0·K1·R0
11:34
73d ago
Hacker News 首页· rssEN11:34 · 05·16
OpenClaw 作者一个月烧了 130 万美元的 OpenAI 接口费
OpenClaw 的开发者发推说,30 天内光 OpenAI 的 token 就花了 130 万美元。正文没披露具体用了多少 token、调了哪些模型、有没有折扣或包月协议,也没有账单截图。如果是真的,这个烧钱速度说明要么用户量极大,要么每个请求都用了最贵的模型(比如 GPT-4 Turbo 或 o1)。但信息缺口太大,没法判断是真实成本还是营销噱头。
#OpenClaw#OpenAI#Commentary
一句话点评
OpenClaw 开发者称30天烧了130万美元OpenAI token费,约合每天4.3万美元。正文没披露具体用量、模型组合或是否有折扣协议,也无账单截图。如果是真的,要么用户量极大,要么每个请求都用了最贵模型(如GPT-4 Turbo)。但信息缺口太大,无法判断是真实成本还是营销噱头。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
11:03
73d ago
r/LocalLLaMA· rssEN11:03 · 05·16
给显卡降功耗,跑本地模型更省电
Reddit 用户 NotArticuno 实测给 GPU 降功耗墙(power limit)对本地推理的影响。测试用 qwen3.5:9b 模型,跑 TG128 生成和 PP512 处理。正文没披露具体显卡型号和数字结果,所以省了多少电、速度掉多少都不清楚。思路本身对自建服务器或长期跑推理的人有价值——降功耗能省电费、降温度,适合不在意那点速度损失的用户。
#Inference-opt#NotArticuno#Qwen#Commentary
一句话点评
Reddit 用户实测给 GPU 降功耗墙跑本地推理,思路对自建服务器或长期跑推理的人有价值——省电费、降温度。但正文没披露具体显卡型号和数字结果,省了多少电、速度掉多少都不清楚,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
10:22
73d ago
机器之心 · 公众号· rssZH10:22 · 05·16
Anthropic 让 Claude Code 跑在卡片大小的开发板上
Anthropic 在 Code With Claude 活动上给开发者发了一台 Cardputer,这是一块 ESP32-S3 掌上开发板,大小跟卡片差不多。官方说它能跑完整的 Claude Code,也就是让开发者在这块小板上直接写代码、调模型。正文没披露具体跑起来延迟多高、能处理多复杂的任务,但能在这么小的硬件上塞进一个完整的 AI 编程助手,成...
#Code#Tools#Anthropic#Claude
一句话点评
Anthropic 给开发者发了张卡片大小的 ESP32-S3 开发板,说能跑完整 Claude Code。听着挺酷,但正文没披露延迟和任务复杂度——这么小的硬件跑完整编程助手,大概率只能处理极简单的代码补全或脚本,别指望能写复杂项目。更像一个概念验证或开发者玩具,离实用还有距离。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
10:22
73d ago
机器之心 · 公众号· rssZH10:22 · 05·16
2026杭州具身智能大赛:不比炫技,比谁真能干活
2026年杭州国际具身智能场景应用大赛设了三个赛道,200多支队伍在真实场景里比干活——消防、电力巡检、数据中心、水下救援、仓库物流。正文没披露具体技术方案和评分标准,但方向很明确:别光秀走路翻跟头,得能进真实环境解决实际问题。
#Robotics#Agent#Multimodal#机器之心
一句话点评
短评:比赛方向务实,但没披露技术细节和评分标准,先别太激动。 2026年杭州这场具身智能大赛,200多支队伍在消防、电力巡检、数据中心、水下救援、仓库物流等真实场景里比干活,而不是比走路翻跟头。方向是对的——行业确实需要从炫技转向解决实际问题。但正文没披露具体技术方案、评分标准、参赛队伍的技术水平,也没说这些场景的难度系数和真实环境还原度。所以这个比赛的意义更多是信号:政策方和产业方在推动...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
09:30
73d ago
Hacker News 首页· rssEN09:30 · 05·16
Δ-Mem:给大模型加一个超小内存,不用改模型结构就能记住历史
这篇论文提出了一种叫 Δ-Mem 的轻量记忆机制,核心思路是给一个已经训练好的、参数冻结的大模型(full-attention backbone)外挂一个固定大小的在线记忆状态。这个状态矩阵通过 delta 规则(一种增量更新算法)不断压缩和存储历史信息,生成时再用它的输出去修正注意力计算,相当于给注意力加了一个低秩的“记忆偏置”。效果上,只用了一个 ...
#Memory#Research release
一句话点评
给冻结的大模型外挂一个8×8的记忆状态矩阵,用delta规则增量压缩历史,推理时修正注意力计算。MemoryAgentBench涨了31%,LoCoMo涨了20%,成本极低——8×8矩阵几乎不占显存。但论文没披露延迟对比,也没说长上下文场景下记忆是否会饱和。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
07:28
73d ago
AI 群聊日报· atomZH07:28 · 05·16
Bloomberg 数据:AI 高暴露岗位连续两年下降,Technical Writer 跌 18%;Anthropic 全员重置 Claude Code 限额
Bloomberg 报道,BLS 标记的 18 个 AI 高暴露职业 2024-2025 年整体就业降 0.2%,同期全美增 0.8%。Technical writer 跌 18%,图形设计师跌 7.7%,客服跌 4.8%。群友感叹“居然现在才开始减”,并预测 UI 翻译师也快没了。Anthropic 周五惊喜全员重置了 Claude Code 的 5...
#Agent#Code#Tools#Bloomberg
一句话点评
Bloomberg 数据:BLS 标记的 18 个 AI 高暴露职业 2024-2025 年就业降 0.2%,同期全美增 0.8%。Technical writer 跌 18%,图形设计师跌 7.7%,客服跌 4.8%。群友感叹“居然现在才开始减”,并预测 UI 翻译师也快没了。Anthropic 周五惊喜全员重置了 Claude Code 的 5 小时和周限额,但原本的 reset 时间不...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1

更多

频道

后台