ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-06-02

50 items · updated 3m ago
RSS live
2026-06-02 · 星期二2026年6月2日
18:00
56d ago
The Verge · AI· rssEN18:00 · 06·02
Google 电话 App 新增防诈骗功能:冒充联系人来电会直接标可疑
Google 在 6 月 Android 更新里给电话 App 加了个新功能:如果诈骗电话用了你通讯录里某个联系人的号码打进来,App 会直接标成可疑,提醒你挂断。正文没披露它怎么判断是冒充的——是靠网络特征、通话行为还是别的,这点先别太激动。另外这次更新还让三星 S25 等设备支持苹果 AirDrop、把个人安全 App 开放给 13 岁以下孩子、以...
#Safety#Google#Apple#Samsung
一句话点评
Google 电话 App 能识别冒充你通讯录联系人的诈骗来电并标记可疑。关键信息缺口:正文没披露检测机制——是靠网络特征、通话行为还是 AI 分析语音?这点先别太激动。如果只是号码比对,那诈骗犯换号就能绕过。亮点是集成在系统电话 App 里,覆盖广、零操作成本。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
17:58
56d ago
Hacker News 首页· rssEN17:58 · 06·02
GitHub Copilot 桌面端预览:从 issue 到合并,一个 App 搞定
GitHub 放出了一个 Copilot 桌面 App 的技术预览,主打“代理驱动开发”——你可以在一个 App 里接 issue、让 AI 代理干活、审查 diff 然后合并,甚至让代理自己闭环。支持同时跑多个代理会话,每个隔离且实时跟踪,还能用 MCP 服务器和自定义技能扩展工作流。目前是 waitlist 模式,但 Copilot Pro/Pro...
#Code#Tools#GitHub#Product update
一句话点评
GitHub 把 Copilot 做成了一个桌面 App,主打“从 issue 到合并全程代理干活”,还能同时跑多个隔离的代理会话,支持 MCP 服务器扩展。目前是 waitlist 预览,Copilot Pro/Pro+ 用户可申请。正文没披露具体延迟、成功率或定价变化,这点先别太激动。如果真能稳定闭环 issue,对团队协作效率提升明显,但代理驱动的可靠性才是关键。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
17:56
56d ago
AI HOT 精选· aihot-apiZH17:56 · 06·02
OpenClaw 与微软合作,进入企业生态
OpenClaw 宣布与微软合作,将其带入微软和 Windows 生态系统,现在可以在企业环境中安全运行。正文未披露部署细节、安全机制、定价或上线时间。
#Agent#Tools#OpenClaw#Microsoft
一句话点评
OpenClaw 宣布与微软合作,现在能在企业环境里安全跑了。但正文没披露部署细节、安全机制、定价和上线时间,这点先别太激动。合作本身是好事,但具体怎么落地、成本多少都还是未知数。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
17:47
56d ago
TechCrunch AI· rssEN17:47 · 06·02
亚马逊因 Ring 门铃人脸识别功能被集体诉讼
亚马逊被集体诉讼,原因是 Ring 门铃的“熟悉面孔”功能未经路人同意就存人脸图像。原告 Charles Sigwalt 在西雅图提告,但正文没披露集体规模、索赔金额或图片存多久。这个功能去年 9 月公布,12 月上线,之前就被 EFF 和参议员 Markey 反对过。
#Vision#Safety#Amazon#Ring
一句话点评
亚马逊 Ring 门铃的“熟悉面孔”功能被集体诉讼,原告称未经路人同意就存人脸图像。功能去年 9 月公布、12 月上线,之前就被 EFF 和参议员反对过。正文没披露集体规模、索赔金额和图片存多久,法律风险有多大还不好说。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
17:44
56d ago
● P1Hacker News 首页· rssEN17:44 · 06·02
Anthropic 将 Claude Mythos 部署至 15 国关键基础设施
Anthropic 周二宣布,把它的安全漏洞发现项目 Project Glasswing 和背后的模型 Mythos 扩展到 15 个以上国家、约 150 家机构,覆盖电力、水务、医疗和通信这些一旦被攻击就可能影响上亿人的关键领域。这是 Mythos 首次大规模进入国家级基础设施,但文章没披露具体是哪些客户、模型怎么部署、收费方式、上线时间表,也没提安...
#Anthropic#Product update
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 把自家安全模型 Claude Mythos 塞进了 15 国的电网、医院和通信系统,但正文没披露实际部署效果和误报率,这点先别太激动。
锐评
Anthropic 把 Claude Mythos 这个专门找代码漏洞的模型,连同它的“玻璃翼计划”,推给了 15 个国家约 150 家关键基础设施机构,覆盖电力、水务、医疗和通信。按他们的说法,这些地方一旦被黑,可能影响上亿人。这不再是实验室里的攻防演练,而是直接让 AI 进到现实世界的命脉系统里干活。 不过,文章只说了扩张的规模和涉及的行业,没给出任何具体的性能数据。比如 Mythos 在这些真实的老旧工业系统里,漏洞检出率是多少,会不会频繁把正常配置标成高危,这些关键指标全是空白。而且,把 AI 嵌进这么敏感的系统,一旦模型本身出问题或者被对抗样本攻击,后果比漏报几个漏洞严重得多。 目前看,这更像是一次大规模的公测部署公告。要判断它到底靠不靠谱,还得等这些合作方后续会不会公开分享实际使用中的准确率和事故记录。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
17:41
56d ago
r/LocalLLaMA· rssEN17:41 · 06·02
75M参数模型用18B tokens训练,指令跟随能力超过两倍大的SmolLM-135M
有人在Reddit上发帖,说自己从零训练了一个75M参数的小模型KeyLM-75M-Instruct,只用了18B tokens预训练数据,在指令跟随测试IFEval上得了17.85分,比SmolLM-135M-Instruct的17.15分还高一点——后者用了600B tokens预训练,SmolLM2-135M更是用了2T tokens。相当于用不...
#Fine-tuning#Benchmarking#Inference-opt#KeyLM
一句话点评
75M参数模型KeyLM只用了18B tokens预训练,指令跟随得分就超过了用600B tokens训的SmolLM-135M。数据效率确实高,但其他基准(MMLU 24%、HellaSwag 31%)基本是随机水平,作者自己也说知识类任务几乎全在胡编。亮点是训练成本极低,适合资源有限的人复现或做实验基线。但IFEval分数差距很小(17.85 vs 17.15),且SmolLM2-135...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
17:32
56d ago
r/LocalLLaMA· rssEN17:32 · 06·02
为什么还没有用AI代理当NPC的游戏?
一位Reddit用户发问:英伟达三年前就演示了AI驱动的NPC,为什么至今没有一款正式游戏用上?目前只有《上古卷轴》系列的民间Mod算得上例子,但正文没披露任何AAA项目证据、性能基准、发布时间表或失败数据。
#Agent#NVIDIA#Gemma#Reddit
一句话点评
英伟达三年前演示的AI NPC至今没进正式游戏,目前只有《上古卷轴》民间Mod算例子。正文没披露任何AAA项目证据、性能基准或失败数据,这点先别太激动。如果真能落地,玩家对话自由度会质变,但延迟和成本是硬门槛。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
17:30
56d ago
AI HOT 精选· aihot-apiZH17:30 · 06·02
GitHub Copilot 出桌面 App 了,定位是“智能体原生”
GitHub 在 Build 2026 上发布了 Copilot 桌面 App,主打“智能体原生”体验——意思是 Copilot 不再只是 IDE 里的补全插件,而是能像独立助手一样在桌面端干活。正文没披露具体功能列表、定价和上线时间,所以暂时没法判断它比 VS Code 里的 Copilot 强在哪,或者是不是只是套了个壳。
#Agent#Tools#Code#GitHub
一句话点评
GitHub 在 Build 2026 上发布了 Copilot 桌面 App,号称“智能体原生”——意思是 Copilot 不再只是 IDE 里的补全插件,而是能像独立助手一样在桌面端干活。但正文没披露具体功能列表、定价和上线时间,所以暂时没法判断它比 VS Code 里的 Copilot 强在哪,或者是不是只是套了个壳。 短评:画饼阶段,等具体功能再激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
17:18
56d ago
Product Hunt · AI· rssEN17:18 · 06·02
EchoFlow:一款把聊天记录存在本地的安卓 AI 聊天 App
EchoFlow 是一款开源的安卓原生 AI 聊天 App,主打聊天记录存在本地,离线也能翻看历史。它不自己接模型,而是让你自己带 API Key(BYOK),通过 OpenRouter 调用各家模型。界面用了 Material Expressive 设计,有壁纸主题和弹性动画,想做出“安卓原生感”,而不是套壳网页。目前免费,后续计划支持更多模型供应商...
#EchoFlow#Product update
一句话点评
一款开源安卓AI聊天App,聊天记录存本地、离线可翻,自己带API Key通过OpenRouter调模型。界面做了Material Expressive设计,有壁纸主题和弹性动画,想做出“安卓原生感”而不是套壳网页。目前免费,后续计划支持更多模型供应商。 短评:本地存储+BYOK是实在的隐私卖点,但没披露同步机制和加密设计,多设备用户得自己掂量。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K1·R0
17:12
56d ago
AI HOT 精选· aihot-apiZH17:12 · 06·02
NVIDIA 发了个教程:让 AI 智能体记住你教它的工作流,重启也不丢
NVIDIA 用 NemoClaw 和 OpenShell 部署了 Hermes Agent,能连 Slack、Outlook、GitHub 和 NVIDIA 论坛。核心卖点是:你在聊天里纠正它的操作,它会自动把修正变成可复用的技能,下次重建后还能用。私有数据受运行时策略保护。不过正文没披露这个“技能”是怎么存储和版本管理的,也没说跨不同 Agent ...
#Agent#Tools#Memory#NVIDIA
一句话点评
NVIDIA 发了个教程,用 NemoClaw 和 OpenShell 部署 Hermes Agent,能连 Slack、Outlook、GitHub 和论坛。亮点是你在聊天里纠正它的操作,它会自动把修正变成可复用的技能,下次重建后还能用。私有数据受运行时策略保护。 但正文没披露这个“技能”怎么存、怎么版本管理,也没说跨不同 Agent 能不能共享。如果只是单机存个配置文件,那实用性打折。...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
17:00
56d ago
● P1彭博科技· rssEN17:00 · 06·02
Uber 因预算超支给员工 AI 工具设消费上限
Uber 开始限制员工在 Claude Code 这类 AI 编程工具上的开销。公司今年早些时候 AI 预算就超支了,所以现在直接设了使用上限。具体上限是多少、哪些团队受影响、总预算是多少,正文都没披露。
#Code#Tools#Uber#Claude Code
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
Uber 给员工用 AI 编程工具设了每月 1500 美元上限,因为预算四个月就花光了。这个数字本身比工具好坏更值得看,它直接标出了大公司愿意为单人 AI 辅助付多少钱。
锐评
Uber 不是不让用 AI,是花太快了。内部预算四个月就见底,于是给每人每月设了 1500 美元的上限,主要针对 Claude Code 这类 AI 编程助手。这个动作比任何定价分析都实在——它直接亮出了一家大型科技公司对单人 AI 工具成本的容忍线。1500 美元一个月,放在工程师薪资里不算高,但要是全公司几千人都在用,账单就很吓人了。 目前报道没披露 Uber 内部到底有多少人在用、用的频率多高,也没说这个上限是硬封顶还是超额要审批。另外,这个数字只反映 Uber 一家的账,不代表行业均价。其他公司如果效仿,AI 工具厂商的定价策略可能会被这条线锚定。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
16:36
56d ago
Hacker News 首页· rssEN16:36 · 06·02
白宫发布AI行政令:推动先进AI创新与安全
白宫官网发布了一份名为“推动先进人工智能创新与安全”的行政令,但正文只给出了标题和导航菜单,没有披露任何具体政策条款或执行细节。目前仅能从标题判断方向是“创新+安全”,但具体是放宽监管、加大投资还是设立安全标准,一概未知。信息缺口很大,建议等正式文本出来再分析。
#Safety#White House#Hacker News#Policy
一句话点评
白宫发了个AI行政令,标题是“创新+安全”,但正文只有导航菜单,一个字都没写。目前只能猜方向,具体是松监管、投钱还是设标准,全不知道。信息缺口太大,先别激动,等正式文本。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H0·K0·R1
16:35
56d ago
Hacker News 首页· rssEN16:35 · 06·02
Perplexity 把搜索拆成代码积木,让 AI 自己搭检索流程
Perplexity 发了一篇新论文《Rethinking Search as Code Generation》,核心想法是把传统搜索拆成原子化的 SDK 组件(检索、排序、过滤、渲染等),然后让模型自己写代码来组装这些组件,为每个请求定制一条检索流水线。他们管这叫 Search as Code(SaC)。动机是:传统搜索是固定管道,模型只能调一次接口...
#Code#Tools#Perplexity#Research release
一句话点评
Perplexity 把搜索拆成 SDK 组件(检索、排序、过滤),让模型自己写代码组装流水线,每个请求定制一条检索路径。好处是模型能精细控制上下文怎么来,而不是只调一次接口。但论文正文没披露 benchmark 分数、延迟成本、跟传统管线的对比数据。想法挺酷,但效果和落地代价未知,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R0
16:30
56d ago
The Verge · AI· rssEN16:30 · 06·02
微软出了个巴掌大的 Surface 开发机,128GB 内存跑本地 AI
微软新发布的 Surface RTX Spark Dev Box 是个巴掌大的迷你 PC,长得像 Xbox Series X 的顶盖,铝壳直接当散热片用。它用英伟达的 Arm 架构 RTX Spark 芯片,整机功耗 100 瓦(比同芯片笔记本的 45-80 瓦高一点),配了 128GB 统一内存,专门给开发者跑本地 AI 任务。正文没披露价格和上市时...
#Inference-opt#Microsoft#Qualcomm#Nvidia
一句话点评
微软出了个巴掌大的 Arm 开发机,铝壳直接当散热片,100 瓦功耗比同芯片笔记本高一点,配 128GB 统一内存跑本地 AI。但正文没披露价格和上市时间,也没说具体跑什么模型、性能如何。如果定价合理,这可能是最省心的本地 AI 开发硬件,但得等实测。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
16:13
56d ago
Hacker News 首页· rssEN16:13 · 06·02
Kapa.ai 做 RAG 图片索引:索引时用廉价模型描述一次,查询时只跑文本
Kapa.ai 分享他们如何把技术文档里的截图、图表、表格塞进 RAG 流程。核心做法:索引阶段用廉价视觉模型给每张图写一段文字描述,存成文本块;查询时只检索文本,不再调用视觉模型。这样每查询的额外开销只有纯文本的 1%-6%,而答案质量有统计显著提升(McNemar 检验 p<0.05)。他们试过查询时直接传图给 GPT 5.1 和 Claude 4...
#RAG#Vision#kapa.ai#Hacker News
一句话点评
Kapa.ai 把技术文档里的截图、图表塞进 RAG 的实战帖。核心做法:索引阶段用廉价视觉模型给每张图写一段文字描述,存成文本块;查询时只检索文本,不再调用视觉模型。这样每查询的额外开销只有纯文本的 1%-6%,而答案质量有统计显著提升(McNemar 检验 p<0.05)。他们试过查询时直接传图给 GPT 5.1 和 Claude 4.6 Sonnet,成本增加 27%-51%,且 20...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
16:02
56d ago
Hacker News 首页· rssEN16:02 · 06·02
用手机麦克风实时检测呼吸,全在本地跑,不上传音频
Felix 开源了一个叫 shii•haa 的呼吸检测 App,用手机麦克风实时捕捉呼吸并给出反馈。核心是信号处理 + 呼吸状态机 + 轻量 ML,所有计算都在设备本地完成,不上传任何语音或原始音频,隐私上比较放心。目前 GitHub 只有 7 个星,还非常早期,正文没披露具体模型大小或延迟数据,但全本地跑意味着延迟低、不依赖网络。适合想做呼吸冥想或健...
#Audio#Felix#shii•haa#Product update
一句话点评
一个用手机麦克风实时检测呼吸并给出反馈的开源App,信号处理+状态机+轻量ML全在本地跑,不上传任何音频,隐私友好。目前GitHub仅7星,非常早期,正文没披露模型大小和延迟数据,但全本地意味着延迟低、不依赖网络。适合呼吸冥想或健康监测场景,但精度和鲁棒性有待验证。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
16:00
56d ago
AI HOT 精选· aihot-apiZH16:00 · 06·02
DigitalOcean 的 AI 云服务上线 OpenRouter,DeepSeek V3.2 跑得最快
DigitalOcean 的 AI-Native Cloud 现在可以在 OpenRouter 上直接调用了,主打开源模型的推理服务。根据 Artificial Analysis 的数据,它在 DeepSeek V3.2 上的输出速度和延迟都排第一——也就是说,跑这个模型响应快、等得短。不过正文没披露具体价格和可用性细节,想省钱的话还得自己实测对比。
#Inference-opt#DigitalOcean#OpenRouter#Artificial Analysis
一句话点评
DigitalOcean的AI云服务上线OpenRouter,主打开源模型推理。据Artificial Analysis数据,其DeepSeek V3.2输出速度和延迟排第一,响应快等待短。但正文没披露具体价格和可用性,想省钱还得自己实测对比。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K1·R0
16:00
56d ago
AI HOT 精选· aihot-apiZH16:00 · 06·02
Replit Canvas 更新了,但没说具体改了什么
Replit 发推说 Canvas 有更新,正文只给了一个链接和一句“有一些新更新”,没披露具体功能、上线时间或哪些套餐能用。想了解细节得自己去 replit.com/canvas 看,或者等他们后续的讨论串。
#Code#Tools#Replit#Product update
一句话点评
Replit 的 Canvas 更新只发了一条推文,正文就一句话加个链接,没提任何具体功能、上线时间或套餐限制。想确认是不是真有大改动,得自己去 replit.com/canvas 看,或者等他们后续的讨论串。目前信息缺口太大,没法判断值不值得试。
HKR 分解
hook knowledge resonance
打开信源
32
SCORE
H0·K0·R0
15:59
56d ago
AI HOT 精选· aihot-apiZH15:59 · 06·02
微软 Build 2026 大会:Copilot 要变“超级应用”,智能体工具也来了
微软 Build 2026 开发者大会 6 月 2 日在旧金山开幕,重点包括:Copilot 将升级为“超级应用”,配合 Windows 11 大改版;推出类似 OpenClaw 的智能体工具,让模型能直接操作软件界面完成任务。另外,微软刚发布了搭载 Nvidia RTX Spark 芯片的 Surface Laptop Ultra,大会可能还会聊更多...
#Agent#Tools#Microsoft#Nvidia
一句话点评
微软 Build 2026 开幕,核心是把 Copilot 升级成“超级应用”,类似微信小程序集合,配合 Windows 11 大改版。另一个看点是类似 OpenClaw 的智能体工具,让模型直接操作软件界面干活,相当于给 AI 装了一双手。但正文没披露模型规格、定价和上线时间,这些才是开发者关心的。RTX Spark 芯片的 Surface 已发布,大会可能聊更多 Windows on A...
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1
15:52
56d ago
r/LocalLLaMA· rssEN15:52 · 06·02
Minimax M3 在政治审查基准上表现异常,但测试细节没公开
Reddit 用户 DingyAtoll 发帖称,Minimax M3 在一项针对中国/CCP 政治偏见的基准测试中是个异类——几乎不拒绝敏感话题。但帖子没交代测试用了多少条 prompt、具体问了什么、评分标准是什么,也没给复现方法。所以这个结论目前只能当个线索,不能当证据。正文没披露测试样本量和 prompt 列表,验证强度很弱。
#Safety#Benchmarking#MiniMax#DingyAtoll
一句话点评
Reddit 用户 DingyAtoll 发帖称 Minimax M3 在政治敏感话题上几乎不拒绝,但帖子没交代测试用了多少条 prompt、具体问了什么、评分标准,也没给复现方法。所以这个结论目前只能当个线索,不能当证据。正文没披露测试样本量和 prompt 列表,验证强度很弱。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
15:50
56d ago
r/LocalLLaMA· rssEN15:50 · 06·02
StepFun 3.5 MTP 被提交到 llama.cpp,但具体实现细节还没公开
开发者 pwilkin 给 llama.cpp 提了一个 PR(编号 #23274),内容是 StepFun 3.5 的 MTP(多 token 预测)支持。Reddit 上的帖子只提到这个 PR 排在 Gemma MTP 的 PR #23398 之前,正文没披露任何实现细节,比如改了哪些代码、性能如何。如果你想知道它怎么跑、效果怎样,目前只能等 PR...
#Inference-opt#StepFun#ggml-org#pwilkin
一句话点评
开发者 pwilkin 给 llama.cpp 提了 StepFun 3.5 的多 token 预测(MTP)PR,排在 Gemma MTP 之前。但正文被屏蔽,没披露改了啥、性能如何。MTP 能一次预测多个 token,理论上推理更快,但具体加速比、显存开销、模型兼容性全是未知数。如果你在跑 StepFun 3.5 且想尝鲜,可以盯着这个 PR 合并,但别指望立刻有稳定收益。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H0·K1·R0
15:41
56d ago
AI HOT 精选· aihot-apiZH15:41 · 06·02
Gary Marcus:AI 行业的经济账算不过来,迟早要崩
Gary Marcus 发了一篇长文,核心论点就一个:现在 AI 行业的经济模型跑不通。他列了两条线。第一条是数学:大家都在用差不多的数据、差不多的技术路线,根本没有护城河。没有护城河就没人能垄断市场,没人垄断就打不了高价,最后只能打价格战,变成卖算力的苦生意。第二条是心理:越来越多的人开始注意到这个问题了。他发了一条推文,一夜之间 75 万+ 阅读,...
#Safety#Gary Marcus#Safety/alignment#Commentary
一句话点评
Gary Marcus 发文说 AI 行业的经济模型跑不通。核心论据两条:一是技术路线和数据趋同,没有护城河,最终只能打价格战,变成卖算力的苦生意;二是越来越多的人开始注意到这个问题,他一条推文一夜 75 万+阅读,且多数人认同。Marcus 还引用了 Bain 的报告质疑企业客户的 ROI,以及 Anthropic 取消无限量套餐等信号。不过全文没有给出具体模型、实验或案例数据,更像一篇观...
HKR 分解
hook knowledge resonance
打开信源
38
SCORE
H1·K0·R1
15:37
56d ago
r/LocalLLaMA· rssEN15:37 · 06·02
2026 年智能体框架怎么选:LangGraph、CrewAI、LlamaIndex 还是干脆不用框架
作者给了一张 2026 年的框架选型地图,核心判断是:先别急着上框架。如果只是一个智能体调用一两个工具,裸调模型加结构化输出更便宜、更好调试。框架的价值体现在需要分支流程、持久状态、重试、人工审批、记忆、多智能体协作或长时间运行的时候。具体推荐:LangGraph 适合有状态的生产流程;CrewAI 适合快速搭多智能体原型;LlamaIndex 适合重...
#Agent#RAG#Memory#LangGraph
一句话点评
短评:选框架前先问自己:真的需要吗?一个智能体调一两个工具,裸调模型更省心。 点评:这篇 Reddit 帖子的核心判断很实用:别一上来就上框架。作者给了一张 2026 年的选型地图,关键建议是——如果只是单个智能体调用一两个工具,直接裸调模型加结构化输出更便宜、更好调试。框架的价值体现在需要分支流程、持久状态、重试、人工审批、记忆、多智能体协作或长时间运行的时候。具体推荐:LangGrap...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H0·K1·R1
14:48
56d ago
AI HOT 精选· aihot-apiZH14:48 · 06·02
商汤开源办公技能套件 SenseNova-Skills,能生成图表、做PPT、写报告
商汤开源了一套叫 SenseNova-Skills 的办公技能包,专门给智能体(比如 OpenClaw、HermesAgent)用。目前有四个功能:生成信息图(可以照着参考图改风格)、做数据分析(支持多张表、清洗和画图)、自动做 PPT(生成大纲+排版,输出可编辑文件)、以及深度研究(搜学术、技术、社交来源后写报告)。代码已全部公开。正文没披露训练数据...
#Agent#Tools#SenseTime#OpenClaw
一句话点评
商汤开源了一套办公技能包,智能体可以直接调用。目前四个功能:生成信息图(可参考风格)、做数据分析(多表清洗画图)、自动做PPT(出大纲排版)、深度研究(搜学术技术社交来源写报告)。代码全公开。但正文没披露训练数据、模型大小和效果评测,实际可用性要自己试。短评:办公智能体技能包开源,功能全但缺评测。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R0
14:13
56d ago
Hugging Face 博客· rssEN14:13 · 06·02
Holo3.1:本地运行的电脑操控智能体
Holo3.1 主打快速、本地运行,能直接操控电脑界面。但正文是空的,没披露模型大小、运行条件、跑分结果或发布时间。所以目前只能知道它想做到“快且本地”,具体多快、多省资源、效果如何,一概没提。
#Agent#Tools#Hugging Face#H Company
一句话点评
Holo3.1 号称能本地快速操控电脑界面,但正文是空的,没披露模型大小、运行条件或跑分。目前只能知道它想做到“快且本地”,具体多快、多省资源、效果如何,一概没提。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H1·K0·R1
14:13
56d ago
AI HOT 精选· aihot-apiZH14:13 · 06·02
Nathan Lambert 离开 Ai2,OLMo 开源模型项目少了一员大将
Ai2(艾伦人工智能研究所)的研究员 Nathan Lambert 宣布离职,他在那干了两年半,主要搞 OLMo 和 Tulu 这些开源模型项目。他自己说这是职业生涯的巅峰。接下来他会先休息一阵,但还会继续做开源模型和开放科学。正文没说他下一步去哪,也没提离职原因。
#Fine-tuning#Nathan Lambert#Ai2#Allen Institute for AI
一句话点评
Nathan Lambert 离开 Ai2,他是 OLMo 和 Tulu 开源模型的核心人物。正文没说他下一步去哪,也没提离职原因。开源模型圈少了一个关键推动者,后续动向值得关注。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:02
56d ago
AI HOT 精选· aihot-apiZH14:02 · 06·02
MiniCPM-V 4.6 直接拉包就能跑,不用自己编译了
OpenBMB 宣布 MiniCPM-V 4.6 已完整支持 vLLM v0.22.0,用户只需拉取预构建包即可运行,不再需要自定义分支或额外编译。这对部署来说省了一步麻烦事,尤其适合不想折腾环境的人。正文没披露性能提升或延迟数据,所以这点先别太激动,但集成本身是实打实的便利。
#Multimodal#Vision#Inference-opt#OpenBMB
一句话点评
MiniCPM-V 4.6 现在直接拉 vLLM v0.22.0 的预构建包就能跑,不用自己编译或改分支,部署省了一步。对不想折腾环境的人挺友好。但正文没提性能提升或延迟数据,所以这点先别太激动,集成本身是实打实的便利。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
13:59
56d ago
r/LocalLLaMA· rssEN13:59 · 06·02
llama.cpp 加了个“思考模式”开关,能调推理用力程度
llama.cpp 的 PR #23434 给 UI 加了一个 Thinking mode 开关,用户可以开启、关闭或限制模型的“思考”过程,还能选 reasoning effort 等级。正文没披露具体参数细节,也没说合并状态。对本地跑模型的人来说,这个开关意味着可以手动控制模型在回答前“想多久”,想省电或要快速回复就关掉或调低,需要深度推理就开高。
#Reasoning#Tools#ggml-org#llama.cpp
一句话点评
llama.cpp 的 PR #23434 给 UI 加了个 Thinking mode 开关,能调 reasoning effort 等级。对本地跑模型的人来说,这等于手动控制模型“想多久”——省电或要快速回复就关掉或调低,需要深度推理就开高。正文没披露具体参数细节,也没说合并状态,所以实际效果和兼容性还不确定。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R1
13:56
56d ago
Hacker News 首页· rssEN13:56 · 06·02
别给求职者发AI推销邮件了,这很残忍
一位HN用户在求职帖发帖几小时后,就收到一封推销LLM/RAG服务的邮件。发帖人已失业6个月,是带着妻猫和债务的移民,每次邮件都以为是工作机会,结果只是推销。帖子获得65个赞和7条评论,核心诉求是:别用AI工具批量骚扰求职者。
#RAG#Agent#Hacker News#Claude Code
一句话点评
一位失业6个月的移民在HN求职帖发帖几小时后,收到推销LLM/RAG服务的邮件,每次以为是工作机会。帖子获65赞。核心问题:AI工具被用来批量骚扰求职者,缺乏基本同理心。正文没披露发件人是否用了AI批量抓取,但作者讽刺建议给Claude Code加个'同理心'技能。这事提醒AI从业者:别把技术便利建立在他人痛苦上,尤其是对处境艰难的人。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
13:31
56d ago
Product Hunt · AI· rssEN13:31 · 06·02
MakersClaw:把 AI 员工塞进 Slack/Teams/Telegram,按调用次数付费
MakersClaw 今天在 Product Hunt 上线,主打把 AI 代理直接部署到 Slack、Teams 和 Telegram 里。每个代理有独立容器和持久记忆,7x24 小时在线。预设角色包括客服、销售、调研和 SEO,也支持自己写指令。收费按工具调用次数算,有免费档。正文没透露底层模型和具体费率,所以实际成本好不好控制得打个问号。
#MakersClaw#Slack#Microsoft Teams
一句话点评
MakersClaw 今天在 Product Hunt 上线,主打把 AI 代理直接部署到 Slack、Teams 和 Telegram 里。每个代理有独立容器和持久记忆,7x24 小时在线。预设角色包括客服、销售、调研和 SEO,也支持自己写指令。收费按工具调用次数算,有免费档。正文没透露底层模型和具体费率,所以实际成本好不好控制得打个问号。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
13:29
56d ago
● P1Ben's Bites· rssEN13:29 · 06·02
Claude Opus 4.8 发布,Claude Code 学会写脚本派子任务并行干活
Anthropic 发了新模型 Claude Opus 4.8,主要卖点是 Claude Code 现在能先写一个调度脚本,再同时拉起多个子代理并行处理复杂任务。不过有开发者提醒,这并不证明松散的 multi-agent 架构靠谱,反而是围绕小代理循环的确定性工作流更稳。模型本身被 Simon Willison 评价为“温和但有用的升级”,更诚实、更少...
#Agent#Code#Benchmarking#Anthropic
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Opus 4.8 在 Claude Code 里能写脚本并行派活给子代理了,但别急着吹多智能体架构,确定性工作流更稳。
锐评
Anthropic 发了 Claude Opus 4.8,核心卖点是 Claude Code 现在能先写一个调度脚本,再同时拉起多个子代理并行干活。这听起来像多智能体协作,但有开发者直接泼冷水:松散的 multi-agent 架构并不靠谱,反而是围绕小代理循环的确定性工作流更稳。模型本身被评价为“温和但有用的升级”,主要进步是更诚实,对自己代码里的缺陷没那么瞎。Every 的体感更积极,认为比 4.7 跳了一大步,在内部高级工程师基准上能和 GPT-5.5 掰手腕。但有个硬伤:Claude 的应用端体验还是比 Codex 乱。 跑分方面,它在 ARC-AGI-3 上拿了第一,分数是 GPT-5.5 的三倍,但 Datacurve 的新基准又把它排在 GPT-5.5 下面,只比 5.4 好一丢丢,而且消耗的 token 多得多,成本更高。这种基准打架的情况说明,模型强不强很看你测什么任务。另外,Anthropic 同时提交了机密 S-1 文件,并完成了 650 亿美元 H 轮融资,投后估值 9650 亿,今年很可能 IPO。 这条新闻缺的是 Opus 4.8 在真实生产环境里的延迟和成本数据,以及那个并行子代理功能在复杂项目里的失败率。基准分数看看就好,别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
13:21
56d ago
r/LocalLLaMA· rssEN13:21 · 06·02
喂本地模型前,PDF 表格和多栏排版怎么处理?
Reddit 用户对比了四种 PDF 预处理方案(PyMuPDF、marker、docling、llama parse),发现表格和多栏布局喂给本地模型后输出乱码。正文没披露测试集、准确率、运行时间或成本,所以这只是个经验分享,不是评测。如果你也遇到 PDF 解析乱码,可以看看这些工具的讨论,但别直接当结论用。
#RAG#Tools#PyMuPDF#pdfplumber
一句话点评
Reddit 用户实测四种 PDF 预处理工具(PyMuPDF、marker、docling、llama parse),结论是表格和多栏布局喂给本地模型后输出乱码。正文没披露测试集、准确率或运行时间,所以这只是个经验分享,不是评测。如果你也遇到 PDF 解析乱码,可以看看这些工具的讨论,但别直接当结论用。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H0·K0·R1
12:56
56d ago
r/LocalLLaMA· rssEN12:56 · 06·02
Jetson Orin Nano Super 8GB 跑小模型:25W 功耗性价比最高
有人在 250 美元的 Jetson Orin Nano Super 8GB 上测了 8 个 1.35 亿到 10 亿参数的小模型,用 llama.cpp CUDA 跑,试了 7W、15W、25W 和 MAXN 四种功耗模式。结论是 25W 最划算:比 15W 每秒多生成 36–47% 的 token,比 MAXN 每焦耳多产出 8–35% 的 tok...
#Inference-opt#Benchmarking#NVIDIA#Hugging Face
一句话点评
有人在250美元的Jetson Orin Nano Super 8GB上测了8个小模型,结论是25W功耗模式最划算:比15W每秒多生成36-47%的token,比MAXN每焦耳多产出8-35%。不过正文被Reddit屏蔽了,没披露具体模型名称、精度(int4还是fp16)和延迟数据,所以这个“最划算”目前只能当参考。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
12:40
56d ago
Product Hunt · AI· rssEN12:40 · 06·02
Forward:一行命令把你的 API 装进客户的代码库
Forward 是一个 AI 工具,号称客户只需跑一行命令,它就能自动分析客户的代码仓库、写好集成代码、建一个新分支、跑测试,最后提一个 PR 等人审查。说白了就是帮你省掉写几十页 API 文档的功夫,让客户从注册到第一次调通 API 的流程从几小时缩到几分钟。它还能学习你团队的代码风格,并通过构建验证保证安全。不过正文没披露它支持哪些编程语言、具体怎...
#Code#Tools#Forward#Product Hunt
一句话点评
一行命令让AI自动读你客户的代码仓库、写集成代码、建分支跑测试,最后提个PR等人审查。对API/SDK公司来说,这能省掉写几十页文档的功夫,把客户从注册到调通API的时间从几小时缩到几分钟。但正文没披露支持哪些编程语言、具体怎么分析仓库、以及定价。如果只支持主流语言且能处理复杂依赖,那确实能降低集成门槛。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
12:38
56d ago
AI HOT 精选· aihot-apiZH12:38 · 06·02
Gemini Spark 规划旅行:效果惊艳,但让人后背发凉
Google DeepMind 的 Gemini Spark 模型在规划旅行任务上表现惊人,但 The Verge 的体验文章说它同时带来一种“不安感”。正文没披露具体测试条件、定价、上线时间或性能数字,所以“可怕”到底是指模型太自主、还是暴露了隐私风险,目前只能靠猜。
#Agent#Google DeepMind#Gemini Spark#The Verge
一句话点评
短评:The Verge 说 Gemini Spark 规划旅行强到“可怕”,但没给任何数字,先别跟着嗨。 点评:The Verge 这篇标题很唬人,说 Gemini Spark 规划旅行强到“令人不安”。但正文只给了情绪,没披露任何测试条件、定价、上线时间或性能数字。所谓“可怕”到底是指模型太自主、还是暴露了隐私风险,目前只能靠猜。对于从业者来说,这条信息价值有限——没有 benchma...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1

更多

频道

后台