ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-19

50 items · updated 3m ago
RSS live
2026-05-19 · 星期二2026年5月19日
09:09
70d ago
Product Hunt · AI· rssEN09:09 · 05·19
Upstream:一个同时给人类和AI Agent用的邮箱客户端
Upstream 今天在 Product Hunt 上线,定位是“人和 Agent 都能用的收件箱”。它让 AI 在后台帮你分类邮件、起草回复、处理杂活,前端界面做得比较精致。团队来自 Y Combinator,2026 年发布,目前免费,Pro 版首月免费试用。正文没披露用的是哪个模型、支持哪些第三方工具,也没提隐私政策怎么处理邮件数据。
#Agent#Upstream#Y Combinator#Product Hunt
一句话点评
短评:Y Combinator 孵化的 AI 收件箱,界面好看,但模型和隐私政策都没说。 点评:Upstream 今天在 Product Hunt 上线,定位是“人和 Agent 都能用的收件箱”。说白了就是让 AI 在后台帮你分类邮件、起草回复、处理杂活,前端做得比较精致。团队来自 Y Combinator,目前免费,Pro 版首月免费试用。 关键信息缺口:正文没披露用的是哪个模型、支...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
08:56
70d ago
Product Hunt · AI· rssEN08:56 · 05·19
Kept:把 AI 聊天记录存成本地 Markdown,不上云
Kept 是一个本地工具,能把你在 ChatGPT、Claude、Gemini、Grok 等平台上的对话抓下来,存成 Obsidian 兼容的 Markdown 文件,所有数据留在你自己电脑上,不上传任何云端。它还自带全文搜索、知识图谱和一个 MCP 服务器(让其他 AI 工具能直接读这些笔记)。项目 MIT 开源许可证,免费。目前只看到 Mac 标签...
#Memory#Kept#Product update
一句话点评
Kept 是个本地工具,能把你跟 ChatGPT、Claude 等 AI 的聊天记录抓下来,存成 Obsidian 能读的 Markdown 文件,所有数据都在你电脑上,不上传云端。它还自带全文搜索、知识图谱,甚至开了个 MCP 接口让其他 AI 工具直接读这些笔记。MIT 开源免费。 目前只看到 Mac 标签,Windows/Linux 用户得等等。正文没披露它怎么抓取对话——是浏览器插...
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R1
07:39
70d ago
● P1AI HOT 精选· aihot-apiZH07:39 · 05·19
月之暗面 Kimi 新融资拉来国资和央企,半年估值翻四倍
Kimi 正在进行一笔 20 亿美元(约 136 亿人民币)的融资,已接近收尾。新股东名单里出现了国智投、北京人工智能基金等国资机构,以及中国移动这样的央企。今年 1 月和 2 月,Kimi 已经密集完成了三轮融资,分别拿了 5 亿、7 亿和 7 亿美元。加上最新这笔,不到半年融资总额超过 39 亿美元,估值比去年 11 月的约 43 亿美元翻了四倍多...
#Code#Moonshot AI#Kimi#China Mobile
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Kimi 半年融了 39 亿美元,估值翻四倍,新股东里出现了国资和央企。钱是到位了,但商业化能不能跑通,正文没提。
锐评
这条融资消息最值得看的是股东结构变化。国智投、北京人工智能基金和中国移动进场,说明 Kimi 在资本层面已经不只是 VC 故事,开始有国家队背书。不到半年密集完成四轮融资,总额超过 39 亿美元,估值从去年 11 月的约 43 亿美元涨到现在的体量,速度确实快。 但正文只讲了融资数字和股东名单,没披露这 20 亿美元新钱的具体用途,也没提公司收入、付费用户留存或模型 API 调用量这些能验证商业化的指标。之前有报道说 1-2 月付费订单增长猛,但那是两个月前的数据了。另外,K2.6 模型刚开源,集成到 Cursor 算是产品落地的一步,可实际用户反馈和付费转化还没看到。 我会先打个折:估值翻四倍更多反映的是资本对头部大模型公司的押注意愿,不直接等于业务健康度。还缺的信息是 Kimi 自己的营收规模、毛利率和客户留存率,这些才是判断它值不值这个价的关键。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
06:45
70d ago
r/LocalLLaMA· rssEN06:45 · 05·19
MTP 在 Apple Silicon 上反而掉速?实测 27B 模型 M2 Max 跑出 9 vs 12 t/s
一位 Reddit 用户在 M2 Max(96GB 内存)上测试了 froggeric 和 unsloth 的 27B 模型,发现开启 MTP(推测是 Multi-Token Prediction,即一次预测多个 token 的加速技术)后,生成速度反而从约 12 t/s 降到 9 t/s。正文没披露具体配置细节和 MTP 实现方式,所以这个结果不一定...
#Inference-opt#Apple#Reddit#Unsloth
一句话点评
短评:MTP 在 Apple Silicon 上反而减速,说明这技术对带宽敏感的设备不友好。 点评:一位 Reddit 用户在 M2 Max(96GB)上测了 27B 模型,开 MTP 后生成速度从 12 t/s 掉到 9 t/s,降了 25%。MTP 本意是一次预测多个 token 来加速推理,但这里适得其反。原因可能是 Apple Silicon 的统一内存带宽有限(约 400 GB/...
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R1
06:28
70d ago
AI HOT 精选· aihot-apiZH06:28 · 05·19
Cursor 发布 Composer 2.5:用文本反馈做局部强化学习,训练量是上一代的 25 倍
Cursor 把 Composer 从 2.0 跳到 2.5,核心改进是训练时加了一种叫“目标文本反馈”的方法。简单说,模型在长任务里犯错(比如调了一个不存在的工具),以前只能靠最终得分猜哪里错了,现在可以在出错的那一步直接塞一句提示(比如“可用工具有这些”),然后只在这一步把模型输出往正确方向拉。这样改行为更精准,不用等整个任务跑完才给反馈。训练量也...
#Code#Tools#Cursor#Hacker News
一句话点评
Cursor 把 Composer 从 2.0 跳到 2.5,核心改进是训练时加了一种叫“目标文本反馈”的方法。简单说,模型在长任务里犯错(比如调了一个不存在的工具),以前只能靠最终得分猜哪里错了,现在可以在出错的那一步直接塞一句提示(比如“可用工具有这些”),然后只在这一步把模型输出往正确方向拉。这样改行为更精准,不用等整个任务跑完才给反馈。训练量也大了不少——和 SpaceXAI 合作,...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H0·K1·R1
05:50
70d ago
Product Hunt · AI· rssEN05:50 · 05·19
Viberia:像玩《文明》一样指挥AI智能体
Viberia 是一个把多个AI智能体放在一张等距地图上的管理工具,你可以像玩策略游戏一样,看到每个智能体的状态(谁卡住了、谁在提问、谁干完了),点进去就能聊天、换模型、用自己的API Key。智能体之间还能组队、互相学新技能,内置了文档、终端和浏览器。产品刚上Product Hunt,目前免费,但正文没披露具体的工作流机制、定价、支持哪些模型,以及什...
#Agent#Viberia#Product update
一句话点评
Viberia 把多个 AI 智能体放在一张等距地图上,像玩《文明》一样管理它们的状态——谁卡住了、谁在提问、谁干完了。点进去就能聊天、换模型、用自己的 API Key,智能体还能组队、互相学新技能。目前免费,但正文没披露具体的工作流机制、定价、支持哪些模型,以及多人协作怎么实现。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R0
05:09
70d ago
Product Hunt · AI· rssEN05:09 · 05·19
Thinnest AI:每分钟1.5卢比,做100多种语言的语音AI代理
Thinnest AI 是一个语音 AI 代理基础设施,主打便宜和多语言。它声称每分钟通话成本只要 1.5 卢比(约合人民币 1 毛 3),支持 100 多种语言,还能让你自己选语音识别(STT)、语音合成(TTS)和大模型(LLM),也接 Twilio 和 SIP 这类电话系统。它有个无代码流程编辑器,可以挂知识库(RAG)和 MCP 工具。不过正文...
#Agent#Audio#Thinnest AI#Product update
一句话点评
Thinnest AI 号称每分钟通话只要1.5卢比(约1毛3人民币),支持100多种语言,还能自己选语音识别、语音合成和大模型。价格确实低,但正文没披露用了什么模型、延迟多少、部署条件如何。无代码流程编辑器和外挂资料库是加分项,但语音代理的体验关键在延迟和打断处理,这些信息缺口让它更像一个低价入口,不是成熟方案。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R1
04:36
70d ago
新智元 · 公众号· rssZH04:36 · 05·19
Profy 上线全球首个 AI 专家市场:把你的经验打包成数字分身,7x24 小时接单
Profy 推出一个平台,让专家把自己的工作流程打包成 AI 数字分身,7x24 小时在线变现。用户可以通过自然对话或上传 CLI 文件来创建分身。官方称其 HLE 评分比基础模型高出近 20 个百分点——HLE 是衡量模型在专家级任务上表现的指标,这个提升幅度说明数字分身确实能学到一些专业套路。不过正文没披露具体用了哪些模型、训练成本多少、以及分身能...
#Agent#Tools#Benchmarking#Profy
一句话点评
Profy 上线了一个专家数字分身市场,号称 HLE 评分比基础模型高近 20 个百分点,说明分身确实能学到专业套路。但正文没披露用了什么模型、训练成本多少,以及分身能处理多复杂的任务。先别太激动,HLE 提升幅度大可能因为基础模型本身得分低,而且平台刚上线,验证案例太少。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
04:24
70d ago
Hacker News 首页· rssEN04:24 · 05·19
Codex-Maxxing:把编程助手当操作系统用
作者 Jason Liu 分享了他如何把 OpenAI Codex 从写代码的工具变成日常工作的“操作系统”。核心做法是给每个重要工作流建一个“持久线程”(可以压缩历史、长期保留的对话),配合语音输入、中途打断(steering)、共享记忆(用 Obsidian 笔记库存上下文)和心跳监控(让模型在后台盯着 PR 或 Slack 线程)。他提到持久线程...
#Code#Tools#Commentary
一句话点评
作者把 Codex 从写代码工具变成日常“操作系统”,核心是给每个工作流建一个可压缩历史的持久线程,配合语音输入、中途打断和共享记忆。他提到线程压缩后能跑几个月,但没披露具体成本、模型版本或延迟数据。做法有参考价值,但效果和开销得自己试。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
04:17
70d ago
r/LocalLLaMA· rssEN04:17 · 05·19
OpenCoffer 开源:自托管记账 + 自带模型聊天
OpenCoffer 发布了第一个开源版本,主打自托管个人财务管理和自带大模型聊天。你可以把它理解成一个本地记账软件,同时还能用自己的模型跟它对话查账。不过正文没披露支持哪些模型、怎么部署、要不要钱,也没说数据怎么连到模型——信息缺口挺大,想试的话得自己去翻仓库。
#Tools#OpenCoffer#ChatGPT#Open source
一句话点评
OpenCoffer 是个开源的自托管记账软件,亮点是能接你自己的大模型来聊天查账。但正文被屏蔽了,没披露支持哪些模型、怎么部署、要不要钱,数据怎么连到模型也没说——信息缺口很大,想试得自己去翻仓库。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H1·K0·R1
04:00
70d ago
FT · 科技· rssEN04:00 · 05·19
无人机公司Helsing联手OHB竞标欧洲军用卫星项目,给卫星装AI大脑
德国无人机公司Helsing和航天公司OHB计划联合竞标一个军用卫星项目,目标是建一套带AI的侦察监控网络。说白了就是给天上的卫星装个AI大脑,让它能自己识别目标、分析画面。Helsing之前主要做无人机上的AI系统,这次想往太空走。正文没披露合同金额、卫星数量、采购时间表,也没说卫星什么时候部署、在什么条件下能用。所以这事还在早期,具体规模和技术成熟...
#Vision#Helsing#OHB#Partnership
一句话点评
德国无人机AI公司Helsing要和OHB联手竞标军用卫星项目,给卫星装AI大脑做侦察监控。正文没披露合同金额、卫星数量、部署时间,信息缺口很大,目前只能当意向看。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
04:00
70d ago
FT · 科技· rssEN04:00 · 05·19
四大会计师事务所招AI专家比招审计师还多
四大会计师事务所(德勤、安永、毕马威、普华永道)发布的AI专家岗位数量已经超过审计师岗位。正文没披露具体招聘数字、时间范围、地区分布或各家数据,所以没法判断这个“超过”是总量还是增速。但方向很明确:审计这类流程化业务正在被AI替代,事务所需要更多懂模型部署、数据工程的人,而不是传统做底稿的人。
#Big Four#Personnel
一句话点评
四大会计师事务所(德勤、安永、毕马威、普华永道)发布的AI专家岗位数量已超过审计师岗位。方向明确:审计这类流程化业务正在被AI替代,事务所需要更多懂模型部署、数据工程的人,而非传统做底稿的人。但正文未披露具体招聘数字、时间范围、地区分布或各家数据,无法判断“超过”是总量还是增速。信息缺口明显,结论需谨慎引用。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
03:57
70d ago
Product Hunt · AI· rssEN03:57 · 05·19
Agora-1:一个能多人实时互动的AI世界模型,像玩游戏一样操控AI视频
Odyssey 在 Product Hunt 上发布了 Agora-1,一个“可玩的”多智能体世界模型研究预览。最多四个人类或 AI 智能体可以同时进入同一个实时生成的 3D 场景,从不同视角观看并互动,模型会维持场景的一致性。这不像传统 AI 视频只能看,更像一个共享的、可操控的模拟环境。不过正文没披露模型参数量、训练数据、推理成本、访问权限或发布时...
#Agent#Odyssey#Product Hunt#Product update
一句话点评
Odyssey 发了 Agora-1,一个最多4人/智能体同时进入的实时生成3D场景,大家能一起看一起互动,模型会保持场景一致。这比只能看的AI视频进了一步,更像共享模拟环境。但正文没披露模型参数量、训练数据、推理成本、访问权限和发布时间,这些关键信息缺失让实际可用性打折扣。短评:多人实时交互世界模型,方向有意思,但细节太少,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R0
03:56
70d ago
Hacker News 首页· rssEN03:56 · 05·19
LLMCap:给 LLM API 调用设个硬性美元上限,超了就停
LLMCap 是一个代理层,你改一行代码把 API 请求指向它的地址,然后在后台设好每日或每月的美元上限。一旦花销触顶,它会在 token 被消耗前直接返回 429 错误,而不是事后发警报。官方声称新增延迟低于 35 毫秒,支持 Anthropic、OpenAI、Google Gemini、Mistral、Cohere 五家供应商,并提供 VS Cod...
#Tools#LLMCap#Hacker News#Product update
一句话点评
LLMCap 是一个代理层,你改一行代码把 API 请求指向它的地址,然后在后台设好每日或每月的美元上限。一旦花销触顶,它会在 token 被消耗前直接返回 429 错误,而不是事后发警报。官方声称新增延迟低于 35 毫秒,支持 Anthropic、OpenAI、Google Gemini、Mistral、Cohere 五家供应商,并提供 VS Code 插件和命令行工具。 短评:硬止损比...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
03:49
70d ago
Product Hunt · AI· rssEN03:49 · 05·19
Multi-Claude:在 Mac 上同时登录多个 Claude 账号
一个 macOS 原生应用,让你在电脑上同时跑多个 Claude 账号,每个账号独立保存会话、历史记录和设置,切换只需点一下。开发者说数据只存在本地,唯一的网络请求是一次性的许可证校验。目前是一次性买断,没有订阅,首发周用码 PRODUCTHUNT25 打 75 折。不过正文没披露具体定价、最多能加几个账号、以及最低支持哪个 macOS 版本。另外它本...
#Tools#Claude#Product update
一句话点评
一个 macOS 原生应用,让你在电脑上同时跑多个 Claude 账号,每个账号独立保存会话、历史记录和设置,切换只需点一下。开发者说数据只存在本地,唯一的网络请求是一次性的许可证校验。目前是一次性买断,没有订阅,首发周用码 PRODUCTHUNT25 打 75 折。不过正文没披露具体定价、最多能加几个账号、以及最低支持哪个 macOS 版本。另外它本质是个浏览器包装器,不涉及 Claude...
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
03:48
70d ago
彭博科技· rssEN03:48 · 05·19
澳洲最大养老金说 agentic AI 会颠覆行业,但没透露具体怎么干
AustralianSuper(管理 3500 万会员的澳洲最大养老基金)公开表态,认为 agentic AI(让模型进业务流程干活)能改变它服务会员的方式。正文没披露部署计划、供应商、时间表或投资金额,所以目前只是一个方向性表态,不是落地案例。
#Agent#AustralianSuper#Commentary
一句话点评
AustralianSuper(澳洲最大养老基金,3500万会员)说agentic AI(让模型进业务流程干活)能改变服务方式。但正文没披露部署计划、供应商、时间表或投资金额,目前只是一个方向性表态,不是落地案例。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R0
03:43
70d ago
AI HOT 精选· aihot-apiZH03:43 · 05·19
QoderWork 发布 Design Desk:用自然语言生成可运行 React 项目的无限画布
QoderWork 推出了 Design Desk,一个无限画布 AI 工作区,用户用自然语言描述需求,就能直接生成可运行的 React + Vite 项目。设计师和开发者可以在同一份文件上协作,减少交接摩擦。目前正文没披露定价、底层模型和具体上线时间,想尝鲜可以直接去官网下载。
#Code#Tools#Alibaba Cloud#QoderWork
一句话点评
QoderWork 出了个 Design Desk,用自然语言描述就能生成可运行的 React + Vite 项目,设计师和开发者能在同一份文件上协作,减少交接摩擦。听起来像把 Figma 和代码生成揉到一起,但正文没披露定价、底层模型和具体上线时间,想尝鲜得自己去官网下载。目前看更像一个概念演示,实际协作效果和生成代码质量未知,别急着当主力工具。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
03:06
70d ago
Hacker News 首页· rssEN03:06 · 05·19
Sieve:扫一遍 Cursor/Claude 聊天记录,揪出泄露的 API Key
Sieve 是一款 Mac 工具(9.99 美元),专门扫描本地 AI 编程助手的聊天记录和状态文件,找出你不小心贴进去的 API Key、Token、密码和私钥。支持 Cursor、Claude Code、VS Code Copilot、Windsurf、Codex 等 9 款工具,还能扫项目里的 .env 文件。扫描完全在本地完成,不上传任何数据。...
#Code#Tools#Safety#Sieve
一句话点评
Sieve 是个 Mac 小工具(9.99 美元),专门扫 Cursor、Claude Code 等 9 款 AI 编程助手的聊天记录,找出你不小心贴进去的 API Key、密码和私钥。扫描全在本地完成,不上传任何数据,发现后还能直接擦除或存进系统钥匙串。这点先别太激动——正文没披露检测规则的具体细节,比如靠正则还是启发式,误报率未知。另外只支持 Mac,Windows 和 Linux 用户...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
02:55
70d ago
Product Hunt · AI· rssEN02:55 · 05·19
CLI Market:一个API查3760家零售商的商品,AI代理直接下单
CLI Market 把 VTEX 电商平台上的 3760 多家零售商(包括家乐福、三星等)的商品查询和购买接口,打包成一个统一的 Python 包。你装一个 `pip install cli-market`,AI 代理就能用自然语言说“买米”,然后自动跨店比价、加购物车、下单。它提供了 12 个 MCP 工具(让模型直接调用的功能模块),比如 `ma...
#Agent#Tools#CLI Market#Product update
一句话点评
CLI Market 把 VTEX 平台上 3760 多家零售商(家乐福、三星等)的商品查询和购买接口打包成一个 Python 包,装个 `pip install cli-market`,AI 代理就能用自然语言说“买米”,自动跨店比价下单。它提供了 12 个 MCP 工具(让模型直接调用的功能模块),比如搜索、比价、加购物车。开源 MIT 协议,免费。但正文没披露 API 调用是否收费、有...
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K1·R0
02:18
70d ago
● P1FT · 科技· rssEN02:18 · 05·19
Google与黑石合资AI云公司,计划部署自研芯片基础设施
FT 这篇报道的正文被安全验证页挡住了,只从现有摘要能看出:一家黑石投资的 AI 云厂商拿到了 50 亿美元投资,计划明年上线 500 兆瓦的数据中心容量。标题里提到 Google 在推芯片,但正文没披露用的是 TPU 还是自研 Arm 芯片、以什么形式合作——是租算力、联合部署还是单纯采购。这点先别太激动,等看到全文再判断。
#Inference-opt#Google#Blackstone#Funding
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Google 拉上黑石搞了个新 AI 云公司,起步就砸 50 亿美元,还打算用自己的芯片,摆明了要绕开英伟达。
锐评
Google 和黑石要合伙成立一家独立的 AI 云公司,专门卖搭载 Google 自研 TPU 芯片的算力服务。这事的核心逻辑是:Google 不想只当芯片的消费者,它想把自己设计的 TPU 变成一种可以对外出租的“基础设施”,直接跟英伟达的 GPU 云抢生意。起步资金 50 亿美元,目标是在 2027 年把数据中心规模干到 500 兆瓦,这个数字说明他们不是小打小闹,是奔着大规模商用去的。 不过,目前的消息主要来自《华尔街日报》的爆料,Google 和黑石官方都还没正式官宣,所以具体的股权结构、公司名字、运营团队都还是未知数。另外,TPU 虽然在某些 AI 任务上效率很高,但开发者生态跟英伟达的 CUDA 比还差得远,客户愿不愿意为了成本优势切换平台,是最大的不确定性。如果后续有具体的客户签约名单和 TPU 性能对比数据,这个故事的含金量会更高。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
01:46
70d ago
r/LocalLLaMA· rssEN01:46 · 05·19
MTP 在工具调用多的 agent 流程里可能反而拖后腿
Reddit 用户质疑 MTP(多 token 预测)在工具调用密集的 agent 流水线上是否真的有用。以 Qwen3.6-27B 为例,公开的 benchmark 显示:事实类任务上 MTP 的接受率只有 62-70%,而代码任务有 79-89%。差距挺大,说明 MTP 在需要精确调用外部工具的场景下可能帮倒忙。不过原帖没披露自己在生产 agent...
#Agent#Tools#Inference-opt#Qwen
一句话点评
Reddit 用户实测发现,Qwen3.6-27B 的多 token 预测(MTP)在工具调用场景下可能帮倒忙:事实类任务接受率仅 62-70%,远低于代码任务的 79-89%。差距说明 MTP 在需要精确调用外部工具时反而拖后腿。不过原帖没披露生产环境实测数据,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
01:38
70d ago
r/LocalLLaMA· rssEN01:38 · 05·19
本地跑子代理:10GB显存就能用,单KV缓存槽搞定
Reddit用户发布pi-subagent,让本地子代理跑在pi coding agent上,显存需求不到10GB,只用llama.cpp一个KV缓存槽。实测Apex Qwen在q_8 KV量化下能撑175-200k上下文,速度25-40 tokens/秒,取决于草稿命中率。正文没披露具体硬件配置和草稿模型大小,但显存和上下文长度数据挺实在,本地部署门...
#Agent#Code#Inference-opt#Qwen
一句话点评
一个Reddit用户搞了个pi-subagent,让本地子代理跑在pi coding agent上,显存不到10GB,只用llama.cpp一个KV缓存槽。实测Apex Qwen在q_8 KV量化下能撑175-200k上下文,速度25-40 tokens/秒,取决于草稿命中率。正文没披露具体硬件配置和草稿模型大小,但显存和上下文长度数据挺实在,本地部署门槛确实低。 短评:本地子代理显存不到...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
01:30
70d ago
Hacker News 首页· rssEN01:30 · 05·19
LLM 半年回顾:模型冠军换了五次,编程智能体终于靠谱了
Simon Willison 在 PyCon US 2026 上用五分钟闪电演讲总结了 LLM 过去半年的关键变化。核心判断是:2025 年 11 月是一个转折点,编程智能体从“经常翻车”跨过“基本可用”的门槛,能当日常工具用了。这背后是 OpenAI 和 Anthropic 用“可验证奖励的强化学习”死磕代码质量的结果。同期“最佳模型”头衔在 Ant...
#Simon Willison#Hacker News#Commentary
一句话点评
Simon Willison 在 PyCon US 2026 用五分钟闪电演讲总结 LLM 半年变化。核心判断:2025 年 11 月是转折点,编程智能体从“经常翻车”跨过“基本可用”门槛,能当日常工具用了。这背后是 OpenAI 和 Anthropic 用“可验证奖励的强化学习”死磕代码质量的结果。同期“最佳模型”头衔在 Anthropic、OpenAI、Google 之间换了五次,但演讲...
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K0·R1
01:14
70d ago
r/LocalLLaMA· rssEN01:14 · 05·19
从6GB到32GB:一个玩家用RTX 3090加3060凑显存跑大模型
Reddit用户晒单:买了张RTX 3090(24GB),打算跟手头的RTX 3060(8GB)拼在一起,凑出32GB显存,装Ubuntu用llama.cpp跑代码类模型,比如Qwen 3.5 4B和Qwen 3.6 27B。这配置成本不高——二手3090大概三四千块,加上3060总共32GB,比买一张RTX 4090(24GB)便宜一半以上。不过正文...
#Code#Inference-opt#Reddit#Qwen
一句话点评
Reddit 用户晒单:买二手 RTX 3090(24GB)配手头 RTX 3060(8GB),凑 32GB 显存,总成本约三四千元,比单买 RTX 4090(24GB)便宜一半以上。打算装 Ubuntu 用 llama.cpp 跑 Qwen 3.5 4B 和 Qwen 3.6 27B 等代码模型。 短评:二手卡拼显存是本地玩家的省钱老路子,32GB 跑 27B 模型够用,但跨卡通信延迟高...
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R1
01:08
70d ago
Product Hunt · AI· rssEN01:08 · 05·19
Freu AI:用自然语言让 Mac 应用自动干活,运行不花钱
Freu AI 是一个 Mac 上的 AI 代理,你说句话它就能帮你操作桌面应用。它先“看”一遍你的界面,把跨应用的流程记下来,然后转成一套确定性的 DSL(领域特定语言)在本地跑——不用写死坐标或选择器,每次跑也不消耗 token,所以官方说运行成本是零。它还开源了浏览器自动化引擎 freu-cli。不过正文没披露它支持哪些应用、怎么收费(只说运行免...
#Agent#Tools#Freu AI#Product Hunt
一句话点评
Freu AI 号称用自然语言就能让 Mac 应用自动干活,而且每次运行成本为零。它先“看”一遍你的界面,把跨应用流程记下来,转成一套确定性的 DSL 在本地跑,不用写死坐标或选择器,也不消耗 token。这点先别太激动——正文没披露它支持哪些应用、怎么收费(只说运行免费),也没说部署要求。开源了浏览器自动化引擎 freu-cli 倒是加分项。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
01:00
70d ago
彭博科技· rssEN01:00 · 05·19
新西兰裁8700个公务员岗位,同时推AI替代
新西兰政府计划裁掉约8700个公共部门岗位,合并一些部委,并扩大AI的使用范围。裁人规模不小,占公务员总数约6.5%,但正文没披露具体时间表、用了哪些AI系统、以及预计能省多少钱。对AI从业者来说,这算一个政府级“用AI降本”的案例,但细节太少,暂时没法判断是简单自动化还是深度改造。
#New Zealand#Policy
一句话点评
新西兰政府计划裁掉约8700个公务员(占总数的6.5%),同时说要扩大AI使用范围。这是一个政府级“用AI降本”的案例,但正文没披露具体用哪些AI系统、时间表以及预计省多少钱。目前信息太少,没法判断是简单自动化还是深度改造,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
00:48
70d ago
AI HOT 精选· aihot-apiZH00:48 · 05·19
Claude Code v2.1.144:后台会话可恢复,改名“用量积分”
Anthropic 给 Claude Code 打了个小补丁。新增 /resume 命令,终端里跑到一半的会话切到后台后能捡回来继续用,不用重开。之前叫“extra usage”的计费项改名为“usage credits”,更直白。修了一堆 bug:终端显示错乱、macOS 上特定文件夹会闪退、模型选择不记住、工具调用异常、MCP 服务器分页工具列表加...
#Agent#Code#Tools#Anthropic
一句话点评
短评:Claude Code 小版本更新,加了会话恢复和改名计费项,修了一堆 bug。 点评:Anthropic 给 Claude Code 打了个补丁,核心变化就两个:新增 /resume 命令,终端里跑到一半的会话切到后台后能捡回来继续用,不用重开;之前叫“extra usage”的计费项改名为“usage credits”,更直白。修了一堆 bug:终端显示错乱、macOS 上特定文...
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H0·K1·R1
00:41
70d ago
AI HOT 精选· aihot-apiZH00:41 · 05·19
让AI写代码时同步记笔记,方便人类事后查账
这个提示词让AI编码助手在写代码的同时,自动记录设计决策、偏离原始需求的地方、权衡过的方案和遗留问题。相当于给AI的思考过程留了一份“审计日志”,Code Review时可以直接对照笔记看代码,不用再反向猜AI为什么这么写。正文没披露完整模板、token消耗、评测效果或实际采用数据,所以效果到底多好还不确定,但思路挺实用——把AI的隐性判断变成可读文档...
#Code#Tools#Commentary
一句话点评
这个提示词让AI编码助手边写代码边记设计决策、偏离需求的地方、权衡过的方案和遗留问题,相当于给思考过程留了份审计日志,Code Review时直接对照笔记看代码,不用再反向猜AI为什么这么写。正文没披露完整模板、token消耗、评测效果或实际采用数据,所以效果多好还不确定,但思路挺实用——把AI的隐性判断变成可读文档。 短评:思路实用,把AI的隐性判断变成可读文档,但缺模板和实测数据,效果...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
00:04
70d ago
r/LocalLLaMA· rssEN00:04 · 05·19
RTX 5060 Ti 本地跑大模型实测:有人整理了多卡配置和跑分表
Reddit 用户 club-5060ti 把 RTX 5060 Ti 本地跑大模型的零散经验整理成了结构化基准测试仓库,覆盖 1/2/3/4 卡以及混合 CUDA 硬件组合。提交测试结果必须写明拓扑(显卡怎么连的)、运行时、模型、量化精度、上下文长度、KV 缓存和速度。正文没披露具体跑分数据,但至少让想组多卡跑本地模型的人有个统一对比标准,不用再翻零...
#Inference-opt#Benchmarking#NVIDIA#Qwen
一句话点评
短评:给多卡跑本地模型的人统一了对比标准,但没跑分数据,先别太激动。 点评:Reddit 用户 club-5060ti 把 RTX 5060 Ti 本地跑大模型的零散经验整理成了结构化基准测试仓库,覆盖 1/2/3/4 卡以及混合 CUDA 硬件组合。提交测试结果必须写明拓扑(显卡怎么连的)、运行时、模型、量化精度、上下文长度、KV 缓存和速度。这相当于给想组多卡跑本地模型的人一个统一对比...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
00:00
70d ago
AI HOT 精选· aihot-apiZH00:00 · 05·19
Claude Design 升级:Token 限制翻倍,能一口气画完多页 UI 了
Anthropic 把 Claude Design 所有套餐的 Token 上限翻了一倍,之前画完整 UI、多页设计稿或者跑复杂 Agent 工作流时经常卡在 Token 不够用,现在空间大了,连续创作的体验从“能用”变成“真香”。不过正文没披露具体翻倍到多少、什么时候上线、不同套餐之间有没有区别。
#Agent#Code#Anthropic#Claude Design
一句话点评
Anthropic 把 Claude Design 所有套餐的 Token 上限翻了一倍,画完整 UI、多页设计稿或跑复杂 Agent 工作流时不再频繁卡顿,连续创作体验从“能用”变“真香”。不过正文没披露具体翻倍到多少、什么时候上线、不同套餐之间有没有区别。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1

更多

频道

后台