ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-07-26

32 items · updated 3m ago
RSS live
2026-07-26 · 星期日2026年7月26日
23:50
58d ago
r/LocalLLaMA· rssEN23:50 · 07·26
MiniMax-M3视觉能力合并入llama.cpp支持本地多模态推理
llama.cpp 刚合并了 MiniMax-M3 的视觉支持,开发者现在能在本地用这个多模态模型做图片理解。正文没披露具体支持哪些视觉任务、模型大小或性能数据,所以还不知道跑起来有多快、显存吃多少。但合并本身意味着社区可以直接用 llama.cpp 跑 MiniMax-M3 的视觉能力,不用等官方工具。
#Vision#MiniMax#llama.cpp#Open source
一句话点评
Minimax-M3 的视觉能力已合入 llama.cpp,本地跑多模态模型更方便了。不过 Reddit 原文被屏蔽,具体支持了哪些视觉任务、性能如何都没披露。目前只有两条标题,信息量约等于零,建议等官方或实测报告再判断。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R0
23:35
58d ago
Hacker News 首页· rssEN23:35 · 07·26
用你自己的 agent 对话记录蒸馏小模型,号称成本砍半、效果接近顶尖模型
experientiallabs 开源了一个工具,能把你在 agent(让模型进业务流程干活)上跑过的对话记录直接变成训练数据,用来持续微调一个小模型。他们宣称这样蒸馏出来的小模型成本只要原来的一半,效果还能接近顶尖大模型。但正文没给出具体用了哪些模型、跑分对比,也没披露详细的成本计算方式——所以“一半成本”和“前沿质量”这两个说法暂时只能当标题看,得...
#experientiallabs
一句话点评
短评:用 agent 对话记录蒸馏小模型,宣称成本减半、效果接近大模型。但没给模型名、跑分和成本明细,先当标题看。 点评:experientiallabs 开源了一个工具,核心思路是把 agent(让模型进业务流程干活)的对话日志直接当训练数据,持续微调一个小模型,让它学会大模型的回答风格。这本质上是蒸馏+持续学习,方向对——用真实业务数据做对齐,比人工标注便宜。但正文没披露用了哪个大模型...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
23:31
58d ago
彭博科技· rssEN23:31 · 07·26
WSJ:英伟达正谈出资,帮 OpenAI 租下软银在美国的数据中心
《华尔街日报》的消息,英伟达可能在帮 OpenAI 出钱,租用软银在美国的一个数据中心。整个项目的盘子大概在 2500 亿美元。不过 Bloomberg 的原文被反爬页面挡住了,具体条款、时间线、每家出多少都没披露。这 2500 亿到底是项目总规模还是英伟达一家的承诺,目前也没法确认。
#Nvidia#OpenAI#SoftBank#Funding
一句话点评
英伟达可能在帮 OpenAI 出钱租软银的美国数据中心,整个盘子号称 2500 亿美元。但 Bloomberg 原文被反爬页面挡住了,具体条款、每家出多少、这 2500 亿是总规模还是英伟达一家的承诺,全都没法确认。数字很大,信息很空,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
78
SCORE
H1·K0·R1
23:27
58d ago
Hacker News 首页· rssEN23:27 · 07·26
Wattage:给 AI Agent 装个“电表”和“电闸”,超预算就断电
Wattage 是一个开源工具,专门给 AI Agent(让模型进业务流程干活的程序)用的。它干两件事:一是记录每次调用花了多少 token(相当于记电表),二是设一个硬性成本上限——如果 Agent 这次跑超了预算,直接掐断不让继续执行。对跑 Agent 工作流的团队来说,不用自己搭监控就能控制推理开销。不过正文没披露支持哪些模型或框架,兼容性得自己试。
#faizannraza#GitHub
一句话点评
Wattage 是个给 AI Agent 用的开源“电表+电闸”,记录每次调用的 token 数,还能设硬预算,超了直接掐断。对跑 Agent 工作流的团队来说,不用自己搭监控就能控制推理开销。但正文没披露支持哪些模型或框架,兼容性得自己试。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
22:48
58d ago
Hacker News 首页· rssEN22:48 · 07·26
Cursor Bridge:一个 Rust 二进制文件,让你用 Cursor 订阅免费跑 Claude Code
这是一个刚上 GitHub 的开源工具,只有一个 Rust 编译的二进制文件,零配置就能把 Cursor 订阅的额度转给 Claude Code 用。说白了就是省一份钱——如果你已经买了 Cursor,就不用再单独付 Claude Code 的费用了。项目目前只有 13 颗星,刚起步。正文没披露支持哪些模型、有没有速率限制,这点先别太激动。如果是真的,...
#Code#Cursor#Claude Code#hkc5
一句话点评
一个刚上 GitHub 的开源工具,用 Rust 写的单文件,零配置就能把 Cursor 订阅额度转给 Claude Code 用——省一份钱。项目才 13 颗星,刚起步。正文没披露支持哪些模型、有没有速率限制,这点先别太激动。如果是真的,对同时用这两款工具的个人开发者挺省钱。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K1·R1
21:24
58d ago
Product Hunt · AI· rssEN21:24 · 07·26
Grok 4.5 发布:xAI 新模型主攻编程和工程任务
xAI 在 Product Hunt 上发布了 Grok 4.5,定位是写代码、跑自动化任务和做知识工作。训练数据覆盖编程、科学、工程和数学,官方说它在真实工程任务上超过了同类领先模型。免费可用,但正文没披露具体跑分、上下文长度或推理成本,所以这点先别太激动——如果真能免费达到顶级编码水平,那确实挺省钱。
#Code#Reasoning#xAI#Grok
一句话点评
Grok 4.5 号称在真实工程任务上超过同类模型,且免费可用。但正文没披露具体跑分、上下文长度或推理成本,所以这点先别太激动——如果真能免费达到顶级编码水平,那确实挺省钱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
20:53
58d ago
Hacker News 首页· rssEN20:53 · 07·26
用 Lean 写了个 Zstandard 解压器,证明 LLM 终于能自动写证明了
作者用 Lean 语言写了一个 Zstandard 解压器,核心论点是:LLM 现在能自动处理大部分证明义务,让依赖类型语言(如 Lean、Rocq)从“写证明比写代码累 10 倍”变成可用的工具。他引用了 seL4 项目的数据:证明耗时是设计和实现的 10 倍,证明代码行数是 C 代码的 20 倍。现在 LLM 可以自动生成证明,不再需要人手动磨。文...
#Code#Lean#Rocq#Zstandard
一句话点评
作者用 Lean 写了个 Zstandard 解压器,核心论点是 LLM 现在能自动处理大部分证明义务,让依赖类型语言从“写证明比写代码累 10 倍”变成可用工具。他引用了 seL4 项目的数据:证明耗时是设计和实现的 10 倍,证明代码行数是 C 代码的 20 倍。现在 LLM 可以自动生成证明,不再需要人手动磨。文章没提具体用了哪个模型,也没给延迟或成功率数字,所以这点先别太激动。如果是...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
20:24
58d ago
Product Hunt · AI· rssEN20:24 · 07·26
Rivault:AI 代理想动你的敏感数据,得先过 Face ID 这一关
Rivault 是一个零知识保险库,专门管 AI 代理能不能碰你的敏感数据。比如代理要订机票,需要你的护照号或信用卡,它会先发一个授权请求,你用 Face ID 或 Passkey 解锁,任务完成后数据自动脱敏。Rivault 默认看不到你的数据。目前标了“免费”,但具体定价细节正文没披露。
#Rivault#Hyu Lim#Claude Code
一句话点评
Rivault 是一个零知识保险库,专门管 AI 代理能不能碰你的敏感数据。代理要订机票需要护照号或信用卡,它会先发授权请求,你用 Face ID 或 Passkey 解锁,任务完成后数据自动脱敏。Rivault 默认看不到你的数据。目前标了“免费”,但具体定价细节正文没披露。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
17:28
58d ago
Hacker News 首页· rssEN17:28 · 07·26
Boffin:给 AI 编程助手加了个“架构师”,每次改代码前先过一遍项目规矩
Boffin 做的事很直接:它拦在 AI 编程助手和你的代码之间,每次助手要改文件,Boffin 就按你定好的架构约束检查一遍,防止项目结构被改歪。帖子就一句话,没讲具体怎么实现、支持哪些编程助手、约束能细到什么程度。想法是清楚的,但正文没披露任何实现细节,也没人评论,现在只能当个概念看。
#Code#Agent#Boffin
一句话点评
Boffin 在 AI 编程助手每次改代码前加一道架构检查,防止项目结构跑偏。想法很实用,但正文没披露支持哪些助手、约束能细到什么程度、性能开销多大。目前零评论、3 个点赞,只能当概念看。如果是真的,对维护大项目挺省钱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
15:51
58d ago
Hacker News 首页· rssEN15:51 · 07·26
设计就是妥协
Steph Ango 说“妥协”不是脏话,就是做取舍。没有产品能样样精通,明确承认自己哪里不行,反而能在另一个方向做到极致。想讨好所有人,结果就是哪都不突出。好设计不是没有妥协,而是选对妥协。
#Steph Ango
一句话点评
Steph Ango 这篇 2018 年的短文把“妥协”重新定义为“做取舍”,说好设计不是没有妥协,而是选对妥协。观点本身不新,但表达清晰,适合产品经理和设计师当提醒。正文没有具体案例或数据支撑,更像一篇个人博客随笔。如果你正在纠结产品方向,可以花一分钟读一下,但别指望有实操方法。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
13:25
58d ago
Hacker News 首页· rssEN13:25 · 07·26
Nautilus:不用K8s也能管服务器,一个轻量级桌面工具
Nautilus 是一个用 Tauri(Rust)和 React 写的跨平台 Linux 服务器管理工具,通过 Docker、SSH 和 SFTP 来操作服务器,主打轻量,目标用户是那些不想上 Kubernetes 的小团队或单机运维。项目刚上线 GitHub,目前 26 个星,正文没披露性能基准或生产环境用例,所以这点先别太激动。如果你只需要管一两台...
#Nautilus#ricardoborges#Open source
一句话点评
Nautilus 是一个用 Rust + React 写的跨平台 Linux 服务器管理工具,通过 Docker、SSH 和 SFTP 操作,主打轻量,目标用户是不想上 K8s 的小团队或单机运维。项目刚上线 GitHub,目前 26 个星,正文没披露性能基准或生产环境用例,所以这点先别太激动。如果你只需要管一两台机器,它可能比 K8s 省事,但成熟度还很低,别当生产工具用。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
13:13
58d ago
Hacker News 首页· rssEN13:13 · 07·26
AI 提升效率后,最大的坑是同时开 40 个项目然后 burnout
作者用 AI 把单任务效率提升了 2-100 倍,结果同时开了 40 个“概念验证”项目,差点 burnout。核心教训:AI 能做的事变多了,但人的时间和注意力是有限的。与其横向铺开,不如挑几件事往深做。作者引用了 Garry Tan 的“日全食 vs 日偏食”比喻——最后 1% 的打磨可能花掉 50-90% 的时间,但带来的效果是 100 倍的差距...
#Rick Manelius#Garry Tan
一句话点评
作者用AI把单任务效率提了2-100倍,结果同时开了40个概念验证项目,差点burnout。核心教训:AI能做的事变多了,但人的时间和注意力是有限的。与其横向铺开,不如挑几件事往深做。作者引用了Garry Tan的“日全食vs日偏食”比喻——最后1%的打磨可能花掉50-90%的时间,但带来的效果是100倍的差距。AI让那最后1%变便宜了,所以没理由不把事做完。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
09:01
58d ago
Hacker News 首页· rssEN09:01 · 07·26
Ruff v0.16.0:默认规则从59条暴增到413条,还能格式化Markdown里的Python代码
Astral 发布了 Ruff v0.16.0。最大的变化是默认开启的 lint 规则从59条涨到413条,相当于不配任何配置文件就能多抓一堆语法错误和运行时 bug。新功能包括:能格式化 Markdown 文件里的 Python 代码块(支持 py、pycon、pyi 标签),以及新增了 ruff: ignore 和 ruff: file-ignor...
#Astral#Ruff
一句话点评
Ruff v0.16.0 默认 lint 规则从 59 条暴涨到 413 条,不配任何配置文件就能多抓一堆语法错误和运行时 bug。新功能包括格式化 Markdown 里的 Python 代码块,以及新的注释屏蔽语法。想回到旧版 59 条规则,配 select = ["E4", "E7", "E9", "F"] 就行。 短评:默认规则翻 7 倍,对新手和 CI 友好,但老项目可能突然报一堆...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
08:02
58d ago
Product Hunt · AI· rssEN08:02 · 07·26
Edit Mind 接入 Strava:用自然语言搜视频,心率配速当标签
Edit Mind 是一款纯本地的视频搜索工具,你可以像跟朋友描述一样搜素材,不用联网。这次新接入了 Strava,能把每一段画面匹配到对应的运动记录上——心率、速度、海拔、距离都对齐到帧。如果你用 GoPro 或运动相机,GPS 数据能让匹配更准。适合内容创作者、剪辑师和记者。正文没披露是否支持中文搜索,也没说价格和免费额度。
#Edit Mind#Strava#GoPro
一句话点评
纯本地视频搜索工具,新接Strava能把心率、速度、海拔对齐到每一帧,适合剪辑师找素材。但正文没提是否支持中文搜索,也没说价格和免费额度,这点先别太激动。如果是真的挺省钱,毕竟不用上传云端。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
04:30
58d ago
量子位 · 公众号· rssZH04:30 · 07·26
MonkeyOCRv2:0.7B模型拿下17语种文档解析,一年前同类还要3B
MonkeyOCRv2用0.7B参数做到了17种语言的文档解析,开源模型里排第一。一年前类似任务要3B模型,参数量直接砍到四分之一不到。但正文没披露具体评测分数和训练数据量,所以这个“第一”到底领先多少、靠多少样本堆出来的,目前不清楚。模型已开源,想试可以直接拉下来跑。
#MonkeyOCRv2
一句话点评
MonkeyOCRv2用0.7B参数做到17语种文档解析,开源第一。一年前类似任务要3B,参数量砍到四分之一以下,成本降很多。但正文没披露具体评测分数和训练数据量,这个“第一”领先多少、靠多少样本堆出来的不清楚。模型已开源,想试可以直接拉下来跑。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
04:00
58d ago
FT · 科技· rssEN04:00 · 07·26
打工人开始怀念没有AI的日子
FT这篇报道捕捉到一种正在蔓延的情绪:AI疲劳。不是技术不好,而是工具频繁更换、被逼着“学新技能”让人心累。很多人怀念不用跟提示词打交道的日子。文章描述的是氛围,不是硬数据——AI落地速度超过了人的适应能力。
#Financial Times
一句话点评
FT这篇讲的是AI疲劳——不是技术不好,而是工具换太勤、被逼着学新东西让人心累。很多人怀念不用跟提示词打交道的日子。文章描述的是氛围,不是硬数据,没有具体调研数字或样本量。AI落地速度超过了人的适应能力,这点先别太激动,它更像一篇社会观察,不是技术分析。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
03:54
58d ago
AI HOT 精选· aihot-apiZH03:54 · 07·26
在 8 美元的 ESP32-S3 芯片上跑 2890 万参数大模型
这个 GitHub 项目把 2890 万参数的大模型塞进了一颗 8 美元的 ESP32-S3 微控制器里,不需要 GPU 也不用联网,直接在本地跑推理。2890 万参数在今天的 LLM 里算很小的,但放在智能家居、可穿戴设备这类低功耗场景里够用。项目提供了模型转换和部署脚本,但正文没披露推理速度,也没说支持哪些模型架构——这两点很关键,速度太慢就没法用...
#ESP32-S3#slvDev#Open source
一句话点评
8美元的ESP32-S3跑2890万参数模型,不用GPU不联网,本地推理。参数虽小,但智能家居、可穿戴够用。项目给了转换和部署脚本,但没披露推理速度和支持哪些模型架构——速度太慢就没法用,这点先别太激动。如果是真的挺省钱,但信息缺口明显。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
02:18
58d ago
Hacker News 首页· rssEN02:18 · 07·26
把《绿野仙踪》18万字小说拆成知识图谱,234个节点、1852条关系
SynapTale 把《绿野仙踪》系列18万词的小说文本,抽成了一个时序知识图谱。演示版有234个节点(角色、地点、事件、魔法物品等19种类型)和1852条边(欺骗、救援、杀死等98种关系类型)。你可以按章节过滤、找两个节点之间的路径,也能看到关键转折点——比如多萝西和稻草人之间有14个关键互动时刻。正文没披露用了什么抽取模型、准确率多少,但这个规模对...
#SynapTale
一句话点评
SynapTale 把《绿野仙踪》18万词小说抽成时序知识图谱,234个节点、1852条边,能按章节过滤、查角色路径。多萝西和稻草人之间有14个关键互动时刻,这个粒度对叙事分析挺实用。但正文没披露用了什么抽取模型、准确率多少,所以节点和边的质量要打个问号。如果是手工标注那规模不大,如果是全自动抽取那精度存疑。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
00:36
59d ago
Hacker News 首页· rssEN00:36 · 07·26
Inflect-Micro-v2:936万参数就能合成完整语音
这个模型只有936万参数,比主流语音模型动辄上亿的参数小了一个数量级,理论上很适合跑在手机或IoT设备上。但正文没披露音质、延迟和训练数据量,所以实际效果要打问号。如果真能在小芯片上跑出可用的语音,那边缘设备做语音交互的成本会低很多。
#Hugging Face
一句话点评
936万参数的语音模型,比主流模型小一个数量级,理论上能跑在手机或IoT设备上。但正文没披露音质、延迟和训练数据量,实际效果要打问号。如果是真的,边缘设备做语音交互的成本会低很多。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
00:25
59d ago
AI HOT 精选· aihot-apiZH00:25 · 07·26
xAI 发布 Grok 命令行工具,输入 /tutorial 就能上手
马斯克宣布 xAI 推出 Grok CLI(命令行工具),用户下载 Grok Build 后输入 /tutorial 即可开始使用。正文没披露具体功能、支持哪些平台或定价,只给了一个下载链接。如果你习惯用终端操作,这算是个新入口,但具体能做什么还得等实测。
#xAI#Elon Musk
一句话点评
马斯克发了个下载链接,说 Grok 出了命令行工具,输 /tutorial 就能用。正文没披露支持哪些平台、具体能跑什么任务、要不要付费。如果是真的,对习惯终端的开发者算多一个入口,但功能边界和定价全是空白,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
00:00
59d ago
Computing Life · Share · 鸭哥调研· rssZH00:00 · 07·26
AI agent 开始删文件了,用结果确定性搭一套它毁不掉的备份
OpenAI 的 GPT-5.6 Sol 模型在 agent 编程时会误删整个 $HOME 或代码库,破坏力远超人类手滑。作者没去教 AI 敲命令行,而是给了一段自然语言 prompt,让 AI 助手自己搭好 Borg 加密增量备份、配好定时任务,并强制做一次恢复测试——从备份里提取真实文件,比对 SHA-256 哈希值,对上了才算成功。从外置硬盘起步...
#Agent#Code#OpenAI#GPT-5.6
一句话点评
短评:AI agent 误删文件不是段子,GPT-5.6 Sol 已确认会删 $HOME。作者没教 AI 敲命令,而是用一段 prompt 让 AI 自己搭好 Borg 加密增量备份并强制做恢复测试——SHA-256 对不上就不算成功。核心判断:没测试过恢复的备份等于没有。关键数字:Borg 增量备份只存变化块,省空间;恢复测试必须比对哈希值。信息缺口:正文没披露 GPT-5.6 误删的具体...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0

更多

频道

后台