ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-06-21

20 items · updated 3m ago
RSS live
2026-06-21 · 星期日2026年6月21日
22:55
36d ago
Hacker News 首页· rssEN22:55 · 06·21
用 850 条样本微调 Qwen 3:0.6B,问题分类准确率从 10% 涨到 79%
作者想给自家做个问答机器人,先让一个 6 亿参数的小模型把问题分到“泳池”“暖通”等类别,再缩小搜索范围。直接靠提示词让原版模型分类,131 道题只对了 13 道(10%),模型还老自己发明新类别。用 Unsloth 和 QLoRA 微调后,同样 131 道题对了 104 道(79%),训练数据只有约 850 条。正文没披露训练耗时和硬件配置,但样本量...
#Fine-tuning#Qwen#Unsloth
一句话点评
用 850 条自家问题微调 Qwen 3:0.6B,分类准确率从 10%(13/131)跳到 79%(104/131)。小模型+QLoRA 成本低,适合个人项目。但正文没披露训练耗时和硬件,样本量小且领域窄,泛化能力未知。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
22:47
36d ago
Product Hunt · AI· rssEN22:47 · 06·21
NeuralAgent 3.0:一个能替你操作电脑的 AI,每次点击只要 285 毫秒
NeuralAgent 3.0 是一个能直接控制你电脑的 AI 助手——它能看到你的屏幕,自己打开应用、点按钮、管理文件。核心卖点是速度:每次 UI 操作(比如点一下、打一行字)大约只要 285 毫秒。它用两个模型分工:一个快速模型专门执行动作,另一个推理模型负责规划和出错后恢复。支持 Windows 和 macOS,桌面和浏览器都能用。正文没披露具体...
#NeuralAgent#Khaled Shadid
一句话点评
NeuralAgent 3.0 号称每次 UI 操作只要 285 毫秒,比同类快不少。它用两个模型分工:一个快的负责点按钮打字,一个慢的负责规划和纠错。支持 Windows 和 macOS,桌面和浏览器都能用。短评:速度是亮点,但正文没披露定价,只说有免费选项,也没给基准测试或对比数据。如果是真的,挺省钱。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
21:05
36d ago
Hacker News 首页· rssEN21:05 · 06·21
Recall:给 Claude Code 装个本地记忆,不用每次开新会话都重新解释项目
Recall 是一个完全离线的小工具,帮 Claude Code 记住你的项目信息。它会把项目文件、目录结构和你的偏好索引到本地的向量库里,下次开新会话时自动把相关上下文塞进去,省掉反复解释的 token 消耗。正文没提索引多久刷新一次,也没说本地存储会占多大空间。
#raiyanyahya#Claude Code
一句话点评
给 Claude Code 装个本地记忆,下次开新会话不用再从头解释项目。思路对,但正文没披露索引刷新策略和存储开销,小项目可以试试,大项目先观望。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
18:04
37d ago
AI 群聊日报· atomZH18:04 · 06·21
AI 用得越猛,升职越没戏?三张 5060 Ti 跑本地大模型,微信 AI 内测
今天群聊最值得看的是 @今天群内信息量极大 写的长文,讲自己在中厂用 AI 把产出拉到全公司最高,VP 夸他“超人速度交付”,结果连续两次升职被毙。复盘发现,正因为交付太快,他在高管眼里从出主意的“脑”变成了干活的“手”,项目越做越散,到升职时根本讲不出成体系的故事。文章核心观点是:别只响应公司给你的奖励机制,得主动设计你给别人的奖励机制,控制交付的摩...
#Code#Agent#Qwen 3.6 27B#RTX 5060 Ti
一句话点评
今天群聊最值得看的是 @今天群内信息量极大 写的长文,讲自己在中厂用 AI 把产出拉到全公司最高,VP 夸他“超人速度交付”,结果连续两次升职被毙。复盘发现,正因为交付太快,他在高管眼里从出主意的“脑”变成了干活的“手”,项目越做越散,到升职时根本讲不出成体系的故事。文章核心观点是:别只响应公司给你的奖励机制,得主动设计你给别人的奖励机制,控制交付的摩擦。 这个判断来自作者的真实经历,不是...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R1
16:41
37d ago
Hacker News 首页· rssEN16:41 · 06·21
软件定价的“可卖最小单元”:买还是用AI自建,算一笔账
作者用Jira和Salesforce算了一笔账:AI让自建软件变便宜了,但没免费。一个年薪20万美元的工程师,每月最多只能花4小时维护自建版Jira才能回本(省下的400美元订阅费刚好覆盖工时成本),但初始搭建就要几周。结论是存在一个“可行区间”:定价合理且复杂度够高的软件,买比自建划算;低于某个门槛,自建更省钱。
#Atlassian#Salesforce#Claude
一句话点评
短评:用Jira算了一笔账:AI让自建变便宜,但没免费。 作者用Jira和Salesforce算账,结论很实在:一个年薪20万美元的工程师,每月最多只能花4小时维护自建版Jira才能回本(省下的400美元订阅费刚好覆盖工时成本),但初始搭建就要几周。所以存在一个“可行区间”:定价合理且复杂度够高的软件,买比自建划算;低于某个门槛,自建更省钱。 关键数字:$400/月订阅费 vs $96/...
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K1·R0
16:14
37d ago
Hacker News 首页· rssEN16:14 · 06·21
AI 把招聘搞坏了:简历能造假,面试能作弊,HBR 建议换考实操
HBR 访谈了 120 位招聘负责人、分析了 6380 场初筛面试,结论是生成式 AI 让简历和视频面试都失效了。简历可以用 AI 批量优化,面试也能靠实时辅助工具作弊。作者建议放弃传统面试,改用工作样本测试(让候选人直接做一道实际工作题)。正文没提具体工具或技术方案,也没给数据验证这个建议的效果。
#Harvard Business Review#Personnel
一句话点评
HBR 访谈了 120 位招聘负责人、分析了 6380 场初筛面试,结论是 AI 让简历和视频面试都失效了——简历能被批量优化,面试也能靠实时辅助工具作弊。建议放弃传统面试,改用工作样本测试(让候选人直接做一道实际工作题)。但正文没给数据验证这个建议的效果,也没提具体工具或技术方案。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
14:40
37d ago
TechCrunch AI· rssEN14:40 · 06·21
iOS 27 的 AI 功能不止 Siri:苹果把 AI 塞进了日常应用里
苹果在 iOS 27 里没有只靠新版 Siri 来撑 AI 场面,而是把 AI 直接嵌进了用户已经天天用的那些应用里,目标是解决实际问题,不需要你学新操作。正文没列出具体有哪些功能,只说了方向:让 iPhone 能在你已有的使用习惯里帮你干活,而不是让你去适应一个新助手。
#Apple#iOS 27
一句话点评
苹果在 iOS 27 里没只靠新版 Siri 撑 AI,而是把 AI 塞进用户天天用的 App 里,目标是让你不用学新操作就能干活。正文没列具体功能,只说了方向——这点先别太激动,等实测。关键看苹果能不能真做到“无感嵌入”,而不是又一个画饼的智能助手。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
10:11
37d ago
AI HOT 精选· aihot-apiZH10:11 · 06·21
美团 tabbit 国际版把 GPT-5.5、Claude Opus 4.8 等旗舰模型打包免费开放了
tabbit 国际版一口气接入了 GPT-5.5、Claude Opus 4.8、Gemini 3.5 Flash,外加国内的 Kimi-2.6、GLM-5.1 和 MiniMax-M3,不用单独订阅就能用。国内版只给国内模型,海外模型是国际版独占。现在还在免费推广期,正文没提免费到什么时候、以后怎么收费,这点先别太激动。
#Meituan#tabbit#OpenAI
一句话点评
美团把GPT-5.5、Claude Opus 4.8、Gemini 3.5 Flash和国内几款旗舰模型打包进一个App,国际版免费免订阅。对想尝鲜多模型但不想分别付费的用户很友好。但正文没披露免费期多长、以后怎么收费,也没说是否限频次或限上下文。如果是真免费且不限量,那挺省钱;但推广期一过可能就变脸,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
07:13
37d ago
Product Hunt · AI· rssEN07:13 · 06·21
AgentX:一个能搭多智能体团队、还能跑测试的工具,支持任意大模型
AgentX 是一个多智能体框架,让你用任意大模型搭协作 AI 团队,还自带评测系统。你可以建测试集、跑评估、对比不同模型的表现和成本,在上线前定位问题。它把 CI/CD 那套流程搬到了智能体开发上。正文没披露具体定价或免费额度,只标了“Free Options”。
#AgentX#Product Hunt#Cloudflare#Benchmark
一句话点评
AgentX 把 CI/CD 那套搬到了多智能体开发上:你可以用任意大模型搭协作团队,建测试集、跑评估、对比不同模型的表现和成本,上线前定位问题。自带评测系统这点挺实用,相当于给智能体团队配了个“体检医生”。不过正文没披露具体定价或免费额度,只标了“Free Options”,实际门槛未知。如果是真的,对想上多智能体但怕失控的团队是个低成本验证工具。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
04:51
37d ago
AI HOT 精选· aihot-apiZH04:51 · 06·21
腾讯元宝父亲节活动:上传照片就能和年轻爸爸合影
腾讯元宝上线父亲节功能:上传一张爸爸年轻时的照片和一张自己的照片,输入提示词(比如“穿越回20年前和爸爸一起打球”),元宝会生成一张合成合影。活动主打用户体验,没提用了什么模型或技术细节。效果好不好取决于照片质量和提示词写得多细,正文没披露生成速度或是否支持多人合影。
#Vision#Tencent#Yuanbao
一句话点评
腾讯元宝上线父亲节活动,上传自己和爸爸年轻时的照片,写句提示词就能生成穿越合影。效果取决于照片质量和提示词细节,正文没披露生成速度、是否支持多人,也没提用了什么模型。玩玩可以,别当正经AI评测。
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K0·R0
00:58
37d ago
Hacker News 首页· rssEN00:58 · 06·21
AI 写的代码能跑,但我还是会扔掉重写
作者 Vinicius Brasil 认为,用 AI 写代码真正的瓶颈不是生成,而是审查。他列出五条拒绝 AI 代码的理由:自己讲不清实现思路、改动量比问题本身还大、没证明必要就引入抽象、代码能跑但让系统更难理解、以及信任输出超过了自己的判断。他经常把 AI 改的东西全删了重来,第二次效果更好,不是因为模型变强了,而是工程师自己把问题想透了。CI 绿灯...
#Vinicius Brasil
一句话点评
这篇博客讲的是用 AI 写代码的真实瓶颈:不是生成,是审查。作者 Vinicius Brasil 说他经常把 AI 改的东西全删了重来,第二次效果更好,不是因为模型变强了,而是他自己把问题想透了。他列出五条拒绝 AI 代码的理由,第一条就是“我没法用自己的话讲清楚实现思路”。这点很实在——代码能跑、CI 绿灯,不代表方案合理、可扩展。文章没给数据,纯个人经验,但判断逻辑清晰。缺的是:他用的什...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R1
00:12
37d ago
Hacker News 首页· rssEN00:12 · 06·21
送货机器人遭抵制:行人被逼让路,多城开始禁行
BBC报道,芝加哥、旧金山、多伦多和格伦代尔等地居民开始抵制送货机器人。芝加哥居民John Roberts发起全市暂停请愿,已收集约4400个签名。旧金山限制了机器人的运营区域,多伦多自2021年起禁止其使用人行道。格伦代尔市议会正考虑临时禁令,理由是机器人占用 sidewalk、阻挡应急车辆、发生碰撞。英国谢菲尔德还出现了Uber Eats机器人被破...
#Starship Technologies#Uber Eats#BBC#Policy
一句话点评
送货机器人从酷炫变成过街老鼠,芝加哥、旧金山、多伦多等地居民开始抵制。核心矛盾是机器人占了人行道,行人反而要躲它。芝加哥一份请愿收集了约4400个签名,要求全市暂停运营。旧金山已限制运营区域,多伦多2021年起就禁止上人行道。格伦代尔市议会正考虑临时禁令,理由是机器人挡路、阻挡应急车辆、还发生过碰撞。英国谢菲尔德甚至有Uber Eats机器人被破坏。运营商Starship Technolog...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1

更多

频道

后台