ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-14

50 items · updated 3m ago
RSS live
2026-05-14 · 星期四2026年5月14日
23:54
74d ago
AI HOT 精选· aihot-apiZH23:54 · 05·14
Yetone 开源了一个 Agent Skill,让桌面应用代码写出原生手感
开发者 Yetone 把一篇桌面应用“最佳实践”文章做成了 Agent Skill,叫 native-feel-skill。Coding Agent 拿到这个 Skill 后,重构或开发跨平台桌面应用时,会自动遵循那些让界面响应快、交互跟手的写法,最终效果接近原生应用。项目代码已开源在 GitHub。正文没披露具体用了哪些最佳实践条目,也没说支持哪些框...
#Agent#Code#Yetone#GitHub
一句话点评
短评:把最佳实践做成Agent Skill,让Coding Agent自动写出接近原生体验的桌面应用,思路挺实用。 点评:开发者Yetone把一篇桌面应用“最佳实践”文章做成了Agent Skill,叫native-feel-skill。Coding Agent拿到这个Skill后,重构或开发跨平台桌面应用时,会自动遵循那些让界面响应快、交互跟手的写法,最终效果接近原生应用。项目代码已开源...
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
23:37
74d ago
Hacker News 首页· rssEN23:37 · 05·14
Rust 编译器要出 LLM 使用政策
Rust 官方仓库 rust-lang/rust 正在讨论是否给编译器项目加一条 LLM 使用政策。目前只有一个 PR 链接,正文没披露政策具体条款,比如是否禁止 AI 生成的代码提交、要不要标注 AI 辅助等。Hacker News 上有 24 票和 7 条评论,讨论热度不高。如果政策落地,Rust 会是少数明确约束 LLM 使用的主流编译器项目之一。
#Code#Rust#Hacker News#Policy
一句话点评
Rust 编译器项目正在讨论是否要出台 LLM 使用政策,目前只有一个 PR 链接,具体条款(比如是否禁止 AI 生成的代码提交、要不要标注 AI 辅助)正文没披露。Hacker News 上只有 24 票和 7 条评论,讨论热度不高。如果政策落地,Rust 会是少数明确约束 LLM 使用的主流编译器项目之一。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
23:32
74d ago
AI HOT 精选· aihot-apiZH23:32 · 05·14
OpenCode 和 Qwen 3.6 Plus 又免费了
OpenCode 和 Qwen 3.6 Plus 开启了第二轮免费使用。官方说上次被薅光了 GPU,这次加了更多算力。但没说明免费额度、能用多久、免费期后怎么收费,也没说要不要申请资格。想白嫖的可以再试试,但别抱太大期望。
#Code#OpenCode#Qwen#Product update
一句话点评
OpenCode 和 Qwen 3.6 Plus 又免费了,上次被薅光 GPU,这次加了算力。但正文没披露免费额度、能用多久、免费后怎么收费,也没说要不要申请。想白嫖可以再试,别抱太大期望。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
23:11
74d ago
欧盟 AI 法案· rssEN23:11 · 05·14
欧盟AI法案第50条透明度规则实操指南:2026年8月起,聊天机器人、AI生成内容、情绪识别和深度伪造都得贴标签
欧盟AI法案第50条从2026年8月2日起生效,要求四类AI使用场景必须做透明度披露,不限于高风险系统。第一,跟AI直接交互(比如聊天机器人)得告诉用户对面不是真人;第二,AI生成的合成内容(文字、图片、音频)要打水印或标注;第三,情绪识别和生物特征分类系统必须告知用户正在被识别;第四,深度伪造和涉及公共利益的AI生成文本也要标注。罚金最高可达3500...
#Safety#EU AI Act#European Commission#Policy
一句话点评
欧盟AI法案第50条2026年8月2日生效,要求四类场景必须做透明度披露:聊天机器人要告诉用户对面不是真人、AI生成内容要打水印、情绪识别要告知用户、深度伪造要标注。罚金最高3500万欧元或全球年营收7%。不限于高风险系统,范围比预期宽。但正文没解释水印技术标准是否统一,也没说小企业合规成本有多高。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
23:09
74d ago
r/LocalLLaMA· rssEN23:09 · 05·14
Llama-Studio:给本地 llama-server 套了个 Web 管理界面
开发者 m94301 发了个开源工具 Llama-Studio,用 Python 加少量 JS 给 llama-server 做了个 WebUI。核心功能是按模型保存 JSON 配置、固定端口跑多个实例、选 GPU、看显存占用,还内置了一个启动参数浏览器——直接读当前 llama-server 的 -help 输出,不用再开终端查参数格式。带一个粗略的...
#Tools#Inference-opt#m94301#Llama-Studio
一句话点评
Llama-Studio 给 llama-server 套了个 WebUI,按模型存配置、固定端口跑多实例、选 GPU、看显存,还内置了启动参数浏览器,不用再开终端查参数格式。作者说主要用来在家折腾设置、对比实验版和主线版。带手机界面,地下室也能改配置。开源,Python 加少量 JS。但正文没披露用户量、稳定性或性能开销,算是个个人工具,适合本地玩家尝鲜,生产环境慎用。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
22:44
74d ago
Hacker News 首页· rssEN22:44 · 05·14
英国难民安置系统换掉Palantir,省了“数百万”英镑
英政府自建系统替换了Palantir的Foundry平台,用于管理乌克兰难民住宿匹配。之前Palantir免费搭了6个月,后来两年合同分别花了450万和550万英镑。新系统由住房社区部内部团队开发,说每年能省“数百万”运行成本,而且更灵活、数据代码自己控制。正文没披露具体节省数字和开发成本,所以“数百万”还是个模糊数。这事也反映了英国对过度依赖美国大厂...
#BBC#Palantir#Policy
一句话点评
英政府自建系统替换Palantir,用于乌克兰难民住宿匹配。Palantir最初免费搭了6个月,后来两年合同分别花了450万和550万英镑。新系统由住房社区部内部开发,说每年能省“数百万”运行成本,更灵活、数据代码自己控制。正文没披露具体节省数字和开发成本,所以“数百万”还是个模糊数。这事也反映了英国对过度依赖美国大厂的警惕,但Palantir在英还有NHS、国防部等大合同,影响有限。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
22:37
74d ago
Hacker News 首页· rssEN22:37 · 05·14
安大略省审计发现,医生用的AI病历记录系统经常搞错基本信息
安大略省审计部门抽查了20款获批的AI病历记录系统(AI Scribe),发现60%的系统会把处方药写错——比如张冠李戴,把A患者的药记到B患者名下。审计报告还提到,这些系统会漏掉关键信息、凭空编造患者或医生都没说过的话。不过正文没披露具体样本量、错误率、审计方法和产品名称,所以这个60%到底有多严重还不好说。对AI从业者来说,这是个典型的医疗场景下幻...
#Audio#Tools#Safety#Ontario auditors
一句话点评
安大略审计署抽查20款AI病历记录系统,60%会把处方药写错,比如把A患者的药记到B名下。还会漏信息、编造对话。但正文没披露具体样本量、错误率、审计方法和产品名,这个60%到底多严重还不好说。对AI从业者来说,这是医疗场景下幻觉的实锤案例,但验证力度有限。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
22:21
74d ago
The Verge · AI· rssEN22:21 · 05·14
马斯克诉奥特曼案结案陈词:法官当场纠正马斯克律师
马斯克诉奥特曼案今天结案陈词。马斯克的律师 Steven Molo 表现糟糕:叫错共同被告名字(把 Greg Brockman 喊成 Greg Altman),声称马斯克不要求金钱赔偿但被法官当场纠正,而且整场陈词指控对方撒谎却拿不出多少证据支持马斯克的法律主张。OpenAI 律师 Sarah Eddy 的应对很简单——把己方提交的大量证据按时间线排好...
#Elon Musk#Sam Altman#OpenAI#Policy
一句话点评
马斯克律师结案陈词翻车:叫错被告名字、声称不索赔被法官当场纠正,整场指控对方撒谎但证据不足。OpenAI律师只按时间线排证据就压过对方。案子本身没新信息,看点全在律师表现有多离谱。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
22:05
74d ago
AI HOT 精选· aihot-apiZH22:05 · 05·14
Luma Agents 号称能自动搞定电商素材全流程
Luma Labs 发推说他们的 Luma Agents 可以自动处理电商活动素材,从定义需求、设定风格到输出多种格式,号称能打破瓶颈。但正文没披露具体模型、定价或可复现的基准测试,所以效果和成本都未知。
#Agent#Luma Labs#Product update
一句话点评
Luma Labs 推了个叫 Luma Agents 的自动化工具,号称能包办电商素材从需求定义到多格式输出。但正文没披露用了什么模型、怎么收费,也没给可复现的测试结果,效果和成本全是未知数。短评:画饼阶段,先别激动。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
21:09
74d ago
Product Hunt · AI· rssEN21:09 · 05·14
Basedash MCP Connectors:让 BI 工具直接帮你发邮件、建工单
Basedash 今天上线了 MCP Connectors,核心变化是:它原来只能读数据库、数据仓库和 SaaS 工具里的数据,现在能通过 MCP 协议反过来写数据了。你可以在聊天框里让 AI 把最新注册用户发邮件、把客服工单自动转成 Linear 的 bug、或者根据用户行为更新 HubSpot 的线索状态。支持 Linear、HubSpot、Sla...
#Agent#Tools#Basedash#Product update
一句话点评
Basedash 从只读数据升级为能写数据了:通过 MCP 协议,AI 可以在聊天框里直接操作 Linear、HubSpot、Slack 等工具,比如给新用户发邮件、把客服工单转成 bug。相当于给 BI 工具装上了“手”,能干活了。但正文没披露支持多少应用、权限怎么控制、定价和上线时间,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K0·R1
21:07
74d ago
FT · 科技· rssEN21:07 · 05·14
OpenAI律师:马斯克用毫无根据的诉讼“想把我们缠死”
OpenAI律师在结案陈词中说,马斯克提起的诉讼毫无根据,目的就是“把OpenAI缠死”。这场官司可能影响OpenAI今年计划中的IPO,但正文没披露索赔金额和法院审理时间表。
#OpenAI#Elon Musk#Policy
一句话点评
OpenAI律师在结案陈词中直说,马斯克起诉就是想“缠死”他们,案子毫无根据。这场官司可能影响OpenAI今年计划中的IPO。正文没披露索赔金额和法院审理时间表,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K0·R1
21:05
74d ago
Hacker News 首页· rssEN21:05 · 05·14
Anthropic 开源法律版 Claude:一套插件,帮律师处理合同审查、合规检查等流程
Anthropic 在 GitHub 上发布了 Claude for Legal 项目,是一套面向法律工作流的插件集合。目前仓库有 3.6k Star、554 Fork,热度不低。但正文没有披露具体功能、许可证或部署要求——比如是直接调用 Claude API 的模板,还是需要本地跑模型;支持哪些法律场景(合同审查、法规检索、尽职调查等)也都没写。如果...
#Anthropic#Claude#Hacker News#Product update
一句话点评
Anthropic 在 GitHub 上丢了个 Claude for Legal 项目,说是法律工作流插件集,但正文几乎没写具体功能、许可证或部署要求。3.6k Star 热度不低,但信息缺口太大——是调 API 的模板还是本地跑模型?支持合同审查还是法规检索?全没提。短评:Anthropic 画了个法律 AI 的饼,但连馅儿是什么都没说。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R1
21:02
74d ago
Hacker News 首页· rssEN21:02 · 05·14
Runo:一个按 schema 直接返回 JSON 的爬虫 API,号称效率比同类高 6-7 倍
Runo 是一个新的网页抓取 API,核心卖点是用户只需定义一个 JSON schema(字段名、类型、示例),它就能直接返回结构化数据,不用自己写 CSS 选择器或 XPath,也不用再解析 HTML。作者声称效率比现有方案高 6-7 倍,但这个数字来自自述的“guesstimate”,没有公开测试方法。价格方面,免费版每月 500 次请求,不需要绑...
#Tools#Runo#Firecrawl#Product update
一句话点评
Runo 是一个新的网页抓取 API,核心卖点是用户只需定义一个 JSON schema(字段名、类型、示例),它就能直接返回结构化数据,不用自己写 CSS 选择器或 XPath,也不用再解析 HTML。作者声称效率比现有方案高 6-7 倍,但这个数字来自自述的“guesstimate”,没有公开测试方法。价格方面,免费版每月 500 次请求,不需要绑信用卡,但速率限制很严(1次/分钟),基...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
20:59
74d ago
r/LocalLLaMA· rssEN20:59 · 05·14
TurboQuant 实测:KV 缓存省 2.4 倍,但延迟反而变差了
vLLM 团队对比了 TurboQuant 和 FP8 两种 KV 缓存量化方案。FP8 能把缓存容量翻倍,精度损失几乎可以忽略;TurboQuant 的 k8v4 模式省得更多(2.4 倍),但吞吐和延迟指标全线变差。正文没披露具体测试环境和模型规模,所以这点先别太激动——省缓存但慢下来,对在线服务来说可能得不偿失。
#Inference-opt#Benchmarking#vLLM#MajorZesty
一句话点评
vLLM 团队实测 TurboQuant 和 FP8 两种 KV 缓存量化方案。FP8 缓存翻倍,精度损失几乎可忽略;TurboQuant 的 k8v4 模式省 2.4 倍,但吞吐和延迟全线变差。正文没披露测试环境和模型规模,省缓存但慢下来,在线服务可能得不偿失。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
20:59
74d ago
The Verge · AI· rssEN20:59 · 05·14
马斯克骂同事“蠢驴”,OpenAI 员工做了个奖杯送他
马斯克起诉奥特曼的庭审上出现了一个插曲:OpenAI 员工给研究员 Josh Achiam 定制了一个奖杯,上面刻着“永远别停止当个蠢驴”。起因是马斯克当年离开 OpenAI 时说要赶超 Google,Achiam 质疑“这真的好吗”,马斯克当场骂他 jackass。这个奖杯是同事后来买来送给 Achiam 的。庭审法官让双方律师当众念出奖杯上的字。正...
#Safety#Elon Musk#Sam Altman#OpenAI
一句话点评
庭审上 OpenAI 员工给研究员 Achiam 送了个奖杯,刻着“永远别停止当个蠢驴”——因为当年马斯克离开 OpenAI 说要赶超 Google,Achiam 质疑安全风险,被马斯克骂 jackass。法官让双方律师当众念出奖杯文字。这事跟合同纠纷无关,但暴露了 OpenAI 内部对安全质疑者的态度。正文没披露 Achiam 是否还在 OpenAI。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
20:39
74d ago
● P1Hacker News 首页· rssEN20:39 · 05·14
arXiv推出新政策对幻觉引用的论文实施一年禁投
arXiv 宣布,如果论文里出现编造的参考文献(即模型瞎编的引用),作者将被禁止投稿一年。这条消息来自一条推文,目前只有 24 个点赞和 2 条评论,正文没披露具体怎么界定“编造”、是否区分故意和无意、以及有没有申诉渠道。惩罚力度挺重,但执行细节还不清楚。
#arXiv#Policy#Safety/alignment
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
arXiv 对用 AI 编造参考文献的论文直接禁投一年,这比单纯拒稿狠多了,等于公开划了一条红线。
锐评
arXiv 这次的政策很直接:只要论文里出现 AI 聊天记录的残留、或者编造出不存在的参考文献(也就是“幻觉引用”),作者就会被禁止向 arXiv 投稿一年。这不是在讨论 AI 辅助写作的边界,而是针对最粗糙的“AI 代写然后直接扔上去”的行为。The Verge 的报道里用了“slop”这个词,指的就是那种毫无人工审核痕迹、连提示词都懒得删的垃圾稿件。 政策针对的是“无可辩驳的证据”,比如正文里直接留下了跟 ChatGPT 的对话片段。这其实说明 arXiv 的审核逻辑不是去猜你有没有用 AI,而是抓那些连基本伪装都不做的极端案例。目前正文没披露这个审核是靠人工举报还是自动化工具,也没说一年后解禁的具体条件。这点先别太激动,它管不了那些认真用 AI 润色但仔细改过的人,主要打击的是最底端的学术灌水。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
20:22
74d ago
Hacker News 首页· rssEN20:22 · 05·14
亚马逊爬虫终于认 robots.txt 了
作者收到亚马逊邮件,说从 2026 年 6 月 15 日起,Amazonbot 会按 robots.txt 规则爬站,不再需要手动申请。邮件还保留了 Outlook for Mac 的签名,作者觉得挺搞笑。正文没披露测试条件或变更日期,但这对站长是好事——之前亚马逊爬虫不守规则,逼得作者自己写了个反爬工具 Anubis。现在终于合规,省得自己折腾。
#Amazon#Product update
一句话点评
亚马逊终于让爬虫遵守 robots.txt 了,6 月 15 日起生效。之前 Amazonbot 不守规矩,逼得作者自己写反爬工具 Anubis。邮件还留着 Outlook for Mac 签名,挺搞笑。正文没披露测试条件或变更日期,但这对站长是好事——省得自己折腾。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
20:13
74d ago
彭博科技· rssEN20:13 · 05·14
应用材料业绩预期超分析师预测,AI芯片需求拉动设备订单
应用材料(Applied Materials)给出的销售和利润预期高于分析师估计,主要驱动力是AI计算和存储芯片的需求。正文没披露具体数字、季度和对比范围,所以暂时没法判断这个“超预期”幅度有多大。对AI从业者来说,这条信号是:上游设备商还在扩产,说明下游芯片厂对AI硬件的资本开支没停。
#Inference-opt#Applied Materials#Product update
一句话点评
应用材料(Applied Materials)的销售和利润预期高于分析师估计,靠的是AI芯片需求。上游设备商还在扩产,说明下游芯片厂对AI硬件的资本开支没停。但正文没披露具体数字、季度和对比范围,暂时判断不了“超预期”幅度有多大。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R1
20:11
74d ago
r/LocalLLaMA· rssEN20:11 · 05·14
llama.cpp 每次对话都重算整个提示词,40k token 的缓存几乎没用上
有用户在 LocalLLaMA 反映,llama.cpp 在 150k 上下文窗口下,每次对话都重新处理 4 万多个 token 的提示词。虽然缓存相似度高达 0.996(几乎完全命中),但实际命中的 token 数只有约 4,750,导致提示词评估时间从 19 token 的 473 毫秒暴涨到 44,016 token 的 222 秒。缓存占用 4...
#Agent#Code#Inference-opt#llama.cpp
一句话点评
llama.cpp 在 150k 上下文下,每次对话都重算 4 万 token 的提示词,缓存相似度 0.996 但实际命中不到 5k token,导致单次评估从 0.5 秒飙到 222 秒。问题出在缓存上限设了 2.5GB,实际占用 4.6GB,超限后旧缓存被踢。正文没披露具体复现步骤和 llama.cpp 版本。短评:缓存命中率虚高,实际没省时间,调大缓存上限或换更智能的驱逐策略能缓解。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R1
20:11
74d ago
AI HOT 精选· aihot-apiZH20:11 · 05·14
Mixpanel 接入 Replit MCP,开发流程里直接看数据
Mixpanel 把数据分析功能做成了 Replit 的 MCP 工具,开发者发布产品后不用切后台就能看用户行为数据。正文只提了下周伦敦黑客松有现场演示,没交代具体能查哪些指标、怎么接入、要不要额外付费。
#Tools#Mixpanel#Replit#Product update
一句话点评
Mixpanel 把数据分析做成了 Replit 的 MCP 工具,开发者发完产品不用切后台就能看用户行为数据。正文只提了下周伦敦黑客松有现场演示,没交代具体能查哪些指标、怎么接入、要不要额外付费。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
20:10
74d ago
AI HOT 精选· aihot-apiZH20:10 · 05·14
SuperGrok Heavy 半年六折,Grok Build 开放测试
SuperGrok Heavy 半年套餐从每月 300 美元降到 99 美元,打了约 67% 的折扣,力度不小。同时 Grok Build 开始公测,但正文没披露具体功能范围,这点先别太激动。
#Tools#Grok#SuperGrok#Product update
一句话点评
SuperGrok Heavy 半年套餐从每月 300 美元降到 99 美元,打了六折,力度不小。但 Grok Build 公测只提了一嘴,没披露具体功能范围,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R1
19:57
74d ago
r/LocalLLaMA· rssEN19:57 · 05·14
传英伟达要涨RTX 5090售价,因为GDDR7显存变贵了
Reddit帖子转述报道称,英伟达准备提高RTX 5090的定价,理由是GDDR7显存成本上涨。帖子没透露涨多少、什么时候涨,也没说RTX 50系列和PRO系列是否一起涨。正文被屏蔽,看不到更多细节。对本地跑模型的人来说,5090涨价意味着买卡门槛更高,但消息来源是传闻,可信度要打折。
#Inference-opt#NVIDIA#TechPowerUp#Product update
一句话点评
英伟达准备涨RTX 5090的价,理由是GDDR7显存成本涨了。帖子没透露涨多少、什么时候涨,也没说RTX 50系列和PRO系列是否一起涨。正文被屏蔽,看不到更多细节。对本地跑模型的人来说,5090涨价意味着买卡门槛更高,但消息来源是传闻,可信度要打折。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
19:55
74d ago
Product Hunt · AI· rssEN19:55 · 05·14
DramaBox:给 TTS 写个“剧本”,它就能演出来,还自带水印
Resemble AI 今天在 Product Hunt 上发了 DramaBox,一个能把场景描述转成“有表演感”语音的 TTS 模型。你写一句“主持人假装震惊、倒吸一口气然后大笑”,模型会按这个情绪和节奏去念,而不是平铺直叙。每个输出都打了 Resemble 自家的不可见水印,方便溯源。开源、只支持英文,模型和代码在 Hugging Face 上能...
#Audio#Resemble AI#Product update
一句话点评
Resemble AI 今天发了个叫 DramaBox 的 TTS 模型,亮点是能按场景描述(比如“主持人假装震惊、倒吸一口气然后大笑”)来念台词,带表演感,不是平铺直叙。每个输出都打了自家不可见水印,方便溯源。开源、只支持英文,模型和代码在 Hugging Face 上能找到。 值得看的是“用文字指令控制语气”这个方向,比传统 TTS 更灵活,适合播客、短视频配音。但正文没披露模型参数量...
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R0
19:38
74d ago
r/LocalLLaMA· rssEN19:38 · 05·14
有人在单卡80GB显存上从零训了个7B MoE模型,280B token计划,14000步时事实准确率只有1/3
一位Reddit用户分享了自己从预训练到RLHF(PPO/GRPO)完整训一个7B MoE大模型的过程。模型用了64个专家,上下文窗口4096 token,计划训2800亿token。最抓眼球的是硬件门槛:只用一张80GB显存的GPU就跑起来了。但别急着兴奋——第14000步时模型的事实准确率只有1/3,说明这个规模下模型还没学到多少靠谱知识。正文没披...
#Fine-tuning#Inference-opt#Benchmarking#DeepSeek
一句话点评
一位Reddit用户用单张80GB显卡(如A100或H100)从零训了一个7B MoE模型,64个专家、4096上下文,计划训2800亿token。第14000步时事实准确率仅1/3,说明这个规模下模型还没学到多少靠谱知识。硬件门槛低是亮点,但效果验证很弱,正文没披露训练数据来源和具体评测集。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
19:05
75d ago
TechCrunch AI· rssEN19:05 · 05·14
Clawdmeter:把 Claude Code 用量做成桌面小仪表盘
一个叫 Clawdmeter 的开源小工具,能把你在 Claude Code 里的使用统计变成桌面上的迷你仪表盘,专给重度 AI 编程用户看。目前正文没披露支持哪些平台、显示几个指标、怎么安装,也没说它是读本地日志还是调 API。
#Code#Tools#Clawdmeter#Claude Code
一句话点评
Clawdmeter 是个开源小工具,能把你在 Claude Code 里的使用数据变成桌面仪表盘,适合重度 AI 编程用户。目前正文只说了这些,没提支持什么系统、显示几个指标、怎么安装,也没说它是读本地日志还是调 API。信息缺口挺大,想尝鲜得自己去 GitHub 翻。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
18:59
75d ago
r/LocalLLaMA· rssEN18:59 · 05·14
Qwen3.6 的 Q4 和 Q6 差距大吗?
有人在单张 RTX 3090 上跑 Qwen3.6 密集 27B 模型,用 Q4_M 量化,速度约 65 tok/s,上下文能撑到 6.5 万到 10 万 token。他问换成 Q6 会不会好很多,但没贴 Q6 的实际跑分。所以目前只能知道 Q4 在 3090 上跑得挺快、显存够用,但精度损失多大、Q6 值不值得换,正文没给数据。
#Inference-opt#Qwen#NVIDIA#Commentary
一句话点评
Qwen3.6 27B 在单张3090上Q4量化跑65 tok/s,上下文能到6.5万-10万token,速度不错。但问Q6值不值得换,正文没给Q6数据,精度损失多大未知。建议自己跑个对比,别盲猜。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
18:55
75d ago
Hugging Face 博客· rssEN18:55 · 05·14
IBM 开源多语言嵌入模型 Granite R2:32K 上下文,97M 参数版称霸小模型检索
IBM 发布了 Granite Embedding Multilingual R2,两个模型都基于 ModernBERT 架构,采用 Apache 2.0 开源协议。一个 97M 参数的小模型,在同等规模(1 亿参数以下)的多语言检索任务上拿了最好成绩;另一个 311M 参数的大模型支持 Matryoshka 表示学习(一种可以截断向量维度、按需平衡速...
#Embedding#RAG#Benchmarking#Hugging Face
一句话点评
IBM 开源了 Granite Embedding Multilingual R2,两个 embedding 模型,Apache 2.0 协议。小号 97M 参数,在 1 亿参数以下的多语言检索里拿了 SOTA,支持 32K 上下文窗口。大号 311M 参数支持 Matryoshka 表示学习(可以截断向量维度来平衡速度和精度)。 短评:小模型跑检索性价比不错,但正文没披露具体语言覆盖和评...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
18:49
75d ago
r/LocalLLaMA· rssEN18:49 · 05·14
cyankiwi AWQ 4-bit 量化新方法:用联合缩放让模型输出更接近原版
cyankiwi AWQ 4-bit 量化在 5 月 26 日更新中提出了一种新思路:把缩放因子和量化范围放在一起优化,目标是让量化后的模型输出分布尽量贴近原版。在 GPQA Diamond 测试集上,它对 Llama-3.3-70B-Instruct 的 KL 散度做到了 0.02826,而之前最好的 4-bit 基线是 0.04444——差距接近 ...
#Inference-opt#Benchmarking#cyankiwi#Meta
一句话点评
cyankiwi AWQ 4-bit 量化把缩放因子和量化范围一起优化,让量化后模型输出更贴近原版。在 GPQA Diamond 上,Llama-3.3-70B 的 KL 散度从 0.04444 降到 0.02826,差距接近 36%,说明分布保真度明显提升。不过正文没披露推理速度或显存占用,实际部署收益还不清楚。另外只测了 Llama-3 系列,其他架构效果未知。如果真能无损压缩,对本地部...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R1
18:17
75d ago
Hacker News 首页· rssEN18:17 · 05·14
xAI 推出 Grok Build:一个跑在终端里的编程助手,先给 SuperGrok Heavy 用户用
xAI 今天发布了 Grok Build 的早期测试版,这是一个命令行(CLI)编程助手,面向专业开发者。它可以直接在你的终端里跑,支持先出计划再执行、并行子代理、以及接入你已有的 AGENTS.md、插件、MCP 服务器等工具。目前只对 SuperGrok Heavy 订阅者开放,安装命令是一行 curl。正文没披露具体定价、可用地区或正式发布日期,...
#Code#Tools#xAI#Grok
一句话点评
xAI 出了个终端里的编程助手 Grok Build,目前只给 SuperGrok Heavy 订阅者用。亮点是能先出计划让你审再执行、并行跑子代理、还能接你已有的 AGENTS.md 和 MCP 服务器。一行 curl 安装,挺方便。但正文没披露具体定价、可用地区或正式发布日期,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K0·R1
18:16
75d ago
Product Hunt · AI· rssEN18:16 · 05·14
Coworker AI:按任务自动切换模型,号称省80%的API费
Coworker AI 的核心卖点是“上下文感知的模型路由”——说白了就是系统会根据你当前的任务(聊天、写代码、做文档、跑自动化流程等),自动选一个最便宜且够用的模型来干活,而不是所有请求都走最贵的旗舰模型。官方举了个例子:一家公司去年12月花50万美元的AI费用,到今年5月涨到1500万,CFO开始问“是砍AI预算还是砍人头”。Coworker 给的...
#Inference-opt#Coworker AI#Product update
一句话点评
Coworker AI 的核心是“上下文感知模型路由”,说白了就是系统根据任务自动选最便宜够用的模型,不一股脑全上旗舰。官方举了个例子:一家公司AI费用从去年12月的50万美元涨到今年5月的1500万,CFO开始问砍预算还是砍人头。这个痛点很真实,但正文没披露支持哪些模型、定价、路由规则,也没说实测能省多少。概念不新,关键看落地效果和成本透明度。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K0·R1
18:09
75d ago
AI HOT 精选· aihot-apiZH18:09 · 05·14
Anthropic 发报告:美国在 AI 前沿领先,但没说怎么保持
Anthropic 发了一篇关于中美 AI 竞争的报告,结论是美国及其民主盟友目前在前沿 AI 领域领先。但正文没披露评估指标、具体策略或时间线,所以这个结论有多大参考价值不好说。想了解怎么保持优势的话,得自己点链接看全文。
#Anthropic#Policy#Commentary
一句话点评
Anthropic 发报告说美国及其盟友在前沿 AI 领先中国,但正文没披露评估指标、具体策略或时间线,结论参考价值有限。想了解怎么保持优势得自己点链接看全文。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H0·K0·R1

更多

频道

后台