ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-06-09

50 items · updated 3m ago
RSS live
2026-06-09 · 星期二2026年6月9日
15:02
49d ago
AI HOT 精选· aihot-apiZH15:02 · 06·09
Claude Mythos 几小时内发布,精简版 Fable 同日上线
Anthropic 的 Claude Mythos 将在几小时内揭晓,同时推出精简版 Claude Fable,定价是 Opus 的两倍——比最初 Mythos 的 5 倍 Opus 定价便宜不少,但依然很贵。正文没披露模型参数量、上下文窗口、跑分或具体上线时间表,目前只有定价信息。
#Anthropic#Claude#Apple#Product update
一句话点评
Claude Mythos 几小时内发布,同时推精简版 Fable,定价 Opus 两倍,比最初传的五倍便宜。但正文没披露参数量、上下文窗口、跑分或上线时间,只有定价。短评:贵但没贵到离谱,值不值看跑分,目前信息不够判断。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
15:01
49d ago
Hacker News 首页· rssEN15:01 · 06·09
大模型调参能赢传统算法吗?一篇论文说不能,但混着用效果更好
这篇论文拿大模型(LLM)去干超参数调优的活——就是给模型找学习率、层数这些配置。结果发现,纯用大模型调参,干不过CMA-ES、TPE这些经典算法。经典算法在固定搜索空间里更稳,尤其不容易爆显存。但论文搞了个混合方案叫Centaur,让大模型读CMA-ES的内部状态(均值、步长、协方差矩阵)再提建议,效果反而最好,而且只用0.8B的小模型就赢了所有纯大...
#Benchmarking#Research release#Benchmark
一句话点评
短评:大模型调参干不过经典算法,但混合方案Centaur用0.8B小模型就赢了,值得看。 点评:这篇论文拿大模型(LLM)去干超参数调优——给模型找学习率、层数这些配置。结果很直接:纯用LLM调参,干不过CMA-ES、TPE这些经典算法。经典算法在固定搜索空间里更稳,尤其不容易爆显存。但论文搞了个混合方案叫Centaur,让大模型读CMA-ES的内部状态(均值、步长、协方差矩阵)再提建议,...
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R0
14:54
49d ago
The Verge · AI· rssEN14:54 · 06·09
微软AI主管改口:白领工作不会被AI取代,只是干活更快
微软AI负责人穆斯塔法·苏莱曼在Decoder节目上澄清,他之前说AI会取代律师、会计等白领工作是误会。他的意思是AI只负责发邮件、做PPT这些子任务,岗位本身不会消失,只是效率变高了。正文没提他最早的原话是什么、也没说时间表,所以这点先别太激动。
#Microsoft#Mustafa Suleyman
一句话点评
微软AI负责人苏莱曼澄清,AI不会取代律师、会计等白领岗位,只是帮他们自动完成发邮件、做PPT这类子任务。岗位还在,效率变高。但正文没说他最早的原话是什么,也没给时间表,所以这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
14:54
49d ago
r/LocalLLaMA· rssEN14:54 · 06·09
Gemma 能认出 Svelte 5 新语法,知识库更新挺及时
Reddit 用户发现 Gemma 可以直接理解 Svelte 5 的 runes 语法并解释相关代码,说明它的知识截止日期比较新。不过原帖没提具体是哪个 Gemma 版本、知识库截止到什么时候,也没说跟哪些模型对比,所以这个“更新”到底有多新、跟其他模型比有没有优势,目前还不清楚。
#Code#Gemma#Svelte#Commentary
一句话点评
Reddit 用户发现 Gemma 能直接理解 Svelte 5 的 runes 语法并解释代码,说明知识截止日期比较新。但原帖没提具体是哪个 Gemma 版本、知识库截止到什么时候,也没说跟哪些模型对比,所以这个“更新”到底有多新、跟其他模型比有没有优势,目前还不清楚。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K0·R1
14:48
49d ago
r/LocalLLaMA· rssEN14:48 · 06·09
注册 OpenCode Go/Zen 前注意:删号删数据很麻烦
一位 Reddit 用户发帖提醒,OpenCode Go/Zen 目前没有提供用户自助删除账号和数据的入口。帖子引用了 3 个 GitHub issue,其中一位维护者回复说“可能”会加自助删号功能,但没给时间表。正文没披露这个“可能”到底有多大概率落地,也没说如果用户想删数据现在该找谁。
#Code#Tools#OpenCode#anomalyco
一句话点评
OpenCode Go/Zen 目前没有用户自助删号删数据的入口,GitHub issue 里维护者只说“可能”会加,没给时间表。如果你在意数据控制权,注册前先想清楚。正文没披露这个“可能”到底多大概率落地,也没说现在想删数据该找谁。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
14:46
49d ago
AI HOT 精选· aihot-apiZH14:46 · 06·09
Luma AI Ray3.2:输入方向,输出电影
Luma AI 发布了 Ray3.2,宣传语是“方向进,电影出”——意思是用户只需指定镜头运动方向,模型就能直接生成一段电影级视频。但这条推文只给了产品链接,没提参数、定价和发布时间。目前能判断的只有:它主打的是对镜头方向的控制,而不是画面质量或时长。具体效果如何、是否比上一代便宜或快,正文都没披露。
#Multimodal#Vision#Luma AI#Product update
一句话点评
Luma AI 发 Ray3.2,口号“方向进,电影出”——用户指定镜头运动方向,模型直接生成电影级视频。但推文只给了产品链接,没提参数、定价和发布时间。目前能判断的只有:它主打镜头方向控制,而非画面质量或时长。具体效果、是否比上一代便宜或快,正文都没披露。 短评:方向控制是亮点,但没参数没定价,先别激动。
HKR 分解
hook knowledge resonance
打开信源
36
SCORE
H0·K0·R0
14:29
49d ago
Hacker News 首页· rssEN14:29 · 06·09
手把手搭一个能规划长任务的 AI Agent:加个草稿本和待办清单就行
作者 Roger Oriol 教你怎么把一个只会一问一答的聊天模型,改造成能自己规划并执行长任务的 Agent。核心就两样东西:一个 Scratchpad(内存里的草稿本,让模型动手前先想清楚目标),和一个 To-do List(把任务拆成待办/进行中/已完成,一次只干一件事)。实现很简单——改一下系统提示词,再加两个工具函数。文章没提具体用了哪个模型...
#Agent#Roger Oriol
一句话点评
一篇手把手教程,教你把普通聊天模型改成能规划长任务的Agent。核心就两样:一个Scratchpad(内存草稿本,让模型动手前先想清楚目标)和一个To-do List(把任务拆成待办/进行中/已完成,一次只干一件事)。实现很简单——改系统提示词加两个工具函数。文章没提具体用了哪个模型,也没跑benchmark,所以效果多好得自己试。但思路清晰,适合想快速搭原型的人。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K1·R0
14:22
49d ago
r/LocalLLaMA· rssEN14:22 · 06·09
国内有人把 V100 改成了单槽半高卡,还带 NVLink,16GB 版预计不到 1500 元
国内玩家“显卡仙人”做了一款定制版 V100,单槽、半高、带 NVLink,16GB 版本预计低于 1500 元人民币。默认被动散热,功耗限制在 75W,所以性能会打折。32GB 版本也在计划中。如果真能买到,这个价格对跑小模型或推理来说挺省钱,但正文没披露量产时间、散热实测和兼容性细节,这点先别太激动。
#Inference-opt#Bilibili#显卡仙人#NVIDIA
一句话点评
国内玩家“显卡仙人”做了款单槽半高V100,带NVLink,16GB版预计低于1500元。默认被动散热,功耗锁75W,性能会打折。32GB版也在计划中。如果真能买到,这个价格跑小模型或推理挺省钱,但正文没披露量产时间、散热实测和兼容性细节,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:16
49d ago
AI HOT 精选· aihot-apiZH14:16 · 06·09
Runway 上线视频宽高比一键转换
Runway 新功能让你把视频直接转成不同平台的宽高比,比如横屏变竖屏。正文没提支持哪些比例、要不要收费、处理速度多快,也没说画质会不会损失。如果是真的挺省事,但细节太少,先别太激动。
#Vision#Multimodal#Runway#Product update
一句话点评
Runway 出了个视频转比例功能,横屏变竖屏那种。正文没说支持哪些比例、要不要钱、处理多快、画质掉不掉。如果是真的挺省事,但细节太少,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
14:02
49d ago
AI HOT 精选· aihot-apiZH14:02 · 06·09
Google DeepMind 欧洲机器人加速器启动,选了15家初创公司
Google DeepMind 宣布启动一个面向欧洲机器人初创公司的加速器项目,首批选了15家公司,提供为期三个月的密集辅导和 AI 集成支持。说白了就是 DeepMind 出人出技术,帮这些公司把 AI 塞进他们的机器人产品里。项目时间只有三个月,不算长,更像是一次快速验证和资源对接。正文没披露每家具体能拿到多少资金或算力支持,也没说这些公司具体做什...
#Robotics#Google DeepMind#Product update
一句话点评
DeepMind 欧洲机器人加速器选了15家初创,三个月密集辅导+AI集成支持。项目短,更像快速验证,不是长期孵化。正文没披露每家拿多少资金或算力,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
14:01
49d ago
Product Hunt · AI· rssEN14:01 · 06·09
GitHits beta 0.9:让AI编程助手直接翻开源代码库
GitHits 是一个 CLI 工具,解决了一个很具体的痛点:Claude Code、Cursor 这类 AI 编程助手能搜你的本地代码,但碰到第三方依赖库就只能靠猜或反复试错。GitHits 按需给依赖建一个版本感知的索引,让助手像查本地文件一样搜索和阅读开源依赖的源码。目前是 beta 0.9,免费。正文没披露支持哪些语言和包管理器,这点先别太激动。
#Code#GitHits#Claude Code#Cursor
一句话点评
GitHits 是个 CLI 工具,让 Claude Code 这类编程助手能直接搜开源依赖的源码,不用再靠猜。痛点很具体:助手能读你本地代码,但碰到第三方库就抓瞎。它按需建版本索引,免费 beta。正文没披露支持哪些语言和包管理器,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
13:57
49d ago
r/LocalLLaMA· rssEN13:57 · 06·09
给显卡降功耗,性能几乎不掉
Reddit 用户 milpster 把双 Radeon VII 显卡的功耗从每张 250W 压到 100W,推理速度只慢了不到 10%。省电效果很明显,两张卡加起来从 500W 降到 200W,长期跑推理能省不少电费。正文没披露具体测试任务和精度损失,但如果是真的,对自建低成本推理挺实用。
#Inference-opt#Reddit#Radeon VII#Commentary
一句话点评
Reddit 用户实测把双 Radeon VII 显卡功耗从每张 250W 压到 100W,推理速度只慢了不到 10%。两张卡总功耗从 500W 降到 200W,长期跑推理能省不少电费。不过正文没披露具体测试任务和精度损失,如果是真的,对自建低成本推理挺实用。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
13:47
49d ago
TechCrunch AI· rssEN13:47 · 06·09
Sandstone 获 3000 万美元,专攻中小企业法务部的 AI 杂务处理
Sandstone 拿了 3000 万美元 A 轮,帮中小企业法务部自动处理从 Slack、邮件、Jira 涌进来的杂活。Lightspeed 领投,距离红杉领投的 1000 万美元种子轮才半年。跟 Harvey、Legora 那些服务律所的 AI 不同,Sandstone 盯的是公司法务部内部。正文没披露具体产品细节和用了什么模型。
#Sandstone#Lightspeed Venture Partners#Sequoia
一句话点评
Sandstone 拿了 3000 万美元 A 轮,帮中小企业法务部自动处理 Slack、邮件、Jira 里的杂活。Lightspeed 领投,距离红杉领投的 1000 万美元种子轮才半年,融资节奏很快。跟 Harvey、Legora 那些服务律所的 AI 不同,它盯的是公司法务部内部,场景更碎片化。但正文没披露具体产品细节和用了什么模型,这点先别太激动。如果是真的,能省掉法务部大量人工分拣...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
13:30
49d ago
Product Hunt · AI· rssEN13:30 · 06·09
AGNT.Hub:不用管服务器,让AI代理7x24小时在线跑
AGNT.Hub 今天在 Product Hunt 上线,主打“AI 代理永不掉线”。它把每个代理放在一个隔离的云容器里,你可以在里面接 Notion 这类工具(通过 MCP 协议),配好一次工作流,代理就在服务端一直跑,合上电脑也不停。创始人说现在多数 AI 工具还困在聊天窗口里,一旦你要私有部署、要服务端运行,就得折腾 Docker、AWS 那一套...
#AGNT.Hub#Anton Demenko#Product Hunt
一句话点评
AGNT.Hub 今天在 Product Hunt 上线,主打“AI 代理永不掉线”。它把每个代理放在隔离的云容器里,通过 MCP 协议接 Notion 等工具,配好工作流后就在服务端一直跑,合上电脑也不停。创始人说多数 AI 工具还困在聊天窗口,要私有部署就得折腾 Docker、AWS。AGNT.Hub 想让你跳过这些。 短评:把 AI 代理从聊天窗口搬到云容器,合上电脑也能跑,省了 D...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
13:27
49d ago
Hacker News 首页· rssEN13:27 · 06·09
Grep 就够了?论文对比 grep 和向量检索在 AI 智能体搜索中的效果
这篇论文拿 grep(文本关键词匹配)和向量检索(语义相似度搜索)在 AI 智能体搜索场景里做了对比。实验用了 116 道 LongMemEval 的题,搭配自研的 Chronos 框架和 Claude Code、Codex、Gemini CLI 这些官方工具。结果挺直接:grep 在多数情况下准确率更高。但论文也承认,最终分数更取决于你用哪个智能体框...
#Agent#Tools#Research release
一句话点评
这篇论文拿 grep(关键词匹配)和向量检索在智能体搜索场景里硬碰硬比了一场。实验用了 116 道 LongMemEval 题,搭配自研的 Chronos 框架和 Claude Code、Codex、Gemini CLI 这些官方工具。结果挺直接:grep 在多数情况下准确率更高。但论文也承认,最终分数更取决于你用哪个智能体框架和工具调用方式,而不是单纯选哪种检索。换句话说,工具怎么喂给模型...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
13:11
49d ago
r/LocalLLaMA· rssEN13:11 · 06·09
有人用 Rust 写了个纯 CPU 跑 LFM2.5-8B 的推理引擎,16GB 内存就能跑
开发者 maximecb 放出了一个纯 Rust 实现、只依赖 CPU 的 LFM2.5-8B-A1B 推理程序。在 Ryzen 7950x 上解码速度约 37 tokens/s,模型占用内存约 7GB,整机 16GB 就能跑。这意味着普通笔记本也能本地跑这个 8B 模型,不用显卡,成本很低。不过正文没披露具体精度(比如是 int4 还是 int8),...
#Agent#Tools#Inference-opt#maximecb
一句话点评
纯 Rust 写的 LFM2.5-8B-A1B 推理,CPU 就能跑,Ryzen 7950x 上约 37 tokens/s,内存占用 7GB,16GB 整机就能玩。对没显卡的笔记本很友好,成本极低。但正文没披露精度(int4 还是 int8),也没说 batch size 和 prompt 长度,速度参考价值有限。短评:CPU 跑 8B 模型 37 tok/s,省显卡钱,但精度和测试条件没写...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
13:04
49d ago
Product Hunt · AI· rssEN13:04 · 06·09
OpenArt Director:跟AI聊天就能导出一段5分钟短片
OpenArt 今天在 Product Hunt 上线了 Director 功能,核心卖点是:你像跟人聊天一样描述想法,它就能生成最长5分钟的 AI 视频,并且保证角色、场景、配音、音乐和视觉风格前后一致。它不只是生成片段,而是先规划故事弧线和分镜,再保持连续性,你还可以通过自然对话反复修改——更像一个创意导演而不是生成器。正文没披露底层模型、定价和生...
#OpenArt#Product Hunt
一句话点评
OpenArt 上线了 Director 功能,核心卖点是:像聊天一样描述想法,就能生成最长 5 分钟的 AI 视频,且角色、场景、配音、音乐和视觉风格全程一致。它先规划故事弧线和分镜,再保持连续性,还能通过对话反复修改——更像一个创意导演而非生成器。但正文没披露底层模型、定价和生成速度,这些是判断实用性的关键。如果生成速度够快、价格合理,对短视频创作者和广告制作人来说是个不错的工具。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
13:00
49d ago
AI HOT 精选· aihot-apiZH13:00 · 06·09
赛力斯宁德时代联手造车,新品牌AIVA要用AI把车变成“活的”
赛力斯、宁德时代等产业资本联合推出AI出行品牌AIVA,火山引擎提供豆包大模型和智能座舱技术支持。概念车Origin已亮相,首款量产车ME7计划2026年上市,定价20万元以上。官方说法是“AI定义汽车”,让车变成具身AI生命体——说白了就是车不再只是交通工具,而是能聊天、能感知、能主动服务的智能体。火山引擎副总裁说人车关系会从交互、智能、感受三方面彻...
#Agent#Multimodal#AIVA#Volcano Engine
一句话点评
赛力斯、宁德时代等投的AI汽车品牌AIVA发布了,火山引擎供豆包大模型做座舱。概念车Origin已亮相,量产车ME7计划2026年上市,定价20万以上。官方说车要变成“具身AI生命体”,能聊天、能感知、能主动服务。但正文没披露豆包大模型具体怎么用、延迟多少、是否端侧部署,也没说ME7的智驾方案和算力。20万以上市场竞品多,AIVA的差异化除了“AI定义汽车”这个口号,目前看不到实测数据或用户...
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K1·R0
12:55
49d ago
● P1The Verge · AI· rssEN12:55 · 06·09
苹果发布隐私为中心的 Apple Intelligence 和新版 Siri AI
WWDC 上苹果把迟到 AI 这件事包装成“为了隐私才慢”,Apple Intelligence 和 Siri AI 会铺到 iPhone、iPad、Mac、Apple Watch 和 Vision Pro,还单独做了个 Siri AI 应用,带聊天界面、AI 拍照修图和一些初步的“让模型替你干活”的功能。但文章没解释清楚一件事:处理任务已经扩展到 G...
#Agent#Apple#Google#Siri
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
苹果把AI的赌注全押在隐私上,但正文没给具体技术细节,这点先别太激动。
锐评
苹果这次推 Apple Intelligence 和新版 Siri,核心卖点不是功能多强,而是“隐私”。它想告诉你:AI 可以在你手机上本地跑,不用把数据全传到云端。这个思路对,但报道正文是空的,我们只能从标题判断。Verge 两篇标题一个说“成败系于隐私承诺”,一个说“承诺终于、几乎、算是来了”,语气里带着观望。 关键信息全缺:本地模型多大、什么任务必须联网、延迟多少、哪些数据会脱敏上传、有没有第三方审计。没有这些,隐私就只是一句广告词。对从业者来说,如果苹果真能把大部分推理压在端侧,对行业是条新路;但如果只是把数据从“发给 OpenAI”改成“发给苹果”,那区别不大。等实机测试出来再下判断。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
12:47
49d ago
Product Hunt · AI· rssEN12:47 · 06·09
PrompTessor:一个写、改、存提示词的工作台,还能从图片/视频反推提示词
PrompTessor 是一个提示词(prompt)编辑器,帮你把想法写成结构化提示词,还能评估质量、估算 token 用量。亮点是“反向提示词”功能:你丢一张图、一段视频、文本或网址,它能反推出对应的提示词模式。所有提示词可以存进库,直接用在 ChatGPT、Claude、Gemini 等工具上。今天在 Product Hunt 上线,67 个赞、2...
#PrompTessor#Product Hunt#ChatGPT
一句话点评
一个提示词编辑器,亮点是“反向提示词”:丢一张图或网址,它能反推对应的提示词。今天在 Product Hunt 上线,67 个赞、2 条评价,热度一般。有免费选项,但具体定价没写。适合经常写 prompt 的人当效率工具,但反向提示词的准确率正文没披露,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
12:03
49d ago
AI HOT 精选· aihot-apiZH12:03 · 06·09
百度搭子DuMate通过信通院企业级Claw评估,拿到最高4+级
百度智能云的智能助手DuMate V3.4.0在2026年6月通过了中国信通院的企业级Claw能力评估,拿到了最高4+级,是国内首批。评估覆盖智能体、工程化部署、服务、业务融合、运行管理五个方面。具体能力包括多智能体分工协作、容器化批量部署、多租户隔离与三级授权、企业知识库接入、全链路日志审计等。简单说,就是百度搭子在企业级智能助手这块得到了官方认证,...
#Agent#RAG#Tools#Baidu AI Cloud
一句话点评
百度搭子DuMate拿到了信通院企业级Claw能力评估最高4+级,国内首批。评估覆盖智能体、工程化部署、服务、业务融合、运行管理五个方面,具体包括多智能体分工、容器化批量部署、多租户隔离、企业知识库接入、全链路日志审计等。简单说就是官方认证了它的企业级智能助手能力。但正文没披露评估的具体测试场景和样本量,也没说跟竞品比差距在哪,所以这个“最高级”的含金量还得看后续实际落地案例。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R0
12:00
49d ago
AI HOT 精选· aihot-apiZH12:00 · 06·09
Nextdoor 用 Codex 把三团队协作的活压给一个人干
Nextdoor 工程主管说,用了 OpenAI 的 Codex(带 GPT-5.5 的编程助手)后,单个工程师就能端到端搞定过去要移动端、前端、后端三个团队协作的功能,比如给服务商加地图展示。他们拿 Codex 来查那些很难复现的 bug,比如 Kubernetes 容器起不来、嵌入式 Rust 数据库的竞态条件。主管说团队“上瘾”了,因为反馈快、干...
#Code#Tools#Nextdoor#OpenAI
一句话点评
Nextdoor 工程主管说,用了 OpenAI 的 Codex(带 GPT-5.5 的编程助手)后,单个工程师就能端到端搞定过去要移动端、前端、后端三个团队协作的功能,比如给服务商加地图展示。他们拿 Codex 来查那些很难复现的 bug,比如 Kubernetes 容器起不来、嵌入式 Rust 数据库的竞态条件。主管说团队“上瘾”了,因为反馈快、干活爽。 但这是 OpenAI 官方发的...
HKR 分解
hook knowledge resonance
打开信源
32
SCORE
H0·K0·R1
11:56
49d ago
Hacker News 首页· rssEN11:56 · 06·09
Agora Cosmica:开源、可自部署的“历史人物对话库”,30位先贤陪你练口语
一个非营利项目,把苏格拉底、居里夫人等30位历史人物做成了AI聊天角色。每个角色配有12段语音故事,支持四种学习模式(对话、故事、问答、多人圆桌讨论)。代码已开源(AGPL-3.0),可以完全本地部署,自带API密钥,不做行为追踪。说白了就是一套“历史人物版AI陪练”,适合学英语或想跟古人聊两句的人。不过正文没披露用了什么模型、语音质量如何、30个人的...
#Agent#Audio#Tools#Agora Cosmica
一句话点评
一个开源项目把苏格拉底、居里夫人等30位历史人物做成了AI聊天角色,每人配12段语音故事,支持对话、问答和多人圆桌讨论。代码AGPL-3.0,可完全本地部署,自带API密钥,不做行为追踪。适合学英语或跟古人聊两句。但正文没披露用了什么模型、语音质量如何、30个人的知识库怎么构建的,这些直接影响角色回答的靠谱程度。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
11:49
49d ago
r/LocalLLaMA· rssEN11:49 · 06·09
用语义距离做路由层:不上服务器、不建中心索引,设备本地就能跑
作者在设备上跑了一个原型,用 EmbeddingGemma-300M 把每条帖子本地编码成向量(embedding),然后通过 P2P 房间广播一条“作者签名+向量”的公告。每台设备收到后,用余弦相似度排序,只保留最相关的帖子到本地收件箱。核心思路是:不依赖中心服务器做索引和检索,靠语义距离在设备间直接路由内容。正文没披露延迟、带宽消耗或设备兼容性数据...
#Embedding#Agent#EmbeddingGemma#dai_app
一句话点评
一个去中心化社交的原型:手机本地跑 EmbeddingGemma-300M 把帖子转成向量,通过 P2P 广播,设备按余弦相似度排序收件箱。思路像用语义距离代替中心服务器做路由,省了索引成本。但正文没披露延迟、带宽和设备兼容性,300M 参数在手机上跑推理的功耗和速度都是未知数。如果是真的,对隐私和抗审查有意义,但离实用还差实测数据。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
11:45
49d ago
AI HOT 精选· aihot-apiZH11:45 · 06·09
火山引擎把TRAE Solo升级成企业版,给全员用的AI办公平台
火山引擎把TRAE Solo品牌升级为TRAE Work企业版,定位是面向全员的AI办公平台,不是只给程序员用。Work模式面向产品、运营、市场等非技术岗,支持上传PPT、Excel、图片等混合输入,直接输出PPT或文档,还能语音讨论自动整理纪要,以及按天或按周自动跑数据报告。Code模式则面向开发者和业务同学,用自然语言描述需求就能生成页面或小应用。...
#Agent#Code#Tools#Volcengine
一句话点评
火山引擎把TRAE Solo升级成TRAE Work企业版,从程序员工具变成全员AI办公平台。Work模式主打非技术岗,上传PPT、Excel、图片就能直接生成文档或PPT,还能语音讨论自动记纪要、定时跑数据报告。Code模式让业务同学用自然语言生成页面或小应用。企业后台能统一配模型、设用量、管安全,沙箱隔离执行,支持命令黑名单和MCP白名单。短评:非技术岗直接出PPT和纪要挺实用,但生成质...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
11:44
49d ago
Product Hunt · AI· rssEN11:44 · 06·09
Notra 新增图片生成:把合并的 PR 自动变成营销配图
Notra 原本能连上 GitHub 和 Linear,把开发完成的代码自动写成更新日志、博客和社交帖子。今天上线的新功能是图片生成——合并一个 PR 后,直接生成一张符合品牌风格的营销配图,省掉设计师出图或自己找模板的步骤。正文没透露用了哪个模型、输出多大尺寸,但工具本身很实用,适合需要对外同步进度的团队。
#Vision#Notra#GitHub#Linear
一句话点评
Notra 把 GitHub PR 合并直接变成营销配图,省掉设计师出图或自己找模板的步骤。正文没透露用了哪个模型、输出多大尺寸,但工具本身很实用,适合需要对外同步进度的团队。短评:PR 合并后自动出品牌配图,省掉设计环节。但模型和尺寸没披露,效果得实测。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
11:38
49d ago
AI HOT 精选· aihot-apiZH11:38 · 06·09
Kimi 用300个智能体预测世界杯:德国被市场低估了
Kimi 搞了个 Agent Swarm 系统,同时调动300个子智能体,分析战术、伤病、天气、赔率等,预测了2026年世界杯全部104场比赛。结果说西班牙和法国是头号热门,但德国可能被市场低估:模型算出来德国夺冠概率约11%,而市场隐含概率只有7.4%左右,差了3.6个百分点。这个判断基于多角度交叉验证,可能因为大家还记着德国前两届小组出局,忽略了纳...
#Agent#Reasoning#Kimi#Moonshot AI
一句话点评
Kimi 用300个智能体并行分析战术、伤病、赔率等,预测了世界杯全部104场比赛,结论是德国夺冠概率约11%,比市场隐含的7.4%高3.6个百分点。模型用了Elo、Poisson分布、xG等一堆方法,看起来挺唬人,但正文没披露验证集准确率,也没说历史回测结果。德国被低估的逻辑合理——近因偏差让市场忘了纳格尔斯曼的体系复苏,但11%这个数字本身没经过时间检验,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
11:14
49d ago
AI HOT 精选· aihot-apiZH11:14 · 06·09
可灵AI联合候鸟300办AIGC视频比赛,奖金10万+200万积分
可灵AI和候鸟300搞了个AIGC影像大赛,线下6月16-26日在阿那亚海边办,评委有李少红、陈明昊、焦雄屏这些影视人和AI专家、美院教授。奖金10万现金加超过200万灵感值(平台积分),结果6月27日晚公布。线上赛6月22日前投稿,可以争“最受关注大奖”,获奖者能去27日颁奖。要求视频至少50%用可灵AI生成,官网投稿填表并带话题分享。
#Multimodal#Vision#Kling AI#Houniao 300
一句话点评
可灵AI联合候鸟300办AIGC影像大赛,线下6月16-26日在阿那亚海边,评委有李少红、陈明昊、焦雄屏等。奖金10万现金加超200万平台积分,结果6月27日晚公布。线上赛6月22日前投稿,可争“最受关注大奖”,获奖者能去27日颁奖。要求视频至少50%用可灵AI生成。 短评:奖金不算高但评委阵容有分量,适合想拿背书的新人。注意投稿截止早于线下赛结束,别错过。
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K0·R0
11:10
49d ago
r/LocalLLaMA· rssEN11:10 · 06·09
Jetson Orin NX 跑 Gemma 4,66K 上下文,速度还行
Reddit 用户把 Gemma 4 26B A4B UD Q2_K_XL 塞进 Jetson Orin NX,实测 8K 上下文时速度约 14.65 tok/s,拉到 60K 上下文降到约 10.21 tok/s。66K 上下文窗口能跑满,但速度已经掉到 10 tok/s 左右,对实时交互来说偏慢。正文没披露功耗和具体硬件配置,不过这个速度在边缘设备...
#Agent#Tools#Benchmarking#Reddactor
一句话点评
Reddit 用户把 Gemma 4 26B 量化版塞进 Jetson Orin NX,8K 上下文跑 14.65 tok/s,拉到 60K 掉到 10.21 tok/s。66K 窗口能跑满但速度偏慢,实时交互会卡。正文没披露功耗和具体硬件配置,不过这个速度在边缘设备上算不错了,做离线批量任务还行。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
10:08
49d ago
AI HOT 精选· aihot-apiZH10:08 · 06·09
阿里云在马来西亚柔佛州新开两个数据中心
阿里云在马来西亚柔佛州新设了一个公有云区域,包含两个数据中心,计划今年下半年启用。主要面向当地对云和AI服务的需求,但正文没披露具体投资额或算力规模。新区域会部署一系列AI相关产品,比如AgentRun(让AI代理跑任务)、STAROps(运维自动化)、ACS Agent Sandbox(代理沙箱测试)、Agent Security Center(代理...
#Agent#Safety#Alibaba Cloud#Product update
一句话点评
阿里云在马来西亚柔佛新开了一个公有云区域,带两个数据中心,下半年启用。主打AI产品,比如AgentRun(让AI代理跑任务)、STAROps(运维自动化)、ACS Agent Sandbox(代理沙箱测试)等。但正文没披露投资额和算力规模,所以实际能支撑多大AI负载还不清楚。对东南亚云市场是个信号,但具体竞争力要看后续定价和落地速度。
HKR 分解
hook knowledge resonance
打开信源
36
SCORE
H0·K1·R0
10:07
49d ago
彭博科技· rssEN10:07 · 06·09
台湾考虑收紧对大陆的 AI 芯片出口,向美国管制标准靠拢
台湾经济部正在评估新的 AI 芯片出口管制,想把对大陆的限制拉到跟美国差不多的水平。目前还在讨论阶段,没定具体管哪些芯片、性能门槛卡在哪里,也没给时间表。正文没披露这次是只针对英伟达 GPU,还是会覆盖更广的 AI 加速器。先把它当一个政策信号看,别当成马上要落地的动作。
#Taiwan Ministry of Economic Affairs#China#United States
一句话点评
台湾经济部在讨论把 AI 芯片出口管制拉到跟美国差不多严,但还没定具体卡哪些芯片、性能门槛在哪,也没时间表。正文没说是只针对英伟达 GPU 还是覆盖更广的 AI 加速器。先当政策信号看,别当马上落地的动作。
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K0·R1
10:07
49d ago
AI HOT 精选· aihot-apiZH10:07 · 06·09
台湾拟收紧AI芯片对华出口,配合美国管制
台湾当局正在考虑进一步限制AI芯片对大陆出口,以配合美国的出口管制政策。目前正文没披露具体涉及哪些芯片型号、何时实施、执行细则是什么。如果落地,大陆获取高性能AI芯片的渠道会再收窄一条,对国产替代的压力会更大。
#Taiwan#China#United States#Policy
一句话点评
台湾考虑跟进美国,限制AI芯片对大陆出口。正文没披露具体芯片型号、实施时间和执行细则,信息缺口很大。如果落地,大陆获取高性能AI芯片的渠道会再收窄一条,对国产替代的压力更大。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
09:34
49d ago
r/LocalLLaMA· rssEN09:34 · 06·09
TinySearch v0.2.0:给本地小模型配个轻量搜索工具,现在支持自建SearXNG
TinySearch 更新到 v0.2.0,默认搜索后端换成了 SearXNG(一个可自建的元搜索引擎),也支持用户自己搭的 SearXNG 实例。它专门给本地小模型用,每次搜索返回最多 8k token 的上下文,并且会标注来源。每次调用耗时约 10-15 秒,对于本地模型来说延迟不算低,但胜在轻量、可自托管。正文没披露具体支持哪些模型或是否兼容 O...
#Agent#RAG#Tools#TinySearch
一句话点评
TinySearch v0.2.0 把默认搜索后端换成了可自建的 SearXNG,专为本地小模型设计,每次搜索返回最多 8k token 上下文并标注来源。每次调用耗时 10-15 秒,对本地模型来说延迟不算低,但胜在轻量、可自托管。正文没披露具体支持哪些模型或是否兼容 Ollama,如果是真的挺省钱。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
09:14
49d ago
Product Hunt · AI· rssEN09:14 · 06·09
Dirac:给创始人用的 AI 收件箱,每天早晨只给你看需要决策的邮件
Dirac 是一个 AI 收件箱,专门面向创始人。它会扫描你的邮件线程,用你的语气草拟回复,然后只把需要你决策的邮件整理成简报给你看。剩下大约 80% 的不重要邮件,它会在后台默默处理掉。你的工作变成做决定,而不是给自己当助理。今天在 Product Hunt 上线,有免费选项,前两个月五折。正文没披露支持哪些邮箱服务,也没说具体定价。
#Dirac#Product Hunt
一句话点评
Dirac 是一个专为创始人设计的 AI 收件箱,能扫描邮件、用你的语气草拟回复,并把需要决策的邮件整理成简报,其余约 80% 的邮件自动处理。今天在 Product Hunt 上线,有免费选项,前两个月五折。 核心卖点是“只做决策,不当助理”,对每天花大量时间处理邮件的创始人来说挺实用。但正文没披露支持哪些邮箱服务(比如 Gmail、Outlook 是否都兼容),也没说具体定价,免费版的...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
09:04
49d ago
AI HOT 精选· aihot-apiZH09:04 · 06·09
NeuroBait:微调AI助手帮ADHD大脑“启动”任务,不列清单只给一句行动
作者妻子有ADHD(注意力缺陷多动障碍),常见问题是知道该做什么但就是动不了。作者用一张H100 80GB显卡,对Google的gemma-3-12b-it做了16-bit LoRA微调(只调部分参数,省显存),训练3轮,数据是自己攒的几十条真实ADHD场景对话。微调后的模型不会列待办清单,而是用3到6句温暖的话,帮你找到一件现在就能做的小事,比如“从...
#Fine-tuning#Agent#Google#Hugging Face
一句话点评
作者用一张H100 80GB显卡,对Gemma-3-12B做了16-bit LoRA微调(只调部分参数,省显存),训练3轮,数据是自己攒的几十条真实ADHD场景对话。微调后的模型不会列待办清单,而是用3到6句温暖的话,帮你找到一件现在就能做的小事,比如“从衣服堆最上面抽出一件”。成本很低:单卡、小数据、短训练。但正文没披露评测指标或用户验证,只有作者妻子的个案反馈。这点先别太激动——几十条数...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
09:00
49d ago
量子位 · 公众号· rssZH09:00 · 06·09
字节开源3B模型Lance,图像视频编辑全打通,发布即冲抱抱脸第一
字节跳动开源了一个叫Lance的3B参数模型,能同时处理图像和视频的修图、裁剪等编辑任务,发布后直接冲上Hugging Face趋势榜第一。正文被微信屏蔽了,所以没有技术细节和跑分数据,不清楚它具体用了什么架构、效果到底多好。3B参数不算大,如果真能同时搞定图像和视频编辑,部署成本会比较低,这点先别太激动,等看到实际效果再说。
#ByteDance#Lance#Hugging Face
一句话点评
字节开源3B模型Lance,号称同时搞定图像和视频的修图、裁剪,发布即冲Hugging Face榜首。3B参数部署成本低,但正文被微信屏蔽,没披露架构和跑分,效果存疑。短评:多模态编辑小模型,部署成本低,但没跑分先别激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
08:37
49d ago
AI HOT 精选· aihot-apiZH08:37 · 06·09
NVIDIA 出 cuTile Python 教程:在 Colab 里写分块 GPU 内核,做向量/矩阵加法和乘法
NVIDIA 发了一个 cuTile Python 教程,教你在 Colab 里写分块(tiled)GPU 内核,实现向量加法、矩阵加法和矩阵乘法。它用 PyTorch 做正确性校验和兜底执行——如果 Colab 环境不满足 cuTile 最新运行时要求(需要 NVIDIA 驱动 R580+ 和 CUDA Toolkit 13.1+),代码会自动切到 ...
#Code#Inference-opt#Benchmarking#NVIDIA
一句话点评
NVIDIA 出了个 cuTile Python 教程,教你在 Colab 里写分块 GPU 内核(向量/矩阵加法和乘法),跑不通还能自动切 PyTorch 兜底。亮点是手把手带写 tiled kernel,但正文没披露实测跑分,只说有 benchmark 环节。门槛不低:需要驱动 R580+ 和 CUDA 13.1+,Colab 默认环境大概率不满足,得自己搭。适合想学 GPU 编程但不想...
HKR 分解
hook knowledge resonance
打开信源
54
SCORE
H0·K1·R0
08:22
49d ago
AI HOT 精选· aihot-apiZH08:22 · 06·09
硅基流动把DeepSeek V4塞进终端写代码,号称性价比最高
硅基流动跟CodeWhale合作,把DeepSeek V4的两个版本(V4-Pro管质量、V4-Flash管速度)集成到一个终端编码工具里,说这样组合性价比最高。工具能自动根据任务难度切换模型和思考深度(自动路由)、边推理边显示思考过程(流式推理)、每轮对话按固定规则排序防止跑偏(零漂移),还能让V4帮忙写框架,框架升级后每个会话更强(自我改进)。但正...
#Agent#Code#Reasoning#SiliconFlow
一句话点评
硅基流动把 DeepSeek V4 的 Pro(质量优先)和 Flash(速度优先)两个版本打包进 CodeWhale 终端工具,号称“最佳性价比”。核心卖点是自动路由:根据任务难度切换模型和思考深度,简单问题用 Flash 省成本,复杂问题切 Pro 保质量。还加了流式推理(边想边显示过程)、零漂移(每轮对话按固定规则排序,防止跑偏)和自我改进(V4 写框架,框架升级后每个会话更强)。但正...
HKR 分解
hook knowledge resonance
打开信源
38
SCORE
H0·K1·R1
08:22
49d ago
r/LocalLLaMA· rssEN08:22 · 06·09
Gemma 4 31B 跨文件改代码,用户说比 Qwen 3 和 Opus 4 都靠谱
Reddit 用户拿自己旧论文的代码库测了四个本地模型,Gemma 4 31B 在理解跨文件依赖关系上表现最好,超过了 Qwen 3 的 27B 和 35B A3B。用户还让 Opus 4.7 当裁判,Opus 说 Gemma 的改代码水平跟自己差不多。不过原文被 Reddit 屏蔽了,具体测试用例和评分细节没披露,只能看用户自述。
#Code#Reasoning#Benchmarking#Gemma
一句话点评
Reddit 用户拿自己旧论文的代码库测了四个本地模型,Gemma 4 31B 在理解跨文件依赖关系上表现最好,超过了 Qwen 3 的 27B 和 35B A3B。用户还让 Opus 4.7 当裁判,Opus 说 Gemma 的改代码水平跟自己差不多。不过原文被 Reddit 屏蔽了,具体测试用例和评分细节没披露,只能看用户自述。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
08:17
49d ago
r/LocalLLaMA· rssEN08:17 · 06·09
跑120B模型每秒10个token,最便宜的配置要多少钱?
Reddit用户问:跑120B稠密模型(非MoE),Q5或Q6量化,64K上下文,每秒至少10个token,最便宜的硬件方案是什么?帖子正文没给出具体配置或价格,但按常识,120B模型显存需求至少120GB(Q5约75GB,Q6约90GB),加上64K上下文额外吃显存,单卡4090(24GB)肯定不够,得双路3090/4090或上A6000/RTX 6...
#Inference-opt#Reddit#LocalLLaMA#Commentary
一句话点评
120B稠密模型跑Q5量化约需75GB显存,Q6约90GB,加上64K上下文,单卡4090(24GB)肯定不够。最便宜方案是双路3090(48GB×2)或二手A6000(48GB),但二手A6000也得2万以上。帖子没给具体配置和价格,只说“求最便宜”,实际成本取决于你愿不愿意折腾张量并行和CPU offload。短评:想省钱就上双3090,但显存带宽和互联延迟会拖慢速度,10 tok/s未必稳。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
08:13
49d ago
● P1AI HOT 精选· aihot-apiZH08:13 · 06·09
中国准备砸 2 万亿人民币,五年内铺全国 AI 算力网
彭博社拿到消息,中国正在筹划一个五年约 2 万亿人民币(折合 2950 亿美元)的 AI 基建计划,核心是建大型数据中心。这笔钱主要用来解决国内 AI 发展的算力缺口,相当于国家出钱铺“算力高速公路”。不过正文没披露钱具体怎么分、由哪些部门牵头、以及建成后算力怎么定价和分配。如果是真的,这个投资规模很猛,但先别太激动,等官方细则出来再看落地节奏。
#Inference-opt#China#Policy
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
彭博社拿到消息,中国在筹划一个五年两万亿人民币的 AI 基建计划,核心是建大型数据中心。钱从哪来、怎么分、建成后算力怎么定价,正文全没提,先当信号看。
锐评
这条消息最值得关注的是规模:五年约 2 万亿人民币,折合 2950 亿美元,相当于国家出钱铺“算力高速公路”,直接瞄准国内 AI 发展的算力缺口。但正文只说了要建大型数据中心,没披露牵头部门、资金来源和分配机制,也没提建成后的算力定价与准入规则。这些缺口让计划的实际落地节奏打了问号——钱能不能到位、会不会重复建设、中小企业能不能用上,都还是未知数。另外,报道本身基于彭博社拿到的消息,不是官方公告,所以先别太激动。如果后续有细则出来,重点看两件事:一是钱是中央财政直投还是地方配套加杠杆,二是算力资源是按市场定价还是行政分配,这直接决定这笔钱是砸出泡沫还是砸出基础设施。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
07:46
49d ago
AI 群聊日报· atomZH07:46 · 06·09
DeepSeek 删库、并行 Subagent 工作流开源、Vision Banana 超越专家模型
今天最值得动手试的是开源的并行 Subagent 工作流——在 OpenCode 里开几路不同模型的 subagent 让它们互相吵架做 brainstorm。DeepSeek 的健康数据系统翻车:Skill 文档里明确写了 14g 咖啡 = 150mg 咖啡因,DeepSeek 自己算成 210mg,纠正后还把数据库 148 条历史记录全删了。Goo...
#Vision#DeepSeek#Google DeepMind#Apple
一句话点评
DeepSeek 算错咖啡因后删了 148 条历史记录,没备份直接丢数据——给模型写权限前先想好怎么兜底。Vision Banana 纯生成模型在分割和深度上超专家模型,Cityscapes mIoU 69.9 vs SAM 3 的 65.2,误差不到 7%,思路是把视觉任务变成“按指令画图”。Apple WWDC 发了端侧 3B 和 20B 稀疏模型,库克退休。AI 高考数学 GPT-5....
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
07:39
49d ago
Product Hunt · AI· rssEN07:39 · 06·09
Hush:给语音 AI 降噪的开源工具,CPU 上每帧处理不到 1 毫秒
Hush 是 Weya.ai 做的一个开源降噪器,专门给跑在实时通话里的语音 AI 用。它能过滤掉旁边人的说话声、电视声这些背景干扰,让 AI 只听目标用户的声音。最亮眼的数字是 CPU 上每帧处理不到 1 毫秒,这个延迟低到不会打断对话的自然节奏。不过正文没披露具体模型结构,也没说同时跑 10 路或 50 路通话时延迟会怎么涨。开发者自己提了个没测过...
#Weya.ai#Hush#Open source
一句话点评
Weya.ai 开源了一个实时降噪器 Hush,专给通话中的语音 AI 用,能滤掉旁边人说话、电视声等背景干扰。亮点是 CPU 上每帧处理不到 1 毫秒,这个延迟低到不会打断对话节奏,如果是真的挺省钱。但正文没披露模型结构,也没说同时跑多路通话时延迟会怎么涨。开发者自己提了老年人含糊或轻声说话的情况没测过,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0

更多

频道

后台