ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-20

50 items · updated 3m ago
RSS live
2026-05-20 · 星期三2026年5月20日
15:56
69d ago
AI HOT 精选· aihot-apiZH15:56 · 05·20
OpenRouter 自动路由会锁住会话直到缓存过期
OpenRouter 发帖解释自动路由的缓存行为:一旦路由命中,会话会固定在同一模型或提供商上,直到缓存过期,所以不用担心自动切换导致缓存失效。正文没披露缓存时长、缓存 key 规则以及什么条件下会切换提供商。
#Inference-opt#OpenRouter#Product update
一句话点评
OpenRouter 说自动路由会把会话钉在同一模型上直到缓存过期,所以不会因切换导致缓存失效。但正文没披露缓存时长、key 规则和切换条件,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
15:45
69d ago
● P1Hacker News 首页· rssEN15:45 · 05·20
字节跳动开源Lance:用单个模型实现图像视频理解与生成编辑
Lance 是字节跳动放出的一个多模态研究项目,把看图、看视频、生成图片、生成视频和编辑这些事塞进了同一个模型里。模型激活参数只有 3B,个头不大,训练用了不到 128 张 GPU,对想复现或微调的人来说门槛不算高。代码、论文和模型权重都公开了,但项目页没写具体的 benchmark 跑分和商用许可条款,这点先别太激动,得自己去翻论文和 HF 页面确认。
#Multimodal#Vision#ByteDance#Lance
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
字节开源了一个3B参数的模型Lance,能同时做图片和视频的理解、生成和编辑,但实际效果和限制正文没细说。
锐评
字节跳动把Lance放出来了,一个模型干三件事:看懂图片/视频、生成新内容、还能编辑。参数量只有3B,属于小模型,好处是本地跑得动,成本低。但正文主要是个GitHub仓库的导航页,没给技术报告、没给评测分数,也没说训练数据怎么来的。光看Star数(445)和Fork数(27),社区还在早期围观阶段。 “统一多模态”这个方向是对的,但小模型同时做理解和生成,通常会在某个任务上妥协——要么生成质量打折扣,要么理解不够细。这点先别太激动,等他们放出论文或demo再看。另外,仓库里Issues只有6个,Pull requests是0,说明外部贡献还没起来,代码成熟度待观察。 目前缺的关键信息:在标准测试集上和专用模型的对比、推理延迟、显存占用,以及生成内容的版权和安全性说明。如果这些不补上,暂时只能当个有趣的研究预览,不适合直接往产品里塞。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
15:42
69d ago
r/LocalLLaMA· rssEN15:42 · 05·20
Qwen 3.6 35B 量化版实测:MTP 比 NTP 快 20-40%,但只限 GPU 负载高时
ByteShape 放出了 Qwen 3.6 35B 的 GGUF 量化版,分 NTP 和 MTP 两种方案,在五张 GPU 和四类 CPU 设备上跑了基准。MTP 在 GPU 负载高时生成速度能快 20-40%,但 CPU 上反而推荐用 NTP。注意:正文没披露具体量化精度和显存占用,所以省显存的效果只能靠猜。如果手头有高负载 GPU 任务,MTP ...
#Inference-opt#Benchmarking#ByteShape#Qwen
一句话点评
ByteShape 把 Qwen 3.6 35B 量化成 GGUF,分 NTP 和 MTP 两种方案。MTP 在 GPU 负载高时生成速度快 20-40%,但 CPU 上反而推荐 NTP。注意:正文没披露具体量化精度和显存占用,所以省显存的效果只能靠猜。如果手头有高负载 GPU 任务,MTP 值得一试,但 CPU 用户先别激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
15:41
69d ago
AI HOT 精选· aihot-apiZH15:41 · 05·20
开源插件让Codex App用上Computer Use和自定义界面
一个开源项目给Codex App做了个插件,即使你是API登录用户,也能开启Computer Use功能(让模型操作电脑界面),还能加Goal指令(设定任务目标)。界面可以改成类似Chrome浏览器的顶部Tab样式,任务开始和完成时能设置音效提醒。项目地址在评论区,正文没披露插件安装难度或对API调用成本的影响。
#Agent#Tools#Open source#Product update
一句话点评
短评:给Codex App加Computer Use和Goal指令的开源插件,API用户也能用,但安装门槛和成本影响未知。 点评:这个开源插件让Codex App的API登录用户也能用上Computer Use(模型操作电脑界面)和Goal指令(设定任务目标),算是把原本可能限制在高级订阅的功能下放了。界面还能改成Chrome顶部Tab样式,加任务音效提醒,体验上更像个完整工具。但正文没披...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R0
15:41
69d ago
r/LocalLLaMA· rssEN15:41 · 05·20
Cohere 开源 Command A+ 模型,BF16 权重已上线 Hugging Face
Reddit 用户分享了一个 Hugging Face 链接,指向 Cohere 的 Command A+ 模型(BF16 精度)。目前正文被 Reddit 屏蔽,无法获取参数量、许可证、发布说明或跑分数据。如果你在找能本地部署的商用级模型,这个值得关注,但具体性能还得等更多信息。
#CohereLabs#Hugging Face#Reddit#Product update
一句话点评
Cohere 悄悄在 Hugging Face 上传了 Command A+ 的 BF16 权重,但 Reddit 帖子正文被屏蔽,参数量、许可证、跑分全没披露。如果是之前 Command A 的升级版,可能支持 128K 上下文和工具调用,适合本地部署。但这点先别太激动——没跑分没许可证,商用风险未知。正文没披露任何技术细节,连模型卡都看不到。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K0·R1
15:18
69d ago
r/LocalLLaMA· rssEN15:18 · 05·20
IBM 两个 OCR 模型对比:加了个动态提示到底有没有用?
Reddit 上有人问 granite-docling-258m 和加了动态提示的 2stage 版本到底差在哪。发帖人只说了 2stage 版会用动态提示预先算好页面布局对象,专门应对训练数据里没见过的排版。但正文被 Reddit 屏蔽了,没披露具体效果提升多少、延迟变高还是变低、样本需求有没有减少。如果你在挑 OCR 模型,这点信息还不够做决定,得...
#Vision#IBM#Reddit#Granite Docling
一句话点评
IBM 的 granite-docling-258m 和加了动态提示的 2stage 版本,区别在于后者能预先算好页面布局,专门对付训练数据里没见过的排版。但正文被 Reddit 屏蔽了,没披露效果提升多少、延迟变高还是变低。如果你在挑 OCR 模型,这点信息还不够做决定,得等实测。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K1·R0
15:14
69d ago
FT · 科技· rssEN15:14 · 05·20
黑石50亿美元数据中心计划:创意还是无奈?
黑石集团抛出一个50亿美元的数据中心建设计划,从商业逻辑上看说得通,市场空间也确实大。但正文被付费墙挡住,没披露选址、容量、客户和建设时间表。这点先别太激动——50亿在数据中心行业不算小数目,但没具体信息前只能当个方向性信号。
#Blackstone#Financial Times#Commentary
一句话点评
黑石砸50亿美元建数据中心,方向对但细节全无。选址、容量、客户、时间表一概没披露,正文被付费墙挡住。50亿在数据中心行业不算小,但没具体信息前只能当个方向性信号,别太激动。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R0
15:10
69d ago
Hacker News 首页· rssEN15:10 · 05·20
Stable Audio 3:Stability AI 开源三款音频生成模型,小模型可在消费级显卡上跑
Stability AI 发布了 Stable Audio 3,一套包含 small、medium、large 三个尺寸的音频生成模型,能生成和编辑几分钟长的音频。核心改进是自研的“语义-声学自编码器”,把音频压进紧凑的隐空间再扩散生成,既保真又让模型更容易理解音频结构。后训练阶段加了对抗训练,减少推理步数、提升生成质量。生成速度:H200 上不到 2...
#Audio#Research release
一句话点评
Stability AI 开源了三个尺寸的音频生成模型,小和中模型权重和代码都放了,能在消费级显卡上跑。核心改进是自己搞的“语义-声学自编码器”,把音频压进紧凑空间再扩散生成,几分钟的长音频也能一次生成,不用分段拼接。后训练加了对抗训练,推理步数少了,生成质量反而更高。H200 上生成不到 2 秒,MacBook M4 也就几秒。不过论文没披露训练数据具体规模,也没给和同类模型的客观指标对比...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
15:00
69d ago
AI HOT 精选· aihot-apiZH15:00 · 05·20
PixVerse 用角色分镜保证 AI 视频角色一致
PixVerse 发了一个 15 秒的烹饪短片,核心做法是先画好角色分镜,再拿它当参考生成视频。这样能保证同一个角色、故事节点、镜头方向和动作细节从头到尾不跑偏。正文没披露分镜工作流的具体步骤,但思路很直接:让 AI 在动起来之前先知道角色长什么样、故事怎么走。
#Multimodal#Vision#PixVerse#Product update
一句话点评
PixVerse 用角色分镜当参考,生成了一段 15 秒的烹饪短片,保证角色、故事节点、镜头方向、动作细节从头到尾一致。思路很直接:让 AI 先知道角色长什么样、故事怎么走,再动起来。正文没披露分镜工作流的具体步骤,但这个方法比纯文生视频靠谱,适合做叙事类短片。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
14:40
69d ago
Hacker News 首页· rssEN14:40 · 05·20
用AI智能体给分布式系统做测试
这是一个GitHub项目,标题说用AI智能体(AI agent)来测试分布式系统。但正文只给了仓库链接和Hacker News讨论链接,目前3颗星、0个issue。项目具体怎么设计智能体、测什么系统、用什么方法、能不能复现、效果如何,全都没披露。这点先别太激动,等作者放出更多细节再说。
#Agent#GitHub#Hacker News#Open source
一句话点评
标题说用AI智能体测分布式系统,但正文只给了GitHub链接,目前3星、0个issue。具体怎么设计、测什么、效果如何,全没披露。这点先别太激动,等作者放出更多细节再说。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R0
14:00
69d ago
TechCrunch AI· rssEN14:00 · 05·20
NanoClaw 创始人拒了 2000 万美元收购,自己拿了 1200 万美元种子轮
NanoClaw 是 OpenClaw 的安全替代品,跑在容器沙箱里,不让 AI agent 直接接触电脑。创始人拒绝了 2000 万美元收购,转而拿了 1200 万美元种子轮。正文没披露投资方和估值,但拒绝收购说明团队想自己控制方向。
#Agent#Safety#Tools#NanoClaw
一句话点评
NanoClaw 是 OpenClaw 的安全替代品,把 AI agent 关在容器沙箱里跑,不让它直接碰电脑。创始人拒了 2000 万美元收购,拿了 1200 万种子轮——拒绝收购说明团队想自己控方向,但正文没披露投资方和估值,这点先别太激动。短评:安全沙箱 + 拒绝收购,方向对但钱和验证都还缺。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
13:43
69d ago
Hacker News 首页· rssEN13:43 · 05·20
GitHub 确认 3800 个仓库被恶意 VSCode 插件攻破
GitHub 证实,一个恶意 VSCode 扩展导致 3800 个仓库被入侵。目前正文没披露插件名称、攻击链条和受影响账户范围,只链接了之前 Hacker News 的讨论帖。3800 这个数字说明影响面不小,但具体怎么攻的、哪些仓库遭殃,还得等更多细节。
#Code#Tools#GitHub#VSCode
一句话点评
GitHub 确认一个恶意 VSCode 扩展搞了 3800 个仓库,数字挺大,但正文没披露插件名字、攻击链条和受影响账户范围,只链了个 HN 讨论帖。目前信息缺口明显,没法判断是供应链投毒还是凭据窃取。短评:数字吓人,细节欠奉,先别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
13:33
69d ago
r/LocalLLaMA· rssEN13:33 · 05·20
Hugging Face 排行榜现在能按模型参数量筛选了
Hugging Face 的基准测试页面新增了按模型大小筛选的功能,比如可以直接看 32B 以下哪个模型在 SWE-bench Verified 上表现最好。正文没披露筛选粒度(比如是按 7B/13B 档位还是精确参数量)以及功能上线时间。对挑小模型做部署的人来说,省得自己手动扒数据了。
#Benchmarking#Hugging Face#Product update#Benchmark
一句话点评
Hugging Face 的排行榜现在能按模型大小筛选了,比如直接看 32B 以下谁在 SWE-bench Verified 上最强。对挑小模型部署的人来说省了手动扒数据的功夫。但正文没披露筛选粒度(是按 7B/13B 档位还是精确参数量)以及上线时间,功能细节还不清楚。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
12:38
69d ago
r/LocalLLaMA· rssEN12:38 · 05·20
有人用 Qwen 3.6-27B 写了个单页 Hugging Face 模型搜索工具
Reddit 用户发了一个纯 HTML 的 Hugging Face 模型搜索工具,代码是用 Qwen 3.6-27B 写的。功能上支持按日期范围和参数量筛选模型,搜索结果会按基础模型和衍生作者分组展示,第一次搜索后会缓存 HF API 结果。工具本身就是一个 HTML 文件,不用装依赖,打开就能用。正文没披露缓存有效期和是否支持私有模型搜索。
#Code#Tools#Qwen#Hugging Face
一句话点评
一个纯 HTML 的 Hugging Face 模型搜索工具,代码是 Qwen 3.6-27B 写的。支持按日期和参数量筛选,结果按基础模型和衍生作者分组,第一次搜索后缓存 HF API 结果。不用装依赖,打开就能用。正文没披露缓存有效期和是否支持私有模型搜索。短评:模型搜索小工具,代码是 AI 写的,胜在轻量,但功能有限。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
11:43
69d ago
r/LocalLLaMA· rssEN11:43 · 05·20
Reddit 用户实测 whichllm:4-6GB 显存笔记本能跑,但精度没给数据
一位 Reddit 用户在办公笔记本(4-6GB 显存)上测了 whichllm,说 qwen2.5-coder-instruct 3b 能当本地命令行工具用。但帖子没披露 gpt-oss-20b 或 qwen3.6-27b 的可复现运行条件,也没给任何精度对比数据。正文被 Reddit 屏蔽,看不到更多细节。结论:低显存能跑,但准确率未知,别急着信。
#Code#Tools#Inference-opt#Qwen
一句话点评
Reddit 用户用 4-6GB 显存的办公笔记本跑了 whichllm,说 qwen2.5-coder-instruct 3b 能当本地命令行工具用。但帖子被 Reddit 屏蔽,正文看不到,也没披露 gpt-oss-20b 或 qwen3.6-27b 的可复现运行条件,更没给任何精度对比数据。结论:低显存能跑,但准确率未知,别急着信。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K1·R1
10:57
69d ago
Hacker News 首页· rssEN10:57 · 05·20
BBC 记者 20 分钟骗过谷歌 AI,让它说自己是世界热狗冠军
BBC 记者自己试了一下,只花 20 分钟发了一篇假博客,第二天谷歌 AI 就把他描述成世界热狗冠军。问题出在 AI 搜索时太容易信单个网页,有人已经在用这招操纵医疗、理财等严肃问题的回答。谷歌说政策没变,但悄悄更新了反垃圾规则。专家提醒:在系统修好之前,别太信 AI 给你的唯一答案。
#Safety#Google#BBC#Incident
一句话点评
BBC记者花20分钟发假博客,第二天谷歌AI就把他描述成世界热狗冠军。问题出在AI搜索太容易信单个网页,医疗、理财等严肃问题已被操纵。谷歌说政策没变,但悄悄更新了反垃圾规则。专家提醒:系统修好前别太信AI给的唯一答案。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
10:42
69d ago
AI HOT 精选· aihot-apiZH10:42 · 05·20
商汤 SenseNova U1:一个模型同时处理文字和图片
商汤发了 SenseNova U1,号称能同时理解文本和图像,而不是像多数工具那样分开做。正文没披露模型参数量、定价、上线时间,也没给可复现的评测条件,所以实际效果和成本都还不清楚。
#Multimodal#Vision#SenseTime#Product update
一句话点评
商汤发了 SenseNova U1,号称能同时理解文本和图像,而不是像多数工具那样分开做。正文没披露模型参数量、定价、上线时间,也没给可复现的评测条件,所以实际效果和成本都还不清楚。 短评:多模态不新鲜,关键看落地成本。商汤没给任何硬指标,先打个折。
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K0·R0
10:35
69d ago
Hacker News 首页· rssEN10:35 · 05·20
Qwen3.7-Max:专为智能体时代设计的旗舰模型
Qwen3.7-Max 是阿里云最新发布的闭源模型,主打智能体(agent)能力,也就是让模型能自己调用工具、写代码、操作软件,完成几百上千步的复杂任务。官方展示了一个例子:模型连续跑了35小时,自主优化了1000多次内核代码。在编码智能体测试中,Terminal Bench 2.0 得分69.7,SWE-Verified 80.4,都略高于对比的 O...
#Agent#Qwen#Hacker News#Product update
一句话点评
阿里云发了Qwen3.7-Max,闭源模型,主打让模型自己干活——写代码、调内核、操作软件,能连续跑35小时自主优化内核代码,调了1000多次工具。编码测试Terminal Bench 2.0得分69.7,SWE-Verified 80.4,比对比模型略高一点,但差距不大。亮点是跨框架通用,Claude Code、OpenClaw都能跑。不过正文没披露模型参数量、训练成本、API定价,也没说...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
10:32
69d ago
AI HOT 精选· aihot-apiZH10:32 · 05·20
Qwen 2026大会:AI原生云架构蓝图发布
阿里云在Qwen 2026大会上公布了主题演讲议程,核心是AI原生云和Agent原生云架构,以及多模态视觉技术发布。议程强调面向全球规模的工程蓝图,但正文没披露具体架构参数、产品上线时间或可用性。
#Agent#Reasoning#Multimodal#Qwen
一句话点评
阿里云在 Qwen 大会上画了个 AI 原生云架构的饼,但正文没披露任何具体参数、上线时间或可用性。议程标题看着挺大——Agent 原生云、多模态视觉、推理未来——但全是方向,没细节。目前只能当战略预告看,别当产品发布。
HKR 分解
hook knowledge resonance
打开信源
32
SCORE
H0·K0·R0
10:15
69d ago
● P1AI HOT 精选· aihot-apiZH10:15 · 05·20
软银对 OpenAI 押注超 600 亿美元,内部担心孙正义对奥尔特曼是“追星式”信任
软银在 OpenAI 上的总承诺投资已超过 600 亿美元,持股超 10% 却没有董事会席位,连观察员席位都没拿到。部分高管私下担心孙正义把太多资本集中在一家公司身上,而且对奥尔特曼的信任近乎“追星”,下属提出极端风险问题时曾被不耐烦地驳回。软银为此卖掉了英伟达等资产,也没有投资其他竞品模型,这让一些内部人士联想到当年 WeWork 的灾难。目前 Op...
#SoftBank#OpenAI#Masayoshi Son#Funding
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
软银砸了超600亿美元给OpenAI,持股过10%却连个董事会观察员都没拿到,内部有人觉得孙正义对奥尔特曼的信任像追星。
锐评
这条新闻最值得看的是数字背后的不对等关系:软银承诺投资超过600亿美元,持股超10%,但连一个董事会观察员席位都没拿到。这意味着软银对OpenAI的决策几乎没有影响力,钱进去了,话语权没进去。部分高管私下把这事和当年WeWork的灾难类比,不是没道理——孙正义又一次把大量资本集中在一位他个人高度信任的创始人身上,而且下属提极端风险时被不耐烦地驳回。 目前软银账面上是赚的,年度利润增长三倍多,主要靠OpenAI估值上升。但这里有个时间差:这些收益是纸面上的,而OpenAI还没上市,竞争对手Anthropic的估值已经在逼近甚至可能反超。软银为此卖掉了英伟达等资产,也没投其他竞品模型,等于把鸡蛋全放在一个篮子里。 正文没披露这600亿美元的具体条款和退出机制,也没说软银内部反对声音到底有多大、有没有触发过正式的风险审查。这些信息缺口让“高度信心”的说法暂时只能打个折。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
10:14
69d ago
AI HOT 精选· aihot-apiZH10:14 · 05·20
阿里云MSE AI调度器公测:让Agent自己干活,不用人盯着
阿里云开放了MSE AI调度器的免费公测,主要解决开源Agent方案(比如OpenClaw、Dify)常见的三个问题:容易挂、运维麻烦、出了事不知道哪步错了。它做了分布式调度保证高可用、统一权限管理、弹性伸缩省成本,以及全链路可观测性——就是每一步执行都能追踪到日志和耗时。适合想把Agent放进生产流程、但不想自己搭整套运维体系的团队。公测免费,链接在原文。
#Agent#Tools#Alibaba Cloud#OpenClaw
一句话点评
阿里云把MSE AI调度器开放免费公测了,主打解决开源Agent方案(OpenClaw、Dify)容易挂、运维麻烦、出问题找不到根因的痛点。它做了分布式调度保证高可用、统一权限管理、弹性伸缩省成本,以及全链路可观测——每一步执行都能追踪日志和耗时。适合想把Agent放进生产流程、但不想自己搭运维体系的团队。公测免费,但正文没披露公测结束后的定价,长期成本未知。
HKR 分解
hook knowledge resonance
打开信源
36
SCORE
H0·K1·R0
10:04
69d ago
Hacker News 首页· rssEN10:04 · 05·20
用AI写了10万行Rust代码后的经验总结
作者用AI在约4周内写了10万行Rust代码,实现了一个多Paxos共识引擎,性能从2.3万 ops/s优化到30万 ops/s。核心经验是:让AI写代码合约(前置条件、后置条件、不变式),再让AI根据合约生成测试和属性测试,能提前抓到Paxos安全违规这类深层bug。作者还推荐轻量级规格驱动开发——先用/specify生成用户故事和验收标准,再用/c...
#Code#Commentary
一句话点评
作者用AI在4周内写了10万行Rust代码,实现了一个多Paxos共识引擎,性能从2.3万 ops/s优化到30万 ops/s。核心经验是:让AI写代码合约(前置条件、后置条件、不变式),再让AI根据合约生成测试和属性测试,能提前抓到Paxos安全违规这类深层bug。作者还推荐轻量级规格驱动开发——先用/specify生成用户故事和验收标准,再用/codex或claude code生成实现。...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
08:49
69d ago
Hacker News 首页· rssEN08:49 · 05·20
Raster 上线链上投资组合分析工具,从原始区块链数据重建可审计的盈亏
Raster 发布了一个 DeFi 投资组合分析工具,能从原始链上活动重建可审计的状态,并计算出确定的盈亏(PnL)。页面展示了一个示例钱包,资产净值约 31 万美元,但未实现亏损高达 59 万美元,说明工具能清晰呈现实际盈亏。正文没有披露定价、支持多少条链、以及上线时间,这些信息目前是缺失的。
#Agent#Raster#Product update
一句话点评
Raster 做了一个 DeFi 投资组合分析工具,能从链上原始数据重建交易历史并算出确定的盈亏(PnL)。示例钱包净值 31 万美元,未实现亏损却高达 59 万美元,说明工具能清晰展示实际盈亏,而不是只看表面数字。这点对 DeFi 用户挺有用,尤其是那些跨链、多协议操作的人。但正文没披露定价、支持多少条链、以及上线时间,这些信息目前是缺失的。如果是真的,能省去手动对账的麻烦,但先别太激动,...
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R0
08:48
69d ago
r/LocalLLaMA· rssEN08:48 · 05·20
Qwen3.6 27B 在两块 Blackwell 6000 上跑到 100–110 tokens/s,还有优化空间吗?
Reddit 用户用 llama.cpp 跑 Qwen3.6-27B,两块 Blackwell 6000 GPU,输出速度 100–110 tokens/s。配置拉满:104 万上下文、并行 4、BF16 GGUF、FlashAttention、MTP draft。速度不慢,但正文没披露延迟分解或每层利用率,所以瓶颈在哪不好说。如果这是纯推理,这个吞吐...
#Inference-opt#llama.cpp#Qwen#AMD
一句话点评
两块Blackwell 6000跑Qwen3.6-27B,输出100–110 tokens/s,配置拉满:104万上下文、BF16、FlashAttention、MTP draft。速度不差,但正文没披露延迟分解或每层利用率,瓶颈在哪不好说。如果纯推理,这个吞吐对27B模型算正常偏上,但两块专业卡的成本够买好几台消费级机器,性价比存疑。短评:速度还行,但两块专业卡的成本够买好几台消费级机器了。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
08:35
69d ago
AI HOT 精选· aihot-apiZH08:35 · 05·20
Gemini 3.5 Flash 上线 OpenCode,百万上下文,定价对标国内模型
Gemini 3.5 Flash 在 OpenCode 平台上线了,主打速度快、支持 100 万 token 上下文(相当于一次塞进好几本书),而且定价跟 GLM、Kimi、DeepSeek Pro 差不多。这意味着如果你用惯了国内这些模型,切过去成本不会跳涨。不过正文没披露具体每百万 token 多少钱,也没说是否支持流式输出或函数调用,实际体验还得...
#Inference-opt#Gemini#OpenCode#DeepSeek
一句话点评
短评:速度+百万上下文,价格对标国内主流,切模型成本低。但没披露具体定价和流式支持,先别急着换。 点评:Gemini 3.5 Flash 上了 OpenCode,主打快和 100 万 token 上下文(一次塞几本书没问题),定价说跟 GLM、Kimi、DeepSeek Pro 差不多。如果你用惯了国内模型,切过去成本不会跳涨,这点挺省钱。但正文没披露每百万 token 具体多少钱,也没说...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
08:29
69d ago
r/LocalLLaMA· rssEN08:29 · 05·20
LMStudio 的 MTP 功能开了反而让输出变差
一位 Reddit 用户发现,在 LMStudio 里开启 MTP(多 token 预测)功能后,模型输出质量明显下降。他做了两次对比测试,只切换 MTP 开关,提示词用了 52 个短句。但帖子没交代用了什么模型、LMStudio 版本和采样参数,所以这个结论的适用范围还不清楚。
#Inference-opt#LMStudio#LocalLLaMA#Incident
一句话点评
Reddit 用户实测发现,在 LMStudio 里打开 MTP(多 token 预测,即一次预测多个后续 token 以加速推理)后,输出质量反而变差。他只做了两次对比测试,提示词用了 52 个短句,但没交代用了什么模型、LMStudio 版本和采样参数。结论适用范围有限,更像是个案提醒:MTP 加速可能牺牲质量,尤其在小模型或特定采样设置下。正文没披露测试模型和版本,建议用户在自己常用配...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
07:40
69d ago
AI HOT 精选· aihot-apiZH07:40 · 05·20
写个提示词就能生成超真实足球场自拍视频
PixVerse 放了一条提示词,目标是生成一段五个朋友在大型体育场用手机自拍的视频。提示词写得很细:五个角色的外貌要一致、球场环境要具体、镜头要模拟真实手机拍摄的抖动和失焦,还得有一连串自然的动作。效果看起来挺真,但正文没披露生成成功率、需要多少算力、或者是不是每次都能保持角色长相不崩——这点先别太激动。
#Multimodal#Vision#PixVerse#Product update
一句话点评
PixVerse 放了一条超细提示词,目标是生成五个朋友在球场用手机自拍的视频,效果挺真。但正文没披露生成成功率、算力成本或角色长相是否每次都能保持不崩——这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K1·R0
07:18
69d ago
r/LocalLLaMA· rssEN07:18 · 05·20
Qwen3.7 Max 在 Artificial Analysis 排第五,跟 GPT-5.4 差不多,比 Gemini 3.5 Flash 高一点
Qwen3.7 Max 在 Artificial Analysis 的榜单上排第五,分数跟 GPT-5.4(xhigh 配置)差不多,还比刚发的 Gemini 3.5 Flash 高一截。另一边,DSV4 Flash 和 Qwen3.6 27B 比自家 Max 版本低了 6 分。帖子还提到 Qwen3.7 的 27B 和 35B 版本分数没公布,大家只...
#Benchmarking#Qwen#Artificial Analysis#Google
一句话点评
Qwen3.7 Max 在 Artificial Analysis 排第五,分数跟 GPT-5.4 高配版差不多,还压了刚发的 Gemini 3.5 Flash 一头。但注意这是 Max 版,27B/35B 小模型分数还没公布,大家只能干等。同场 DSV4 Flash 和 Qwen3.6 27B 比自家 Max 低了 6 分,说明小模型跟大杯差距不小。正文没披露具体测试集和成本,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
07:05
69d ago
Product Hunt · AI· rssEN07:05 · 05·20
InstaVM:给 AI agent 开一台“即开即用”的虚拟机,200 毫秒内启动
InstaVM 在 Product Hunt 上线,主打“给 AI agent 的即时电脑”。它用 Firecracker 微虚拟机技术,把 agent 跑在隔离环境里,启动时间不到 200 毫秒。你可以把它理解成给每个 agent 单独开一台轻量服务器,跑完就销毁,安全可控。产品定位是 agent 的生产控制面板,支持监控和权限管理。目前正文没披露定...
#Agent#Tools#InstaVM#Product Hunt
一句话点评
给每个 AI agent 单独开一台轻量虚拟机,跑完就销毁,启动不到 200 毫秒。基于 Firecracker 微VM,主打隔离和安全。目前只看到 Product Hunt 页面,定价、支持哪些 agent 框架、部署方式都没披露。如果是按需计费,对跑短任务的 agent 挺省钱,但长期运行的成本和性能还得看实测。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K0·R0
06:21
69d ago
Product Hunt · AI· rssEN06:21 · 05·20
Second Brain for AI:给 Claude、ChatGPT 和 Cursor 装一个持久记忆层,免费
每次关掉聊天窗口,AI 就忘了你之前说过什么。这个开源工具(MIT 协议)给 Claude、ChatGPT、Cursor 等 MCP 客户端加了一个自托管的记忆层,存一次上下文,下次靠语义就能召回,不用再翻关键词。它跑在 Cloudflare 上,有免费额度,数据归你自己管。还带了去重和语义搜索功能。去重逻辑分三档:相似度低于 0.85 就存为新条目;...
#Memory#Anthropic#OpenAI#Cursor
一句话点评
给 Claude/ChatGPT 加了个自托管记忆层,下次聊天能靠语义召回之前说过的内容,不用再翻关键词。跑在 Cloudflare 上,有免费额度,数据归自己管。去重分三档,相似度低于 0.85 才存为新条目。但正文没披露存储机制、权限边界和保留策略,免费额度具体多少也没说,生产环境慎用。
HKR 分解
hook knowledge resonance
打开信源
54
SCORE
H0·K0·R1
06:18
69d ago
AI HOT 精选· aihot-apiZH06:18 · 05·20
开源油猴脚本:截图自动上传小红书抖音,还能扒YouTube字幕喂给ChatGPT
一个开源油猴脚本,能让你在浏览器里截图后直接粘贴上传到小红书、抖音和微信公众号后台,省去手动保存再上传的步骤。还顺手加了YouTube字幕复制、倍速播放,以及把内容一键导出到NotebookLM或ChatGPT的功能。作者说这工具让他更愿意把X上的内容同步到国内平台,不过也承认部分平台的上传体验不太好。正文没披露脚本具体支持哪些浏览器、有没有平台封号风险。
#Tools#X#NotebookLM#ChatGPT
一句话点评
一个油猴脚本,让你在浏览器里截图后直接粘贴上传到小红书、抖音和微信公众号后台,省去手动保存再上传的步骤。还顺手加了YouTube字幕复制、倍速播放,以及把内容一键导出到NotebookLM或ChatGPT。作者说这工具让他更愿意把X上的内容同步到国内平台,不过也承认部分平台的上传体验不太好。正文没披露脚本具体支持哪些浏览器、有没有平台封号风险。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R0
06:13
69d ago
r/LocalLLaMA· rssEN06:13 · 05·20
给8B小模型加护栏,agent任务从53%跳到99%
Reddit帖子说,给一个80亿参数模型加上护栏(guardrails),在agent任务上准确率从53%拉到99%。数字很漂亮,但正文没披露具体任务集、模型名字、护栏机制和评测条件,所以先别太激动。如果属实,意味着小模型加一层规则或验证就能接近满分,成本比换大模型低很多。
#Agent#Safety#Benchmarking#ACM CAIS
一句话点评
短评:8B模型加护栏从53%跳到99%,数字漂亮但先别激动。 点评:Reddit帖子称,给一个80亿参数模型加上护栏(guardrails),在agent任务上准确率从53%拉到99%。如果属实,意味着小模型加一层规则或验证就能接近满分,成本比换大模型低很多。但正文没披露具体任务集、模型名字、护栏机制和评测条件,来源是ACM CAIS '26预印本,且Reddit链接被墙,无法验证。这点先...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
05:55
69d ago
Product Hunt · AI· rssEN05:55 · 05·20
Google Stitch 3.0:草稿秒变可编辑 UI,还带了个新 Agent
Google 发布了 Stitch 3.0,核心卖点是“用 AI 在实时画布上生成和迭代 UI 界面”。你输入文字描述,它就能直接生成移动端或网页端的 UI 稿,支持流式编辑、原地 AI 修改,还能一键导出到 Figma、Netlify、Lovable 和 Bolt。这次还引入了一个叫 Hatter 的新 Agent,目标是处理多步骤设计任务,另外新增...
#Code#Tools#Google#Product update
一句话点评
Google 把 Stitch 升级到 3.0,主打文字生成 UI 并实时编辑,还能一键导出到 Figma、Netlify 等工具。新增的 Hatter Agent 试图处理多步骤设计任务,但正文没披露它具体能多“多步骤”,也没提定价和模型细节。免费这一点对快速原型挺友好,但生成质量、复杂交互支持、以及 Hatter 的实际能力都还是未知数。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R0
05:24
69d ago
Product Hunt · AI· rssEN05:24 · 05·20
Google Antigravity 2.0:桌面端多智能体编排工具
Google 发布了 Antigravity 2.0,一个桌面应用,可以在 IDE 里同时跑多个编码智能体,还支持定时后台任务和子智能体工作流。它原生集成了 AI Studio、Firebase 和 Android,面向做生产级应用的开发者。正文没披露具体能跑多少个智能体、怎么集成、定价多少、什么时候能用,所以实际效果和成本还不清楚。
#Agent#Tools#Google#Product update
一句话点评
Google 出了个桌面应用 Antigravity 2.0,能在 IDE 里同时跑多个编码智能体,还支持定时后台任务和子智能体工作流。原生集成了 AI Studio、Firebase 和 Android,面向做生产级应用的开发者。但正文没披露具体能跑多少个智能体、怎么集成、定价多少、什么时候能用,所以实际效果和成本还不清楚。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
05:19
69d ago
Product Hunt · AI· rssEN05:19 · 05·20
Google 出了个终端里的编程助手,能同时跑多个代码 agent
Google Antigravity 今天发布了 CLI 版本,让你直接在终端里运行和监控多个编程 agent。支持多步推理、多文件编辑、调用工具,还能记住历史对话。特别优化了 SSH 会话和纯键盘操作,适合那些不想离开命令行的开发者。产品页没说支持哪些模型、怎么安装、价格多少,也没提权限控制。目前有免费选项,今天在 Product Hunt 上排第一...
#Agent#Code#Tools#Google
一句话点评
Google 把 Antigravity 的编程 agent 塞进了终端,支持多步推理、多文件编辑和对话历史,专为 SSH 和键盘党设计。今天在 Product Hunt 排第一,有免费选项。但正文没披露支持哪些模型、怎么安装、价格多少,也没提权限控制。这点先别太激动,等具体信息出来再评估。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
05:00
69d ago
FT · 科技· rssEN05:00 · 05·20
特朗普的AI“垃圾宣传”机器
FT报道称,特朗普的Truth Social账号大量使用AI生成的假图片来改变政治传播的边界。正文没披露用了什么生成工具、发了多少张图、提示词是什么、以及发布的时间线。
#Multimodal#Vision#Safety#Donald Trump
一句话点评
FT报道特朗普Truth Social账号大量使用AI生成假图,但正文没披露用了什么工具、发了多少张、提示词和发布时间线。关键信息缺口太大,只能当现象看,没法评估规模和技术细节。短评:AI假图进政治传播,但FT这篇信息量不够,工具、数量、时间线全没给。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
04:51
69d ago
Hacker News 首页· rssEN04:51 · 05·20
MiniMax M2.7 实测:在三个真实工作流里当副手,比 Opus 4.7 差在哪
作者拿到 MiniMax M2.7 的 API 额度后,直接把它塞进 Claude Code,跑了三个自己常干的活:重构一个老 PyTorch 项目、给 Obsidian 知识库写笔记、以及更新一个过时的 PyTorch 项目。对比基准是 Claude Opus 4.7。结果挺一致:M2.7 在任务边界清晰、输出格式固定的时候挺好用,但一旦上下文里有些...
#Code#Benchmarking#MiniMax#Hacker News
一句话点评
短评:M2.7 在边界清晰的任务上表现不错,但上下文一模糊就容易翻车。 点评:作者拿到 MiniMax M2.7 API 额度后,把它塞进 Claude Code 跑了三个真实工作流:重构 PyTorch 项目、写 Obsidian 笔记、更新旧项目。对比基准是 Claude Opus 4.7。结果一致:M2.7 在任务边界清晰、输出格式固定时挺好用,但一旦上下文里有些隐含条件没写清楚,它...
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R0

更多

频道

后台