ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-13

37 items · updated 3m ago
RSS live
2026-05-13 · 星期三2026年5月13日
07:31
76d ago
r/LocalLLaMA· rssEN07:31 · 05·13
有人在8GB显存上试过BeeLlama.cpp吗?能做agentic coding吗?
Reddit用户问BeeLlama.cpp在8GB显存+32GB内存上跑agentic coding的效果,特别是Q4量化版Qwen3.6-35B-A3B、Qwen3.6-27B、Gemma-4-31B和Gemma-4-26B-A4B。帖子引用了一个相关讨论,说Qwen 3.6 27B Q5在RTX 3090上跑200k上下文,速度比基线快2-3倍,峰...
#Agent#Code#Inference-opt#BeeLlama.cpp
一句话点评
BeeLlama.cpp 在 8GB 显存上跑 agentic coding 有人试过吗?帖子说 Qwen 3.6 27B Q5 在 3090 上 200k 上下文速度比基线快 2-3 倍,峰值 135 tps。但正文被 Reddit 屏蔽了,没披露具体 agent 任务类型和成功率。8GB 跑 27B 模型显存肯定不够,得靠 CPU 卸载,延迟会高。这点先别太激动,等实测。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R1
07:16
76d ago
r/LocalLLaMA· rssEN07:16 · 05·13
Q.ANT 光子 GPU 号称性能百倍、功耗降 90%,但正文没给任何实测数据
Reddit 上有人讨论德国公司 Q.ANT 的光子 GPU 进展。这家公司刚在奥斯汀开了办公室,挖了 IBM 老将 Bruno Spruth 当 CTO。它说自己的光子 GPU 已经在莱布尼茨超算中心跑了几个月,第二代产品性能是晶体管 GPU 的 100 倍、能效高 90 倍。数字很漂亮,但正文没披露任何实测数据或第三方验证,连跑的是什么负载都没说。...
#Inference-opt#Q.ANT#Bruno Spruth#Leibniz Supercomputing Centre
一句话点评
德国公司Q.ANT说自己的光子GPU已在莱布尼茨超算中心跑了好几个月,第二代性能是晶体管GPU的100倍、能效高90倍。数字漂亮得像PPT,但正文没披露任何实测数据或第三方验证,连跑的是什么负载都没说。挖了IBM老将当CTO、在奥斯汀开办公室,更像融资前造势。如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
06:57
76d ago
Hacker News 首页· rssEN06:57 · 05·13
有人用 ChatGPT 用出了“AI 精神病”,还去申请当教皇
一名荷兰 IT 工作者 Dennis Biesma 在使用 ChatGPT 后出现严重幻觉,自称破解了宇宙终极理论、无限核聚变,甚至向梵蒂冈申请当教皇。医生诊断为“AI 精神病”(AI psychosis),认为 AI 的拟人化对话可能诱发或加重精神分裂倾向。正文没有披露他具体用了多久、每天对话量多少,也没有给出既往精神病史。这件事提醒从业者:对话式 ...
#Safety#ChatGPT#Hacker News#The Standard
一句话点评
一名荷兰IT男跟ChatGPT聊到自称破解了宇宙终极理论、无限核聚变,还向梵蒂冈申请当教皇。医生诊断这叫“AI精神病”,认为AI的拟人化对话可能诱发或加重精神分裂倾向。正文没披露他具体用了多久、每天对话量多少,也没给既往精神病史。这件事提醒从业者:对话式AI的拟人化风险不是理论上的,真实用户可能分不清边界。但个案不能直接推成普遍结论,缺使用时长和病史数据,没法判断是AI诱因还是既有病发。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R1
06:37
76d ago
● P1纽约时报中文网· rssZH06:37 · 05·13
中国智库向Anthropic要Mythos模型被拒,美方视作AI竞赛升级信号
上个月在新加坡一场非官方对话中,一家中国智库要求Anthropic向北京开放其最新的Mythos模型,被直接拒绝。Mythos是个擅长找软件漏洞的模型,Anthropic目前只给美国政府和40多家机构用,理由是怕引发网络安全危机。美方官员认为这次接触虽非正式外交,但背后大概率有中国政府授意,并把它看作中美AI竞赛升温的又一个迹象。文章提到,美国最新模型...
#Code#Safety#Tools#Anthropic
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
中国智库私下要 Anthropic 开放 Mythos 模型被拒,这事不意外,但说明中美 AI 技术隔离已经从芯片烧到了模型本身。
锐评
这条新闻的核心不是“被拒”,而是“谁在要”和“要的是什么”。出面的是智库,不是政府,但美方判断背后有北京授意,这种“二轨外交”本身就是试探水温的标准动作。他们要的 Mythos 是个专门找软件漏洞的模型,Anthropic 只给了美国政府及 40 多家机构,理由是怕引发网络安全危机。换句话说,这模型在美方眼里已经不是商业产品,而是类似军火清单上的东西。 文章提到美方估计自家最新模型领先中国九个月到一年,比之前的半年差距拉大了。但这个数字得打个折:领先幅度是动态的,而且 DeepSeek 去年已经证明能用华为芯片做出有竞争力的模型。真正值得关注的信息缺口是:Anthropic 拒绝的具体理由是什么?是法律限制、公司政策,还是政府直接施压?正文没披露。另外,中方要模型的用途是“保护关键基础设施”,这个说法本身不新鲜,但放在 Mythos 这种攻击属性极强的模型上,说服力有限。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
05:26
76d ago
AI HOT 精选· aihot-apiZH05:26 · 05·13
AI技能更新:新增可交互地图组件,支持缩放拖拽和AI标记
Skills功能更新后,AI可以生成带地图的版式和地图组件,支持缩放、拖动等交互操作,还能在地图上任意打标记。正文没披露这个功能支持哪个平台、怎么调用、以及版本号。
#Tools#Product update
一句话点评
AI 技能更新加了地图组件,能缩放、拖动、打标记,适合做位置相关的交互展示。但正文没说是哪个平台、怎么调用、版本号多少,目前只能当个功能预告看。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
05:10
76d ago
r/LocalLLaMA· rssEN05:10 · 05·13
Qwen3.6-27B 一次修好 CSS 界面 bug,Gemma4-26B 循环 15 分钟没搞定
一位用户在 MacBook Pro M4 Max 上本地跑模型,用 Qwen3.6-27B-UD-MLX-8bit 一次就修好了 CSS 下拉菜单跑出屏幕的 bug,而 Gemma4-26B 在同一台机器上反复读代码、改代码、失败,循环了大约 15 分钟。正文没披露具体 prompt 或调试步骤,但对比很直观:Qwen 一次过,Gemma 卡死循环。
#Code#Reasoning#Vision#Qwen
一句话点评
Qwen3.6-27B 一次修好 CSS 下拉菜单 bug,Gemma4-26B 在同一台 MacBook Pro M4 Max 上循环 15 分钟失败。对比直观,但正文没披露 prompt 和调试步骤,可能是 prompt 差异或模型对局部代码修改的稳定性不同。单次成功不等于全面碾压,Gemma 的循环也可能是策略保守。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
04:35
76d ago
AI HOT 精选· aihot-apiZH04:35 · 05·13
oMLX 新版让苹果本地跑多模态更快,显存压力也小了
oMLX 更新到 0.3.9.dev2,主要加了三个东西:Gemma 4 的 MTP 视觉路径(让模型看图更准)、DFlash 引擎(加速推理)、ParoQuant(量化压缩,省显存)。还支持一键启动 copilot 接 Claude 这类工具,以及 oQ 自动代理来缓解显存瓶颈。作者说图文处理速度变快、显存占用更低,但没给具体跑分或延迟对比,所以实际...
#Vision#Multimodal#Inference-opt#oMLX
一句话点评
oMLX 0.3.9.dev2 让苹果端侧跑多模态模型更快、更省显存,新增 Gemma 4 视觉路径、DFlash 推理引擎和 ParoQuant 量化压缩。还支持一键启动 copilot 接 Claude,以及 oQ 自动代理缓解显存瓶颈。作者说图文处理变快、显存占用更低,但没给具体跑分或延迟对比,所以实际提升幅度要自己测。对想在 Mac 上本地跑多模态模型的人来说,这版值得试,但别直接信...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
04:06
76d ago
新智元 · 公众号· rssZH04:06 · 05·13
VLA模型总忽略语言指令?LangForce用对数似然比损失让模型更听话
华中科大、哈工大和港科大(广州)联合提出了LangForce,核心思路是给VLA模型加一个对数似然比损失,强迫它更依赖语言指令而不是只盯着视觉。在SimplerEnv的分布外场景测试里,LangForce平均成功率66.5%,比QwenGR00T基线高了11.3个百分点。正文没披露训练数据量和计算成本,但效果提升挺明显,尤其对指令跟随幻觉有针对性。
#Robotics#Multimodal#Alignment#Huazhong University of Science and Technology
一句话点评
给VLA模型加一个对数似然比损失,强迫它更听语言指令而不是只看视觉。在SimplerEnv分布外场景测试里,平均成功率66.5%,比QwenGR00T基线高了11.3个百分点。正文没披露训练数据量和计算成本,但效果提升挺明显,尤其对指令跟随幻觉有针对性。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
04:00
76d ago
FT · 科技· rssEN04:00 · 05·13
欧洲那几只AI股票涨了,因为美国科技热钱开始往外找标的
FT报道,欧洲为数不多的AI概念股最近涨了一波,原因是投资者在美国科技股涨了几年之后,开始去欧洲翻有没有能跟上的标的。正文没披露具体公司名字、涨幅数字、估值变化或时间区间,所以没法判断这波是情绪驱动还是真有业绩支撑。
#Financial Times#Funding#Commentary
一句话点评
FT说欧洲AI概念股涨了,因为美国科技股涨太久,投资者开始去欧洲翻标的。但正文被付费墙挡住,没披露具体公司、涨幅、估值或时间区间。这点先别太激动——没法判断是情绪轮动还是真有业绩支撑。缺关键数字和标的名单,信息量约等于标题本身。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H1·K0·R1
04:00
76d ago
FT · 科技· rssEN04:00 · 05·13
亚马逊设备负责人:我们不一定非要造手机
亚马逊硬件负责人 Panos Panay 在 Alexa+ 发布后接受采访,明确说公司不一定要做手机。正文没披露具体产品形态、发布时间或盈利目标,所以这点先别太激动。Panay 的潜台词可能是亚马逊更想围绕 Alexa+ 做智能家居或可穿戴设备,而不是跟苹果、三星正面抢手机市场。
#Audio#Amazon#Panos Panay#Alexa+
一句话点评
亚马逊硬件老大说公司不一定做手机,潜台词是更想围绕Alexa+做智能家居或可穿戴,而不是跟苹果三星硬碰硬。正文没披露具体产品形态、发布时间或盈利目标,所以这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K0·R1
04:00
76d ago
FT · 科技· rssEN04:00 · 05·13
Google DeepMind 计划“反击”
FT 一篇报道标题说 Google DeepMind 准备“卷土重来”,但正文只提到 Google 和 DeepMind 正在对 OpenAI 和 Anthropic 施加压力,没有披露任何具体模型、时间表或性能指标。所以这个“反击”目前更像一个战略姿态,不是产品发布预告。
#Google DeepMind#OpenAI#Anthropic#Commentary
一句话点评
FT标题说DeepMind要“卷土重来”,但正文只提了它和Google在给OpenAI、Anthropic施压,没披露任何模型、时间表或跑分。目前更像一个战略姿态,不是产品预告。 短评:标题党,正文没干货,先别激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
03:56
76d ago
r/LocalLLaMA· rssEN03:56 · 05·13
本地跑视频流水线:Qwen3 27B 比 Gemma 4 26B 更会调工具
一位用户在本地跑视频自动化流程,Qwen3 27B 能干净地调度工具,Gemma 4 26B 却在同一个机器上卡在工具调用循环里。整个流程用了 OpenCode 工作流,上下文窗口撑到 174K token,本地图片生成靠 Hugging Face 上的 Said Image Turbo。最终只拿到一次性的部分结果,说明长上下文和工具调用的稳定性还有坑。
#Agent#Tools#Multimodal#Qwen
一句话点评
Qwen3 27B 在本地视频自动化流程里比 Gemma 4 26B 更稳,后者容易卡在工具调用循环里。整个工作流上下文撑到 174K token,但只拿到一次性的部分结果,说明长上下文和工具调用的稳定性还有坑。正文没披露具体硬件配置和耗时,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
03:48
76d ago
● P1AI HOT 精选· aihot-apiZH03:48 · 05·13
Anthropic 被曝正谈判新一轮融资,投前估值超 9000 亿美元,要筹至少 300 亿
彭博社消息,Anthropic 正在跟投资者初步谈新一轮融资,目标是按 9000 亿美元以上的投前估值,筹至少 300 亿美元。这个数字比它今年 2 月融 G 轮时的 3800 亿投后估值翻了一倍多。交易还没签条款清单,预计最快本月底完成。Anthropic 计划今年晚些时候 IPO,现在急着筹钱主要是为了填算力资源的开销。
#Anthropic#Google#Amazon#Funding
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 估值半年翻倍多,急着在 IPO 前再融 300 亿美元填算力窟窿,但条款清单都还没签,变数不小。
锐评
Anthropic 这轮融资的估值跳涨速度有点吓人。2 月份刚以 3800 亿美元估值融了 300 亿,现在直接喊出 9000 亿以上的投前估值,再要 300 亿。说白了,就是烧钱太快,急着在年底上市前再囤一笔弹药,主要用来付高昂的算力账单。 不过,目前这还只是彭博社援引知情人士的初步洽谈,连条款清单都没签,预计最快本月底完成交易。这个时间表听起来很紧,中间会不会有变数不好说。而且,正文没披露这 300 亿的具体投资方是谁,也没说钱会具体怎么花在算力上,是买卡还是租云服务。 我会先打个折来看这个数字。估值半年翻一倍多,在还没上市、没有公开财务数据的情况下,更多反映的是投资方对头部 AI 公司的稀缺性焦虑,而不是公司实际业务撑起了这个价。等 IPO 招股书出来,看看收入和亏损的真实数字,才能判断这 9000 亿到底值不值。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
03:27
76d ago
AI HOT 精选· aihot-apiZH03:27 · 05·13
腾讯混元Hy3预览版上线GMI云,自称最强开源模型
腾讯混元在X上宣布Hy3预览版已登陆GMI Cloud,并称其为最强开源模型。但正文没披露参数量、跑分、定价或使用门槛,所以这个“最强”目前只能当宣传口号看,等具体数据出来再判断。
#Tencent Hunyuan#GMI Cloud#Hy3#Product update
一句话点评
腾讯混元说 Hy3 预览版上了 GMI Cloud,号称“最强开源模型”。但正文没给参数量、跑分、定价或使用门槛,这个“最强”目前只能当宣传口号看。等具体数据出来再判断。
HKR 分解
hook knowledge resonance
打开信源
32
SCORE
H0·K0·R0
03:15
76d ago
AI HOT 精选· aihot-apiZH03:15 · 05·13
百度李彦宏提新指标:日活跃智能体数(DAA)
李彦宏提议用日活跃智能体数(DAA)衡量智能体时代,类比移动互联网的DAU。他认为令牌消耗只反映成本,DAA更能体现产出价值。但正文没披露怎么统计、时间窗口多长,也没给出任何具体数值,所以这个指标目前还只是个概念。
#Agent#Baidu#Robin#Commentary
一句话点评
李彦宏提议用日活跃智能体数(DAA)替代令牌消耗来衡量智能体时代,类比移动互联网的DAU。想法不错,但正文没披露怎么统计、时间窗口多长,也没给任何具体数值,目前只是个概念。短评:指标方向对,但没数据没方法,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
03:14
76d ago
FT · 科技· rssEN03:14 · 05·13
北京叫停一家新加坡AI公司收购案,“新加坡洗白”还走得通吗?
FT这篇报道的核心案例是:北京叫停了一起涉及一家总部设在新加坡的AI初创公司的收购案。文章把这件事当作一个测试,看中国公司通过在新加坡设总部来规避国内监管的做法(FT称之为“Singapore washing”)还能不能持续。正文没披露买方、卖方、交易金额、法律依据和时间线,也没说这笔交易对Manus这家公司的具体运营有什么影响。信息缺口比较大,但信号...
#Manus#Financial Times#Policy
一句话点评
北京叫停一家新加坡AI初创公司的收购案,FT拿它当测试案例:中国公司靠“新加坡洗白”绕监管还行不行?正文没披露买方、卖方、交易金额和法律依据,信息缺口很大。信号意义大于实操参考,别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
03:10
76d ago
r/LocalLLaMA· rssEN03:10 · 05·13
本地小模型每周跑一遍完整工作流:查库、发邮件、写文档、转PDF
Reddit用户NoWorking8412分享了一个每周用Qwen3.6-35B-A3B(35B参数但激活仅3B,本地跑得动)跑完的完整流程:先评估数据库内容,然后通过邮件交换选择,自动生成Google Doc,收集修改意见,最后转成PDF模板。整个过程不依赖云端API,全部在本地完成。正文没披露具体延迟和硬件配置,但35B模型能跑通多步骤agent ...
#Agent#Embedding#Memory#Qwen
一句话点评
一个Reddit用户用Qwen3.6-35B-A3B(35B参数但只激活3B,本地能跑)跑通了一个每周自动流程:评估数据库、邮件选内容、生成Google Doc、收集修改意见、转PDF。全程不调云端API。亮点是证明了小激活模型也能做多步agent干活,但正文没披露延迟和硬件配置,实用性要打折。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
03:07
76d ago
AI HOT 精选· aihot-apiZH03:07 · 05·13
Codex 更新了应用内浏览器,支持多视口测试和截图核查
Codex 这次更新主要给应用内浏览器加了多视口测试功能,你可以切换不同屏幕尺寸测应用,还能在断点处点按验证。长测试会在关键节点自动截图,方便你回头检查。如果嫌测试慢,可以隐藏浏览器来禁用动画,速度能快1-2倍。另外标注功能也优化了,发送更快、消耗更少 tokens。整体看下来,对做 UI 测试的人来说挺实用,尤其是多视口和截图核查能省不少手动检查的功夫。
#Agent#Code#Tools#Codex
一句话点评
Codex 给浏览器加了多视口测试,能切屏幕尺寸、在断点处点按验证,长测试还会自动截图。隐藏浏览器能禁用动画,速度提升1-2倍。标注也优化了,发送更快、耗 tokens 更少。对 UI 测试挺实用,但正文没披露截图精度和标注节省的具体比例。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
03:03
76d ago
彭博科技· rssEN03:03 · 05·13
摩根大通资管:AI还在早期,别盯着短期,要看长期价值迁移
摩根大通资管的Joanna Shen在彭博电视上说,AI仍处于早期采用阶段,AI agent是几十年来第一个能提升劳动力投入的技术。正文没披露具体投资标的、估值方法或时间线,所以这点先别太激动——观点偏宏观,适合做长期配置的参考,不是操作建议。
#Agent#JPMorgan Asset Management#Joanna Shen#Bloomberg
一句话点评
摩根大通资管Joanna Shen说AI agent是几十年来第一个能提升劳动力投入的技术,AI还在早期采用阶段。观点偏宏观,适合做长期配置参考,不是操作建议。正文没披露具体投资标的、估值方法或时间线,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H0·K0·R1
02:47
76d ago
Latent Space· rssEN02:47 · 05·13
微调要凉了?OpenAI 停掉微调 API,Latent Space 说这是趋势
OpenAI 停掉了微调 API,Latent Space 把这当作头条。文章说,虽然头部玩家(Cursor、Cognition)反而在加大开源模型的强化微调,但对大多数 AI 工程团队来说,微调已经不是主流。替代方案包括超长提示词(比如 Claude 的 Constitution)和推理时计算。正文没披露 OpenAI 停 API 的具体原因,但暗示...
#Fine-tuning#Benchmarking#Inference-opt#OpenAI
一句话点评
OpenAI 停掉微调 API,Latent Space 直接说“微调已死”。但头部玩家 Cursor、Cognition 反而在加大开源模型的强化微调,所以“死”的是大众市场,不是全部。替代方案是超长提示词(比如 Claude 的 Constitution)和推理时计算。正文没披露 OpenAI 停 API 的具体原因,只暗示 GPU 紧缺或用户已转向。对多数 AI 工程团队来说,微调确实...
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
02:38
76d ago
AI HOT 精选· aihot-apiZH02:38 · 05·13
BenchLoop:给本地大模型跑分,一键出排行榜
BenchLoop 是一个给本地大模型做标准化测试的工具。你拉个模型下来,跑一下,它就能给出质量、速度和可靠性的综合评分,还支持对比不同提示格式(比如原生模式和 Hermes 模式)的表现。结果可以自动发到公开排行榜上,方便横向比较。说白了就是帮你省掉自己搭测试流程的麻烦,直接看哪个模型在本地跑得又快又好。不过正文没披露它具体用了哪些测试集、评分权重怎...
#Benchmarking#Inference-opt#BenchLoop#Hermes
一句话点评
BenchLoop 是个给本地大模型跑分的工具,拉下来一键测质量、速度和可靠性,还能对比不同提示格式(比如原生 vs Hermes 模式),结果自动上排行榜。省了你自己搭测试流程的麻烦。但正文没披露具体用了哪些测试集、评分权重怎么定,排行榜的权威性得打个问号。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
02:23
76d ago
r/LocalLLaMA· rssEN02:23 · 05·13
别急着买本地推理机,先攒钱等下一代
Reddit 用户说一台计划中的 1TB Genoa 机器从 6000 美元涨到了 30000 美元,涨幅 5 倍。帖子提到 64GB DDR5 RDIMM 已量产、256GB DDR5 RDIMM 可达 9200 MT/s,但没给任何跑分或实测数据。作者认为未来 2-3 年本地推理硬件会大升级,现在买不划算。不过正文没披露具体配置清单和涨价原因,也没...
#Inference-opt#Reddit#Apple#Micron
一句话点评
一台计划中的1TB Genoa机器从6000美元涨到3万美元,涨幅5倍。帖子说64GB DDR5 RDIMM已量产、256GB可达9200 MT/s,但没给任何跑分或实测数据。作者认为未来2-3年本地推理硬件会大升级,现在买不划算。不过正文没披露具体配置清单和涨价原因,也没说明是关税、供应链还是需求导致。信息缺口大,建议等实测再决定。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K1·R1
01:50
76d ago
彭博科技· rssEN01:50 · 05·13
AI 基建把内存芯片吃紧了,股市里赢家和输家差距拉大
全球内存芯片短缺,原因是 AI 基础设施建得太猛。Bloomberg 这篇报道说,缺货已经让不同公司的业绩和股价表现明显分化。正文被 paywall 挡住了,没披露具体是哪几家公司、股价涨跌多少、供需缺口有多大。
#Inference-opt#Commentary
一句话点评
全球内存芯片缺货,AI基建猛建是主因。Bloomberg说这已让公司业绩和股价明显分化,但正文被paywall挡住,没披露具体公司、涨跌幅和供需缺口。缺货本身不意外,关键是哪些公司扛得住、哪些掉队,这点先别太激动,等具体数据出来再判断。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
01:45
76d ago
Product Hunt · AI· rssEN01:45 · 05·13
BossHogg:给 AI 代理用的 PostHog 命令行工具
BossHogg 是一个面向 AI 编码代理和终端开发者的 CLI 工具,让你不用打开庞大的 MCP 工具集就能操作 PostHog 的分析和功能开关。简单说,就是让 AI 代理直接在命令行里查数据、改配置,省去来回切换界面的麻烦。项目开源免费,但正文没披露安装步骤、定价和具体支持哪些命令,想用还得自己去 GitHub 翻文档。
#Agent#Tools#BossHogg#PostHog
一句话点评
BossHogg 给 PostHog 套了个命令行壳,AI 编码代理不用开笨重的 MCP 工具集就能查数据、改功能开关。开源免费,但正文没披露具体支持哪些命令、怎么装,想用还得去 GitHub 翻文档。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R0
01:26
76d ago
AI HOT 精选· aihot-apiZH01:26 · 05·13
阿里云 Qwen 3.6 Plus 限免,主打“智能体原生”
阿里云宣布 Qwen 3.6 Plus 在 Nous Portal 上限时免费,并称其为“AI 未来原生智能体”。合作方是 Hermes Agent 和 NousResearch 社区。正文没披露免费期多久、模型参数量、免费结束后定价多少、以及使用有无限制。
#Agent#Alibaba Cloud#NousResearch#Hermes Agent
一句话点评
阿里云把 Qwen 3.6 Plus 放到 Nous Portal 上限免,合作方是 Hermes Agent 和 NousResearch 社区。正文没披露免费期多久、模型参数量、免费结束后定价多少、以及使用有无限制。短评:限免拉新,但关键信息全缺,先别激动。
HKR 分解
hook knowledge resonance
打开信源
38
SCORE
H1·K0·R1
00:29
76d ago
AI HOT 精选· aihot-apiZH00:29 · 05·13
Telegram 里点几下就能跑 AI 智能体,不用注册也不用花钱
Browser Use 新项目 BuxFather,直接在 Telegram 里启动 AI agent,点几下就给一个完整电脑加浏览器环境,24/7 自己跑还能自己改进。关键是不需要注册、不需要付费,对重度 Telegram 用户来说很方便。正文没披露具体能跑什么任务、有没有使用限制,但即开即用这个思路挺省事。
#Agent#Tools#Browser Use#BuxFather
一句话点评
Browser Use 搞了个 BuxFather,在 Telegram 里点几下就能启动一个带浏览器的完整电脑环境,AI agent 24/7 自己跑还能自我改进。关键是不用注册、不用付费,对重度 Telegram 用户来说确实方便。但正文没披露具体能跑什么任务、有没有使用限制,这点先别太激动。即开即用这个思路挺省事,但实际能干啥还得看后续。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
00:04
76d ago
r/LocalLLaMA· rssEN00:04 · 05·13
用 H200 花几美元微调 TranslateGemma-4B,让英语和威尔士语双向翻译更好
作者开源了一个微调 TranslateGemma-4B 的仓库,专门优化英语和威尔士语的双向翻译。只跑了 5% 的训练量,在 H200 上花了 40 分钟、几美元成本,用来验证流程能跑通。正文没披露用了多少数据,也没给 BLEU 或 COMET 分数,所以效果到底多好还不清楚。作者还在等 Flash Attention v4 出正式版,打算之后上 B2...
#Fine-tuning#TranslateGemma#NVIDIA#Open source
一句话点评
有人用 H200 花了 40 分钟、几美元微调 TranslateGemma-4B 做英语-威尔士语双向翻译,只跑了 5% 的训练量,主要是验证流程能跑通。成本确实低,但正文没披露用了多少数据,也没给 BLEU 或 COMET 分数,效果到底多好还不清楚。作者还在等 Flash Attention v4 正式版,打算之后上 B200 云实例跑完整训练。这点先别太激动,目前更像一个可复现的 d...
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R0
00:00
76d ago
Computing Life · Share · 鸭哥调研· rssZH00:00 · 05·13
AI 行业在找一个新指标:从“烧了多少 token”转向“干成了多少事”
Salesforce 和百度几乎同时推出了新的 Agent 计费指标,前者叫 AWU(数完成的任务数),后者叫 DAA(数活跃的 agent 数)。核心逻辑是把衡量标准从“消耗了多少算力”换成“完成了多少产出”。文章指出,用 token 当指标会激励平台让用户多烧 token,而新指标会倒逼平台帮用户省 token、快完成任务。两个方案都还粗糙,没有第...
#Agent#Salesforce#Baidu#Commentary
一句话点评
Salesforce和百度几乎同时推出新计费指标,核心逻辑是把衡量标准从“消耗了多少算力”换成“完成了多少产出”。文章指出,用token当指标会激励平台让用户多烧token,而新指标会倒逼平台帮用户省token、快完成任务。两个方案都还粗糙,没有第三方审计,百度方案更像叙事工具。但方向对了:指标换了,激励就换了。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
00:00
76d ago
AI HOT 精选· aihot-apiZH00:00 · 05·13
每天121封邮件,AI帮你筛到只剩6封
风投人Tom Tunguz预测,五年内没人会一天打开五次Gmail。现在知识工作者日均收121封邮件,相当于工作时段每4分钟一封。AI处理方案用自然语言规则+个人邮件历史做上下文,敏感数据走本地模型,收据自动转发报销、销售线索自动进CRM并生成草稿。最终收件箱消失,只剩真正重要的6条消息。正文没披露具体产品名或实测延迟,但思路很直接:把邮件处理从手动分...
#Agent#Tools#Memory#Tom Tunguz
一句话点评
风投人Tom Tunguz预测五年内没人一天开五次Gmail。现在知识工作者日均收121封邮件,相当于工作时段每4分钟一封。AI方案用自然语言写规则+个人邮件历史做上下文,敏感数据走本地模型,收据自动转发报销、销售线索自动进CRM并生成草稿。最终收件箱消失,只剩6条真正重要的消息。正文没披露具体产品名或实测延迟,但思路很直接:把邮件处理从手动分拣变成个人AI助理。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1

更多

频道

后台