ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-29

16 items · updated 3m ago
RSS live
2026-05-29 · 星期五2026年5月29日
02:12
60d ago
r/LocalLLaMA· rssEN02:12 · 05·29
Reddit 用户曝光:有人 fork 你的项目改个名就当自己的发
Reddit 用户 Glittering_Focus1538 发帖指控 u/Worried_Goat_8604 两天前把他的 SmallCode 项目低质量 fork 后,改名为 LightAgent 当作独立项目发布。帖子附了两个 GitHub 链接,但没有对比 commit 差异,也没提许可证条款,所以到底算不算抄袭、有没有违反开源协议,正文里没给...
#Code#Agent#Reddit#SmallCode
一句话点评
Reddit 上有人指控两天前自己的 SmallCode 项目被低质量 fork 后改名 LightAgent 当新项目发。帖子只贴了链接,没对比 commit 差异,也没提许可证,所以算不算抄袭、有没有违反协议,正文没给证据。开源圈常见纠纷,但信息不全,先别急着站队。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
00:45
60d ago
AI HOT 精选· aihot-apiZH00:45 · 05·29
三星抢先出样 HBM4E 内存,单堆栈 48GB、带宽 3.6 TB/s
三星宣布向主要客户交付业界首批 12 层 HBM4E 样品,单堆栈容量 48GB,引脚速度 14Gbps(可扩至 16Gbps),带宽 3.6 TB/s,比 HBM4 再提升 20%。能效和散热也分别改善了 16% 和 14%。不过正文没披露具体客户是谁、量产时间表,以及样品是否已通过验证——所以“业界首批”更多是抢发布节奏,离真正落地还有距离。
#Samsung Electronics#Product update
一句话点评
三星抢发HBM4E样品,单堆栈48GB、带宽3.6 TB/s,比HBM4再提20%,能效和散热也改善了。但正文没披露客户是谁、量产时间,样品是否通过验证也不清楚——所以“业界首批”更多是抢发布节奏,离落地还有距离。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
00:09
60d ago
Hacker News 首页· rssEN00:09 · 05·29
神秘模型 Hy3 冲上 OpenRouter 榜首,腾讯出品,便宜是最大原因
OpenRouter 排行榜上突然冒出两个新模型,其中 Hy3 preview 的 token 用量甚至超过了 Claude 50% 以上。作者查了一圈发现,这是腾讯开源的模型,在 Hugging Face 上公开的基准测试成绩其实一般,远不如 Claude Opus 4.7 或 GPT 5.5。那为什么这么多人用?核心原因就是便宜:Hy3 输入价格是...
#Benchmarking#OpenRouter#Hy3#Benchmark
一句话点评
腾讯开源模型 Hy3 preview 在 OpenRouter 上 token 用量超 Claude 50% 以上,但 Hugging Face 公开的基准测试成绩一般,远不如 Claude Opus 4.7 或 GPT 5.5。核心原因就是便宜:输入价格仅 $0.066/百万 token,比 DeepSeek V4 Flash 还低。不过正文没披露具体评测机制和排名差距,用户量是否真实也存...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
00:08
60d ago
r/LocalLLaMA· rssEN00:08 · 05·29
把 Lance 模型塞进 RTX 2080 Ti 22GB,单卡双卡都跑通了
有人在老卡 RTX 2080 Ti(22GB)上硬跑 Lance 模型,单卡能跑,双卡拼 44GB 显存还能用流水线并行和张量并行。关键优化是用了 Turing 架构专属的 kernel 和对齐量化,让老卡也能撑住大模型推理。正文没披露具体加速比和精度损失,但至少证明 2080 Ti 这种老卡还没被淘汰,双卡方案对显存不够的人是个低成本选择。
#Inference-opt#Lance#NVIDIA#Known_Ice9380
一句话点评
有人在 RTX 2080 Ti(22GB)上硬跑 Lance 模型,单卡能跑,双卡拼 44GB 显存还能用流水线并行和张量并行。关键优化是用了 Turing 架构专属的 kernel 和对齐量化,让老卡也能撑住大模型推理。正文没披露具体加速比和精度损失,但至少证明 2080 Ti 这种老卡还没被淘汰,双卡方案对显存不够的人是个低成本选择。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
00:07
60d ago
AI HOT 精选· aihot-apiZH00:07 · 05·29
阶跃星辰发布 198B 多模态模型 Step 3.7 Flash,英伟达说能跑在企业级 GPU 上
阶跃星辰(StepFun)的 Step 3.7 Flash 是一个 1980 亿参数的 MoE 多模态模型,每次推理只激活约 110 亿参数,所以虽然模型很大但实际算力消耗不算离谱。它支持图片、视频和文字输入,上下文窗口 256K,还提供了低、中、高三档推理深度可选。英伟达官方博客说这个模型可以在他们的 GPU 上跑,也支持 SGLang、Tensor...
#Multimodal#Vision#StepFun#NVIDIA
一句话点评
阶跃星辰的 Step 3.7 Flash,1980 亿参数 MoE 模型,每次推理只激活约 110 亿参数,所以虽然模型大但实际算力消耗不算离谱。支持图片、视频和文字输入,上下文 256K,还提供低、中、高三档推理深度可选。英伟达官方博客说可以在他们的 GPU 上跑,也支持 SGLang、TensorRT-LLM 等框架。但正文没披露跑一次需要多少张卡、延迟多少,也没给任何基准测试分数。对于...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R0
00:00
60d ago
OpenAI 博客· rssEN00:00 · 05·29
OpenAI 发布第三方评估指南:怎么测、测什么、结果能不能信
OpenAI 发了一篇指南,教第三方怎么评估前沿模型的能力和安全防护。核心观点是:现在的模型已经不是一问一答的聊天机器人了,它们会用工具、能多步推理、还能嵌入业务流程,所以评估方式也得跟着变。指南把评估目标分成三类——测能力、测防护、测对比——并强调评估报告必须说清楚两件事:你测的是什么,以及你的结果有没有被污染、被钻空子、被模型故意装傻等因素干扰。正...
#Benchmarking#Safety#OpenAI#Policy
一句话点评
OpenAI 发了一份第三方评估指南,核心是说现在的模型会调用工具、多步推理,不能再用老式一问一答来测了。指南把评估目标分成三类:测能力、测防护、测对比,还列出了五种可能污染结果的因素(比如奖励黑客、拒绝回答、数据泄露、任务无效、故意装傻)。正文没披露具体评估流程、指标、参与方或覆盖哪些模型,所以这份指南更像一个方法论框架,不是实操手册。对从业者来说,价值在于它系统性地提醒了评估设计中的坑,...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
00:00
60d ago
AI HOT 精选· aihot-apiZH00:00 · 05·29
OpenAI 发布第三方评估操作手册:重点讲怎么测前沿模型才靠谱
OpenAI 发了一篇指南,讲第三方怎么评估前沿模型的安全和能力。核心观点是:现在模型已经不是一问一答的聊天机器人了,它们会用工具、能多步推理、还能在业务流程里干活(agent workflow),所以评估方式也得跟着变。手册把评估要测的东西分成三类:能力到底能不能跑出来、安全护栏扛不扛打、不同模型放一起比谁强。还列了几个容易让结果不准的坑:奖励黑客(...
#Safety#Benchmarking#OpenAI#Policy
一句话点评
OpenAI 发了一份第三方评估指南,核心是说现在的模型已经不是聊天机器人了,它们会用工具、能多步推理、还能在业务流程里干活(agent workflow),所以评估方式也得跟着变。指南把评估要测的东西分成三类:能力到底能不能跑出来、安全护栏扛不扛打、不同模型放一起比谁强。还列了几个容易让结果不准的坑:奖励黑客(模型钻任务漏洞拿高分)、拒绝回答、数据污染、任务本身有问题、故意放水。但全文没披...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
00:00
60d ago
AI HOT 精选· aihot-apiZH00:00 · 05·29
PyTorch 性能分析入门:torch.profiler 怎么用
Hugging Face 发了一篇 torch.profiler 的入门教程,教你怎么用它找训练和推理的瓶颈。正文没给完整代码和可复现的指标,所以没法直接抄来跑。但目录里列了矩阵乘法、torch.compile 融合算子、CPU 与 GPU 时间线对比这些常见场景,适合刚想上手看性能火焰图的人。
#Inference-opt#Tools#Hugging Face#PyTorch
一句话点评
torch.profiler 入门教程,教你看训练推理的火焰图找瓶颈。正文没给完整代码和可复现指标,没法直接抄来跑。但目录列了矩阵乘法、torch.compile 融合算子、CPU/GPU 时间线对比等常见场景,适合刚想上手的人。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K0·R1

更多

频道

后台