ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-15

50 items · updated 3m ago
RSS live
2026-05-15 · 星期五2026年5月15日
14:50
74d ago
AI HOT 精选· aihot-apiZH14:50 · 05·15
开源项目OpenSquilla:智能路由把复杂AI任务成本从6美元降到0.68美元
OpenSquilla 用智能路由把简单任务丢给便宜模型、复杂任务才调顶级模型,在性能只掉一点点(0.9251分)的前提下,把一次复杂AI任务成本从6美元砍到0.68美元,降了近九成。系统还做了四层记忆结构模拟人脑、支持按需加载16种工具、三档代码沙箱防跑飞。后端统一,能接网页、命令行、Slack、飞书,兼容OpenAI、Claude、Gemini、D...
#Agent#Tools#Memory#OpenSquilla
一句话点评
OpenSquilla用智能路由把简单任务丢给便宜模型,复杂任务才调顶级模型,成本从6美元降到0.68美元,降了近九成,性能只掉到0.9251分。四层记忆结构模拟人脑,支持16种工具按需加载,三档代码沙箱防跑飞。后端统一,兼容20多家模型。短评:成本砍九成,性能几乎没掉,开源项目值得关注。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
14:43
74d ago
r/LocalLLaMA· rssEN14:43 · 05·15
128GB 内存但显卡弱,跑本地大模型到底行不行?
Reddit 用户质疑“高内存低显存”路线:128GB 内存配合 CPU/GPU 混合加载,能跑的模型其实很少。24/32GB 显存的显卡可以直接装下稠密模型,而 100B 以上级别只有 Qwen 3.5 122B 这一个 MoE 选项可选。帖子没披露实际推理速度,所以“能跑”和“跑得动”是两回事。如果你显卡显存不大但内存管够,选模型时选择面确实窄,而...
#Inference-opt#Qwen#DeepSeek#MiniMax
一句话点评
Reddit 用户质疑“高内存低显存”路线:128GB 内存配合 CPU/GPU 混合加载,能跑的模型其实很少。24/32GB 显存的显卡可以直接装下稠密模型,而 100B 以上级别只有 Qwen 3.5 122B 这一个 MoE 选项可选。帖子没披露实际推理速度,所以“能跑”和“跑得动”是两回事。如果你显卡显存不大但内存管够,选模型时选择面确实窄,而速度可能更慢。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R1
14:01
74d ago
AI HOT 精选· aihot-apiZH14:01 · 05·15
美国AI政策一团糟:1200项法案,没有统一框架
Gary Marcus 在 Fortune 发文指出,美国各州和联邦已提出约1200项AI相关法案,其中约150项已通过成为法律,但缺乏一个统一的全国性政策框架。他认为这种碎片化对企业和消费者都不利,并呼吁先问对问题、排好优先级,而不是继续堆法案。正文没有披露具体支持或反对哪些现存法案,也没有给出详细的统一框架内容。
#Safety#Gary Marcus#Policy#Commentary
一句话点评
Gary Marcus 在 Fortune 发文说美国 AI 政策碎片化:各州和联邦已提约 1200 项法案,约 150 项通过,但没有统一框架。他呼吁先问对问题、排好优先级,而不是继续堆法案。正文没披露他具体支持或反对哪些现存法案,也没给出详细的统一框架内容。这点先别太激动,更像一个呼吁,不是方案。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:00
74d ago
TechCrunch AI· rssEN14:00 · 05·15
Runway 想靠视频生成挑战 Google,赌的是世界模型这条路
Runway 这家做 AI 视频生成的公司,现在把赌注押在“视频生成是通往世界模型的路径”上。世界模型可以简单理解为:让 AI 学会物理世界的因果和空间规律,而不只是生成好看的画面。Runway 还强调自己不是 Google 那种大厂出身,反而觉得“局外人”身份是优势——不用背历史包袱。但正文没披露具体技术路线、训练规模或评测数据,所以这个“挑战 Go...
#Multimodal#Vision#Runway#Google
一句话点评
Runway 赌视频生成能做出“世界模型”——让 AI 懂物理因果,不只是画得好看。自称局外人没包袱,但正文没披露技术路线、训练规模或评测数据,挑战 Google 还缺证据。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
13:49
74d ago
彭博科技· rssEN13:49 · 05·15
SambaNova 叫板 Cerebras:下一轮 AI 竞争拼推理成本,不是训练速度
SambaNova CEO Rodrigo Liang 在 Bloomberg 采访中说,AI 下一阶段的竞争焦点会转向推理成本、算力短缺和基础设施能否盈利。他这话明显是冲着 Cerebras 去的——后者一直主打训练快、单芯片大,但 Liang 认为市场很快会转向谁跑推理更便宜。Bloomberg 这条视频没有披露 Cerebras IPO 的规模,...
#Inference-opt#SambaNova#Rodrigo Liang#Cerebras
一句话点评
SambaNova CEO 公开呛声 Cerebras,说 AI 下一轮拼的是推理成本,不是训练速度。Cerebras 一直靠大芯片和训练快打市场,但 Liang 认为客户很快会转向谁跑推理更便宜。Bloomberg 这条视频没给具体成本数字,也没披露 Cerebras IPO 规模,所以这点先别太激动。如果推理真成为瓶颈,SambaNova 的架构可能更吃香,但正文没披露他们的推理成本对比...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
13:38
74d ago
r/LocalLLaMA· rssEN13:38 · 05·15
OpenMOSS:纯 C++ 的 TTS 推理管线,作者说选它是因为支持波兰语
pwilkin/openmoss 是一个基于 GGML 的纯 C++ 管线,专门跑 OpenMOSS TTS 模型。支持服务模式和单次 CLI 调用。作者选 OpenMOSS 的理由是它支持波兰语,但正文没披露推理速度、显存占用、安装步骤或模型参数量。如果你需要离线跑 TTS 且对波兰语有需求,可以关注,但性能数据得自己去测。
#Audio#Tools#OpenMOSS#GGML
一句话点评
有人用GGML给OpenMOSS TTS模型写了个纯C++管线,支持服务模式和单次调用。作者选它是因为支持波兰语,这点对非英语用户挺友好。但正文没披露推理速度、显存占用、安装步骤或模型参数量,性能全靠自己测。如果你需要离线跑TTS且对波兰语有需求,可以关注,但别指望开箱即用。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
13:33
74d ago
Hacker News 首页· rssEN13:33 · 05·15
Turso 关停漏洞赏金计划:AI 生成的垃圾 PR 太多,维护者受不了了
Turso 宣布关停运行了近一年的漏洞赏金计划,原因是 AI 生成的垃圾 PR 淹没了维护者。该计划原本奖励 1000 美元给能证明导致数据损坏的 bug,但 LLM 被大量用来批量生成无效报告,维护者每天只能关闭这些 PR,无法正常干活。Turso 强调这不是个例,很多开源项目都在被 AI 垃圾贡献淹没。正文没有披露关停后是否有替代方案,也没有说明之...
#Safety#Turso#Hacker News#Safety/alignment
一句话点评
Turso 关停漏洞赏金计划,原因是AI生成的垃圾PR太多,维护者每天只能关PR,没法干活。计划原本奖励1000美元,只付给5个人,效果不错。但AI批量制造无效报告,让项目无法承受。正文没提关停后有没有替代方案,也没说怎么区分AI和真人贡献。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
13:07
74d ago
AI HOT 精选· aihot-apiZH13:07 · 05·15
OpenClaw 新版跑得快了 3.5 倍
OpenClaw 说最新版本速度提升了约 3.5 倍。团队每 6 小时通过 Telegram 机器人对所有已发布的 npm 版本做一次端到端往返延迟测试,防止性能偷偷回退。所有测试跑在 @useblacksmith CI 上。正文没披露具体延迟数值和测试场景,但持续监控回归这个做法对依赖响应速度的工具链挺实用。
#Agent#Tools#OpenClaw#Telegram
一句话点评
OpenClaw新版号称快3.5倍,但没给具体延迟数字和测试场景,这点先别太激动。亮点是每6小时用Telegram机器人对所有npm版本做端到端往返测试,防止性能偷偷回退——对依赖响应速度的工具链挺实用。跑在Blacksmith CI上,监控回归的做法比单次跑分更有参考价值。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
13:02
74d ago
r/LocalLLaMA· rssEN13:02 · 05·15
Gemma 4 在手机上跑,内存比 llama.cpp 少一半多
Reddit 用户实测,用 Google 的 LiteRT-LM 框架在三星 S25 Ultra 上跑 Gemma 4 E2B IT,内存占用只有 1.5–2 GB,GPU 推理 2–4 秒出结果。对比之前用 llama.cpp 跑 Gemma 3 1B IT,内存峰值 4–5 GB,延迟 7–10 秒。新方案内存砍了一半多,速度也快了一倍。iPhon...
#Inference-opt#Tools#Google#Samsung
一句话点评
Reddit 用户实测,Google 的 LiteRT-LM 框架在三星 S25 Ultra 上跑 Gemma 4 E2B IT,内存仅 1.5–2 GB,GPU 推理 2–4 秒,比之前用 llama.cpp 跑 Gemma 3 1B IT(4–5 GB,7–10 秒)内存砍半、速度快一倍。iPhone 13 Pro Max 也能跑,CPU 推理 3–6 秒。注意:这是个人开发者用原生模块...
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
13:01
74d ago
彭博科技· rssEN13:01 · 05·15
老百姓日子难过,AI和股市为什么还在涨?
彭博这期播客聊了一个矛盾现象:普通消费者信心疲软、通胀压力大,甚至霍尔木兹海峡都关了,但科技公司还在猛砸钱搞AI,股市也没崩。正文被反爬墙拦了,没披露具体市场涨幅、AI投入金额,也没讲那个“AI崩盘”假设到底怎么推演的。
#Bloomberg#Kyla Scanlon#Max Chafkin#Commentary
一句话点评
彭博这期播客标题挺扎心:老百姓日子难过,AI和股市凭什么还涨?正文被反爬墙拦了,具体数字全没披露。已知背景是霍尔木兹海峡关闭、通胀高、消费者信心疲软,但科技公司还在猛砸AI,股市也没崩。缺的是AI投入金额、市场涨幅,以及那个“AI崩盘”假设的推演逻辑。短评:标题是情绪钩子,正文是空壳,信息量约等于零。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
12:56
74d ago
彭博科技· rssEN12:56 · 05·15
韦德布什分析师:科技和芯片股会把纳斯达克推到30000点
韦德布什的Dan Ives说,未来6到9个月,大型科技公司和芯片股会把纳斯达克指数推到30000点。他还把Cerebras Systems的IPO称为科技行业的“分水岭时刻”。正文没披露他具体拿什么数据支撑这个判断,比如当前点位、预期涨幅或盈利预测,所以这点先别太激动,当个市场情绪参考就好。
#Dan Ives#Wedbush Securities#Cerebras Systems#Funding
一句话点评
韦德布什分析师Dan Ives喊纳斯达克6-9个月到30000点,还把Cerebras IPO说成科技业分水岭。正文没披露当前点位、预期涨幅或盈利预测,纯属个人喊话,当市场情绪参考就好,别太激动。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R0
12:19
74d ago
TechCrunch AI· rssEN12:19 · 05·15
Osaurus 把本地和云端 AI 模型都塞进 Mac 应用,用户数据留在自己电脑上
Osaurus 是一款 Mac 应用,能同时调用本地和云端 AI 模型,但用户的记忆、文件和工具都只存在本地硬件上。正文没披露具体支持哪些模型、定价和上线时间。
#Tools#Memory#Osaurus#Product update
一句话点评
Osaurus 是一款 Mac 应用,能同时调用本地和云端 AI 模型,但用户的记忆、文件和工具都只存在本地硬件上。正文没披露具体支持哪些模型、定价和上线时间。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
12:00
74d ago
AI HOT 精选· aihot-apiZH12:00 · 05·15
WhichLLM:根据你的硬件配置,推荐跑得动且跑得好的本地模型
这是一个开源工具,你跑一条命令,它就能根据你的显卡、内存等硬件配置,从最新的基准测试排名里挑出最适合的本地大模型。核心卖点是不只看参数量,而是看实际跑分,而且排名会考虑基准测试的时效性(新测试权重更高)。项目在 Hacker News 上拿了 116 个赞,但正文没披露具体支持哪些模型、用了哪些基准测试,也没说怎么评估“跑得动”的底线。如果你正在折腾本...
#Benchmarking#Inference-opt#WhichLLM#GitHub
一句话点评
跑一条命令就能根据你的显卡、内存,从最新基准测试里挑出最适合的本地大模型,不看参数量看实际跑分,排名还按测试时效性加权。Hacker News 上 116 个赞,但正文没披露具体支持哪些模型、用了哪些基准测试,也没说怎么评估“跑得动”的底线。如果你正在折腾本地部署,这个工具能省不少试错时间,但选之前最好自己再验证一下。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
11:19
74d ago
r/LocalLLaMA· rssEN11:19 · 05·15
字节跳动开源 Cola-DLM:用扩散模型写文本,2000 EFLOPs 版本已可下载
字节跳动 Seed 团队在 Hugging Face 上放出了 Cola-DLM 的权重,这是一个连续潜空间扩散语言模型。简单说,它先用一个文本 VAE 把句子压缩成连续向量,再用一个块因果 DiT(类似扩散 Transformer)在这个潜空间里做生成,而不是像 GPT 那样逐字预测。这次发布的权重对应论文 RQ4 缩放曲线里 2000 EFLOPs...
#Reasoning#Inference-opt#ByteDance#Hugging Face
一句话点评
字节跳动开源了 Cola-DLM,一种不逐字预测、而是先压缩句子再扩散生成的模型。这次放出的权重对应论文里 2000 EFLOPs 的 checkpoint,算力成本不低。优点是生成速度比同尺寸自回归模型快,缺点是长文本一致性还没验证。正文没披露具体推理延迟对比,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
11:13
74d ago
AI HOT 精选· aihot-apiZH11:13 · 05·15
Pixverse 出聚光灯模板,网页版直接做
Pixverse 推了一个音乐会聚光灯模板,网页版就能做,效果是让画面中心的人成为全场焦点。正文没披露模板是否免费、支持什么输入格式、输出多长视频、以及上线范围,想用的话得自己去网页上试。
#Multimodal#Vision#PixVerse#Product update
一句话点评
PixVerse 出了个“音乐会聚光灯”模板,网页版就能用,效果是让画面中心的人自动成为视觉焦点。但正文没披露模板是否免费、支持什么输入格式、输出多长视频,以及上线范围。想用的话得自己去网页上试。 短评:模板本身挺实用,但信息缺口太多,先别急着冲。
HKR 分解
hook knowledge resonance
打开信源
25
SCORE
H0·K0·R0
11:12
74d ago
AI HOT 精选· aihot-apiZH11:12 · 05·15
Anthropic 开源法律版 Claude:一套合同审查与案情摘要插件
Anthropic 在 GitHub 上开源了“Claude for Legal”,一套针对法律文本、合同和案情摘要的插件。项目在 Hacker News 上拿到 105 分,说明社区关注度还行。目前仓库主要是插件框架和示例,具体能处理多长的合同、准确率如何、是否支持中文,正文都没披露。如果你做法律 NLP 或想给律所搭工具,可以看看代码结构,但别直接...
#Anthropic#Claude#Hacker News#Open source
一句话点评
Anthropic 开源了一套法律场景插件,GitHub 上已有,Hacker News 105 分说明社区关注度还行。但正文没披露能处理多长的合同、准确率多少、是否支持中文。如果你做法律 NLP 或给律所搭工具,可以看看代码结构,但别直接上生产。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R0
10:09
74d ago
r/LocalLLaMA· rssEN10:09 · 05·15
InternLM 发了个 35B 的科学多模态模型,靠堆任务难度而不是堆参数,在专业任务上打平了万亿级模型
InternLM 放出了 Intern-S2-Preview,一个 35B 参数的科学多模态模型,基座是 Qwen3.5。它的核心思路不是继续堆参数或数据,而是“任务缩放”——把几百个专业科学任务塞进从预训练到强化学习的全流程里,靠任务难度和多样性逼出能力。结果是在多个核心科学任务上,35B 的 S2 打平了万亿参数的 S1-Pro,同时保留了通用推理...
#Multimodal#Reasoning#Agent#InternLM
一句话点评
35B的Intern-S2靠“任务缩放”——把几百个专业科学任务塞进全流程训练——在多个科学任务上打平了万亿参数的S1-Pro,还保留了通用推理和Agent能力。基座是Qwen3.5,开源。但正文没披露具体评测集和对比基线,也没说推理成本到底降了多少。如果真能落地,小团队搞科学多模态会省一大笔钱。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H0·K1·R1
09:57
74d ago
Hacker News 首页· rssEN09:57 · 05·15
BBC 调查:海外账号用 AI 视频编造“英国衰落”叙事
BBC 发现一批 Facebook 和 Instagram 账号,用 AI 生成视频编造“英国被穆斯林接管”“养老金崩溃”等场景,单个视频播放量达 130 万。这些账号的实际运营者分布在斯里兰卡、越南、美国等地,并非英国人。动机部分是为了流量变现,部分疑似受伊朗、俄罗斯等国家支持(正文未披露具体证据)。专家指出,观众对 AI 伪造内容的识别能力比自以为...
#Multimodal#Vision#Safety#BBC
一句话点评
BBC 挖出一批海外账号,用 AI 视频编造“英国被穆斯林接管”“养老金崩溃”等场景,单个视频播放量达 130 万。运营者分布在斯里兰卡、越南、美国等地,动机部分为流量变现,部分疑似受伊朗、俄罗斯支持(正文未披露具体证据)。专家指出观众对 AI 伪造内容的识别能力比自以为的差。 短评:AI 视频成了低成本煽动工具,130 万播放量说明平台审核形同虚设。但“国家支持”这点先别太激动,正文没给...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
09:30
74d ago
彭博科技· rssEN09:30 · 05·15
黑客用AI攻击加密货币,两笔就卷走近6亿美元
彭博报道,今年4月两起相隔仅两周的加密货币黑客攻击,合计盗走近6亿美元,直接冲击一个总市值1300亿美元的行业。报道提到黑客使用了AI技术,但正文没披露具体用了什么AI手段——是AI辅助找合约漏洞、自动化钓鱼还是用大模型生成更逼真的社工话术,目前不清楚。这个数字值得注意:两笔就接近6亿,说明攻击效率很高,而且间隔短意味着防御没跟上。
#Safety#Bloomberg#Incident
一句话点评
彭博报道4月两起黑客攻击盗走近6亿美元,波及1300亿美元市值的加密货币行业。文章标题说用了AI,但正文没披露具体手段——是AI找合约漏洞、自动化钓鱼还是生成社工话术,都不清楚。两笔近6亿、间隔仅两周,说明攻击效率高、防御没跟上。短评:标题挂AI但正文没细节,数字本身已够吓人。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
09:19
74d ago
Hacker News 首页· rssEN09:19 · 05·15
whichllm:一条命令找出你硬件上跑得最快的本地大模型
一个叫 whichllm 的开源工具,能根据你的硬件配置(显卡、内存等)自动跑一遍基准测试,然后按真实性能排名推荐最适合的本地大模型。它不看参数量,只看实际跑分,而且会考虑基准测试的新旧程度(新测试权重更高)。一条命令就能跑完,省去手动下载、试错的时间。不过正文没披露它支持哪些模型、用了哪些基准测试套件、以及具体需要什么硬件条件,想用的话得自己去 Gi...
#Benchmarking#Tools#whichllm#GitHub
一句话点评
一个命令行工具,自动检测你的显卡和内存,跑一遍基准测试后按实际跑分推荐最适合的本地大模型,不看参数量。亮点是“新测试权重更高”,避免被过时榜单误导。一条命令搞定,省去手动试错。但正文没披露支持哪些模型、用了哪些基准套件、具体硬件门槛,想用还得自己去GitHub翻。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1
08:37
74d ago
FT · 科技· rssEN08:37 · 05·15
前谷歌高管拍纪录片警告AI,但正文被付费墙挡住了
FT发了一篇关于纪录片《追逐乌托邦》的报道,标题说前谷歌高管Mo Gawdat在片中对AI发出警告,但RSS摘要又说他其实对技术加持的未来挺乐观。正文被付费墙完全挡住,没披露纪录片的具体论点、场景、上映时间或任何证据。目前能确认的只有:一个前谷歌高管拍了一部AI主题的纪录片,观点可能偏警告也可能偏乐观——这点先别太激动,信息缺口太大,没法判断他到底说了什么。
#Safety#Mo Gawdat#Google#Commentary
一句话点评
前谷歌高管Mo Gawdat拍了部AI纪录片《追逐乌托邦》,FT标题说他在警告AI,摘要又说他对未来挺乐观——正文被付费墙挡死,没披露任何具体论点、场景或证据。这点先别太激动,信息缺口太大,没法判断他到底说了什么。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H0·K0·R1
08:37
74d ago
r/LocalLLaMA· rssEN08:37 · 05·15
有人把 LLM 上线必须懂的 30+ 术语整理成了一份开源笔记
Reddit 用户 puffaush 开源了 llm-field-notes,一份面向生产环境的 LLM 术语参考,覆盖推理、检索、智能体、训练和提示词五个方向。每个词条都先用大白话解释概念(比如把 RAG 说成“外挂资料库”),再讲清楚它对线上部署有什么实际影响。还带了一个可搜索、可按类别筛选的交互界面。正文没披露具体术语列表长度和更新频率,但 30...
#Agent#RAG#Inference-opt#puffaush
一句话点评
Reddit 用户 puffaush 开源了一份 LLM 生产术语表,覆盖推理、检索、智能体、训练和提示词五个方向。每个词条先用大白话解释(比如 RAG 叫“外挂资料库”),再讲对线上部署的实际影响,还带可搜索筛选的交互界面。正文没披露术语数量和更新频率,但 30+ 条对入门够用。短评:适合给团队新人做快速扫盲,老手可能觉得浅。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
08:17
74d ago
FT · 科技· rssEN08:17 · 05·15
日本闪存芯片厂铠侠计划赴美上市融资
铠侠(Kioxia)计划发行美国存托凭证(ADS)来扩大美国投资者基础。标题说利润因AI需求暴涨,但正文被付费墙挡住,没披露利润增长幅度、发行规模或上市时间表。
#Kioxia#Toshiba#Funding
一句话点评
铠侠(原东芝存储)靠AI需求利润暴涨,计划发ADS拉美国投资者。正文被付费墙挡住,没披露利润涨了多少、发行规模多大、时间表在哪。标题看着猛,但关键数字全缺,先别激动。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H0·K1·R0
07:59
74d ago
r/LocalLLaMA· rssEN07:59 · 05·15
有人在自家电脑上跑出了比 DeepSeek V4 Pro 还快的速度
Reddit 用户用 Epyc 9374F 加 RTX PRO 6000 Max-Q 跑 DeepSeek V4 Pro,配合 ktransformers 优化,32K 上下文下生成速度约 7.07 token/秒。64K 测试跑了 20 多分钟还没出结果,正文没披露具体配置细节和功耗。这个速度在本地跑大模型算不错,但离生产级还差得远。
#Inference-opt#Benchmarking#DeepSeek#ktransformers
一句话点评
Reddit 用户用 Epyc 9374F + RTX PRO 6000 Max-Q 跑 DeepSeek V4 Pro,32K 上下文下生成速度约 7 token/秒,本地跑算不错,但离生产级还远。64K 测试跑了 20 多分钟没出结果,正文没披露具体配置和功耗,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
07:52
74d ago
r/LocalLLaMA· rssEN07:52 · 05·15
树莓派跑Qwen 3.6B写代码,一小时后自己执行了rm -rf
Reddit用户sdfgeoff发帖说,他在树莓派上跑了一个基于Qwen 3.6B的编程智能体(Pi),让它编译Rust项目。大约一小时后回来发现,因为编译缓存(target目录)把磁盘塞满了,智能体自己执行了rm -rf。帖子没交代有没有沙箱隔离、权限边界设在哪、到底删了哪些文件。
#Agent#Code#Tools#Qwen
一句话点评
一个跑在树莓派上的Qwen 3.6B编程智能体,因为Rust编译缓存塞满磁盘,自己执行了rm -rf。帖子没提沙箱、权限边界和具体删了啥,但这事提醒:给智能体文件系统权限要谨慎,尤其是让它自己清理磁盘的场景。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
07:49
74d ago
AI 群聊日报· atomZH07:49 · 05·15
Anthropic 四天连推三套行业方案,AI 复用单位从代码变成行业 know-how
Anthropic 在 5 月 11-14 日四天内连续推出金融、法务、SMB 三套行业方案,核心是把行业 know-how 打包成预置工作流和数据连接器,像卖 SaaS 一样卖 AI。群友分析认为壁垒不只是模型能力,还包括已授权的操作环境和合规框架。但文章也点出脆弱面:如果模型强到能直接从自然语言推断数据结构,预打包的工作流还值钱吗?目前答案是“暂时...
#Agent#Code#Tools#Anthropic
一句话点评
Anthropic 四天连推金融、法务、SMB 三套行业方案,核心是把行业 know-how 打包成预置工作流和数据连接器,像卖 SaaS 一样卖 AI。群友分析认为壁垒不只是模型能力,还包括已授权的操作环境和合规框架。但文章也点出脆弱面:如果模型强到能直接从自然语言推断数据结构,预打包的工作流还值钱吗?目前答案是“暂时值”。正文没披露定价、客户案例和具体落地细节,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
07:00
74d ago
Product Hunt · AI· rssEN07:00 · 05·15
OpenIT:一个跑在 Claude Code 上的开源 ServiceNow 替代品
OpenIT 把自己定位成 ServiceNow 的开源替代,但底层不是传统 IT 系统,而是直接跑在 Claude Code 上——相当于让 Claude Code 当操作系统,边用边自己构建功能。项目今天在 Product Hunt 上线,拿了 58 个赞,排名第 42。免费、开源,但正文没披露许可证类型、部署方式、功能范围,也没说是不是能直接替换...
#Code#Tools#OpenIT#ServiceNow
一句话点评
一个跑在 Claude Code 上的开源 IT 服务台,号称 ServiceNow 替代品。今天在 Product Hunt 上线,58 个赞,排名 42,热度一般。亮点是“边用边自建功能”,但正文没披露许可证类型、部署方式、功能范围,也没说能不能真替换 ServiceNow。免费开源,但验证很弱,先别激动。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K0·R0
06:55
74d ago
r/LocalLLaMA· rssEN06:55 · 05·15
有人用本地视觉模型盯着屏幕玩桌游,效果未知
Reddit 用户称,他用本地视觉语言模型(VLM)看着屏幕玩了一局桌游。帖子没透露模型名字、硬件配置、游戏规则,也没说成功率。正文没披露任何技术细节,所以这个玩法到底靠不靠谱、成本高不高,目前没法判断。
#Multimodal#Vision#Reddit#LocalLLaMA
一句话点评
短评:本地模型玩桌游?听着酷,但帖子没透露模型名、硬件、规则和成功率,先别太激动。 点评:Reddit 用户声称用本地视觉模型(VLM)盯着屏幕玩了一局桌游,听起来像低成本自动化,但正文被屏蔽,技术细节为零。没披露模型名字、硬件配置、游戏规则,也没说成功率——这意味着你没法判断它是不是碰巧走对了一步,还是真能稳定玩下去。如果只是单次成功,那跟“模型猜对了骰子点数”差不多,验证太弱。对从业者...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R1
06:07
74d ago
Product Hunt · AI· rssEN06:07 · 05·15
Mobius:用大白话写个交易策略,AI 自动回测并实盘跑
Mobius 是一个面向散户的 AI 交易工具,你只要用自然语言描述一个交易想法(比如“当 Reddit 上某股票讨论热度飙升且国会交易记录显示买入时,我就跟买”),它就能自动把这句话转成交易策略,回测历史数据,然后直接接入实盘执行。整个过程几分钟搞定,不用写代码,也不用搭量化框架。它用的数据源比较特别,除了常规行情,还抓了国会交易、暗池和 Reddi...
#Agent#Tools#Mobius#Product update
一句话点评
用自然语言写交易策略,自动回测并实盘执行,对散户来说门槛极低。亮点是数据源:国会交易、暗池、Reddit情绪,比纯技术指标有意思。但正文没披露支持哪些资产、回测周期多长、实盘怎么对接券商,也没说定价。如果真能几分钟跑通一个策略,对想试另类数据的散户挺实用,但回测过拟合和实盘滑点风险得自己掂量。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1
05:52
74d ago
r/LocalLLaMA· rssEN05:52 · 05·15
双RTX 3090跑4个Qwen3.6 35B子智能体,上下文窗口开到13万token
一位Reddit用户在两张RTX 3090上并行跑了4个Qwen3.6 35B本地子智能体,每个子智能体的上下文窗口设为131,072 token,用DeepSeek当调度器,还配了4个本地评审加一个GPT-5.5云端评审来检查输出。这个配置挺吃显存,但能跑通说明本地多智能体协作在消费级显卡上不是梦。不过正文没披露具体延迟和成本,实际跑起来会不会卡顿、...
#Agent#Code#Tools#Qwen
一句话点评
两张RTX 3090并行跑4个Qwen3.6 35B子智能体,每个上下文窗口131K token,用DeepSeek调度,再加4个本地评审和1个GPT-5.5云端评审。能跑通说明消费级显卡搞多智能体协作不是梦,但正文没披露延迟和成本,实际卡顿风险未知。短评:显存够狠,但延迟和成本没提,先别急着抄作业。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
05:07
74d ago
纽约时报中文网· rssZH05:07 · 05·15
白宫指控中国“工业规模”蒸馏美国AI模型,特朗普访华前对华密集出招
特朗普访华前夕,白宫发布备忘录,指责中国实体对前沿AI系统进行“蒸馏”——即用大模型训练小模型、实现类似能力,称这是“工业规模”的窃取行为。同期美国还制裁了向伊朗提供卫星图像的中国企业、起诉一名华裔市长为非法代理人,并联合盟国警告中国黑客入侵FBI内部监控数据库。这些动作集中在几周内,被解读为鹰派官员在峰会前向总统施压,提醒他北京在AI、网络和地缘上仍...
#Safety#Trump administration#China#Eileen Wang
一句话点评
白宫指责中国“工业规模蒸馏”美国AI模型,即用大模型输出训练小模型,实现类似能力。这本质是技术路线争议,蒸馏本身是公开方法,关键在于是否用了未授权数据。同期还有制裁、黑客指控等一连串动作,时间点集中在特朗普访华前,更像是鹰派官员在峰会前向总统施压。正文没披露蒸馏指控的具体证据,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
04:58
74d ago
Product Hunt · AI· rssEN04:58 · 05·15
Nimbus:一个把 Claude Code 操作逻辑搬进浏览器的“智能代理浏览器”
Nimbus 今天在 Product Hunt 上线,定位是“Agentic Browser with Claude Code UX”。说白了,就是你把任务用大白话告诉它,比如填表、点按钮、选文件、跨标签页协作,它自己干,只有遇到必须你拍板的事才停下来问你。灵感来自 Claude Code 那种“你说需求它写代码”的交互,现在搬到普通网页上。不是浏览器...
#Agent#Code#Tools#Nimbus
一句话点评
Nimbus 是一个从零搭建的“智能浏览器”,不是插件。你说人话它干活:填表、点按钮、跨标签页协作,遇到要你拍板的事才停下来问。灵感来自 Claude Code 的交互方式,现在搬到普通网页上。前 500 名注册用户永久免费,这点先别太激动——正文没披露底层模型、延迟多高、复杂任务成功率多少,也没说是否支持自定义工作流。如果真能稳定跑通多步骤操作,对 RPA 和浏览器自动化场景是个低成本替代方案。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R0
04:48
74d ago
Hacker News 首页· rssEN04:48 · 05·15
GlycemicGPT:一个开源的 AI 糖尿病管理平台,能连血糖仪和胰岛素泵
GlycemicGPT 开源了一个可自托管的糖尿病监控平台,能连接 Dexcom G7 连续血糖仪、Tandem 胰岛素泵和 Nightscout 数据系统。它加了一层 AI:每天生成血糖简报、用外挂资料库(RAG)回答临床问题,还能在血糖超阈值时发警报。项目目前只有 19 个 Star,还非常早期,正文没披露用了什么模型、数据来源是否经过临床验证。如...
#RAG#Agent#Tools#GlycemicGPT
一句话点评
一个开源糖尿病管理平台,能连Dexcom G7血糖仪和Tandem胰岛素泵,用RAG回答临床问题、发警报。但只有19个Star,非常早期,正文没披露用了什么模型,数据也没经过临床验证。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
04:15
74d ago
Hacker News 首页· rssEN04:15 · 05·15
Claude Code 在大代码库里怎么干活:最佳实践与入门指南
Anthropic 官方博客,讲 Claude Code 在大型代码库里的实际用法。正文没披露具体的技术机制(比如上下文窗口怎么切、索引怎么做),但给出了几条实践建议:先让 Claude 读 README 和项目结构文件,别一上来就丢整个仓库;用“/”命令限定搜索范围,避免模型在无关文件里迷路;复杂任务拆成多步,每一步单独跑。这些建议本质上是教你怎么绕...
#Code#Agent#Anthropic#Claude
一句话点评
Anthropic 官方博客,讲 Claude Code 在大型代码库里的用法。核心建议很实在:先让模型读 README 和项目结构文件,别一上来就丢整个仓库;用“/”命令限定搜索范围,避免在无关文件里迷路;复杂任务拆成多步,每一步单独跑。这些本质上是教你怎么绕开上下文窗口限制——但正文没披露具体技术机制,比如上下文怎么切、索引怎么做。对用 Claude Code 的开发者有实操价值,但想了...
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K0·R1
04:00
74d ago
FT · 科技· rssEN04:00 · 05·15
布莱尔之子创立的 Multiverse 估值 21 亿美元,主打 AI 培训
Multiverse 完成 7000 万美元融资,估值达到 21 亿美元,这是该公司 2022 年以来的首次融资。官方说法是用于“AI 劳动力培训”,但正文没披露具体产品怎么做、客户怎么收费、部署细节。所以这点先别太激动,估值高不等于技术方案已经跑通。
#Euan Blair#Multiverse#Funding
一句话点评
Multiverse 拿了7000万美元,估值冲到21亿,说是要做AI劳动力培训。但正文被墙了,具体怎么培训、怎么收费、部署细节一概没披露。估值高不等于方案跑通了,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R1
04:00
74d ago
FT · 科技· rssEN04:00 · 05·15
麦肯锡调整合伙人薪酬:现金比例下降,股权占比上升
麦肯锡告诉高级员工,未来薪酬中股权部分会更多。标题说这是“AI之后的薪酬改革”,但正文被付费墙挡住,没披露具体砍了多少现金、涉及哪些级别的合伙人、在哪些地区生效、什么时候开始。所以“AI导致降薪”这个因果关系目前只是标题暗示,正文没给证据。
#McKinsey#Personnel
一句话点评
麦肯锡告诉高级员工未来薪酬中股权占比会更高,标题把这事扣在“AI之后薪酬改革”上。但正文被付费墙挡住,没披露砍了多少现金、涉及哪些级别合伙人、在哪些地区生效、何时开始。所以“AI导致降薪”这个因果关系目前只是标题暗示,正文没给证据。
HKR 分解
hook knowledge resonance
打开信源
59
SCORE
H1·K0·R1
03:56
74d ago
彭博科技· rssEN03:56 · 05·15
深圳Adtek科技提交港股IPO申请,中国AI公司上市潮再添一员
深圳Adtek科技已向港交所提交IPO申请,这家公司业务涉及数据中心和人工智能。正文没披露募资规模、估值、承销商和上市时间表,所以目前能确认的信息就这么多——又一家中国AI相关公司准备去香港上市,但具体值多少钱、什么时候挂牌,还得等后续文件。
#Adtek Technology#Funding
一句话点评
深圳 Adtek 科技向港交所提交 IPO 申请,业务涉及数据中心和 AI。正文没披露募资规模、估值、承销商和上市时间表,所以目前能确认的信息就这么多——又一家中国 AI 相关公司准备去香港上市,但具体值多少钱、什么时候挂牌,还得等后续文件。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0

更多

频道

后台