ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-25

23 items · updated 3m ago
RSS live
2026-05-25 · 星期一2026年5月25日
06:37
64d ago
彭博科技· rssEN06:37 · 05·25
软银股价创新高,赌的是OpenAI上市能赚一笔
软银集团股价涨到历史最高,原因是市场在赌它手里的OpenAI和SB Energy股权能值大钱——如果这两家公司上市的话。正文没披露软银具体持股比例、IPO时间表或估值数字,所以这个涨幅更多是情绪驱动,不是实锤收益。
#SoftBank Group#OpenAI#SB Energy#Funding
一句话点评
软银股价创历史新高,市场赌它手里的OpenAI和SB Energy股权能值大钱——如果这两家上市的话。正文没披露持股比例、IPO时间表或估值,涨幅更多是情绪驱动,不是实锤收益。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
06:35
64d ago
r/LocalLLaMA· rssEN06:35 · 05·25
Qwen 3.6 跑分:双卡 RTX PRO 6000 上 35B 模型生成速度 3500 token/秒
Reddit 用户 mxforest 用两张 RTX PRO 6000 专业卡(显存很大,但具体容量没提)跑了 Qwen 3.6 的基准测试。35B 模型在 BF16 精度下,128 并发时生成速度达到 3500 token/秒,提示词处理速度 30000 token/秒——这个吞吐量对本地部署来说相当高,适合做实时对话或批量推理。27B 模型在开启 ...
#Inference-opt#Benchmarking#Qwen#NVIDIA
一句话点评
两张 RTX PRO 6000 跑 Qwen 3.6 35B,BF16 下 128 并发生成速度 3500 token/秒,提示词处理 30000 token/秒——这个吞吐量对本地部署来说相当高,适合实时对话或批量推理。但注意这是专业卡,显存和带宽远超消费级,普通玩家别直接对标。正文没披露具体显存容量和功耗,也没说是否用量化。短评:本地跑 35B 能到 3500 tps,但那是两张专业卡堆...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
06:30
64d ago
Product Hunt · AI· rssEN06:30 · 05·25
MashuPack:把代码仓库打包成一个干净文件,扔给 Claude 或 ChatGPT
MashuPack 让你从代码仓库里挑出需要的部分,合并成一个纯文本文件,方便直接丢给 ChatGPT、Claude 或 Gemini 用。它主要解决浏览器里用 AI 时文件数量限制、上传麻烦、上下文拼凑混乱的问题。目前免费,但正文没披露支持哪些编程语言、仓库大小上限、具体定价或执行细节。
#Code#Tools#Claude#ChatGPT
一句话点评
把代码仓库里选中的部分合并成一个纯文本文件,直接丢给 ChatGPT 或 Claude 用,省去手动复制粘贴的麻烦。目前免费,但正文没披露支持哪些语言、仓库大小上限和具体定价,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R1
06:27
64d ago
r/LocalLLaMA· rssEN06:27 · 05·25
两块 Jetson AGX Orin 64GB 能跑什么本地模型?
Reddit 用户问两块 Jetson AGX Orin 64GB 能跑什么本地模型。已知参数:统一内存约 55GB,带宽约 205GB/s。55GB 显存够装 70B 模型(4-bit 量化约 40GB),但 205GB/s 带宽比 RTX 4090(约 1TB/s)慢很多,推理速度会明显偏慢。正文没披露具体功耗、价格或实际跑模型的效果,所以这点先别...
#Inference-opt#NVIDIA#Commentary
一句话点评
两块 Jetson AGX Orin 64GB 能跑 70B 模型(4-bit 量化约 40GB),但 205GB/s 带宽只有 RTX 4090 的五分之一,推理速度会明显偏慢。正文没披露实际功耗和跑模型的具体效果,所以这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H0·K1·R0
06:25
64d ago
Product Hunt · AI· rssEN06:25 · 05·25
Curlo:用文字描述就能搜本地音效,全程离线
Curlo 是一个 macOS 应用,让你用自然语言描述来搜索本地的音效和音乐,比如“雨打铁皮屋顶”或“短促的金属撞击声”。它完全在本地运行,音频文件和搜索请求都不出设备,隐私有保障。核心是靠一个本地音频嵌入模型把声音转成向量,然后做语义匹配。正文没披露具体用了什么模型,也没说索引方式——是导入时一次性建索引还是每次查询都扫一遍,这点先别太激动。支持按...
#Audio#Curlo#Product update
一句话点评
Curlo 是一个 macOS 应用,让你用自然语言搜本地音效和音乐,比如“雨打铁皮屋顶”。它完全离线运行,音频和搜索请求都不出设备,隐私有保障。核心靠本地音频嵌入模型把声音转成向量做语义匹配。正文没披露具体用了什么模型,也没说索引方式——是导入时一次性建索引还是每次查询都扫一遍,这点先别太激动。支持按标签、元数据管理,适合音效库大的创作者。但没提定价和系统要求,免费选项具体指什么也不清楚。...
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K1·R0
06:22
64d ago
r/LocalLLaMA· rssEN06:22 · 05·25
llama.cpp 修了个 checkpoint 保存 bug,省得每次重跑 7 万 token 的上下文
llama.cpp 的 PR #22929 修复了服务端 checkpoint 保存的 bug。之前在做 agent 编程(让模型自己写代码改代码)时,如果上下文有 7 万 token,每次保存 checkpoint 都会把整个 prompt 重新处理一遍,非常慢。作者自己用了两周这个补丁,说触发重处理的原因是 opencode 的上下文重写和模型端去...
#Agent#Code#Reasoning#llama.cpp
一句话点评
llama.cpp 修了个挺实在的 bug:agent 编程场景下,7 万 token 的上下文每次保存 checkpoint 都要重算整个 prompt,慢得离谱。作者自己打了补丁用了两周才提 PR,说明问题确实烦人。触发条件是 opencode 重写上下文和模型删推理过程。修复后省的是重复计算,对跑长上下文 agent 的用户是实打实的提速。正文没披露具体加速比,但逻辑上省的是 O(n)...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
04:45
64d ago
新智元 · 公众号· rssZH04:45 · 05·25
AI 算命 Agent 准确率逼近人类大师,但先别急着信
一个叫 Tianfu Agent 的系统在中文命理基准 MingLi-Bench 上跑到了 50% 的截断准确率,而 Claude、GPT 等基线模型只有 23%–40%(四选一选择题)。它用了 200 多个工具、三套规则库和多个子 Agent,还会给自己打分。但正文没披露测试集大小和人类大师的准确率基线,所以这个“逼近”到底多近还不好说。
#Agent#Tools#Reasoning#DestinyLinker
一句话点评
一个叫 Tianfu Agent 的系统在中文命理选择题上跑到了 50% 准确率,Claude、GPT 等基线只有 23%–40%。它用了 200 多个工具和三套规则库,还会给自己打分。但正文没披露测试集大小和人类大师的准确率,所以“逼近”到底多近还不好说。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R0
04:45
64d ago
新智元 · 公众号· rssZH04:45 · 05·25
Ilya发了一张芯片版“思考者”雕像图,签名IS 2026
Ilya Sutskever在Instagram上发了一张图,把罗丹的《思考者》雕像P成了芯片晶圆风格,签名写的是“IS 2026”。同一周,OpenAI被曝在推内部推理模型、更新Codex Mac版,还有高盛和摩根士丹利参与IPO的消息。正文没披露Ilya这张图跟OpenAI这些动作有没有直接关系,也没说他在想什么。
#Reasoning#Code#Agent#Ilya Sutskever
一句话点评
Ilya发了张《思考者》晶圆风格图,签名IS 2026,但正文没说他到底在想什么,也没说跟OpenAI这周推推理模型、Codex Mac版更新、高盛大摩参与IPO这些事有没有关系。信息缺口很大,别过度解读。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
04:42
64d ago
r/LocalLLaMA· rssEN04:42 · 05·25
Qwen3.6 27B 在 V100 上跑到 1000 tps,但别急着下单
Reddit 用户说 Qwen3.6 27B 在 V100 集群上并发 128 个请求时生成速度达到 1000 t/s,单用户单条请求约 80 t/s,处理速度 3000 t/s。这个数字看着很猛,但正文没披露用了多少张 V100、有没有量化、以及具体显存配置,所以实际部署成本还不清楚。如果真能用老卡跑出新速度,对预算有限的团队是个好消息,但验证前先打个折。
#Inference-opt#Qwen#Reddit#Benchmark
一句话点评
Reddit 用户称 Qwen3.6 27B 在 V100 集群上并发 128 请求时生成速度达 1000 t/s,单用户约 80 t/s,处理速度 3000 t/s。数字很猛,但正文没披露用了多少张 V100、是否量化及显存配置,实际部署成本未知。如果真能用老卡跑出新速度,对预算有限的团队是好消息,但验证前先打个折。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
04:27
64d ago
量子位 · 公众号· rssZH04:27 · 05·25
2026智源大会:图灵奖得主带队,中国大模型第一梯队全来了
6月12-13日北京,25个论坛200多场报告,主题覆盖智能体、世界模型、具身智能、AI安全、AI原生教育。阵容挺强,但正文没披露完整嘉宾名单,具体谁上台讲什么还得等后续议程。
#Agent#Robotics#Safety#BAAI
一句话点评
2026智源大会6月12-13日北京开,25个论坛200多场报告,覆盖智能体、世界模型、具身智能、AI安全、AI原生教育。图灵奖得主领衔,中国大模型第一梯队基本都到。但正文没披露完整嘉宾名单和具体议程,谁上台讲什么还是未知数。阵容看着挺强,但信息缺口大,建议等后续议程出来再判断值不值得去。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H0·K1·R1
04:19
64d ago
r/LocalLLaMA· rssEN04:19 · 05·25
给 149 美元的开发板写了个 C++ 推理引擎,MiniCPM-V 4.6 速度翻倍
开发者 Known_Ice9380 在 Orange Pi AIPro(Ascend 310B NPU,149 美元)上,从头写了一个纯 C++ 推理引擎来跑 MiniCPM-V 4.6。他绕过了 PyTorch 等框架,文本生成和视觉编码全在 NPU 上跑,Python 只负责分词和图像预处理。初始用官方接口只有 2.88 token/s,因为 NP...
#Inference-opt#Vision#Code#Known_Ice9380
一句话点评
开发者给 149 美元的 Orange Pi 板子(Ascend 310B NPU)手写了一套纯 C++ 推理引擎跑 MiniCPM-V 4.6,绕过 PyTorch 等框架,把文本生成速度从 2.88 token/s 拉到 5.90 token/s,翻了一倍。关键优化是给 M=1 场景(逐 token 解码)写了自定义矩阵乘核,以及把 24.8 万词表拆成 16 块并行算。目前瓶颈在板子 ...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
04:00
64d ago
FT · 科技· rssEN04:00 · 05·25
不只是SpaceX:科技巨头也在债券市场大举融资
美国科技巨头正在通过发行债券来筹集建设AI数据中心的资金。正文没有披露具体发行规模、利率、期限或涉及哪些公司,所以没法判断融资成本高不高、市场买不买账。但趋势很清楚:AI基建太烧钱,连这些现金充裕的大厂也要去借钱了。
#SpaceX#Funding
一句话点评
美国科技巨头开始发债建AI数据中心,连现金充裕的大厂都要借钱,说明AI基建烧钱到了新高度。正文没披露具体发债规模、利率和期限,所以没法判断融资成本高不高、市场买不买账。趋势值得关注,但缺关键数字,先别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
03:59
64d ago
r/LocalLLaMA· rssEN03:59 · 05·25
SEELS:一个 Windows 桌面应用,点一下“不对”就能生成 LoRA 训练数据
SEELS 0.1.5 alpha 版已发布,安装包 2.81GB,自带 CUDA 运行时、便携 Python、本地 Whisper 语音转文字和 Piper 语音合成。核心功能是一个“Teach”按钮:用户纠正模型回答后,应用自动把纠正内容存成 jsonl 格式的语料库,并直接在应用内启动 PEFT LoRA 训练。正文没披露训练耗时、硬件要求或模型...
#Fine-tuning#Tools#Audio#SEELS
一句话点评
一个叫 SEELS 的 Windows 桌面应用,核心卖点是个“Teach”按钮:模型答错了你直接纠正,它自动攒成 jsonl 语料库,然后在应用里启动 PEFT LoRA 训练。安装包 2.81GB,自带 CUDA 运行时和便携 Python,省去环境配置的麻烦。想法很直接——把用户纠正当成微调数据来源,降低收集训练数据的门槛。但正文没披露训练耗时、硬件要求或支持哪些基座模型,实际跑起来是...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
03:48
64d ago
AI HOT 精选· aihot-apiZH03:48 · 05·25
面壁智能联合清华开源 BitCPM-CANN:中国首个在华为昇腾上训出来的 1.58-bit 端侧模型
面壁智能、清华和 OpenBMB 开源了 BitCPM-CANN,号称中国首个完全基于华为昇腾训练并开源的三值(1.58-bit)端侧大模型。1.58-bit 就是把模型参数压缩到只用 -1、0、1 三个值,比传统 BF16 精度省约 6 倍显存——这意味着一个 8B 参数的模型能直接塞进旗舰手机跑。模型有 0.5B、1B、3B、8B 四个尺寸,官方说...
#Inference-opt#ModelBest#Tsinghua University#Huawei
一句话点评
面壁智能联合清华开源了BitCPM-CANN,这是国内首个完全基于华为昇腾训练的三值(1.58-bit)端侧大模型。参数只用-1、0、1三个值,比传统BF16省约6倍显存,8B模型能塞进旗舰手机跑。官方说能力保留90%-97.2%,有0.5B到8B四个尺寸,权重已开源。短评:国产算力全链路验证是亮点,但正文没披露具体跑分和手机端实测延迟,90%保留率在复杂任务上可能打折。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
02:51
64d ago
r/LocalLLaMA· rssEN02:51 · 05·25
llama.cpp 有个取巧的加速技巧:把当前回复的 token 重新塞进 KV cache
一位 Reddit 用户在 llama.cpp 的 WebUI 开发者选项里发现了一个设置,原理是把当前模型回复生成的所有 token 重新喂进 KV cache,而不是等下次提问时再从头处理。在 Open-WebUI 里,他用 Qwen3.6-35B-A3B(MXFP4 量化,单张 RX 7900 XTX 全量卸载)测试,之前模型读完大网页后 pro...
#Inference-opt#Tools#llama.cpp#Open-WebUI
一句话点评
llama.cpp 藏了个开发者选项,能把当前回复的 token 重新喂进 KV cache,不用等下次提问再从头算。实测 Qwen3.6-35B-A3B 读大网页后,prompt 处理从 5-30 秒降到几乎瞬间。单卡 RX 7900 XTX 跑 MXFP4 量化,约 100 tps。作者说没发现副作用,但正文没披露显存占用变化或长上下文稳定性。适合多轮工具调用场景,省的是等待时间而非推理算力。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
02:30
64d ago
彭博科技· rssEN02:30 · 05·25
日本 Sakura Internet 要把 AI 数据中心投资翻到近 7 倍
Sakura Internet 的 CEO 说,公司可能把资本开支提高到最初计划的近 7 倍,用来满足日本国内的 AI 数据中心需求。正文没披露原来的预算基数和时间线,所以这个“7 倍”到底是从多少涨到多少、花多久花完,目前还不清楚。不过方向很明确:日本也在抢算力资源,中小型云厂商开始猛砸钱。
#Sakura Internet#Product update
一句话点评
日本云厂商Sakura Internet要把资本开支提到最初计划的近7倍,抢AI数据中心。但正文没披露原预算基数和时间线,这个“7倍”到底从多少涨到多少、花多久花完,目前不清楚。方向明确:日本也在抢算力,中小云厂商开始猛砸钱。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
00:00
64d ago
OpenAI 博客· rssEN00:00 · 05·25
OpenAI 签下巴西两大媒体,ChatGPT 能直接看 Folha 和 UOL 的新闻了
OpenAI 宣布与巴西 Grupo Folha 和 Grupo UOL 达成内容合作,ChatGPT 现在可以引用并展示这两家媒体的新闻报道,并附上原文链接。这是 OpenAI 在巴西的首个媒体合作,目前巴西是 ChatGPT 全球最大市场之一,月活超 5000 万,日均消息量约 1.4 亿条。合作方还会拿到 Codex、ChatGPT Enterp...
#OpenAI#Grupo Folha#Grupo UOL#Partnership
一句话点评
OpenAI 在巴西签了首个媒体合作,Folha 和 UOL 的新闻现在能直接出现在 ChatGPT 里并带原文链接。巴西是 ChatGPT 全球最大市场之一,月活超 5000 万,日均消息 1.4 亿条,合作方还能拿到 Codex 和企业版工具。但正文没披露交易金额和流量分成比例,也没说是否独家。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
00:00
64d ago
OpenAI 博客· rssEN00:00 · 05·25
OpenAI 说今年 3 月美国至少有 400 万人用 ChatGPT 创业或打理小生意
OpenAI 自己出了一份分析,说 2026 年 3 月美国至少有 400 万人用 ChatGPT 来规划、启动或运营一门生意。这些人大多不是科技创业者,而是咨询、电商、家政、美容、餐饮等行业的个体户。他们把 ChatGPT 当成一个多面手助手,用来写文案、回客户消息、查合规要求、定价格。其中 71% 是已经在经营的人,营销和文案是最主要的用途,占了 ...
#OpenAI#ChatGPT
一句话点评
OpenAI 自己发报告说,2026年3月美国至少有400万人用ChatGPT来规划或运营生意,其中71%是已经在经营的个体户,集中在咨询、电商、家政、美容、餐饮。营销和写文案是头号用途(26%)。付费用户里经营者的比例更高(Plus 78%,Pro 81%),说明真干活的人更愿意掏钱。报告没交代这400万是怎么从ChatGPT总用户里筛出来的,也没说这些生意因此多赚了多少。结论方向对——A...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0

更多

频道

后台