ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-26

50 items · updated 3m ago
RSS live
2026-05-26 · 星期二2026年5月26日
23:34
62d ago
AI HOT 精选· aihot-apiZH23:34 · 05·26
Anthropic 任命韩国负责人,准备在首尔开办公室
Anthropic 挖来前 Snowflake 韩国总经理 KiYoung Choi 当韩国代表董事,马上要在首尔开办公室。理由是韩国人用 Claude 的强度是人口比例的 3.5 倍,而且偏技术和创意类工作。Choi 在 Google Cloud、Adobe、微软干过,经验是帮大企业搞云和 AI 转型。正文没披露首尔办公室具体人数和开业时间,但提到高...
#Anthropic#KiYoung Choi#Snowflake#Personnel
一句话点评
Anthropic 挖来前 Snowflake 韩国总经理 KiYoung Choi 当韩国代表董事,马上要在首尔开办公室。理由是韩国人用 Claude 的强度是人口比例的 3.5 倍,而且偏技术和创意类工作。Choi 在 Google Cloud、Adobe、微软干过,经验是帮大企业搞云和 AI 转型。正文没披露首尔办公室具体人数和开业时间,但提到高管近期会去剪彩。这条主要是人事和区域扩张...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
22:20
62d ago
r/LocalLLaMA· rssEN22:20 · 05·26
Cactus 混合路由器:Gemma4-2B 本地跑大部分任务,只把 15–55% 请求扔给 Gemini,效果持平 Gemini Flash Lite
Cactus 发布了一个仅 6.5 万参数的混合路由器,能把 15–55% 的任务路由到 Gemini 处理,其余在本地用 Gemma4-2B 跑。帖子说这个 6.4 万参数的路由器同时支持文本、视觉和音频输入。效果上,这套方案整体表现跟 Gemini-3.1-Flash-Lite 差不多。核心思路是:简单问题本地解决,复杂问题才调云端,省成本。不过正...
#Agent#Multimodal#Inference-opt#Cactus
一句话点评
Cactus 搞了个 6.5 万参数的小路由器,让 Gemma4-2B 在本地跑简单问题,复杂问题才调 Gemini,整体效果跟 Gemini-3.1-Flash-Lite 差不多。15–55% 的任务走云端,意味着大部分推理在本地完成,成本能省不少。但正文没披露路由器的延迟和误判率——如果判断错了,把复杂问题丢给本地小模型,效果可能崩。另外,路由器同时处理文本、视觉和音频,这点先别太激动,...
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
21:59
62d ago
r/LocalLLaMA· rssEN21:59 · 05·26
RTX 5090 跑扩散模型比专业卡快 3 秒,但功耗拉到 600W
有人在 Anima 扩散模型上对比了 RTX 5090 和 RTX 6000 PRO 系列。600W 的 5090 跑完 36 秒,同功耗的 RTX 6000 PRO WS/SE 慢 3 秒(39 秒)。有意思的是,把 5090 降到 400W 后速度掉到 48 秒,跟 325W 的 RTX 6000 PRO MaxQ 一样。说明 5090 在低功耗下...
#Benchmarking#Vision#Inference-opt#NVIDIA
一句话点评
RTX 5090 满血 600W 跑 Anima 扩散模型 36 秒,比同功耗的 RTX 6000 PRO WS/SE 快 3 秒。但降到 400W 就掉到 48 秒,跟 325W 的 6000 PRO MaxQ 持平。说明 5090 靠高功耗换性能,降功耗后优势全无。测试只跑了一个模型,且正文被屏蔽,没披露显存占用和精度设置,参考价值有限。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
21:24
62d ago
AI HOT 精选· aihot-apiZH21:24 · 05·26
Claude Code 出了个安全插件,写代码时帮你抓漏洞
Claude Code 发布了一个安全指导插件,所有用户都能从 /plugins 安装。插件会在你写代码时识别并修漏洞。正文没披露它具体能查哪类漏洞、怎么扫描、以及自动修复到什么程度——这点先别太激动,实际覆盖面和误报率都不清楚。
#Code#Tools#Safety#Claude Code
一句话点评
Claude Code 出了个安全指导插件,装了就帮你边写代码边找漏洞。但正文没说是哪类漏洞、怎么扫、自动修到什么程度——覆盖面和误报率都不清楚,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
21:08
62d ago
AI HOT 精选· aihot-apiZH21:08 · 05·26
Google 发了个 Gemini Omni 视频提示词指南,教你用5招控画面
Google 出了份 Gemini Omni 视频生成的使用指南,核心是5个提示词技巧:用模型已有的知识写短描述就行;能精确控制视频里的文字排版;支持推拉摇移这些专业镜头指令,像摄影师一样调度画面;可以迭代编辑,不用从头重来;还能直接调角色动作节奏或情绪。说白了就是靠提示词让模型生成更可控的视频。目前这个功能在 Gemini 应用和 Google Fl...
#Multimodal#Vision#Google#Gemini
一句话点评
Google 出了份 Gemini Omni 视频提示词指南,核心就五招:用常识写短描述、精确控制文字排版、像摄影师一样用推拉摇移、迭代编辑不用重来、直接调角色情绪。说白了就是让视频生成更可控。目前功能在 Gemini 应用和 Google Flow 里能用。但指南没提生成时长、分辨率、成本这些硬指标,也没说是否支持多人或复杂场景。如果真能靠提示词精确调度镜头和文字,对做短视频或广告素材的人...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
21:04
62d ago
r/LocalLLaMA· rssEN21:04 · 05·26
Quale:给代码助手画个“禁区地图”,少犯蠢
Quale 是一个轻量工具,不依赖语法,也不限编程语言,直接对代码做静态分析,然后输出一份 JSON 合同给 AI 助手。合同里写明:改哪个文件、跑哪些测试、哪些区域不能碰、哪些边界必须保持稳定。作者用本地 Qwen 和 Mistral 试了,说改对文件的概率提高了,幻觉也少了——但正文没披露具体数字,这点先别太激动。思路挺实在:与其让模型猜,不如提前...
#Agent#Code#Tools#Quale
一句话点评
Quale 是个轻量工具,不依赖语法也不限编程语言,直接对代码做静态分析,输出一份 JSON 合同给 AI 助手,写明改哪个文件、跑哪些测试、哪些区域不能碰、哪些边界必须保持稳定。作者用本地 Qwen 和 Mistral 试了,说改对文件的概率提高了,幻觉也少了——但正文没披露具体数字,这点先别太激动。思路挺实在:与其让模型猜,不如提前把规则喂给它。缺的是基准测试数据和跟其他方案(如 Aid...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
20:10
62d ago
r/LocalLLaMA· rssEN20:10 · 05·26
给 Hermes 找个本地记忆检索器,NPU 上要跑得快
Reddit 用户在给 hindsight/Hermes 项目找一个本地记忆检索器,要求能在 Strix Halo 的 NPU 上高吞吐运行。帖子提到 GPT OSS 20B 在旧榜单上排名不错,但在 NPU 上做记忆检索很慢——模型太大,NPU 推理带宽撑不住。正文没披露具体延迟数据或替代方案,但需求很明确:要一个轻量、能塞进 NPU 的小模型,专门...
#Agent#Memory#Inference-opt#Hermes
一句话点评
有人在给 Hermes 项目找本地记忆检索器,要求能在 Strix Halo 的 NPU 上高吞吐跑。GPT OSS 20B 虽然老榜单排名不错,但 NPU 推理带宽撑不住,跑记忆检索很慢。正文没披露具体延迟数据或替代方案,但需求很明确:要一个轻量、能塞进 NPU 的小模型。 短评:NPU 跑 20B 模型做记忆检索,带宽是硬伤,得换小模型。
HKR 分解
hook knowledge resonance
打开信源
44
SCORE
H0·K0·R1
19:59
62d ago
AI HOT 精选· aihot-apiZH19:59 · 05·26
人类与AI分工:教育、咨询和文学奖争议
这篇文章讨论哪些人类特质该保留、哪些可以交给AI,提到了教育实验、咨询实验和最近一个文学奖争议。正文没披露实验设计、样本量、结果,也没说是哪个文学奖,信息缺口比较大,先别急着下结论。
#Commentary
一句话点评
一篇讨论人类与AI分工的帖子,提到教育、咨询实验和文学奖争议,但正文没披露实验设计、样本量、结果,也没说是哪个文学奖。信息缺口大,先别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H1·K0·R1
19:56
62d ago
AI HOT 精选· aihot-apiZH19:56 · 05·26
选择保持人性:AI 让社交媒体帖子越来越像,但别让它替你思考
Ethan Mollick 观察到社交媒体上的帖子越来越趋同,他怀疑是 AI 生成或同质化处理的结果。正文没披露具体平台、样本量或检测方法。他引用两项教育研究:土耳其高中约 1000 名学生用 ChatGPT 做数学作业,平时作业完成得更好,但考试时反而不如不用 AI 的同学——因为 AI 直接给答案,绕过了学习必需的心智努力。另一项在台北十所高中近 ...
#Commentary
一句话点评
Ethan Mollick 观察到社交媒体帖子越来越像,怀疑是 AI 生成或同质化处理的结果,但正文没披露具体平台、样本量或检测方法。他引用两项教育研究:土耳其约 1000 名高中生用 ChatGPT 做数学作业,平时作业完成得更好,但考试时反而不如不用 AI 的同学——因为 AI 直接给答案,绕过了学习必需的心智努力。另一项在台北十所高中的近千名学生中,用 AI 辅助学习的学生在概念理解上...
HKR 分解
hook knowledge resonance
打开信源
36
SCORE
H0·K0·R1
19:55
62d ago
AI HOT 精选· aihot-apiZH19:55 · 05·26
Luma Agents 把新闻稿一键转成可分享图
Luma Labs 宣布 Luma Agents 能把新闻稿直接变成可分享的图形,操作就两步:贴内容、定方向。正文没披露模板数量、生成次数限制或定价,目前看更像一个轻量演示,离成熟产品还有距离。
#Agent#Tools#Luma Labs#Product update
一句话点评
Luma Labs 出了个 Agents 功能,能把新闻稿一键转成可分享的图片,操作就两步:贴内容、定方向。听起来挺省事,但正文没披露模板数量、生成次数限制或定价,目前更像一个轻量演示,离成熟产品还有距离。短评:两步出图,但缺模板数和定价,先当玩具看。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K1·R0
19:53
62d ago
彭博科技· rssEN19:53 · 05·26
美光因AI芯片供不应求股价上涨,分析师称供应紧张还会持续
Bloomberg报道,分析师Daniel Pilling认为美光股价上涨是因为AI芯片需求超过了供应。正文没披露涨幅有多大、供需缺口具体多少、以及这轮紧张会持续到什么时候。简单说就是AI还在抢芯片,美光先吃到了红利。
#Daniel Pilling#Sands Capital Management#Micron Technology#Commentary
一句话点评
分析师Daniel Pilling说美光股价涨是因为AI芯片供不应求。正文没披露涨幅、缺口大小和紧张持续多久。一句话:AI抢芯片,美光先吃红利,但缺具体数字支撑判断。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H0·K0·R1
19:52
62d ago
r/LocalLLaMA· rssEN19:52 · 05·26
Qwen 3.7 开源审批流程曝光,但正文只提了三个尺寸
标题说 Qwen 3.7 的开源审批流程罕见曝光,但正文只列出了 9B、27B 和 122B 三个模型尺寸,没透露审批机制和发布时间。信息缺口明显,目前能确认的只有这三个版本的存在。
#Qwen#Open source#Commentary
一句话点评
Qwen 3.7 开源审批流程曝光?Reddit 帖子标题很猛,但正文只列了 9B、27B 和 122B 三个尺寸,审批机制、发布时间全没提。信息缺口太大,目前能确认的只有这三个版本存在。短评:标题党,正文没干货,等官方消息。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K1·R0
19:40
62d ago
Hacker News 首页· rssEN19:40 · 05·26
DeepSWE:一个防污染的编程智能体长任务评测集
DeepSWE 是一个从头写任务、不用已有 GitHub commit 或 PR 的编程评测集,目的是防止模型在预训练阶段见过答案。它覆盖 91 个仓库、5 种语言,提示词比 SWE-bench Pro 短一半,但模型平均要写 5.5 倍的代码才能通过。评测用的验证器是手写的,只测软件行为不测实现细节,作者发现 SWE-bench Pro 的验证器有 ...
#Agent#Code#Benchmarking#DeepSWE
一句话点评
DeepSWE 是一个从头写任务、不用已有 GitHub commit 的编程评测集,防止模型在预训练时见过答案。覆盖 91 个仓库、5 种语言,提示词比 SWE-bench Pro 短一半,但模型平均要写 5.5 倍代码才能通过。验证器是手写的,只测软件行为不测实现细节,作者发现 SWE-bench Pro 的验证器有 8% 假阳性、24% 假阴性。榜单上 GPT-5.5 最高 70%,D...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
18:34
63d ago
r/LocalLLaMA· rssEN18:34 · 05·26
Windows 上管 llama.cpp 的桌面小工具
有人写了个 Windows WPF 应用,专门在 WSL/Ubuntu 里管理 llama.cpp。能自动装环境、切换 CPU/CUDA/Vulkan 编译、从 Hugging Face 下 GGUF 模型、改启动参数、监控 llama-server 状态。目前只支持同时跑一个模型,首次发布没签名,默认只开本地服务。适合不想敲命令行的 Windows 用户。
#Tools#Inference-opt#llama.cpp#Hugging Face
一句话点评
有人给 Windows 用户做了个 llama.cpp 图形界面,自动装环境、切编译后端、下模型、改参数、看服务状态,全在 WPF 里点鼠标完成。目前只支持同时跑一个模型,首次发布没签名,默认只开本地服务。适合不想敲命令行的 Windows 用户,但多模型并发、安全签名、远程访问等场景暂时别指望。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R1
18:33
63d ago
Product Hunt · AI· rssEN18:33 · 05·26
zero.xyz:给AI Agent一个装了8000个工具的万能工具箱
zero.xyz 是一个统一API平台,让AI Agent可以直接调用大约8000个工具、API和服务,不需要自己配密钥或写集成代码。它兼容 Claude Code、Codex、Gemini 等主流命令行Agent。产品目前免费,还送5美元体验金。不过正文没披露具体支持哪些服务、调用有没有速率限制、以及企业级认证怎么做,这些对实际落地挺关键。
#Agent#Tools#zero.xyz#Product update
一句话点评
zero.xyz 给 AI Agent 开了个“万能接口”,号称能直接调约 8000 个工具/API,不用自己配密钥或写集成代码,兼容 Claude Code、Codex 等主流命令行 Agent。目前免费还送 5 美元体验金,这点先别太激动——正文没披露具体支持哪些服务、调用有没有速率限制、企业级认证怎么做,这些对实际落地挺关键。如果真能覆盖常用服务且延迟可控,倒是省了团队自己接一堆 AP...
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K1·R1
18:17
63d ago
● P1彭博科技· rssEN18:17 · 05·26
中国扩大顶尖AI人才出境限制范围
彭博社在 5 月 26 日的节目里提到,中国正在收紧对顶尖 AI 人才的出境旅行限制。不过,因为彭博社网站本身有反爬机制,我们没能拿到视频的完整文字稿。目前能看到的片段里,没有披露这项限制的具体范围、执行方式、受影响人数,也没有给出政策生效的时间表。所以,这更像是一个信号,但具体怎么落地、影响多大,正文都没说清楚。
#Bloomberg#China#SpaceX#Policy
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
彭博这条视频报道正文被反爬墙了,具体限制范围、涉及哪些私企、执行到什么程度都没看到,只能当个信号看。
锐评
这条消息目前能确认的事实很薄。彭博的报道本身是视频,我们拿到的正文被反爬机制挡了,只留下标题说中国把顶尖AI人才的出境限制从体制内扩到了私企。Reddit上有人在讨论,但也没有补充更多细节。 我会先打个折:限制范围多大、针对什么级别的人、是审批变严还是直接卡护照,这些关键信息正文都没披露。如果是真的,说明监管把AI人才当战略资源在管,私企的工程师和研究员出国参会、谈合作可能要多一道手续。但没看到原文之前,别急着下结论说“全面收紧”。 还缺的东西很明确:彭博原视频里到底说了哪些公司、引用了什么信源、有没有具体案例。这些补不上,这条新闻就只能当风向标,不能当事实用。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
18:08
63d ago
AI HOT 精选· aihot-apiZH18:08 · 05·26
Qwen3.7 Max 上线 Go 平台,1M 上下文窗口
Qwen3.7 Max 已在 Go 平台可用,目前只支持文本,但上下文窗口拉到 1M(约 70 万汉字),能一次塞进整本书或超长对话。官方称这是 Qwen 家族目前最聪明的模型,但正文没披露具体跑分或对比数据,这点先别太激动。
#Reasoning#Qwen#Go#Product update
一句话点评
Qwen3.7 Max 上线 Go 平台,文本模型,上下文拉到 1M(约 70 万汉字),能一次塞整本书。官方说是 Qwen 家族最聪明,但没给跑分或对比数据,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R0
17:51
63d ago
r/LocalLLaMA· rssEN17:51 · 05·26
本地Agent学会自己复盘,跑分从30%涨到90%
一个叫autoswarm的项目让本地Agent能自我优化:它用本地代理记录对话日志,自动复盘后把经验写进skills.yaml,再注入到后续的系统提示词里。作者在TerminalBench的10个任务子集上测试,性能从约30%提升到约90%。效果很猛,但正文没披露具体用了什么模型、跑了多少轮、有没有过拟合风险。
#Agent#Tools#Memory#autoswarm
一句话点评
一个叫 autoswarm 的项目让本地 Agent 自己复盘对话日志,把经验写进 skills.yaml 再注入系统提示词,实现自我优化。在 TerminalBench 的 10 个任务子集上,性能从约 30% 跳到约 90%,效果很猛。但正文没披露用了什么模型、跑了多少轮、有没有过拟合风险,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
17:17
63d ago
FT · 科技· rssEN17:17 · 05·26
一只AI芯片ETF 50天涨87%,成为史上最快突破100亿美元市值的ETF
Roundhill Memory ETF(代码DRAM)4月上线,50天内涨了87%,标题说它成了史上最快达到100亿美元市值的ETF。但正文被FT的付费墙挡住了,看不到持仓和资金流入数据,所以没法判断这波涨幅是靠AI芯片概念炒作还是真有真金白银流入。
#Inference-opt#Roundhill#Funding
一句话点评
一只叫DRAM的ETF,50天涨87%,号称史上最快破百亿市值。但正文被FT墙挡住了,看不到持仓和资金流入,没法判断是AI芯片概念炒作还是真有钱进来。标题很猛,信息缺口很大,先别激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
16:52
63d ago
r/LocalLLaMA· rssEN16:52 · 05·26
Qwen3.5 122B 量化到 Q3 后,长上下文到 8 万 token 就开始胡编
Reddit 用户实测 Qwen3.5 122B(激活 10B)的 Q3_K_XL 量化版,写代码到 75-80k 上下文就开始幻觉和遗忘。已经开了 BF16 KV cache,但帖子没交代到底是 Q3 量化、模型本身还是 llama.cpp 设置导致的。信息缺口:没给可复现的触发条件,也没说其他量化档位(如 Q4)是否更稳。
#Code#Inference-opt#Memory#Qwen
一句话点评
Qwen3.5 122B(激活10B)量化到Q3_K_XL后,写代码到75-80k上下文就开始幻觉和遗忘。用户已开BF16 KV cache,但没说是量化、模型还是llama.cpp设置的问题。信息缺口:没给可复现的触发条件,也没说Q4是否更稳。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
16:00
63d ago
AI HOT 精选· aihot-apiZH16:00 · 05·26
Replit 应用加登录的两种方式:零配置或品牌化
Replit 给应用加登录提供了两个选项:一是 Replit Auth,零配置,用户直接用 Replit 账户登录,适合快速验证;二是 Clerk Auth,支持品牌化登录界面,开发和生产环境都只需一个提示词就能搞定。正文没披露具体费用或限制,但零配置方案对原型阶段挺省事。
#Tools#Replit#Clerk#Product update
一句话点评
Replit 给应用加登录出了两个方案:Replit Auth 零配置,用户直接用 Replit 账号登录,适合快速验证原型;Clerk Auth 支持品牌化登录界面,开发和生产环境都只需一个提示词搞定。正文没披露费用或限制,但零配置方案对原型阶段挺省事。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R1
16:00
63d ago
TechCrunch AI· rssEN16:00 · 05·26
Human Archive 雇印度零工戴摄像头帽子,给机器人攒训练数据
这家由伯克利和斯坦福研究员创立的公司,让印度零工戴着装摄像头的帽子和传感器出门干活,采集真实世界的物理数据给机器人训练用。正文没披露样本量、定价、采集流程和客户名单,所以规模多大、数据质量如何、谁在买单都还不清楚。
#Robotics#Human Archive#UC Berkeley#Stanford
一句话点评
这家公司让印度零工戴摄像头帽子采集物理数据,思路是用低成本人力替代昂贵机器人采集。伯克利和斯坦福背景的团队,方向对但正文没披露样本量、定价和客户,规模和数据质量存疑。短评:人力采集物理数据,成本低但验证弱,客户和规模都没说。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
15:39
63d ago
AI HOT 精选· aihot-apiZH15:39 · 05·26
2026年5月AI展望:开源模型还没追上闭源,Google的Gemini也打不过Claude Code
这篇文章是Nathan Lambert对2026年5月AI行业现状的观察。核心判断是:开源模型在真正的智能体(agent)场景里,离闭源模型还有明显差距。去年12月Anthropic的Opus 4.5在Claude Code里表现炸裂,但到现在快半年了,还没有开源模型能复制那个体验。作者估计这个差距可能还要再拖半年以上。Google的Gemini 3....
#Gemini#Mythos#Commentary#Open source
一句话点评
开源模型在真正的智能体场景里离闭源还有明显差距。去年12月Anthropic的Opus 4.5在Claude Code里表现炸裂,但快半年了,还没有开源模型能复制那个体验。作者估计这个差距可能还要再拖半年以上。Google的Gemini 3.5 Flash也没能挑战Claude Code和Codex。正文没披露Mythos的具体参数和发布方,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K0·R1
15:36
63d ago
Hacker News 首页· rssEN15:36 · 05·26
大语言模型也需要睡觉
这篇论文提出一个比喻:让大模型像人一样“睡觉”——定期清空上下文缓存(相当于短期记忆),然后利用空闲时间对积累的信息做离线循环处理,把关键内容压缩成“快速权重”(类似长期记忆)。这样做的目的是解决Transformer注意力机制在处理超长文本时计算量爆炸的问题。作者在细胞自动机、多跳图检索和数学推理任务上测试,发现加了“睡眠”机制的模型能完成普通Tra...
#Research release
一句话点评
这篇论文给Transformer加了个“睡觉”机制:定期清空短期记忆(KV缓存),用空闲时间把积累的信息压缩成长期记忆(快速权重)。在细胞自动机、多跳图检索和数学推理上,普通Transformer和混合模型搞不定的任务,加了睡眠的模型能完成。睡眠时间越长,效果越好,尤其对需要深层推理的例子。不过目前只在合成任务和一个小规模数学题上测试,没披露在真实长文本场景(比如整本书问答)上的表现,也没说...
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
15:32
63d ago
r/LocalLLaMA· rssEN15:32 · 05·26
MOSS-TTS-v1.5:开源语音合成模型,支持31种语言和显式停顿控制
OpenMOSS团队发布了MOSS-TTS-v1.5,一个支持31种语言的开源语音合成模型。相比1.0版本,主要改进包括:指定语言标签后多语言合成效果更好(不指定时部分语言有升有降)、声音克隆更稳定(重复生成一致性更高)、能处理参考音频远长于目标文本的场景、更严格跟随标点停顿,以及支持在文本里插入"[pause 3.2s]"这样的显式停顿标记。模型保留...
#Audio#Multimodal#OpenMOSS-Team#Hugging Face
一句话点评
MOSS-TTS-v1.5 开源,支持31种语言,声音克隆更稳,还能插显式停顿标记(如[pause 3.2s])。亮点是长参考音频+短文本的克隆场景优化,但正文没披露模型参数量、推理速度或训练数据规模,实际效果得跑一遍才知道。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
15:20
63d ago
彭博科技· rssEN15:20 · 05·26
AI 数据中心疯狂耗电,电网和基建跟不上
CyrusOne CEO 说 AI 数据中心扩张卡在电网、熟练工人和万亿级基础设施投资上。正文没披露具体容量、时间表或项目地点,信息缺口明显。核心判断是:算力增长快,但电力和基建是硬瓶颈,不是砸钱就能短期解决的。
#Inference-opt#CyrusOne#Eric Schwartz#Bloomberg
一句话点评
CyrusOne CEO 说 AI 数据中心扩张卡在电网和熟练工人上,需要万亿级基础设施投资。正文没披露具体容量、时间表或项目地点,信息缺口明显。核心判断是:算力增长快,但电力和基建是硬瓶颈,不是砸钱就能短期解决的。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
15:17
63d ago
r/LocalLLaMA· rssEN15:17 · 05·26
DreamServer:一个帮你装好本地大模型全家桶的安装器
Signal_Ad657 在 Reddit 上介绍了 DreamServer 安装器,支持 Linux、Windows 和 Mac。它能自动配置开源应用、模型流水线、后端依赖、硬件监控、多 GPU 检测和并行协调。模型下载和仪表盘切换还在最后测试中。正文没披露具体支持哪些模型或推理引擎,也没说安装包多大、首次启动要多久。如果你不想手动折腾环境,这个工具...
#Tools#Fine-tuning#Inference-opt#DreamServer
一句话点评
DreamServer 想做一个跨平台本地 AI 安装器,自动配环境、监控硬件、协调多 GPU。正文没披露支持哪些模型或推理引擎,也没说安装包多大、首次启动要多久。如果你不想手动折腾环境,这个工具值得关注,但具体好不好用还得等模型下载和仪表盘功能上线再看。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
15:17
63d ago
FT · 科技· rssEN15:17 · 05·26
英国律所因AI引用错误被法官当庭训斥
英国Pinsent Masons律所因AI生成的资料出错,被法官Mark Mullen公开批评,并警告律师不要把法律研究和推理外包给AI。正文没披露具体是哪个AI工具、出了什么错,但法官的态度很明确:AI可以辅助,不能替代专业判断。
#Reasoning#Pinsent Masons#Mark Mullen#Policy
一句话点评
英国Pinsent Masons律所被法官公开批评,因为AI生成的资料出了错。法官Mark Mullen警告律师别把法律研究和推理外包给AI。正文没披露具体是哪个AI工具、出了什么错,但态度很明确:AI可以辅助,不能替代专业判断。这点先别太激动,因为没细节,不知道是模型幻觉还是引用错了判例。对法律、医疗这类高风险行业是个提醒:AI出错成本高,验证门槛也高。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
14:57
63d ago
Hacker News 首页· rssEN14:57 · 05·26
Minicor:给没 API 的老系统装个 AI 鼠标键盘,自称能把 RPA 失败率从 30% 打下来
Minicor 是一个面向 Windows 桌面的 RPA 平台,专门处理那些没有 API 的老系统。它通过一个 MCP 服务器让 Claude Code 或 Codex 这类 AI 直接操控虚拟机,自动生成 Python 工作流。核心卖点是“自愈”——当 UI 按钮位置变了或者弹出了意外对话框,代理能自己发现、调整、继续跑,不用等人重写脚本。官方说传...
#Agent#Code#Tools#Minicor
一句话点评
Minicor 用 AI 操控 Windows 虚拟机,自动搞定那些没 API 的老系统。核心卖点是“自愈”——按钮位置变了或弹窗了,代理能自己发现并调整,不用等人重写脚本。官方说传统 RPA 大规模部署失败率超 30%,这点先别太激动,正文没披露 Minicor 自己的失败率或成本对比。YC 孵化、有 SOC 2 和 HIPAA 合规,适合医疗等敏感行业。但依赖 Claude Code 这...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:55
63d ago
TechCrunch AI· rssEN14:55 · 05·26
环球音乐与TikTok续约,联手打击未经授权的AI音乐
环球音乐集团(UMG)和TikTok续签了合作协议,重点打击未经授权的AI生成音乐。UMG多年来一直在推动平台、流媒体服务和AI公司执行更严格的内容审核政策,这次续约是延续这一方向。正文没披露具体的技术手段或惩罚措施,所以暂时只能理解为双方在政策层面继续联手。
#Audio#Safety#Universal Music Group#TikTok
一句话点评
环球音乐和TikTok续约,联手打击AI盗版歌。正文没披露具体技术手段或惩罚措施,所以暂时只能理解为政策层面继续联手。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H0·K0·R1
14:54
63d ago
MIT 科技评论· rssEN14:54 · 05·26
85%企业想三年内用上AI Agent,但76%说现有基础设施撑不住
MIT Tech Review 联合 Ema 发了一篇报告,核心矛盾是:企业想用 AI Agent(能自主干活、跨系统协调的 AI)来提效,但大部分公司只是把 Agent 贴到旧流程上,而不是重新设计组织架构。PwC 的 CTO 打了个比方:这就像往快散架的运营模型上贴胶带。Ema 提出一个叫“Agent 驱动的业务转型”(ABT)的框架,分三层:技术...
#Agent#MIT Technology Review#Ema#PwC
一句话点评
MIT Tech Review 联合 Ema 发报告,说 85% 企业想三年内用上 AI Agent,但 76% 承认现有架构撑不住。PwC 的 CTO 打了个比方:把 Agent 贴到旧流程上,就像往快散架的运营模型上贴胶带。Ema 提了个 ABT 框架(Agent 驱动的业务转型),分技术栈、员工、考核三层。报告引了 BCG 数据:Agent 大规模部署后,业务流程能快 30%-50%,...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
14:39
63d ago
r/LocalLLaMA· rssEN14:39 · 05·26
给 Linux 用户准备的本地 MCP 服务器一键安装脚本
这个项目提供了六个 Bash 脚本,帮你在 Linux 上快速装好本地的 MCP HTTP 服务器,默认端口从 8001 到 8006,暴露 /mcp 端点。适合在家里的局域网或者信任的网络里用,不用折腾复杂的配置。正文没披露具体支持哪些 MCP 服务,也没说脚本是否经过安全审计,自己跑之前最好扫一眼内容。
#Agent#Tools#Memory#MCP Basic Servers
一句话点评
六个 Bash 脚本,一键装好本地 MCP 服务器(端口 8001-8006),适合在家用 Linux 上跑 Agent 工具链。省了手动配环境的时间,但正文没披露具体支持哪些 MCP 服务(比如文件、搜索、数据库?),也没说脚本是否经过安全审计。自己跑之前最好扫一眼内容,别直接 sudo 执行。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R1
14:34
63d ago
r/LocalLLaMA· rssEN14:34 · 05·26
Harbor v0.4.19:一条命令拉起本地编程助手,支持vLLM/SGLang/llama.cpp后端
Harbor v0.4.19 新增了一个 launch 命令,能一键启动 Codex、Claude、PI、OpenCode 等本地编程工具,后端可选 vLLM、SGLang 或 llama.cpp。加上 --web 参数后,请求会走内置的 LLM 网关,自动预配网络搜索能力。说白了就是帮你省掉手动配环境、搭网关的麻烦,一条命令让本地模型直接进编程工作流...
#Agent#Code#Tools#Harbor
一句话点评
Harbor v0.4.19 新增一条命令就能启动 Codex、Claude 等本地编程工具,后端可选 vLLM、SGLang 或 llama.cpp,加 --web 参数还能自动配好网络搜索。省掉手动搭环境、配网关的麻烦,对想快速试本地编程 agent 的人挺实用。但正文被 Reddit 屏蔽,没披露具体支持哪些模型、性能如何、是否稳定。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R1
14:00
63d ago
AI HOT 精选· aihot-apiZH14:00 · 05·26
微软亚洲研究院办AI价值观挑战赛,找哲学法学社科的人来参赛
微软亚洲研究院发起了一个全球AI价值观挑战赛,专门面向哲学、伦理、法学和社会科学的研究人员。比赛目的是探讨AI能否理解人类价值观的复杂性。帖子只给了报名链接,没披露比赛形式、奖金、时间线和评审标准。如果你关心AI对齐中的价值判断问题,可以关注后续信息。
#Alignment#Safety#Microsoft Research Asia#Safety/alignment
一句话点评
微软亚洲研究院办了个AI价值观挑战赛,只招哲学、伦理、法学、社科的人,想探讨AI能不能理解人类价值观的复杂性。但正文只给了报名链接,没披露比赛形式、奖金、时间线和评审标准,信息缺口很大。如果你关心AI对齐中的价值判断问题,可以蹲后续,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K0·R1
13:49
63d ago
Product Hunt · AI· rssEN13:49 · 05·26
Chunk sidecars:在代码提交前让 AI 先跑一遍微型编译
CircleCI 推出 Chunk sidecars,核心思路是在 AI 生成的代码进入正式 CI 流水线之前,先跑一次轻量级的“微构建”,平均耗时约 27 秒,而完整跑一次 CI 要 5 分钟,成本差距很明显。它会在本地模拟 CI 环境,自动检测项目技术栈,如果编译失败,AI 代理可以在代码还没提交前就迭代修复,不用等 CI 跑完再回头改。官方说这能...
#Agent#Code#CircleCI#Product update
一句话点评
CircleCI 出了个“Chunk sidecars”,让 AI 写的代码在提交前先跑一次轻量级“微构建”,平均 27 秒,比完整 CI 的 5 分钟省很多。如果编译失败,AI 代理能在本地迭代修复,不用等 CI 跑完再回头改。官方说能减少 3-5 倍的重试 token 消耗,这点先别太激动,因为没披露支持哪些语言、验证机制具体怎么工作,以及 CircleCI 的集成细节。免费对所有用户开...
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K0·R1

更多

频道

后台