ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-28

50 items · updated 3m ago
RSS live
2026-05-28 · 星期四2026年5月28日
15:45
61d ago
AI HOT 精选· aihot-apiZH15:45 · 05·28
商汤升级信息图生成模型:文本更准、布局更稳、支持学术图表
商汤发布了 SenseNova-U1-8B-MoT-Infographic 的升级版,一个 8B 参数的信息图生成模型。主要改进有三:文本准确性和可读性提升,减少了重复和奇怪的放大;布局更一致,背景更稳定;图表和示意图渲染质量提高,还新增了学术内容渲染支持。不过正文没披露具体评测指标、开源情况、定价或开放时间,所以实际效果和可用性还得等更多信息。
#Multimodal#Vision#SenseTime#SenseNova
一句话点评
商汤把信息图生成模型升级到8B参数,主要修了三个毛病:文字不乱重复放大、布局不歪、图表渲染更稳,还加了学术内容支持。但正文没披露评测指标、开源、定价和开放时间,实际效果和可用性得打个问号。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
15:41
61d ago
AI HOT 精选· aihot-apiZH15:41 · 05·28
Google 用 Kaggle 黑客松教小模型“先想再说”,冠军方案用评分表当奖励信号
Google 办了一场 Kaggle 黑客松,让社区用有限的 TPU 算力(Kaggle TPU v5e-8,限 9 小时)把 Gemma-2-2B 和 Gemma-3-1B 这种小模型训练出推理能力。冠军方案叫 G-RaR,核心是用一个大模型(Gemma-3-12B)当裁判,按评分表给模型的推理步骤打分,而不是只看答案对不对。这样即使答案不唯一,模型...
#Reasoning#Fine-tuning#Alignment#Google
一句话点评
Google 用 Kaggle 黑客松证明,小模型(Gemma-2-2B/3-1B)在有限算力(TPU v5e-8,限 9 小时)下也能训练出推理能力。冠军方案 G-RaR 的核心是用一个大模型当裁判,按评分表给推理步骤打分,而不是只看答案对不对。这样即使答案不唯一,模型也能收到细颗粒度的反馈。参赛者超过 11000 人,提交 300+ 方案。不过正文没披露最终模型在标准推理基准(如 GSM...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
15:36
61d ago
TechCrunch AI· rssEN15:36 · 05·28
Anthropic 租 SpaceX 算力到底租多久?马斯克和文件说法不一样
马斯克公开说 xAI 租给 Anthropic 的 Colossus 集群只是 180 天短租,双方提前 90 天通知就能取消,而且短租是 xAI 自己要求的。但 SpaceX 在 S-1 文件里写的付款计划一直排到 2029 年 5 月。两边说法对不上,正文没披露合同总金额、具体算力规模和解约条款细节,所以没法判断到底谁在打折说。
#Inference-opt#Elon Musk#xAI#Anthropic
一句话点评
马斯克公开说xAI租给Anthropic的Colossus集群只是180天短租,提前90天通知就能取消,且短租是xAI自己要求的。但SpaceX在S-1文件里写的付款计划一直排到2029年5月。两边说法对不上,正文没披露合同总金额、具体算力规模和解约条款细节,所以没法判断到底谁在打折说。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
15:35
61d ago
TechCrunch AI· rssEN15:35 · 05·28
Oculus 创始人做的对话 AI 公司 Sesame 上线 iOS 应用
Sesame 今天发布了 iOS 版 App,把他们的对话 AI 智能体开放给公众。文章说这款 App 支持更自然的来回对话,但没透露定价、用户数或模型参数。团队来自 Oculus 创始人,之前融过 2.5 亿美元。正文没披露延迟数据或支持多少种语言,想评估实际体验还得等上手。
#Agent#Audio#Sesame#Oculus
一句话点评
Oculus 创始人做的对话 AI 公司 Sesame 发了 iOS 版,主打更自然的来回聊天。团队背景和 2.5 亿美元融资是亮点,但正文没披露延迟、支持语言、定价和用户数,实际体验和竞争力都还看不清。短评:Oculus 创始人做的对话 AI 上 iOS 了,但延迟、定价、用户数全没提,先别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
15:35
61d ago
AI HOT 精选· aihot-apiZH15:35 · 05·28
Oculus创始人做的对话AI上线iOS,主打真人聊天感
Sesame 今天发布了 iOS 应用,把他们的对话式 AI 智能体开放给公众。核心卖点是交互更自然、更像真人来回聊天,而不是传统一问一答的机器人。正文没披露模型规格、定价、支持地区或上线时间表,所以技术细节和可用性暂时不清楚。
#Agent#Audio#Sesame#Oculus
一句话点评
Oculus 创始人做的对话 AI 终于上 iOS 了,主打“更像真人来回聊”而不是一问一答。但正文没披露模型规格、定价、支持地区或上线时间表,技术细节和可用性暂时不清楚。短评:真人感交互是卖点,但没参数没价格,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
15:23
61d ago
r/LocalLLaMA· rssEN15:23 · 05·28
给AI写代码加一道本地规则闸门:知识图谱+混合检索拦截违规操作
InfinriDev 开源了 Writ,一个给 AI 编程代理用的执行规则层。它先用五阶段检索(Neo4j 知识图谱、Tantivy 全文索引、HNSW 向量搜索、ONNX 嵌入)找出当前任务相关的规则,然后通过 30 个 bash 钩子脚本在工具调用前拦截——除非代码通过了审批、测试和静态分析,否则不让执行。这套方案全跑在本地,不用调模型,但正文没披...
#Agent#RAG#Code#InfinriDev
一句话点评
Writ 给 AI 编程代理加了一层本地规则拦截器:用 Neo4j 知识图谱 + 向量搜索等五阶段检索找出当前任务规则,再通过 30 个 bash 钩子在工具调用前拦截——代码没通过审批、测试和静态分析就不让执行。全本地跑,不用调模型,但正文被 Reddit 屏蔽了,没披露检索延迟和规则库维护成本。思路像给代理上“交通规则”,适合对代码安全敏感但不想改模型的团队。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
15:10
61d ago
AI HOT 精选· aihot-apiZH15:10 · 05·28
商汤升级信息图生成模型,8B参数专攻文字不乱排、图表更清晰
商汤发布了升级版信息图生成模型 SenseNova-U1-8B-MoT-Infographic,参数规模8B。官方称在四个方向做了优化:文字准确性和可读性提升,减少重复和不当放大;布局更一致、背景更稳定;图表和示意图质量提高;新增学术内容渲染支持。推文附了 Hugging Face 模型页和演示链接。正文没披露训练数据量或推理速度,实际效果得跑过才知道。
#Multimodal#Vision#SenseTime#Hugging Face
一句话点评
商汤把信息图生成模型升到8B,主攻文字不乱跑、排版不崩、图表更清楚,还加了学术内容支持。官方说四个方向都优化了,但没给训练数据量和推理速度,实际效果得跑过才知道。Hugging Face有模型页,可以自己试。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R0
15:05
61d ago
Product Hunt · AI· rssEN15:05 · 05·28
GPS:给编程助手装一个长期记忆,不用每次重复项目规则
GPS 是一个开源工具,专门解决编程助手(比如 Claude Code、Cursor)每次会话结束就失忆的问题。它会把项目的代码规范、踩过的坑、测试命令等记下来,下次编辑前自动调出相关内容。亮点是按代码符号和文件来索引记忆,而不是塞进一个越来越大的 CLAUDE.md 文件里。本地运行、命令行操作,支持 MCP 协议。免费,但正文没披露能存多少条记忆、...
#Memory#Code#GPS#Product Hunt
一句话点评
GPS 给编程助手加了个长期记忆层,把项目规范、踩坑记录按代码符号和文件索引,下次编辑自动调出,不用再塞进越来越大的 CLAUDE.md。本地运行、免费、支持 MCP 协议。但正文没披露能存多少条记忆、检索延迟多高,以及是否支持团队共享。如果真能做到按需召回且不拖慢会话,对频繁切换项目的开发者挺实用。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H0·K1·R1
15:05
61d ago
Hacker News 首页· rssEN15:05 · 05·28
Ktx:给数据分析 Agent 一个可执行的上下文层
Kaelio 开源了 ktx,一个给数据分析 Agent 用的“可执行上下文层”。简单说,就是把业务上下文(比如表结构、字段含义、关联关系、度量指标、过滤条件等)写成 Markdown 和 YAML 文件,让 Agent 在执行查询前能直接读取这些定义,而不是靠猜或靠硬编码。项目基于 Apache 2.0 协议。目前 173 个 Star,14 个 I...
#Agent#Tools#Kaelio#Claude Code
一句话点评
Ktx 把业务上下文(表结构、字段含义、度量指标等)写成 Markdown/YAML 文件,让数据分析 Agent 直接读取,不用靠猜或硬编码。思路不新,但开源实现少。目前 173 Star,14 个 Issue,验证还很弱。正文没披露和 dbt、Semantic Layer 的对比,也没说对复杂查询的覆盖度。如果它能降低 Agent 写 SQL 的幻觉率,对 BI 团队有价值,但别急着上生产。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
15:00
61d ago
AI HOT 精选· aihot-apiZH15:00 · 05·28
Google I/O 2026 速览:12 个重点,但只提了 Gemini Omni 和 3.5 Flash 两个模型名
Google 发了 I/O 2026 的 12 个高光时刻视频合集,正文只点名了 Gemini Omni 和 Gemini 3.5 Flash 两个模型,没披露参数、定价、上线时间或产品细节。Omni 应该是多模态统一模型,3.5 Flash 是轻量版,但具体快多少、便宜多少、能不能跑在端侧,一概没说。其他 10 个 moment 只给了标题和视频链接...
#Multimodal#Inference-opt#Google#Gemini Omni
一句话点评
Google I/O 2026 的 12 个高光时刻,正文只点名了 Gemini Omni(多模态统一模型)和 Gemini 3.5 Flash(轻量版),没披露参数、定价、上线时间或产品细节。其他 10 个 moment 只有标题和视频链接,信息量极低。 短评:标题党,正文几乎没干货,等后续技术博客再判断。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
14:58
61d ago
r/LocalLLaMA· rssEN14:58 · 05·28
vLLM 推理速度是 llama.cpp 的 5 倍,但跑不了 GGUF 量化版
有用户在 RTX A6000 48GB 上实测,vLLM 的 prefill 速度达到 5k-10k tokens/s,而 llama.cpp 只有 800-1000 tokens/s,差距约 5 倍。但问题来了:Unsloth 做的 Q8 量化版在生成 pandas 代码时比官方 FP8 还好,vLLM 却报“不支持的架构”错误,根本跑不了 GGUF...
#Inference-opt#Code#vLLM#Unsloth
一句话点评
vLLM 的 prefill 速度是 llama.cpp 的 5 倍,但跑不了 GGUF 量化版。Unsloth Q8 写 pandas 代码比官方 FP8 还好,vLLM 却报架构不支持。问题卡在量化格式兼容性上,正文没披露 vLLM 后续是否计划支持。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
14:57
61d ago
r/LocalLLaMA· rssEN14:57 · 05·28
有人在 Llama.cpp 里塞了个叫 Laguna 的新模型
Reddit 用户 linuxid10t 发了个 GitHub 链接,说他把 Laguna(XS.2)模型移植到了 Llama.cpp 里。正文没披露任何性能数据、兼容性细节,也没说会不会合进上游主线。目前只能看到仓库地址和评论区链接,具体跑起来快不快、能不能直接用,都得自己去试。
#Code#Inference-opt#linuxid10t#Llama.cpp
一句话点评
Reddit 用户 linuxid10t 把 Laguna(XS.2)模型移植到了 Llama.cpp,但正文只给了 GitHub 仓库和评论区链接,没披露任何性能、兼容性或上游合并计划。跑起来快不快、能不能直接用,都得自己去试。目前信息缺口很大,建议先观望,等更多实测或官方说明。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H0·K1·R1
14:38
61d ago
AI HOT 精选· aihot-apiZH14:38 · 05·28
OpenRouter 新增 Flex 和 Priority 两种服务层级
OpenRouter 给 OpenAI、Google Vertex 等模型加了两个服务选项:Flex(灵活)和 Priority(优先)。正文没披露具体定价,只说去各模型页面看。推测 Flex 可能更便宜但延迟高或排队,Priority 反之。
#Inference-opt#OpenRouter#OpenAI#Google Vertex
一句话点评
OpenRouter 给 OpenAI、Google Vertex 等模型加了 Flex(灵活)和 Priority(优先)两个服务层级。正文没披露具体定价,只说去各模型页面看。推测 Flex 可能更便宜但延迟高或排队,Priority 反之。短评:API 路由商开始分层卖服务,省钱还是省时间,得等价格出来再算。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H0·K1·R1
14:33
61d ago
The Verge · AI· rssEN14:33 · 05·28
iOS 27 渲染图曝光:Siri 改成药丸气泡,还能选 ChatGPT
Bloomberg 放出了 iOS 27 的渲染图,Siri 的交互界面会变成从灵动岛弹出的药丸形气泡,下面带一个下拉菜单,让你选“Ask”“Siri”还是“ChatGPT”。Mark Gurman 说苹果会在 6 月 WWDC 上公布最终设计,所以现在看到的只是预览,正式版 UI 可能不一样。正文没提具体功能细节,比如能不能直接调 ChatGPT 回...
#Agent#Tools#Apple#Bloomberg
一句话点评
Bloomberg 放出了 iOS 27 的 Siri 渲染图:交互变成从灵动岛弹出的药丸形气泡,下面有个下拉菜单让你选“Ask”“Siri”还是“ChatGPT”。Mark Gurman 说苹果会在 6 月 WWDC 公布最终设计,所以现在看到的只是预览,正式 UI 可能不一样。正文没提具体功能细节,比如能不能直接调 ChatGPT 回答、延迟多少、是否支持中文。目前只能看个交互方向,别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
14:26
61d ago
r/LocalLLaMA· rssEN14:26 · 05·28
微调 jina-v5 做法律语义排序,模型把“没收”判成了“偷烟”
一位用户在斯洛伐克法律语料上微调 jina-embeddings-v5-small,用了 46001 条 MarginMSE 三元组和 LoRA,跑了 2789 步。结果模型把“prepadnutie”(法律上的没收)排成了与“偷烟”相关,而不是真正的“没收”。问题出在语义排序(reranking)阶段,模型没学会区分法律术语和日常用词。正文没披露训练...
#Embedding#Fine-tuning#RAG#Jina AI
一句话点评
有人在斯洛伐克法律语料上微调 jina-embeddings-v5-small,用了 46001 条三元组和 LoRA,跑了 2789 步,结果模型把法律术语“prepadnutie”(没收)排成了“偷烟”。问题出在 reranking 阶段没学会区分法律和日常用词。正文没披露训练数据质量、学习率或验证集设计,所以不清楚是样本噪声还是 LoRA 秩不够。如果是真的,说明法律 RAG 的微调不...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:20
61d ago
FT · 科技· rssEN14:20 · 05·28
教皇挑战硅谷:AI 伦理不能只让科技公司说了算
FT 报道称教皇方济各正在主动介入 AI 治理,直接挑战硅谷的规则制定权。文章标题用了“disrupts”,但正文被付费墙挡住,没有披露教皇具体提出了哪些政策、目标、时间表或执行手段。目前能确认的信息只有“教皇选择认真应对 AI 挑战”这个立场,至于他打算怎么管、管多宽、有没有实质约束力,一概未知。这点先别太激动——表态本身有信号意义,但缺细节就等于缺牙齿。
#Safety#Pope#Policy#Commentary
一句话点评
教皇方济各要“挑战硅谷”制定AI规则,但FT正文被付费墙挡住,没披露任何具体政策、目标或执行手段。目前能确认的只有表态本身有信号意义——宗教领袖介入AI治理,说明这事已经出圈了。但缺细节就等于缺牙齿:他打算怎么管?有没有实质约束力?一概未知。这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R0
14:14
61d ago
Product Hunt · AI· rssEN14:14 · 05·28
Openstatus MCP 健康检查器
Openstatus 发布了一个 MCP 健康检查工具,不是只发个 HTTP ping 看通不通,而是模拟 AI 客户端做完整的协议握手(initialize、ping、tools/list 三步走),能检查 JSON-RPC 的版本协商和认证头解析。说白了,普通监控只看服务器有没有开机,这个工具看的是 MCP 服务器能不能真正跟 AI 客户端对上话。...
#Tools#Openstatus#Product update
一句话点评
OpenStatus 新出的 MCP 健康检查工具,不是只发个 HTTP ping 看通不通,而是模拟 AI 客户端做完整的协议握手(initialize、ping、tools/list 三步走),能检查 JSON-RPC 的版本协商和认证头解析。说白了,普通监控只看服务器有没有开机,这个工具看的是 MCP 服务器能不能真正跟 AI 客户端对上话。 短评:MCP 服务器专用监控,比 HTT...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
14:08
61d ago
Product Hunt · AI· rssEN14:08 · 05·28
WorkClaw:在 Slack 里给你配一队 AI 同事,有职位有老板
WorkClaw 今天在 Product Hunt 上线,卖的不是 AI 助手,而是 AI 同事。每个 Claw 有职位、有直属经理,能 24 小时跟整个团队协作,还能调用 3000 多个应用。跟常见的一人一个助手的模式不同,WorkClaw 在 Slack 或 Teams 里跑多个 AI 角色,像真人同事一样。正文没透露底层模型、定价,也没说技能和流...
#WorkClaw#Product Hunt#Slack
一句话点评
WorkClaw 今天在 Product Hunt 上线,卖的不是 AI 助手,而是 AI 同事。每个 Claw 有职位、有直属经理,能 24 小时跟整个团队协作,还能调用 3000 多个应用。跟常见的一人一个助手的模式不同,WorkClaw 在 Slack 或 Teams 里跑多个 AI 角色,像真人同事一样。正文没透露底层模型、定价,也没说技能和流程学习的具体机制。如果真能稳定跑多角色协...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
14:02
61d ago
AI HOT 精选· aihot-apiZH14:02 · 05·28
Runway 一人一天做出 AI 短片《昨夜》,讲东京一夜的记忆碎片
Runway 发布了一部完全由 AI 生成的短片《昨夜》,一个人用 Runway 在一天内完成,属于 Project Luxo 项目,目的是测试 AI 视频能否跨过“恐怖谷”(即画面逼真到让人不觉得诡异)。短片通过破碎记忆的视角,讲在东京改变人生的一个夜晚。正文没披露模型设置、片长、工作流程步骤或评估标准,所以不清楚具体用了多少算力、生成质量如何验证。
#Multimodal#Vision#Runway#Project Luxo
一句话点评
Runway 用一部完全由 AI 生成的短片《昨夜》来测试 AI 视频能否跨过“恐怖谷”,一个人一天内完成,成本和时间门槛确实低。但正文没披露片长、模型设置和生成质量验证方式,所以“跨过恐怖谷”这个结论得打个问号。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:00
61d ago
TechCrunch AI· rssEN14:00 · 05·28
Visa 投资 Replit,想让开发者做的 AI 代理能直接收款
Visa 投了一笔钱给 AI 编程平台 Replit,金额没公开。双方在探索怎么把 Visa 的支付能力塞进 Replit,这样开发者——以及他们写的 AI 代理——不用离开平台就能收钱。Visa 还说自己有超过 1000 名员工已经在用 Replit 做原型和开发。合作涉及 Visa 的 AI 支付套件 Intelligent Commerce 和 ...
#Agent#Code#Tools#Visa
一句话点评
Visa投了Replit,金额未公开。双方想把Visa支付能力塞进Replit,让开发者和AI代理直接在平台上收钱。Visa说已有1000+员工用Replit做原型。合作涉及Visa的AI支付套件Intelligent Commerce。正文没披露投资额、交易条款和代理支付上线时间。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
14:00
61d ago
The Verge · AI· rssEN14:00 · 05·28
Rivian 软件老大:你们不需要 CarPlay 和实体按键
Rivian 软件负责人 Wassym Bensaid 在播客里聊了 Rivian Assistant 和与大众的合资公司 RV Tech(大众投了近 60 亿美元)。R2 会是首款用新架构的车。他坚持不用 CarPlay,认为车机自己做才能打通全车功能(比如走近车自动调座椅、空调)。正文没披露 Rivian 替代 CarPlay 的完整功能清单,但提...
#Agent#Rivian#Volkswagen#Wassym Bensaid
一句话点评
Rivian 软件老大在播客里重申:不用 CarPlay,因为车机自己做才能打通座椅、空调这些硬件功能。R2 会是首款用新架构的车,大众投了近 60 亿美元合资搞底层系统。Rivian Assistant 刚上线,体验有亮点也有槽点。正文没披露替代 CarPlay 的完整功能清单,也没说 Assistant 的延迟和成功率。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
13:43
61d ago
r/LocalLLaMA· rssEN13:43 · 05·28
Reddit 用户称西方开源模型 SOTA 夹在 Gemma4-31B 和 Nemotron3-Super-120B 之间
一位 Reddit 用户发帖说,西方开源模型的最强水平目前落在 Gemma4-31B 和 Nemotron3-Super-120B 之间。帖子没有给出任何跑分、评测条件或具体分数,也没交代拿来对比的四款中国中重型模型是谁。正文被屏蔽了,看不到更多细节。所以这个判断目前只能当个观点看,没法验证。
#Benchmarking#Gemma#Nemotron#Meta
一句话点评
一个Reddit用户声称西方开源模型最强水平介于Gemma4-31B和Nemotron3-Super-120B之间,还提到四款中国中重型模型做对比。但帖子正文被屏蔽,没给出任何跑分、评测条件或具体分数。这个判断目前只能当观点看,没法验证。短评:没数据没来源,当个观点听听就好。
HKR 分解
hook knowledge resonance
打开信源
51
SCORE
H1·K0·R1
13:12
61d ago
AI HOT 精选· aihot-apiZH13:12 · 05·28
Anthropic 在米兰开第六个欧洲办公室,顺带晒了几个意大利客户用 Claude 的硬数据
Anthropic 在米兰开了新办公室,这是它在欧洲的第六个点(之前已有伦敦、都柏林、巴黎、苏黎世、慕尼黑)。正文主要晒了几个意大利客户案例:JAKALA 把 Claude 铺到了 3000 多个工位,说释放了 senior 团队约 70% 的时间;金融超级 App Satispay 把 18 个月的计划压缩到 7 个月,核心支付系统更新比原计划快 1...
#Code#Safety#Anthropic#JAKALA
一句话点评
Anthropic 在米兰开了欧洲第六个办公室,主要晒意大利客户案例。JAKALA 把 Claude 铺到 3000 多个工位,说 senior 团队释放了约 70% 的时间;Satispay 把 18 个月计划压缩到 7 个月,核心支付系统更新比原计划快 10 倍。数字挺好看,但都是客户自报,没有第三方验证,也没有披露具体成本或 ROI。Bending Spoons 说大部分代码改动用 C...
HKR 分解
hook knowledge resonance
打开信源
38
SCORE
H0·K1·R0
13:10
61d ago
AI HOT 精选· aihot-apiZH13:10 · 05·28
OpenClaw 新版本上线:安全边界更严、网关更快、内存更稳
OpenClaw 发布了 2026.5.27 版本,主要改进包括更严格的运行时安全边界(防止越权或逃逸)、更快的网关和回复路径(降低请求延迟)、以及 Codex 和应用服务器的内存稳定性(减少 OOM 或抖动)。此外还优化了频道和提供商支持,新增 Pixverse 视频能力。正文未披露具体性能提升幅度或安全漏洞细节,但整体属于一次常规迭代,适合正在用 ...
#Code#Safety#Memory#OpenClaw
一句话点评
OpenClaw 发了个常规更新,主要修运行时安全边界(防越权逃逸)、降网关延迟、稳内存防 OOM。没给具体提升数字,也没说修了啥漏洞,算一次小迭代。Pixverse 视频是新能力,但正文没披露效果。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H0·K1·R0
13:03
61d ago
Ben's Bites· rssEN13:03 · 05·28
我又为另一个 SaaS 付了钱
Ben's Bites 的编辑试用了 Magic Path,一个让多个智能体在共享画布上生成设计资产、组件和动画的工具。他很快用光了免费额度,然后订阅了 Pro 版。文章还列出了 DeepSWE 的 113 个长周期任务,平均每个修复涉及 668 行代码和 7 个文件,当前排行榜上 GPT-5.5 以 70% 领先。另外,Claude Code 新增了...
#Agent#Code#Benchmarking#Ben’s Bites
一句话点评
DeepSWE 新基准:113 个长周期任务,平均每个修复改 668 行、7 个文件,比 SWE-bench Pro 更重。GPT-5.5 以 70% 领先,但样本量小,领先优势未必稳。Magic Path 让多智能体在画布上协作生成组件,免费额度很快用完,Pro 版值不值看个人需求。Claude Code 新增安全插件,实时检查代码风险,实用但效果待验证。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
13:02
61d ago
Hacker News 首页· rssEN13:02 · 05·28
60秒小游戏:AI代理疯狂弹窗要权限,你能撑多久?
一个叫 Continue? Y/N 的网页游戏,让你在60秒内不断审批AI代理的权限请求——点同意或拒绝。游戏模拟的是“AI代理权限疲劳”:代理每干一步都要你点头,点多了就容易手滑放行危险操作。作者还附了一篇博客解释为什么这种攻击在现实中有效。游戏机制正文没细说,但概念挺直观:考验你在一分钟里能不能顶住弹窗轰炸。
#Agent#Product update
一句话点评
一个60秒的网页游戏,让你反复审批AI代理的权限请求——点同意或拒绝。模拟的是“AI代理权限疲劳”:代理每干一步都要你点头,点多了就容易手滑放行危险操作。作者还附了一篇博客解释为什么这种攻击在现实中有效。游戏机制正文没细说,但概念挺直观:考验你在一分钟里能不能顶住弹窗轰炸。 短评:60秒弹窗轰炸,模拟AI代理权限疲劳,概念直观但机制未披露。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1
13:00
61d ago
TechCrunch AI· rssEN13:00 · 05·28
AI算力荒里,有人赌SambaNova是下一个Cerebras
一家叫General Compute的新公司,专做AI推理云(就是模型训练完上线后,跑用户请求的那个阶段),刚拿了1500万美元种子轮,估值6000万。它的赌注是:用SambaNova的芯片替代GPU来跑推理。正文没披露这笔钱具体买了多少算力、延迟能压到多少、什么时候上线,所以这点先别太激动。但方向挺明确——GPU跑推理确实又贵又费电,换专用芯片如果能...
#Inference-opt#General Compute#SambaNova#Cerebras
一句话点评
一家叫 General Compute 的新公司,专做 AI 推理云(模型上线后跑用户请求的阶段),刚拿了 1500 万美元种子轮,估值 6000 万。它赌的是用 SambaNova 的专用芯片替代 GPU 来跑推理。GPU 跑推理确实又贵又费电,换专用芯片如果能压住延迟和成本,方向是对的。但正文没披露这笔钱具体买了多少算力、延迟能压到多少、什么时候上线,所以这点先别太激动。另外 Samba...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
12:56
61d ago
r/LocalLLaMA· rssEN12:56 · 05·28
Qwen3.x 的投机解码草稿接受率只有 40-60%,哪里设错了?
一位用户在 llama.cpp 上用 Qwen3.5-122B 或 Qwen3.6-27B 的 MTP(多 token 预测)做代码对话,草稿接受率只有 40-60%,远低于别人晒的 80% 左右。他开了 draft-mtp,spec-draft-n-max 设到 4,上下文塞了 7.2 万 token。正文没披露具体硬件和 batch size,所以...
#Inference-opt#Code#Qwen#llama.cpp
一句话点评
Qwen3.x 的 MTP(多 token 预测,一次猜多个词再挑)在代码对话场景下草稿接受率只有 40-60%,远低于别人晒的 80%。用户开了 draft-mtp、spec-draft-n-max 设到 4,上下文塞了 7.2 万 token。正文没披露具体硬件和 batch size,所以低接受率可能是 batch 太小或显存带宽不够,也可能是代码场景本身更难猜。如果 batch 调大...
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K1·R1
12:37
61d ago
r/LocalLLaMA· rssEN12:37 · 05·28
Hugging Face 模型页加了个“只看基座模型”开关,过滤掉微调版和量化版
Hugging Face 在模型列表页新增了一个“Base only”切换按钮,勾上之后只显示基座模型,把微调版、量化版、蒸馏版等衍生模型都过滤掉。背后用的是 base_model_relation=base 这个参数。对找模型的人来说挺实用,不用再在一堆名字差不多的变体里翻。不过正文没披露这个功能是全量上线还是灰度测试,也没说覆盖规则——比如有些模型...
#Fine-tuning#Hugging Face#Product update
一句话点评
Hugging Face 给模型列表加了“Base only”开关,勾上只显示基座模型,微调、量化、蒸馏版全过滤掉。背后参数是 base_model_relation=base。找模型不用再翻一堆同名变体,挺实用。但正文没披露是全量上线还是灰度,也没说覆盖规则——有些模型可能没标 base 关系,会被漏掉。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
12:27
61d ago
r/LocalLLaMA· rssEN12:27 · 05·28
用树莓派搭分布式存模型检查点,Mac mini 当调度员
作者开源了一套分布式检查点存储系统,用一台 Mac mini M4 当协调节点,四台 4GB 树莓派 4B 当工作节点,把一个 942MB 的 safetensors 检查点分片并冗余存储。系统自带重试、副本降级、mDNS 自动发现,以及 Prometheus/Grafana/Loki 监控。正文没披露读写延迟和可靠性测试数据,所以实际能不能用、快不快...
#Tools#Raspberry Pi#Prometheus#Grafana
一句话点评
用树莓派集群存模型检查点,思路挺省钱:一台 Mac mini M4 当协调节点,四台 4GB 树莓派 4B 当工作节点,把 942MB 的 safetensors 文件分片冗余存储。系统自带重试、副本降级、mDNS 自动发现和监控。但正文没披露读写延迟和可靠性测试数据,实际能不能用、快不快还是未知数。适合低成本备份场景,生产环境慎用。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
12:20
61d ago
Hacker News 首页· rssEN12:20 · 05·28
五个前沿大模型对67%的事实核查结论不一致
Lenz 研究团队用1000条真实用户提交的事实核查请求测试了五个前沿大模型(未公开具体模型名单),让每个模型给出“真/基本真/误导/假”四档结论。结果67%的请求至少有一个模型跟其他模型意见不同,34%的请求存在两档以上的实质性分歧(比如一个说真、另一个说假)。模型之间的一致性系数 Krippendorff's α 为0.639,说明共识有限。正文没...
#Benchmarking#Reasoning#Benchmark
一句话点评
五个前沿大模型对1000条真实事实核查请求,67%的案例至少有一个模型跟其他意见不同,34%存在实质性分歧(一个说真、另一个说假)。模型间一致性系数Krippendorff's α=0.639,共识有限。正文没公开具体模型名单和评估协议,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
11:51
61d ago
r/LocalLLaMA· rssEN11:51 · 05·28
DwarfStar 分布式推理:帖子只有标题,正文被 Reddit 屏蔽了
Reddit 用户发帖讨论 DwarfStar 的分布式推理,但正文被 Reddit 屏蔽(返回 403),只留下一个 YouTube 链接。目前看不到任何架构、节点数、吞吐量或可复现的部署细节。想了解具体内容得先登录 Reddit 或直接看那个视频。
#Inference-opt#DwarfStar#Commentary
一句话点评
标题说 DwarfStar 搞分布式推理,但正文被 Reddit 屏蔽,只留了个 YouTube 链接。目前看不到任何架构、节点数或吞吐量数据,想了解具体内容得先登录 Reddit 或直接看视频。信息缺口太大,没法判断实际价值。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K0·R1
11:30
61d ago
FT · 科技· rssEN11:30 · 05·28
谁来决定AI会抢走哪些工作?
FT这篇评论抛出一个问题:不同AI模型对“哪些工作会被AI取代”的评估结果差异很大,但文章正文被付费墙挡住,没披露具体用了哪些模型、样本量、职业分类和评估方法。所以目前只能看到问题,看不到数据支撑。
#Benchmarking#Financial Times#Commentary
一句话点评
FT这篇评论抛出一个好问题:不同AI模型对“哪些工作会被AI取代”的评估结果差异很大,但正文被付费墙挡住,没披露具体用了哪些模型、样本量、职业分类和评估方法。所以目前只能看到问题,看不到数据支撑。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1
11:06
61d ago
r/LocalLLaMA· rssEN11:06 · 05·28
本地跑大模型给多人用,该用什么软件栈?
一位用户在 Linux 上用 vLLM、llama.cpp、llama-swap、Apache 和 LibreChat 搭了一套本地 LLM 服务,给不到 10 个外部用户用。现在卡在两个地方:llama-swap 最多只能同时处理 10 个请求,LibreChat 只有网页聊天界面,没有 API 接口和 API-key 管理功能。正文没披露具体硬件配...
#Inference-opt#Tools#vLLM#llama.cpp
一句话点评
一位用户用 vLLM + llama.cpp + llama-swap + LibreChat 搭了套本地 LLM 服务,给不到 10 个外部用户用。现在卡在两个地方:llama-swap 最多同时处理 10 个请求,LibreChat 只有网页聊天界面,没有 API 接口和 API-key 管理功能。正文没披露具体硬件配置和模型大小,所以 10 并发限制是软件瓶颈还是硬件瓶颈不好判断。如果...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K0·R1
10:40
61d ago
● P1AI HOT 精选· aihot-apiZH10:40 · 05·28
DeepSeek 被曝融完 500 亿美元就冲科创板 IPO
一位参与本轮融资的大型基金经理说,DeepSeek 打算在完成约 500 亿美元(折合 3500 亿人民币)的融资后,立刻申请科创板上市。帖子没提估值、时间表、招股书,公司自己也没出来确认,我会先打个折看这件事。
#DeepSeek#Funding
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
消息来自一位参投基金经理,公司没确认,先打五折看。
锐评
这条消息只有一个信源:一位参与本轮融资的大型基金经理。帖子说 DeepSeek 打算在拿完约 500 亿美元(折合 3500 亿人民币)融资后立刻申请科创板上市,但没给出估值、时间表,也没看到招股书或公司官方表态。500 亿美元这个融资规模本身就很大,如果属实,说明资方对 DeepSeek 的商业化预期拉得很高。但“融完立刻申请”这种说法更像意向而非既定动作,科创板审核周期和监管态度都是变量。正文没披露这轮融资是否已 close、有哪些领投方、资金用途是什么,也没提公司营收或盈利情况。这些缺口让整件事还停在传闻阶段,别急着当定局看。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
09:51
61d ago
MIT 科技评论· rssEN09:51 · 05·28
毕业典礼上AI被喝倒彩:2026届毕业生不买账
前谷歌CEO埃里克·施密特在亚利桑那大学毕业典礼上呼吁毕业生“帮助塑造AI”,结果被全场嘘声打断。他承认对工作消失和未来破碎的担忧“是理性的”。中佛罗里达大学和中田纳西州立大学的毕业典礼上也出现了类似场景。另一边,OpenAI仍在赢官司、融巨资、签新合作,瑞茜·威瑟斯彭甚至警告女性“要么拥抱AI,要么被取代”。
#Safety#Eric Schmidt#Google#OpenAI
一句话点评
施密特在毕业典礼上喊话毕业生'帮助塑造AI',被全场嘘声打断,他自己也承认对工作消失的担忧'是理性的'。中佛罗里达大学和中田纳西州立大学也出现了类似场景。另一边,OpenAI仍在赢官司、融巨资、签新合作,瑞茜·威瑟斯彭甚至警告女性'要么拥抱AI,要么被取代'。 这条新闻的价值在于它捕捉到了AI行业精英与普通年轻人之间的情绪断层——前者在台上画饼,后者在台下喝倒彩。但正文没有提供任何调查数据...
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
09:42
61d ago
r/LocalLLaMA· rssEN09:42 · 05·28
Krasis 更新:Qwen3.6-35B-A3B Q4 在 8GB 笔记本上跑出阅读速度
Krasis v1.0 在单张 8GB RTX 3070 Mobile 笔记本上跑 Qwen3.6-35B-A3B 的 Q4 量化版,实测最好成绩是 222 token/秒的预填充速度和 12.48 token/秒的生成速度。做法是把热路径代码改成 Rust 实现,加上 4/6-bit KV 缓存和 HQQ 注意力机制,模型数据从系统内存流式加载。这个...
#Inference-opt#Code#Krasis#Qwen
一句话点评
单张8GB笔记本显卡跑35B模型,预填充222 token/s、生成12.48 token/s,接近阅读速度。核心优化是把热路径代码改成Rust,加上4/6-bit KV缓存和HQQ注意力,模型数据从系统内存流式加载。正文被Reddit屏蔽,没披露显存占用和功耗,这点先别太激动。如果真能稳定跑,低成本本地部署35B模型的门槛就降了一大截。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1

更多

频道

后台