ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-28

50 items · updated 3m ago
RSS live
2026-05-28 · 星期四2026年5月28日
23:54
60d ago
AI HOT 精选· aihot-apiZH23:54 · 05·28
llm-anthropic 0.25.1 发布:支持 Claude Opus 4.8,默认输出长度不再卡 8192
Simon Willison 的 LLM 命令行工具更新了 Anthropic 插件,主要三件事:新增 Claude Opus 4.8 模型;给开通了 fast mode 的企业用户加了个 `-o fast 1` 参数,能更快出结果;默认 max_tokens 从固定的 8192 改成每个模型自己的最大输出长度——之前 8192 会截断长回复,现在不用...
#Tools#Inference-opt#Anthropic#Claude
一句话点评
Simon Willison 的 LLM 命令行工具更新了 Anthropic 插件,主要三件事:新增 Claude Opus 4.8 模型;给开通了 fast mode 的企业用户加了个 `-o fast 1` 参数,能更快出结果;默认 max_tokens 从固定的 8192 改成每个模型自己的最大输出长度——之前 8192 会截断长回复,现在不用手动调了。 短评:小版本更新,对 CL...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
23:42
60d ago
Hacker News 首页· rssEN23:42 · 05·28
旧金山一初创公司被曝在Airbnb里偷偷测试机器人,结果把房子搞砸了
一家叫Bot Company的旧金山初创公司,被房东起诉说他们租Airbnb不是为了住,而是在里面偷偷测试做家务的机器人原型。房东的监控拍到有人搬大黑箱子进屋,之后安保系统被关掉,房子和个人物品被损坏。房东已经收到多条差评。正文没披露具体损失金额和机器人损坏细节,但这事说明:在真实家庭环境里测机器人,搞砸的风险不小,而且公司可能为了保密连房东都不告诉。
#Robotics#Bot Company#Airbnb#Incident
一句话点评
短评:租Airbnb偷偷测家务机器人,结果把房子搞坏了被房东告上法庭。 点评:旧金山初创公司Bot Company被房东起诉,指控他们租Airbnb不是为了住,而是在里面偷偷测试做家务的机器人原型。房东监控拍到有人搬大黑箱子进屋,之后安保系统被关掉,房子和个人物品被损坏,房东已收到多条差评。这事说明:在真实家庭环境里测机器人,搞砸的风险不小,而且公司可能为了保密连房东都不告诉。正文没披露具...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
23:34
60d ago
r/LocalLLaMA· rssEN23:34 · 05·28
有人在 Windows 上跑通了 SearXNG,不用 Docker 也不用 WSL
Reddit 用户 zmarcoz2 发帖说他在 Windows 上成功运行了 SearXNG(一个自托管的元搜索引擎),而且没借助 Docker 或 WSL。这对不想装虚拟化层或 Linux 子系统的 Windows 用户来说是个好消息,意味着部署门槛可能更低。不过帖子正文被 Reddit 屏蔽了,只留下一张图片链接,所以具体怎么装的、用了哪些依赖、...
#Tools#SearXNG#Reddit#zmarcoz2
一句话点评
有人在 Windows 上跑通了自托管搜索引擎 SearXNG,没装 Docker 也没开 WSL。这对想本地搭搜索工具又嫌虚拟化麻烦的人是个好消息。但帖子正文被 Reddit 屏蔽了,只剩一张图,具体怎么装的、用了哪些依赖、有没有坑,一概没披露。目前只能当个“有人做到了”的线索,没法复现。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R1
23:33
60d ago
AI HOT 精选· aihot-apiZH23:33 · 05·28
OpenRouter 上线模型对比页,可视化 GPT-5.5 和 Claude Opus 4.7/4.8 表现
OpenRouter 推出了一个模型对比页面,能直接可视化 GPT-5.5、Claude Opus 4.7 和 Claude Opus 4.8 的性能差异。正文没披露具体用了哪些指标维度、怎么打分的,所以这个页面更像一个快速看板,帮你直观感受模型间的相对强弱,而不是严谨的评测报告。
#Benchmarking#OpenRouter#OpenAI#Anthropic
一句话点评
OpenRouter 搞了个模型对比页面,把 GPT-5.5、Claude Opus 4.7 和 4.8 放一起可视化。好处是直观,不用自己翻基准分。但正文没交代用了哪些指标、怎么打分的,所以更像快速看板而非严谨评测。短评:直观对比 GPT-5.5 和 Claude Opus 4.7/4.8,但评分方法未公开,当看板用就好。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
23:28
60d ago
r/LocalLLaMA· rssEN23:28 · 05·28
Linux Kernel 7.0 让 Intel ARC B50 在 Linux Mint 上即插即用
一位 Reddit 用户报告,升级到 Kernel 7.0 后,Intel ARC B50 显卡在 Linux Mint 22.3 上直接点亮,无需额外配置。帖子没提驱动版本、跑了什么负载、性能怎么样,所以目前只能确认能亮机,实际干活效率未知。
#Inference-opt#Intel#Linux Mint#Ubuntu
一句话点评
Intel ARC B50 在 Linux Kernel 7.0 下被 Reddit 用户报告能直接点亮,不用额外配置。但帖子没提驱动版本、跑了什么负载、性能如何,目前只能确认亮机,实际干活效率未知。短评:能亮机是好事,但跑大模型效率未知,先别激动。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R1
23:16
60d ago
r/LocalLLaMA· rssEN23:16 · 05·28
为什么没人做个社区项目,教你在家用8GB显存从零训一个LLM?
Reddit用户提议搞一个社区教程,硬约束是只用消费级显卡(8GB显存)、不租云GPU,从零开始训一个LLM。帖子点名了nanoGPT/nanoChat、BitNet、Muon优化器、激进量化,以及用Wikipedia dump做数据。想法挺好,但正文没披露任何现成的项目链接或代码仓库,目前还只是一个讨论帖。
#Code#Inference-opt#Andrej Karpathy#Reddit
一句话点评
Reddit 上有人提议搞一个社区教程,硬约束是只用 8GB 显存的消费级显卡、不租云 GPU,从零开始训一个 LLM。帖子点名了 nanoGPT/nanoChat、BitNet、Muon 优化器、激进量化,以及用 Wikipedia dump 做数据。想法挺好,但正文没披露任何现成的项目链接或代码仓库,目前还只是一个讨论帖。 短评:8GB 显存训 LLM 的社区教程,想法好但还没人真做出...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
22:56
60d ago
Product Hunt · AI· rssEN22:56 · 05·28
Firecrawl 上线 /monitor:网页变了就通知 AI agent,省 90% 的 token 钱
Firecrawl 今天在 Product Hunt 上发布了 /monitor 功能,核心逻辑很简单:你盯着一个网页,它一变就通过 webhook 推给你的 AI agent。官方说这样能省掉最多 90% 的 LLM token 开销——因为 agent 不用每次都把整页塞进模型,只处理变化的部分。这个数字挺实在,如果监控的页面多、变化少,省下来的 ...
#Agent#Tools#Firecrawl#Product update
一句话点评
Firecrawl 的 /monitor 功能,核心是监控网页变化并通过 webhook 推给 AI agent,号称能省最多 90% 的 LLM token 开销。这个数字挺实在,尤其适合监控大量变化少的页面。但正文没披露监控频率、定价和 API 细节,也没说支持哪些网站。如果频率低或只支持静态页面,实用性会打折扣。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
22:39
60d ago
r/LocalLLaMA· rssEN22:39 · 05·28
Benchmark-Yourself 上线:普通人也能跟开源大模型 PK 跑分,成绩还能写进简历
一个叫 Benchmark-Yourself 的 Streamlit 应用上线了,让你跟开源大模型做同样的测试题,然后给你一个分数。目前有 5 个基准测试,做完可以把成绩贴到简历或 LinkedIn 上。正文没披露具体考什么题、怎么算分、跟哪些模型比,所以这个分数的参考价值暂时不好判断。
#Benchmarking#Benchmark-Yourself#Streamlit#JLeonsarmiento
一句话点评
一个 Streamlit 应用让你跟开源模型做同样的测试题,然后给你打分,还能贴到简历上。目前有 5 个基准,但正文没披露具体考什么题、怎么算分、跟哪些模型比,所以这个分数的参考价值暂时不好判断。如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
22:16
60d ago
r/LocalLLaMA· rssEN22:16 · 05·28
Claude CLI 新版加了三类消息角色,本地 vLLM 直接崩了,一行代码就能修
Claude CLI 2.1.154 版本在 API 消息里新增了 ctx、msg、system 三种角色,导致本地用 vLLM 跑 Anthropic 协议时直接报错。Reddit 用户发现只要在 vLLM 源码里加一行 Literal 展开就能恢复对 MiniMax-M2.7 等模型的调用。正文没披露这行补丁的具体写法,但修复成本极低,适合还在本地...
#Tools#Code#Anthropic#vLLM
一句话点评
Claude CLI 新版本加了三种消息角色,导致本地用 vLLM 跑 Anthropic 协议直接报错。Reddit 用户发现改一行 vLLM 源码就能恢复,修复成本极低。但正文没给补丁写法,得自己翻评论区。适合还在本地折腾的人,生产环境慎用。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
21:49
60d ago
AI HOT 精选· aihot-apiZH21:49 · 05·28
Altman 和 Amodei 改口:AI 不会消灭白领工作,两人都在准备万亿 IPO
OpenAI 的 Sam Altman 和 Anthropic 的 Dario Amodei 过去一年都在警告 AI 会大量取代白领工作,现在两人都承认自己错了。Altman 说“我错得挺离谱”,他试过让 AI 代回 Slack 和邮件,最后还是自己动手,觉得人跟人之间的互动没法外包。Amodei 之前说 AI 可能干掉 50% 的白领岗位,现在改口说...
#Sam Altman#Dario Amodei#Commentary
一句话点评
Altman和Amodei承认之前说AI会干掉大量白领工作是错的。Altman自己试了让AI代回消息,最后还是自己动手,说人际互动没法外包。两人改口的时间点正好都在各自公司准备IPO(估值约1万亿美元)之前,这点先别太激动。正文没披露他们具体改成了什么措辞,也没提IPO是否影响了表态。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
21:24
60d ago
TechCrunch AI· rssEN21:24 · 05·28
互联网正在被机器重建
AWS、Cloudflare 等基础设施公司正在重新设计云系统,因为 AI agent(能自主执行任务的程序)正从实验阶段进入生产环境。文章认为未来互联网流量将主要由机器而非人类用户主导。AWS 推出了新一代 OpenSearch Serverless,这是一个全托管的搜索和向量数据库,用于存储和检索数据,专门为 agent 应用设计。正文没有披露具体...
#Agent#AWS#Cloudflare#Commentary
一句话点评
AWS和Cloudflare在重新设计云系统,因为AI agent(能自主干活的程序)要从实验进生产了。文章判断未来互联网流量主要来自机器而非人类。AWS推出了OpenSearch Serverless,一个全托管的搜索和向量数据库,专门给agent用。但正文没披露具体定价、部署时间线或流量占比数据,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
20:55
60d ago
AI HOT 精选· aihot-apiZH20:55 · 05·28
Grok Build 0.2.7 上线:新增用量查询、登录、子智能体共享终端,图像理解也升级了
Grok Build 0.2.7 主要加了四个功能:/usage 可以查用量,/login 支持登录,跨子智能体共享终端(多个子任务能共用同一个终端环境),以及图像理解能力改进。正文没披露具体改进幅度、定价或灰度范围,想了解细节得自己去翻 changelog。
#Agent#Vision#Tools#xAI
一句话点评
Grok Build 0.2.7 更新了四个功能:用量查询、登录、跨子智能体共享终端(多个子任务共用同一个终端环境),以及图像理解改进。正文没披露改进幅度、定价或灰度范围,想了解细节得自己去翻 changelog。短评:四个功能里共享终端最实用,但没给性能数据,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
20:48
60d ago
● P1彭博科技· rssEN20:48 · 05·28
Apollo 正为 Anthropic 拉一笔 360 亿美元贷款,用来买谷歌芯片
Apollo 和 Blackstone 在找其他投资人一起凑约 360 亿美元的债务融资,给 Anthropic 建 AI 基础设施。标题说这笔钱会用来买谷歌的芯片,但正文因为 Bloomberg 的反爬墙没抓到,具体买什么型号、多少量、什么时候交付都没披露。我会先打个折:360 亿这个数字很大,但它是债务融资不是纯股权,结构上可能带杠杆,实际落到芯片...
#Inference-opt#Apollo Global Management#Blackstone#Anthropic
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Apollo 在帮 Anthropic 找 360 亿美元债务融资买谷歌芯片,但正文被反爬没抓到,具体买什么、怎么交付全没披露,数字很大先别太激动。
锐评
这条消息的核心是一笔规模惊人的债务融资:Apollo 和 Blackstone 正牵头为 Anthropic 凑约 360 亿美元,名义上是买谷歌芯片建 AI 基础设施。但 Bloomberg 原文因为反爬墙没抓到正文,所以关键信息全是缺口——芯片型号、采购量、交付时间、利率结构都没披露。360 亿这个数字本身需要打折看:它是债务融资不是纯股权,结构里很可能带杠杆,实际落到芯片采购上的金额会小于面值。另外,用债务方式给一家还在烧钱的 AI 公司铺硬件,风险不低,一旦模型商业化节奏跟不上,还本付息压力会很大。对从业者来说,这条新闻目前只能说明资本在重注押 Anthropic 的算力扩张,但落地细节和真实成本还完全看不清。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
20:48
60d ago
r/LocalLLaMA· rssEN20:48 · 05·28
4张3090跑Qwen 3.6 27B全精度,想升级到8张或换B5000,值不值?
Reddit用户用4张RTX 3090(共96GB显存)跑Qwen 3.6 27B 128K全精度,现在纠结升级路线:加4张到8张凑192GB显存(约$4200+税),或者买一张48GB的RTX B5000(约$4200+税),再往上就是$10k+的B6000。核心问题是:更大显存能跑更大模型,但成本翻倍甚至翻三倍,性价比是否划算。正文没披露用户具体跑...
#Inference-opt#Code#Qwen#MiniMax
一句话点评
4张3090跑Qwen 3.6 27B全精度,96GB显存够用但想上更大模型。升级到8张3090(192GB)或单张B5000(48GB)都约$4200,B6000则$10k+。核心矛盾:加卡显存翻倍但成本翻倍,单卡省电省空间但显存少。正文没披露用户具体跑什么任务,如果是推理为主,8张3090性价比更高;如果要训练,单卡B5000更省心。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R1
20:35
60d ago
AI HOT 精选· aihot-apiZH20:35 · 05·28
Replit Canvas:一个让你边画边改的AI建站工具
Replit 发布了 Canvas,一个智能体设计工具,用来建网站、做应用和营销素材。它不像传统聊天框那样只能打字,而是给你一块画布,可以自由探索想法、创建不同版本并反复修改。正文没披露定价、开放范围或背后的模型机制,所以具体怎么收费、什么时候能用、效果多好,目前还不清楚。
#Agent#Tools#Replit#Product update
一句话点评
Replit 出了个叫 Canvas 的智能体设计工具,主打画布式交互,不是传统聊天框。能建网站、做应用和营销素材。但正文没披露定价、开放范围或背后的模型机制,所以具体怎么收费、什么时候能用、效果多好,目前还不清楚。 短评:画布交互比聊天框更直观,适合反复迭代。但没定价和开放范围,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
20:18
60d ago
r/LocalLLaMA· rssEN20:18 · 05·28
Mimo 2.5 Pro 跑在 8 块 GB10 上,1k 上下文能到 40 token/秒
Reddit 用户用 8 块华硕 Nvidia GB10 组了个小集群跑 Mimo 2.5 Pro,单用户写代码请求下,1k 上下文时每秒生成 40 个 token,30k 时掉到 32,125k 时 25,250k 时还有 17。并行跑 2 路能到 60,4 路冲到 83。对一个 1T 参数模型来说,这个速度算不错了,说明 GB10 这种小卡堆起来也...
#Code#Inference-opt#Mimo#Nvidia
一句话点评
8块GB10小卡堆起来跑1T参数的Mimo 2.5 Pro,1k上下文能到40 token/s,250k长文还有17,并行4路冲到83。对个人玩家来说成本低、速度够用,但正文没披露具体延迟和精度损失,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
20:14
60d ago
The Verge · AI· rssEN20:14 · 05·28
微软 365 Copilot 改版:加载快一倍,界面更清爽
微软给 365 Copilot 做了次大改版,官方说加载速度快了一倍,桌面和移动端同步更新。新设计叫“渐进式展示”——你写什么提示,它就弹出对应的工具和控件,不再一次性堆满按钮。输入框也升级了,能直接调格式,还能自动扩展。响应内容更结构化、更好扫读。不过正文没披露具体延迟数据,快一倍是相对旧版还是某个基准,这点先别太激动。
#Agent#Tools#Microsoft#The Verge
一句话点评
微软 365 Copilot 改版,官方说加载快一倍,桌面和移动端同步更新。新设计“渐进式展示”根据你写的提示弹出对应工具,不再堆满按钮。输入框能直接调格式、自动扩展,响应也更结构化好扫读。但正文没披露具体延迟数据,快一倍是相对旧版还是某个基准,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
20:06
60d ago
TechCrunch AI· rssEN20:06 · 05·28
Asana 花 7500 万美元买了个无代码 AI 助手搭建工具 StackAI
Asana 收购了 StackAI,一个让你不用写代码就能搭 AI 工作流的工具,花了 7500 万美元。StackAI 可以把 Salesforce、Slack、Gsuite 这些系统里的数据拉进来,让 AI 代理(也就是能自动干活的程序)直接在业务流程里跑。这笔钱对 Asana 来说不算小,但比起自己从头搞要省事。StackAI 之前总共融了不到 ...
#Agent#Tools#Asana#StackAI
一句话点评
Asana 花 7500 万美元买了 StackAI,一个不用写代码就能搭 AI 工作流的工具,能把 Salesforce、Slack 等系统数据拉进来干活。对 Asana 来说,这笔收购比自研划算,但正文没披露具体整合时间表和客户迁移方案。短评:买得值,但落地细节还缺。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
20:05
60d ago
彭博科技· rssEN20:05 · 05·28
太阳能公司Nextpower花3.65亿美元买电池公司,盯上AI数据中心的电老虎胃口
Nextpower同意以最高3.65亿美元收购Prevalon Energy,从太阳能追踪支架供应商跨入储能领域,直接瞄准AI数据中心的电力需求。这笔收购金额不算小,但说明AI带来的用电压力已经让能源公司愿意真金白银押注储能。正文被Bloomberg paywall挡住,没披露交易具体时间线和Prevalon的现有客户或项目规模。
#Nextpower#Prevalon Energy#Funding
一句话点评
太阳能支架商Nextpower花最多3.65亿美元买下储能公司Prevalon,直接说就是冲着AI数据中心的用电需求去的。金额不算小,说明AI带来的电力压力已经让能源公司愿意真金白银押注储能。但正文被Bloomberg paywall挡住,没披露Prevalon现有客户、项目规模或技术路线,这笔收购到底值不值还不好说。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
20:01
60d ago
r/LocalLLaMA· rssEN20:01 · 05·28
本地模型能用来记会议笔记吗?
Reddit 用户问本地模型能不能替代 Bluedot + Claude 做会议记忆,需求是搜几个月内的会议记录、转录、摘要、行动项和录音。帖子没提试过哪个本地模型、跑过什么基准、用了多少数据、延迟目标多少、硬件条件如何,信息缺口很大。
#RAG#Memory#Reddit#Bluedot
一句话点评
Reddit 用户问本地模型能否替代 Bluedot+Claude 做会议记忆,需求是搜几个月内的会议记录、转录、摘要、行动项和录音。但帖子没提试过哪个模型、跑过什么基准、用了多少数据、延迟目标多少、硬件条件如何,信息缺口很大。短评:问题很实际,但信息太少,没法判断。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R1
19:43
60d ago
Hacker News 首页· rssEN19:43 · 05·28
Sam Altman 和 Dario Amodei 开始收回“AI 会消灭大量工作”的预言
两位 AI 大佬同时改口,不再强调 AI 会大规模取代人类工作。Altman 和 Amodei 之前都说过类似“很多岗位会消失”的话,现在态度明显软化。文章来自 Fortune,在 Hacker News 上有 68 个点赞和 55 条评论,但正文没有披露他们具体说了什么、改口到什么程度。所以目前只能确认方向变了,具体理由和细节还不清楚。
#Sam Altman#Dario Amodei#Fortune#Commentary
一句话点评
Sam Altman 和 Dario Amodei 同时改口,不再强调 AI 会大规模取代人类工作。Fortune 报道,Hacker News 上 68 点赞、55 评论,但正文没披露他们具体说了什么、改口到什么程度。目前只能确认方向变了,具体理由和细节还不清楚。 短评:大佬改口是好事,但没给具体理由,先别急着当定心丸。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
19:03
61d ago
AI HOT 精选· aihot-apiZH19:03 · 05·28
Gemini Omni 在印度开放视频编辑功能
印度用户现在能用 Gemini Omni 直接编辑和转换手机里的视频了,支持从相册或已存文件上传。目前只限印度地区,其他地区还没消息。
#Multimodal#Vision#Gemini#Product update
一句话点评
Gemini Omni 向印度用户开放了视频编辑功能,支持从相册上传视频直接剪辑和转换。目前仅限印度,其他地区未开放。正文没披露具体编辑能力(如裁剪、滤镜、转格式)和延迟表现,实用性待验证。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H0·K1·R0
18:52
61d ago
AI HOT 精选· aihot-apiZH18:52 · 05·28
MiniMax M2.7 免费智能体编程限时开放
MiniMax 宣布 M2.7 模型可在 OpenHandsDev 上免费用于智能体编程(让模型自动写代码、调代码),但限时开放。正文没说明活动持续多久、有无使用次数限制、模型参数大小以及是否需要申请资格。想尝鲜得抓紧,但具体门槛和时长都不清楚。
#Agent#Code#MiniMax#OpenHandsDev
一句话点评
短评:免费白嫖 M2.7 写代码,但限时且门槛未知,别太激动。 MiniMax 把 M2.7 模型塞进 OpenHandsDev 平台,让开发者免费体验智能体编程——也就是模型自己写代码、调代码,省去手动改 bug 的功夫。限时开放,但正文没披露活动持续多久、有无使用次数限制、是否需要申请资格。M2.7 是 MiniMax 的旗舰模型,编程能力在内部测试中表现不错,但这次免费是推广手段还是...
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H0·K1·R1
18:52
61d ago
● P1AI HOT 精选· aihot-apiZH18:52 · 05·28
Anthropic 拿了 650 亿美元,估值冲到 9650 亿,说这可能是上市前最后一次私募
Anthropic 刚完成 H 轮融资,融了 650 亿美元,投后估值 9650 亿美元。公司放风说这大概率是 IPO 前最后一轮私募了。正文没披露具体投资方和资金用途,也没提这轮估值比上一轮涨了多少。9650 亿这个数字先别太激动——一级市场估值和二级市场定价是两回事,得等招股书出来才能看到真实财务底子。
#Anthropic#Funding
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
9650 亿估值先别太激动,一级市场定价和二级市场是两回事,得等招股书看真实财务底子。
锐评
Anthropic 这轮融了 650 亿美元,估值推到 9650 亿,公司放风说这大概率是 IPO 前最后一轮私募。数字看着吓人,但正文没披露投资方是谁、钱具体怎么花,也没提这轮估值比上一轮涨了多少——这些缺口让判断打了折扣。一级市场估值往往包含大量优先权条款保护,和上市后二级市场定价逻辑不同,9650 亿这个数更像谈判结果而非市场定价。我会先打个折看:等招股书出来,收入结构、亏损规模、客户集中度这些硬指标才能验证这个估值是不是撑得住。现在还缺的信息包括这轮是纯股权还是含债、有没有老股转让、以及 IPO 大致时间窗口。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
18:43
61d ago
彭博科技· rssEN18:43 · 05·28
美国投资人押注巴西AI警务公司Pax,计划在巴西国内快速扩张
巴西AI初创公司Pax拿到美国投资,打算在巴西国内快速铺开用AI帮警察查暴力案件的业务。Bloomberg的报道正文被屏蔽了,所以没披露具体融了多少钱、谁投的、在哪些城市落地、以及效果怎么样。
#Vision#Pax#Funding#Product update
一句话点评
巴西AI创企Pax拿到美国投资,要在国内铺开用AI帮警察查暴力案件的业务。Bloomberg正文被屏蔽,没披露融了多少钱、谁投的、在哪些城市落地、效果如何。信息缺口太大,只能当个信号看:美国资本在押注拉美公共安全AI赛道。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
18:41
61d ago
AI HOT 精选· aihot-apiZH18:41 · 05·28
Google 发布 Pay & Wallet MCP 服务器,AI 助手可以直接查文档、验钱包卡、管商户
Google 推出了一个 MCP 服务器,专门给 Google Pay 和 Google Wallet 的开发者用。核心思路是让 AI 编程助手(比如 Cursor、VS Code 里的 agent)能直接调用四个工具:搜官方文档(用了 RAG,也就是外挂资料库,回答更准)、验证 Wallet 卡券的 JWT 或 JSON 定义、查你的集成状态和商户 ...
#Agent#Tools#Google#Product update
一句话点评
Google 给 Pay 和 Wallet 开发者出了个 MCP 服务器,让 AI 编程助手能直接搜文档(RAG 外挂资料库)、验证卡券 JWT、查集成状态和商户信息。好处是少切页面,但正文没披露延迟和成本,也没说支持哪些 IDE 以外的 agent。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
18:35
61d ago
● P1AI HOT 精选· aihot-apiZH18:35 · 05·28
Anthropic 完成 650 亿美元 H 轮融资,估值冲到 9650 亿美元
Anthropic 拿了 650 亿美元,投后估值 9650 亿美元,由 Altimeter Capital 等机构领投。公司说 Claude 的企业客户增长很快,年化收入(run-rate revenue)已经超过 470 亿美元。这笔钱主要用来继续做安全与可解释性研究、扩算力、铺产品。算力方面,他们跟亚马逊签了最多 5 吉瓦的新容量,跟 Googl...
#Safety#Interpretability#Anthropic#Altimeter Capital
精选理由
精选 · 重要度 96 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 又融了 650 亿美元,估值冲到 9650 亿,年化收入 470 亿,但正文没披露利润和实际合同负债结构,这个估值倍数先别太激动。
锐评
Anthropic 这轮 H 轮拿了 650 亿美元,投后估值 9650 亿美元,领投方包括 Altimeter Capital、Dragoneer、Greenoaks 和红杉。公司自己说 Claude 的企业客户增长很快,年化收入(run-rate revenue)已经超过 470 亿美元。这个数字是按最近一个月收入乘以 12 算出来的,不是已经到账的年度收入,所以实际规模要打个折。 这笔钱主要投向三个方向:安全与可解释性研究、扩算力、铺产品。算力方面,他们跟亚马逊签了最多 5 吉瓦的新容量,跟 Google 和博通签了 5 吉瓦的下一代 TPU 容量,还跟 SpaceX 合作拿 GPU 资源。Claude 现在是第一个同时跑在 AWS、Google Cloud 和微软 Azure 三大云上的前沿模型。 值得留意的是,这轮融资里还出现了美光、三星、SK 海力士三家存储和逻辑芯片厂商作为“战略基础设施合作伙伴”。这说明 Anthropic 在往供应链上游走,想直接跟芯片厂绑定来保证算力供应,而不只是靠云厂商。但正文没披露这几家芯片厂具体投了多少钱、是以现金还是以产能承诺形式参与,也没说这 650 亿里有多少是之前已经承诺过的老钱——比如亚马逊那 50 亿就是之前签好的。利润、现金流、客户留存率这些关键指标一概没提,所以这笔钱到底是续命还是加速扩张,外面的人暂时看不出来。
HKR 分解
hook knowledge resonance
打开信源
96
SCORE
H1·K1·R1
18:32
61d ago
TechCrunch AI· rssEN18:32 · 05·28
AI 代币期货要来了,像炒黄金原油一样炒 token
大型交易所正在设计 AI 代币的衍生品,把 token 从计算产出重新定义为类似电力或带宽的原材料投入。上海期货交易所已在推进相关合约设计,CME 集团也有动作。正文没披露具体合约规格、定价机制和上线日期,所以暂时没法判断交易门槛和流动性。方向值得关注:如果 token 真能像大宗商品一样期货化,AI 算力成本对冲就有了金融工具,对做推理部署的团队来说...
#Product update
一句话点评
上海期货交易所和CME都在推AI token期货,把token当电力、带宽一样的原材料来交易。方向有意思:如果真能期货化,做推理部署的团队就能用金融工具对冲算力成本。但正文没披露合约规格、定价机制和上线日期,交易门槛和流动性暂时没法判断。这点先别太激动,等细则出来再说。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
18:09
61d ago
● P1Hacker News 首页· rssEN18:09 · 05·28
Anthropic完成650亿美元H轮融资估值达9650亿美元
Anthropic 拿了 650 亿美元,领投方是 Altimeter、Dragoneer、Greenoaks 和红杉,投后估值 9650 亿美元。这笔钱主要用来扩算力、做安全研究和把 Claude 塞进更多企业流程里。公司说月经常性收入(run-rate revenue)这个月刚过 470 亿美元,比 2 月份 G 轮时又涨了一截。算力方面,他们跟亚...
#Anthropic#Funding
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 估值冲到 9650 亿美元,把 OpenAI 甩在身后。但 650 亿融资额和近万亿估值之间的差距,说明这轮很可能不是纯现金交易,具体条款正文没细说。
锐评
Anthropic 这轮 H 轮融资把估值推到了 9650 亿美元,直接超过了 OpenAI,成了目前最贵的非上市 AI 公司。单轮融了 650 亿美元,这个数字本身就很大,但更值得看的是估值——接近 1 万亿,说明投资人赌的是它未来能吃掉很大一块企业级 AI 市场。 不过,正文只给了估值和融资额,没披露这 650 亿里多少是现金、多少是算力券或债务转换。近万亿估值对应多少年收入、客户数、毛利率,这些关键指标也完全没提。另外,多家信源都提到 IPO 在即,但没给出时间表或上市地。 我会先打个折:这种体量的融资,估值里通常夹着对赌条款和流动性偏好,实际到手能自由花的钱可能远小于 650 亿。想判断这估值是贵还是便宜,得等 S-1 文件出来看真实财务数据。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
17:44
61d ago
r/LocalLLaMA· rssEN17:44 · 05·28
Granite 4.1 从混合注意力改回纯 Transformer,8GB 显存下可用上下文从 128k 暴跌到 14k
Reddit 用户实测发现,Granite 4.1 把上一代混合 Mamba 注意力架构换回了纯 Transformer。代价很直接:8GB 显存下,能用的上下文从 128k 掉到约 14k,输入速度从约 1000 token/秒降到 300 token/秒,生成速度从 40 token/秒降到 15 token/秒。正文没披露为什么改回纯 Trans...
#Fine-tuning#Inference-opt#IBM#Commentary
一句话点评
IBM 把 Granite 4.1 从混合 Mamba 注意力架构改回纯 Transformer,代价是 8GB 显存下可用上下文从 128k 暴跌到约 14k,输入速度从 1000 token/秒降到 300 token/秒,生成速度从 40 token/秒降到 15 token/秒。正文没披露为什么改回纯 Transformer,也没说训练成本或评测分数。如果是为兼容性牺牲效率,那本地部...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
17:35
61d ago
AI HOT 精选· aihot-apiZH17:35 · 05·28
Replit 说有四步能防 AI 生成应用留后门,但没公开具体步骤
Replit 发帖称有一套四步流程,用来保障 vibecode(AI 写代码)应用的安全,避免发布时留下后门。但帖子只提了目标,没披露四步具体是什么、做了哪些技术检查、以及可复现的安全条件。信息缺口明显,目前只能当个预告看。
#Code#Safety#Replit#Product update
一句话点评
Replit 说有一套四步流程保 AI 写代码的应用安全,但帖子只画了饼,没披露四步具体是啥、做了哪些技术检查。目前就是个预告,信息缺口太大,没法判断靠不靠谱。
HKR 分解
hook knowledge resonance
打开信源
36
SCORE
H1·K0·R1
17:21
61d ago
● P1AI HOT 精选· aihot-apiZH17:21 · 05·28
Claude Code 现在能同时派几十上百个“子代理”分头干活
Claude Code 推出了动态工作流,一次会话里可以自动生成脚本、派出几十到几百个小代理(subagent)并行处理任务,做完还会先自己验证结果再交给你。目前是研究预览版,Max、Team 和开通了权限的企业用户能在命令行、桌面版、VS Code、API 以及 Amazon Bedrock 和 Vertex AI 上用到。正文没给出具体性能对比数据...
#Agent#Code#Tools#Anthropic
精选理由
精选 · 重要度 85 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude Code 能自己写脚本、派几十上百个小代理并行干活,做完还先自查再交差。但正文没给性能对比,实际省多少时间、会不会并行翻车还不清楚。
锐评
Anthropic 给 Claude Code 加了个动态工作流,简单说就是让模型在一次对话里自动拆任务、写脚本、生成几十到几百个小代理(subagent)并行执行,最后把结果汇总验证再给你。这比之前手动一步步调要省事,尤其适合批量改代码、跑测试、跨文件重构这类重复性工作。 目前是研究预览版,Max、Team 和开了权限的企业用户能在命令行、桌面版、VS Code、API 甚至 Amazon Bedrock 和 Vertex AI 上用到。覆盖面挺广,但正文没给出任何性能对比数据——比如同样一个重构任务,用动态工作流比不用快多少、token 消耗涨了多少、并行代理多了会不会互相踩脚。这些才是决定要不要切过去的关键。 另外,代理数量提到“几十到几百”,这个范围太宽了。上限几百个代理同时跑,调度和一致性怎么保证,正文也没展开。建议等有实际跑分或者社区反馈再判断,现在只能当个方向性更新看。
HKR 分解
hook knowledge resonance
打开信源
85
SCORE
H1·K1·R1
17:10
61d ago
Hacker News 首页· rssEN17:10 · 05·28
一项本可切断全美警用车牌识别系统(含Flock)资金的两党修正案被否决
一项两党联合提出的修正案(Amendment 221)在5月21日的众议院交通与基础设施委员会审议中被否决,投票结果为20票赞成、44票反对。该修正案仅一句话:任何接受联邦Title 23公路资金的政府实体,其车牌识别摄像头只能用于收费。由于Title 23覆盖全美约四分之一公共道路,每年向各州拨款约530-570亿美元,且几乎所有执法机构都接受这笔钱...
#Vision#Flock#Policy
一句话点评
一项两党修正案试图禁止警察用联邦公路资金搞车牌识别(LPR),包括Flock的摄像头,但5月21日在众议院委员会被否决,20:44票。修正案只有一句话:拿Title 23公路拨款(每年约530-570亿美元,覆盖全美四分之一公路)的机构,LPR只能用于收费。因为几乎所有执法机构都拿这笔钱,通过就等于全国禁用。Flock有5000多家执法客户,月读20亿次车牌,如果法案通过,它们得在联邦拨款和...
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
17:09
61d ago
彭博科技· rssEN17:09 · 05·28
比亚迪发布自研智驾芯片,号称国内最强,但算力、制程、量产时间都没说
比亚迪发布了一款自研的智能驾驶芯片,自称是中国目前最强大的车规级芯片。但正文没披露算力、制程工艺、量产时间以及具体装车条件,所以这个“最强”目前还只是一个口号,没法跟英伟达Orin或地平线征程系列做直接对比。如果是真的,比亚迪在智驾芯片上自给自足会省一大笔采购成本,但信息缺口太大,先别太激动。
#Robotics#BYD#Product update
一句话点评
比亚迪发了颗自研智驾芯片,号称中国最强车规级。但正文没披露算力、制程、量产时间和装车条件,这个“最强”目前没法跟英伟达Orin或地平线征程系列比。如果是真的,自给自足能省一大笔采购成本,但信息缺口太大,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
17:08
61d ago
r/LocalLLaMA· rssEN17:08 · 05·28
6GB显存能训什么模型?
Reddit用户问6GB显存能训什么模型,目标是用传感器读数做响应。正文没披露能跑多大模型、用什么方法、batch设多少,也没跟vast.ai租显存比成本。6GB显存大概只够跑7B以下模型做LoRA微调,batch size得压到1-2,训练速度会很慢。
#Fine-tuning#Reddit#vast.ai#FunctionGemma
一句话点评
6GB显存基本只能跑7B以下模型的LoRA微调,batch size得压到1-2,训练速度会很慢。正文没披露具体模型大小、方法和batch设置,也没跟vast.ai租显存比成本。如果是用传感器读数做响应,小模型加LoRA可能够用,但效果和速度都得打折。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H0·K0·R1
17:05
61d ago
● P1AI HOT 精选· aihot-apiZH17:05 · 05·28
Claude Opus 4.8 发布:编码和操控浏览器更强,快速模式降价三分之二
Anthropic 把 Opus 升级到了 4.8,价格和 4.7 一样。主要提升在写代码和让模型自己操作网页完成任务上:在 Online-Mind2Web 这个测浏览器操控能力的基准上拿了 84%,漏掉的代码错误比之前少了大约 75%。新加了一个 2.5 倍速的快速模式,费用降到了之前的三分之一。早期用户反馈它更诚实,不会在证据不足时硬说搞定了,做复...
#Agent#Reasoning#Code#Anthropic
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
Opus 4.8 在浏览器操控基准上拿了 84%,漏代码错误少了约 75%,还出了个 2.5 倍速模式,费用降到之前的三分之一。
锐评
Anthropic 把 Opus 4.8 定位成一次加量不加价的升级,价格和 4.7 持平。最实在的改进在写代码和让模型自己操作网页干活这两块:Online-Mind2Web 这个测浏览器操控能力的基准上拿了 84%,漏掉的代码错误比之前少了大约 75%。新加的快速模式把速度拉到 2.5 倍,费用降到之前的三分之一,对高频调用场景挺省钱。早期用户反馈它更诚实,不会在证据不足时硬说搞定了,做复杂任务时会先确认再动手,这点对放进业务流程里跑很重要。 不过这篇公告是 Anthropic 自己发的,引用的用户评价都来自合作方,没有独立第三方的对照测试。系统卡里应该有更完整的评估,但正文没给出快速模式下能力会不会打折、延迟具体是多少。另外,跟 GPT-5.5 的对比只出现在个别用户引语里,缺少系统性的横向数据。如果你主要用它写代码或做网页自动化,漏错误少了 75% 是个值得试的信号;但如果是其他场景,等独立评测出来再判断会更稳。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
17:00
61d ago
● P1TechCrunch AI· rssEN17:00 · 05·28
Anthropic 发了 Opus 4.8,带了个能调度一群子模型干活的动态工作流工具
Opus 4.8 这次配了一个叫 Dynamic Workflows 的工具,核心作用是让一个主模型像工头一样,协调一堆子模型分头执行任务。正文没提价格、上下文窗口多大、跑分成绩,也没说什么时候能用上。
#Agent#Tools#Anthropic#Product update
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 发了 Opus 4.8,配了个让主模型当工头指挥子模型干活的工具,但价格、跑分、窗口大小全没提。
锐评
Opus 4.8 这次最大的变化是带了一个叫 Dynamic Workflows 的工具,思路是让一个主模型像工头一样,把任务拆给一群子模型分头执行。这比单模型从头跑到尾更灵活,理论上能处理更复杂的多步骤任务。但正文只给了一句话,没披露任何关键指标:价格、上下文窗口多大、跑分对比、延迟表现、子模型之间怎么通信,这些全不知道。 从产品节奏看,Anthropic 在推 agent 工作流,想让模型进业务流程干活。但没跑分和定价,就没法判断这代模型是实打实的提升还是功能包装。另外,子模型群(swarm)的协调成本和出错率也没提,实际用起来可能比听起来麻烦。 我会先打个折:工具思路对,但信息缺口太大,等有实测和定价再判断值不值得切。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
17:00
61d ago
● P1The Verge · AI· rssEN17:00 · 05·28
Claude Opus 4.8 发布,主打“老实”:不确定时会直说,瞎编的概率降到前代的四分之一
Anthropic 周四放出 Claude Opus 4.8,这次没吹性能天花板,而是强调模型更“诚实”。公司说早期测试者发现它更愿意主动标注自己没把握的地方,而不是硬编一个听起来合理的答案。内部评测给了一个具体数字:Opus 4.8 做出无据论断的概率大约是前代模型的四分之一。不过正文没披露这个评测的具体基准和对比对象,我会先打个折——四倍改善听起来...
#Alignment#Safety#Reasoning#Anthropic
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 说新模型 Opus 4.8 更“诚实”,会主动承认自己没把握,但四倍改善这个数字没公布具体怎么测的,先别太激动。
锐评
Claude Opus 4.8 这次没拼跑分,而是把“诚实”当卖点,说模型更愿意标注自己不确定的地方,而不是硬编答案。内部评测给了一个很抓眼球的数据:做出无据论断的概率大约是前代的四分之一。但正文没披露这个评测的具体基准、对比对象和测试集,四倍改善听起来很猛,实际效果得看第三方怎么复现。 对从业者来说,这条更新指向一个很实际的问题:模型在业务流程里干活时,能不能在没把握的时候主动停住,而不是悄悄出错。Anthropic 没提这种“诚实”是靠对齐训练还是推理时的机制实现的,也没说主动标注不确定性会不会让模型变得过于保守、拒绝回答正常问题。这两点会直接影响它能不能真的进生产环境。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
16:05
61d ago
r/LocalLLaMA· rssEN16:05 · 05·28
Qwen3.6 35B 输出格式测试:Markdown 比 HTML 快 3 倍,得分还更高
一位用户在 Q8 精度下测试了 Qwen3.6 35B A3B 模型用五种格式输出的效果。Markdown 得分最高(78/100),而带 CSS 的 HTML 生成了 10,290 个 token,耗时 82 秒——token 量是纯文本的 5 倍,速度也慢很多。结论是:如果只是让模型写东西,Markdown 性价比最高;HTML 排版虽好看,但代价...
#Reasoning#Benchmarking#Code#Qwen
一句话点评
Qwen3.6 35B 用五种格式输出,Markdown 得分最高(78/100),带 CSS 的 HTML 生成了 10290 token,耗时 82 秒——token 量是纯文本的 5 倍,速度也慢很多。结论很直白:写东西选 Markdown 性价比最高,HTML 排版好看但代价太大。测试只在 Q8 精度下跑了一次,样本少,结论仅供参考。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
16:02
61d ago
AI HOT 精选· aihot-apiZH16:02 · 05·28
微软开源 Data Formulator:用 AI 智能体帮你拖拽分析企业数据
微软研究院开源了 Data Formulator,一个面向企业数据工作流的 AI 分析工具。它把原始数据导入一个 AI 就绪的工作空间,用户可以用 AI 智能体(相当于一个会干活的助手)来探索、分析和可视化数据,把表格变成可操作的洞察。正文没披露定价、部署方式以及数据如何连接到系统,所以实际落地成本和安全验证还不清楚。
#Agent#Tools#Data Formulator#Product update
一句话点评
微软开源了 Data Formulator,把原始数据导入一个 AI 工作空间,用智能体帮你分析、画图。相当于给 Excel 配了个会干活的助手。但正文没提定价、部署方式、数据怎么连进去,所以实际落地成本和安全验证还不清楚。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K1·R0

更多

频道

后台