ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-06-05

50 items · updated 3m ago
RSS live
2026-06-05 · 星期五2026年6月5日
21:14
52d ago
Product Hunt · AI· rssEN21:14 · 06·05
Toyo:一个住在 iMessage 里、还能打电话给你的 AI 执行助理
Toyo 是一个嵌入 iMessage 的 AI 助手,你不需要下载新 App,像跟同事发消息一样跟它聊天就行。它还能主动打电话给你汇报进展。功能上,它能帮你筛邮件、准备会议、推进项目,并从公司内部工具里拉取上下文。正文没披露它用的是什么模型、定价多少、以及具体接入了哪些企业工具,所以技术细节和成本都还不清楚。
#Audio#Toyo
一句话点评
Toyo 把 AI 助手塞进 iMessage,不用下新 App,还能主动打电话汇报进展,交互门槛确实低。功能上能筛邮件、准备会议、拉公司工具上下文,听起来像个轻量级执行助理。但正文没披露用啥模型、定价多少、接入了哪些企业工具,技术细节和成本全是盲区。如果是真的,对懒得装新 App 的团队挺友好,但效果和安全性得打个问号。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
21:05
52d ago
r/LocalLLaMA· rssEN21:05 · 06·05
OpenLumara:一个专为本地模型写的AI代理,系统提示词只有4k token
OpenLumara 是一个开源的 AI 代理(让模型能调用工具、执行任务的框架),默认系统提示词只有约 4k token,比主流方案轻很多。所有模块都可以随时替换,默认不开放 shell 权限,但支持通过 Docker 或 Podman 跑沙箱来执行命令。项目用 GPL2 许可证发布,代码从零手写,不是靠 vibe coding 堆出来的。正文没披露...
#Agent#Code#Tools#OpenLumara
一句话点评
OpenLumara 是一个专为本地模型设计的开源 AI Agent 框架,默认系统提示词仅约 4k token,比主流方案轻很多。所有模块可随时替换,默认不开放 shell 权限,但支持 Docker/Podman 沙箱执行命令。代码从零手写,不是 vibe coding 堆出来的。正文被 Reddit 屏蔽,未披露具体性能测试或与其他框架的对比。短评:轻量、模块化、本地优先,但缺实测数据...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
21:02
52d ago
● P1AI HOT 精选· aihot-apiZH21:02 · 06·05
Apollo 和 Blackstone 凑了 350 亿美元帮 Anthropic 买芯片
两家资管巨头 Apollo 和 Blackstone 给 Anthropic 搞了一笔 350 亿美元的债务融资,专门用来扩建 AI 算力基础设施。这笔钱主要花在采购芯片上,但报道没披露具体芯片型号、债务条款和交付时间表。350 亿这个数字说明 AI 军备竞赛的烧钱速度已经拉到主权基金级别了,不过靠借债而不是股权融资来买硬件,财务压力会直接挂在资产负债...
#Apollo Global Management#Blackstone#Anthropic#Funding
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
350 亿美元靠借债买芯片,Anthropic 的资产负债表压力拉满了,但报道没写利率和抵押物,这笔账划不划算还不好说。
锐评
Apollo 和 Blackstone 联手给 Anthropic 凑了 350 亿美元债务,专门用来采购 AI 芯片、扩建算力。这个数字把 AI 军备竞赛的烧钱门槛直接拉到了主权基金级别。靠借债而不是股权融资来买硬件,好处是不稀释现有股东,坏处是财务压力会直接挂在公司账上,未来现金流得先还债。 报道没披露具体芯片型号、债务条款和交付时间表,所以没法判断这笔钱到底买了多少有效算力,以及 Anthropic 要背多高的利息。350 亿这个数本身说明资管巨头在赌 AI 基础设施的长期回报,但债务结构下,一旦模型商业化速度跟不上还款节奏,风险会很大。 还缺几个关键信息:这笔债的利率、期限和抵押物是什么,芯片采购的具体分配(训练还是推理),以及 Anthropic 目前的营收能不能覆盖利息。这些没出来之前,先别急着说这是“信心票”,更像是一场高杠杆的豪赌。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
21:02
52d ago
● P1彭博科技· rssEN21:02 · 06·05
Apollo 完成 350 亿美元债务融资,专款给 Anthropic 买 AI 芯片
Apollo 已经把这笔 350 亿美元的债包好了,钱指定用来给 Anthropic 采购 AI 芯片。报道没提具体买什么型号、找谁供货、利率多少,也没说芯片什么时候能到货。350 亿这个数字很大,说明 Anthropic 在算力扩张上下了重注,但融资结构是债不是股权,意味着将来是要还的,成本压力会直接压在未来的营收上。
#Apollo#Anthropic#Bloomberg#Funding
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 靠借 350 亿美元买芯片,不是融资是背债,将来营收压力会很大。但正文没披露芯片型号、供应商和利率,这笔账到底划不划算还不好说。
锐评
Apollo 把这笔 350 亿美元的债包好了,钱指定给 Anthropic 买 AI 芯片。350 亿这个数字很大,说明 Anthropic 在算力扩张上下了重注,但融资结构是债不是股权,意味着将来是要还的,成本压力会直接压在未来的营收上。 报道没提具体买什么型号、找谁供货、利率多少,也没说芯片什么时候能到货。这些信息缺口让外人很难判断这笔交易的实际成本——利率高的话,财务负担会很重;芯片交付延迟的话,算力扩张的时间表也会被打乱。 我会先打个折看待这条消息:金额够大,但关键条款全缺,更像是一个融资阶段的宣告,离真正把芯片用上还有距离。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
21:01
52d ago
r/LocalLLaMA· rssEN21:01 · 06·05
Gemma 4 QAT 实测:AMD 7900 XTX 单卡提速 45%,省 5.7GB 显存,质量不掉
有人在 AMD 7900 XTX 单卡上测了 Gemma 4 的量化感知训练(QAT)版本,跑 12B 模型生成时间从 323 秒降到 176 秒,快了近一半,显存省了 5.7GB,而且所有测试 prompt 的质量都没掉。QAT 相当于在训练阶段就让模型适应低精度,比事后硬压效果好。不过原文被 Reddit 屏蔽了,具体怎么做的 QAT、用了什么数据...
#Inference-opt#Benchmarking#Gemma#AMD
一句话点评
AMD 7900 XTX 单卡跑 Gemma 4 12B,QAT 版生成时间从 323 秒降到 176 秒,省了 5.7GB 显存,质量没掉。QAT 就是在训练时让模型适应低精度,比事后硬压效果好。但原文被 Reddit 屏蔽,具体怎么做的 QAT、用了什么数据、是否只测了特定 prompt 都没披露,复现门槛未知。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
20:51
52d ago
● P1AI HOT 精选· aihot-apiZH20:51 · 06·05
SpaceX 与 Google 签下云算力大单,Google 每月付 9.2 亿美元用 xAI 数据中心
SpaceX 披露了一份云服务协议,Google 每月向 SpaceX 支付 9.2 亿美元,换取 xAI 数据中心的计算能力,折合一年约 110 亿美元。正文没披露合同期限、GPU 规模或交付条款。这笔钱说明 AI 算力已经像电力或发射能力一样,成了可以单独定价、单独交易的基础资源。
#Inference-opt#SpaceX#Google#xAI
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Google 每月付 SpaceX 9.2 亿美元买 xAI 数据中心的算力,一年就是 110 亿。但正文没写合同签了几年、用多少张 GPU、什么时候开始交付,这笔账先别急着算。
锐评
这条消息的核心不是两家公司合作,而是 AI 算力已经变成一种可以单独定价、按月结算的大宗商品。Google 每月掏 9.2 亿美元,一年下来 110 亿,这个数字放在任何行业都算得上重注。但正文只给了一个金额,合同期限、GPU 规模、交付条款全都没披露,所以没法判断这是长期锁价还是短期抢货。 值得留意的是交易结构:SpaceX 收钱,算力却来自 xAI 的数据中心。这像是马斯克系内部资源打包对外卖,SpaceX 可能扮演了渠道或基础设施提供方的角色。如果 Google 买的是推理算力,那说明 xAI 的集群已经能对外商用;如果是训练算力,那 Google 自己的 TPU 都没满足需求,缺口不小。 还缺几个关键信息:算力具体用在哪类任务上、交付有没有性能保障、价格里包不包含电力和冷却成本。这些不补上,110 亿更像一个标题数字,实际价值要打折扣。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
20:22
52d ago
● P1FT · 科技· rssEN20:22 · 06·05
特朗普称美国政府可能入股AI公司
特朗普公开表示美国可能直接持有 AI 公司的股权。但 FT 这篇报道正文被付费墙挡住了,没披露具体要投多少钱、瞄准哪些公司、通过什么交易结构或政策机制来执行。光看标题像是一个重大政策转向的信号,但关键细节目前全是空白,先别急着下判断。
#Donald Trump#Financial Times#Policy#Funding
精选理由
精选 · 重要度 100 · 吸引力 + 共鸣
一句话点评
特朗普想用公共财富基金直接入股 OpenAI 这类 AI 公司,但 FT 正文被付费墙挡了,具体入股比例、资金来源和操作路径都没披露。
锐评
这条消息的核心是:美国政府可能不再只当监管者,而是想直接当 AI 公司的股东。特朗普提的方案是通过公共财富基金来持股,这跟之前给美国人发“AI 分红”的设想是一套逻辑——把 AI 视为国家基础设施,收益要回流给公众。但目前所有报道都卡在“正在讨论”阶段,FT 的原文还锁在付费墙后面,我们看不到具体谈判细节。 这里有几个关键缺口:第一,入股的钱从哪来,是财政拨款还是发债;第二,持股比例和投票权怎么设计,会不会干预公司运营;第三,OpenAI 正在从非营利转向营利性公司,这个时间点谈入股,是趁火打劫还是顺势接盘。这些都没说清楚。 对从业者来说,如果美国政府真成了大股东,AI 出口管制、数据合规、模型开源这些政策都可能变得更硬。但眼下这事还停留在政治表态层面,先别急着调整策略。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K0·R1
20:22
52d ago
彭博科技· rssEN20:22 · 06·05
英国央行行长警告:能源不够用,AI 可能要“限电”
英国央行行长安德鲁·贝利说,有限的能源容量可能会限制 AI 在各经济领域的部署。正文没披露具体的限电机制、时间表或缺口数字,所以这点先别太激动——目前只是一个方向性警告,不是政策文件。
#Bank of England#Andrew Bailey#Policy#Commentary
一句话点评
英国央行行长贝利警告:能源容量有限,可能限制AI在各行业的部署。但正文没披露限电机制、时间表或缺口数字,所以这点先别太激动——目前只是一个方向性警告,不是政策文件。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
20:18
52d ago
Product Hunt · AI· rssEN20:18 · 06·05
Charlie Labs 发布 Daemons:让 AI 代理自动盯 PR、Issue 和 CI,不用等人来催
Charlie Labs 今天在 Product Hunt 上架了 Daemons,一组常驻仓库的 AI 代理,能自动监控 PR、Issue、CI、文档和 Sentry 报错。它们直接在 GitHub、Linear、Slack 和 Sentry 里留下可审查的更新,团队不用再等人手动触发。页面写了“免费选项”,但没披露具体定价,这点先别太激动。如果是真...
#Charlie Labs#GitHub#Linear
一句话点评
短评:常驻仓库的AI代理,自动盯PR、Issue、CI和报错,不用等人手动触发。免费选项存在但定价没写,先别激动。 点评:Charlie Labs在Product Hunt上架了Daemons,一组常驻仓库的AI代理,能自动监控PR、Issue、CI、文档和Sentry报错,直接在GitHub、Linear、Slack里留下可审查的更新。说白了就是让AI在开发流程里当个24小时值班的助手,...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
20:10
52d ago
r/LocalLLaMA· rssEN20:10 · 06·05
一台10年前的Xeon就能跑本地模型
Reddit帖子声称一台2016年的Xeon处理器就够跑本地模型,但正文只链接了一个“Gemma 4 on a 2016 Xeon”的页面,没有披露模型大小、量化方式、吞吐量或硬件配置。信息缺口很大,无法验证实际效果。
#Inference-opt#Reddit#LocalLLaMA#Gemma
一句话点评
短评:标题党,正文只扔了个链接,没跑分没配置,先别信。 Reddit 帖子标题说“10年前的Xeon就够了”,但正文只链了一个“Gemma 4 on a 2016 Xeon”页面,没有披露模型大小、量化方式、吞吐量或硬件配置。信息缺口很大,无法验证实际效果。如果真能跑,可能是极低比特量化或极小模型,但正文没给任何数字,连是4bit还是8bit都没说。建议等实测数据,别急着翻旧服务器。
HKR 分解
hook knowledge resonance
打开信源
47
SCORE
H1·K0·R1
20:06
52d ago
● P1Hacker News 首页· rssEN20:06 · 06·05
Google与SpaceX签订计算算力协议每月支付9.2亿美元
CNBC 报道,Google 和 SpaceX 签了一份算力租用合同,每月支付 9.2 亿美元,用的是 xAI 数据中心里的计算资源。报道只给了这个单月金额,没写合同签了多久、总共涉及多少块 GPU、以及算力具体怎么交付。如果按一年算,这笔合同价值超过 110 亿美元,对数据中心租赁来说是个很大的单子。不过正文没披露 Google 拿到的算力规模,也没...
#Inference-opt#Google#SpaceX#xAI
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
Google每月付SpaceX 9.2亿美元租GPU,总合同300亿。但别急着算每卡单价,正文没披露具体芯片型号和数量,算力密度完全未知。
锐评
这笔交易最值得盯的不是金额本身,而是“SpaceX作为算力房东”这个角色。Google以每月9.2亿美元、总价300亿美元的规模向SpaceX采购计算能力,合同期限和具体交付节点正文没提,但月付近十亿的量级已经超过多数云厂商单季度资本开支。 关键信息缺口很大:SpaceX的算力到底部署在哪、用的是谁家的GPU、电力成本怎么摊、Google是直接租裸金属还是带软件栈的服务,这些都没披露。有来源暗示算力可能落在xAI的数据中心里,如果属实,等于Google间接给竞争对手的关联公司输血,这层利益冲突比合同金额更值得追问。 对从业者来说,这条消息的信号是:头部大模型公司对算力的饥渴已经逼出非传统供应商,连火箭公司都开始做IDC生意了。但没看到交付时间表和性能基准前,300亿这个数字先打个七折看。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
20:00
52d ago
AI HOT 精选· aihot-apiZH20:00 · 06·05
英伟达发 Nemotron 3 Ultra 教程,但没提参数、价格和跑分
英伟达官方发了 Nemotron 3 Ultra 的配置教程和演示,说可以在你喜欢的智能体框架(让模型进业务流程干活)里直接用。但正文没披露模型参数量、定价、跑分或上线条件,目前只能看演示,没法判断实际效果和成本。
#Agent#NVIDIA AI#Nemotron#Product update
一句话点评
英伟达发了 Nemotron 3 Ultra 的配置教程和演示,说能在你用的智能体框架里直接跑。但正文没披露参数量、定价、跑分或上线条件,目前只能看演示,没法判断实际效果和成本。短评:教程有了,但没参数没定价,先别急着用。
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K0·R0
19:46
52d ago
r/LocalLLaMA· rssEN19:46 · 06·05
R9700 32GB 单卡跑 Qwen3 三款模型,实测数据没给全
Reddit 用户 TimmyIT 用一张 R9700 32GB 显卡,分别跑了 Qwen3-8B、14B 和 32B 的 Q4_K_M 量化版,测试工具是 llama-bench。帖子只贴了结果截图,没写具体吞吐量数字,所以没法直接对比速度。如果你也在考虑单卡跑 Qwen3 大模型,这个测试方向有用,但正文没披露具体数据,参考价值有限。
#Benchmarking#Inference-opt#Qwen#TimmyIT
一句话点评
短评:单卡跑Qwen3三兄弟,方向有用但没数据。 点评:Reddit用户TimmyIT用一张R9700 32GB显卡,分别跑了Qwen3-8B、14B和32B的Q4_K_M量化版,测试工具是llama-bench。帖子只贴了结果截图,没写具体吞吐量数字,所以没法直接对比速度。如果你也在考虑单卡跑Qwen3大模型,这个测试方向有用,但正文没披露具体数据,参考价值有限。另外,R9700是AMD...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R1
19:45
52d ago
Product Hunt · AI· rssEN19:45 · 06·05
ZeroGPU:用闲置设备跑小模型,替代大模型推理
ZeroGPU 的逻辑是:不是所有任务都需要最强模型。它用混合边缘网络上的小模型处理 70–80% 的生产任务,声称能达到前沿模型的准确率。速度号称快 10 倍,成本低 50%。核心是复用现有算力,而不是新建 GPU 集群。正文没披露具体支持哪些模型、真实延迟数据,也没说边缘网络用的是用户设备还是第三方节点。
#ZeroGPU#Product Hunt
一句话点评
ZeroGPU 的逻辑是:不是所有任务都需要最强模型。它用混合边缘网络上的小模型处理 70–80% 的生产任务,声称能达到前沿模型的准确率。速度号称快 10 倍,成本低 50%。核心是复用现有算力,而不是新建 GPU 集群。正文没披露具体支持哪些模型、真实延迟数据,也没说边缘网络用的是用户设备还是第三方节点。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
19:23
52d ago
r/LocalLLaMA· rssEN19:23 · 06·05
量化感知训练(QAT)是什么?
Reddit 用户问量化感知训练(QAT)是什么,以及 Gemma 4 的 QAT 量化版能否在 4GB 显存 + 16GB 内存下跑。正文只披露了 Gemma 4 26B MoE 的 IQ2 NL 量化版在 9 层卸载到 GPU 时跑出 8.5–9 TPS,没提 4GB 显存的具体表现,也没解释 QAT 原理。简单说,QAT 是在训练阶段就让模型适应...
#Fine-tuning#Inference-opt#Reddit#Gemma
一句话点评
QAT 就是在训练时让模型提前适应低精度,这样量化后掉精度更少。Gemma 4 26B MoE 的 IQ2 NL 版在 9 层卸载到 GPU 时跑出 8.5–9 TPS,但 4GB 显存 + 16GB 内存的具体表现没披露。如果是真的,这个速度在低显存设备上挺实用,但 QAT 原理和训练成本正文都没讲清楚。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K1·R1
19:07
53d ago
AI HOT 精选· aihot-apiZH19:07 · 06·05
Claude 让 rsync 变烂了吗?有人真去数了 bug
一篇数据分析文章,用 rsync 每个版本的 bug 数据做了个简单统计:Claude 辅助开发后的版本,bug 率是否异常偏高?方法是用“每 10 次提交的 bug 数”做精确置换检验,看 Claude 版本落在历史分布的哪个位置。正文没披露最终结论,但作者强调所有数字和图表由 Python 脚本自动生成,避免幻觉。背景是 2026 年 5 月 rs...
#Code#Claude#rsync#Hacker News
一句话点评
一篇用 rsync 各版本 bug 数据做的统计,核心问题是:Claude 辅助开发后的版本,bug 率是否异常偏高?方法是用“每 10 次提交的 bug 数”做精确置换检验,看 Claude 版本落在历史分布的哪个位置。正文没披露最终结论,但作者强调所有数字和图表由 Python 脚本自动生成,避免幻觉。背景是 2026 年 5 月 rsync 因一条无证据的 Mastodon 帖子被骂上...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
18:50
53d ago
Hacker News 首页· rssEN18:50 · 06·05
Transformer 天生就擅长压缩信息
这篇被 ICLR 2026 选为三篇杰出论文之一的工作,核心观点是 Transformer 架构本身就有一种“简洁”倾向——它不需要额外设计就能用更少的 token 表达更多信息。正文目前只有标题和获奖信息,没有披露具体的模型设置、证明细节或实验。所以目前只能知道结论,没法判断这个“简洁”到底省了多少 token、在什么任务上有效、跟现有压缩方法比怎么样。
#Reasoning#ICLR#Research release
一句话点评
ICLR 2026 杰出论文,说 Transformer 天生就“简洁”——用更少 token 表达更多信息,不需要额外设计。但正文只有标题和获奖信息,没披露模型设置、证明细节或实验。目前只能知道结论,没法判断这个“简洁”到底省了多少 token、在什么任务上有效、跟现有压缩方法比怎么样。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
18:20
53d ago
Hacker News 首页· rssEN18:20 · 06·05
OpenAI 用 Codex 写了一个完整产品,零行人工代码
OpenAI 团队用 Codex 代理(让模型自动写代码、跑测试、修 bug)在五个月内从零构建了一个内部软件产品,零行人工代码。最终代码量约一百万行,由三个工程师驱动,平均每人每天合入 3.5 个 PR,开发速度估计是手写的 10 倍。核心做法是:人类只写提示词、设计环境和反馈回路,代理负责执行。团队发现瓶颈不在代码生成,而在人类 QA 能力——于是...
#Agent#Code#Tools#OpenAI
一句话点评
OpenAI 用 Codex 代理(自动写代码、跑测试、修 bug)五个月从零造了一个内部产品,零行人工代码,最终约一百万行。三个工程师驱动,平均每人每天合入 3.5 个 PR,开发速度估计是手写的 10 倍。核心做法:人类只写提示词、设计环境和反馈回路,代理负责执行。团队发现瓶颈不在代码生成,而在人类 QA 能力——于是他们开始思考怎么让代理自己验证自己。 短评:一个极端的“纯代理开发”...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
18:12
53d ago
● P1FT · 科技· rssEN18:12 · 06·05
Meta 考虑通过增发股票筹资数百亿美元用于 AI 基础设施
FT 这篇报道的正文被付费墙挡住了,只留了个标题和摘要。标题里提到两件事:一是 Meta 刚谈成了一笔“轰动性的谷歌交易”,二是它正考虑通过增发股票筹集数百亿美元,用来砸在 AI 基础设施上。但具体谷歌这笔交易是什么内容、规模多大、什么时候签的、价格怎么算,正文没披露,所以没法判断这单子到底有多“轰动”。增发股票这事也还停留在“考虑”阶段,没有公布时间...
#Meta#Google#Funding
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Meta 在跟 Google 签完大单后,考虑发新股筹几百亿美元砸 AI 基建,但 FT 正文被付费墙挡了,具体金额和条款都没看到。
锐评
这条消息的核心是 Meta 可能要通过增发股票来融资,规模是“数百亿美元”,用途是 AI 基础设施。先打个折:FT 的报道正文我们没拿到全文,只看到了标题和网站导航,所以具体数字、时间表、是直接发新股还是发可转债、以及跟 Google 那笔“轰动性交易”到底是什么关系,这些关键信息全是缺口。 从已知标题判断,Meta 在跟 Google 达成某笔大交易后立刻考虑股权融资,说明 AI 军备竞赛的烧钱速度可能超出了它现有现金流的承受范围。几百亿美元的规模不是小数目,如果落地,会是科技巨头里比较罕见的公开市场融资动作。但没看到条款前,没法判断这是常规财务操作还是真的资金吃紧。 还缺什么:FT 原文的完整细节、Meta 官方回应、以及这笔钱具体会投向算力芯片、数据中心还是自研模型训练。这些没补上之前,只能当一条信号很强的传闻看。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
18:08
53d ago
彭博科技· rssEN18:08 · 06·05
轨道数据中心面临太空挑战
Starcloud CEO 谈在轨建设与维护数据中心,前提是 SpaceX 最终想在轨道上部署 100 吉瓦的 AI 算力。正文被 Bloomberg 的机器人检测墙挡住,没披露任何技术细节、成本或时间表。100 吉瓦这个数字很大——相当于几十个大型核电站的装机容量,但完全在太空实现,供电、散热、维护都是未知数。目前只能确认有人想干这事,具体怎么干、多...
#Inference-opt#Starcloud#Philip Johnston#SpaceX
一句话点评
SpaceX 想在轨道上部署 100 吉瓦 AI 算力,相当于几十个核电站的装机容量,但全文被 Bloomberg 机器人墙挡住,没披露任何技术细节、成本或时间表。目前只能确认有人想干这事,供电、散热、维护全是未知数。短评:太空数据中心画饼很大,但正文一个字没看到,先别激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
17:52
53d ago
彭博科技· rssEN17:52 · 06·05
耶鲁预算实验室:AI 没让公司少招人
耶鲁预算实验室执行主任 Martha Gimbel 说,5 月就业报告比预期强,经济数据里看不到 AI 对招聘有显著影响。换句话说,目前没有证据表明企业因为上了 AI 就砍人头。正文没披露具体行业或岗位的拆分,所以这点先别太激动——宏观数据平滑了结构差异,可能某些岗位已经被替代了但被其他岗位的增长盖住了。
#Yale Budget Lab#Martha Gimbel#Bloomberg#Commentary
一句话点评
耶鲁预算实验室主任说5月就业数据比预期强,宏观上没看到AI导致企业砍人。但正文没拆分行业和岗位,可能某些岗位已被替代,只是被其他增长盖住了。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
17:50
53d ago
AI HOT 精选· aihot-apiZH17:50 · 06·05
跟AI智能体协作应该像跟同事聊天打手势一样自然
这篇帖子主张AI智能体之间的协作应该支持文本聊天、对着屏幕做手势和实时对话,而不是靠复杂的API或结构化指令。正文没有披露任何产品、模型、基准测试或实现细节,所以这更像一个设计理念的呼吁,而非技术方案。
#Agent#Multimodal#Tools#Commentary
一句话点评
这篇帖子主张AI智能体之间应该像同事一样聊天、比划屏幕、实时对话,而不是靠复杂的API或结构化指令。理念听着挺自然,但正文没披露任何产品、模型、基准测试或实现细节,所以这更像一个设计愿景的呼吁,而非可落地的技术方案。目前信息缺口很大:没有说用什么模型、怎么实现手势识别、延迟多高、验证过哪些场景。如果真能做成,确实能降低agent协作的工程门槛,但这点先别太激动,等看到demo或论文再说。
HKR 分解
hook knowledge resonance
打开信源
28
SCORE
H0·K0·R0
17:31
53d ago
r/LocalLLaMA· rssEN17:31 · 06·05
Gemma 4 12B 写代码和调工具其实没坏,但得用对聊天模板
Reddit 用户发现 Gemma 4 12B 在 OpenCode 里调用工具一直失败,问题出在聊天模板上。用 llama.cpp 从源码编译,再配合自定义 Jinja 模板(示例用的是 unsloth/gemma-4-12b-it-GGUF 的 8-bit 量化版 UD-Q8_K_XL),工具调用就正常了。正文没披露具体模板内容,但至少说明模型本身...
#Code#Tools#Gemma#llama.cpp
一句话点评
Gemma 4 12B 代码和工具调用翻车,问题出在聊天模板,不是模型本身。用 llama.cpp 源码编译加自定义 Jinja 模板就能修好,示例用了 8-bit 量化版。正文没披露具体模板内容,修复门槛偏高,普通用户可能搞不定。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
17:27
53d ago
Hacker News 首页· rssEN17:27 · 06·05
Sakana AI 成立 RSI 实验室:让 AI 自己改自己,目标是少花算力也能迭代
Sakana AI 宣布成立 RSI(递归自我改进)实验室,核心思路是让 AI 系统自己写代码、做实验、改架构,形成自动升级循环,而不是靠堆算力。他们之前已经做了几个相关项目:LLM-Squared 让大模型自己发明训练算法,发现了一个叫 DiscoPOP 的偏好优化方法;Darwin Gödel Machine 让智能体自己改代码,在 SWE-ben...
#Reasoning#Sakana AI#Research release
一句话点评
Sakana AI 正式成立 RSI 实验室,核心思路是让 AI 自己写代码、做实验、改架构,形成自动升级循环,而不是靠堆算力。他们之前几个项目挺实在:LLM-Squared 让大模型自己发明了偏好优化方法 DiscoPOP;Darwin Gödel Machine 让智能体自己改代码,在 SWE-bench 上性能翻倍;ShinkaEvolve 只用 150 个样本就解决了复杂优化问题。这...
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
17:09
53d ago
AI HOT 精选· aihot-apiZH17:09 · 06·05
Riverflow 2.5:能调评分标准的图像模型,免费到6月9日
OpenRouter 上架了 Sourceful 的 Riverflow 2.5,号称首个可独立控制评分标准的图像模型。你可以自己定标准来引导模型怎么想、怎么改图,还能调节推理努力,在速度和画质之间做取舍。目前免费到6月9日,之后有 Fast 和 Pro 两档,但正文没披露具体价格和跑分结果,所以实际效果和成本还得等实测。
#Vision#Reasoning#Inference-opt#OpenRouter
一句话点评
OpenRouter 上架了 Sourceful 的 Riverflow 2.5,号称首个可独立控制评分标准的图像模型。你可以自己定标准来引导模型怎么想、怎么改图,还能调节推理努力,在速度和画质之间做取舍。目前免费到6月9日,之后有 Fast 和 Pro 两档,但正文没披露具体价格和跑分结果,所以实际效果和成本还得等实测。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
17:06
53d ago
AI HOT 精选· aihot-apiZH17:06 · 06·05
ChatGPT 网页版现在能直接写邮件并发送
ChatGPT 网页版新增了一个功能:在写作块里写完邮件后,可以直接点发送,不用复制粘贴到邮箱。正文没披露支持哪些邮箱服务商、是否全量上线、以及有没有权限控制(比如能不能限制只发给某些人)。目前看是个小便利,适合快速回复或草稿场景。
#Tools#ChatGPT#OpenAI#Product update
一句话点评
ChatGPT 网页版现在能直接在写作块里发邮件,省了复制粘贴的步骤。小便利,适合快速回复或草稿场景。但正文没披露支持哪些邮箱服务商、是否全量上线、有没有权限控制(比如限制只发给某些人)。这点先别太激动,可能只是部分用户能用。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
17:05
53d ago
FT · 科技· rssEN17:05 · 06·05
树莓派销量超预期,投资者押注AI硬件需求
树莓派预计上半年销量超过400万台,原因是低价微型电脑需求强劲。投资者看好这类硬件与AI的结合,但正文没披露具体股价涨幅、估值或AI硬件用例。
#Raspberry Pi#Product update
一句话点评
树莓派上半年销量预计超400万台,投资者赌它搭上AI硬件快车。但正文没披露具体股价涨了多少、估值多少,也没说清楚AI到底怎么用在这块板子上——是当边缘推理设备还是当机器人控制器?这点先别太激动。400万台对树莓派不算夸张,之前高峰期年销千万级。关键是AI用例落地情况,正文没给。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R0
16:53
53d ago
彭博科技· rssEN16:53 · 06·05
动物园老虎和豹子成了数据中心的新对手
彭博报道,纳什维尔一个拟建的数据中心遭到当地动物园反对,原因是老虎和豹子可能受噪音和振动影响。正文没披露开发商、规模、供电方案和审批状态,冲突焦点就是动物福利 vs 算力扩张。
#Bloomberg#Policy
一句话点评
纳什维尔一个数据中心因噪音和振动被当地动物园反对,理由是影响老虎和豹子。这事挺新鲜,但正文没披露开发商、规模、供电方案和审批状态,冲突焦点就是动物福利 vs 算力扩张。目前信息太少,只能当个社会新闻看,别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
16:50
53d ago
彭博科技· rssEN16:50 · 06·05
彭博:越来越多的人用AI做投资决策,财富管理行业面临生存危机
彭博发了一条视频,说AI正在给财富管理行业带来生存危机——越来越多的人开始信任AI的理财建议,并直接用AI做投资决策。但正文没披露具体比例、样本量或用了哪些工具,所以这个“越来越多”到底多到什么程度,目前还不清楚。如果趋势是真的,那传统理财顾问的价值会被重新审视,毕竟AI便宜、随时可用、还不用看人脸色。不过这点先别太激动,缺少数据支撑,更像是一个行业预...
#Bloomberg#Suzanne Woolley#Commentary
一句话点评
彭博发了一条视频,说AI正在给财富管理行业带来生存危机——越来越多的人开始信任AI的理财建议,并直接用AI做投资决策。但正文没披露具体比例、样本量或用了哪些工具,所以这个“越来越多”到底多到什么程度,目前还不清楚。如果趋势是真的,那传统理财顾问的价值会被重新审视,毕竟AI便宜、随时可用、还不用看人脸色。不过这点先别太激动,缺少数据支撑,更像是一个行业预警。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H1·K0·R1
16:27
53d ago
r/LocalLLaMA· rssEN16:27 · 06·05
有人做了个 iOS 应用,能在 iPhone 上跑 GGUF 模型并测速
开发者发布了一款叫 GenBench 的免费 iOS 应用,底层用 llama.cpp 和 Metal,可以在 iPhone/iPad 上下载、运行和测试 GGUF 模型。它能测三个指标:每秒生成 token 数(tok/s)、首 token 延迟(模型从收到输入到吐出第一个字要等多久)和峰值内存占用。测试用的是标准化提示词,方便横向对比不同模型在苹果...
#Benchmarking#Inference-opt#Vision#GenBench
一句话点评
一个免费 iOS 应用,用 llama.cpp 在 iPhone/iPad 上跑 GGUF 模型,测生成速度、首 token 延迟和内存占用。开发者自己测了 Qwen 系列,但正文被 Reddit 屏蔽,具体数字和测试条件没披露。亮点是标准化提示词方便横向对比,但 iOS 端推理受散热和后台限制,跑大模型容易降频,结果仅供参考。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
16:23
53d ago
r/LocalLLaMA· rssEN16:23 · 06·05
把 KV 缓存挪到内存里,速度没掉太多
有人在 RTX 5060 Ti 16GB 上跑 Qwen3.6 27B 模型,用 llama.cpp 的 -nkvo 参数把 KV 缓存从显存搬到内存,f16 精度不变。65k 上下文下,峰值生成速度从 23 token/s 降到 19,长文本生成从 16 掉到 14。代价是 4-5 token/s 的损失,但省下了显存,让大模型能在小显存卡上跑更长的...
#Inference-opt#Qwen#llama.cpp#NVIDIA
一句话点评
RTX 5060 Ti 16GB 跑 Qwen3.6 27B,把 KV 缓存挪到内存,65k 上下文下生成速度从 23 token/s 降到 19,长文本从 16 降到 14。代价是 4-5 token/s 的损失,但省下了显存,让大模型能在小显存卡上跑更长的上下文。这点先别太激动,测试只用了 f16 精度,没提量化后的表现,而且内存带宽瓶颈在更长上下文下会更明显。正文没披露具体内存占用和 ...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
16:20
53d ago
r/LocalLLaMA· rssEN16:20 · 06·05
Granite4 Vision 4B 小模型专攻图表和表格提取,社区 PR 已提交但合并状态未知
一个叫 Granite Vision 4.1 4B 的视觉语言模型,专门做图表提取、表格提取和语义键值提取。模型只有 4B 参数,算小模型,跑本地推理成本低。社区有人给 llama.cpp 提了 PR(编号 23545)来支持它,但正文没披露这个 PR 有没有被合并,所以能不能直接用还不确定。
#Vision#Multimodal#Granite Vision#llama.cpp
一句话点评
Granite Vision 4.1 4B 是个小视觉模型,专攻图表、表格和键值提取,4B 参数跑本地很省钱。社区给 llama.cpp 提了 PR 支持它,但正文没披露 PR 是否已合并,所以能不能直接用还不确定。短评:小模型做结构化提取,本地部署成本低,但合并状态未知,别急着用。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
15:59
53d ago
Hacker News 首页· rssEN15:59 · 06·05
微软开源 pg_durable:把“任务持久化”直接塞进 PostgreSQL 数据库里
微软开源了一个 PostgreSQL 扩展 pg_durable,核心思路是把“任务一旦开始就必须跑完”的保证(durable execution)做到数据库内部,而不是靠外部消息队列或应用层重试。好处是省掉中间件,事务和任务状态天然一致,适合金融、订单这类不能丢数据的场景。不过正文没披露具体实现机制、API 长什么样,也没说支持哪些 PostgreS...
#Tools#Microsoft#Open source
一句话点评
微软开源了一个 PostgreSQL 扩展 pg_durable,把“任务一旦开始就必须跑完”的保证塞进数据库内部,省掉外部消息队列或应用层重试。好处是事务和任务状态天然一致,适合金融、订单这类不能丢数据的场景。但正文没披露具体实现机制、API 长什么样,也没说支持哪些 PostgreSQL 版本,目前还是个黑盒。如果是靠 PostgreSQL 自身的 WAL 和事务回滚来实现,那延迟可能不...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
15:32
53d ago
Hacker News 首页· rssEN15:32 · 06·05
微软内部文件说要让AI“上瘾”,CEO纳德拉假装不知情
404 Media 拿到一份微软内部战略文档,标题是“ClawPilot:概览与Project Lobster计划”,第一阶段目标直接写“让用户上瘾”。文档作者包括Scout项目负责人Omar Shahine。Scout是微软新推的“个人助理AI”,能读你的邮件、聊天记录、浏览历史和私人文档,然后帮你写邮件、做表格、开发票。微软说已经在内部员工身上测试...
#Microsoft#Satya Nadella#Incident
一句话点评
微软内部文档直接写要让用户对Scout AI上瘾,CEO纳德拉公开否认但404 Media指出文档作者包括Scout项目负责人。关键不是口号,是Scout能读邮件、聊天记录、浏览历史和私人文档,权限大得吓人。正文没披露具体上瘾机制设计,这点先别太激动——可能只是KPI话术。但内部文档白纸黑字+高管署名,公关翻车已成定局。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
15:26
53d ago
AI HOT 精选· aihot-apiZH15:26 · 06·05
Suno 教你怎么录人声:6 条实用技巧
Suno 给付费网页用户开放了 Voices 功能,并给出了 6 条录音建议:找个安静地方(别在浴室录,回声会失真)、先练歌词再录、不用追求完美(它要的是你的声音特质,不是录音室效果)、尽量录够一分钟以上(素材越多,生成结果越稳定)、根据曲风调整演唱方式(民谣里的细腻唱法放到流行里可能没劲)、以及大胆尝试死亡金属或巴萨诺瓦等反差风格。正文没披露具体用了...
#Audio#Suno#Product update
一句话点评
Suno 给付费网页用户开放了 Voices 功能,并给出了 6 条录音建议:找个安静地方(别在浴室录,回声会失真)、先练歌词再录、不用追求完美(它要的是你的声音特质,不是录音室效果)、尽量录够一分钟以上(素材越多,生成结果越稳定)、根据曲风调整演唱方式(民谣里的细腻唱法放到流行里可能没劲)、以及大胆尝试死亡金属或巴萨诺瓦等反差风格。正文没披露具体用了什么模型或技术细节,也没说免费用户何时能...
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H0·K1·R0
15:13
53d ago
Hacker News 首页· rssEN15:13 · 06·05
HN 热帖:2026 年 6 月,你的 AI 开发技术栈和工作流是什么?
一位有 20 年经验的老程序员在 HN 上发帖,想为线下 workshop 收集现代 AI 开发工具推荐。他本人还在用 Linux Mint、VSCodium、Python 和 AWS,几乎没用过 AI 辅助编程工具。他列了几个具体需求:搭个人静态网站、用 FastAPI 写个表单转 PDF 的小工具、用 SyncThing 同步三台 Linux 电脑...
#Agent#Code#Tools#Hacker News
一句话点评
一位20年老程序员想学AI开发工具,自己还在用Linux Mint和VSCodium,几乎没用过AI编程助手。帖子只有4分2条评论,讨论热度很低。正文没披露他最终选了哪些工具,目前只看到有人推荐OpenCode+Go订阅。想了解真实AI开发工作流的可以翻翻评论区,但样本太少,参考价值有限。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1

更多

频道

后台