ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-07-23

50 items · updated 3m ago
RSS live
2026-07-23 · 星期四2026年7月23日
22:30
61d ago
Hacker News 首页· rssEN22:30 · 07·23
用球员跑位数据,给 64 场世界杯比赛做了能看的 3D 回放
Roger Dickey 用 PFF 公开的 2022 世界杯球员追踪数据(每秒 30 次位置采样),在浏览器里重建了全部 64 场比赛的 3D 回放。原始追踪数据每场约 1GB,他让 Claude 帮忙压成约 100MB 的流式格式,并按 10 秒一段拆分,边看边加载。球员的跑动、头球、门将扑救等动作靠事件数据触发,不是纯位置推算。约 27% 的直播...
#Roger Dickey#PFF#Claude (Anthropic)
一句话点评
Roger Dickey 用 PFF 公开的 2022 世界杯球员追踪数据(每秒30次位置采样),在浏览器里重建了全部64场比赛的3D回放。原始追踪数据每场约1GB,他让Claude帮忙压成约100MB的流式格式,并按10秒一段拆分,边看边加载。球员的跑动、头球、门将扑救等动作靠事件数据触发,不是纯位置推算。约27%的直播时段没有追踪数据,用剪辑片段填补。代码和数据源都公开。正文没提延迟和成本。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
21:50
61d ago
Product Hunt · AI· rssEN21:50 · 07·23
MemoryCustodian:把项目记忆直接存进代码仓库,让编程助手不再忘事
MemoryCustodian 把项目决策、约束条件和上下文存成仓库里的 Markdown 文件,Codex、Claude Code、Gemini 这类编程助手干活时能直接读取,不用依赖外部服务,也不会把提示词撑爆。它靠一份清单文件按任务加载相关记忆,避免一股脑塞进无关信息。工具开源、数据留在本地,换不同助手也能接着用。目前免费,正文没提后续收费计划。
#MemoryCustodian#Codex#Claude Code#Open source
一句话点评
MemoryCustodian 把项目决策、约束条件存成仓库里的 Markdown 文件,Codex、Claude Code 等编程助手干活时直接读,不用外部服务,也不撑爆提示词。开源、数据本地,换助手也能接着用。目前免费,正文没提后续收费计划。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
21:27
61d ago
彭博科技· rssEN21:27 · 07·23
英伟达跟封测厂 Amkor 签了 15 亿美元的芯片封装大单
彭博的报道正文被反爬页面挡住了,具体条款、时间表、涉及哪款芯片都没披露。光从标题看,英伟达花 15 亿美元提前锁定了 Amkor 的先进封装产能,说明现在高端芯片封装的产能还是很紧张。这点先别太激动,等更多细节出来才能判断这笔钱具体怎么花、对成本和交付周期有多大影响。
#Nvidia#Amkor
一句话点评
英伟达花 15 亿美元提前锁定了 Amkor 的先进封装产能,说明高端芯片封装的供应还是紧。但正文被彭博的反爬页面挡住了,具体条款、时间表、涉及哪款芯片都没披露。这点先别太激动,等更多细节出来才能判断这笔钱具体怎么花、对成本和交付周期有多大影响。
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K0·R1
21:15
61d ago
The Verge · AI· rssEN21:15 · 07·23
Alexa Plus 升级:能听懂更复杂的指令了
亚马逊给 Alexa Plus 加了个 AI 更新,让它能处理更复杂的指令,尤其是跨多个智能家居设备的操作。以前只能说“关灯”,现在可以说“关灯、拉窗帘、把空调调到26度”这种多步任务。文章没透露用了什么模型或技术细节,但方向很明确:从单条命令转向多步骤任务。如果是真的,这对智能家居体验是个实在的提升,不过具体效果还得看实际表现。
#Amazon#Alexa Plus
一句话点评
Alexa Plus 更新后能一次处理“关灯、拉窗帘、调空调”这种多步指令,从单条命令转向多步骤任务。方向对,但文章没透露用了什么模型或技术细节,具体效果还得看实际表现。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
21:00
61d ago
FT · 科技· rssEN21:00 · 07·23
新加坡主权基金GIC:中国AI模型会把部署成本打下来
新加坡主权基金GIC的首席投资官公开说,中国AI模型在效率上能追上美国,但价格低得多,企业部署成本会大幅下降。这对想用AI但嫌贵的公司是个好消息。不过正文没披露具体是哪些模型、成本到底差多少、以及时间表,所以这个判断目前还比较笼统。如果是真的,确实挺省钱。
#GIC
一句话点评
GIC 首席投资官公开说中国 AI 模型效率追平美国但价格低得多,企业部署成本会大幅下降。如果是真的挺省钱,但正文没披露具体是哪些模型、成本差多少、时间表,目前还是个笼统判断。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H0·K0·R0
20:59
61d ago
● P1Hacker News 首页· rssEN20:59 · 07·23
Stripe 洽谈以约 100 亿美元收购 AI 模型集市 OpenRouter
WSJ 消息,Stripe 在谈收购 OpenRouter,开价大概 100 亿美元。OpenRouter 做的是一个模型集市,开发者按用量付费调用各种 AI 模型,相当于一个统一的 API 入口。这个价格对一层模型路由来说不便宜,但和 Stripe 做支付基础设施的路子对得上。正文没披露谈判进展、支付方式或监管障碍,我会先打个折——目前只是初步接触,...
#Stripe#OpenRouter#WSJ
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
100亿美元买一个模型API中转站,价格不便宜,但Stripe做支付管道,OpenRouter做模型管道,逻辑是顺的。正文没披露谈判进展和支付方式,先别太激动。
锐评
WSJ的消息说Stripe在谈收购OpenRouter,开价大概100亿美元。OpenRouter干的事很简单:把各种AI模型打包成一个统一API,开发者按用量付钱,它负责路由和计费。这相当于模型界的“支付网关”,跟Stripe的主业确实对得上——都是做基础设施层,赚流水的钱。 100亿这个数对一层路由来说不便宜。OpenRouter本身不训练模型,赚的是差价和手续费,护城河在于接入的模型数量和开发者习惯。但正文没披露它的营收、利润率或交易量,也没说谈判到了哪一步、是现金还是换股。WSJ的RSS snippet只给了个标题和摘要,细节全缺。 还缺几个关键信息:OpenRouter的GMV和抽成比例是多少?Stripe是买技术还是买客户群?监管会不会拿AI模型分发做文章?这些没答案之前,100亿的价签只能当个参考方向看。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
20:34
61d ago
Product Hunt · AI· rssEN20:34 · 07·23
Velane:给AI Agent用的云平台,管工具和函数,号称零冷启动
Velane是一个专为AI Agent设计的云平台,用来管理工具和函数。它提供了一个代码沙箱(声称零冷启动)、版本控制、开发/测试/生产环境,以及800多个集成,目标是取代传统的iPaaS。Agent可以直接控制平台,支持Claude、Codex、Cursor等。今天在Product Hunt上线,目前排名第12,有99个赞。正文没披露定价和实际延迟数据。
#Velane#Product Hunt#Claude
一句话点评
Velane 是一个让 AI Agent 自己管理工具和函数的云平台,号称零冷启动的代码沙箱、版本控制、800+ 集成,想取代传统 iPaaS。今天在 Product Hunt 上线,排名第 12,99 个赞。亮点是 Agent 可以直接控制平台,支持 Claude、Codex、Cursor。但正文没披露定价和实际延迟数据,零冷启动是否真能做到有待验证。如果是真的,挺省钱,但别急着激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
20:01
61d ago
彭博科技· rssEN20:01 · 07·23
英特尔因AI数据中心需求强劲提高全年预测
英特尔最新季度营收预测远超分析师预期,盘后股价飙升。主要驱动力是AI数据中心业务增长,说明英特尔的AI芯片翻身仗正在见效。但正文没披露具体是哪款AI芯片、哪些客户在买,这点先别太激动——如果只是靠低价抢单,利润未必好看。
#Intel
一句话点评
英特尔盘后暴涨,因为AI数据中心业务拉高了营收预期。但正文没说是哪款芯片、哪些客户在买——如果只是靠低价抢单,利润未必好看。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
19:29
61d ago
Product Hunt · AI· rssEN19:29 · 07·23
ngrok AI Gateway:一个入口管所有模型,自建模型也能走内网不暴露
ngrok 推出了 AI Gateway,核心卖点是用一个 API 地址和一套密钥,把 OpenAI、Anthropic 和自建模型的请求都路由过去。自带可观测性、访问控制和 fallback(主模型挂了自动切备用)。自建模型通过 ngrok 的内网连进来,不用暴露到公网。对同时用多家供应商的团队来说,省掉了自己搭网络和写路由逻辑的麻烦。正文没披露定价...
#ngrok#OpenAI#Anthropic
一句话点评
ngrok 把内网穿透的老本行用到了 AI 上:一个 API 地址、一套密钥,把 OpenAI、Anthropic 和自建模型的路由、监控、fallback 全包了。自建模型走 ngrok 内网连进来,不用暴露公网,对混用多家供应商的团队省了搭网络和写路由的麻烦。但正文没披露定价和延迟,这点先别太激动——如果加一层网关后延迟能控制在可接受范围,且价格不比自建贵,那确实挺省钱。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H0·K1·R0
19:01
61d ago
r/LocalLLaMA· rssEN19:01 · 07·23
两张 4090D 跑 DeepSeek V4 Flash,速度 105 token/秒
开发者用 Triton 重写了原本只支持 Blackwell 的 DeepGEMM、FlashInfer 稀疏 MLA 和块缩放 FP8 内核,让 DeepSeek V4 Flash 能在两张 RTX 4090D(共 48GB 显存)上通过 vLLM 跑起来,生成速度约 105 token/秒。模型先被压缩到 IQ2 精度才能塞进 96GB 显存,配合...
#DeepSeek#NVIDIA#vLLM
一句话点评
短评:开发者用Triton重写Blackwell专用内核,让DeepSeek V4 Flash在两张4090D上跑到105 token/s,本地部署门槛大降。 点评:开发者用Triton重写了原本只支持Blackwell的DeepGEMM、FlashInfer稀疏MLA和块缩放FP8内核,让DeepSeek V4 Flash能在两张RTX 4090D(共48GB显存)上通过vLLM跑起来,...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
19:00
61d ago
Hacker News 首页· rssEN19:00 · 07·23
谷歌上线自拍视频登录:眨眨眼、转个头就能验证身份
谷歌今天上线了“自拍登录”功能,用户对着摄像头做眨眼、转头等动作,系统实时分析视频来判断是不是真人,而不是简单比对一张照片。谷歌说这比密码或短信验证码更安全,还能防深度伪造攻击。目前只限部分 Pixel 和三星机型,iOS 和网页端没提。
#Google
一句话点评
谷歌上线了“自拍登录”,让你对着摄像头眨眼、转头来验证身份,而不是简单比照片。它分析实时视频判断你是不是真人,号称能防深度伪造。目前只限部分 Pixel 和三星机型,iOS 和网页端没提。正文没披露误识率和对抗样本测试结果,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
19:00
61d ago
● P1TechCrunch AI· rssEN19:00 · 07·23
Claude语音模式升级支持多模型和应用集成功能
Anthropic 给 Claude 的语音模式换了底模,现在你可以手动选 Opus、Sonnet 或 Haiku,默认会沿用你上次文字聊天用的模型。官方说这能撑住更长的对话,比如帮你打磨沟通方式、过一遍客户提案、或者脑暴市场调研。更实际的变化是,语音模式现在能接通 Gmail、Google 日历、Slack、Canva 和 Notion,直接让它改会...
#Audio#Agent#Anthropic#Claude
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude 语音模式现在能调用 Opus 和 Sonnet 了,还能直接操作 Gmail、日历和 Notion,这点比 OpenAI 的语音模式实用。但正文没提多语言支持的具体效果,先别急着切换工作流。
锐评
Anthropic 这次更新把语音模式的底模从 Haiku 换成了 Opus 和 Sonnet,默认用最快版本。这意味着语音对话不再只是快速闲聊,可以处理更复杂的任务,比如帮你梳理客户提案、做产品市场调研。更关键的是,它现在能直接连到 Gmail、Google 日历、Slack、Canva 和 Notion 这些应用,你可以用嘴改会议时间、起草邮件或建文档。这和 OpenAI 刚更新的语音模式走了完全不同的路:OpenAI 在打磨对话自然度,Anthropic 则让语音模式进业务流程干活。 不过,TechCrunch 的报道没给出多语言表现的具体测试,也没提连接第三方工具时的延迟和权限控制细节。能连工具是好事,但如果每次操作都要反复确认或者响应慢,体验会打折扣。另外,语音模式默认沿用文字聊天最后用的模型,这个设计挺聪明,但用户得自己留意当前挂的是哪个模型,不然可能用 Haiku 跑重任务。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
18:35
61d ago
AI HOT 精选· aihot-apiZH18:35 · 07·23
电影数据站 TheNumbers 被 AI 爬虫和攻击打崩,78,000 部电影历史数据暂时全丢
电影行业最权威的数据站 TheNumbers.com 今年 3 月消失了一周,回来只剩一个空壳。创始人 Bruce Nash 说罪魁祸首是两波 AI 爬虫:2024 年来的训练爬虫,和 2025 年底来的 agentic AI(能自己写脚本抓数据的智能体)。加上安全攻击,网站只能从零重建。正文没披露重建花了多少钱、要多久,但确认 78,000 多部电影...
#TheNumbers.com#Bruce Nash
一句话点评
电影数据站 TheNumbers.com 因两波 AI 爬虫(2024 年训练爬虫 + 2025 年底能自己写脚本抓数据的智能体)加上安全攻击,今年 3 月被迫从零重建,78,000 多部电影的历史数据暂时全没了。创始人 Bruce Nash 亲述,网站消失一周后回来只剩空壳。正文没披露重建花了多少钱、要多久,但这事给所有靠公开数据吃饭的网站提了个醒:AI 爬虫不是流量,是攻击。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
18:29
61d ago
Hacker News 首页· rssEN18:29 · 07·23
Mozilla AI 在 ACM FAccT 2026 上演示:给大模型装“护栏”也得先测准,光靠文本判断会漏事实错误
Mozilla AI 在蒙特利尔的 ACM FAccT 2026 上展示了一个观点:给大模型装的安全护栏(guardrails)本身也需要像模型一样被严格评估。他们用 120 个难民庇护场景、5 种语言(英语、波斯语、阿拉伯语、库尔德索拉尼语、普什图语)做了测试,发现纯文本护栏经常漏掉事实错误——比如某个 NGO 到底存不存在、某条法律是否还在生效。于...
#Mozilla AI#ACM FAccT#Claude Sonnet 4.6#Benchmark
一句话点评
Mozilla AI 在 ACM FAccT 上提出:安全护栏(guardrails)本身也需要像模型一样被严格评估。他们用 120 个难民庇护场景、5 种语言测试,发现纯文本护栏常漏掉事实错误——比如某 NGO 是否存在、某法律是否有效。于是他们做了个带联网搜索的 agentic 护栏。35 人试玩,90% 的判断与无工具版一致,但工具版纠正了事实错误。效果很依赖 judge 模型:Cla...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H0·K1·R0
18:23
61d ago
Hacker News 首页· rssEN18:23 · 07·23
ATProto 想做应用层的通用协议,但隐私功能还没到位
Luke Kanies 想基于 ATProto(Bluesky 的底层协议)做一套替代 Yelp、GoodReads 的点评应用,核心卖点是用户自己管数据、能选择公开或仅限好友可见。参加完 Local First 大会后,他发现 ATProto 的身份系统已经能用,但协议目前只支持公开数据。社区正在设计“permissioned data”(其实就是私...
#ATProto#Bluesky#Luke Kanies
一句话点评
Luke Kanies(Puppet 创始人)想用 ATProto 做一套用户自己管数据的点评应用,替代 Yelp、GoodReads。核心卖点是数据可公开也可仅限好友可见,但 ATProto 目前只支持公开数据,社区正在设计“permissioned data”(权限数据),正文没披露何时落地。身份系统已可用,但协议层缺私密能力。如果是真的挺省钱,但这点先别太激动——私密数据是应用层还是协...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
18:11
61d ago
Hacker News 首页· rssEN18:11 · 07·23
Geekbench 7 发布:新增 AV1 编码、Whisper 字幕、Jolt 物理引擎,多核评分更聪明
Primate Labs 今天发布了跨平台跑分工具 Geekbench 7。CPU 测试新增了三个媒体负载:用 AV1 编码屏幕共享视频、用 Opus 压缩音频、以及一边解码视频一边用 Whisper 生成实时字幕——模拟视频会议和播客场景。多核测试改了规则:只跑那些真实应用里确实会多线程的任务,比如 HTML5 浏览被移除了,因为浏览器基本是单线程的...
#Benchmarking#Primate Labs#Geekbench#Jolt Physics
一句话点评
Geekbench 7 更新了 CPU 和 GPU 测试负载,新增 AV1 编码、Opus 音频压缩、Whisper 实时字幕等视频会议场景,多核测试只跑真实多线程任务(比如移除了单线程的 HTML5 浏览),GPU 首次支持 CUDA 并加入人脸跟踪滤镜、AI 超分、背景虚化等 ML 负载。数据集也变大了,压缩和 PDF 测试加了更多样本文档。个人版免费,Pro 打八折到 8 月 6 日。...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
17:07
61d ago
TechCrunch AI· rssEN17:07 · 07·23
Runway 不做模型公司了,改卖“媒体路由器”——自动帮你挑最合适的生图/生视频模型
Runway 7月23日上线了 Media Router,一个自动帮你选图像、视频、音频生成模型的工具。你只要告诉它你要质量、速度还是省钱,它就从自家和第三方模型里挑一个最合适的。模型路由在 LLM 圈已经常见,但 Runway 说这是第一个专门给媒体生成做的。CPO 说这是“一站式集成任何生成式媒体模型”的关键一步。正文没披露支持哪些第三方模型、具体...
#Runway#Runway Dev#Anthony Maggio
一句话点评
Runway 把 LLM 圈常见的模型路由(自动选模型)搬到了图片/视频/音频生成上,7月23日上线了 Media Router。开发者只需告诉它要质量、速度还是省钱,它就从自家和第三方模型里挑一个。想法不新鲜,但切中痛点:媒体生成模型太多,手动试错成本高。不过正文没披露支持哪些第三方模型、具体定价和延迟数据,所以“省钱省时间”到底省多少得打个问号。如果真能集成主流模型并透明报价,对中小开发...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
17:00
61d ago
The Verge · AI· rssEN17:00 · 07·23
OpenAI 把 ChatGPT Health 全量开放,号称推理能力“超过临床医生”
OpenAI 宣布 ChatGPT Health 对所有用户开放,并声称模型在医疗推理任务上“比临床医生水平更高”。但正文没披露具体评测基准、对比样本量,也没说拿来比较的医生是什么资质——这个结论完全靠 OpenAI 自己一句话,没有第三方验证。如果是真的,意味着 AI 在诊断推理上可能已经够格当辅助工具,但这点先别太激动,缺数据支撑。
#OpenAI
一句话点评
OpenAI 宣布 ChatGPT Health 全量开放,并声称模型在医疗推理上“比临床医生水平更高”。但正文没披露具体评测基准、对比样本量,也没说拿来比较的医生是什么资质——这个结论完全靠 OpenAI 自己一句话,没有第三方验证。如果是真的,意味着 AI 在诊断推理上可能已经够格当辅助工具,但这点先别太激动,缺数据支撑。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
16:28
61d ago
TechCrunch AI· rssEN16:28 · 07·23
Meta 用一首讲人类灭绝的歌,给 AI 拍了一支乐观广告
Meta 发了一支新广告,画外音说“未来属于每个人”,画面是人们跳舞、游泳、拥抱,想传递 AI 不会让人疏离。但背景音乐选了 David Bowie 的《Five Years》,这首歌讲的是地球只剩五年就要末日。TechCrunch 指出了这个巨大的割裂感,不过正文没披露这支广告的投放预算和具体渠道。
#Meta#David Bowie
一句话点评
Meta 新广告用 David Bowie 的《Five Years》当 BGM,歌词讲的是地球只剩五年就要末日,画面却是人们跳舞游泳拥抱,画外音说“未来属于每个人”。TechCrunch 指出这个割裂感很离谱。正文没披露投放预算和渠道,所以不知道这波操作到底花了多少钱、铺了多广。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
16:28
61d ago
r/LocalLLaMA· rssEN16:28 · 07·23
苹果 M5 的矩阵乘法核心还没被推理框架用起来
M5 芯片硬件上支持 INT8 激活值(w4a8 格式),但 MLX 和 llama.cpp 目前都还在用 16 位精度跑。作者自己写了 w8a8 内核,在 M5 MacBook Air 上跑 Gemma4 的预填充任务,速度从每秒 2193 个 token 提到了 3029 个,短上下文时能冲到近 1 万 tps。代码还没整理成一键可用的状态。评论区...
#Apple#MLX#llama.cpp
一句话点评
M5 芯片硬件支持 INT8 激活值,但主流推理框架还没跟上。作者自己写了 w8a8 内核,在 M5 MacBook Air 上跑 Gemma4 预填充,速度从每秒 2193 token 提到 3029,短上下文能冲到近 1 万 tps。代码还没整理成一键可用,目前只是概念验证。 精度方面要打个折。评论区有人指出 INT8 激活值容易丢精度,作者自己也说“直觉上不该直接能用”,但实测用 4...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
16:00
61d ago
● P1AI HOT 精选· aihot-apiZH16:00 · 07·23
蚂蚁百灵发布 Ling-3.0-flash 模型,124B 参数、5.1B 激活
蚂蚁百灵推出了新模型 Ling-3.0-flash,总参数 124B,但每次推理只激活 5.1B 参数,体量只有上一代旗舰 Ring-2.6-1T 的八分之一左右,却在推理、指令遵循和 Agent 任务上打平甚至反超。核心变化是预训练阶段就用了原生混合线性注意力架构,把 KDA 和 MLA 层按 5:1 交替堆叠,专家激活比例压到 1/64,用更少的计...
#Reasoning#Agent#Code#Ant Ling
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
蚂蚁用124B总参数、5.1B激活参数的小模型,在多项指标上对标甚至超过了自家上一代1T旗舰,智能密度确实高,但评测基准和真实业务差距没细说。
锐评
蚂蚁百灵这次发布的Ling-3.0-flash,核心卖点是用极小的激活参数量(5.1B)去对标上一代1T级旗舰模型Ring-2.6-1T。从技术上看,这主要靠三件事:原生混合线性注意力(KDA+MLA交替堆叠)、极低的专家激活比例(1/64的稀疏MoE),以及针对Agent场景的定向训练。官方给出的评测图显示,在数学、代码、指令遵循等榜单上,这个小模型确实能跟大得多的模型掰手腕,智能密度(单位参数下的分数)优势明显。 但有几个地方需要打折看。第一,评测默认开启思考模式,且均分计算只取所有模型都有得分的部分,这可能会让对比偏向自己擅长的子集。第二,文章反复强调“越级挑战”,但没给出在完全相同的推理预算下与同量级模型的横向对比,比如跟其他5B激活参数的模型比到底强多少。第三,Agent能力展示集中在Blender建模、MiniAppBench这类特定场景,通用企业级工具调用、复杂业务流程的稳定性没有第三方验证。 另外,长上下文场景下TTFT降低60%-80%这个数字,依赖的是SGLang HiCache+Mooncake的分级缓存架构,这是推理部署层面的优化,不是模型本身的能力。如果你自己的部署环境没有这套缓存体系,这个收益是拿不到的。整体看,模型在参数效率上的工程创新值得关注,但实际落地效果还需要更多独立评测和业务场景的反馈来佐证。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
15:42
61d ago
Hacker News 首页· rssEN15:42 · 07·23
OneCLI:一个开源凭证网关,让 AI 智能体干活时不直接碰密钥
OneCLI 是一个开源的凭证网关,自带一个内置保险库。它的思路是:AI 智能体通过命令行工具去调外部服务,网关在中间把密钥注入请求,智能体本身拿不到明文密钥。仓库目前有 2.6k 星,issues 和 PR 都比较活跃。不过正文没披露具体支持哪些服务、权限粒度能做到什么程度,也没提引入网关后延迟会增加多少。
#OneCLI
一句话点评
给 AI 智能体配钥匙,但钥匙本身不交给它。OneCLI 的思路是让智能体通过命令行调外部服务,网关在中间把密钥注入请求,智能体全程拿不到明文。仓库有 2.6k 星,issues 和 PR 都挺活跃,说明有人真在用。但正文没写支持哪些服务、权限能细到什么程度,也没提加一层网关后延迟会多多少。这点先别太激动——如果只是包了一层 vault 的 CLI 代理,市面上类似方案不少,关键看它跟现有 ...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
15:18
61d ago
Hacker News 首页· rssEN15:18 · 07·23
软件工厂为什么失败:光会写代码不够,得会喂上下文
HumanLayer 这篇博客认为,很多“软件工厂”项目(用 AI 自动生成代码的项目)失败,不是因为模型写不出代码,而是因为团队没做好“上下文工程”——也就是没把业务逻辑、约束条件、历史决策精确地喂给模型。模型能生成代码,但生成对的代码需要更精细的上下文管理。正文没有给出具体案例或数据,核心论点就是:纯工程能力(写代码、搭框架)不够,上下文工程才是瓶颈。
#Code#HumanLayer
一句话点评
HumanLayer 这篇博客说,AI 写代码的项目失败,不是因为模型写不出代码,而是团队没把业务逻辑、历史决策喂清楚。纯工程能力(搭框架、写代码)不够,“上下文工程”才是瓶颈。正文没给具体案例或数据,观点本身不新,但点出了一个容易被忽视的环节。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
15:18
61d ago
● P1Hacker News 首页· rssEN15:18 · 07·23
近200家硅谷创业公司联名反对特朗普政府禁用中国开源AI模型
近 200 家硅谷公司,包括 Proton 和 Y Combinator,联名致信特朗普政府,反对一刀切禁止中国的开源(open-weight)AI 模型。这些创始人认为,如果切断对月之暗面、阿里巴巴等公司公开模型参数的访问,会直接打击大量依赖这些模型做开发的美国创业公司。他们主张用有针对性的防护措施替代全面禁令。这是硅谷创业圈首次就这一政策争议进行有...
#Proton#Y Combinator#Little Tech Association
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
15:11
61d ago
Hacker News 首页· rssEN15:11 · 07·23
Palmier Pro:开源 macOS 视频编辑器,专为 AI 工作流打造
Palmier Pro 是一个开源 macOS 视频编辑器,GitHub 上已有 11.1k 星,主打 AI 集成。它支持 AI 驱动的剪辑功能,但正文没披露具体支持哪些模型、API 或性能基准。如果你在找能接入 AI 的本地剪辑工具,这个项目值得关注,但实际效果和兼容性还得自己试。
#Palmier Pro#GitHub
一句话点评
一个开源 macOS 视频编辑器,GitHub 11.1k 星,主打 AI 集成剪辑。但正文没披露具体接入了哪些模型、API 还是本地跑,性能基准也空白。如果是真的能本地调用模型做自动剪辑,挺省钱;但实际效果和兼容性得自己试,别被星数冲昏头。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R0
15:00
61d ago
TechCrunch AI· rssEN15:00 · 07·23
英伟达要把 GPU 送上月球
月球车公司 Lunar Outpost 宣布,下一辆月球车会用英伟达 Jetson 芯片控制激光雷达(lidar),这很可能是第一块上月的 GPU。NASA 正花钱请私营公司探月,为 2028 年载人任务铺路。英伟达还跟 Firefly Aerospace 合作,让 Jetson 在绕月卫星上处理图像。两趟任务都赶在今年底前用 Falcon 9 发射。...
#Robotics#Nvidia#Lunar Outpost#Firefly Aerospace
一句话点评
英伟达要把 Jetson 芯片送上月球,装在月球车和绕月卫星上处理激光雷达和图像。两趟任务都赶今年底用 Falcon 9 发射,NASA 出钱为 2028 年载人探路。但正文没披露具体芯片型号和功耗限制——月球环境对散热和辐射要求极高,Jetson 能不能扛住才是关键。如果是真的,这算是边缘计算最远的落地场景了。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
14:52
61d ago
● P1TechCrunch AI· rssEN14:52 · 07·23
Google Gemini 月活用户超过9.5亿,同比增长三倍
Google 在 2026 年第二季度财报电话会上说,AI 助手 Gemini 的月活用户已经超过 9.5 亿,比去年同期翻了三倍。今年 2 月这个数字还是 7.5 亿。CEO Sundar Pichai 把增长归功于 Daily Brief 这类能自主干活的“代理式”功能,以及个性化代理 Gemini Spark。iOS 端过去一年下载量超过 1.3...
#Agent#Google#Gemini#Sundar Pichai
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Gemini 月活冲到 9.5 亿,半年涨了 2 亿,但文章没给具体市占率,只说 ChatGPT 份额被挤压,这点先别太激动。
锐评
Google 在财报电话会上说 Gemini 月活用户超过 9.5 亿,比 2 月的 7.5 亿又多了 2 亿,一年翻了三倍。CEO 把增长归功于 Daily Brief 这类能自主干活的“代理式”功能,以及个性化代理 Gemini Spark。iOS 端过去一年下载量超过 1.3 亿次,说明移动端拉新挺猛。 不过这篇文章主要引用的是 Google 自己公布的数据和 Sensor Tower 的报告,Sensor Tower 只提了 ChatGPT 份额被挤压,但没给出 Gemini 的具体市占率。所以 9.5 亿这个数字到底有多少是主动使用、多少是被动集成进 Google 全家桶带来的,正文没披露。另外,用户粘性、付费转化这些关键指标也完全没提。 对从业者来说,这个量级说明靠系统预装和生态捆绑推 AI 助手确实快,但想判断产品本身能不能留住人,还得看后续有没有独立 App 的活跃度和留存数据。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
14:40
61d ago
Hacker News 首页· rssEN14:40 · 07·23
数据中心吃掉全球 1.5% 的电,AI 占其中三成
Our World in Data 根据国际能源署(IEA)的数据算了笔账:2025 年全球数据中心用电约 485 太瓦时,相当于德国一年的发电量,占全球总发电量的 1.5%。其中专门跑 AI 的设施用了 155 太瓦时,也就是全球电力的 0.5%,剩下三分之二的电是邮件、视频、网银这些传统服务用掉的。IEA 按基准情景预测,到 2030 年数据中心用...
#International Energy Agency#IEA#Our World in Data
一句话点评
这篇把 AI 用电量讲得很清楚:2025 年全球数据中心用了 485 太瓦时电,占全球发电量 1.5%,其中专门跑 AI 的设施只占 0.5%,剩下三分之二是邮件、视频、网银这些传统服务吃掉的。IEA 预测到 2030 年数据中心用电可能翻倍到 945 太瓦时,AI 是主要增长点。但要注意,这个数字不含加密货币挖矿,另一家机构 Energy Institute 把挖矿算进去后估了 790 太...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
14:08
61d ago
Hacker News 首页· rssEN14:08 · 07·23
PullRun:同一份 OCI 镜像,既能当容器跑,也能当 Firecracker 微虚拟机跑
PullRun 是一个新开源的容器运行时,亮点是同一份 OCI 镜像(就是 Docker 用的那种标准打包格式)可以三种方式运行:普通 Linux 容器、Firecracker 微虚拟机、或者 Apple Silicon 上的虚拟机。它用了零拷贝 DAG 存储(类似 Git 按内容寻址,拉镜像时只传差异部分)和 P2P 镜像同步(多台机器一起加速下载)...
#PullRun#Firecracker#Apple Silicon#Open source
一句话点评
PullRun 新开源,同一份 Docker 镜像能当普通容器跑,也能当 Firecracker 微虚拟机跑,Apple Silicon 也能用。微虚拟机隔离性比容器强,适合跑不信任的 AI 推理任务。亮点是零拷贝存储和 P2P 拉镜像,启动和分发更快。但正文没给任何性能数字,也没说生产环境验证过,这点先别太激动。如果是真的,省掉重打包的麻烦挺省钱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
14:00
61d ago
● P1The Verge · AI· rssEN14:00 · 07·23
苹果起诉OpenAI窃取硬件设计商业机密
苹果在加州法院起诉 OpenAI,指控它系统性挖走前苹果工程师、窃取 AI 硬件和操作系统设计的商业机密。这不是普通的人事纠纷——苹果正拉着 Jony Ive 做 AI 硬件,OpenAI 也在搞自己的设备,两家都想定义智能手机之后的下一个计算平台。OpenAI 同时还在应付《纽约时报》等机构的版权官司,法律麻烦越堆越多。这篇是播客文字稿,没列出具体证...
#Apple#OpenAI#Jony Ive
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
苹果告 OpenAI 挖人偷技术,背后是两家都在抢“后手机时代”的硬件入口,但播客没给出实锤证据,先当商业博弈看。
锐评
苹果在加州起诉 OpenAI,指控对方系统性挖走前苹果工程师、窃取 AI 硬件和操作系统设计的商业机密。这事不是普通的人事纠纷——苹果正拉着 Jony Ive 做 AI 硬件,OpenAI 也在捣鼓自己的设备,两边都想定义智能手机之后的下一个计算平台。OpenAI 同时还在应付《纽约时报》等机构的版权官司,法律包袱越背越重。 这篇是播客文字稿,没列出具体证据、挖了多少人、索赔金额,也没说苹果手里有什么材料能证明“系统性窃取”。所以目前只能把它看成一场围绕人才和硬件路线的前哨战,法律上能不能站住脚还不好说。 还缺的关键信息:苹果到底拿出了哪些技术被偷的细节,OpenAI 的设备进展到什么程度,以及这场官司会不会拖慢两家各自的硬件时间表。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
12:00
61d ago
The Verge · AI· rssEN12:00 · 07·23
佛罗里达退休右派抗议数据中心:跟左派站到一块了
佛罗里达州Hernando County的保守派退休居民正在抗议新建数据中心,理由包括环境、就业、生活质量——还有中国。这场名为“Humans First”的全国性抗议显示,对AI基础设施的地方抵制正在跨越政治阵营。
#Humans First#Hernando County#Florida#Policy
一句话点评
佛罗里达退休居民抗议数据中心,理由包括环境、就业、生活质量——还有中国。这场“Humans First”运动跨越左右阵营,说明AI基建的地方阻力正在政治化。正文没披露抗议规模或具体项目影响,但趋势值得关注:数据中心选址可能从技术问题变成社会议题。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R1
11:30
61d ago
FT · 科技· rssEN11:30 · 07·23
工会该拿AI怎么办?FT建议别抵抗,去定规则
FT这篇评论认为工会不该死扛AI,而是主动参与制定规则。核心主张两条:一是要求“算法透明”,让工人知道排班、绩效、裁员是怎么被AI决定的;二是签“技能契约”,逼雇主在裁员前先出钱培训。文章拿丹麦模式举例——灵活雇佣加高福利兜底。但正文没提具体案例或正在推进的法案,观点偏宏观,落地细节不多。
#Financial Times
一句话点评
FT评论建议工会别硬扛AI,该主动去谈规则:要求算法透明(让工人知道排班、绩效、裁员怎么被AI定的),签技能契约(雇主裁员前先出钱培训)。拿丹麦模式举例,灵活雇佣加高福利兜底。但全文没具体案例或法案,观点偏宏观,落地细节不多。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
11:20
61d ago
AI HOT 精选· aihot-apiZH11:20 · 07·23
昆仑万维CEO:堆Token没用,模型才是根本,还在训音乐和游戏模型
昆仑万维CEO方汉在WAIC上说,光看Token消耗量衡量不了AI价值,得靠Claude Code这类编程助手搭好工程框架,模型能力才能落地。他透露公司还在持续训练模型,后续会发布音乐、具身世界和游戏世界模型,认为模型和算力才是AI公司的长期饭碗。另外他提醒,AI写代码会留下技术债,生产事故可能翻几倍,代码审查和责任机制得跟上。正文没披露具体模型参数或...
#昆仑万维#方汉#Claude Code
一句话点评
昆仑万维CEO方汉在WAIC上泼了盆冷水:光堆Token没用,得靠Claude Code这类编程助手搭好工程框架,模型能力才能落地。他透露还在训模型,后续要发音乐、具身世界和游戏世界模型,认为模型和算力才是长期饭碗。另外他提醒,AI写代码会留下技术债,生产事故可能翻几倍,代码审查和责任机制得跟上。正文没披露具体模型参数或发布时间,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
11:11
61d ago
AI HOT 精选· aihot-apiZH11:11 · 07·23
Google 开源 Agent Skills:教 AI 代理安全操作云服务,已有近 70 套指令
Google 在 GitHub 上开源了一套 Agent Skills,本质上是教 AI 编码代理如何安全操作云服务的指令集。目前仓库里有近 70 套指令,覆盖 8 个类别,每套都包含专家验证过的操作流程、只读与变更操作之间的安全闸门,以及执行前对环境变量和 IAM 权限的预检。文章提到了安全审计、Serverless 部署和 BigQuery 流水线...
#Agent#Google Cloud#Google AI#Romin Irani
一句话点评
Google 开源了一套 Agent Skills,本质是教 AI 编码代理安全操作云服务的指令集。仓库目前有近 70 套指令,覆盖 8 个类别,每套都包含专家验证的操作流程、只读与变更操作间的安全闸门,以及执行前的环境变量和 IAM 权限预检。文章提到了安全审计、Serverless 部署和 BigQuery 流水线优化,但没具体说覆盖哪些云产品。作者也提醒,用 Agent Skills ...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H0·K1·R0
09:00
61d ago
最佳拍档· atomZH09:00 · 07·23
大模型每个参数能存多少信息?ICML 2026 论文说约 3.6 比特
这篇 ICML 2026 论文用信息论估算大模型每个参数的记忆容量,结论是大约 3.6 比特。还讨论了非预期记忆(模型意外记住训练数据中的偶然模式)、双下降(模型变大时泛化能力先变差再变好)和成员推断攻击(判断某条数据是否在训练集里)。正文没披露用了什么模型或数据集,也没说 3.6 比特是理论值还是实验值,所以这点先别太激动。
#ICML
一句话点评
ICML 2026 一篇论文用信息论估算大模型每个参数能存约 3.6 比特信息。这个数字本身挺有意思,但正文没披露用了什么模型或数据集,也没说 3.6 比特是理论推导还是实验测出来的,所以先别太激动。论文还聊了非预期记忆(模型意外记住训练数据里的偶然模式)、双下降(模型变大时泛化先变差再变好)和成员推断攻击(判断某条数据是否在训练集里),都是老话题,没看到新结论。 短评:3.6 比特/参数...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0

更多

频道

后台