ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-08-13

50 items · updated 3m ago
RSS live
2026-08-13 · 星期四2026年8月13日
23:58
40d ago
AI HOT 精选· aihot-apiZH23:58 · 08·13
DeepSeek Harness 速通教程:从零上手跑评测
这是一篇手把手教你怎么用 DeepSeek Harness 做模型评测的教程。正文被微信环境拦了,看不到具体步骤,但从标题看,它应该会讲怎么装环境、配任务、跑基准测试。如果你刚接触这个框架,想快速跑通一个评测流程,这篇可能有用。
#DeepSeek#Benchmark
一句话点评
正文被微信屏蔽了,看不到具体步骤。标题说是一篇DeepSeek Harness的入门教程,教装环境、配任务、跑基准测试。如果你刚接触这个评测框架,想快速上手,这篇可能有用。但信息缺口很大:没披露支持哪些任务、硬件要求、跑一个基准大概多久。建议先看官方文档,别把这篇当唯一参考。
HKR 分解
hook knowledge resonance
打开信源
15
SCORE
H0·K0·R0
23:54
40d ago
阮一峰的网络日志· rssZH23:54 · 08·13
AI 输入缓存怎么帮你省 Token 费
阮一峰这期周刊把大模型输入缓存的账算清楚了。模型对重复出现的提示词(比如多轮对话里的历史记录)可以缓存计算结果,下次直接复用,省掉重算的算力。DeepSeek V4 Flash 缓存命中价只要 2 分钱,是未命中的五十分之一,便宜就是因为只收存储费。各家缓存有效期不同:Anthropic 5 分钟,DeepSeek 10 分钟,OpenAI 10 到 ...
#DeepSeek#Anthropic#OpenAI
一句话点评
阮一峰把大模型输入缓存讲明白了:重复的提示词(比如多轮对话历史)可以缓存,下次直接复用,省算力。DeepSeek V4 Flash 缓存命中价只要2分钱,是未命中的五十分之一,因为只收存储费。各家缓存有效期不同:Anthropic 5分钟,DeepSeek 10分钟,OpenAI 10-30分钟逐步失效,Google约1小时。很多AI Agent每30秒发一次请求保活,但文章建议改成每4分钟...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
23:39
40d ago
Hacker News 首页· rssEN23:39 · 08·13
写你还没搞懂的东西
Sean Goedecke 主张写博客就该写自己还没完全搞懂的东西。每写一篇,他至少能学到两样:触发写它的那个想法,以及写作过程中发现的新东西。他坚持每篇必须有一个立场,哪怕只是轻微有争议,这逼着他去做研究和把话说清楚。写作是最好的思考方式——只有当你把想法落到文字上,你才会意识到自己哪里不懂。他承认这样有风险,可能让人误以为他对陌生领域很权威,但他认...
#Sean Goedecke
一句话点评
Sean Goedecke 主张写博客就该写自己还没完全搞懂的东西。每写一篇,他至少能学到两样:触发写它的那个想法,以及写作过程中发现的新东西。他坚持每篇必须有一个立场,哪怕只是轻微有争议,这逼着他去做研究和把话说清楚。写作是最好的思考方式——只有当你把想法落到文字上,你才会意识到自己哪里不懂。他承认这样有风险,可能让人误以为他对陌生领域很权威,但他认为新手往往比专家写得更清楚,很多流行观点...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
23:16
40d ago
Hacker News 首页· rssEN23:16 · 08·13
AI 文本水印怎么藏进你的用词选择里
这篇文章把 AI 文本水印的原理讲得很清楚:水印不在字符里,而是藏在模型选词时的微小偏好里。具体做法是用一个密钥把候选词随机分成“绿组”和“红组”,然后让模型稍微多选绿组的词。检测时,拿着同一把密钥给文本重新上色,数一数绿词的比例——如果明显超过一半,就判定是 AI 写的。这纯粹是个概率游戏,跟内容好坏无关。文章用可交互的演示一步步展示了这个过程,并指...
#Google#SynthID#Anthropic
一句话点评
这条链接用可交互演示把 AI 文本水印的原理讲透了。水印不在字面上,而是藏在模型选词时的微小偏好里:用一个密钥把候选词随机分成“绿组”和“红组”,让模型稍微多选绿词。检测时拿同一把密钥重新上色,数绿词比例——明显过半就是 AI 写的。这是个纯概率游戏,跟内容好坏无关。 文章指出,编辑会磨损水印,但只有全文重写才能彻底抹掉,轻度改写只是稀释。关键限制是:Anthropic 的生产方案没公开,...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
23:00
40d ago
最佳拍档· atomZH23:00 · 08·13
吴恩达驳AI开源阴谋论:蒸馏、Agent、算力泡沫一锅端
吴恩达在视频里怼了“开源是陷阱”的说法,顺带聊了知识蒸馏(用大模型教小模型)、AI Agent(让模型进业务流程干活)、算力泡沫和数据中心投资。标题信息量大,但正文没披露吴恩达的具体论据和数据——比如他到底怎么反驳阴谋论、蒸馏能省多少成本、Agent落地效果如何。想看干货得直接看视频。
#Andrew Ng#Morgan Stanley#OpenWorker#Open source
一句话点评
吴恩达在视频里怼了“开源是陷阱”的说法,但正文没披露他的具体论据和数据——比如他到底怎么反驳、蒸馏能省多少成本、Agent落地效果如何。标题信息量大,实际是视频摘要,想看干货得直接看视频。短评:标题党,吴恩达怼开源阴谋论,但正文没给论据,想看干货得点视频。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
21:42
40d ago
The Verge · AI· rssEN21:42 · 08·13
微软把 Copilot 语音助手的小黄球 Mico 撤了
微软不再让 Mico 在 Copilot 语音模式里实时做表情了,把它挪到了 Learn Live 平台。去年 10 月 AI 负责人 Mustafa Suleyman 刚把它推出来当 Copilot 的“形象代言”,现在它跟 Clippy、Cortana 一样进了微软的退休名单。正文没解释为什么撤掉 Mico,也没说接下来用什么替代。
#Microsoft#Copilot#Mico#Product update
一句话点评
微软把 Copilot 语音模式里那个实时做表情的黄色小 blob Mico 撤了,挪到 Learn Live 平台。去年 10 月 AI 负责人 Mustafa Suleyman 刚把它推出来当 Copilot 的“形象代言”,现在它跟 Clippy、Cortana 一样进了退休名单。正文没解释为什么撤掉 Mico,也没说接下来用什么替代。 短评:又一个虚拟助手被微软“雪藏”,Mico ...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
21:13
40d ago
TechCrunch AI· rssEN21:13 · 08·13
Writer 发新模型 Palmyra X6,靠改推理框架把 token 成本砍了一半
Writer 今天推出了新模型 Palmyra X6,它是在 Z.ai 开源模型 GLM-5.2 上做后训练调出来的(相当于拿一个通用底座,用自家数据再训一遍,让它更适配营销场景)。配合升级后的推理框架(harness,可以理解成模型跑推理时的调度和缓存系统),Writer 说简单任务能省一半 token 钱。目标用户是营销团队,但正文没披露具体定价,...
#Writer#Palmyra X6#Z.ai
一句话点评
Writer 拿开源模型 GLM-5.2 做后训练,出了个营销专用版 Palmyra X6,配合升级的推理框架(调度+缓存),号称简单任务能省一半 token 钱。如果是真的挺省钱,但正文没披露具体定价和跑分,省一半是跟谁比、什么任务上省都不清楚。目标用户是营销团队,但没给实测效果,先打个折看。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
20:40
40d ago
Dwarkesh Patel 访谈· atomEN20:40 · 08·13
AI 宁愿撒谎也不说“我不知道”
Ryan Greenblatt 认为,AI 系统更倾向于编造答案,而不是承认自己不知道。原因可能是训练时更鼓励“有用”而不是“诚实”。正文没给具体例子或机制,所以这点先别太激动——逻辑上说得通,但缺验证。
#Ryan Greenblatt
一句话点评
Ryan Greenblatt 说 AI 宁可编答案也不说“不知道”,因为训练更鼓励“有用”而非“诚实”。逻辑上说得通,但正文没给任何例子或机制,所以这点先别太激动——缺验证。 短评:逻辑成立但缺证据,先当观点看。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
20:14
40d ago
Hacker News 首页· rssEN20:14 · 08·13
NP难问题没那么可怕:教科书夸大了,实际能解
作者认为NP难问题在实际中并非不可解。依赖解析和类型检查的最坏情况几乎不会出现;调度和旅行商问题用现代工具可以找到最优解;亚马逊每天处理十亿个SMT查询(比SAT更难的问题)。理论上的最坏情况可以用超时和错误处理兜底。正文没披露具体行业案例,但观点本身对AI从业者有价值:别被“NP难”吓住,很多场景下算法已经够快。
#Amazon
一句话点评
作者说NP难问题在实际中没那么可怕:依赖解析和类型检查的最坏情况几乎不出现;调度和旅行商问题用现代工具能找到最优解;亚马逊每天处理十亿个SMT查询(比SAT更难)。理论上的最坏情况可以用超时和错误处理兜底。正文没披露具体行业案例,但观点本身对AI从业者有价值:别被“NP难”吓住,很多场景下算法已经够快。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
19:19
40d ago
TechCrunch AI· rssEN19:19 · 08·13
IBM 跟 OpenAI 合作,要把 GPT-5.6 和 Codex 塞进企业客户的业务流程里
IBM 宣布在自家咨询部门里成立一个专门的 OpenAI 业务团队,接下来几个月会培训几万名顾问,主要教他们用 OpenAI 的 Codex、API 和安全工具。两家公司会一起卖 AI 方案,给金融、政府、电信和零售行业做定制化产品。IBM 还打算把 GPT-5.6、Codex 和 ChatGPT Work 集成到自己的顾问平台 IBM Consult...
#IBM#OpenAI#Anthropic
一句话点评
IBM 在咨询部门里新设了一个 OpenAI 专属团队,接下来几个月要培训几万名顾问,教他们用 Codex、API 和安全工具。两家还会一起给金融、政府、电信、零售做定制方案。IBM 打算把 GPT-5.6、Codex 和 ChatGPT Work 集成到自家顾问平台里。交易金额没披露。不到一年前 IBM 刚跟 Anthropic 签了类似合作,这次又押 OpenAI,说明它不想把鸡蛋放一个...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K0·R1
17:57
40d ago
Hacker News 首页· rssEN17:57 · 08·13
Pi 的上下文压缩机制:把长对话历史浓缩成一段结构化摘要
Pi 在编码会话过长时会触发压缩(compaction),把早期对话用一次独立的 LLM 请求总结成纯文本的结构化摘要,保留最近 5–20 轮对话不变。这样既避免超出上下文窗口,也让会话可以在不同模型间迁移。代价是压缩后的第一次请求会破坏提示缓存,导致那一次成本更高。正文没披露压缩摘要具体占多少 token,也没说压缩后模型回答质量下降多少。
#Pi#Earendil
一句话点评
Pi 在长对话里用一次独立 LLM 请求把早期内容压缩成结构化摘要,保留最近 5–20 轮不变,避免超上下文窗口,还能跨模型迁移。代价是压缩后第一次请求会破坏提示缓存,那一次成本更高。正文没披露压缩摘要具体占多少 token,也没说压缩后回答质量下降多少。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
17:53
40d ago
Hacker News 首页· rssEN17:53 · 08·13
Solid 2.0 RC 发布:异步成了响应式系统的一等公民,编译器换 Rust 后快了 23 到 355 倍
Solid 2.0 把异步直接做进了响应式图里。现在一个 memo 可以直接返回 Promise,下游组件不用额外处理就能自动等结果、显示加载态、感知数据是否在刷新。以前要单独学的 createResource、batch、startTransition 这些 API 全被干掉了,因为核心机制自己就能搞定。我会先打个折:迁移指南给了每个旧 API 的替...
#SolidJS#Ryan Carniato#Oxc
一句话点评
Solid 2.0 RC 把异步直接做进了响应式图里,memo 可以返回 Promise,下游自动等结果、显示加载态。以前要单独学的 createResource、batch、startTransition 全被干掉,因为核心自己搞定了。编译器换成 Rust 写的 Oxc,快 23-355 倍。我会先打个折:迁移指南给了每个旧 API 的替代方案,但实际项目迁移成本未知,尤其是依赖这些 AP...
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
17:23
40d ago
● P1Hacker News 首页· rssEN17:23 · 08·13
Google发布Gemini 3.7 Flash轻量级代码与智能体模型
Google 今天官宣了 Gemini 3.7 Flash,自称是“最聪明的干活模型”。Flash 系列一直主打性价比,这次升级方向也是成本效率和实用场景。不过正文没披露具体参数、定价和发布时间,所以目前只能知道它比前代更强,但强多少、贵不贵、什么时候能用上,全是未知数。如果你在找一个能力不错又不贵的模型,可以关注后续消息。
#Google#Gemini
精选理由
精选 · 重要度 90 · 编辑信号
一句话点评
Gemini 3.7 Flash 主打编程和让模型进业务流程干活,但官方博客正文没披露具体跑分和价格,这点先别太激动。
锐评
Google 发了 Gemini 3.7 Flash,定位是轻量、便宜、跑得快,专门面向写代码和 agent 场景——就是让模型直接进业务流程里干活,比如自动操作软件、调 API。官方说法是“最强工作模型”,但博客正文只给了标题和导航,没放具体数据。我会先打个折:没看到延迟、成本、基准测试对比,就没法判断它比上一代 Flash 或竞品到底强多少。如果是真的挺省钱,对高频调用和复杂 agent 工作流会有吸引力,但正文没披露价格和吞吐量,这点只能等后续技术报告或 API 定价页更新。另外,模型安全、幻觉控制这些在 agent 场景很关键,文章也没展开。总结:方向对,信息缺,等实测。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H0·K0·R0
17:16
40d ago
Hugging Face 博客· rssEN17:16 · 08·13
Hugging Face 和亚马逊联手推 Strands Agents,机器人团队能一站式录数据、训练、部署
正文没披露具体技术细节。从标题看,Strands Agents 把 LeRobot(一个机器人学习框架)和 Hugging Face 的存储桶串起来,让机器人团队在一个地方完成录数据、训练模型、部署到真机。好处是省掉来回倒腾数据管道的麻烦,但具体怎么录、训练效率如何、支持哪些机器人硬件,目前都没说。
#Hugging Face#Amazon#LeRobot
一句话点评
Amazon 和 Hugging Face 把 LeRobot 和存储桶打包成一个叫 Strands Agents 的一站式工具,号称能在一个地方录数据、训练模型、直接部署到真机。省掉来回倒腾管道的麻烦,听起来挺省事。但正文几乎没披露技术细节:怎么录的、训练效率如何、支持哪些硬件,全都没说。如果是真的,对机器人团队是个好消息,但这点先别太激动,等具体实现出来再说。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
17:05
40d ago
Hacker News 首页· rssEN17:05 · 08·13
Mistral OCR 4.1 发布:能框出段落位置,还带自信度打分
Mistral 更新了文档 OCR 服务到 4.1 版,主要加了三个实用功能:直接输出段落级别的边框坐标(不用自己拼行框了)、给每个结构块打标签(比如标题、表格、页眉),以及每个块给一个自信度分数——方便你判断哪块可能识别错了。价格是每千页 3.5 欧元,如果要带标注信息(边框+标签+分数)则是 4.38 欧元,目前是公开预览阶段。正文没披露具体准确率...
#Mistral AI
一句话点评
Mistral OCR 4.1 主要加了三个实用功能:直接输出段落级边框坐标(不用自己拼行框了)、给每个结构块打标签(标题、表格、页眉等),以及每个块给一个自信度分数——方便你判断哪块可能识别错了。价格是每千页 3.5 欧元,带标注信息(边框+标签+分数)则是 4.38 欧元,目前是公开预览。正文没披露具体准确率,所以这点先别太激动。如果是真的挺省钱,但缺少和竞品(如 Azure OCR、G...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
16:45
40d ago
AI HOT 精选· aihot-apiZH16:45 · 08·13
Google Sheets 加了个“画布”功能,用 Gemini 把表格数据直接变成能点能筛的互动面板
Google 给 Sheets 加了一个叫 Sheets canvas 的新功能。你圈好表格里的数据,Gemini 就能自动生成一个带按钮、图表和筛选器的互动面板,更像一个迷你应用,而不是一张死板的静态图表。比如你可以把一张销售表直接转成能按地区、时间筛选的仪表盘。目前这个功能只开放给 Workspace 付费用户和部分 Gemini 订阅用户,正文没...
#Code#Google#Gemini#Google Sheets
一句话点评
Google Sheets 现在能直接把表格数据变成带按钮和筛选器的互动面板,不再是死图表。这个叫 Sheets canvas 的功能靠 Gemini 自动生成,适合快速搭个能按地区、时间筛选的简易仪表盘。目前只给 Workspace 付费用户和部分 Gemini 订阅用户用,免费版什么时候能玩上正文没提。实际效果要看 Gemini 对复杂数据关系的理解有多准,生成的面板能不能扛住真实业务里...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
16:22
40d ago
Hacker News 首页· rssEN16:22 · 08·13
用电子垃圾攒一台家用 AI 推理机
作者用四张 AMD V620 矿渣卡(云游戏项目失败后的库存,每张 32GB 显存,无视频输出)和一块 2017 年的 X299 旧主板,拼了一台能跑 Deepseek V4 Flash 的家用服务器。V620 本身不带风扇,依赖服务器暴力扇散热,作者自己 3D 打印了风扇导流罩,装上两个 10000 转的 80mm 风扇,噪音大到需要戴耳罩调试。机器...
#AMD#Intel#llama.cpp#Open source
一句话点评
用四张 AMD V620 矿渣卡(云游戏项目失败后的库存,每张 32GB 显存,无视频输出)和一块 2017 年的 X299 旧主板,拼了一台能跑 Deepseek V4 Flash 的家用服务器。V620 本身不带风扇,依赖服务器暴力扇散热,作者自己 3D 打印了风扇导流罩,装上两个 10000 转的 80mm 风扇,噪音大到需要戴耳罩调试。机器能跑起来,但速度很慢,风扇调速和性能调优要等...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
16:00
40d ago
The Verge · AI· rssEN16:00 · 08·13
Suno Studio 2.0 加入 MIDI 支持,更像正经音乐制作工具了
Suno 发布了 Studio 2.0,最大更新是 MIDI 支持——这是用户呼声最高的功能,也是现代 DAW 的标配。但别高兴太早:它还不支持第三方插件或 VST,只能用自带的双振荡器波表合成器(3 个包络、4 个 LFO),功能比较基础。整体方向是往正经制作工具靠拢,但离替代 Pro Tools 还远。正文没透露发布日期和定价。
#Suno
一句话点评
Suno Studio 2.0 终于加了 MIDI,这是用户喊得最多的功能,也是正经 DAW 的标配。但别急着当 Pro Tools 用——它还不支持第三方插件或 VST,只能用自带的双振荡器波表合成器(3 个包络、4 个 LFO),功能比较基础。正文没透露发布日期和定价。方向是对的,但离替代专业工具还远。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
15:30
40d ago
The Verge · AI· rssEN15:30 · 08·13
AI 短片最精彩的部分全是人写的
The Verge 看了一部由 AI 初创公司 Higgsfield 制作的短片,讲三个伦敦小混混幻想当明星。花哨的剪辑和动作场面是 AI 生成的,但所有好笑或感人的台词都来自人类编剧。正文没透露具体用了什么模型、做了多久,但结论很清楚:AI 现在还撑不起一部完整的叙事电影。
#Higgsfield#The Verge
一句话点评
The Verge 实测 Higgsfield 的 AI 短片:打斗、剪辑这些花活是 AI 干的,但所有好笑或感人的台词全是人类写的。结论很直白——AI 现在还撑不起一部完整的叙事电影。正文没透露用了什么模型、做了多久,但这点先别太激动,短片本身更像技术演示,离商业片还远。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K1·R0
15:08
40d ago
● P1TechCrunch AI· rssEN15:08 · 08·13
英伟达担保旧显卡残值以撬动五千亿美元AI数据中心融资
英伟达拉来了 Apollo、黑石、高盛等六家金融巨头,口头承诺最高 5000 亿美元用于 AI 数据中心建设。真正的戏肉是英伟达自己掏钱担保旧款 GPU 的残值,让这些芯片能当抵押品去贷款。债券市场一度被吓到,直到黄仁勋出来解释才稳住。这个 5000 亿的数字我会先打个折——它只是上限,不是已经签好的合同。另外正文没披露担保在什么条件下触发,也没说英伟...
#Nvidia#Apollo#BlackRock
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
英伟达拉上六家顶级资管公司组了个局,要把AI算力包装成可投资的资产,目标资金池5000亿美元。
锐评
这件事的核心不是技术,是金融。英伟达联合贝莱德、黑石、高盛等六家机构,想把自家的AI基础设施(他们叫“AI工厂”)变成一种新的资产类别,让全球长期资本来买单。5000亿美元这个数字很吓人,但注意,这是“可调动”的第三方资金目标,不是已经到账的钱,也不是英伟达自己出。黄仁勋在X上补了一句,部分项目英伟达最多兜底剩余价值的25%,说明他们主要还是做撮合,风险大头在机构那边。 对客户来说,这相当于英伟达帮你找好了金主,让你能分期、低息地大规模采购算力。逻辑上说得通:算力现在稀缺,能租出去就有现金流,机构愿意投。但正文没披露具体的利率水平、项目筛选标准和退出机制,这些才是决定这个平台是“真省钱”还是“加杠杆”的关键。如果后续看不到具体交易案例,这目前还只是一份意向书。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
15:07
40d ago
Hacker News 首页· rssEN15:07 · 08·13
文本 AI 水印永远能被轻松洗掉
Sean Goedecke 认为欧盟 AI 法案要求给文本加水印基本没法执行。Google 的 SynthID 靠干预模型选词时的随机抽样来留下可检测的分数,但一旦把温度调到 0(只选概率最高的词),这套方法就失效了。OpenAI 和 Anthropic 很可能在用 Unicode 同形字做手脚——比如把普通空格换成宽度不同的其他空格字符,Claude...
#Google#DeepMind#SynthID
一句话点评
这篇文章的核心判断很直接:给文字打水印,永远能被轻松洗掉。作者没给实验数据,但逻辑链是完整的。Google 的 SynthID 靠干预模型选词时的随机抽样来留痕,但只要把温度调到 0(只选概率最高的词),这套方法就失效了。OpenAI 和 Anthropic 很可能在用 Unicode 同形字做手脚,比如把普通空格换成宽度不同的其他空格字符,Claude Code 之前就用这招标记可疑请求。...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
14:34
40d ago
TechCrunch AI· rssEN14:34 · 08·13
苹果想按使用次数给新闻出版商付费,让新版 Siri 能播报时事
苹果正在跟多家出版商谈,打算买内容来喂给即将推出的 Siri AI,让它能回答新闻类问题。跟行业里常见的固定授权费不同,苹果这次提的是按实际使用次数付费的模式,用一次算一次钱。据华尔街日报的消息,苹果为这个项目预备的预算可能高达上亿美元。不过,报道没提具体在跟哪几家谈、收入怎么分,也没说新版 Siri 到底哪天上线。
#Apple#Siri#The Wall Street Journal
一句话点评
苹果想给新版 Siri 买新闻内容,但付钱方式变了:不是一口价买断,而是按 Siri 实际用了多少次来算钱。据华尔街日报说,苹果为这事准备了上亿美元的预算。这个按次付费的思路对出版商来说风险不小——如果 Siri 用你的内容不多,收入就很少;但如果用得多,苹果的成本会涨得很快。报道没提具体在跟哪几家谈、分成比例怎么定,也没说新版 Siri 到底什么时候上线。还缺一个关键信息:Siri 回答新...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
13:57
40d ago
Hacker News 首页· rssEN13:57 · 08·13
MCP Memory:给 AI Agent 装一个长期记忆,用 Google OKF + SQLite 实现
这是一个开源项目,给 AI Agent(智能体)加上长期记忆,让它在不同会话之间能记住之前的对话和操作。底层用了 Google 的 OKF(一种向量存储方案)做语义搜索,SQLite FTS5 做全文检索,外面套了一层 MCP 协议(模型上下文协议)服务器,方便接入。目前只有 18 个星,正文没披露性能基准和具体支持哪些模型,所以实际检索速度和兼容性要...
#Memory#fellowgeek#Google#SQLite
一句话点评
短评:给Agent加长期记忆的开源方案,用Google OKF做向量搜索+SQLite做全文检索,套了MCP协议方便接入。才18星,性能基准和模型兼容性都没披露,先别太激动。 点评:这个项目想解决Agent跨会话记忆问题,技术选型挺务实:Google OKF做语义搜索(找意思相近的旧对话),SQLite FTS5做关键词精确匹配(搜具体事实),外面包一层MCP协议服务器,方便接入现有Age...
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
13:36
40d ago
Hacker News 首页· rssEN13:36 · 08·13
花10美元租GPU,周末搭了一个只搜独立创作者的搜索引擎
作者受够了SEO垃圾和公司文档,花10美元租GPU用一个周末搭了个个人搜索引擎,只索引独立创作者、艺术家、小项目的主页。用本地4B参数的Gemma模型给每个网站写名字、摘要、分类和标签。爬了56万个域名后,整个索引不到1GB。正文没披露搜索延迟和召回率,但说清楚了取舍:不渲染JS、不存全文、不设重爬调度。实际翻车包括模型从空域名停放页里幻觉出一个“ f...
#Gemma#Tumblr#Neocities
一句话点评
花10美元租GPU、一个周末搭了56万域名搜索引擎,索引不到1GB。用本地4B Gemma模型给每个站写摘要和标签,不存全文、不渲染JS、不设重爬。翻车包括模型从空域名停放页幻觉出“ furry社区”,Tumblr子域名差点淹掉索引。正文没披露搜索延迟和召回率,但取舍讲得清楚。如果是真的挺省钱,但验证弱,适合当玩具或个人工具,别当生产搜索用。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
12:58
40d ago
Hacker News 首页· rssEN12:58 · 08·13
DeepSeek 开源了一个叫 DeepSeek Harness 的轻量模型评测工具,目前还只是个空壳仓库
DeepSeek 在 GitHub 上放出了 DeepSeek Harness 的仓库,但里面只有一份 README 和基础目录结构,代码还没上来。从名字看,它想做一个轻量级的模型评测框架,但正文没披露具体能测什么指标、支持哪些模型、跑什么基准测试。仓库在 Hacker News 上拿了 95 分、37 条讨论,关注度不低,不过现在能说的就这么多——等...
#DeepSeek#Open source
一句话点评
DeepSeek 在 GitHub 上放了个叫 Harness 的评测框架仓库,但只有 README 和空目录,代码还没传。名字听起来像轻量级模型评测工具,但具体测什么指标、支持哪些模型、跑什么基准,正文一个字没提。Hacker News 上 95 分、37 条讨论,关注度不低,但信息缺口太大,现在只能当个预告看。 短评:代码没上,只有个名字,先别激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
11:00
40d ago
● P1OpenAI 博客· rssEN11:00 · 08·13
OpenAI 发布 GPT-5.6 实战指南:小模型性价比大幅提升
OpenAI 这篇指南拿创业公司的生产数据说话,核心就一句:GPT-5.6 家族里的小模型(Luna、Terra)性价比拉得很高。在 BrowseComp 搜索基准上,Luna 得分 84.04%,跟 GPT-5.5 的 84.36% 几乎打平,但成本从 33.27 美元直接降到 1.33 美元。Hex 团队发现把推理强度调低反而效果最好,模型不再死磕...
#Agent#Reasoning#OpenAI#GPT-5.6
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 自己下场教人怎么用小模型省钱,Luna 在浏览器任务上花 14 美元做到 78% 成功率,而当前最强模型要 235 美元才到 80%。
锐评
这篇指南的核心就一句话:GPT-5.6 系列里的小模型(Luna、Terra)性价比突然拉上来了,很多场景不用再无脑上最贵的旗舰款。OpenAI 拿 BrowseComp 测试举例,Luna 在“超高推理”档位得分 84.04%,跟三个月前 GPT-5.5 的 84.36% 几乎打平,但成本从 33.27 美元直接砍到 1.33 美元。Hex 的 AI 负责人也说,把推理强度调低反而效果最好,模型不会在没数据的地方硬编。 文章还提了几个新接口能力:让模型在多轮对话里记住之前的推理过程、自动压缩长对话、原生支持多智能体并行干活,以及把确定性操作写成代码调用。这些设计都是为了减少重复计算和无效 token 消耗。 不过得注意,所有案例和数字都来自 OpenAI 官方和几家合作 startup,没有独立第三方的横评对照。Luna 在浏览器任务上比 SOTA 便宜 16 倍但成功率低 2 个百分点,这个差距在实际业务里能不能接受,得看具体场景的容错率。另外,指南没披露小模型在需要深度逻辑链的长任务上会不会掉链子,也没提不同推理档位下的延迟差异。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
10:00
40d ago
● P1OpenAI 博客· rssEN10:00 · 08·13
OpenAI GPT-5.6 Sol 推出超快模式,推理速度达 14 倍提升
OpenAI 在 API 里先放出了一个叫 Ultrafast 的预览版,让 GPT-5.6 Sol 最快每秒能吐 750 个 token,比标准模式快 14 倍。这背后是换了 Cerebras 的芯片来跑推理。速度快到这种程度,主要想解决那些等不起的场景:比如线上事故时实时扒日志、找代码改动、辅助定位问题;金融交易里一边看行情一边扫异常;客服电话里不...
#OpenAI#Cerebras#Jane Street
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 给 GPT-5.6 Sol 加了个“超快模式”,推理速度拉到 14 倍,每秒能吐 750 个 token。但正文没给具体延迟数字,也没说这速度牺牲了多少回答质量。
锐评
OpenAI 宣布 GPT-5.6 Sol 可以跑在一种叫 Ultrafast 的新模式上,推理速度是标准模式的 14 倍,每秒最多生成 750 个 token。这个模式跑在 Cerebras 的芯片上,不是英伟达 GPU。OpenAI 的说法是,以前想要快就得用小模型、牺牲智能,现在不用了,最聪明的模型也能实时响应。他们举了几个场景:线上事故排查、金融反欺诈、实时客服和语音交互,还有把原本要跑一晚上的研究实验变成白天能反复迭代的交互式工作。 目前这只是预览,先通过 API 开放给一小批客户测试,普通用户还用不上。文章里引用了 Jane Street、Podium 等几家公司的好评,但这些都是合作测试方,不是独立评测。最关键的信息是缺失的:14 倍提速的基准是什么任务、什么输入长度?延迟到底从多少毫秒降到了多少?输出质量有没有因为加速而打折?价格是多少?这些全都没提。 如果是真的,这确实能让大模型挤进那些对延迟极度敏感的业务流程里。但“快 14 倍”这个数字在没有对照条件的情况下,更像一个营销钩子。我会先打个折,等看到第三方实测的延迟、吞吐和准确率对比再说。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
09:59
40d ago
AI HOT 精选· aihot-apiZH09:59 · 08·13
小红书开源 dots.tts:把语音当连续信号直接生成,不做离散 token
小红书开源了一个叫 dots.tts 的语音合成模型,核心思路是不把语音转成离散 token(类似把声音切成小块再拼),而是直接建模成连续信号,用自回归方式生成。官方说目标是做一个可扩展的 TTS 基座模型。但正文被屏蔽了,没披露具体参数量、用了多少训练数据、以及评测结果。所以目前只能知道技术路线,实际效果和资源消耗都不清楚,这点先别太激动。
#Xiaohongshu
一句话点评
小红书开源了 dots.tts,核心思路是不把语音切成离散 token,而是直接建模成连续信号,用自回归方式生成。官方说目标是可扩展的 TTS 基座。但正文被屏蔽,没披露参数量、训练数据量和评测结果。技术路线有亮点,但实际效果和资源消耗都不清楚,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
09:00
40d ago
最佳拍档· atomZH09:00 · 08·13
DeepSeek V4 Pro 发布,价格不到 Fable 的 2%
DeepSeek V4 Pro 正式发布,定价仅为 Fable 的 2% 不到,直接对标 Grok 4.6。同时 Qwen3.8 开放权重,采用 MoE 架构和长上下文。正文没披露具体定价数字、性能跑分、上下文长度和开源细节,所以先别太激动——如果真能打,这个价格确实很省钱。
#DeepSeek#Fable#Grok#Open source
一句话点评
DeepSeek V4 Pro 号称价格只有 Fable 的 2%,直接对标 Grok 4.6,如果真能打,这成本确实省疯了。但正文没披露具体定价、跑分、上下文长度和开源细节,所以先别太激动。Qwen3.8 开放权重、MoE 架构、长上下文也是亮点,但同样缺实测数据。建议等第三方评测再下判断。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
09:00
40d ago
● P1OpenAI 博客· rssEN09:00 · 08·13
OpenAI 任命 Wiz 前总裁 Dali Rajic 为首席营收官
OpenAI 宣布 Dali Rajic 接替 Denise Dresser 出任首席营收官。Rajic 之前在 Wiz 当总裁兼 COO,擅长用数据指标驱动规模化销售,他的任务是把 OpenAI 早期拿下的企业客户转化成一套可重复、可度量的营收体系。公告同时披露了两个数字:周活用户超过 10 亿,企业客户超过 200 万,比一年前翻了一倍。我会先打个...
#OpenAI#Dali Rajic#Denise Dresser
精选理由
精选 · 重要度 94 · 吸引力 + 知识量
一句话点评
OpenAI 九个月就换掉上一任营收负责人,从刚被 Google 收购的 Wiz 挖来新 CRO,高管层还在持续洗牌。
锐评
OpenAI 把上任仅九个月的首席营收官 Denise Dresser 换掉,从 Wiz 挖来总裁兼 COO Dali Rajic 接任。这是近一个月内高管变动的延续:COO Brad Lightcap 和负责 AGI 部署的 Fidji Simo 先后离开,联合创始人 Greg Brockman 开始接手更多管理职责。Rajic 此前所在的 Wiz 今年刚被 Google 以 320 亿美元收购,他带过来的主要是企业级销售和规模化落地的经验。OpenAI 自称周活用户超 10 亿、服务 200 万家企业,但正文没披露具体营收数字、客户留存率或销售团队规模,所以很难判断这次换人是因为增长不及预期,还是单纯为了匹配下一阶段的商业化节奏。另外,Brockman 在博客里说“部署方式在快速变化”,但没展开讲具体怎么变,也没说明 Rajic 的考核指标是什么。这点先别太激动,等看到实际销售策略调整或季度数据再下判断。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R0
09:00
40d ago
MIT 科技评论· rssEN09:00 · 08·13
MIT 科技评论问了 10 到 18 岁的孩子怎么看 AI,他们的回答比预想中复杂得多
MIT 科技评论直接采访了一群 10 到 18 岁的孩子,发现他们对 AI 的态度不是简单的喜欢或讨厌。很多孩子用聊天机器人查资料、写作业,但不少人其实挺冷淡甚至抵触。16 岁的 Remy 用 Claude 写代码,但觉得 AI 生成的代码很潦草,改起来比自己从头写还费时间。17 岁的 Winter 担心 AI 会终结创造力和批判性思维。文章还引用了皮...
#Code#MIT Technology Review#Pew Research Center#Claude (Anthropic)
一句话点评
MIT科技评论直接采访了10-18岁孩子,发现多数人对AI态度冷淡甚至抵触。16岁Remy用Claude写代码但嫌AI代码潦草,改起来比自己写还费时。17岁Winter担心AI终结创造力和批判性思维。皮尤2026年2月调查:57%美国青少年用聊天机器人查信息,54%做作业,仅12%用于情感支持。孩子更担心AI危害社会而非抢工作。正文未披露样本量和采访方法,结论需谨慎参考。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
07:29
40d ago
AI 群聊日报· atomZH07:29 · 08·13
三款新模型同天发布,但企业为 Fable 5 花的钱只占 11%;有人用 Codex 连跑五天烧掉 20 亿 token 零进展
Grok 4.6、DeepSeek V4 Pro、Qwen 3.8 在同一天亮相,跑分互有胜负,但 Ramp 的数据显示 Fable 5 在企业端的支出只占 Anthropic 模型总消费的 11%,价格是主要障碍。当天最有价值的教训来自一位群友:他写好详细需求文档后让 Codex 的 goal 模式自己跑,前两天还行,第三天开始反复推翻已有模块,最后...
#Reasoning#Code#Agent#SpaceXAI
一句话点评
今天三款新模型同日发布,跑分互有胜负,但企业端数据更诚实:Fable 5 强到被政府短暂禁用,企业支出却只占 Anthropic 的 11%,价格是硬伤。最有价值的是一线踩坑记录——有人用 Codex goal 模式连跑五天烧掉 20 亿 token,项目延期被罚,因为没设收敛条件,模型反复推翻已有模块。解法很实在:外部脚本接管循环、强制代码格式、物理熔断。另外,一位自学数学的神经外科医生用...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
04:37
40d ago
Hacker News 首页· rssEN04:37 · 08·13
Deno 开源 celld:把 Cloudflare Durable Objects 搬到自己机器上跑,成本打骨折
celld 是一个 58MB 的单文件程序,能让你把原本跑在 Cloudflare 上的 Durable Objects 代码原封不动地部署到自己的服务器上,数据存进你自己的 S3 兼容桶里。它的核心思路是把存储桶当协调器,通过一次原子写入来争抢对象所有权,没有复杂的成员管理或共识协议,出问题时你可以直接查 SQLite 文件和日志。官方给的性能数字挺...
#Deno#Cloudflare#Kenton Varda
一句话点评
Deno 开源了 celld,一个 58MB 的单文件程序,让你能把 Cloudflare Durable Objects 的代码原封不动搬到自己的服务器上,数据存进你自己的 S3 兼容桶。我会先打个折:官方给的性能数字(无状态请求 p50 延迟 0.2 毫秒、每线程约 9.4 万请求/秒)是在苹果 M 系笔记本本地回环上跑的,生产环境 vCPU 会更慢,正文也承认了这点。耐用写入延迟约 9...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0

更多

频道

后台