ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-08-18

50 items · updated 3m ago
RSS live
2026-08-18 · 星期二2026年8月18日
23:47
35d ago
Product Hunt · AI· rssEN23:47 · 08·18
Cronloop AI:给 AI 设个闹钟,让它定时跑任务
Cronloop AI 让你用 Markdown 描述任务,选 Codex 或 Claude Code 当后台模型,连上工具,就能创建一个定时循环的 AI 代理。间隔从 5 分钟到一周可选,每个代理有持久记忆,还能每次跑完后自我改进。有免费版。正文没披露具体定价和每次调模型的费用,如果是真的挺省钱,但这点先别太激动。
#Cronloop AI#Codex#Claude Code
一句话点评
Cronloop AI 让你用 Markdown 写任务,选 Codex 或 Claude Code 当后台,就能创建一个定时循环的 AI 代理,间隔 5 分钟到一周。每个代理有持久记忆,还能每次跑完后自我改进。有免费版。正文没披露具体定价和每次调模型的费用,如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
22:14
35d ago
TechCrunch AI· rssEN22:14 · 08·18
Cursor 趁 GitHub 频繁宕机,推出自己的代码托管平台
Cursor 原本是做 AI 代码编辑器的,现在被 SpaceX 收购后,直接杀进代码托管领域,跟 GitHub 抢地盘。起因是 GitHub 最近老出问题,下载失败率一度冲到 50%,开发者怨声载道。不过这篇报道没提新平台具体有什么功能、怎么收费、什么时候上线,只知道 Cursor 想趁 GitHub 掉链子的时候拉用户。
#Cursor#GitHub#SpaceX
一句话点评
Cursor(AI代码编辑器,现归SpaceX)趁GitHub下载失败率飙到50%时推出代码托管平台抢用户。但正文没披露新平台的功能、定价和上线时间,目前只能算一个趁火打劫的预告,实际竞争力未知。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
22:06
35d ago
Hacker News 首页· rssEN22:06 · 08·18
Z AI 的 GLM-5.3 在推理模型里排第 8,智力分 60,输出话多但单价不高
GLM-5.3 是 Z AI 今年 8 月发的闭源推理模型,在 Artificial Analysis 智力指数上拿了 60 分,排 181 个模型里的第 8,比中位数 35 高出一截。它输出很啰嗦,跑完评测总共吐了 1.7 亿个 token,中位数才 7200 万。价格方面,输入每百万 token 1.4 美元,输出 4.4 美元,都比中位数便宜;跑...
#Reasoning#Code#Z AI#Artificial Analysis
一句话点评
GLM-5.3 在 Artificial Analysis 的智力评测里排第 8,分数 60,比中位数 35 高不少,但代价是话特别多——跑完评测吐了 1.7 亿个 token,是中位数的两倍多。输入每百万 token 1.4 美元,输出 4.4 美元,都比同类中位数便宜,跑完整套智力评测花了 1238.5 美元。上下文窗口 100 万 token,只支持文字输入输出。正文没披露推理速度和参...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
22:00
35d ago
OpenAI 博客· rssEN22:00 · 08·18
ChatGPT 广告下周进入 31 个欧洲市场,免费和 Go 用户会看到广告
OpenAI 宣布从下周起,把 ChatGPT 广告铺到德国、法国、西班牙等 31 个欧洲国家。广告只对 Free 和 Go 用户展示,Plus、Pro、Enterprise 付费用户不受影响。目前广告主得通过 OpenAI 的销售团队或代理合作投放,自助广告后台要到今年夏天晚些时候才上线。过去半年,平台新增了转化优化、地理定向和自定义受众功能,但 O...
#OpenAI#ChatGPT
一句话点评
OpenAI 把 ChatGPT 广告铺到 31 个欧洲国家,下周生效。广告只对 Free 和 Go 用户展示,付费用户不受影响。目前广告主只能通过销售团队或代理投放,自助后台要等到今年夏天晚些时候。过去半年新增了转化优化、地理定向和自定义受众功能。OpenAI 重申不出售用户数据,广告不影响模型回答。 短评:广告扩张速度不慢,但自助后台还没上线,说明投放门槛和成本暂时不低。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R0
21:14
35d ago
● P1Hacker News 首页· rssEN21:14 · 08·18
Claude Code 四小时逆向工程为 HP 打印机编写 macOS 驱动
作者有一台 HP Laser 1008a,本质是三星贴牌机,用私有 SPL3 光栅语言,既没 macOS 驱动也不支持 AirPrint,插 Mac 上就是块砖。他开了个 Claude Code 会话,从装通用驱动卡在“连接设备”开始,一步步让模型读打印机自己吐的错误页来反推 SPL3 指令格式,绕过 macOS 的 USB 沙箱直接跟设备对话,再在 ...
#Claude Code#Opus 4.8#HP
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
一个人用 Claude Code 花了四小时,给一台 HP 从未出过 Mac 驱动的打印机写了个 macOS 驱动,最后能正常打印。
锐评
这条新闻的看点不是 AI 又干了什么大事,而是一个具体的、可复现的逆向工程过程被完整公开了。作者面对一台没有 macOS 驱动、也不支持 AirPrint 的 HP Laser 1008a(本质是三星贴牌机,用私有 SPL3 光栅语言),让 Claude Code 从查 USB 设备、试通用 PCL 驱动失败,到读打印机自检页反推打印语言,再到绕过 macOS USB 沙箱直接跟设备通信,最后在 Linux 容器里跑 HP 原厂的 rastertospl 编解码器,产出了一个能用的后台守护进程和 MIT 协议的一键安装脚本。全程四小时,对话记录全公开。 值得留意的几个数字:四小时是单次会话时长,模型是 Opus 4.8 配 1M 上下文窗口。这个上下文容量很关键,意味着它能在一口气里吞下大量技术文档、错误日志和试错记录,不用频繁切会话丢状态。但正文没披露这四小时里人工干预了多少次、哪些步骤是 AI 自己试出来的、哪些是作者指了方向。另外,最终方案依赖在 Linux 容器里跑 HP 原厂闭源二进制,这绕过了直接逆向 SPL3 协议,但也意味着方案绑定了那个特定二进制文件,换一台打印机未必能复用。 还缺的信息:打印质量到底怎么样,有没有丢图、错位或字体问题;这个驱动在别的 Mac 版本上能不能跑;以及最关键的一点——整个过程里 Claude Code 自己踩了多少坑、作者纠正了多少次。如果是真的全程低干预,那说明大上下文窗口的编码助手在硬件逆向这种需要跨层知识(USB 协议、CUPS 打印系统、容器、沙盒)的任务上,已经能当半个搭档用了。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
20:24
35d ago
r/LocalLLaMA· rssEN20:24 · 08·18
阿里RISC-V芯片跑通27B大模型,每秒30个token
阿里平头哥的玄铁C950,一颗RISC-V架构CPU,跑通了Qwen3-8的27B参数模型,推理速度达到30 tokens/s。这个速度放在手机或边缘设备上已经能用了——聊天打字基本不卡。但正文没披露功耗、内存配置和部署场景,所以实际能效和落地成本还不清楚。不过单看这个数字,RISC-V在端侧推理上确实开始有戏了,尤其对国产芯片替代来说是个信号。软件生...
#Alibaba#XuanTie C950#Qwen3-8 27B
一句话点评
阿里平头哥的玄铁C950,一颗RISC-V架构CPU,跑通了Qwen3-8的27B参数模型,推理速度达到30 tokens/s。这个速度放在手机或边缘设备上已经能用了——聊天打字基本不卡。但正文没披露功耗、内存配置和部署场景,所以实际能效和落地成本还不清楚。不过单看这个数字,RISC-V在端侧推理上确实开始有戏了,尤其对国产芯片替代来说是个信号。软件生态和工具链成熟度仍是短板,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
19:26
35d ago
AI HOT 精选· aihot-apiZH19:26 · 08·18
Anthropic 用 Claude Tag 当 CI/CD 故障的一线值班员
Anthropic CI 团队工程师写了个 agent,让 Claude Tag 自动响应 CI/CD 流水线失败。设计思路是用 Claude 做故障初筛(triage),减少人工值班负担。但正文没披露具体架构、延迟或成功率,所以这点先别太激动——不知道它多快、多准,也不知道成本。
#Agent#Anthropic#Claude Tag
一句话点评
Anthropic CI 团队用 Claude Tag 写了个 agent,自动响应 CI/CD 流水线故障,做初筛(triage)来减少人工值班负担。思路挺实用:让模型进业务流程干活,先判断问题归属。但正文没披露具体架构、延迟或成功率,所以这点先别太激动——不知道它多快、多准,也不知道成本。如果是真的挺省钱,但缺验证数据,建议观望。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R1
19:10
35d ago
Hacker News 首页· rssEN19:10 · 08·18
Argus:用 AI 给 AI 写的代码做自动化测试
Argus 是一个开源 QA 工具,专门给那些用 AI 编程助手(比如 Copilot、Cursor)写代码、但人工测试跟不上速度的团队用。它能自动生成并运行测试用例,帮你抓住 AI 代码改得快时漏掉的问题。目前正文没披露支持哪些编程语言、能集成到什么 CI 系统、以及定价,如果是开源项目那成本倒是低。
#Argus#GitHub#Open source
一句话点评
Argus 是个开源 QA 工具,专治 AI 写代码快但人工测试跟不上的团队。它能自动生成测试用例,跑得比人快。目前只看到 GitHub 页面,没披露支持哪些语言、能接什么 CI、定价——开源的话成本倒低。短评:AI 写代码快,测试别拖后腿,但具体多好用还得看实测。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
19:00
35d ago
OpenAI 博客· rssEN19:00 · 08·18
OpenAI 出 500 万美元帮国会等监督机构学会审查政府怎么用 AI 做国安决策
OpenAI 宣布拿 500 万美元的培训、技术支持和 API 额度,帮国会委员会这类民主监督机构看懂并审计政府在国家安全里怎么用 AI。计划不是让 OpenAI 去监督政府,而是给授权审查人员一套能追溯 AI 决策记录的工具,包括输入、输出和调用过什么工具。正文没披露具体合作机构和落地时间表,只说接下来一年会跟授权官员试点。500 万对机构能力建设来...
#OpenAI
一句话点评
OpenAI 拿 500 万美元(培训+API 额度)帮国会委员会这类监督机构看懂政府怎么用 AI 搞国安。核心是给一套可追溯的决策记录工具,不是 OpenAI 去监督政府。正文没披露具体合作机构和落地时间表,只说接下来一年试点。500 万对机构能力建设来说不算多,关键是试点能不能跑通。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R0
18:47
35d ago
Hacker News 首页· rssEN18:47 · 08·18
PantheonGPU:开源 GPU 压力测试与 AI 负载跑分工具
PantheonGPU 是一个开源工具,专门用来给 GPU 做压力测试和 AI 负载跑分。它支持 NVIDIA(CUDA)和 AMD(ROCm),内置 45 项测试,覆盖计算、显存、缓存、互联和功耗。AI 测试部分包括 LLM 解码/预填充、KV 缓存抖动、MoE 路由器、RAG 嵌入等,基本覆盖了当前主流推理场景。安装方式是一个 Debian 包,一...
#Benchmarking#PantheonGPU
一句话点评
PantheonGPU 是个开源 GPU 压力测试和 AI 跑分工具,支持 NVIDIA 和 AMD,内置 45 项测试,覆盖计算、显存、缓存、互联和功耗。AI 测试包括 LLM 解码/预填充、KV 缓存抖动、MoE 路由器、RAG 嵌入等,基本覆盖主流推理场景。安装简单,一条命令就能跑。适合买卡前验货、集群维护或跨卡对比。但正文没披露支持哪些具体 GPU 型号,也没给任何跑分数据,所以目前...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
18:07
35d ago
Hacker News 首页· rssEN18:07 · 08·18
Turbovec:把 Google 的 TurboQuant 向量压缩算法搬进 Rust,还带了 Python 接口
这是一个用 Rust 写的向量索引库,核心是 Google 的 TurboQuant 量化技术——简单说就是把高维向量压得更小,查得更快。仓库有 1.5 万星标、1300 次复刻、362 次提交,热度不低。但正文没给出压缩率、召回率或延迟这些关键指标,也没跑任何基准测试。所以现在只能把它当成一次工程移植:让 TurboQuant 在 Rust 生态里能...
#Google#RyanCodrai
一句话点评
Google 的 TurboQuant 量化技术被移植到 Rust 生态,仓库 1.5 万星标热度很高。但正文没给压缩率、召回率或延迟数据,也没跑基准测试。目前只能当工程移植看,性能好不好得实测才知道。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
17:02
35d ago
Hacker News 首页· rssEN17:02 · 08·18
Claude Code 每周额度明天起缩水三分之一
Anthropic 从5月13日到8月19日给 Claude Code 加了50%的每周使用额度,但明天(8月19日)促销结束,额度会降回标准水平,相当于直接砍掉三分之一。Pro、Max、Team 和旧版按席位计费的 Enterprise 用户都会受影响,免费版和按用量计费的 Enterprise 本来就没参与。单次会话5小时的限制不变。如果你在用 C...
#Anthropic#Claude Code#Product update
一句话点评
Anthropic 给 Claude Code 加了三个月的 50% 每周额度促销,明天(8月19日)结束,额度直接砍回原样,相当于每周少用三分之一。Pro、Max、Team 和旧版按席位计费的 Enterprise 用户都受影响,免费版和按用量计费的 Enterprise 本来就没参与。单次会话 5 小时限制不变。如果你在用 Claude Code 做日常开发,明天开始得省着点用了。正文没...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K0·R0
16:28
35d ago
Hacker News 首页· rssEN16:28 · 08·18
Claude 多模型集体出问题,官方还在排查
Anthropic 的状态页显示,Claude Opus 5、Mythos 5、Fable 5、Sonnet 5、Haiku 4.5 等多个模型都出现了请求错误率升高的问题。受影响的不只是网页版 claude.ai,还包括 API、Claude Code 和 Claude Cowork。官方从 UTC 时间 16:20 开始调查,到 17:12 还在查...
#Anthropic#Claude#Incident
一句话点评
Claude 全线模型(Opus 5、Sonnet 5、Haiku 4.5 等)从 UTC 16:20 开始报错率飙升,网页、API、Code、Cowork 全中招。到 17:12 还在查,没给修复时间。正文没披露具体错误率数字和根因,目前只能干等。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
16:26
35d ago
Hacker News 首页· rssEN16:26 · 08·18
machine0:从命令行开持久化 CPU/GPU 虚拟机,按分钟计费
machine0 是 YC S26 的创业项目,主打从命令行直接创建持久化虚拟机,支持 CPU 和 GPU(H100、H200、L40S 等)。虚拟机不主动关就一直跑,可以暂停、快照、恢复,按分钟计费——CPU 最低 0.013 美元/小时(约 0.1 元),GPU 最低 0.836 美元/小时(约 6 元),比按秒计费的 Modal 或 E2B 便宜...
#machine0#Y Combinator
一句话点评
YC S26 的 machine0 主打从 CLI 一键拉起持久化 CPU/GPU 虚拟机,按分钟计费,最低 CPU 0.013 美元/小时(约 0.1 元),GPU 0.836 美元/小时(约 6 元),比 Modal 等按秒计费方案便宜。支持暂停、快照、恢复,适合跑长期 agent。但正文没披露是否支持自定义镜像,GPU 实例也限 4 个区域。如果是真的挺省钱,但先别太激动——按分钟计费...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
16:21
35d ago
Hacker News 首页· rssEN16:21 · 08·18
苹果在欧盟取消按安装量收费,改为对 App Store 外交易抽成 5%
苹果跟欧盟委员会谈妥了,把之前争议很大的“核心技术费”(按安装量收钱)砍掉,换成一项叫“核心技术佣金”的新收费:只要你的 app 不在 App Store 里分发,苹果就从数字交易里抽 5%。App Store 内的佣金也降了,用苹果支付抽 26%(小开发者 15%),用第三方支付抽 20%(小开发者 10%),跳转网页支付的抽 15%(小开发者 10...
#Apple#European Commission#Dun & Bradstreet#Policy
一句话点评
苹果把按安装量收的“核心技术费”砍了,换成对 App Store 外交易抽 5% 的“核心技术佣金”。App Store 内佣金也降了,用苹果支付抽 26%,用第三方支付抽 20%,跳转网页支付抽 15%,小开发者还能再打折。我会先打个折:这是跟欧盟谈妥后的统一方案,10 月 1 日生效,但正文没披露新佣金结构对苹果收入的实际影响,也没说 5% 的“核心技术佣金”怎么审计和征收。另外,开发者...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
16:19
35d ago
TechCrunch AI· rssEN16:19 · 08·18
苹果带摄像头的 AirPods 可能没那么可怕:不让用户拍照录像
苹果泄露的带摄像头 AirPods 可能避开了其他 AI 穿戴设备的隐私雷区——它压根不让用户拍照或录像。正文没披露具体技术细节和发布时间,但光这一点就值得先打个折:如果真这么设计,它就不是偷拍工具,而更像一个环境感知传感器。
#Apple
一句话点评
苹果带摄像头的AirPods泄露了,但文章说它压根不让用户拍照录像,只做环境感知。这点先别太激动——正文没披露具体技术细节和发布时间,隐私设计到底多靠谱还不好说。如果真这么干,它就不是偷拍工具,更像一个耳朵上的传感器。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
15:46
35d ago
Hacker News 首页· rssEN15:46 · 08·18
纯C写的微型GPT,在M5上号称每秒1000万token
GitHub上一个叫microgpt-c的项目,用纯C写了一个极简的GPT训练和推理管线,零外部依赖。作者说在Apple M5芯片上跑到了每秒1000万token。项目已经700多星了,但正文没披露模型大小、参数量或者测试条件,所以这个吞吐量数字先打个折。适合当教学代码看,能帮你理解GPT内部怎么跑起来的。
#Apple#GitHub#Open source
一句话点评
一个纯C写的极简GPT训练推理管线,零外部依赖,作者称在Apple M5上跑到了1000万token/秒。项目已700多星,但正文没披露模型大小、参数量或测试条件,这个吞吐量先打个折。适合当教学代码看,能帮你理解GPT内部怎么跑起来的。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
14:00
35d ago
TechCrunch AI· rssEN14:00 · 08·18
Warp 推出一套“开箱即用”的 AI 软件开发工厂
Warp 发布了一套叫 Warp Factories 的基础设施,目标是让公司快速搭建“软件工厂”——说白了就是一个围绕传统开发流程跑的 agent 循环(让模型自动走需求、编码、测试、部署)。这思路现在挺火,很多团队在拿它重组工程部门。Warp 想降低这个转型门槛,但正文没披露定价、部署方式或具体集成细节,所以实际落地成本和支持范围还不清楚。
#Warp
一句话点评
Warp 推出 Warp Factories,号称开箱即用的“软件工厂”——让 agent 自动走需求、编码、测试、部署。这思路不新鲜,很多团队在试,但 Warp 想降低门槛。正文没披露定价、部署方式或具体集成细节,所以实际落地成本和支持范围还不清楚。如果是真的,能省不少搭基建的功夫,但先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
13:45
35d ago
TechCrunch AI· rssEN13:45 · 08·18
Perplexity 在印度白送一年会员,换来几百万用户和一次变现测试
Perplexity 去年跟印度电信商 Airtel 合作,把付费会员免费送给 Airtel 用户用一年。现在最早一批免费订阅开始到期,数据出来了:印度用户量冲到几百万,免费期结束后新用户下载量下滑,但留下来的用户开始掏钱,印度市场收入涨了约 60%。这说明捆绑销售确实能把人拉进来,而且有一部分人愿意续费。不过文章没披露具体的留存率和转化率,所以这个 ...
#Perplexity#Airtel
一句话点评
Perplexity 在印度跟电信商 Airtel 绑套餐送一年会员,用户量冲到几百万,免费期结束后新下载量下滑,但留下来的用户开始掏钱,印度市场收入涨了约 60%。这说明捆绑拉新有效,而且确实有人愿意续费。不过文章没给具体留存率和转化率,所以这 60% 的涨幅到底是从多低的基数涨上来的,还不好判断。如果基数很小,涨 60% 也没那么激动。另外,免费用户里有多少是冲着白嫖去的、用完就走,正文...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
13:13
35d ago
Hacker News 首页· rssEN13:13 · 08·18
我取消了AI代码审查订阅,写了个免费本地版
开发者mukundzha开源了avouch,一个本地Python代码审查工具,只检查改动的行,不扫整个文件。跑一次只要几秒,在git push之前就能出结果。作者放弃了付费的AI审查服务,自己写了个基于AST(抽象语法树)的分析器,不依赖任何外部API。目前只支持Python,正文没提其他语言的计划。
#mukundzha#avouch#Open source
一句话点评
一个开发者因为嫌付费AI代码审查太贵,自己写了个本地工具avouch,只检查你改动的Python行,跑一次几秒,不依赖任何外部API。基于AST(抽象语法树,就是代码结构分析)实现,不是AI。目前只支持Python,正文没提其他语言计划。如果是纯Python项目,这工具挺实用,但别指望它能理解业务逻辑或给出风格建议。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
13:08
35d ago
Hacker News 首页· rssEN13:08 · 08·18
Kent Beck:可组合测试,跟你想的不一样
Kent Beck 区分了测试隔离和可组合性。隔离是每个测试自己建数据、互不依赖;可组合性则是把测试当整体看,让整个测试套件更高效。他举了个例子:4 种利息计算 × 5 种报表方式,暴力法要 20 个测试,用组合只需要 10 个——4 个测计算、5 个测报表、1 个测两者是否接上了。组合后的测试跑得更快、更好读、更具体,改代码时也更不容易碎。有人反对减...
#Kent Beck
一句话点评
短评:Kent Beck 把测试组合讲清楚了:4种利息×5种报表,暴力测要20个,组合只用10个。 点评:Kent Beck 这篇讲的是测试隔离和可组合性的区别。隔离是每个测试自己建数据、互不依赖;组合是把测试当整体看,让整个套件更高效。他举了个例子:4种利息计算×5种报表方式,暴力法要20个测试,用组合只需要10个——4个测计算、5个测报表、1个测两者是否接上了。组合后的测试跑得更快、更...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
13:00
35d ago
The Verge · AI· rssEN13:00 · 08·18
Firefox 智能窗口上线:聊天能读实时网页,历史记录支持看图搜索,还能自动整理标签页
Firefox 的 Smart Window 模式现在接入了 Exa 的实时网页信息,AI 聊天回复里会附上来源链接。你还可以用大白话搜浏览历史,比如“我上周看过的跑鞋”,它会直接弹出之前浏览过的网站图片。另外,它能自动建议标签页分组,顺手帮你关掉重复的页面。目前只展示了现场演示,正文没披露公开上线时间。
#Mozilla#Firefox#Exa
一句话点评
Firefox 的 Smart Window 模式现在能实时抓网页信息(接入了 Exa),AI 回复会带来源链接。还能用大白话搜浏览历史,比如“上周看过的跑鞋”,直接弹出之前浏览的网站图片。另外会自动建议标签页分组、关掉重复页面。现场演示看着挺顺,但正文没披露公开上线时间,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
12:01
35d ago
The Verge · AI· rssEN12:01 · 08·18
Google 的“宠物记忆”连自家猫都认不出
Google 给 Nest 摄像头加了个“宠物记忆”功能,号称能认出每只猫狗,还能根据是哪只宠物调整智能家居。但实测下来,它连作者自家的猫都分不清,也没解决通知轰炸的老问题。正文没披露识别错误率,也没说什么时候修。
#Google#Gemini for Home#Nest
一句话点评
Google 给 Nest 摄像头加了个“宠物记忆”功能,号称能认出每只猫狗并调整智能家居。实测连作者自家的猫都分不清,通知轰炸也没解决。正文没披露识别错误率,也没说什么时候修。目前就是个噱头,别指望它真能分清你家主子。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
11:00
35d ago
● P1OpenAI 博客· rssEN11:00 · 08·18
OpenAI 暂停 Astra 模型训练两周,因发现关键网络安全能力
OpenAI 在 8 月 18 日说,他们下一代模型 Astra 的内部评估显示,它的网络安全能力可能已经踩到了自家安全框架里“关键”那条红线。加上前阵子跟 Hugging Face 合作时出的安全事故,公司决定先把强化学习训练停了两周,把研究环境的安全加固做完再说。目前最大规模的那次前沿训练跑量还挂着没动,只跑一些小规模测试来观察模型行为、验证防护措...
#Reasoning#OpenAI#Astra#Hugging Face
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 主动暂停了 Astra 模型的强化学习训练,因为内部测试发现它可能已经具备关键级别的网络攻击能力。
锐评
OpenAI 自己踩了刹车。他们在训练一个叫 Astra 的新模型时,发现它可能达到了“关键网络安全能力”的门槛——说白了,就是模型能自己找漏洞、写攻击脚本了。加上之前跟 Hugging Face 的安全事件,他们决定先把 Astra 的强化学习训练停掉两周,最大的那次前沿训练跑到现在还挂着,要先做小规模测试,确认安全措施跟得上再继续。 文章里提到了具体动作:把能执行代码或联网的模型推理先停了,恢复时加上了更严的沙箱和网络隔离,还让模型自己模拟攻击来测防御。这些改动被他们形容为“成本高、拖进度”,但没给出具体数字。 这篇声明很坦诚,但缺的东西也明显。它没说 Astra 到底在什么测试里、以多高的成功率展示了攻击能力,也没说这个“关键”判定是内部红队打的还是按 Preparedness Framework 的硬指标过的。没有这些,我们只能知道他们很紧张,但判断不了这个能力是实验室里的花活,还是真能穿透现代防御。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
11:00
35d ago
● P1OpenAI 博客· rssEN11:00 · 08·18
OpenAI 推出青少年版 ChatGPT 含引导式学习和安全保护机制
OpenAI 给 13 到 17 岁的用户单独做了一个 ChatGPT 版本,系统估出年龄或用户自报年龄在这个区间就会自动切过去。核心是“学习模式”,用提问和分步引导代替直接给答案;如果检测到你想抄作业,会弹出提醒并把你推回学习模式。家长可以设“学习时段”,到点强制开启学习模式。另外 OpenAI 跟 CodeAI 合作,教青少年理解 AI 怎么工作、...
#OpenAI#CodeAI#Racquel Gibson#Safety/alignment
精选理由
精选 · 重要度 88 · 吸引力 + 知识量
一句话点评
OpenAI 给 13-17 岁用户自动切到青少年版,加了引导式学习模式和防抄作业提醒,但正文没给出错率或实际拦截效果的数据。
锐评
这条发布更像是一次功能打包,把之前零散推出的学习模式、家长控制、年龄预测整合成一个自动触发的青少年版本。核心变化是系统判断用户未满 18 岁就直接切进去,不用手动设置。学习功能上,Study Mode 用引导提问代替直接给答案,新增的“作业提醒”能识别抄作业行为并重定向到分步解题,还加了可定时开启的“学习时段”。这些设计思路对,但 OpenAI 自己没公布任何量化指标——比如提醒准确率多高、误判率多少、学生成绩有没有实际提升。文中引用了一位高中老师的评价和一个学生项目案例,都是正面个例,不能当普遍效果看。另外,和 CodeAI 的合作只说了要教学生理解 AI 原理,具体课程或资源还没落地。家长最关心的内容过滤和安全护栏到底强到什么程度,公告里也只给了原则,没给测试结果。整体方向没问题,但效果验证基本空白,先当一次产品整合看比较合适。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R0
11:00
35d ago
OpenAI 博客· rssEN11:00 · 08·18
OpenAI 和 CodeAI 合作教高中生 AI 素养,同时推出 ChatGPT 青少年版
OpenAI 宣布与教育组织 CodeAI 合作,目标是帮高中生建立 AI 素养——不只是会用工具,还要能批判性思考 AI 的输出、理解它的局限。合作内容包括成立联合咨询委员会、推出“AI 一小时”课程、举办“建造者挑战赛”,以及让 OpenAI 专家支持 CodeAI 的高中课程。同时,OpenAI 还上线了 ChatGPT 青少年版,内置健康使用提...
#OpenAI#CodeAI#ChatGPT for Teens
一句话点评
OpenAI 和 CodeAI 合作推高中生 AI 素养,不是教工具使用,而是批判性思考 AI 输出。同步上线 ChatGPT 青少年版,带健康使用提醒和家长控制。合作包括联合咨询委员会、'AI 一小时'课程、建造者挑战赛。正文没披露投入金额和覆盖学生目标数,具体效果待验证。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
10:57
35d ago
FT · 科技· rssEN10:57 · 08·18
美国两党终于达成共识:怕AI
FT评论说,美国左右两派现在都怕AI,左派担心失业和不平等,右派怕假消息和选举被搞。两边都想管,但具体怎么管谈不拢。文章没引用民调或法案,核心判断是:美国政治里,怕AI已经取代了吹AI,成了新共识。
#Financial Times#Policy
一句话点评
FT评论说美国两党现在都怕AI,左怕失业右怕假消息,但没引用民调或法案,更像政治观察而非数据报告。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K0·R1
09:00
35d ago
The Verge · AI· rssEN09:00 · 08·18
苹果带摄像头的 AirPods 在泄露视频里现身了
macOS Tahoe 26.7 测试版里藏了一段视频,展示了传闻中带摄像头的 AirPods。画面里一个人拿着书封对着耳机,Visual Intelligence 就能识别书名,Siri 还会说“看到喜欢的就让我存下来”。彭博的 Gurman 之前说过,这些摄像头只拍低分辨率画面,相当于给耳机装了个“眼睛”。耳机本体比 AirPods Pro 3 更...
#Apple#MacRumors#Bloomberg
一句话点评
苹果带摄像头的 AirPods 首次在 macOS 测试版视频里亮相。视频里人拿书封对着耳机,Visual Intelligence 就能识别书名,Siri 说“看到喜欢的就让我存下来”。彭博 Gurman 之前透露,摄像头只拍低分辨率画面,相当于给耳机装“眼睛”。耳机比 AirPods Pro 3 更厚。正文没披露发布时间和价格。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
07:28
35d ago
Hacker News 首页· rssEN07:28 · 08·18
Elm 作者发布 Acadia 公测版,用函数式语法写数据库查询
Evan Czaplicki 把 Elm 风格的类型系统带到了数据库操作里。Acadia 让你用函数式语法定义表和查询,编译时直接生成 SQL,迁移前编译器会先验证,不用再提心吊胆跑 SQL 迁移。自定义类型可以直接存进数据库,不用手动转成 JSON 或一堆可空字段。目前支持 Elm 和 Haskell,客户端、服务端、数据库可以共享同一套类型定义,改...
#Evan Czaplicki#Acadia#Elm
一句话点评
Elm 作者 Evan Czaplicki 做了个叫 Acadia 的工具,让你用函数式语法写数据库操作,编译时直接转成 SQL,迁移前编译器会先验证,不用再提心吊胆跑 SQL 迁移。自定义类型可以直接存进数据库,不用手动转 JSON 或搞一堆可空字段。目前支持 Elm 和 Haskell,客户端、服务端、数据库可以共享同一套类型定义。公开 alpha 阶段,有文档和示例。 短评:Elm ...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
07:00
35d ago
● P1OpenAI 博客· rssEN07:00 · 08·18
Asana用Codex两周完成五年测试框架迁移项目
Asana 的工程师用 OpenAI Codex 把公司里一个叫 Enzyme 的过时测试框架从代码库里彻底移除了。之前内部评估这个活要干五年、花大概 600 万美元,实际只用了两个日历周,模型和基础设施成本加起来约 1.2 万美元。做法是写一段五句话的提示词,同时跑最多四个编码 agent,每个 agent 在独立的代码副本里干活,工程师每天检查两次...
#Code#Asana#OpenAI#Amritansh Raghav
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Asana用OpenAI Codex两周干完了原本预计五年的测试框架迁移,花了1.2万美元,对比原计划600万美元。但这是OpenAI官方案例,效果可能挑最好的说。
锐评
Asana把前端测试工具Enzyme从代码库里彻底移除,这个工具已经没人维护,堵住了技术栈升级的路。他们用Codex,从一段五句话的指令出发,最多四个编码智能体并行在代码副本里改,工程师每天看两次、每次改动都要审。实际工程耗时1.5周,跨了两个自然周,模型和基础设施成本约1.2万美元。原先的人力方案预计至少五年、约600万美元。 数字看着很漂亮,但得打几个折。这是OpenAI官网发的客户案例,天然会挑最成功的项目讲。正文没提代码库规模、测试覆盖率变化、迁移后出了多少bug,也没说工程师审代码花了多少时间——这些才是真实成本。另外,Enzyme本身是已经死掉的老框架,迁移路径相对明确,不代表复杂业务逻辑重构也能这么顺。 如果数据没注水,这个案例说明一件事:对于规则清晰、重复性高的大规模代码改动,让模型并行干活加人审,确实能把年缩成周。但还缺第三方复现和失败案例,才能判断这是可复制的方法还是运气好的个例。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
07:00
35d ago
AI HOT 精选· aihot-apiZH07:00 · 08·18
设计 AI 评测:先求清晰,再谈可视化
Google AI 工程师 Katie McLaughlin 开了一个系列博客,讲怎么用开源框架(Inspect AI、Harbor)给 agent 技能做客观评测。这篇是开篇,重点在流程——跑一个 codelab 里的 benchmark 脚本,然后用 Google Sheets 和 Data Studio 做可视化看趋势,并没有给出具体的评测结果。...
#Google AI#Katie McLaughlin#Inspect AI
一句话点评
Google AI 工程师开了一个系列博客,讲怎么用开源框架(Inspect AI、Harbor)给 agent 技能做客观评测。这篇是开篇,重点在流程——跑 benchmark 脚本,然后用 Google Sheets 和 Data Studio 做可视化看趋势。没有给出具体的评测结果,适合想自己搭评测管线的团队参考,但别指望有现成结论。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
06:07
35d ago
纽约时报中文网· rssZH06:07 · 08·18
硅谷没右转,它只是换了个大客户
硅谷大佬们集体拥抱特朗普和五角大楼,不是政治转向,是市场转向。硅谷本来就是靠冷战军费起家的,后来跑去赚全球消费者的钱,尤其想拿下中国市场。现在中国对美国科技公司关上了门,联邦政府反而成了AI和自主武器最大的买家。谷歌2018年在员工压力下退出五角大楼的“马文计划”,2026年又签了新的国防AI合同。红杉资本拆了中国业务,投了一家19岁创始人做的杀人无人...
#Sharon Weinberger#Donald Trump#Google
一句话点评
硅谷拥抱五角大楼不是政治转向,是客户换了。冷战靠军费起家,后来追全球消费者,尤其想拿下中国市场。现在中国对美国科技公司关门,联邦政府反而成了AI和自主武器最大买家。谷歌2018年因员工抗议退出五角大楼的“马文计划”,2026年又签了新的国防AI合同。红杉拆了中国业务,投了一家19岁创始人做的杀人无人机公司。文章判断很直接:硅谷爱的是利润,不是炸弹。但正文没给出具体合同金额和国防订单占这些公司...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
04:00
35d ago
FT · 科技· rssEN04:00 · 08·18
英国政府开始算账:被断供顶级 AI 模型,经济要亏多少钱
英国政府委托了一项研究,想量化一个极端场景:如果完全拿不到最前沿的 AI 模型(比如被出口管制或供应链中断卡住),金融、医疗、国防这些关键行业会受多大冲击,GDP 会掉多少。研究还没做完,正文没披露具体由哪家机构接单、预算多少、什么时候出结果。
#UK government
一句话点评
英国政府掏钱研究一个极端场景:如果完全拿不到前沿AI模型,金融、医疗、国防等行业GDP会掉多少。研究还没做完,正文没披露谁接单、预算多少、何时出结果。目前只有问题没有答案,适合关注地缘AI风险的人先标记。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
04:00
35d ago
FT · 科技· rssEN04:00 · 08·18
AI 没叛变,更糟的是人在故意使坏
这篇 FT 评论文章认为,现在最该担心的不是 AI 自己失控,而是人拿它来干坏事。文章举了几个例子:用深度伪造(deepfake)搞诈骗、用算法操纵舆论、以及用 AI 压榨劳动力。全文是观点输出,没有提供新的研究数据或统计。
#Financial Times
一句话点评
FT评论文章,观点输出型,没有新数据。核心论点是:AI最大的风险不是失控,而是被人拿来干坏事——深度伪造诈骗、算法操纵舆论、用AI压榨劳动力。例子都是老生常谈,没有具体案例或统计支撑。适合当观点参考,但别当事实引用。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1

更多

频道

后台