ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-08-11

50 items · updated 3m ago
RSS live
2026-08-11 · 星期二2026年8月11日
23:00
42d ago
最佳拍档· atomZH23:00 · 08·11
AI算力没过剩,反而更紧缺了
Gavin Baker 认为 GPU 和 HBM 内存依然紧张,Blackwell 和开源模型会进一步推高需求,甚至把太空算力当作长期赌注。正文没披露具体数字或时间线,只给出了一个判断:算力远没到饱和。
#Gavin Baker#Blackwell#SpaceX
一句话点评
Gavin Baker 说算力没过剩,GPU 和 HBM 内存依然紧,Blackwell 和开源模型还会推高需求,甚至把太空算力当长期赌注。但正文没给任何具体数字或时间线,全是判断没证据。观点可以参考,但别当投资依据。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
21:54
42d ago
Hacker News 首页· rssEN21:54 · 08·11
pg_clickhouse v0.10 发布:子查询下推让 TPC-H 查询快了 1000 倍
ClickHouse 的 PostgreSQL 桥接工具 pg_clickhouse 发布 v0.10,核心改进是子查询下推,让 TPC-H 基准测试的查询速度提升了 1000 倍。简单说,以前很多查询需要把数据拉到 PostgreSQL 那边处理,现在直接在 ClickHouse 里算完再返回结果,省掉了大量数据传输和转换。这次还换用了 C 语言驱动...
#ClickHouse#pg_clickhouse#Open source
一句话点评
pg_clickhouse v0.10 把子查询下推做到位了,TPC-H 全量查询提速 1000 倍——以前数据要拉到 PostgreSQL 算,现在直接在 ClickHouse 算完再返回,省掉大量传输。还换了 C 驱动,新增聚合支持。但正文没给绝对延迟数字,1000 倍是相对提升,基线多慢不清楚。如果是真的,对用 PostgreSQL 查 ClickHouse 的场景很实用。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
21:03
42d ago
Latent Space· rssEN21:03 · 08·11
Chai Discovery 连签四家药企,BioAI 工具终于有人买单了
Chai Discovery 今年夏天拿下了四笔药企合作——礼来、诺华、argenx,外加礼来老客户的扩展单,估值冲到 40 亿美元。联合创始人 Matt McPartlon 和产品负责人 Neil Patil 在播客里解释转折点:结构模型现在预测结合亲和力(就是分子跟靶点贴得紧不紧)已经准到药企敢用在真实研发里。Chai 不自己造药管线,而是卖工具帮...
#Chai Discovery#Eli Lilly#Novartis
一句话点评
Chai Discovery 今年夏天拿下礼来、诺华等四家药企合作,估值冲到 40 亿美元。核心卖点是结构模型预测分子与靶点结合亲和力已经准到药企敢用在真实研发里,不自己造药,而是卖工具帮药企筛候选分子、降低临床失败率。播客里没披露具体交易金额和时长。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
20:15
42d ago
彭博科技· rssEN20:15 · 08·11
超微电脑给出销售预期,比最乐观的分析师预测还高
超微电脑(Super Micro)发了销售预测,比华尔街最乐观的估计还高。盘后股价直接跳涨。超微是AI服务器的核心供应商,这个信号说明AI硬件需求还在涨。但正文没披露具体数字、增长百分比,也没说是哪个季度的预测,所以这点先别太激动。
#Super Micro
一句话点评
超微电脑(AI服务器核心供应商)发了销售预测,比华尔街最乐观的估计还高,盘后股价跳涨。但正文没披露具体数字、增长百分比,也没说是哪个季度的预测,所以这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
19:52
42d ago
AI HOT 精选· aihot-apiZH19:52 · 08·11
Mojo 1.0 正式发布:AI 编程语言终于稳定了
Modular 宣布 Mojo 语言达到 1.0 里程碑,从 2023 年首次发布至今,Mojo 已成长为一门通用编程语言,社区围绕它开发了库、工具和应用。1.0 版本的核心承诺是提供稳定基础,让开发者可以放心做长期项目,不再频繁被破坏性更新打断。Modular 表示,Mojo 已经在自家商业基础设施 MAX 和 Modular Cloud 里跑生产了...
#Modular#Mojo#MAX
一句话点评
Mojo 1.0 正式发布,从 2023 年亮相到现在,终于承诺 API 稳定,开发者可以放心做长期项目了。Modular 说自己已经在 MAX 和 Modular Cloud 里跑生产,但没披露任何性能对比数据或用户案例。对于想用 Mojo 替代 Python 做高性能计算的人,1.0 是个信号,但生态成熟度、工具链完善度都还是未知数。短评:Mojo 1.0 终于不随便改语法了,但生态还太...
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
19:41
42d ago
● P1The Verge · AI· rssEN19:41 · 08·11
ChatGPT 和 Gemini 月活用户均突破 10 亿
OpenAI 和 Google 各自宣布自家聊天机器人月活用户超过 10 亿。ChatGPT 还是领先,但 Gemini 追得很快。文章没给出两边具体的月活数字,也没说统计口径是不是一样。我会先打个折——这类数据通常把网页、App 和间接 API 调用都打包算进去了,不全是每天在用的真人。
#OpenAI#Google#ChatGPT
精选理由
精选 · 重要度 88 · 吸引力 + 共鸣
一句话点评
ChatGPT 和 Gemini 月活都过了 10 亿,但别急着说平起平坐——OpenAI 还是领先,差距在缩小而已。
锐评
两家主力聊天机器人月活用户同时跨过 10 亿,说明 AI 对话工具已经成了跟搜索、社交一样的日常基础设施。The Verge 的报道强调 OpenAI 仍是领头羊,但 Gemini 追得很快,差距在收窄。这个数字本身是月活,不是日活或付费用户,所以只能说明“用过”,不能直接等同于“深度依赖”。报道没给出具体的用户重叠率、使用频次分布,也没拆开免费和付费比例。想知道谁真的更稳,还得看留存和付费转化,光比月活容易高估实际粘性。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K0·R1
18:53
42d ago
AI HOT 精选· aihot-apiZH18:53 · 08·11
Runway Seedance 2.5 上线,一次能塞进 50 个角色参考,还能跟着音乐走 30 秒
Runway 把 Seedance 视频模型升到了 2.5 版,这次主要加了两样东西:一是单次生成可以指定最多 50 个不同的角色参考图,二是生成的片段最长能到 30 秒,并且画面会跟着你给的音乐节奏走。正文没提技术细节和价格,所以现在只能当一次功能更新看,实际效果和稳定性还得自己跑跑才知道。
#Runway
一句话点评
Runway Seedance 2.5 上线了,这次能一次塞进 50 个角色参考图,生成最长 30 秒、跟着音乐节奏走的视频。听着挺猛,但正文没给任何技术细节、价格或对比数据,所以现在只能当功能更新看。我会先打个折:50 个角色同时保持一致性,实际跑起来稳定性怎么样、会不会崩,都得自己试。另外 30 秒片段在视频生成里算长了,但没提生成速度和成本,如果是真的省钱又稳定,那对做短片的人挺实用。...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
18:49
42d ago
● P1TechCrunch AI· rssEN18:49 · 08·11
Google Gemini 独立应用月活用户突破 10 亿
Sundar Pichai 在 X 上宣布,Gemini 独立 App 的月活用户数超过了 10 亿,成为 Google 旗下第 14 个达到这个量级的产品。这个数字只算了 App 端,没把搜索里的 AI Mode 用户算进去。作为参考,ChatGPT 在今年 6 月也刚跨过 10 亿月活的门槛。Google 还给了两个使用习惯的数据:63% 的用户会...
#Vision#Google#Gemini#Sundar Pichai
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
Gemini 独立应用月活过了 10 亿,跟 ChatGPT 只差两个月。但 10 亿这个数没算上搜索和安卓内置入口,实际铺量可能更大。
锐评
Google 自己说 Gemini 独立应用月活突破 10 亿,成了公司第 14 个十亿级产品。这个数字只算独立 app,没把搜索里的 AI 模式、Workspace 侧边栏和安卓系统内置入口算进去——如果全算,盘子会更大。ChatGPT 在 6 月先到 10 亿,Gemini 8 月跟上,差距两个月,说明 Google 靠自有渠道追得很快。 文章给了几个使用数据:63% 的用户用过语音对话,每天生成超过 1.5 亿张图片,iOS 端也有超过 1 亿活跃用户。这些数字能看出用户不只是在文本框里打字,语音和图片生成是主要用法。 不过文章没提付费用户占比、用户留存和平均使用时长。10 亿月活听着大,但如果大部分是尝鲜或者被 Google 全家桶导流过来的,商业价值要打折。另外,Gemini 3.5 Flash 刚发布,主打编程和让模型进业务流程干活,但这次没给任何企业端或开发者数据,没法判断这些新功能对增长的贡献有多大。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
18:20
42d ago
AI HOT 精选· aihot-apiZH18:20 · 08·11
ChatGPT 桌面端现在能导入其他智能体的工作数据了
OpenAI 给 ChatGPT 桌面应用加了个导入功能,可以把你在别的智能体上做的项目、聊天记录、技能和插件同步到 ChatGPT Work 和 Codex 里。导入历史可以查看,设置里还能打开自动更新。不过正文没提具体支持哪些智能体来源,也没说需要什么数据格式,这点先别太激动。
#OpenAI#ChatGPT#Codex
一句话点评
OpenAI 给 ChatGPT 桌面端加了导入功能,能把你在其他智能体上的项目、聊天记录、技能和插件同步到 ChatGPT Work 和 Codex 里。支持查看导入历史,还能开自动更新。但正文没提具体支持哪些智能体来源,也没说数据格式,这点先别太激动。如果是真的,迁移成本会低不少。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
18:06
42d ago
Hacker News 首页· rssEN18:06 · 08·11
Val Town 发文批评:用 AI 生成假人发推销视频,不道德
Val Town 员工收到一封冷邮件,里面附了一段“个性化”视频推销,视频里的“Chase”眼神呆滞、语气刻意随意——是 AI 生成的。对方被问后也承认了。Val Town 认为,哪怕推销内容本身无害,假装自己是真人去联系潜在客户就是不道德。他们自己也在用 AI 做销售,但会诚实告知对方这是自动化消息。
#Val Town#Robin Sloan#Represent Studio
一句话点评
短评:AI 生成真人视频做冷 outreach,被一眼识破。Val Town 说:用 AI 可以,但别装人。 点评:Val Town 员工收到一家初创公司的冷邮件,附带一段“个性化”视频推销。视频里的“Chase”眼神呆滞、语气刻意随意——是 AI 生成的。对方被问后也承认了。Val Town 认为,哪怕推销内容本身无害,假装自己是真人去联系潜在客户就是不道德。他们自己也在用 AI 做销售...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
17:41
42d ago
● P1TechCrunch AI· rssEN17:41 · 08·11
OpenAI 前首席运营官 Brad Lightcap 宣布离职
Brad Lightcap 是 OpenAI 资历最深的几位高管之一,2018 年加入,先当了四年 CFO,2022 年转任 COO。今年早些时候 OpenAI 调整高管分工,他卸下了 COO 职务,现在正式宣布离开。他在内部信里说心情复杂,以后会换个角度帮公司推进使命。至于他到底要去做什么、具体哪天走、谁来接他的班,这篇报道全都没提。
#OpenAI#Brad Lightcap
精选理由
精选 · 重要度 92 · 吸引力 + 共鸣
一句话点评
OpenAI 又走一位老将,COO 干了四年后宣布自己创业,但没说他到底要做什么。
锐评
Brad Lightcap 是 OpenAI 里待得最久的高管之一,2018 年加入,先当 CFO,2022 年转 COO,今年年初刚在内部调整中换了角色,现在直接离职创业。他在内部信里说“换个角度继续推进使命”,但对自己新公司的方向一个字没提。TechCrunch 的报道也没挖出更多细节,只确认他确实要走。 这事值得关注的点在于,OpenAI 近两年高管流失已经不是个案,Lightcap 这种管过钱又管过运营的核心人物离开,对一家正在拼命商业化、同时还要维持非营利架构的公司来说,运营层面的连续性会打折扣。不过目前信息太少,没法判断他是正常轮换还是对内部路线有分歧。他新公司做什么、是否还在 AI 赛道、会不会跟老东家有竞争,正文都没披露,这点先别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K0·R1
17:23
42d ago
● P1Hacker News 首页· rssEN17:23 · 08·11
xAI 发布 Grok Bot 测试版:能操作应用工具的 AI 同事
xAI 推出了 Grok Bot,定位不是聊天助手,而是能直接操作浏览器和应用软件的 AI 同事。你给它派任务,它会自己登录 Zendesk 这类工具,点完整个业务流程,最后把做完的活交回来。多个 Bot 可以同时干活、互相交接任务,还能记住你的工作习惯和上下文。定价分两档:个人版 Cursor Ultra 每月 200 美元,团队版 Cursor P...
#Agent#xAI#Grok Bot
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
xAI 把 Grok 做成了一个能自己登录工具干活的“队友”,目前是早期测试版,别急着当正式员工用。
锐评
xAI 发布了 Grok Bot 的早期测试版,定位不是聊天机器人,而是能独立操作云电脑、自动登录你的在线账户去执行任务的 AI 代理。简单说,你可以给它派活,它自己打开浏览器、登录网站、填表或处理数据,像远程实习生。The Verge 的报道确认了这一点,但正文没披露它的任务完成率、错误率或支持哪些具体工具。目前只是测试版,稳定性、安全性和权限边界都还不清楚。最让人犹豫的是你得把账户密码交给它自动登录,这在实际工作流里风险不小。如果后续能给出它在常见办公场景下的准确率,以及是否支持本地沙盒运行而不是纯云端操作,才值得认真评估。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
17:04
42d ago
Google 研究院· rssEN17:04 · 08·11
Google 把临床 AI AMIE 升级成能看脸听声音的医生,模拟问诊接近专家水平
Google 升级了它的临床对话 AI AMIE,现在能同时处理音频和视频输入。在模拟问诊中,AMIE 可以读取患者的面部表情和语气,表现接近真人专家。不过正文没披露底层模型、训练数据规模,也没说什么时候能落地。
#Google#AMIE
一句话点评
Google 把临床对话 AI AMIE 升级成能看脸听语气了。模拟问诊里表现接近真人专家,但正文没披露底层模型、训练数据规模,也没说什么时候能落地。如果是真的,远程问诊的体验会好很多,但这点先别太激动——模拟环境和真实诊室差得远,而且没提安全验证和合规路径。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
16:57
42d ago
Hacker News 首页· rssEN16:57 · 08·11
Google 说 Go 语言最适合 AI 辅助编程:读代码比写代码更重要
Google Developers Blog 发了一篇观点文章,核心论点是 Go 语言最初的设计目标——团队协作、可读性、自带工具链——正好是 AI 辅助编程最需要的。当 AI 几秒就能生成几百行代码时,人的瓶颈从“写”变成了“读、审、维护”。Go 自带格式化工具、测试框架、依赖管理和安全工具,这些对人和 AI 都适用。文章说 AI agent 用 G...
#Code#Google#Go#Rob Pike
一句话点评
Google 官方博客发文,说 Go 语言的设计初衷——团队协作、可读性、自带工具链——正好是 AI 辅助编程最需要的。当 AI 几秒生成几百行代码时,人的瓶颈从“写”变成了“读、审、维护”。Go 自带格式化、测试、依赖管理和安全工具,对人和 AI 都适用。文章说 AI agent 用 Go 重构代码时能利用这些工具保持正确性,不像其他语言容易错误叠加。Go 的标准库还能减少代码风格差异,给...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
16:54
42d ago
FT · 科技· rssEN16:54 · 08·11
英国租房中介被租客用ChatGPT写的投诉信压得喘不过气
英国租房中介反映,租客开始用ChatGPT等AI工具写正式投诉信,内容涉及维修、押金纠纷等。中介称投诉量上升,处理成本增加。正文没披露具体增长数字或AI使用率,所以这点先别太激动——但趋势本身值得留意:AI降低了写正式文书的门槛,租客维权成本变低,中介的审核成本却变高了。
#ChatGPT
一句话点评
英国租客用ChatGPT写投诉信,中介抱怨处理成本上升。正文没给具体数字,所以别太激动——但趋势值得留意:AI降低了写正式文书的门槛,租客维权成本变低,中介审核成本变高。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
16:31
42d ago
● P1AI HOT 精选· aihot-apiZH16:31 · 08·11
Ryan Greenblatt论AI自动化研究可能引发递归自我改进失控
Redwood Research 的首席科学家 Ryan Greenblatt 在播客里跟 Dwarkesh Patel 辩论了一个挺吓人的可能性:一旦 AI 能完全接手 AI 研发工作(他预测中位数是 2031 年),就可能启动一个反馈循环,把原本需要四到五年的进展压缩到一年内完成。Patel 本来因为算力和人类专家数据瓶颈对此很怀疑,但聊完后觉得这...
#Alignment#Ryan Greenblatt#Dwarkesh Patel#Redwood Research
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Redwood Research 首席科学家 Ryan Greenblatt 预测,AI 可能在 2031 年左右实现研发全自动化,随后一年内通过“递归自我改进”快速跃迁至远超人类的超级智能。
锐评
Ryan Greenblatt 和 Dwarkesh Patel 的这场辩论,核心是“递归自我改进”到底靠不靠谱。Greenblatt 的逻辑链很清晰:AI 研发本身是个高度可验证的任务,一旦 AI 在这件事上达到人类顶级专家水平,就能自己迭代出更强的 AI,形成闭环。他给了一个很具体的量化判断:这个闭环一旦启动,一年内能跑出正常需要四到五年的 AI 进步。这个速度有多夸张?他拿 GPT-3 到 Mythos 5 的跨越来类比,相当于把好几年的技术代差压缩进一年。 但这里有几个关键前提需要打折。首先,这个判断高度依赖“AI 研发完全可验证”的假设,但现实中很多前沿突破并非简单的指标爬山,而是需要范式转换,正文里没有给出 AI 如何自主完成这种跳跃的证据。其次,Dwarkesh 也质疑了人类专家数据是否会成为瓶颈,毕竟现在的进步很大程度上还建立在人类已有的知识上。Greenblatt 的 2031 年自动化研发中位数预测,听起来很激进,但文章没披露这个预测背后的具体模型或依据,更像是一个基于趋势的直觉判断。 最后,他们讨论了对齐问题,但没给出解决方案。如果真到了那个阶段,谁来定义这些超级智能的忠诚对象?文章只提出了担忧,比如现有的“宪法式”规范可能不足以让 AI 成为个人的守护者。整体来看,Greenblatt 描绘了一个逻辑上可能但证据链不完整的未来,最大的信息缺口在于,我们完全不知道从“擅长做 AI 研发”到“能独立做出颠覆性突破”之间的工程鸿沟到底有多宽。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
16:00
42d ago
AI HOT 精选· aihot-apiZH16:00 · 08·11
Google Cloud 用 Gemini 自动翻译数据库存储过程,加速迁到 PostgreSQL
Google Cloud 把 Gemini 塞进了自家的数据库迁移服务(DMS),专门对付迁移中最头疼的一环:把 Oracle 或 SQL Server 里几百个存储过程、触发器、自定义函数(PL/SQL 或 T-SQL 方言)自动转成 PostgreSQL 的 PL/pgSQL 代码。以前这活全靠人工,得找懂两边方言的专家干好几个月,还容易出错。现在...
#Code#Google Cloud#Gemini#Database Migration Service
一句话点评
Google Cloud 把 Gemini 塞进 DMS,自动把 Oracle/SQL Server 的存储过程、触发器转成 PostgreSQL 代码。以前这活靠人工干好几个月,现在用模型跑。正文没披露准确率和节省的具体时间,如果是真的挺省钱,但先别太激动,得看实际转换质量。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
14:50
42d ago
Hacker News 首页· rssEN14:50 · 08·11
在苹果芯片的 macOS 虚拟机上跑 Llama.cpp,推理速度比原生 macOS 快 11 到 16 倍
cua 团队在 Apple Silicon 的 macOS 虚拟机里搞定了 GPU 直通,让 Linux 虚拟机绕过 macOS 的 Metal 调度开销,直接用 Vulkan 驱动跟 GPU 对话。结果跑 Llama.cpp 推理比原生 macOS 快了 11 到 16 倍。不过正文没提具体测的是哪个模型,也没给每秒 token 数,所以这个倍数我先...
#Inference-opt#cua#Llama.cpp#Apple Silicon
一句话点评
cua 团队在 Apple Silicon 的 macOS 虚拟机里搞定了 GPU 直通,让 Linux 虚拟机绕过 macOS 的 Metal 调度开销,直接用 Vulkan 驱动跟 GPU 对话。结果跑 Llama.cpp 推理比原生 macOS 快了 11 到 16 倍。不过正文没提具体测的是哪个模型,也没给每秒 token 数,所以这个倍数我先打个折——可能是在小模型或特定 batc...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
14:48
42d ago
Hacker News 首页· rssEN14:48 · 08·11
Keet:输入任意主题,AI 自动生成视频课+多邻国式小测验
Keet 是 YC S24 的 iOS 应用,你输入一个主题(比如“大爆炸”或“旧金山历史”),它自动生成一套结构化课程,包含短视频讲解和选择题、滑动配对、连线等游戏式测验。可以调深度、复杂度和旁白风格。目前私测中,前两门课免费,之后按课付费。正文没披露用了什么模型、视频最长多久、以及单次生成的价格,所以成本不好判断。如果是真的,对想快速入门一个陌生领...
#Keet#Y Combinator
一句话点评
Keet 是 YC 孵化的 iOS 应用,输入主题就能自动生成带短视频和选择题、滑动配对等游戏的课程,像 Duolingo 但内容不限。目前私测中,前两门免费,之后按课付费。正文没披露用了什么模型、视频最长多久、单次生成价格,所以成本不好判断。如果是真的,对想快速入门一个陌生领域的人挺实用,但生成质量、事实准确性、以及长期定价是否划算,都得等公测再看。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
14:15
42d ago
AI HOT 精选· aihot-apiZH14:15 · 08·11
跨会话传消息后,Codex 和 Claude 怎么重构 vibe coding 工作流
微信正文被屏蔽,只留了标题。标题说跨会话传消息之后,Codex 和 Claude 在重构 vibe coding 工作流。正文没披露具体方法、效果或对比,信息缺口很大。
#Codex#Claude
一句话点评
标题说跨会话传消息后,Codex 和 Claude 在重构 vibe coding 工作流,但正文被微信屏蔽,只留了“环境异常”页面。信息缺口很大:没披露具体怎么传消息、效果如何、对比谁。如果是真的,跨会话记忆能让 AI 写代码更连贯,但这点先别太激动,来源不可靠,缺实测数据。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
14:03
42d ago
● P1Hacker News 首页· rssEN14:03 · 08·11
OpenAI唯一专职伦理学家Chloé Bakalar离职,公司未寻找替代者
Chloé Bakalar 上个月从 OpenAI 离职,她在公司待了不到一年,是那里唯一一个专门做 AI 伦理的人。OpenAI 发言人跟《金融时报》说,公司不打算找人接替,因为伦理问题不再归某个人或某个团队管,而是已经“嵌入”到各个研究团队的模型开发流程里了。Bakalar 之前在 Meta 当过首席伦理学家,今年三月还公开说过,不该由一家千亿美元...
#OpenAI#Chloé Bakalar#Meta
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 唯一的专职伦理学家干了不到一年就走了,公司也没打算再招人补这个坑。
锐评
Chloé Bakalar 去年 8 月入职,今年 7 月离职,在 OpenAI 待了不到一年。她之前在 Meta 管伦理政策,到 OpenAI 后是公司里唯一一个全职做伦理的人。金融时报的消息源说她没被替换,这意味着 OpenAI 现在没有专职伦理岗了。 OpenAI 给 Gizmodo 的回应是“伦理不由某个人或某个团队独有,已经嵌入到模型开发流程里了”。这话听着像把责任摊平了,但摊平之后谁在关键决策上为伦理问题拍板、有没有否决权,正文没披露。另外,Bakalar 离职的原因也没说——是自己要走还是被优化,不知道。 最近几周 OpenAI 安全条线走的人不少,安全系统负责人和一位资深安全专家也在这个夏天离开。Sam Altman 同期在播客里说“我们已经进入奇点”,语气比之前强硬很多。一边是伦理岗归零,一边是老板喊奇点已到,这两件事放在一起,至少说明公司现阶段的重心不在设置独立的伦理刹车。还缺的信息是:嵌入式的伦理审查具体怎么运作,有没有外部审计,以及这些离职是否跟内部对安全节奏的分歧有关。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
13:37
42d ago
Hugging Face 博客· rssEN13:37 · 08·11
IBM 用更少 token 复现了 ACE 推理效果
IBM 研究院发了一篇博客,说他们能用比 ACE(Agentic Chain-of-Evidence,让模型一步步生成推理链条的方法)少得多的 token 达到差不多的推理质量。核心做法是只让模型输出关键证据链,而不是完整的推理过程。博客标题直接喊“更少 token 也能行”,但正文没披露具体省了多少 token、在什么 benchmark 上测的。如...
#Reasoning#IBM Research#Hugging Face
一句话点评
IBM 说他们搞了个新方法,让模型只输出关键证据链,不用写完整推理过程,就能达到类似 ACE 的效果,而且 token 更少。标题喊得挺响,但正文没披露具体省了多少 token、在什么 benchmark 上测的,也没和 ACE 做直接对比。目前只能当个技术预告看,省 token 这事如果是真的挺省钱,但缺验证细节,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
13:22
42d ago
● P1Hacker News 首页· rssEN13:22 · 08·11
研究发现加密思维链可跨模型重放解码推理过程
Anthropic、OpenAI 和 Google 返回给用户的加密思维链块可以在不同会话、用户和模型之间复用。研究人员把 Claude Opus 4 的加密推理痕迹塞进一个被越狱的 Claude Haiku 4.5,Haiku 就把 Opus 隐藏的思考过程一字不差地转录了出来,全程没有直接攻击强模型,也没触发反蒸馏保护。他们从 6,708 条公开的...
#Reasoning#Code#Anthropic#OpenAI
精选理由
精选 · 重要度 98 · 吸引力 + 知识量 + 共鸣
一句话点评
有人发现,大模型返回给用户的加密思考过程,可以“偷”出来,塞给同门的弱模型重放,直接解码成明文。
锐评
这项研究指出了一个挺要命的实现漏洞:OpenAI、Anthropic 和 Google 的推理模型,会把思考过程加密后发给用户,下次对话再原样传回服务器。但这段加密数据不认人、不认对话,甚至不认模型。研究者把它从强模型(比如 Claude Opus)的回复里抠出来,塞给同厂商一个被越狱的弱模型(比如 Claude Haiku),弱模型就能把强模型的思考步骤一字不差地吐出来。 他们用 120 道编程竞赛题测试,解码出的思考 token 数和 API 报告的隐藏 token 数几乎完全吻合,说明还原度很高。更麻烦的是,团队从 GitHub 和 Hugging Face 上公开的 6708 条对话记录里,用这套方法解出了 31 万多条推理块,从中捞出 704 个隐私信息,包括 62 个 API 密钥、33 个密码和 30 个个人邮箱。其中 64 个敏感信息只藏在思考块里,公开的对话文本里根本没有。 论文没提这种攻击需要多高的越狱技巧,也没说厂商是否已经开始修补。目前看,只要拿到加密块,攻击门槛不高。如果你的应用日志里存了带签名的完整 API 返回,这些加密思考块就等于明文密码本。
HKR 分解
hook knowledge resonance
打开信源
98
SCORE
H1·K1·R1
13:03
42d ago
Ben's Bites· rssEN13:03 · 08·11
让AI输出更好读:两个提示词技巧
Ben's Bites 作者发现AI输出越来越难读,测试了两个自定义指令:让模型用 ASD-STE100 简化技术英语写,以及“像对ADHD患者一样说话”。前者让技术信息更清晰,后者给出简洁的要点和标题,组合效果比说“我不懂技术”好。此外,本周AI新闻:OpenAI 把付费用户默认模型切到 GPT-5.6-Sol,免费用户无限用 GPT-5.6-Lun...
#Vision#OpenAI#Meta#Grok
一句话点评
短评:提示词工程新玩法:让模型用ASD-STE100简化技术英语写,再加一句“像对ADHD患者说话”,输出更清晰。 点评:Ben's Bites作者嫌AI输出越来越难读,试了两个自定义指令:用ASD-STE100简化技术英语写,以及“像对ADHD患者一样说话”。前者让技术信息更清晰,后者给出简洁要点和标题,组合效果比说“我不懂技术”好。这本质是提示词工程,但思路值得借鉴——不是让模型更聪明...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
12:44
42d ago
FT · 科技· rssEN12:44 · 08·11
人类不能在AGI的后座当乘客
FT一篇评论文章警告,AGI正从工具变成自主决策者,人类有沦为被动乘客的风险。作者呼吁重新设计人机关系,确保人始终掌握控制权,而不是只跟着走。文章没有给出具体技术方案或时间表——这是一篇政策与伦理层面的呼吁,不是技术报告。
#Financial Times
一句话点评
FT这篇评论警告AGI正从工具变成自主决策者,人类可能沦为后座乘客。文章呼吁重新设计人机关系,确保人始终掌握控制权。但这是政策伦理层面的呼吁,没有给出具体技术方案或时间表——更像一篇立场声明,不是技术报告。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R1
12:01
42d ago
Product Hunt · AI· rssEN12:01 · 08·11
Jotform 给表单加了个 AI 助手,自动总结回复并生成待办事项
Jotform 新出的 AI Data Assistant 能分析表单提交内容,自动生成摘要和行动项。说白了就是帮你省掉人工翻表格的功夫。不过正文没披露它支持哪些数据源、分析深度如何,所以目前只能确认基础功能——把表单数据变成可读的结论和下一步动作。
#Jotform
一句话点评
Jotform 给表单加了个 AI 助手,能自动总结提交内容并生成待办事项。省了人工翻表格的功夫,但正文没披露支持哪些数据源、分析深度如何,目前只能确认基础功能。如果是真的挺省钱,但别急着当 BI 工具用。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
09:20
42d ago
AI HOT 精选· aihot-apiZH09:20 · 08·11
Ling-3.0-tiny 开源:1.3B 激活参数,专攻真实任务而非闲聊
Ling-3.0-tiny 正式开源,只有 1.3B 激活参数,目标不是通用聊天,而是真实任务场景。正文被微信屏蔽,没披露架构、训练方法、跑分或仓库链接。1.3B 激活参数意味着推理成本低、部署门槛不高,但能力上限也有限,适合做轻量级业务模型。
#Open source
一句话点评
Ling-3.0-tiny 开源,1.3B 激活参数主打真实任务而非聊天。参数小意味着推理成本低、部署门槛不高,但能力上限也有限,适合做轻量级业务模型。正文被微信屏蔽,没披露架构、训练方法、跑分或仓库链接,信息缺口很大。短评:参数小、成本低,但正文被屏蔽,缺架构和跑分,先别激动。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
05:52
42d ago
AI HOT 精选· aihot-apiZH05:52 · 08·11
ZCode 大更新:让 AI 自己拆目标、叫帮手、远程干活、闲时跑任务
ZCode 一次性上了四个功能:Goal 让 AI 把长期目标拆成小步骤自己推进;Subagents 是让多个 AI 角色协作干活;Remote Control 支持远程下发任务;Idle Tasks 利用空闲算力跑后台任务。文章被微信屏蔽,正文看不到,没披露具体规格、定价和上线时间。
#ZCode#Product update
一句话点评
ZCode 一次性上了四个功能:Goal 让 AI 自己拆目标推进,Subagents 多角色协作,Remote Control 远程下发任务,Idle Tasks 用闲时算力跑后台。文章被微信屏蔽,正文看不到,没披露具体规格、定价和上线时间。短评:功能听着挺全,但没细节,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
05:44
42d ago
AI HOT 精选· aihot-apiZH05:44 · 08·11
用 ComfyUI 搭 MiniMax-H3 视频生成流水线,Python 全自动调参
这篇教程教你用 ComfyUI 当推理后端,纯 Python 控制 MiniMax-H3 模型生成视频和音频。它能自动下载模型权重、根据显存选精度和分辨率,支持文生视频、首尾帧条件生成和参考图条件生成。正文没披露单次生成的耗时和成本,但工程流程很扎实,适合想自己搭视频生成服务的人参考。
#MiniMax-H3#ComfyUI#Hugging Face#Open source
一句话点评
这篇教程教你用 ComfyUI 当推理后端,纯 Python 控制 MiniMax-H3 模型生成视频和音频。它能自动下载模型权重、根据显存选精度和分辨率,支持文生视频、首尾帧条件生成和参考图条件生成。正文没披露单次生成的耗时和成本,但工程流程很扎实,适合想自己搭视频生成服务的人参考。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
05:30
42d ago
Hacker News 首页· rssEN05:30 · 08·11
让 DeepSeek 自己讲自己的架构:MoE、MLA、长上下文,以及它承认自己会瞎编
作者用聊天的方式让 DeepSeek 自己解释自己的技术细节,比如混合专家模型(MoE,每次只激活部分专家,省算力)、多头潜在注意力(MLA,压缩记忆,省显存)和长上下文注意力。模型承认自己“内省”能力有限,很多回答只是复述公开论文,甚至可能编造。文章还对比了模型回答和 arXiv 论文,发现它漏了一些公开事实。整体像一份坦诚的技术访谈,适合想了解 D...
#DeepSeek#Manish Shahi
一句话点评
短评:让模型自己讲自己架构,想法有趣,但模型承认“内省有限”,很多回答只是复述论文甚至编造。 点评:作者用聊天方式让 DeepSeek 解释自己的 MoE(混合专家模型,每次只激活部分专家,省算力)、MLA(多头潜在注意力,压缩记忆,省显存)和长上下文注意力。模型坦诚“内省”能力有限,很多回答只是复述公开论文,甚至可能编造。文章还对比了模型回答和 arXiv 论文,发现它漏了一些公开事实。...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
05:26
42d ago
Hacker News 首页· rssEN05:26 · 08·11
Mcptoon:一个号称把 MCP 工具发现环节的 token 消耗砍掉 97% 的命令行客户端
Mcptoon 是一个 MCP 协议的 CLI 客户端,核心卖点是工具发现阶段能省 97% 的 token。如果数字属实,意味着每次让模型选工具时,光描述工具列表就能省下大量上下文预算——对高频调用场景挺省钱。但项目还很早期,HN 上只有 17 分、6 条评论,正文没披露具体怎么实现的,也没说支持哪些模型或协议版本。省 token 的原理、实测效果、兼...
#Mcptoon
一句话点评
Mcptoon 号称在 MCP 工具发现阶段能省 97% 的 token,如果属实,高频调用场景能省不少上下文预算。但项目才 17 分、6 条评论,正文没披露实现原理、支持哪些模型或协议版本,省 token 效果和兼容性都存疑。先别太激动,等实测或技术细节出来再说。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K1·R0

更多

频道

后台