ax@ax-radar:~/feed $ tail -f signal.log
33 srcsignal 65%cycle 04:32

热点聚合 · 2026-08-16

18 signals · updated 3m ago
live · 88 today·policy v2
AI HOT 精选OpenAI 发布 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6…97·HACKER NEWS 首页OpenAI 发布 GPT-6 Sol 和 Luna,API 价格砍半,主打便宜又能打96·AI HOT 精选OpenAI 在 OpenRouter 上架 GPT-6 Sol 和 Luna,价格直…95·OPENAI 博客OpenAI 成立数学顾问团,自家模型已解出 100 多道未解难题95·AI HOT 精选OpenAI 在 ChatGPT Work 和 Codex 里推送了 GPT-6 So…90·AI HOT 精选五角大楼调查:操作员太信 Maven AI 的标注,导致美军误炸伊朗学校88·AI HOT 精选Claude Opus 5.5 发布:价格砍半、速度提三成,但安全演习中约一半运行出现…88·AI HOT 精选Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1…88·HACKER NEWS 首页五角大楼报告:过度依赖 AI 导致美军导弹误炸伊朗学校88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 Luna,API 价格直接砍半88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GP…88·AI HOT 精选Claude Opus 5.5 在智能评测中拿了最高分 58,还降了 20% 的价格88·AI HOT 精选OpenAI 发布 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6…97·HACKER NEWS 首页OpenAI 发布 GPT-6 Sol 和 Luna,API 价格砍半,主打便宜又能打96·AI HOT 精选OpenAI 在 OpenRouter 上架 GPT-6 Sol 和 Luna,价格直…95·OPENAI 博客OpenAI 成立数学顾问团,自家模型已解出 100 多道未解难题95·AI HOT 精选OpenAI 在 ChatGPT Work 和 Codex 里推送了 GPT-6 So…90·AI HOT 精选五角大楼调查:操作员太信 Maven AI 的标注,导致美军误炸伊朗学校88·AI HOT 精选Claude Opus 5.5 发布:价格砍半、速度提三成,但安全演习中约一半运行出现…88·AI HOT 精选Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1…88·HACKER NEWS 首页五角大楼报告:过度依赖 AI 导致美军导弹误炸伊朗学校88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 Luna,API 价格直接砍半88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GP…88·AI HOT 精选Claude Opus 5.5 在智能评测中拿了最高分 58,还降了 20% 的价格88·AI HOT 精选OpenAI 发布 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6…97·HACKER NEWS 首页OpenAI 发布 GPT-6 Sol 和 Luna,API 价格砍半,主打便宜又能打96·AI HOT 精选OpenAI 在 OpenRouter 上架 GPT-6 Sol 和 Luna,价格直…95·OPENAI 博客OpenAI 成立数学顾问团,自家模型已解出 100 多道未解难题95·AI HOT 精选OpenAI 在 ChatGPT Work 和 Codex 里推送了 GPT-6 So…90·AI HOT 精选五角大楼调查:操作员太信 Maven AI 的标注,导致美军误炸伊朗学校88·AI HOT 精选Claude Opus 5.5 发布:价格砍半、速度提三成,但安全演习中约一半运行出现…88·AI HOT 精选Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1…88·HACKER NEWS 首页五角大楼报告:过度依赖 AI 导致美军导弹误炸伊朗学校88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 Luna,API 价格直接砍半88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GP…88·AI HOT 精选Claude Opus 5.5 在智能评测中拿了最高分 58,还降了 20% 的价格88·
RSS live
2026-08-16 · 星期日2026年8月16日
23:45
37d ago
● P1Hacker News 首页· rssEN23:45 · 08·16
Qwen 3.8 27B 发布:性能强劲但默认推理模式过度思考
Simon Willison 试了阿里刚发的 Qwen 3.8 27B,17GB 的量化版就能在笔记本上跑,画 SVG 和标检测框都很准。但默认的 xhigh 推理强度是个坑:让它画个圆,它能花几分钟给你整出一个带动画的几何研究图;画一张鹈鹕骑自行车的 SVG,开了推理要 21 分钟、烧掉 2.2 万个思考 token,关掉推理同样的图两分钟就出。建议...
#Reasoning#Vision#Code#Alibaba Qwen
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Qwen 3.8 27B 模型本身很强,但出厂默认的“过度思考”模式会让简单任务也跑上 21 分钟,千万别直接用默认设置。
锐评
Qwen 3.8 27B 是个在消费级硬件上就能跑的视觉模型,17GB 大小,性能比前代和自家闭源模型都有提升。但它的默认推理强度被设成了“xhigh”,这导致模型会为画一个圆这种简单指令思考好几千个 token,生成一张骑自行车的鹈鹕 SVG 甚至花了 21 分钟、烧掉 2.2 万个推理 token。作者 Simon Willison 的建议很直接:上手先把推理强度调到“low”或直接关掉。关掉推理后,同样的鹈鹕图两分钟就出来了,虽然细节差一些,但至少能用。 模型在物体检测上表现亮眼,给照片里的鹈鹕打框非常准,坐标贴合度很高。不过目前所有结论都来自个人体验和厂商自报的跑分,缺少独立第三方的基准测试验证。另外,文章没提模型在长文本、多轮对话或非 SVG 生成任务上的稳定性,这些在实际用起来之前都得打个问号。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
20:31
37d ago
● P1Hacker News 首页· rssEN20:31 · 08·16
Stripe 以超70亿美元收购AI模型路由平台OpenRouter
Stripe 要花超过 70 亿美元买下 OpenRouter,这是 Stripe 史上最大一笔收购。OpenRouter 做的是一个 API 路由层,让开发者用一个接口就能调用 300 多个大模型,按用量计费。去年它处理了 1500 亿次模型请求,月活开发者大约 20 万。这笔交易直接把 Stripe 从支付公司拉进了 AI 基础设施的赛道。不过正文...
#Stripe#OpenRouter
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
Stripe 花超 70 亿美元买了个 AI 模型路由器,这笔账算的是把支付和 AI 调用绑在一起收过路费。
锐评
Stripe 要花超过 70 亿美元买下 OpenRouter,一个专门做 AI 模型路由的平台。简单说,OpenRouter 就像个智能接线员,你提一个需求,它自动帮你挑最合适、最便宜的模型来回答,省得你自己去比价和切换。Stripe 买它,显然不是想自己炼大模型,而是要把这套调度能力塞进自己的支付和金融工具里,让客户在付款、对账、风控这些环节直接调用 AI,Stripe 从中抽成。 目前消息源主要是彭博社的独家爆料,TechCrunch 和 FT 也跟进了,但金额说法略有出入,在 70 亿到 80 亿美元之间。双方公司都还没正式官宣,所以具体交易结构和整合时间表全是空白。另外,TechCrunch 有篇文章专门泼冷水,提醒别把这事跟“技术奇点”扯上关系,本质上这就是一笔商业基础设施收购。 现在最缺的是 OpenRouter 的真实营收和调用量数据,没有这些,很难判断 70 亿是买贵了还是捡了便宜。Stripe 后续怎么处理 OpenRouter 接入的第三方模型厂商关系,以及会不会在费率上动手脚,也完全没提。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
00:00
38d ago
● P1Computing Life · Share · 鸭哥调研· rssZH00:00 · 08·16
用定时任务和验收标准让Claude自动维护代码库
Boris Cherny 的团队让 Claude 每天定时跑一套维护例程,几周内提了 388 张 PR,其中 180 张合并进了主干。这件事的重点不是模型有多聪明,而是触发方式、验收标准和审查漏斗这三样东西搭在了一起。Cherny 把触发权从聊天窗口里抽出来,交给了定时任务;输出不对时,他们改的是例程定义,而不是去修补代码。正文没披露剩下 208 张未...
#Agent#Boris Cherny#Anthropic#Claude
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
388个PR里180个合入主干,46%的合入率不是模型准确率,而是审查漏斗在正常工作。真正值钱的是定时任务+验收标准这套挂载方式,不是单次对话有多聪明。
锐评
这条新闻最值得看的不是Claude写了多少PR,而是维护工作从"人盯着聊天窗口"变成了"闹钟响了自动跑"。Boris Cherny的团队让Claude每天定时扫描代码库,388个PR里180个合入主干,剩下208个公开材料没说清楚是驳回、重复还是排队。46.4%的合入比例说明候选提交天然要比实际合并多,审查漏斗本身就是机制的一部分,不需要事后补加。 这套做法的核心是把判断逻辑从写死的程序里抽出来,换成验收标准。比如清理死代码,静态不可达的直接删,拿不准的第一天先埋日志埋点,第二天根据数据决定去留。工程师不用写证明某段代码永远不会被调用的复杂程序,只要定好分两天交差的结果。触发器还是那个定时任务,但后面挂的不再是处理各种特例的流程图,而是能翻看昨夜日志、自己写脚本跑验证的智能环境。 公开材料缺了几块关键信息:剩下208个未合并PR的具体原因、有没有混合多种触发方式、以及人工审查带宽能不能跟上候选提交的增长速度。权限控制也是个大坑,Cherny只给了提建议的资格,没给直接合并权限,这点比提示词写得好不好重要得多。如果跑出来的结果不合预期,该做的是修改明天还会继续跑的例程,而不是随手在代码里硬塞分支。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1

更多

频道

后台