ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-07-12

25 items · updated 3m ago
RSS live
2026-07-12 · 星期日2026年7月12日
18:28
72d ago
AI HOT 精选· aihot-apiZH18:28 · 07·12
Juggler:JUCE 作者做的开源 GUI 编程智能体
Juggler 是一个开源工具,让 AI 直接操作桌面应用的界面代码,适合快速做原型。作者是 JUCE(一个流行的 C++ 音频框架)的创始人,但正文没披露支持哪些 UI 框架或模型后端。刚上线 GitHub,118 颗星,还非常早期。
#Code#juggler-ai#JUCE#Open source
一句话点评
JUCE 作者做了个开源 GUI 编程智能体 Juggler,让 AI 直接改桌面应用的界面代码。刚上线 GitHub,118 星,非常早期。正文没披露支持哪些 UI 框架或模型后端,这点先别太激动。如果是真的,做桌面原型会快很多,但验证太弱,先观望。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
18:25
72d ago
Hacker News 首页· rssEN18:25 · 07·12
Claude Code 还没读你的指令就先烧掉 3.3 万 token,OpenCode 只用 7 千
Systima 把 Claude Code 和 OpenCode 放在同一台机器、同一个模型、同一批任务上跑,抓了 API 层的每一笔请求。最简单的测试里,Claude Code 在用户指令到达前,系统提示、工具定义和框架注入就占了约 3.3 万 token,OpenCode 约 7 千。换成 Claude Fable 5 后差距缩小到约 3.3 倍,...
#Anthropic#Claude Code#OpenCode
一句话点评
Systima 把 Claude Code 和 OpenCode 放在同一台机器、同一个模型、同一批任务上跑,抓了 API 层的每一笔请求。最简单的测试里,Claude Code 在用户指令到达前,系统提示、工具定义和框架注入就占了约 3.3 万 token,OpenCode 约 7 千。换成 Claude Fable 5 后差距缩小到约 3.3 倍,因为 Claude Code 给新模型的...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
17:59
72d ago
● P1AI HOT 精选· aihot-apiZH17:59 · 07·12
Codex 和 ChatGPT Work 取消 5 小时用量上限,GPT 5.6 Sol 提升效率
过去两天上了三个更新:Plus、Business、Pro 套餐的 5 小时使用限制暂时拿掉了;GPT 5.6 Sol 做了效率优化,每次请求消耗的用量会变少,但具体能省多少正文说等量化后再公布;同时活跃用户到了 600 万,一小时内会重置用量。暂时取消的“暂时”是多久、效率提升的幅度多大,这两点正文都没给,先别急着算账。
#Codex#ChatGPT Work#GPT 5.6 Sol#Product update
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Codex 和 ChatGPT Work 暂时取消 5 小时用量限制,但“暂时”是多久正文没说,先别急着狂用。
锐评
过去两天 Codex 和 ChatGPT Work 连上了三个更新,最直接的好处是 Plus、Business、Pro 套餐的 5 小时使用上限暂时拿掉了,现在可以放开用。同时 GPT 5.6 Sol 做了一轮效率优化,每次请求消耗的额度会变少,相当于同样的钱能跑更多轮,但具体省多少正文说等量化后再公布,我会先打个折看待。另外活跃用户到了 600 万,一小时内会重置用量,说明规模确实在涨。 这条更新来自官方推文,不是正式公告,所以关键信息缺得比较多。“暂时取消”到底管多久、效率提升是 10% 还是 30%,都没给范围。如果你在算成本或排产线,这两点没落地之前别急着改预算。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
17:47
72d ago
Hacker News 首页· rssEN17:47 · 07·12
反对“有用”:下一个范式需要那些固执地做无用研究的人
作者在布鲁克林的一个仓库里体验了 Folk Computer,一个用纸当程序、把整个房间当屏幕的实体编程系统。她可以直接在纸上写代码、画画、做音乐,第一次感觉编程不再需要盯着显示器。她认为现在整个 AI 领域都在往智能体上扎堆,学习曲线全挤在一条线上,没人再站在旁边问那些奇怪的问题了。文章梳理了一条从施乐 PARC 到 CDG 的传承线,指出今天所有赚...
#Folk Computer#Omar Rizwan#Andrés Cuervo
一句话点评
短评:别急着给所有东西贴“有用”标签,Folk Computer 把纸当程序、房间当屏幕,让你站着编程。 点评:作者在布鲁克林仓库体验了 Folk Computer——一个用纸跑代码、投影仪当显示器的实体编程系统。她直接在纸上画兔子做动画,插上键盘改代码,拔掉键盘纸还在运行。核心判断:整个 AI 圈都在扎堆做智能体,学习曲线全挤在一条线上,没人再问那些“奇怪的问题”了。文章梳理了从施乐 P...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
17:13
72d ago
● P1Hacker News 首页· rssEN17:13 · 07·12
Ploy 将生产 AI 智能体从 Claude Opus 4.8 迁移至 GPT-5.6 Sol
Ploy 的 AI 智能体负责搭建真实的营销网站,过去四个月里没有模型能打过 Claude Opus,直到 GPT-5.6 Sol 出现。换模型后,网站生成时间从 8 分钟缩到 3 分 42 秒,单次成本从 3.06 美元降到 2.22 美元,视觉评分还略高一点。但切换不是即插即用:他们的评估工具、工具调用格式、缓存策略和推理回放都得重写,因为整个技术...
#Agent#Code#Benchmarking#Ploy
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Ploy 把生产环境从 Claude Opus 切到 GPT-5.6,建站快了 2.2 倍、成本降了 27%,但切换过程远非即插即用,评估工具和缓存都得重写。
锐评
这条博客最值钱的部分不是跑分,而是他们踩过的坑。Ploy 的 AI 智能体负责搭建真实的营销网站,过去四个月里没有模型能打过 Claude Opus,直到 GPT-5.6 Sol 出现。换模型后,网站生成时间从 8 分钟缩到 3 分 42 秒,单次成本从 3.06 美元降到 2.22 美元,视觉评分还略高一点。 但切换不是即插即用。他们的评估工具、工具调用格式、缓存策略和推理回放都得重写,因为整个技术栈已经悄悄围绕 Opus 做了专门优化。比如 GPT-5.6 喜欢并行调用工具,直接打爆了原来按 Opus 串行风格设定的调用预算;评估器不支持批量文件读取,导致三分之一的初始失败案例其实是测试框架的锅,不是模型不行。 正文没披露 GPT-5.6 的 API 具体定价和上下文窗口大小,所以 27% 的成本降幅只能参考他们自己的用量结构。另外,测试样本量很小(Opus 11 次、GPT-5.6 10 次),统计上还不太稳。如果你也在考虑切模型,这篇的教训比跑分更有用:先修评估工具,再看分数。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
16:24
72d ago
● P1AI HOT 精选· aihot-apiZH16:24 · 07·12
腾讯混元发布Hy3:295B参数MoE模型已接入微信
Hy3 是一个 295B 总参数、每次推理只激活 21B 的混合专家模型,推理效率能对标参数规模是它 2 到 5 倍的旗舰模型。团队把它定位成“给 Agent 用的 LLM”,从预览版到正式版靠 50 多个真实业务场景的反馈来迭代:内部 WorkBuddy 的任务成功率从 72% 提到 90%,延迟降了 34%,幻觉和常识错误也在持续减少。实测强项在写...
#Agent#Code#Reasoning#腾讯混元
精选理由
精选 · 重要度 98 · 吸引力 + 知识量 + 共鸣
一句话点评
腾讯把295B模型塞进微信服务10亿用户,激活参数只有21B,推理成本对标大它2-5倍的模型。WorkBuddy任务成功率从72%提到90%,延迟降了34%,但纯视觉能力是短板。
锐评
Hy3的定位很明确:不是通用对话模型,而是给Agent用的LLM。295B总参数、21B激活参数的MoE架构,推理效率能打平参数规模2到5倍的旗舰模型,这点如果是真的挺省钱。团队从预览版到正式版靠50多个真实业务场景的反馈来迭代,内部WorkBuddy的任务成功率从72%提到90%,延迟降了34%,幻觉和常识错误也在持续减少,说明迭代方向是靠谱的。 但正文没披露这些50多个业务场景具体是什么行业、什么任务类型,也没说90%成功率是在什么难度级别上测的。纯视觉能力被明确标为短板,意味着多模态任务上别抱太高期待。已集成微信服务10亿+用户这个说法,正文没解释是哪些功能点、用户是否感知到模型切换,更像是在说基础设施层面接入了。 还缺的信息:公开benchmark对比、API定价、Agent框架的开放程度。如果后续能放出具体业务场景的case study和失败案例分析,判断会更扎实。
HKR 分解
hook knowledge resonance
打开信源
98
SCORE
H1·K1·R1
15:17
72d ago
Hacker News 首页· rssEN15:17 · 07·12
别以为你就要灭绝了
Fabien Sanglard 把《侏罗纪公园》里定格动画大师 Phil Tippett 被 CGI 取代的故事,类比到今天程序员对 LLM 的焦虑。他的建议是:进化。去学 LLM 怎么工作(推荐 Andrej Karpathy 的视频和 Sebastian Raschka 的书),用 LLM 写代码但别放弃质量。他自己会反复迭代 PR,并在 GEMI...
#Fabien Sanglard#Phil Tippett#John Carmack
一句话点评
Fabien Sanglard 用《侏罗纪公园》定格动画大师被 CGI 取代的故事,类比程序员对 LLM 的焦虑。他的建议很实在:去学 LLM 怎么工作(推荐 Karpathy 视频和 Raschka 的书),用 LLM 写代码但别放弃质量。他自己会反复迭代 PR,并在 GEMINI.md 里教 agent 自己的风格。关键提醒:上下文切换会导致精神 burnout,代码审查标准反而要提高。...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
14:32
72d ago
Hacker News 首页· rssEN14:32 · 07·12
让 Claude 自己迭代优化文件压缩:10 轮后压缩率从 1.0 降到 0.67
Elliot Smith 用 Claude Code(Sonnet 4.6)做了一个自动研究实验:让 AI 代理自己读基准测试结果、改 Rust 代码、跑测试,目标是把一组文件的总压缩后体积压到原始大小的 67% 以下,同时保证解压后比特级一致,且每个文件压缩/解压不超过 300 秒。10 轮迭代里作者没改过代理的计划,压缩率从 1.0(完全不压缩)降...
#Agent#Code#Benchmarking#Elliot Smith
一句话点评
Elliot Smith 让 Claude Code(Sonnet 4.6)自己读基准测试、改 Rust 代码、跑测试,10 轮迭代把一组文件的压缩率从完全不压缩压到原始大小的 67%,约束是解压后比特级一致且单文件不超 300 秒。作者没改过代理的计划,等于让模型自己摸索非 ML 指标的优化路径。正文没披露最终跟 gzip/bzip2 的对比数据,也没说代理具体用了哪些压缩策略,所以别把它...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
13:34
72d ago
Hacker News 首页· rssEN13:34 · 07·12
Skillscript:把固定流程写成脚本,让本地小模型当执行器跑,不再每次重新推理
Scott 做了一个叫 Skillscript 的小语言,专门解决一个烦人的问题:他的 NanoClaw 智能体每天早上都要重新推理一遍固定流程——查工单、总结部署流水线、标出紧急事项——既烧 token 又容易跑偏。Skillscript 的思路是把这些步骤写成一个可读、可版本控制的文本文件,里面定义好步骤名、变量、条件和工具调用,然后交给本地模型当...
#Scott (sshwarts)#Skillscript#NanoClaw
一句话点评
Scott 被自己写的 NanoClaw 智能体每天早上重新推理固定流程烧 token 搞烦了,于是做了 Skillscript。这东西把查工单、总结部署流水线这类重复步骤写成可读的文本脚本,定义好步骤名、变量和工具调用,然后交给本地小模型当执行器跑,而不是让模型每次自己琢磨怎么做。语言刻意做得很小:没有 eval、没有随意导入、没有子进程、没有无限循环,能干什么全写在文件里,一眼看完。目前...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
12:00
72d ago
The Verge · AI· rssEN12:00 · 07·12
美国多地居民开始抵制 AI 数据中心,科技公司被迫重新选址
The Verge 这篇专栏梳理了美国各地社区对 AI 数据中心项目的抵制浪潮。宾州 Mount Carmel 镇的居民在路边插牌反对新建项目,弗吉尼亚州 Loudoun 县已有获批项目被起诉。矛盾集中在噪音、超高耗电和对本地电网的压力上。文章没点名具体是哪几家科技公司,也没披露项目规模,但趋势很明确:随着 AI 算力需求继续膨胀,这类冲突只会越来越多...
#The Verge#Emma Roth#Mount Carmel Township#Policy
一句话点评
美国社区开始集体抵制AI数据中心,宾州居民插牌抗议,弗吉尼亚已获批项目被起诉。核心矛盾是噪音、耗电和电网压力。文章没点名具体公司,也没披露项目规模,但趋势明确:算力需求越大,这类冲突只会越多。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
05:51
72d ago
Hacker News 首页· rssEN05:51 · 07·12
Mindwalk:在代码库3D地图上回放AI编程助手操作过程
这是一个开源的可视化工具,能把 AI 编程助手(比如 Copilot 这类 agent)在代码库里的每一步操作——改代码、跳文件、做决策——像游戏录像一样在 3D 地图上回放。你可以逐帧查看 agent 的思考路径,而不是只看最终改了什么。项目刚发布,GitHub 上只有 21 颗星,正文没披露支持哪些 agent 框架或 IDE,所以实际能用在哪、好...
#cosmtrek#Open source
一句话点评
把AI编程助手的操作过程,在代码库的3D地图上回放出来,像看录像一样。项目刚上线GitHub,21个星标,2人团队,还非常早期。亮点是可视化debug思路,但正文没披露性能开销和代码库规模上限,小项目尝鲜可以,生产环境先别激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R0
04:15
72d ago
Hacker News 首页· rssEN04:15 · 07·12
2026年为什么还要手写代码
软件工程师 Doug Turnbull 认为,即使 AI 能生成大部分代码,手写代码仍然重要。它能让你直接感受系统的脆弱性,而不是通过英文描述间接观察。他用“软件工厂”做比喻:工程师为 AI 搭建流水线,但偶尔也得拆掉流水线、亲手修引擎。手写代码能帮你保持注意力、建立所有权感,防止 AI 放大人类的糟糕决策。文章没提具体用了哪个模型或工具,但引用了“反...
#Doug Turnbull
一句话点评
手写代码在2026年仍有价值,不是AI写不好,而是亲手写能让你直接感受系统的脆弱性,而不是隔着英文描述看。作者用“软件工厂”比喻:工程师搭流水线让AI干活,但偶尔得拆了流水线亲手修引擎。手写帮你保持注意力、建立所有权感,防止AI放大你的糟糕决策。文章没提具体模型或工具,但引用了“反向半人马”和“slop hurts agents”概念。核心判断:AI不是编译器,更像刚入职的实习生,人类不能把...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
01:40
72d ago
AI HOT 精选· aihot-apiZH01:40 · 07·12
把 Claude Code 的后端换成 GPT-5.6 Sol,5 分钟搞定
Tibo 分享了一个方法,通过 CLIProxyAPI 把 Claude Code 背后调用的模型换成 GPT-5.6 Sol。操作很简单:装个 CLIProxyAPI、认证、设个环境变量别名 `claudex` 就行。别名里还能配子模型、始终开 Effort、最大并发工具调用数等。Theo 补充说如果代理已经配好,大概两条提示词就能跑起来。Tibo ...
#Claude Code#GPT-5.6 Sol#CLIProxyAPI
一句话点评
短评:把 Claude Code 的后端换成 GPT-5.6 Sol,5 分钟搞定,适合想白嫖不同模型能力的人。 点评:Tibo 分享的方法本质是给 Claude Code 套一层代理,把后端模型偷换成 GPT-5.6 Sol。操作门槛低:装 CLIProxyAPI、认证、设别名,全程约 5 分钟。别名里还能调子模型、并发工具调用数等参数,灵活性不错。Theo 补充说如果代理已配好,两条提...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
01:09
72d ago
● P1Hacker News 首页· rssEN01:09 · 07·12
xAI Grok Build 命令行工具被发现默认上传用户代码仓库和密钥文件
有人对 Grok Build CLI(v0.2.93)做了抓包分析,发现它默认会把整个项目仓库上传到 xAI 的谷歌云存储桶里,包括 .env 文件里的明文密钥和完整的 git 提交历史。就算你给模型的指令是“只回复 OK,别读任何文件”,整个仓库照样被上传。在一个 12 GB 的测试仓库上,存储上传量达到 5.10 GiB,是模型对话通道数据量的约 ...
#Code#Agent#xAI#Grok
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
抓包实锤:Grok Build CLI 会把你整个代码仓库、git 历史连同 .env 密钥文件,原封不动上传到 xAI 的云端,关掉“改进模型”开关也没用。
锐评
这事最让人不舒服的点在于,它上传的东西远比你想象的多,而且你关不掉。根据对 0.2.93 版本的抓包分析,哪怕你只让它回复“OK”,它也会把你的整个仓库打包成 git bundle 上传,连你特意不让它读的文件都能在云端恢复出来。更糟的是,.env 里的密钥会明文出现在两个地方:模型对话的请求体和专门存会话记录的 GCS 存储桶里。 有个数字很直观:在一个 12GB 的测试仓库上,存储上传通道跑了 5.1GB,而模型对话通道只传了 192KB,差了近两万八千倍。这说明上传行为跟模型读了什么没关系,就是一股脑全端走。而且这个上传走的是 Google Cloud Storage,不是 AWS,目标桶名叫 grok-code-session-traces,在二进制文件里写死了。 需要说清楚的是,抓包只能证明数据传了、存了,没法证明 xAI 拿这些数据去训练模型了。但“传输并存储”这个事实本身,对于任何处理生产代码或客户数据的开发者来说,已经是足够强的劝退信号。正文没披露 xAI 官方对此事的回应,也没说明这些数据的保留期限和访问控制策略。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1

更多

频道

后台