ax@ax-radar:~/x $ tail -f x-timeline.log
40 srcsignal 72%cycle 04:32

X 监控

50 推文 · updated 3m ago
7 个账号
全部50
2026-04-16 · 星期四2026年4月16日
03:11
103d ago
X · @Khazix0918· x-apiZH03:11 · 04·16
Skill 设计本质是分类学:超过 30 个准确率就崩
作者认为 Agent skill 的核心是分类和触发,不是堆数量。实验数据显示 skill 在 20 个以下时准确率超 90%,超过 30 个开始下降,到 200 个时只剩 20%,而且速度慢、token 消耗大。作者自己常年只保留 30 个以内,比如把公众号封面、PPT 配图等所有生图需求合并成一个 skill,内部按上下文路由,而不是每个场景单独建...
#Agent#Tools#Anthropic#Harness
一句话点评
Skill 不是越多越好,20 个以内准确率超 90%,超过 30 个开始掉,200 个只剩 20%。
锐评
作者用实验数据说话:Skill 数量在 20 个以下时准确率 90%+,超过 30 个开始下降,到 200 个只剩 20%,而且速度慢、token 消耗大。核心观点是 Skill 设计本质是分类学,关键在于找到合适的颗粒度,而不是堆数量。作者自己常年只保留 30 个以内,比如把所有生图需求(公众号封面、PPT 配图等)合并成一个 Skill,内部按上下文路由,而不是每个场景单独建一个。判断 Skill 是否值得存在的三条标准:场景有没有明确边界、是否高频复现、能否归入已有 Skill。正文没披露那篇论文的名字、实验设置和 Claude Skills 生成器更新的具体细节,但作者自己的体感和实验数据一致,可信度较高。对 AI 从业者的实际价值是:别被“万物可 Skill”的热潮带偏,先设计好自己的分类系统,区分哪些该放 CLAUDE.md、哪些该放 Skill,奥卡姆剃刀原则同样适用。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
2026-04-15 · 星期三2026年4月15日
17:08
104d ago
X · @dotey(宝玉)· x-apiZH17:08 · 04·15
Gemini Mac 版上线,但缺 Gem 功能,体验不如网页版
一位用户试用了刚上线的 Gemini Mac 版,评价是不好用,连 Gem(自定义助手)都不支持,整体体验不如网页版。正文只给了主观上手感受,没交代版本号、上线日期、功能范围或支持哪些 Mac 机型。关键问题是功能对齐:桌面版目前还落后于网页版。
#Tools#Google#Gemini#Product update
一句话点评
Mac 版 Gemini 上线了,但连自定义助手都不支持,体验不如网页版。
锐评
一位用户试用了刚上线的 Gemini Mac 版,结论是“不好用”,核心槽点是连 Gem(自定义助手)都不支持,整体体验不如网页版。正文只给了主观上手感受,没交代版本号、上线日期、功能范围或支持哪些 Mac 机型。关键问题是功能对齐:桌面版目前还落后于网页版。如果这是正式版,那 Google 的迭代速度确实慢——网页版槽点一堆,桌面版还砍功能。信息缺口:不知道这是早期版本还是正式发布,也不清楚后续更新计划。如果是真的,那 Mac 用户暂时没必要特意下载。
HKR 分解
hook knowledge resonance
打开信源
57
SCORE
H1·K1·R0
04:56
104d ago
X · @op7418(歸藏)· x-apiZH04:56 · 04·15
套壳 Claude Code 的开发者被模型名搞疯了:API 不返回真实模型名,每次上新都得改代码
一位开发者吐槽,现在各家 Code plan 兼容 Anthropic 模式时,请求都会被映射成 Claude Code 那三个模型名,实际用了哪个模型根本不知道。他列了三个痛点:API 不返回新模型的真实名称,每次上新都得手动更新代码;用户额度看不见;各家写法、设置还不统一。最烦的是用户出问题(不管是模型厂商的锅还是自己操作失误)全怪到套壳软件头上。...
#Code#Tools#Anthropic#Claude Code
一句话点评
套壳开发者被Claude Code兼容模式坑惨了:模型名被映射、额度看不见、用户甩锅全找你。
锐评
一位开发者吐槽,现在各家Code plan兼容Anthropic模式时,请求都会被映射成Claude Code那三个模型名,实际用了哪个模型根本不知道。他列了三个痛点:API不返回新模型的真实名称,每次上新都得手动更新代码;用户额度看不见;各家写法、设置还不统一。最烦的是用户出问题(不管是模型厂商的锅还是自己操作失误)全怪到套壳软件头上。 这事暴露了Anthropic兼容模式的一个信息缺口:API没有透传真实模型名和额度字段,导致套壳方只能猜或硬编码。如果Anthropic不开放这些元数据,第三方工具永远落后一步。正文没提具体是哪些厂商或模型,但问题很普遍——任何走Claude Code兼容路线的套壳产品都会踩坑。开发者最后说想自己封装一个统一API,说明市场确实缺一个标准化的代理层。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
04:40
104d ago
X · @dotey(宝玉)· x-apiZH04:40 · 04·15
BlockNote:一个开箱即用的 React 富文本编辑器,自带 AI 写作助手
BlockNote 是一个基于 ProseMirror 和 Tiptap 的开源 React 富文本编辑器,走 Notion 风格的 Block 编辑体验,拖拽、斜杠菜单、格式工具栏都内置好了。几行代码就能跑起来,不用啃底层概念。它最大的卖点是原生支持 AI 集成:通过 @blocknote/xl-ai 扩展包,用户选中文字点 AI 按钮或输入 /ai...
#Tools#Agent#RAG#BlockNote
一句话点评
BlockNote 把 Notion 编辑器和 AI 写作打包成一个 React 组件,几行代码就能用,但高级功能走 GPL 协议,闭源商用要买许可。
锐评
BlockNote 是一个开源 React 富文本编辑器,基于 ProseMirror 和 Tiptap,走 Notion 风格的 Block 编辑体验,拖拽、斜杠菜单、格式工具栏都内置好了。它最大的卖点是原生支持 AI 集成:通过 @blocknote/xl-ai 扩展包,用户选中文字点 AI 按钮或输入 /ai,就能让 AI 帮忙写、改、续写内容,后端支持 OpenAI、Anthropic 或自定义模型,也能接 RAG 管道补充知识库。AI 操作过程透明,用户可以逐条接受或拒绝。上手门槛低,几行代码就能跑起来,不用啃底层概念。实时协作基于 Yjs,还有导出 PDF、Word 的扩展包。 关键限制在许可:核心编辑器用 MPL-2.0,商业项目可自由使用;但 AI 集成、多列布局、文档导出这些 xl- 高级包用 GPL-3.0,闭源商用需要买商业许可。正文没披露商业许可价格,这点先别太激动。如果你在选 Tiptap 还是 BlockNote:Tiptap 适合深度定制但学习曲线陡,BlockNote 封装更高,适合快速出活。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K1·R0
02:47
104d ago
X · @op7418(歸藏)· x-apiZH02:47 · 04·15
Codepilot 0.50.1:飞书一键接入,消息队列让对话不卡顿
Codepilot 新版本主要让飞书集成变简单了——打开网页点一下就能创建应用并拿到全部权限,不用手动配。还加了子 Agent 进度展示、消息队列(AI 回复时你也能继续发消息)和草稿保存(切换聊天内容不丢)。消息队列对多人协作或长对话场景挺实用,不用等 AI 说完才能打字。正文没披露具体修了多少 bug,也没说权限范围是否可自定义。
#Agent#Tools#Memory#Codepilot
一句话点评
飞书集成一键搞定,不用手动配权限了。
锐评
Codepilot 0.50.1 的核心变化是飞书集成从手动配置变成一键创建应用并拿全权限,对国内用飞书做 AI 工具的团队省了不少事。新增的消息队列让 AI 回复时用户也能继续发消息,多人协作或长对话场景下体验提升明显;子 Agent 进度展示和草稿保存也是实用补丁。正文没披露具体修了多少 bug,也没说权限范围是否可自定义——如果默认是全开,安全敏感场景可能还得手动收窄。整体是小版本迭代,没有架构级改动,但消息队列这个能力对并发对话流挺关键。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R0
2026-04-14 · 星期二2026年4月14日
19:19
105d ago
X · @Yuchenj_UW· x-apiMULTI19:19 · 04·14
Claude Code 重新定义 IDE:基本单元从文件变成智能体
Claude Code 正在把 IDE 改造成面向智能体编程的工具。Andrej 的原话是“我们需要更大的 IDE,基本单元不再是文件,而是智能体”。这意味着写代码的方式可能从手动编辑文件变成让 AI 智能体直接干活。帖子还提到 Cursor 也在争这个方向,但正文没披露 Claude Code 的具体功能、发布时间、定价或路线图。
#Agent#Code#Tools#Anthropic
一句话点评
Claude Code 要把 IDE 改成以智能体为基本单元,Cursor 也在抢这个方向。但正文没披露任何功能、时间或定价。
锐评
这条帖子的核心判断来自 Andrej Karpathy 的一句话:IDE 的基本单元不再是文件,而是智能体。Claude Code 和 Cursor 都在争这个定义权。但正文只给了这个口号,没有披露 Claude Code 的具体功能、发布时间、定价或路线图。对于从业者来说,方向值得关注——如果 IDE 真的从“人写文件”变成“人指挥智能体干活”,那开发流程、代码审查、测试方式都会变。但这点先别太激动,因为目前没有任何可验证的 demo 或用户反馈。信息缺口很明显:Claude Code 到底能做什么、什么时候能用、怎么收费,一概不知。如果只是概念先行,那这条更像行业风向标,不是产品预告。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K0·R1
19:11
105d ago
● P1X · @claudeai· x-apiEN19:11 · 04·14
Anthropic 重新设计桌面版 Claude Code 支持单窗口多会话并排
Anthropic 给 Claude Code 桌面版换了新界面,现在你可以在一个窗口里并排跑多个 Claude 会话,左边多了个侧边栏来管理这些会话。对写代码的人来说,这主要解决的是来回切窗口的打断问题——比如一边让 Claude 改后端,另一边让它写前端,不用再开好几个终端或 IDE 面板。正文没提具体推送时间、支持哪些平台,也没说多会话之间能不能...
#Code#Tools#Anthropic#Claude Code
精选理由
精选 · 重要度 89 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude Code 桌面版重写了底层,现在一个窗口能同时跑多个编程任务,还能并排看结果。
锐评
Anthropic 把 Claude Code 桌面端从底层重写了一遍,核心变化是支持单窗口多会话并排。以前你可能要开好几个终端窗口来回切,现在侧边栏统一管理,还能分屏对比不同任务的输出。这对同时改多个模块、或者一边跑测试一边写新功能的开发者来说,操作会顺滑不少。 官方公告只给了标题,正文没披露具体的技术细节和性能数据。比如多会话并行时资源占用怎么样、上下文窗口上限有没有变,这些都没提。另外,这次改版是只改了交互层,还是连底层任务调度也重构了,目前也看不出来。 我会先打个折:交互体验的提升是实打实的,但别急着把它当成生产力飞跃。等有人实测出多任务下的延迟和内存数据,再判断它到底省了多少切换成本。
HKR 分解
hook knowledge resonance
打开信源
89
SCORE
H1·K1·R1
16:47
105d ago
● P1X · @claudeai· x-apiEN16:47 · 04·14
Anthropic 为 Claude Code 推出 routines 研究预览功能
Anthropic 给 Claude Code 加了一个叫 routines 的研究预览功能。你可以一次性配好提示词、代码仓库和要对接的工具,然后让它按时间表、API 调用或事件触发自动执行。这些任务跑在 Anthropic 自己的服务器上,所以你的笔记本不用一直开着。正文没提怎么收费、有没有次数限制,也没说这个功能会推给哪些用户。
#Agent#Code#Tools#Anthropic
精选理由
精选 · 重要度 96 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude Code 能记住并自动执行你的常用操作流程了,但官方正文没给细节,效果先打七折。
锐评
Anthropic 给 Claude Code 加了个 routines 功能,还在研究预览阶段。简单说,以前你让 AI 写代码得一句句下指令,现在可以把一连串固定操作——比如拉代码、跑测试、部署——打包成一个流程,让它自动按顺序干完。这相当于把 AI 编程助手从“对话工具”往“自动化脚本执行器”推了一步。 目前的信息全来自几条社交动态,Anthropic 官方那条推文正文是空的,没披露 routines 具体怎么配置、支持哪些操作、容错机制怎么样。归一的说法是“从你问它答升级成自动干活”,op7418 只说了“很强”,但都没展开。所以这个功能到底能省多少事、稳不稳定,现在完全没法判断。 我会先观望。如果 routines 只能跑简单线性任务,那跟写个 shell 脚本差别不大;如果能处理分支判断和异常恢复,才算真正进了业务流程。另外,研究预览通常意味着功能还不完整,可能有延迟高、容易断的问题,生产环境别急着上。
HKR 分解
hook knowledge resonance
打开信源
96
SCORE
H1·K1·R1
2026-04-13 · 星期一2026年4月13日
16:08
106d ago
X · @op7418(歸藏)· x-apiZH16:08 · 04·13
Gemini 用 SVG 画 logo 挺顺手,但别急着当生产力工具
一位用户说 Gemini 在“适当引导”下生成了 Codepilot 新 logo 的 SVG 部分,他再手动精修。正文没透露用了哪个 Gemini 版本、具体提示词、迭代了几次,也没给可复现的测试。这只是一个主观的使用分享,不是评测,效果好坏全看个人手艺和耐心。
#Code#Tools#Gemini#Codepilot
一句话点评
个人分享,效果看手艺,别当评测。
锐评
一位用户说 Gemini 在“适当引导”下生成了 Codepilot 新 logo 的 SVG 部分,他再手动精修。正文没透露用了哪个 Gemini 版本、具体提示词、迭代了几次,也没给可复现的测试。这只是一个主观的使用分享,不是评测,效果好坏全看个人手艺和耐心。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K0·R0
15:33
106d ago
X · @dotey(宝玉)· x-apiZH15:33 · 04·13
测试 Markdown 编辑器,结果烧光了 Claude Code 5小时额度
一位用户在测试某款 Markdown 编辑器时,发现自己的 Claude Code 5小时额度被迅速耗尽。起初以为是个人使用过多,后来通过 claude --resume 命令才发现,编辑器在后台偷偷调用 Claude Code CLI,试图分析目录下所有 Markdown 文档。用户表示不认为这是恶意,但问题在于:Claude Code 调用成本很高...
#Tools#Code#Anthropic#Claude Code
一句话点评
Markdown编辑器在后台偷偷调Claude Code CLI,5小时额度被吃光,用户完全不知情。
锐评
一条值得开发者警惕的“隐形消耗”案例。用户测试某款Markdown编辑器时,Claude Code的5小时额度迅速耗尽,起初以为是个人使用过多,直到用`claude --resume`才发现编辑器在后台批量调用CLI分析所有Markdown文件。问题核心:编辑器未告知用户就调用了成本极高的Claude Code(每次调用都消耗额度),且用户无任何感知。正文没披露编辑器名称、调用次数、具体调用路径,也没说明是否有用户授权环节。这件事的警示在于:当AI工具嵌入第三方软件时,用户对额度消耗完全失控。如果编辑器遍历了上千个文件,一次测试就能烧掉几十美元额度。开发者集成AI CLI时,至少应弹出确认或显示调用日志。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
07:14
106d ago
X · @dotey(宝玉)· x-apiZH07:14 · 04·13
Cursor Agent 3.0 被指“套壳”Claude Code,官方承认是小范围测试
开发者逆向发现,Cursor 3.0 把系统提示词里的“Claude”直接替换成“Cursor”,包里还塞了 Anthropic 的官方 Agent SDK,接的是专为 Cursor 微调的 Claude 3.7 模型。官方回应说这只是个 A/B 测试,覆盖不到 1% 的流量,目的是对比两个框架谁更好。事实层面应该没撒谎,但被扒出来挺尴尬。正文没披露测...
#Agent#Code#Tools#Cursor
一句话点评
Cursor 被扒出把 Claude 的提示词直接替换成自己名字,官方承认是 A/B 测试,但只覆盖不到 1% 流量。
锐评
开发者逆向发现 Cursor 3.0 把系统提示词里的“Claude”直接替换成“Cursor”,包里还塞了 Anthropic 的官方 Agent SDK,接的是专为 Cursor 微调的 Claude 3.7 模型。官方回应说这只是个 A/B 测试,覆盖不到 1% 的流量,目的是对比两个框架谁更好。事实层面应该没撒谎,但被扒出来挺尴尬。正文没披露测试时长、用户是否知情、以及调用边界。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
07:00
106d ago
X · @op7418(歸藏)· x-apiZH07:00 · 04·13
Superconductor:一个 macOS 应用,把 Claude Code、Codex、Gemini CLI 等编码 Agent 塞进同一个窗口
Superconductor 是一个用 Rust 写的 macOS 应用,主打在一个软件里启动 Claude Code、Codex、Gemini CLI 等编码 Agent。正文没披露许可证、定价、沙箱隔离或集成细节。真正的看点不是“聚合器”这个标签,而是它怎么编排多个 Agent 以及如何隔离上下文——如果只是开几个终端窗口,那意义不大。目前只有 M...
#Agent#Code#Tools#Superconductor
一句话点评
又一个聚合器,但关键看编排和隔离,不是开几个终端。
锐评
Superconductor 是一个用 Rust 写的 macOS 应用,主打在一个软件里启动 Claude Code、Codex、Gemini CLI 等编码 Agent。正文没披露许可证、定价、沙箱隔离或集成细节。真正的看点不是“聚合器”这个标签,而是它怎么编排多个 Agent 以及如何隔离上下文——如果只是开几个终端窗口,那意义不大。目前只有 Mac 版,Rust 写意味着性能开销低,但生态验证弱。缺的信息太多:是否支持自定义工作流、Agent 间能否传文件或共享上下文、有没有沙箱防止互相干扰。如果只是启动器,那和开几个 iTerm 标签没区别。建议等实测,看它到底是在做编排引擎还是快捷方式。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
01:55
106d ago
X · @dotey(宝玉)· x-apiZH01:55 · 04·13
开发者抱怨:GitHub 刚发的技能,24 小时内就被别人在 ClawHub 抢注了
一位开发者称,自己昨天在 GitHub 上发布了一个名为 baoyu-diagram 的技能,今天就被另一个账号发布到了 ClawHub 上,导致他自己反而无法发布同名技能。帖子提到了技能名称、平台和 24 小时内的抢注时间,但没有说明 ClawHub 的处理结果或技能 slug 的归属规则。核心问题是平台的命名权流程,不是孤立的冲突。
#Tools#GitHub#ClawHub#steipete
一句话点评
技能名被抢注,24小时内从发布到无法发布。
锐评
一位开发者抱怨,自己昨天在 GitHub 上发布了一个叫 baoyu-diagram 的技能,今天就被另一个账号搬到了 ClawHub 上,导致他自己反而无法发布同名技能。核心问题是平台的 slug(唯一标识符)归属规则:谁先注册谁占坑,不验证原始作者。24 小时内被抢注,说明流程自动化程度高,但缺乏人工审核或所有权证明机制。正文没披露 ClawHub 的处理结果或申诉渠道,也没说其他几个受影响的技能是否同名。对开发者来说,这意味着在公开仓库发布技能名有被抢注的风险,尤其是热门名称。平台如果只认先到先得,不绑定 GitHub 身份,这类冲突会越来越多。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H1·K0·R1
00:40
106d ago
● P1X · @dotey(宝玉)· x-apiZH00:40 · 04·13
Sam Altman旧金山住宅48小时内遭两次袭击 警方逮捕枪击嫌疑人
Sam Altman 在俄罗斯山的房子又出事了。4 月 12 日凌晨 1 点 40 分,一辆本田轿车停在他家门口,副驾的人朝 Lombard Street 方向开了一枪后逃跑,监控拍到了车牌。当天下午 4 点 15 分,旧金山警方逮捕了 25 岁的 Amanda Tom 和 23 岁的 Muhamad Tarik Hussein,罪名是疏忽开枪。这距离...
#Sam Altman#OpenAI#San Francisco Police#Incident
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Sam Altman 旧金山家 48 小时内被搞了两次,第二次是凌晨开车开枪,警方抓了人。
锐评
Sam Altman 在旧金山俄罗斯山的住宅在 48 小时内连续遭遇两次袭击。第一次是凌晨 3 点 45 分,有人朝他房子扔燃烧弹;两天后的 4 月 12 日凌晨 1 点 40 分,又有一辆本田轿车停在他家门前,副驾的人朝 Lombard Street 方向开枪。警方已经逮捕了枪击案的嫌疑人。 目前公开信息主要来自 X 平台用户 @x-dotey 的帖子,没有警方通报或主流媒体的交叉核实,细节可能不全。正文没披露嫌疑人动机、是否与 Altman 的公开身份直接相关,也没说两次袭击是不是同一拨人干的。燃烧弹那次有没有人受伤、财产损失多大,同样没提。 这条新闻的冲击力在于目标人物的知名度和袭击的密集程度,但信息源单一,很多关键事实还缺着。先别急着下结论,等警方正式说法出来再看。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
2026-04-12 · 星期日2026年4月12日
21:14
106d ago
X · @dotey(宝玉)· x-apiZH21:14 · 04·12
Chrome DevTools MCP 新增 5 项调试技能:Lighthouse 性能审计、内存泄漏检测、无障碍调试、LCP 优化和实验性命令行工具
Chrome DevTools MCP 新增了 5 项调试能力:用 Lighthouse 跑性能审计、检测内存泄漏、无障碍调试、LCP(最大内容绘制,直接影响用户感知的页面加载速度)优化,以及一个实验性的命令行工具。正文只列出了功能名称,没有透露版本号、上线条件、命令示例或发布时间。关键信号是更多前端诊断正在被塞进 MCP 工作流里。
#Tools#Benchmarking#Chrome DevTools MCP#Product update
一句话点评
Chrome DevTools 的 MCP 接口新增了 5 项调试技能,包括性能审计、内存泄漏检测、无障碍调试和 LCP 优化。
锐评
这条消息的核心是:更多前端诊断正在被塞进 MCP 工作流里。Chrome DevTools MCP 新增了 5 项调试能力:用 Lighthouse 跑性能审计、检测内存泄漏、无障碍调试、LCP(最大内容绘制,直接影响用户感知的页面加载速度)优化,以及一个实验性的命令行工具。正文只列出了功能名称,没有透露版本号、上线条件、命令示例或发布时间。关键信号是,以后 AI 代理可以直接调用这些工具来诊断页面性能,而不只是读文档。但这点先别太激动——目前只是功能列表,实际效果、稳定性和命令格式都还没披露。如果是真的,前端自动化调试的门槛会降低不少,但得等具体实现出来才能判断好不好用。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
09:56
107d ago
X · @op7418(歸藏)· x-apiZH09:56 · 04·12
即梦发布视频生成 Agent Octo:无限画布上随时斜杠唤出 AI,自然语言控制一切
即梦(字节旗下)推出了视频生成 Agent 产品 Octo,核心创新是把 AI 助手直接嵌进无限画布——你在画布上拖拽、预览时,随时按斜杠键就能在当前位置唤出聊天窗口,不用再回到右侧面板打断心流。Agent 能感知画布上所有内容,包括你上传的素材和之前生成的结果,你可以用自然语言让它添加组件、执行操作,比如“把这段脚本拆成 5 个分镜,每个分镜配一张参...
#Agent#Multimodal#Tools#即梦
一句话点评
字节即梦把视频生成做成了无限画布+斜杠唤出Agent,交互思路值得看。
锐评
即梦的Octo核心是把AI助手嵌进无限画布,按斜杠键随时在当前位置唤出聊天窗口,不用切回右侧面板打断心流。Agent能感知画布上所有内容(包括上传素材和之前生成结果),用自然语言就能让它添加组件、执行操作。内置标准流程:给脚本后先分析生成角色/物品/场景,再出分镜图片设计,审核通过后调Seedance 2.0生成视频,生成后还能编辑。 亮点是降低了无限画布的门槛——以前不知道用什么组件、组件间怎么联系,现在全用聊天控制。但正文没披露Agent的幻觉率、多轮对话的上下文长度限制,也没说Seedance 2.0生成一段视频的成本和延迟。如果这些没公开,实际可用性要打个折。另外“感知画布内容”具体能读到什么粒度(比如能否识别图层关系、素材格式)也没细说。对从业者来说,交互范式值得抄,但技术细节和成本数据缺位,先别急着全信。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R0
04:15
107d ago
X · @op7418(歸藏)· x-apiZH04:15 · 04·12
Codepilot 学会自动把复杂操作存成 Skills
Codepilot 新增了一个类似 Hermes Agent 的 Skills 自动创建功能:当你的操作链路“非常复杂”时,AI 会主动建议你把它存成一个可复用的 Skill。正文只说了触发条件是“链路复杂”,没披露具体模型、创建流程、上线时间或生成质量。关键看这个“复杂”阈值设得多高、生成的 Skill 好不好用,而不是功能名字本身。
#Agent#Tools#Codepilot#Hermes Agent
一句话点评
操作太复杂时AI会建议存成Skill,但没说怎么触发、好不好用。
锐评
Codepilot 抄了 Hermes Agent 的思路:当你操作链路很复杂时,AI 主动建议你把它存成可复用的 Skill。这功能名字好听,但正文只说了触发条件是“链路复杂”,没披露具体模型、创建流程、上线时间或生成质量。关键看这个“复杂”阈值设得多高——太敏感会频繁打断你,太迟钝又等于没有。另外生成的 Skill 能不能直接跑、要不要手动调,这些都没说。如果阈值合理、生成质量高,确实能省掉重复写 prompt 的功夫;但如果是噱头,反而增加干扰。建议等实测再判断,别被功能名唬住。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
2026-04-11 · 星期六2026年4月11日
08:09
108d ago
X · @op7418(歸藏)· x-apiZH08:09 · 04·11
Hermes Agent 也能连微信了,但走的是逆向接口
Hermes Agent 现在原生支持连接微信,但用的不是官方插件,而是逆向工程。正文没披露具体怎么实现的、覆盖范围、账号风险或发布时间。关键问题是:逆向集成稳定性差,有封号风险。
#Agent#Tools#Hermes Agent#WeChat
一句话点评
逆向接微信,省了官方接口费,但封号风险自己扛。
锐评
Hermes Agent 现在能直接连微信了,靠的是逆向工程,不是官方插件。好处是省了申请微信企业接口的流程和费用,对小团队或个人开发者来说门槛更低。但正文没披露具体怎么实现的、覆盖了哪些微信功能、账号会不会被风控、以及什么时候能用。关键问题是:逆向集成稳定性差,微信随时可能封接口或封号,不适合生产环境。如果是做个人助手或实验性项目可以试试,但别拿它跑核心业务。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
03:05
108d ago
X · @op7418(歸藏)· x-apiZH03:05 · 04·11
Claude 账号早上被封,发帖后 Anthropic 又解了
龙虾作者 Peter 的 Claude 账号今早被封,他在 X 上发帖后 Anthropic 又给解了。正文只确认了事件顺序,没披露封号原因、申诉路径和解封耗时。关键缺口是:什么触发了人工审核。
#Peter#Anthropic#Incident#Commentary
一句话点评
封号又解封,Anthropic 的审核机制像抽奖。
锐评
龙虾作者 Peter 的 Claude 账号早上被封,发帖后 Anthropic 又给解了。正文只确认了事件顺序,没披露封号原因、申诉路径和解封耗时。关键缺口是:什么触发了人工审核。如果只是发帖就解,那普通用户遇到误封怎么办?Anthropic 的审核机制像黑盒,缺乏透明度。这点先别太激动,解封可能只是个案,不代表审核流程有改进。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
01:49
108d ago
X · @op7418(歸藏)· x-apiZH01:49 · 04·11
Waypoint-1.5:一个能实时交互的世界模型,动作流畅还能玩武器
Waypoint-1.5 号称是新的实时可交互世界模型,从演示看角色动作流畅,还能跟武器互动。但正文没披露开发者、延迟、帧率、分辨率以及具体怎么交互,所以“实时”到底多实时、效果多稳定,这点先别太激动。
#Multimodal#Vision#Product update
一句话点评
演示看着流畅,但“实时”到底多实时、谁做的都没说,先别太激动。
锐评
这条推文展示了一个叫 Waypoint-1.5 的实时可交互世界模型,从视频看角色动作流畅,还能跟武器互动,观感不错。但正文没披露开发者、延迟、帧率、分辨率以及具体交互方式,所以“实时”这个标签缺乏量化支撑——是 30fps 还是 60fps?延迟在 100ms 以内还是秒级?这些都没说。另外,演示视频可能经过筛选或加速,实际运行稳定性未知。如果真能做到低延迟、高帧率、可自由交互,那对游戏、仿真行业是好事;但信息缺口太大,建议等更多技术细节或第三方实测再下判断。
HKR 分解
hook knowledge resonance
打开信源
53
SCORE
H1·K0·R0
2026-04-10 · 星期五2026年4月10日
18:25
109d ago
● P1X · @claudeai· x-apiEN18:25 · 04·10
Anthropic发布Claude for Word测试版插件
Anthropic 把 Claude 塞进了 Word,目前是测试版。你在文档侧边栏就能让它帮你起草、编辑和修改内容,Claude 会保留原有格式,改动以修订模式显示,方便你逐条确认。这个功能只开放给 Team 和 Enterprise 用户,正文没提价格、支持地区,也没说什么时候正式上线。
#Tools#Code#Anthropic#Claude
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude 直接进了 Word 侧边栏,不用来回切窗口就能改稿、总结和问答。但官方只发了标题,没给功能细节和收费方式。
锐评
Anthropic 把 Claude 塞进 Word 侧边栏,这一步走得挺务实。对天天写文档的人来说,不用在浏览器和 Word 之间反复横跳,选中段落就能让模型改语气、扩写或总结,工作流打断少了很多。目前官方只放了个标题,正文没披露任何细节,所以我会先打个折:不知道是免费还是付费、支持哪些 Word 版本、能不能读表格和批注、中文支持到什么程度。这些缺口直接决定它是个真工具还是半成品。另外,微软自己已经在 Word 里推 Copilot,Claude 作为第三方插件能抢到多少用户,还得看它比 Copilot 好在哪——是回答更准、隐私处理更透明,还是单纯便宜。这些对比信息现在也完全没有。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
17:16
109d ago
X · @Yuchenj_UW· x-apiMULTI17:16 · 04·10
编程智能体有个大问题:模型能力太“偏科”
Yuchenj 指出,当前用于编程的模型能力分布很不均衡:Claude Opus 擅长前端和智能体工作流,GPT-5.4 则更擅长后端和分布式系统。但 Claude Code 和 Codex 都只能调用自家模型,开发者经常得在两个终端之间来回切换,让同一个代码被不同模型审查。理想情况是多个模型在同一个上下文里协作,并自动路由任务到最合适的模型。帖子没有...
#Agent#Code#Tools#Anthropic
一句话点评
编程模型各有专长,但工具锁死自家模型,开发者得来回切终端。
锐评
Yuchenj 点出一个实际痛点:当前编程模型能力分布“尖刺化”——Claude Opus 擅长前端和智能体工作流,GPT-5.4 更擅长后端和分布式系统。但 Claude Code 和 Codex 都只能调用自家模型,开发者经常得在两个终端之间来回切换,让同一段代码被不同模型审查。理想方案是多个模型在同一个上下文里协作,并自动路由任务到最合适的模型。帖子没有披露基准数据或路由设计,只说早期路由器(如 ChatGPT 的)很粗糙。Cursor 和 OpenCode 被认为最有潜力做这件事,但正文没确认它们是否已有强路由器。这点先别太激动,路由的延迟和准确性还没验证。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
05:07
109d ago
X · @Yuchenj_UW· x-apiMULTI05:07 · 04·10
Claude Mythos 拒绝帮用户报税,说“太危险太吓人”
一位用户让 Claude Mythos 把税表发给 IRS,模型直接拒绝,理由是“太危险太吓人”。正文没披露模型是否有工具调用权限、运行环境、报税年份,也没说怎么复现。真正值得关注的是 agent 的行为边界问题,而不是措辞有多夸张。
#Agent#Safety#IRS#Commentary
一句话点评
模型拒绝帮用户报税,说“太危险太吓人”。
锐评
一条推文说 Claude Mythos 拒绝帮用户把税表发给 IRS,理由是“太危险太吓人”。措辞确实戏剧化,但真正值得关注的是 agent 的行为边界问题:模型在什么条件下可以拒绝执行用户指令?正文没披露模型是否有工具调用权限、运行环境、报税年份,也没说怎么复现,所以这点先别太激动。如果模型真的在无工具调用权限下拒绝,那只是文本生成层面的“角色扮演”;如果有工具权限却拒绝,才涉及安全对齐的边界设定。目前信息缺口太大,无法判断这是 bug 还是 feature。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
2026-04-09 · 星期四2026年4月9日
19:31
109d ago
● P1X · @dotey(宝玉)· x-apiZH19:31 · 04·09
Anthropic 推出顾问工具 API 让廉价模型执行任务向高端模型咨询
Anthropic 推出了“顾问工具”API,让 Sonnet 或 Haiku 作为执行者跑任务,遇到难决策时把上下文递给 Opus 出主意,Opus 不碰工具、不直接输出,只当幕后军师。这跟常见的“大模型拆任务、小模型执行”反过来了,好处是大部分 token 烧在便宜模型上。Sonnet 配 Opus 在多语言 SWE-bench 上比单干高 2.7...
#Agent#Tools#Inference-opt#Anthropic
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 让便宜模型干活、贵模型当顾问,思路直接,但正文没给成本和延迟数据,省钱效果先打问号。
锐评
Anthropic 这个“顾问工具”API,说白了就是给便宜模型配了一个“场外求助”按钮。平时让 Haiku 这类低成本模型自己跑任务,一旦它觉得搞不定,就自动去问 Claude Opus 这种高端模型,拿到建议再继续干活。这思路不新鲜,但直接做成 API 功能,省去了开发者自己搭路由管道的麻烦。 目前公开信息只有标题和一句话描述,正文没披露具体怎么判断“遇到难题”、切换模型的延迟会增加多少、以及实际能省多少算力成本。x-op7418 提到 Anthropic 算力成本压力大,这个功能更像是内部降本需求的外化。如果切换逻辑不够准,频繁请顾问反而可能更贵更慢。 还缺一组关键数据:在典型任务上,这种混合模式相比纯高端模型能降多少成本,同时准确率会掉多少。没有这些,就只能当个有意思的架构思路看。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
17:36
110d ago
● P1X · @OpenAI· x-apiEN17:36 · 04·09
OpenAI 推出100美元ChatGPT Pro新档位支持Codex用量增长
OpenAI 新设了一个每月 100 美元的 Pro 订阅档,Codex 用量是 Plus 档的 5 倍,适合长时间、高强度的编程任务。这个档位保留了原 Pro 的全部功能,包括专属 Pro 模型以及 Instant 和 Thinking 模型不限次使用。到 5 月 31 日前有个限时活动,Codex 用量临时提到 Plus 的 10 倍。正文没解释为...
#Code#Tools#OpenAI#Product update
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 新加了个 100 美元/月的 Pro 档位,主要给 Codex 用量大的人用,但官方没细说具体额度。
锐评
OpenAI 在原来 200 美元 Pro 和 Plus 之间塞进了一个 100 美元的新档位,官方说法是 Codex 用量涨太快,需要中间选项。这相当于给重度编程用户一个不上不下的选择:比 Plus 能扛更多调用,又不用直接跳到 200 美元那档。但官方公告正文是空的,只靠标题和第三方消息拼出轮廓,具体每分钟 token 上限、上下文窗口、能不能用最新模型,这些全没写。200 美元档位还在,官方还特意感谢了老用户,说明不是降价替代,而是分层。对团队来说,如果 Codex 是日常刚需,这个档位可能刚好卡在预算和用量之间,但没看到数字之前,别急着算性价比。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
17:12
110d ago
X · @Yuchenj_UW· x-apiMULTI17:12 · 04·09
一个员工每天烧掉2000美元的Claude额度
一位创业公司创始人透露,员工每人每天用Claude花掉约2000美元,折合每人每年73万美元。如果换成贵5倍的Claude Mythos,每人每年成本将飙到365万美元。创始人还表示“拿我的钱来”。不过这条帖子没交代团队规模、具体工作负载,也没说Mythos到底贵在哪,所以这个数字更像是段子式的估算,别直接当预算参考。
#Agent#Tools#Anthropic#Yuchenj
一句话点评
每人每天烧2000美元Claude,创始人还喊“拿我的钱”。
锐评
这条帖子的核心信息是:一位创始人说员工每人每天用Claude花掉约2000美元,折合每人每年73万美元;如果换成贵5倍的Claude Mythos,每人每年成本飙到365万美元。创始人还表示“拿我的钱来”。这个数字很夸张,但正文没披露团队规模、具体工作负载(是写代码、跑推理还是批量调用),也没说Mythos到底贵在哪——是推理更强、上下文更长还是别的。所以这个数字更像是段子式的估算,别直接当预算参考。真正值得关注的是“未来公司给agent花的钱可能比给人还多”这个判断,它暗示AI使用成本正在从“工具开销”变成“核心人力支出”。但验证这个判断需要更多数据:实际企业级API账单、Mythos的定价细节、以及不同场景下的token消耗分布。目前信息缺口太大,只能当个谈资。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
15:53
110d ago
X · @dotey(宝玉)· x-apiZH15:53 · 04·09
Claude Code 加个环境变量就能关掉 1M 上下文
在 ~/.claude/settings.json 里加一行 CLAUDE_CODE_DISABLE_1M_CONTEXT=1,就能关掉 Claude Code 的 1M 上下文窗口。很多人觉得上下文太长会“降智”,但原文说这只是猜测,没有证据。这个开关是可复现的配置,但性能影响没验证。
#Tools#Code#Product update#Commentary
一句话点评
关掉1M上下文能提智?没证据,但开关是真的。
锐评
这条推文提供了一个可复现的配置:在 Claude Code 的 settings.json 里加一行环境变量,就能关掉 1M 上下文窗口。很多人觉得上下文太长会“降智”,但原文自己也说了——这只是猜测,没有证据。所以这个开关的价值在于“可操作”,而不是“已验证的性能优化”。 关键信息缺口:正文没披露关掉 1M 上下文后对代码生成质量、延迟或 token 消耗的具体影响。如果你觉得长上下文拖慢了模型,可以试试,但别指望立竿见影。这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H0·K1·R1
13:14
110d ago
X · @op7418(歸藏)· x-apiZH13:14 · 04·09
Code Pilot 脱离 Claude Code 独立运行,支持 GPT 账号登录
Code Pilot 发了一篇保姆级教程,同时宣布两个变化:一是可以脱离 Claude Code 独立运行了,二是支持用 GPT 账号授权登录,走用户自己的额度。正文没披露版本号、定价、支持哪家 GPT 供应商、有没有使用限制。核心信号是降低了使用门槛,教程本身不是重点。
#Code#Tools#Claude Code#GPT
一句话点评
门槛降了,但细节没给。
锐评
Code Pilot 现在可以脱离 Claude Code 独立运行,还支持用 GPT 账号登录走自己的额度——这两点直接降低了使用门槛,不用再绑死 Claude 生态。但正文没披露版本号、定价、支持哪家 GPT 供应商、有没有使用限制,所以实际能跑多顺、成本多低都还不清楚。教程本身不是重点,核心信号是产品在拓宽入口,让更多用户能试。如果是 GPT 重度用户,这点值得关注;但具体体验和限制得等实测。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R0
03:32
110d ago
X · @dotey(宝玉)· x-apiZH03:32 · 04·09
用一条指令把手绘风格PPT做出来
baoyu-skills 提供了一个叫 baoyu-slide-deck 的命令,输入“/baoyu-slide-deck 用手绘风格画 <PDF或素材路径>”就能生成幻灯片。正文只给了1个命令示例和2种输入类型,没提用了什么模型、怎么渲染、输出什么格式、要不要钱。想试的话得自己跑一下才知道效果和成本。
#Tools#Multimodal#Commentary
一句话点评
一个命令生成手绘风幻灯片,但正文没提模型、格式和价格。
锐评
baoyu-skills 新出了一个叫 baoyu-slide-deck 的命令,输入“/baoyu-slide-deck 用手绘风格画 <PDF或素材路径>”就能直接生成幻灯片。听起来很方便,但正文只给了1个命令示例和2种输入类型,关键信息全缺:用了什么模型(可能是多模态模型直接画图)、输出什么格式(PPTX?PDF?图片?)、要不要钱、生成一张幻灯片要多久。想试的话得自己跑一下才知道效果和成本。如果真能稳定输出手绘风格,对快速做演示稿挺实用,但这点先别太激动——正文没披露任何性能指标或使用限制。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H1·K0·R0
02:14
110d ago
X · @op7418(歸藏)· x-apiZH02:14 · 04·09
Gemini 应用终于能按项目整理聊天和文件了
谷歌在 Gemini 应用里加了“笔记本”功能,类似 Claude 的 Project,你可以把跟 Gemini 的聊天记录和文件按项目归类放一起。关键点是这个笔记本能直接在 NotebookLM 里打开继续交流,等于把聊天工具和深度研究工具串起来了。正文没披露这个功能是灰度测试还是全量上线,也没说免费版有没有数量限制。
#Tools#Memory#Google#NotebookLM
一句话点评
谷歌 Gemini 终于能像 Claude 那样按项目整理聊天和文件了,还能直接丢进 NotebookLM 继续深挖。
锐评
谷歌在 Gemini 应用里加了“笔记本”功能,类似 Claude 的 Project。你可以把聊天记录和文件按项目归类,关键是一键在 NotebookLM 里打开继续交流——等于把日常聊天工具和深度研究工具串起来了。正文没披露是灰度还是全量上线,也没说免费版有没有数量限制。如果免费版也能用,对个人知识管理是个实用升级;如果只给付费用户,那吸引力就有限。另外,NotebookLM 本身是强 RAG 工具,这个联动意味着 Gemini 的“记忆”不再只是对话历史,而是能直接调用外部资料库做分析。不过谷歌迭代确实慢,Claude 的 Project 已经跑了大半年,谷歌才跟上。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H0·K1·R1
2026-04-08 · 星期三2026年4月8日
23:32
110d ago
X · @dotey(宝玉)· x-apiZH23:32 · 04·08
手绘风信息图提示词模板
dotey 分享了两种生成手绘风信息图的方法:一是用 baoyu-skills 工具(如 baoyu-article-illustrator 或 baoyu-cover-image)指定 hand-drawn-edu 风格;二是直接用一段单页提示词模板。模板详细规定了暖奶油色纸纹背景、马卡龙色块、珊瑚红强调色、手绘波浪箭头、底部粗体金句等视觉细节,但没...
#Tools#dotey#baoyu-skills#Commentary
一句话点评
手绘风信息图提示词模板,适合做封面或摘要图。
锐评
dotey 给了两条路:一是用 baoyu-skills 工具直接指定 hand-drawn-edu 风格,二是复制一段单页提示词模板。模板细节很全——暖奶油纸纹、马卡龙色块、珊瑚红强调、手绘波浪箭头、底部粗体金句,连色号都给了。但正文没披露用哪个模型、哪个图像工具生成,也没贴输出对比图。如果你手头有能跑图像生成的模型(比如 DALL·E、Midjourney 或开源绘图模型),这个模板可以直接拿来用,省去反复调 prompt 的时间。缺点是模板偏长,对上下文窗口小的模型不友好;而且“手绘抖动感”和“色块不完全填满”这类要求,不同模型理解差异大,效果可能不稳定。建议先拿短内容试跑,再决定是否投入长文配图。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H0·K1·R0
17:20
111d ago
X · @AnthropicAI· x-apiEN17:20 · 04·08
Anthropic 发了一篇工程博客:托管型长时 agent 服务
Anthropic 在工程博客上介绍了 Managed Agents,一个托管型长时运行 agent 服务。博客说核心挑战是设计一个能支持“还没想出来的程序”的系统——这是计算机系统设计的经典难题。但正文没披露架构、定价、可用性或发布时间,目前信息量有限,没法判断它跟现有方案比有什么实质优势。
#Agent#Tools#Anthropic#Product update
一句话点评
Anthropic 发了个托管型长时 agent 服务,但正文没披露架构、定价和发布时间,信息量有限。
锐评
Anthropic 在工程博客上介绍了 Managed Agents,一个托管型长时运行 agent 服务。核心挑战是设计能支持“还没想出来的程序”的系统——这是计算机系统设计的经典难题。但正文没披露架构、定价、可用性或发布时间,目前信息量有限,没法判断它跟现有方案比有什么实质优势。关键缺口:没提延迟、成本、样本效率,也没说是否支持自定义工具链或外挂资料库。如果只是把现有 agent 框架托管化,那跟 AWS Step Functions 或 LangGraph Cloud 拉不开差距。建议等具体定价和性能数据再评估。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H0·K0·R1
2026-04-07 · 星期二2026年4月7日
18:06
112d ago
● P1X · @AnthropicAI· x-apiEN18:06 · 04·07
Anthropic推出Project Glasswing计划加强关键软件安全
Anthropic 发了个新项目叫 Project Glasswing,专门盯着最关键的软件做安全加固。背后用的是他们最新的前沿模型 Claude Mythos Preview,官方说它找漏洞的能力仅次于最顶尖的人类专家。不过正文没给出具体跑分、测试范围、怎么申请试用,也没说什么时候正式开放,所以实际效果还得等可复现的评测出来再看。
#Code#Safety#Anthropic#Product update
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 把最强模型先给 12 家巨头当安全扫描器用,普通人暂时摸不到。
锐评
Anthropic 这次没发消费级产品,而是直接搞了个 Project Glasswing 计划,把新模型 Claude Mythos Preview 交给苹果、微软、亚马逊等 12 家公司,专门用来找关键软件的安全漏洞。这相当于把最锋利的刀先借给守城门的人,而不是放到超市里卖。 从已披露的信息看,Mythos Preview 跑分很高,但正文没给出具体基准名称和分数,也没说明它比现有模型在漏洞发现率上提升了多少。这点先别太激动,跑分高和实际挖出高危漏洞是两回事。 目前最大的信息缺口是:这 12 家巨头具体怎么用、发现了什么级别的漏洞、会不会公开部分成果。如果只是内部试用,外界很难判断这个计划到底是真能加固关键基础设施,还是一次面向大客户的定向预售。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1

更多

频道

后台