ax@ax-radar:~/x/dotey $ tail -f x-timeline-dotey.log
40 srcsignal 72%cycle 04:32

X 监控

26 推文 · updated 3m ago
7 个账号
@dotey26
2026-04-12 · 星期日2026年4月12日
2026-04-11 · 星期六2026年4月11日
2026-04-10 · 星期五2026年4月10日
2026-04-09 · 星期四2026年4月9日
19:31
109d ago
● P1X · @dotey(宝玉)· x-apiZH19:31 · 04·09
Anthropic 推出顾问工具 API 让廉价模型执行任务向高端模型咨询
Anthropic 推出了“顾问工具”API,让 Sonnet 或 Haiku 作为执行者跑任务,遇到难决策时把上下文递给 Opus 出主意,Opus 不碰工具、不直接输出,只当幕后军师。这跟常见的“大模型拆任务、小模型执行”反过来了,好处是大部分 token 烧在便宜模型上。Sonnet 配 Opus 在多语言 SWE-bench 上比单干高 2.7...
#Agent#Tools#Inference-opt#Anthropic
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 让便宜模型干活、贵模型当顾问,思路直接,但正文没给成本和延迟数据,省钱效果先打问号。
锐评
Anthropic 这个“顾问工具”API,说白了就是给便宜模型配了一个“场外求助”按钮。平时让 Haiku 这类低成本模型自己跑任务,一旦它觉得搞不定,就自动去问 Claude Opus 这种高端模型,拿到建议再继续干活。这思路不新鲜,但直接做成 API 功能,省去了开发者自己搭路由管道的麻烦。 目前公开信息只有标题和一句话描述,正文没披露具体怎么判断“遇到难题”、切换模型的延迟会增加多少、以及实际能省多少算力成本。x-op7418 提到 Anthropic 算力成本压力大,这个功能更像是内部降本需求的外化。如果切换逻辑不够准,频繁请顾问反而可能更贵更慢。 还缺一组关键数据:在典型任务上,这种混合模式相比纯高端模型能降多少成本,同时准确率会掉多少。没有这些,就只能当个有意思的架构思路看。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
15:53
110d ago
X · @dotey(宝玉)· x-apiZH15:53 · 04·09
Claude Code 加个环境变量就能关掉 1M 上下文
在 ~/.claude/settings.json 里加一行 CLAUDE_CODE_DISABLE_1M_CONTEXT=1,就能关掉 Claude Code 的 1M 上下文窗口。很多人觉得上下文太长会“降智”,但原文说这只是猜测,没有证据。这个开关是可复现的配置,但性能影响没验证。
#Tools#Code#Product update#Commentary
一句话点评
关掉1M上下文能提智?没证据,但开关是真的。
锐评
这条推文提供了一个可复现的配置:在 Claude Code 的 settings.json 里加一行环境变量,就能关掉 1M 上下文窗口。很多人觉得上下文太长会“降智”,但原文自己也说了——这只是猜测,没有证据。所以这个开关的价值在于“可操作”,而不是“已验证的性能优化”。 关键信息缺口:正文没披露关掉 1M 上下文后对代码生成质量、延迟或 token 消耗的具体影响。如果你觉得长上下文拖慢了模型,可以试试,但别指望立竿见影。这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H0·K1·R1
03:32
110d ago
X · @dotey(宝玉)· x-apiZH03:32 · 04·09
用一条指令把手绘风格PPT做出来
baoyu-skills 提供了一个叫 baoyu-slide-deck 的命令,输入“/baoyu-slide-deck 用手绘风格画 <PDF或素材路径>”就能生成幻灯片。正文只给了1个命令示例和2种输入类型,没提用了什么模型、怎么渲染、输出什么格式、要不要钱。想试的话得自己跑一下才知道效果和成本。
#Tools#Multimodal#Commentary
一句话点评
一个命令生成手绘风幻灯片,但正文没提模型、格式和价格。
锐评
baoyu-skills 新出了一个叫 baoyu-slide-deck 的命令,输入“/baoyu-slide-deck 用手绘风格画 <PDF或素材路径>”就能直接生成幻灯片。听起来很方便,但正文只给了1个命令示例和2种输入类型,关键信息全缺:用了什么模型(可能是多模态模型直接画图)、输出什么格式(PPTX?PDF?图片?)、要不要钱、生成一张幻灯片要多久。想试的话得自己跑一下才知道效果和成本。如果真能稳定输出手绘风格,对快速做演示稿挺实用,但这点先别太激动——正文没披露任何性能指标或使用限制。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H1·K0·R0
2026-04-08 · 星期三2026年4月8日
23:32
110d ago
X · @dotey(宝玉)· x-apiZH23:32 · 04·08
手绘风信息图提示词模板
dotey 分享了两种生成手绘风信息图的方法:一是用 baoyu-skills 工具(如 baoyu-article-illustrator 或 baoyu-cover-image)指定 hand-drawn-edu 风格;二是直接用一段单页提示词模板。模板详细规定了暖奶油色纸纹背景、马卡龙色块、珊瑚红强调色、手绘波浪箭头、底部粗体金句等视觉细节,但没...
#Tools#dotey#baoyu-skills#Commentary
一句话点评
手绘风信息图提示词模板,适合做封面或摘要图。
锐评
dotey 给了两条路:一是用 baoyu-skills 工具直接指定 hand-drawn-edu 风格,二是复制一段单页提示词模板。模板细节很全——暖奶油纸纹、马卡龙色块、珊瑚红强调、手绘波浪箭头、底部粗体金句,连色号都给了。但正文没披露用哪个模型、哪个图像工具生成,也没贴输出对比图。如果你手头有能跑图像生成的模型(比如 DALL·E、Midjourney 或开源绘图模型),这个模板可以直接拿来用,省去反复调 prompt 的时间。缺点是模板偏长,对上下文窗口小的模型不友好;而且“手绘抖动感”和“色块不完全填满”这类要求,不同模型理解差异大,效果可能不稳定。建议先拿短内容试跑,再决定是否投入长文配图。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H0·K1·R0
2026-04-07 · 星期二2026年4月7日
13:31
112d ago
X · @dotey(宝玉)· x-apiZH13:31 · 04·07
Karpathy 的 LLM Wiki:让 AI 替你整理收藏夹,比 Auto Research 更有意思
作者说 Karpathy 的 LLM Wiki 比 Auto Research 更有创意,核心思路是让 AI Agent 把散落在各处的收藏(X 点赞、浏览器书签、微信收藏等)自动整理成结构化的个人 Wiki,而不是让人手动打标签、建分类。作者自己也在做类似工具,但 Karpathy 这一步之前没见过。关键转变是信息整理从人主动变成 AI 主动,你只需...
#Agent#Tools#Memory#Andrej Karpathy
一句话点评
Karpathy 的 LLM Wiki 思路是把散落的收藏自动整理成个人 Wiki,比手动打标签省事。
锐评
这篇帖子的核心判断是:Karpathy 的 LLM Wiki 比 Auto Research 更有创意,因为前者让 AI 主动把 X 点赞、浏览器书签、微信收藏等碎片信息自动整理成结构化 Wiki,而后者只是已有理论的工程实现。作者自己也在做类似工具,但承认 Karpathy 这一步之前没见过。关键转变是信息整理从人主动变成 AI 主动,你只需每天看自己的 Wiki 就行。 但正文没披露任何模型细节、实现方式、定价或发布时间,只停留在个人工作流和产品 idea 层面。所以这个判断目前是概念验证,不是可用的产品。如果真能低成本(比如每月 10 美元以内)且低延迟(整理几百条收藏不超过 5 分钟)地跑通,对信息过载的从业者确实有用。但跨平台数据抓取的合规性、隐私风险、以及 Wiki 的长期维护成本(比如模型幻觉导致分类错误)都是未知数。这点先别太激动,等原型或论文出来再评估。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K0·R0
2026-04-05 · 星期日2026年4月5日
17:52
114d ago
X · @dotey(宝玉)· x-apiZH17:52 · 04·05
Claude Island:把 Claude Code 的审批弹窗搬到 Mac 刘海区
开发者 farouqaldori 开源了一个 macOS 原生应用 Claude Island,用 Swift 写的,能把 Claude Code 每次执行文件操作或运行命令时的批准/拒绝提示,从终端窗口挪到 MacBook 的刘海区域。原理是在 ~/.claude/hooks/ 下装钩子脚本,通过 Unix socket 监听会话事件,首次启动自动配...
#Tools#Code#Claude Code#farouqaldori
一句话点评
把 Claude Code 的审批弹窗挪到 Mac 刘海区域,省得切回终端点批准。
锐评
一个很实在的体验优化:Claude Code 每次执行文件操作或跑命令都要你切回终端点批准,Claude Island 把这个流程挪到了 MacBook 的刘海区,点一下就行。原理是在 ~/.claude/hooks/ 下装钩子脚本,通过 Unix socket 监听会话事件,首次启动自动配置,不用手动折腾。目前已发 3 个版本,要求 macOS 15.6+,Apache 2.0 开源。值得注意的点:它集成了 Mixpanel 做匿名统计,采集应用版本和会话启动事件,虽然声明不收集对话内容,但介意隐私的得留个心。正文没披露延迟数据——从终端弹窗到刘海区响应,实际体感快不快?另外只支持 Claude Code,对其他终端工具(比如直接调 API 的脚本)不适用。整体是个轻量效率补丁,适合多项目同时开、不想来回切终端的 Mac 用户。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
16:35
114d ago
X · @dotey(宝玉)· x-apiZH16:35 · 04·05
实测:system prompt 里不能出现 OpenClaw 这个词,其他 flag 正常
dotey 测试发现,--append-system-prompt 和 -p 这两个参数都能用,但 system prompt 里只要包含 OpenClaw 这个关键词就会失败。正文只说了这一个结果,没交代是什么工具、什么版本、报错信息是什么、测试环境怎么搭的。目前看问题出在关键词级别的拦截,不是参数本身不能用。
#Tools#OpenClaw#dotey#Commentary
一句话点评
关键词拦截,参数本身能用。
锐评
dotey 实测发现,--append-system-prompt 和 -p 这两个参数都能正常使用,但只要 system prompt 里出现“OpenClaw”这个关键词就会失败。问题出在关键词级别的拦截,不是参数本身不能用。正文只披露了这一条结果,没交代是什么工具、什么版本、报错信息是什么、测试环境怎么搭的。目前看,这个拦截可能只针对特定关键词,但信息缺口太大,没法判断是临时限制还是长期策略。如果只是关键词过滤,绕过方法可能很简单,但这点先别太激动,等更多测试结果出来再说。
HKR 分解
hook knowledge resonance
打开信源
44
SCORE
H1·K0·R0
2026-04-04 · 星期六2026年4月4日
02:51
115d ago
X · @dotey(宝玉)· x-apiZH02:51 · 04·04
一个提示词技巧:让 Gemini 帮你绕开水印限制
直接让 Gemini 去水印会被拒绝,但换个思路就行:先让它把背景和文字去掉,换成纯色背景,再恢复原图衣服。本质是分两步绕开限制,不是直接“去水印”。正文没披露模型版本、成功率或失败案例,所以效果因人而异,可以试试但别太当真。
#Vision#Tools#Gemini#Commentary
一句话点评
分两步骗过模型去水印,但成功率看运气。
锐评
这个技巧本质是提示词绕行:先让模型把水印当“背景文字”去掉并换纯色底,再恢复原图衣服,从而绕过直接“去水印”的拒绝机制。正文没披露模型版本、成功率或失败案例,所以效果因人而异。Gemini 不同版本对图像编辑的容忍度差别很大,nano banana 更是闭源黑盒,很可能只对特定水印(半透明、边缘清晰)有效。如果水印压在人脸或复杂纹理上,两步法大概率翻车。可以试试,但别太当真。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
01:26
115d ago
● P1X · @dotey(宝玉)· x-apiZH01:26 · 04·04
Anthropic 停止 Claude 订阅对第三方工具的支持
Claude Code 负责人 Boris Cherny 发公告,太平洋时间 4 月 4 日中午起,Claude Pro 和 Max 订阅的额度不再覆盖通过 OpenClaw 这类第三方工具产生的用量。想继续在这些工具里用 Claude,要么买打折的用量包,要么用 API Key 按量付费。现有订阅用户会拿到一笔等于月费的一次性补偿,觉得不够的明天邮件...
#Tools#Code#Anthropic#OpenClaw
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 一刀切断了第三方工具通过 Claude 订阅接口访问的路径,OpenClaw 等工具直接停摆。
锐评
Anthropic 不再允许第三方应用通过用户自己的 Claude 订阅来调用模型,首当其冲的是 OpenClaw 这类把 Claude 能力嵌入其他工作流的工具。用户社区反应激烈,时间线上骂声一片。这件事的核心矛盾在于:用户付了订阅费,但 Anthropic 现在要管你用什么客户端访问。官方目前没有给出技术上的替代方案,也没说明是出于安全、滥用还是商业策略的考量。正文没披露受影响的具体用户规模,也没提 API 替代路径的定价差异。对依赖这类集成的开发者来说,要么转向官方 API 按 token 付费,要么另找模型。我会先打个折——如果后续 Anthropic 推出自己的官方集成方案,这次封堵就更像清场而非安全动作。还缺官方对封禁理由的正式说明,以及受影响工具的开发者的迁移成本估算。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
2026-04-03 · 星期五2026年4月3日
2026-04-02 · 星期四2026年4月2日
17:51
117d ago
X · @dotey(宝玉)· x-apiZH17:51 · 04·02
团队 Skills 管理:用 Symlink 链接到源码仓库,别复制文件
这篇分享了 5 条团队维护 Skills 的实操经验。核心做法是用 Git 做版本控制,然后用 Symlink 把 .agents/skills 目录直接链接到原始仓库,而不是复制文件。好处有两个:一是 Git 历史干净,二是 Agent 在会话里发现问题可以直接改源码,改完走 Review 提 PR,流程很顺。坑是 Windows 下 Symlink...
#Agent#Tools#Memory#Commentary
一句话点评
用 symlink 管理 Skills,改完直接提 PR,流程很顺。
锐评
这篇分享的是团队维护 Skills 的实操经验,核心是用 Git 做版本控制,再用 Symlink 把 .agents/skills 目录直接链接到原始仓库,而不是复制文件。好处有两个:一是 Git 历史干净,二是 Agent 在会话里发现问题可以直接改源码,改完走 Review 提 PR,流程很顺。坑是 Windows 下 Symlink 支持弱,Markdown 验证还得靠测试集加人工。最后提醒:大部分 Skills 应放项目目录下,别放全局,否则 meta 信息累积会占上下文空间。正文没披露团队规模或 Skills 数量,小团队试错成本低,大团队复制这套可能遇到权限和冲突问题。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H0·K1·R1
17:06
117d ago
● P1X · @dotey(宝玉)· x-apiZH17:06 · 04·02
Google 发布 Gemma 4 开源模型系列,采用 Apache 2.0 许可证
Google 把 Gemma 4 全系列换成了 Apache 2.0 协议,商用、修改、分发不再受限,之前自家协议里的灰色地带这次清掉了。系列包含四个尺寸:31B Dense、26B MoE(混合专家架构)、E4B 和 E2B。31B 在 Arena AI 开源模型文本榜排第三,26B 排第六,Google 说它们表现超过体量大 20 倍的模型。大模型...
#Agent#Multimodal#Code#Google
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
Google 把 Gemini 3 的研究成果下放,推出了开源模型 Gemma 4,用 Apache 2.0 许可,商用友好。
锐评
Gemma 4 直接脱胎于 Gemini 3 的研究,这意味着它可能继承了旗舰模型的核心能力,但以更小的体积和开源许可放出来。Apache 2.0 许可证对开发者很友好,商用几乎没限制。目前正文没披露具体的参数规模、基准测试分数或推理成本,这些是判断它实际竞争力的关键。如果它能用远低于 Gemini 3 的运行成本,提供接近的性能,那对中小团队会很有吸引力。但没看到技术报告前,先别急着下结论,开源模型的真实水平得等社区跑完评测才知道。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
15:42
117d ago
X · @dotey(宝玉)· x-apiZH15:42 · 04·02
一个 pretext 衍生项目:不用浏览器,直接把 Markdown 渲染成多页 PNG 和 SVG
这个项目是 pretext 的衍生版,能把 Markdown 文件直接转成多页 PNG 和 SVG 图片,不需要打开浏览器。作者自己测了,目前有四个硬伤:样式支持有限、不能内嵌图片、强制分页、表格排版会乱。正文没披露项目名、仓库地址和生产环境指标。复杂 Markdown 还远达不到生产可用,但拿来尝鲜学习可以。
#Tools#pretext#Open source#Commentary
一句话点评
一个 pretext 衍生项目,能把 Markdown 直接转成多页 PNG/SVG,不用开浏览器。但作者自曝四个硬伤:样式有限、不能嵌图、强制分页、表格会乱。尝鲜可以,生产别急。
锐评
这个项目是 pretext 的衍生版,核心卖点是“不用浏览器”就把 Markdown 渲染成多页 PNG 和 SVG。听起来省事,但作者自己测了四个硬伤:样式支持有限、不能内嵌图片、强制分页、表格排版会乱。正文没披露项目名、仓库地址,也没给任何生产环境指标(比如渲染速度、内存占用、长文档稳定性)。对于复杂 Markdown,目前远达不到生产可用,拿来学习 pretext 的渲染思路还行。如果你真想用工具把 Markdown 转图片,建议先观望,等作者修完这些硬伤再考虑。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
2026-04-01 · 星期三2026年4月1日
21:00
117d ago
X · @dotey(宝玉)· x-apiZH21:00 · 04·01
Claude Code 新渲染模式:不闪屏、支持鼠标点击,但牺牲了原生搜索
Claude Code 在 v2.1.88+ 版本里加了一个 NO_FLICKER 渲染模式,设环境变量 CLAUDE_CODE_NO_FLICKER=1 就能开。核心思路是像 vim 那样接管整个终端屏幕,只画当前可见内容,不滚动历史。好处是对话长了也不闪屏、不跳屏,内存和 CPU 占用不会跟着对话长度涨。代价也很实在:原生 Cmd+F 搜索失效了,...
#Tools#Anthropic#Claude Code#Boris
一句话点评
终端不闪了,但搜索和复制得重新学。
锐评
Claude Code 新加的 NO_FLICKER 模式,本质是让终端像 vim 一样只画当前屏幕,不滚动历史。好处很实在:长对话不闪屏、不跳屏,内存和 CPU 占用不再跟着对话长度涨。代价也直接:原生 Cmd+F 搜索和滚动条失效,得用 Ctrl+O 再 / 来搜;复制粘贴被接管,选中即复制。鼠标支持算彩蛋,能点输入框、展开工具输出、拖拽选文本自动复制。Boris 说内部测试多数人已默认开。目前是研究预览,需 v2.1.88+。正文没披露正式版时间表,也没说对 tmux 和 VS Code 内置终端的兼容性改进细节。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R0
06:36
118d ago
X · @dotey(宝玉)· x-apiZH06:36 · 04·01
Claude Code 承认代码泄漏是手动部署环节的锅,没甩给个人
Anthropic 的 Boris 发帖说,Claude Code 泄漏是因为一个本该自动化的部署步骤还是人工操作。团队已经上了几个自动化修复,更多改进在推进。正文没披露泄漏发生的时间、波及范围,也没说具体修了哪些漏洞。关键信息是:问题出在流程和基础设施,不是某个人背锅。
#Code#Tools#Anthropic#Claude Code
一句话点评
Anthropic 承认 Claude Code 泄漏是部署环节本该自动化却仍手动操作所致,已上几个自动化修复。没甩锅、没开除人,这点值得点赞。
锐评
Anthropic 的 Boris 正面回应了 Claude Code 代码泄漏事件,核心判断是:问题出在流程和基础设施,不是某个人背锅。具体来说,一个本该自动化的部署步骤还是人工操作,导致了泄漏。团队已经上了几个自动化修复,更多改进在推进。 关键信息:泄漏原因明确——手动部署环节;修复动作已部分落地;态度上没甩锅、没开除人,这点在当下 AI 公司里算难得。但正文没披露泄漏发生的时间、波及范围(多少用户、哪些代码),也没说具体修了哪些漏洞。所以“自动化修复”到底覆盖了多大风险,目前无法验证。 对从业者的启示:如果你的部署流程还有人工环节,尤其是涉及代码或模型权重,这次事件是个提醒。自动化不是可选项,是安全底线。Anthropic 的处理方式值得参考,但信息缺口也说明,这类事故的透明度往往有限。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K0·R1
01:07
118d ago
X · @dotey(宝玉)· x-apiZH01:07 · 04·01
SentrySearch:用自然语言搜视频画面,开源工具一小时成本约2.84美元
SentrySearch 是一个开源命令行工具,能让你像搜文字一样搜视频内容——比如在几小时的行车记录仪里找到“一辆红色卡车闯了停牌”的画面。原理是把视频切成带重叠的片段,用 Google Gemini Embedding API 或本地 Qwen3-VL 模型把每个片段编码成向量,存进本地向量数据库 ChromaDB。搜索时文字查询也转成向量做匹配,...
#Multimodal#Embedding#Tools#Google
一句话点评
开源工具,把视频切成片段转成向量,用自然语言搜画面,一小时成本约2.84美元。
锐评
SentrySearch 是个开源命令行工具,核心思路是把长视频切成带重叠的片段,用多模态嵌入模型(Google Gemini Embedding API 或本地 Qwen3-VL)把每个片段编码成向量,存进 ChromaDB。搜索时文字查询也转成向量做匹配,直接导出对应片段。整个过程不转录、不逐帧生成文字描述,像素和文字在向量层面比较,这是多模态嵌入模型带来的能力。 关键数字:索引一小时视频成本约2.84美元(用云端 API);本地跑需要 24GB 以上显存或内存(Mac 或 NVIDIA GPU)。已适配特斯拉行车记录仪,能在裁剪片段上叠加车速、GPS 和时间信息。 信息缺口:正文没披露搜索精度和召回率,也没说重叠片段的具体长度和步长,这些会影响实际检索效果。另外,本地 Qwen3-VL 的推理速度没提,24GB 显存跑长视频可能不流畅。整体看,对需要从海量视频里找特定画面的场景(安防、行车记录、视频库管理)挺实用,但精度和性能还得自己测。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R0

更多

频道

后台