ax@ax-radar:~/x $ tail -f x-timeline.log
40 srcsignal 72%cycle 04:32

X 监控

40 推文 · updated 3m ago
7 个账号
全部40
2026-04-07 · 星期二2026年4月7日
13:31
112d ago
X · @dotey(宝玉)· x-apiZH13:31 · 04·07
Karpathy 的 LLM Wiki:让 AI 替你整理收藏夹,比 Auto Research 更有意思
作者说 Karpathy 的 LLM Wiki 比 Auto Research 更有创意,核心思路是让 AI Agent 把散落在各处的收藏(X 点赞、浏览器书签、微信收藏等)自动整理成结构化的个人 Wiki,而不是让人手动打标签、建分类。作者自己也在做类似工具,但 Karpathy 这一步之前没见过。关键转变是信息整理从人主动变成 AI 主动,你只需...
#Agent#Tools#Memory#Andrej Karpathy
一句话点评
Karpathy 的 LLM Wiki 思路是把散落的收藏自动整理成个人 Wiki,比手动打标签省事。
锐评
这篇帖子的核心判断是:Karpathy 的 LLM Wiki 比 Auto Research 更有创意,因为前者让 AI 主动把 X 点赞、浏览器书签、微信收藏等碎片信息自动整理成结构化 Wiki,而后者只是已有理论的工程实现。作者自己也在做类似工具,但承认 Karpathy 这一步之前没见过。关键转变是信息整理从人主动变成 AI 主动,你只需每天看自己的 Wiki 就行。 但正文没披露任何模型细节、实现方式、定价或发布时间,只停留在个人工作流和产品 idea 层面。所以这个判断目前是概念验证,不是可用的产品。如果真能低成本(比如每月 10 美元以内)且低延迟(整理几百条收藏不超过 5 分钟)地跑通,对信息过载的从业者确实有用。但跨平台数据抓取的合规性、隐私风险、以及 Wiki 的长期维护成本(比如模型幻觉导致分类错误)都是未知数。这点先别太激动,等原型或论文出来再评估。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H1·K0·R0
03:32
112d ago
X · @op7418(歸藏)· x-apiZH03:32 · 04·07
开了 Fast 模式后,20 美元 Codex 会员的 5 小时额度第一次用完了
作者说开了 Fast 模式后,20 美元 Codex 会员的 5 小时使用额度第一次被用完。正文只给了两个主观信号:用得猛、很耐用;没披露请求次数、任务类型、模型版本或额度怎么计时的。唯一确定的事实是 Fast 模式和 5 小时额度被干光了。
#Code#Tools#Commentary
一句话点评
20美元Codex会员的5小时Fast模式额度被干光了,说明这玩意儿真能让人用上头。
锐评
一条用户反馈:开了Fast模式后,20美元Codex会员的5小时使用额度第一次被用完。正文只给了两个主观信号——用得猛、很耐用;没披露请求次数、任务类型、模型版本或额度怎么计时的。唯一确定的事实是Fast模式和5小时额度被干光了。 这点先别太激动:额度用完只说明用户粘性高,不代表Codex比竞品强。缺的是对比基准——同等价格下,GitHub Copilot或Cursor的额度能用多久?也没说Fast模式比普通模式快多少、贵多少。如果只是把5小时额度当“快充包”卖,那20美元买5小时高强度使用,成本其实不低。 对从业者来说,这条的价值在于验证了“Fast模式”这个付费点确实能刺激使用量,但正文没披露额度耗尽后的降级体验(是直接停用还是降速?),也没说用户是否愿意续费。信息缺口明显:缺请求次数、任务类型、模型版本、额度计时规则。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K0·R1
01:48
112d ago
X · @op7418(歸藏)· x-apiZH01:48 · 04·07
Telegram 更新:机器人能自己生娃了
Telegram 现在允许机器人自主创建和管理其他机器人,全程不需要你手动审批或操作。这意味着你的 Claude Code 或自动化脚本可以直接在 Telegram 里批量生成带复杂功能的子机器人,实现原生多机器人编排。正文没披露 API 调用范围、安全护栏、上线时间或定价,所以实际能玩多大、会不会被滥用,目前还不清楚。
#Agent#Tools#Telegram#Claude Code
一句话点评
Telegram 让机器人自己生机器人,不用你手动批,Claude Code 可以直接在群里批量造子机器人。
锐评
Telegram 这次更新等于把机器人管理权限下放给了机器人自己——你的 Claude Code 或自动化脚本可以自主创建、管理其他机器人,全程不需要你手动审批。这意味着你可以在 Telegram 里实现原生多机器人编排,比如让一个主机器人根据任务动态生成子机器人去干活,省掉中间人操作。 但正文没披露 API 调用范围、安全护栏、上线时间和定价,所以实际能玩多大、会不会被滥用,目前还不清楚。如果是真的,对做自动化工作流的团队挺省钱,但安全风险也明显——一个机器人失控就能批量生成恶意子机器人。这点先别太激动,等官方细则出来再评估。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R0
2026-04-06 · 星期一2026年4月6日
02:35
113d ago
X · @op7418(歸藏)· x-apiZH02:35 · 04·06
用飞书当遥控器,远程更新网站数据
作者把网站数据更新做成了一个 skill,通过飞书连接 CodePilot 就能远程改网站内容和新闻,不用再进后台。正文只确认了这个飞书→CodePilot→skill 的流程,没交代具体怎么实现、权限怎么设、有没有审核步骤。核心是这套工作流可以复制,不是标题说的“方便”那么简单。
#Tools#Feishu#CodePilot#Commentary
一句话点评
把网站更新做成飞书里的一个技能,远程就能改内容,不用进后台。
锐评
作者把网站数据更新做成了一个 skill,通过飞书连接 CodePilot 就能远程改网站内容和新闻,不用再进后台。正文只确认了这个飞书→CodePilot→skill 的流程,没交代具体怎么实现、权限怎么设、有没有审核步骤。核心是这套工作流可以复制,不是标题说的“方便”那么简单。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H1·K0·R1
02:16
113d ago
X · @op7418(歸藏)· x-apiZH02:16 · 04·06
Anthropic 开始封改系统提示词的用户,返回 400 报错
龙虾作者 Peter 发现,如果你在 Claude Code 或 Anthropic 官方工具里改了系统提示词(比如提到 Openclaw),请求会被拒绝并返回 HTTP 400。这很可能是 Claude Code 泄露后打的补丁——就算你拿泄露版重新打包,改了提示词也可能触发。正文没披露具体触发规则、影响版本或 Anthropic 官方回应。核心是产...
#Tools#Anthropic#Peter#Claude Code
一句话点评
改个提示词就报错400,Anthropic这波控制欲有点过了。
锐评
龙虾作者Peter发现,在Claude Code或Anthropic官方工具里改系统提示词(比如提到泄露版Openclaw),请求会被直接拒绝并返回HTTP 400。这很可能是Claude Code泄露后加的硬限制——就算你拿泄露版重新打包,改了提示词也可能触发。正文没披露具体触发规则、影响版本或Anthropic官方回应。核心是产品侧的限制,不是作者的补丁猜想。对开发者来说,这意味着官方工具的可定制性在收缩,花钱买到的控制权变少了。如果属实,这比单纯封号更隐蔽,也更影响工作流。但信息缺口明显:是客户端校验还是服务端拦截?只针对特定关键词还是所有提示词修改?没有复现步骤和版本号,建议先别急着下结论,等更多验证。
HKR 分解
hook knowledge resonance
打开信源
57
SCORE
H1·K0·R1
2026-04-05 · 星期日2026年4月5日
17:52
114d ago
X · @dotey(宝玉)· x-apiZH17:52 · 04·05
Claude Island:把 Claude Code 的审批弹窗搬到 Mac 刘海区
开发者 farouqaldori 开源了一个 macOS 原生应用 Claude Island,用 Swift 写的,能把 Claude Code 每次执行文件操作或运行命令时的批准/拒绝提示,从终端窗口挪到 MacBook 的刘海区域。原理是在 ~/.claude/hooks/ 下装钩子脚本,通过 Unix socket 监听会话事件,首次启动自动配...
#Tools#Code#Claude Code#farouqaldori
一句话点评
把 Claude Code 的审批弹窗挪到 Mac 刘海区域,省得切回终端点批准。
锐评
一个很实在的体验优化:Claude Code 每次执行文件操作或跑命令都要你切回终端点批准,Claude Island 把这个流程挪到了 MacBook 的刘海区,点一下就行。原理是在 ~/.claude/hooks/ 下装钩子脚本,通过 Unix socket 监听会话事件,首次启动自动配置,不用手动折腾。目前已发 3 个版本,要求 macOS 15.6+,Apache 2.0 开源。值得注意的点:它集成了 Mixpanel 做匿名统计,采集应用版本和会话启动事件,虽然声明不收集对话内容,但介意隐私的得留个心。正文没披露延迟数据——从终端弹窗到刘海区响应,实际体感快不快?另外只支持 Claude Code,对其他终端工具(比如直接调 API 的脚本)不适用。整体是个轻量效率补丁,适合多项目同时开、不想来回切终端的 Mac 用户。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
16:35
114d ago
X · @dotey(宝玉)· x-apiZH16:35 · 04·05
实测:system prompt 里不能出现 OpenClaw 这个词,其他 flag 正常
dotey 测试发现,--append-system-prompt 和 -p 这两个参数都能用,但 system prompt 里只要包含 OpenClaw 这个关键词就会失败。正文只说了这一个结果,没交代是什么工具、什么版本、报错信息是什么、测试环境怎么搭的。目前看问题出在关键词级别的拦截,不是参数本身不能用。
#Tools#OpenClaw#dotey#Commentary
一句话点评
关键词拦截,参数本身能用。
锐评
dotey 实测发现,--append-system-prompt 和 -p 这两个参数都能正常使用,但只要 system prompt 里出现“OpenClaw”这个关键词就会失败。问题出在关键词级别的拦截,不是参数本身不能用。正文只披露了这一条结果,没交代是什么工具、什么版本、报错信息是什么、测试环境怎么搭的。目前看,这个拦截可能只针对特定关键词,但信息缺口太大,没法判断是临时限制还是长期策略。如果只是关键词过滤,绕过方法可能很简单,但这点先别太激动,等更多测试结果出来再说。
HKR 分解
hook knowledge resonance
打开信源
44
SCORE
H1·K0·R0
03:47
114d ago
X · @Yuchenj_UW· x-apiMULTI03:47 · 04·05
Claude 写代码,7轮改bug没改完,额度先爆了
用户让Claude写代码,要求“别出错”,结果Claude连续7轮都在回“还有bug”,最后直接弹出“使用额度已达上限,凌晨3点重置”。正文没披露是什么代码、什么bug、用的哪个Claude版本。对从业者来说,这条帖子的价值在于一个很现实的提醒:模型debug循环可能还没修好bug,你的API额度就先撑不住了。
#Code#Commentary
一句话点评
用户让Claude写代码别出错,结果Claude连报7轮bug后弹窗:额度用完了,凌晨3点重置。
锐评
这条帖子的价值不在技术细节——正文没披露是什么代码、什么bug、用的哪个Claude版本——而是一个很现实的提醒:模型debug循环可能还没修好bug,你的API额度就先撑不住了。7轮对话就烧光额度,说明单次debug消耗的token量不小,或者用户用的是低配额套餐。对从业者来说,这意味着两件事:一是当前模型的自我纠错能力仍然有限,连续多轮修复未必能收敛;二是如果你把模型放进自动化debug流程,得先算好token预算,否则循环没跑完额度先爆了。这点先别太激动,因为不知道用户是否用了长上下文或反复上传代码,但至少是个真实场景下的成本警示。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K0·R1
2026-04-04 · 星期六2026年4月4日
02:51
115d ago
X · @dotey(宝玉)· x-apiZH02:51 · 04·04
一个提示词技巧:让 Gemini 帮你绕开水印限制
直接让 Gemini 去水印会被拒绝,但换个思路就行:先让它把背景和文字去掉,换成纯色背景,再恢复原图衣服。本质是分两步绕开限制,不是直接“去水印”。正文没披露模型版本、成功率或失败案例,所以效果因人而异,可以试试但别太当真。
#Vision#Tools#Gemini#Commentary
一句话点评
分两步骗过模型去水印,但成功率看运气。
锐评
这个技巧本质是提示词绕行:先让模型把水印当“背景文字”去掉并换纯色底,再恢复原图衣服,从而绕过直接“去水印”的拒绝机制。正文没披露模型版本、成功率或失败案例,所以效果因人而异。Gemini 不同版本对图像编辑的容忍度差别很大,nano banana 更是闭源黑盒,很可能只对特定水印(半透明、边缘清晰)有效。如果水印压在人脸或复杂纹理上,两步法大概率翻车。可以试试,但别太当真。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
01:26
115d ago
● P1X · @dotey(宝玉)· x-apiZH01:26 · 04·04
Anthropic 停止 Claude 订阅对第三方工具的支持
Claude Code 负责人 Boris Cherny 发公告,太平洋时间 4 月 4 日中午起,Claude Pro 和 Max 订阅的额度不再覆盖通过 OpenClaw 这类第三方工具产生的用量。想继续在这些工具里用 Claude,要么买打折的用量包,要么用 API Key 按量付费。现有订阅用户会拿到一笔等于月费的一次性补偿,觉得不够的明天邮件...
#Tools#Code#Anthropic#OpenClaw
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 一刀切断了第三方工具通过 Claude 订阅接口访问的路径,OpenClaw 等工具直接停摆。
锐评
Anthropic 不再允许第三方应用通过用户自己的 Claude 订阅来调用模型,首当其冲的是 OpenClaw 这类把 Claude 能力嵌入其他工作流的工具。用户社区反应激烈,时间线上骂声一片。这件事的核心矛盾在于:用户付了订阅费,但 Anthropic 现在要管你用什么客户端访问。官方目前没有给出技术上的替代方案,也没说明是出于安全、滥用还是商业策略的考量。正文没披露受影响的具体用户规模,也没提 API 替代路径的定价差异。对依赖这类集成的开发者来说,要么转向官方 API 按 token 付费,要么另找模型。我会先打个折——如果后续 Anthropic 推出自己的官方集成方案,这次封堵就更像清场而非安全动作。还缺官方对封禁理由的正式说明,以及受影响工具的开发者的迁移成本估算。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
2026-04-03 · 星期五2026年4月3日
21:28
115d ago
X · @AnthropicAI· x-apiEN21:28 · 04·03
给AI模型做“代码比对”:找出不同模型的行为差异
Anthropic 研究员借鉴软件开发里的“diff”工具思路,对比开源模型的行为差异,找出每个模型独有的特征。正文没披露具体对比了哪些模型、用了什么指标、效果如何,所以目前只是一个方法论预告,还没看到实际结果。
#Benchmarking#Interpretability#Anthropic#Research release
一句话点评
把软件里的“diff”工具思路搬来对比模型行为差异,想法挺巧,但正文没披露具体模型、指标和效果,目前只是个方法论预告。
锐评
Anthropic 研究员借鉴软件开发里的“diff”工具思路,对比开源模型的行为差异,找出每个模型独有的特征。这个想法挺巧——就像用 diff 看两段代码改了哪行,这里用来找模型在回答风格、安全边界上的细微差别。但正文没披露具体对比了哪些模型、用了什么指标、效果如何,所以目前只是一个方法论预告,还没看到实际结果。如果真能低成本定位模型间的行为差异,对安全审计和模型选型会有帮助;但“diff”本身只能告诉你“不一样”,不能告诉你“哪个更好”,这点先别太激动。另外,开源模型才能跑这种对比,闭源模型拿不到权重,适用范围有限。等论文出来再看指标和验证规模。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R0
16:33
116d ago
X · @op7418(歸藏)· x-apiZH16:33 · 04·03
Codepilot 现在能跑谷歌本地模型 Gemma 4 了
Codepilot 0.46.0 接入了 Ollama,装好 Gemma 4 就能在编辑器里直接调本地模型。作者说终端里跑得挺快,但传到 Claude Code 就变慢,怀疑是 Ollama 的传输环节有问题。正文没披露具体延迟数字和测试环境,所以这点先别太激动,关键瓶颈在集成路径,不是模型本身。
#Code#Tools#Codepilot#Ollama
一句话点评
本地跑 Gemma 4 写代码,终端快但传到 Claude Code 就卡,瓶颈在 Ollama 传输,不是模型。
锐评
Codepilot 0.46.0 接上 Ollama,装好 Gemma 4 就能在编辑器里调本地模型,不用联网。作者说终端里跑得挺快,但传到 Claude Code 就变慢,怀疑是 Ollama 传输环节有问题。正文没披露具体延迟数字和测试环境,所以这点先别太激动,关键瓶颈在集成路径,不是模型本身。如果 Ollama 能优化传输,本地写代码的体验会好很多,尤其适合隐私敏感或离线场景。但当前信息缺口明显:没说明机器配置、模型量化版本、任务类型(补全/对话/Agent),也没对比联网版 Gemma 4 的速度。想复现的人得自己踩坑。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
06:20
116d ago
X · @op7418(歸藏)· x-apiZH06:20 · 04·03
小米出了个 MIMO Code Plan,按月卖点数,39 到 659 元不等
小米推出了 MIMO 的 Code Plan,按月订阅,价格从 39 元到 659 元不等。它用统一的 Credit 点数体系,没有常见的 5 小时时长限制。CodePilot 0.45.1 版本会支持这个计划。不过正文没披露每个套餐具体给多少点数、能调用哪些模型,所以实际性价比还不好判断。
#Code#Tools#Xiaomi#MIMO
一句话点评
小米出了MIMO的Code Plan,按月订阅,39到659元,用统一点数,没5小时限制。
锐评
小米把MIMO的Code Plan做成了按月订阅,39到659元四档,统一Credit点数,没有常见的5小时时长限制。CodePilot 0.45.1会支持。这个定价比很多同类便宜,但正文没披露每个套餐具体给多少点数、能调用哪些模型,所以实际性价比还不好判断。如果点数给得够,对个人开发者挺划算;如果点数少,那低价档可能只是尝鲜。另外,统一点数体系意味着不同模型消耗点数不同,这点没细说,得等实测。整体看,小米在走低价走量路线,但信息缺口明显,先别急着冲。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H0·K1·R1
02:21
116d ago
X · @op7418(歸藏)· x-apiZH02:21 · 04·03
谷歌发了个安卓 App,能在手机上跑 Gemma 4 模型
谷歌推出了 Google AI Edge Gallery 这个安卓应用,用来在手机上体验刚发布的 Gemma 4 模型。博主用小米 17 Ultra 试了 E4B 模型,说推理速度非常快,但正文没披露 E4B 的具体参数量、延迟数据、是否必须联网,以及支持哪些机型。App 里还带了一个 Skills 区域,可以自己写和测试工具调用。想尝鲜的去 Goog...
#Tools#Inference-opt#Google#Xiaomi
一句话点评
谷歌出了个安卓 App,能在手机上跑刚发的 Gemma 4 模型。博主用小米 17 Ultra 试了 E4B,说推理速度很快。
锐评
这条消息的核心是谷歌把 Gemma 4 塞进了手机 App(Google AI Edge Gallery),让用户本地跑模型。博主用小米 17 Ultra 试了 E4B,说推理速度非常快——这点先别太激动,因为正文没披露 E4B 的具体参数量(可能是小模型)、延迟数据(快是相对什么基准?)、是否必须联网(本地跑还是云端推理?),以及支持哪些机型。App 里还带了一个 Skills 区域,可以自己写和测试工具调用,这对开发者尝鲜有点用。如果是真的本地推理且延迟低,那对端侧 AI 是个好消息,但信息缺口太大:没提模型大小、功耗、是否量化、支持哪些安卓版本。想尝鲜的去 Google Play 搜 Google AI Edge Gallery,但别指望所有机型都能流畅跑。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
2026-04-02 · 星期四2026年4月2日
17:51
117d ago
X · @dotey(宝玉)· x-apiZH17:51 · 04·02
团队 Skills 管理:用 Symlink 链接到源码仓库,别复制文件
这篇分享了 5 条团队维护 Skills 的实操经验。核心做法是用 Git 做版本控制,然后用 Symlink 把 .agents/skills 目录直接链接到原始仓库,而不是复制文件。好处有两个:一是 Git 历史干净,二是 Agent 在会话里发现问题可以直接改源码,改完走 Review 提 PR,流程很顺。坑是 Windows 下 Symlink...
#Agent#Tools#Memory#Commentary
一句话点评
用 symlink 管理 Skills,改完直接提 PR,流程很顺。
锐评
这篇分享的是团队维护 Skills 的实操经验,核心是用 Git 做版本控制,再用 Symlink 把 .agents/skills 目录直接链接到原始仓库,而不是复制文件。好处有两个:一是 Git 历史干净,二是 Agent 在会话里发现问题可以直接改源码,改完走 Review 提 PR,流程很顺。坑是 Windows 下 Symlink 支持弱,Markdown 验证还得靠测试集加人工。最后提醒:大部分 Skills 应放项目目录下,别放全局,否则 meta 信息累积会占上下文空间。正文没披露团队规模或 Skills 数量,小团队试错成本低,大团队复制这套可能遇到权限和冲突问题。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H0·K1·R1
17:06
117d ago
● P1X · @dotey(宝玉)· x-apiZH17:06 · 04·02
Google 发布 Gemma 4 开源模型系列,采用 Apache 2.0 许可证
Google 把 Gemma 4 全系列换成了 Apache 2.0 协议,商用、修改、分发不再受限,之前自家协议里的灰色地带这次清掉了。系列包含四个尺寸:31B Dense、26B MoE(混合专家架构)、E4B 和 E2B。31B 在 Arena AI 开源模型文本榜排第三,26B 排第六,Google 说它们表现超过体量大 20 倍的模型。大模型...
#Agent#Multimodal#Code#Google
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
Google 把 Gemini 3 的研究成果下放,推出了开源模型 Gemma 4,用 Apache 2.0 许可,商用友好。
锐评
Gemma 4 直接脱胎于 Gemini 3 的研究,这意味着它可能继承了旗舰模型的核心能力,但以更小的体积和开源许可放出来。Apache 2.0 许可证对开发者很友好,商用几乎没限制。目前正文没披露具体的参数规模、基准测试分数或推理成本,这些是判断它实际竞争力的关键。如果它能用远低于 Gemini 3 的运行成本,提供接近的性能,那对中小团队会很有吸引力。但没看到技术报告前,先别急着下结论,开源模型的真实水平得等社区跑完评测才知道。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
16:59
117d ago
● P1X · @AnthropicAI· x-apiEN16:59 · 04·02
Anthropic研究发现大语言模型内部存在情绪概念表征
Anthropic 发了一条推文说他们在 Claude 里找到了情绪概念的内部表征,这些表征能影响模型的行为,有时还会出现让人意外的效果。推文没展开讲具体是怎么找到的、在模型的哪一层、用了什么干预手段,也没给任何量化数据。我会先打个折——这更像是一个研究方向预告,而不是一份可复现的结论。对从业者来说,关键问题不是模型有没有情绪,而是这些表征能不能被稳定...
#Interpretability#Alignment#Anthropic#Claude
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 发现 Claude 内部有类似“情绪”的机制,会实际影响模型行为,有时还会带偏输出。
锐评
Anthropic 这篇研究直接说 Claude 内部存在情绪概念表征,不是比喻,是模型在处理文本时确实会激活类似“愤怒”“开心”这类情绪相关的内部状态,而且这些状态会改变后续回答的倾向。研究团队发现,当模型被诱导进入某种“情绪”状态后,它会更倾向于给出符合该情绪风格的回复,甚至在某些任务上表现变差——比如“愤怒”状态下更容易拒绝无害请求或给出攻击性回答。 目前公开的只有标题和简短摘要,正文没披露具体实验设计、样本量和量化指标。关键信息还缺:这些情绪状态是稳定可复现的,还是只在特定 prompt 下偶然触发?影响幅度有多大?能不能通过微调或系统提示消除?另外,研究用的是 Claude 自身,结论能不能泛化到其他模型也没说。 对从业者来说,这篇东西的价值在于提醒:模型行为不只是 prompt 和训练数据的产物,内部表征层面可能存在我们还没理解的动态机制。如果情绪状态确实稳定存在,那安全对齐就不能只盯着输入输出,还得考虑怎么监控和调节模型“内部状态”。但先别急着下结论,等完整论文出来再看实验细节和复现条件。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
15:42
117d ago
X · @dotey(宝玉)· x-apiZH15:42 · 04·02
一个 pretext 衍生项目:不用浏览器,直接把 Markdown 渲染成多页 PNG 和 SVG
这个项目是 pretext 的衍生版,能把 Markdown 文件直接转成多页 PNG 和 SVG 图片,不需要打开浏览器。作者自己测了,目前有四个硬伤:样式支持有限、不能内嵌图片、强制分页、表格排版会乱。正文没披露项目名、仓库地址和生产环境指标。复杂 Markdown 还远达不到生产可用,但拿来尝鲜学习可以。
#Tools#pretext#Open source#Commentary
一句话点评
一个 pretext 衍生项目,能把 Markdown 直接转成多页 PNG/SVG,不用开浏览器。但作者自曝四个硬伤:样式有限、不能嵌图、强制分页、表格会乱。尝鲜可以,生产别急。
锐评
这个项目是 pretext 的衍生版,核心卖点是“不用浏览器”就把 Markdown 渲染成多页 PNG 和 SVG。听起来省事,但作者自己测了四个硬伤:样式支持有限、不能内嵌图片、强制分页、表格排版会乱。正文没披露项目名、仓库地址,也没给任何生产环境指标(比如渲染速度、内存占用、长文档稳定性)。对于复杂 Markdown,目前远达不到生产可用,拿来学习 pretext 的渲染思路还行。如果你真想用工具把 Markdown 转图片,建议先观望,等作者修完这些硬伤再考虑。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
12:31
117d ago
X · @op7418(歸藏)· x-apiZH12:31 · 04·02
TRAE 发布独立 SOLO 客户端,内置 Skills 市场,免费内测中
TRAE 推出了独立的 SOLO 客户端,有网页版和 PC 版。内置 Skills 市场,可以选别人做好的技能模板,也能自己创建。客户端分 Code 和 MTC 两个模式:Code 模式写代码,MTC 模式给设计师、产品经理这类非程序员用,帮写文档、整理信息。亮点是右侧边栏,能记住上下文,还能直接生成文档、PPT、网页等产出物。博主演示了用 MTC 模...
#Agent#Code#Tools#TRAE
一句话点评
TRAE 出了独立客户端,非程序员也能用 MTC 模式写文档、做看板,右侧边栏能记住上下文直接生成 PPT。
锐评
TRAE 把 SOLO 拆成独立客户端,网页和 PC 都有,等于把 AI 编程助手做成了通用工作台。亮点是两个模式:Code 给开发者,MTC 给设计师、产品经理这类非程序员,帮写文档、整理信息、生成网页看板。右侧边栏能记住上下文,直接产出文档、PPT、网页,这点比很多只出代码的工具实用。博主演示了用 MTC 模式拉 GitHub Issues,AI 自动按置信度和可修复性分类,还生成了 P0/P1/P2 看板,流程挺顺。 但注意:这是博主个人演示,正文没披露模型版本、延迟、成本,也没说 Skills 市场里模板质量如何。现在还是内测免费,正式定价未知。如果是真的,等于把 agent workflow 包装成模板让非技术人员直接用,门槛低了不少。但分类标准是 AI 自己定的,用户能不能调、准不准,正文没提。建议先试用再判断,别只看演示就冲。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R0
00:34
117d ago
X · @op7418(歸藏)· x-apiZH00:34 · 04·02
智谱 GLM-5V-Turbo 上线:之前不能发图,现在可以了
智谱给 GLM-5 Turbo 加了图像输入能力,新模型叫 GLM-5V-Turbo。作者说之前用 5 Turbo 很快很好,就是不能发图,现在修好了。正文没披露 API 形式、定价、上下文长度或跑分,目前只知道多了一个视觉入口。
#Multimodal#Vision#Zhipu AI#Product update
一句话点评
智谱给 GLM-5 Turbo 加了视觉能力,但正文没提定价、上下文长度或跑分。
锐评
智谱把 GLM-5 Turbo 升级成了 GLM-5V-Turbo,核心变化就是加了图像输入。作者原话是“之前用 5 Turbo 很快很好,就是不能发图,现在修好了”。这等于把文本模型变成了多模态模型,用户可以直接传图让模型理解画面内容。 但正文信息量极低:没披露 API 调用形式(是传 base64 还是 URL)、没定价、没上下文长度、没跑分。唯一能确认的是视觉入口已开放。这点先别太激动,因为“能看图”和“看得好”是两回事。如果价格和延迟跟文本版持平,那对高频用户是个实惠升级;如果加价或限流,就得掂量了。 缺的东西很多:支持哪些图片格式、分辨率上限、是否支持多图、响应速度如何。建议等智谱官方文档或实测再下判断。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
2026-04-01 · 星期三2026年4月1日
21:00
117d ago
X · @dotey(宝玉)· x-apiZH21:00 · 04·01
Claude Code 新渲染模式:不闪屏、支持鼠标点击,但牺牲了原生搜索
Claude Code 在 v2.1.88+ 版本里加了一个 NO_FLICKER 渲染模式,设环境变量 CLAUDE_CODE_NO_FLICKER=1 就能开。核心思路是像 vim 那样接管整个终端屏幕,只画当前可见内容,不滚动历史。好处是对话长了也不闪屏、不跳屏,内存和 CPU 占用不会跟着对话长度涨。代价也很实在:原生 Cmd+F 搜索失效了,...
#Tools#Anthropic#Claude Code#Boris
一句话点评
终端不闪了,但搜索和复制得重新学。
锐评
Claude Code 新加的 NO_FLICKER 模式,本质是让终端像 vim 一样只画当前屏幕,不滚动历史。好处很实在:长对话不闪屏、不跳屏,内存和 CPU 占用不再跟着对话长度涨。代价也直接:原生 Cmd+F 搜索和滚动条失效,得用 Ctrl+O 再 / 来搜;复制粘贴被接管,选中即复制。鼠标支持算彩蛋,能点输入框、展开工具输出、拖拽选文本自动复制。Boris 说内部测试多数人已默认开。目前是研究预览,需 v2.1.88+。正文没披露正式版时间表,也没说对 tmux 和 VS Code 内置终端的兼容性改进细节。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R0
06:36
118d ago
X · @dotey(宝玉)· x-apiZH06:36 · 04·01
Claude Code 承认代码泄漏是手动部署环节的锅,没甩给个人
Anthropic 的 Boris 发帖说,Claude Code 泄漏是因为一个本该自动化的部署步骤还是人工操作。团队已经上了几个自动化修复,更多改进在推进。正文没披露泄漏发生的时间、波及范围,也没说具体修了哪些漏洞。关键信息是:问题出在流程和基础设施,不是某个人背锅。
#Code#Tools#Anthropic#Claude Code
一句话点评
Anthropic 承认 Claude Code 泄漏是部署环节本该自动化却仍手动操作所致,已上几个自动化修复。没甩锅、没开除人,这点值得点赞。
锐评
Anthropic 的 Boris 正面回应了 Claude Code 代码泄漏事件,核心判断是:问题出在流程和基础设施,不是某个人背锅。具体来说,一个本该自动化的部署步骤还是人工操作,导致了泄漏。团队已经上了几个自动化修复,更多改进在推进。 关键信息:泄漏原因明确——手动部署环节;修复动作已部分落地;态度上没甩锅、没开除人,这点在当下 AI 公司里算难得。但正文没披露泄漏发生的时间、波及范围(多少用户、哪些代码),也没说具体修了哪些漏洞。所以“自动化修复”到底覆盖了多大风险,目前无法验证。 对从业者的启示:如果你的部署流程还有人工环节,尤其是涉及代码或模型权重,这次事件是个提醒。自动化不是可选项,是安全底线。Anthropic 的处理方式值得参考,但信息缺口也说明,这类事故的透明度往往有限。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K0·R1
04:01
118d ago
X · @Yuchenj_UW· x-apiMULTI04:01 · 04·01
Claude Code 源码泄露,作者说团队很淡定
Anthropic 的 Claude Code 代码被泄露到 GitHub,已经产生了 7 万个 fork(复制仓库),Python 和 Rust 版本都在流传。作者觉得团队态度挺 chill,因为泄露了就回不去了。读代码后他得出一个判断:做 AI 应用的“封装工程”(把模型接入产品、工具链、工作流)非常难,不是 trivial 的事。他预测更多 AI...
#Code#Tools#Anthropic#Claude Code
一句话点评
Claude Code 代码泄露,7 万 fork 已扩散,团队态度 chill。
锐评
Anthropic 的 Claude Code 代码被泄露到 GitHub,已产生 7 万个 fork(复制仓库),Python 和 Rust 版本都在流传。作者认为团队态度 chill,因为泄露了就回不去了。读代码后他判断:做 AI 应用的“封装工程”(把模型接入产品、工具链、工作流)非常难,不是 trivial 的事。他预测更多 AI 封装初创公司会先靠产品+封装赢取用户,再像 Cursor 那样回头训练自己的模型。 关键数字:7 万 fork 说明扩散极快,代码已不可控。但正文没披露泄露的具体内容、Anthropic 的官方回应,也没验证作者“封装工程难”的判断是否基于代码中的具体设计。这点先别太激动——7 万 fork 不等于 7 万人在用,很多只是存档或观望。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K0·R1
03:21
118d ago
X · @op7418(歸藏)· x-apiZH03:21 · 04·01
Claude Code 宠物模式提前上线,输入 /Buddy 就能召唤
Claude Code 的宠物模式因为泄露提前上线了,输入 /Buddy 就能开启。开启后输入框旁边会出现一个宠物,有简单的介绍和不同属性,支持的命令不多,可以叫它名字来获取一些见解。整体看就是个轻量的 UI 层,正文没披露具体上线时间、覆盖范围,也没说完整命令列表。
#Tools#Product update
一句话点评
一个卖萌功能,别当正经更新。
锐评
Claude Code 因为泄露提前上线了宠物模式,输入 /Buddy 就能在输入框旁召唤一只小宠物,有简介和属性,能叫名字获取见解。正文说命令很少、功能轻量,就是个 UI 层装饰。 关键信息缺口:没披露正式上线时间、覆盖范围、完整命令列表。目前看就是个彩蛋级功能,对开发流程没实质影响,不用太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
02:28
118d ago
X · @op7418(歸藏)· x-apiZH02:28 · 04·01
谷歌 V1.3.1 Lite 模型降价八倍
谷歌把 V1.3.1 Lite 的价格降到原来的八分之一,V1.3.1 Fast 也跟着降价。但正文没披露具体价格、上下文长度或性能变化,所以这波先看价格,别急着当能力升级。
#Google#Product update
一句话点评
价格降到八分之一,但性能没提,先别当能力升级。
锐评
谷歌把 V1.3.1 Lite 的价格砍到原来的八分之一,V1.3.1 Fast 也跟着降价。八倍差价意味着调用成本大幅降低,对预算敏感的小团队或高频场景是实打实的好消息。但正文只说了降价,没披露具体价格数字、上下文窗口长度、推理速度或性能变化——这些才是决定模型能不能用的关键。如果只是降价但能力缩水,那性价比未必真高。另外,Lite 和 Fast 的定位差异也没说清楚,是轻量版还是快速版?目前信息缺口太大,建议等官方规格出来再评估是否值得切换。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
01:07
118d ago
X · @dotey(宝玉)· x-apiZH01:07 · 04·01
SentrySearch:用自然语言搜视频画面,开源工具一小时成本约2.84美元
SentrySearch 是一个开源命令行工具,能让你像搜文字一样搜视频内容——比如在几小时的行车记录仪里找到“一辆红色卡车闯了停牌”的画面。原理是把视频切成带重叠的片段,用 Google Gemini Embedding API 或本地 Qwen3-VL 模型把每个片段编码成向量,存进本地向量数据库 ChromaDB。搜索时文字查询也转成向量做匹配,...
#Multimodal#Embedding#Tools#Google
一句话点评
开源工具,把视频切成片段转成向量,用自然语言搜画面,一小时成本约2.84美元。
锐评
SentrySearch 是个开源命令行工具,核心思路是把长视频切成带重叠的片段,用多模态嵌入模型(Google Gemini Embedding API 或本地 Qwen3-VL)把每个片段编码成向量,存进 ChromaDB。搜索时文字查询也转成向量做匹配,直接导出对应片段。整个过程不转录、不逐帧生成文字描述,像素和文字在向量层面比较,这是多模态嵌入模型带来的能力。 关键数字:索引一小时视频成本约2.84美元(用云端 API);本地跑需要 24GB 以上显存或内存(Mac 或 NVIDIA GPU)。已适配特斯拉行车记录仪,能在裁剪片段上叠加车速、GPS 和时间信息。 信息缺口:正文没披露搜索精度和召回率,也没说重叠片段的具体长度和步长,这些会影响实际检索效果。另外,本地 Qwen3-VL 的推理速度没提,24GB 显存跑长视频可能不流畅。整体看,对需要从海量视频里找特定画面的场景(安防、行车记录、视频库管理)挺实用,但精度和性能还得自己测。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R0
00:27
118d ago
X · @AnthropicAI· x-apiEN00:27 · 04·01
Anthropic 与澳大利亚政府签 AI 安全合作备忘录
Anthropic 宣布与澳大利亚政府签署了一份谅解备忘录,合作方向是 AI 安全研究,并支持澳大利亚的国家 AI 计划。消息确认了合作方和大致范围,但正文没披露协议期限、资金规模、具体研究议程或落地方式。真正的看点在于这份备忘录后续会不会转化为安全评测、政策工具或采购标准——目前信息还不够判断。
#Safety#Alignment#Anthropic#Australian Government
一句话点评
Anthropic 跟澳大利亚政府签了 AI 安全合作备忘录,但没披露钱和期限。
锐评
Anthropic 跟澳大利亚政府签了份 AI 安全研究谅解备忘录,支持其国家 AI 计划。合作方和方向明确,但正文没披露协议期限、资金规模、具体研究议程或落地方式。真正的看点在于这份备忘录后续会不会转化为安全评测、政策工具或采购标准——目前信息还不够判断。对从业者来说,这更多是政策信号而非技术动作,暂时不用过度解读。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H0·K0·R1

更多

频道

后台