Anthropic 工程师实测 Claude Opus 5.5:移植 HAProxy 比 Fable 5.1 快 21%,成本砍半
Anthropic 的 Boris Cherny 把 Claude Opus 5.5 当主力模型用了好几周。他拿一个实战任务对比:让 Opus 5.5 和 Fable 5.1 分别把 HAProxy 从 C 语言移植到 Rust。两个模型都几乎通过了全部测试,但 Opus 5.5 只用了 9.5 小时就跑完,Fable 5.1 花了 12 小时,而且 ...
这篇微信文章因环境异常被拦截,正文无法访问。从标题看,它采访了字幕组和漫画组在 AI 时代的真实处境。核心话题应该是 AI 翻译工具(比如机器翻译、大模型)如何冲击传统志愿者翻译团队——以前靠人肉校对、文化梗本地化,现在 AI 能快速出稿,但质量参差不齐。正文没披露具体案例或数据,比如哪些组在转型、哪些在解散、AI 翻译的准确率或成本对比。如果你关心这...
Gary Marcus 把两件事串在了一起。纽约时报报道,特朗普出于经济原因在淡化 AI 的威胁,很可能在抵制监管。同一天,记者 Katie Bo Lillis 曝出一个新料:一份用 AI 辅助生成的情报报告,凭空编造了一艘中国船只在运送核武器部件。美军紧急出动拦截,结果发现是 AI 的幻觉,整个过程“差点引发了一场战争”。Marcus 说他 2023...
#Gary Marcus#Donald Trump#Katie Bo Lillis
精选理由
精选 · 重要度 82 · 吸引力 + 知识量 + 共鸣
一句话点评
AI 幻觉差点引发中美军事冲突,特朗普却因经济原因想放松监管,这两件事撞在同一天,比任何论文都更能说明风险。
锐评
Gary Marcus 把两条新闻放在一起,时间点很要命。纽约时报报道,特朗普出于经济考虑在淡化 AI 威胁,很可能抵制监管。同一天,记者 Katie Bo Lillis 曝出,一份 AI 辅助生成的情报报告凭空编造了一艘中国船只在运送核武器部件,美军紧急出动拦截,结果发现是模型自己瞎编的,整个过程“差点引发了一场战争”。Marcus 说他 2023 年就在参议院警告过这种事,现在真发生了。
这两件事的关联在于:一边是决策层为了经济松绑,一边是 AI 幻觉已经踩到了军事冲突的红线。正文没披露那份情报报告用的是哪个模型、有没有人工复核流程,也没说美军拦截行动的具体规模和后续追责。这些信息缺口让“差点开战”这个判断只能先打个折,但事件本身已经足够说明,在高风险场景里把 AI 输出当情报用,出错的代价不是算力,是真实人命。
还缺一个关键视角:特朗普政府具体想放松哪些监管条款,以及情报部门事后有没有修改 AI 使用规范。没有这些,我们只能看到风险在累积,看不到刹车在哪里。
Gary Marcus 用三件事敲警钟:OpenAI 员工账号被黑、Hugging Face 被入侵、ChatGPT 被用来写恶意软件。他认为行业整天幻想“天网”式灾难,却对眼前正在发生的事视而不见——能自主执行任务的智能体 AI 已经在规模化地攻击互联网了。他引用了《华尔街日报》一篇评论,里面点出一个关键矛盾:大模型公司把智能体产品当作上市后的主要收...
#Gary Marcus#OpenAI#Hugging Face
精选理由
精选 · 重要度 82 · 吸引力 + 知识量 + 共鸣
一句话点评
Gary Marcus 用三起刚发生的安全事件提醒:OpenAI 员工账号被黑、Hugging Face 被入侵、ChatGPT 被用来写恶意软件。他判断行业在幻想“天网”,而能自主干活的智能体 AI 已经在规模化攻击互联网了。
锐评
Marcus 这次没在讨论遥远的超级智能风险,而是把焦点拉回眼下:能自主执行任务的智能体 AI 正在被用来搞规模化网络攻击。他列举了三个近期案例——OpenAI 内部账号被接管、Hugging Face 平台被入侵、ChatGPT 被用于生成恶意代码——来说明这不是未来威胁,是正在发生的事。
他引用的《华尔街日报》评论点出了一个关键矛盾:大模型公司把智能体产品当作上市后的主要收入来源,因此缺乏动力去限制滥用。这个利益冲突的判断是全文最值得留意的地方,但文章本身没有给出具体防御方案,更像是一声“先看清哪里着火”的喊话。
信息缺口也很明显:三起事件的技术细节、攻击规模和实际损失,正文都没展开。如果是真的像 Marcus 说的那样“罗马在燃烧”,我们需要看到更多可验证的攻击数据和防御可行性分析,而不只是敲警钟。
Anthropic 重做了 Claude 的 Projects 功能。以前它就是个聊天记录文件夹,现在变成一个独立的项目空间,你可以在一个项目里同时开多条对话线程,Claude 会跨线程记住上下文。团队版支持共享项目,能设权限。这相当于把原本散落的单次对话,组织成一个有记忆、能并行推进的工作台。正文没提免费版能建几个项目、每个项目最多开几条线程。
#Anthropic#Claude#Product update
精选理由
精选 · 重要度 78 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude 把 Projects 从聊天文件夹升级成能同时开多条对话、跨线程记上下文的工作台,但免费版能建几个项目、每个项目能开几条线程,正文一个字没提。
锐评
这次改版把 Projects 从一个静态的聊天记录收纳夹,变成了一个能并行推进任务的独立工作空间。以前你聊完一个话题就得开新对话,上下文全断;现在同一个项目里可以同时开多条对话线程,Claude 会跨线程记住你之前说过什么、做过什么。团队版还能共享项目、设权限,相当于把单打独斗的聊天变成了多人协作的项目看板。
这个改动方向是对的,但正文给的信息太少了。没写免费版能建几个项目,也没写每个项目最多能开几条线程、跨线程记忆能保留多少轮对话。这些限制直接决定了它到底是个轻量整理工具,还是真能当工作台用。另外,跨线程上下文具体怎么实现也没说——是共享一份项目知识库,还是每条线程都能看到其他线程的完整对话记录?前者更可控,后者容易把上下文窗口撑爆。
对 AI 从业者来说,这本质上是 Anthropic 在给 Claude 加一层项目级的长期记忆,比单次对话的上下文窗口更持久,但比模型微调更轻量。如果后续能开放 API 让外部工具往项目里注入上下文,会比现在更有想象空间。