ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-08-02

35 items · updated 3m ago
RSS live
2026-08-02 · 星期日2026年8月2日
21:39
51d ago
r/LocalLLaMA· rssEN21:39 · 08·02
中国 DFSX 超节点内存带宽达 960 TB/s,是英伟达 GB200 的 1.67 倍
wccftech 报道了一款叫 DFSX TY64 的超节点,由 14 纳米 DF2000 芯片堆叠而成,标称内存带宽 960 TB/s,对比英伟达 GB200 NVL72 的 576 TB/s,高出 67%。标题喊“2 倍”有点夸张,实际数字是 1.67 倍。它的设计跳过了微凸点,改用垂直的计算-内存塔结构。正文没披露量产时间、功耗和软件生态,所以这...
#DFSX#NVIDIA#AMD
一句话点评
DFSX TY64超节点标称内存带宽960 TB/s,比英伟达GB200 NVL72的576 TB/s高67%,但标题喊“2倍”有点虚。它用14纳米DF2000芯片堆叠,跳过微凸点做垂直计算-内存塔,设计思路挺巧。正文没披露量产时间、功耗和软件生态,所以这点先别太激动——如果是真的,对受限的中国团队是个低成本高带宽选项,但落地还远。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
20:12
51d ago
Hacker News 首页· rssEN20:12 · 08·02
给 TypeScript 编译器加了个 Go 的 defer,结果作者自己劝退了
Andrew Healey 把 Go 语言的 defer 语句硬塞进了 TypeScript 编译器里,做法是在 AST 层面把 defer 重写成 try/finally 加一个栈,在注册时就捕获接收者、方法和参数。折腾完一堆边界情况(比如错误聚合、异步清理)之后,他自己得出结论:defer 大概不该出现在 TypeScript 里。文章没把具体原因...
#Andrew Healey
一句话点评
有人把 Go 的 defer 硬塞进 TypeScript 编译器,靠 AST 重写转成 try/finally 加栈,注册时就捕获接收者、方法和参数。折腾完一堆边界情况(错误聚合、异步清理)后,他自己说 defer 大概不该出现在 TypeScript 里。文章没把具体原因写透,只提了“边界情况太多”。如果是真的,这成本不低——改编译器、加语法、处理运行时语义,收益却只是少写几行 try/...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
20:12
51d ago
Product Hunt · AI· rssEN20:12 · 08·02
mpai:把 Codex 和 Claude Code 变成多人协作终端
mpai 是一个开源终端工具,能让 Codex 和 Claude Code 的会话变成多人可加入的终端。队友通过 Tailscale 加入主机的共享会话,能看到完整上下文,并且用自己的名字发指令。主机始终控制权限,数据不经过第三方。目前只支持 Mac,正文没提 Windows 或 Linux。
#mpai#Codex#Claude Code#Open source
一句话点评
mpai 把 Codex 和 Claude Code 的单人终端会话变成多人协作,队友通过 Tailscale 加入就能看到完整上下文、用自己的名字发指令,主机始终控制权限,数据不经过第三方。目前只支持 Mac,没提 Windows 或 Linux。短评:多人共享 AI 编程会话,省去传截图和复制粘贴的麻烦,但仅限 Mac 且依赖 Tailscale,团队普及门槛不低。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
20:11
51d ago
Hacker News 首页· rssEN20:11 · 08·02
MicroCodex:一个不到1MB的C++版Codex,纯终端跑代码生成
有人用C++重写了OpenAI的Codex(就是那个能根据自然语言生成代码的模型),编译完二进制不到1MB,直接在终端里跑,不需要装Python那一套。好处是延迟低、资源占用小,适合在配置低的机器或者对响应速度有要求的场景里用。但正文没披露它支持哪些模型、性能怎么样、跟原版Codex功能差多少,所以这点先别太激动——如果真能跑通主流模型,那确实挺省成本的。
#Code#Agent#OpenAI#MicroCodex
一句话点评
有人用C++重写了OpenAI的Codex,编译完二进制不到1MB,终端直接跑,不用装Python。延迟低、资源占用小,适合低配机器或对响应速度敏感的场景。但正文没披露支持哪些模型、性能如何、功能差多少,如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
19:42
51d ago
Hacker News 首页· rssEN19:42 · 08·02
一个奇怪的 AI 画图测试:让 14 个模型画一只长着哈布斯堡下巴的青蛙
这个叫 FROGS_ 的月度基准测试,每月给 14 个模型三次机会,用 SVG 画一只“长着哈布斯堡下巴的青蛙”。8 月份 42 次尝试全部生成了有效的 SVG 文件。以 Claude Opus 5 为例,它画出了夸张突出的下颌,下牙盖过上唇,还加了“下垂的皇家眼睑”这种戏谑标注。每次生成耗时 42 到 64 秒,文件大小在 3.4 到 3.9 KB ...
#Vision#Code#Anthropic#Claude Opus 5
一句话点评
有人每月让14个模型用SVG画一只“哈布斯堡下巴的青蛙”,8月42次全成功。Claude Opus 5画出了夸张下颌、下牙盖过上唇,还加了“下垂的皇家眼睑”这种戏谑标注。每次生成42-64秒,文件3.4-3.9KB。好玩但没评分标准,纯属趣味对比,别当正经评测。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
18:53
51d ago
Hacker News 首页· rssEN18:53 · 08·02
用 HTML 给 AI 画草图:一份给开发者的视觉指南
Plannotator 发布了 Effective HTML,一本教你怎么用 HTML 做线框图、原型、图表和计划的小册子。核心判断:当需要表达空间布局、视觉对比或交互逻辑时,HTML 比 Markdown 更合适,因为 AI 能直接读和改这些 HTML 文件。正文没披露 AI 具体怎么消费这些产物——是截图还是解析 DOM?——但引用了 Claude...
#Plannotator#Claude
一句话点评
Plannotator 出了一本小册子,核心观点很实在:跟 AI 聊设计时,别只用 Markdown,HTML 能表达空间、对比和交互,AI 也能直接读和改。正文没讲 AI 具体怎么消费这些 HTML——是截图还是解析 DOM?——但引了 Claude 那篇“HTML 的离谱有效性”。如果是真的,以后做原型、线框图、流程图都可以让 AI 直接改 HTML 文件,省掉截图再描述的步骤。不过目前...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
17:23
51d ago
Product Hunt · AI· rssEN17:23 · 08·02
等 Claude Code 跑代码时抓宝可梦
claudemon 把等 Claude Code 干活的时间变成了游戏。每发一次提示算一步,之后每 20 秒自动再走一步,草丛里可能跳出宝可梦,状态栏会提醒你,在另一个终端标签页里对战。收录了全部 151 只初代宝可梦,完全本地运行,不用注册账号。正文没提是否支持其他终端工具。
#Claude Code#Sergio Zamarro
一句话点评
把等 Claude Code 跑代码的空白时间变成抓宝可梦,每发一次提示或等 20 秒就算走一步,草丛里随机跳出初代 151 只。全本地运行,不用注册,但正文没提是否支持其他终端工具。好玩但别指望提升效率。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
16:57
51d ago
r/LocalLLaMA· rssEN16:57 · 08·02
有人把Qwen模型的一次生成结果全晒出来了,1109条输出随便对比
Reddit用户分享了一个数据集,包含1109条Qwen模型的一次性生成输出,方便大家横向对比不同模型的表现。帖子正文被屏蔽,没透露具体用了哪些模型版本、什么任务或评测指标——只知道这些是原始输出,可以直接拿来比较。如果你想快速看看Qwen系列模型在同样输入下的差异,这个数据集是个现成的起点。
#Qwen#Open source
一句话点评
1109条Qwen模型的一次性生成输出,可以直接拿来横向对比。但正文被屏蔽,没披露用了哪些模型版本、什么任务、评测指标——所以只能看输出文本,没法判断质量或公平性。如果你只是想快速扫一眼不同Qwen模型在同样输入下的差异,这个数据集是个现成的起点;但要做严谨对比,信息缺口太大。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K0·R0
13:26
51d ago
AI HOT 精选· aihot-apiZH13:26 · 08·02
实测MiniMax H3做后期和动效:视频界的审美王来了
这篇文章标题说MiniMax H3在视频后期和动效上表现很好,甚至称它为“审美王”。但正文被微信屏蔽了,只留了个验证码页面,所以没有任何实测细节、模型参数或对比数据。目前只能看到标题,没法判断它到底强在哪、跟其他模型比怎么样。
#MiniMax
一句话点评
标题吹MiniMax H3是视频后期“审美王”,但正文被微信屏蔽,只剩验证码页面。没有实测、参数或对比,没法判断它到底强在哪。建议等能访问的版本再评估,目前信息量为零。
HKR 分解
hook knowledge resonance
打开信源
15
SCORE
H0·K0·R0
13:00
51d ago
The Verge · AI· rssEN13:00 · 08·02
给艺术家分钱,就能让他们接受AI吗?
AI视频生成平台Pippa想用收入分成来拉拢艺术家,核心问题是:光靠钱能不能消除创作者对AI的抵触?正文没披露具体分成比例和注册人数,所以这点先别太激动。如果分成比例够高,确实可能吸引一批人试试,但艺术家对AI的顾虑不只是钱,还有作品被拿去训练、风格被模仿等。
#Pippa
一句话点评
AI视频平台Pippa想用收入分成拉拢艺术家,但正文没披露具体分成比例和注册人数,这点先别太激动。如果比例够高,确实可能吸引一批人试试,但艺术家对AI的顾虑不只是钱,还有作品被拿去训练、风格被模仿等。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R1
12:38
51d ago
Product Hunt · AI· rssEN12:38 · 08·02
Papaya:用手机本地AI给你的性生活画张卡通总结
Papaya 是一款手机 App,它通过监听性爱过程中的声音和动作,在本地生成一张卡通风格的“事后总结图”,还会自动起个标题(比如有用户收到的是“比电梯游说还快”)。全程不需要注册账号、不上传云端、不保存音频。对 AI 从业者来说,这是一个很干净的端侧推理 demo:完全本地运行、隐私优先、用轻量模型做实时音频分析。正文没披露具体用了什么模型或推理框架。
#Papaya#Petros Tepoyan
一句话点评
Papaya 是一款手机 App,通过监听性爱声音和动作,在本地生成卡通“事后总结图”,还会自动起标题(比如“比电梯游说还快”)。全程不注册、不上传、不存音频。对 AI 从业者来说,这是一个干净的端侧推理 demo:完全本地运行、隐私优先、用轻量模型做实时音频分析。正文没披露具体用了什么模型或推理框架。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
11:53
51d ago
Hacker News 首页· rssEN11:53 · 08·02
94.8%的中小企业网站从未被AI回答引用
一项对458个域名的审计发现,近95%的中小企业网站在AI助手回答购买意图问题时从未被提及。在5978条助手回答中,只有1.9%提到了被审计的企业。Gemini的引用率最高,为2.9%,而ChatGPT、Claude和Perplexity的引用率均在1.6%左右。8.9%的网站屏蔽了至少一个AI爬虫,但大多数屏蔽的是训练爬虫(如GPTBot),而非检索...
#Website Auditor#Gemini#ChatGPT
一句话点评
近95%的中小企业网站在AI回答购买意图问题时从未被提及,只有1.9%的回答提到了被审计企业。Gemini引用率最高(2.9%),ChatGPT、Claude和Perplexity都在1.6%左右。8.9%的网站屏蔽了至少一个AI爬虫,但多数屏蔽的是训练爬虫(如GPTBot),而非检索爬虫(如OAI-SearchBot),后者才影响被引用。仅19.3%的网站部署了LocalBusiness结...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
10:51
51d ago
Product Hunt · AI· rssEN10:51 · 08·02
Inventory:给AI聊天记录做个本地搜索引擎
Inventory 把 Cursor、Claude Code、Zed、Codex 和 Kiro 的对话历史全部索引到本地,不用注册、不上云、一次付费。如果你每天在好几个AI编辑器之间来回切,找之前聊过的东西确实很痛苦——它终于让聊天记录变得可搜索了。正文没披露具体定价和搜索延迟,但纯本地意味着隐私有保障,代价是存储得自己管。
#Inventory#Cursor#Claude Code
一句话点评
一个本地索引工具,把 Cursor、Claude Code 等五个 AI 编辑器的聊天记录全搜到一起。一次付费,不上云,隐私有保障。痛点很真实——多编辑器切换时找历史对话确实麻烦。但正文没披露搜索延迟和具体定价,纯本地意味着存储得自己管,索引速度未知。如果是重度多编辑器用户值得一试,否则等评测。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
10:47
51d ago
AI HOT 精选· aihot-apiZH10:47 · 08·02
Codex 让 Sol 指挥 Luna Max 干活,产出翻倍还省额度
这条推文讲了一个 Codex 的高阶用法:在 ~/.codex/agents/ 目录下建一个叫 luna-worker.toml 的子代理,模型选 gpt-5.6-luna,推理强度拉到最高。Sol 只负责拆任务和审代码,具体实现全扔给 Luna Max 去做。标题说这样能省额度、产出翻倍,但正文没披露省了多少额度、翻倍是怎么算的——我会先打个折,这点...
#Code#Codex#Sol#Luna Max
一句话点评
让 Sol 当项目经理,Luna Max 当码农,省额度靠把重活丢给更便宜的模型。正文没披露省了多少、翻倍怎么算,先打个折。如果是真的,等于白嫖一个高级打工仔。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
08:42
51d ago
r/LocalLLaMA· rssEN08:42 · 08·02
WinterMix:Qwen3.5-122B的MLX版,82GB比94GB量化版还强,还有68GB的集群版
社区放出了一个叫 WinterMix 的 Qwen3.5-122B-A10B 原生 MLX 构建。亮点是 82GB 的版本性能超过了 94–95GB 的量化版,相当于用更少显存跑出更好效果,对本地部署很友好。另外还有一个 68GB 的变体,专门给 agent 集群(让多个模型实例协同干活)用。不过正文没披露具体跑分、推理速度或最低硬件要求,所以实际提升...
#Qwen#MLX#Open source
一句话点评
社区搞了个WinterMix,把Qwen3.5-122B的MLX版压到82GB,性能反而超过94-95GB的量化版,显存省了十几GB,本地跑大模型更划算了。还有个68GB的变体专给agent集群用,适合让多个模型实例协同干活。不过正文没披露具体跑分和推理速度,也没说最低硬件要求,所以实际提升有多大、能不能跑起来还得自己试。如果是真的,挺省钱。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R0
07:58
51d ago
Hacker News 首页· rssEN07:58 · 08·02
Cyber v0.3:一门为速度和并发设计的新脚本语言
Cyber 是一门新脚本语言,主打快、省内存、好并发。跑斐波那契递归,VM 模式 19 毫秒、内存 2.9 MB,JIT 模式只要 5 毫秒——比 LuaJIT 稍快一点,比 Python 快三倍以上。它同时支持动态和静态类型,用 fiber(轻量协程)做并发,内存安全,还能通过 FFI 调 C 库或嵌入到其他应用里。不过正文没披露包管理、社区规模、生...
#Cyber#LuaJIT#Python#Open source
一句话点评
Cyber 是一门新脚本语言,跑斐波那契递归 JIT 模式只要 5 毫秒、内存 2.9 MB,比 Python 快三倍以上,跟 LuaJIT 打平。支持动态/静态类型、用 fiber 做轻量协程、内存安全、能调 C 库或嵌入应用。但正文没披露包管理、社区规模、生态成熟度,这些对实际落地很关键。如果是真的挺省钱,但先别太激动,等生态补上再说。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
06:59
51d ago
Hacker News 首页· rssEN06:59 · 08·02
Comp AI 开源了一个以 AI 为核心的 CRM,让模型自动跟进客户、分配任务、更新记录
这个 CRM 把 AI 代理(agent)放在工作流中心,而不是像传统 CRM 那样只加个聊天插件。系统能自动处理客户跟进、任务分配和记录更新,减少手动录入。项目在 GitHub 上已有 1k 星,但正文没披露支持哪些模型、怎么部署,也没说效果验证数据。如果是真的,对销售团队来说能省不少人力成本,但实际落地效果和稳定性还得看后续披露。
#Comp AI#GitHub
一句话点评
Comp AI 开源了一个以 AI 代理(agent)为核心的 CRM,让模型自动处理客户跟进、任务分配和记录更新,而不是像传统 CRM 那样只加个聊天插件。GitHub 上已有 1k 星,但正文没披露支持哪些模型、怎么部署,也没说效果验证数据。如果是真的,对销售团队来说能省不少人力成本,但实际落地效果和稳定性还得看后续披露。 短评:把 CRM 的活交给 AI 代理,省手动录入,但缺模型和...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
06:23
51d ago
AI HOT 精选· aihot-apiZH06:23 · 08·02
Grok 现在能分析任意视频了
马斯克发推说 Grok 可以分析任何视频,并附了一个链接。正文没提支持哪些格式、处理速度多快、能分析多长的视频,也没说有没有文件大小限制。目前只能当个功能预告看,具体好不好用得等实测。
#xAI#Elon Musk
一句话点评
马斯克发推说 Grok 现在能分析任意视频,附了个链接。正文没提支持哪些格式、处理速度多快、能分析多长视频,也没说文件大小限制。目前只能当功能预告看,具体好不好用得等实测。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
06:05
51d ago
Product Hunt · AI· rssEN06:05 · 08·02
Termexo:给 Claude Code 和 Codex 用的 Windows 本地工作台
Termexo 是一个 Windows 桌面工具,把 Claude Code 和 Codex 整合到一个可恢复的本地工作区里。你可以用自定义网格布局同时跑多个真实 PTY 终端(就是真正的命令行窗口),支持会话搜索和恢复,Agent 需要审批时会弹通知,还能切换 Claude 兼容的模型配置而不用重设环境变量。本地运行,不需要注册账号。对 Window...
#Termexo#Claude Code#Codex
一句话点评
Termexo 把 Claude Code 和 Codex 塞进一个 Windows 桌面工作区,支持多终端网格布局、会话搜索恢复、Agent 审批弹窗,还能切换模型配置。本地运行免注册。对 Windows 上同时跑多个 AI 编码 Agent 的开发者挺实用,但正文没披露性能开销和稳定性数据,多终端高负载下会不会卡顿未知。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
05:14
51d ago
Product Hunt · AI· rssEN05:14 · 08·02
Octomind Cloud:一次登录、零 API Key,直接调 27 个模型
Octomind 出了个新服务 Cloud 和 Hub,主打让云端的 AI agent 一次登录就能用 27 个模型,不用自己管 API key。对开发者来说省了配置和密钥管理的麻烦,但正文没披露具体支持哪些模型、定价和延迟,所以实际好不好用、贵不贵还得等更多信息。
#Octomind
一句话点评
Octomind 出了个 Cloud 和 Hub,号称一次登录就能用 27 个模型,不用自己管 API key。对开发者来说省了配置和密钥管理的麻烦,但正文没披露具体支持哪些模型、定价和延迟,所以实际好不好用、贵不贵还得等更多信息。 短评:一次登录调27个模型,省了配API key的麻烦,但没提价格和延迟,先别急着冲。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
04:42
51d ago
AI 群聊日报· atomZH04:42 · 08·02
DS V4 Flash 口碑一日反转,OpenAI 新模型 Astra 花 2000 美元解开十道数学难题
DS V4 Flash 的口碑在一天内坐了个过山车。凌晨大家还在夸它长文本处理能力翻身了,傍晚实测就翻车:让它读规则文件,它承认根本没执行;还幻觉自己重启了服务器,把用户吓一跳。群里有人损它“快而笨”是完美产品策略——用户试一下觉得真快,然后回去用 Claude,GPU 也不会被烧冒烟。更值得关注的是 OpenAI 下一代模型 Astra 在十个停滞超...
#Reasoning#Code#DeepSeek#OpenAI
一句话点评
DS V4 Flash 一天内口碑翻车:凌晨夸长文本翻身,傍晚实测发现它根本不读规则文件,还幻觉自己重启了服务器。群里损它“快而笨”是完美产品策略——用户试完觉得真快,然后回去用 Claude,GPU 也不会被烧冒烟。OpenAI 下一代模型 Astra 在十个停滞超十年的数学开放问题上给出新结果,全部附 Lean 形式化证明,API 推理成本仅约 2000 美元。有人称这是数学的李世石时刻...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R1
04:07
51d ago
Hacker News 首页· rssEN04:07 · 08·02
别把功劳算在 LLM 头上
Isaac Su 发现身边越来越多人喜欢在汇报或发文档时加一句“据某模型说”或“这是某模型写的”。他拆解了四种可能动机:觉得用了工具像作弊、想借模型表现给自己贴金、压根没检查就发出来、或是公司强制要求用 AI 所以先打预防针。他的核心观点是,工具没法被追责,就不该分走功劳。东西做得好,你全权领走;做得烂,也自己扛下来改进。别让一句“AI 可能出错”稀释...
#Isaac Su
一句话点评
短评:别把AI当免责声明,东西是你做的,好坏都该你扛。 Isaac Su这篇博客点出了一个在AI从业者圈里越来越常见的现象:交活时总爱加一句“这是某模型写的”或“据某模型说”。他拆了四种动机——觉得用AI像作弊、想借模型给自己贴金、压根没检查就发、公司强制用AI所以先打预防针。核心论点很干脆:工具没法被追责,就不该分走功劳。东西做得好,你全权领走;做得烂,也自己扛下来改进。别让一句“AI可...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
02:00
51d ago
量子位 · 公众号· rssZH02:00 · 08·02
华为诺亚开源 MindMemOS:让 AI Agent 不再每次对话都“失忆”,记忆和技能一起进化
华为诺亚方舟实验室开源了一个叫 MindMemOS 的框架,核心是解决 AI Agent 的“用完即忘”问题——每次新对话都从零开始,没有长期记忆。它让 Agent 能记住之前的交互,并且技能也跟着积累进化,相当于给 Agent 装了个“大脑皮层”。不过正文被 CAPTCHA 挡住了,技术细节、代码仓库和跑分都没披露,目前只能确认标题说的这个方向。
#Huawei Noah's Ark Lab#MindMemOS
一句话点评
华为诺亚开源了 MindMemOS,号称让 Agent 不再“用完即忘”,能记住历史对话并积累技能。但正文被 CAPTCHA 挡住,代码、跑分、技术细节全没披露。方向是对的——长期记忆是 Agent 落地的关键短板,但没看到具体实现和效果,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R1
01:56
51d ago
Hacker News 首页· rssEN01:56 · 08·02
CostPerPrompt 实时追踪 232 个模型的 API 报价,并帮你估算真实落地成本
这个工具把各家大模型的 API 价格拉出来直接比,数据更新到 2026 年 8 月 2 号。它不止列价格表,还做了几个计算器,让你能算聊天机器人、多步智能体、外挂资料库、语音 AI 和图片 API 一个月大概要花多少钱。智能体计算器专门提醒,因为模型会反复调用工具、循环推理,实际开销可能是你简单估算的 10 到 30 倍。在旗舰模型里,DeepSeek...
#Benchmarking#CostPerPrompt#OpenAI#Anthropic
一句话点评
这个工具把232个模型的API价格拉出来直接比,还做了几个计算器帮你算实际开销。最有用的是智能体计算器,它直接提醒你:模型反复调用工具、循环推理,实际花费可能是你简单估算的10到30倍。价格表里差距也很大,DeepSeek V4 Flash输入每百万token只要9美分,GPT-5.6 Sol要5美元,输出更是差到30美元对18美分。GPU租赁那边,同一张卡在不同供应商之间价差能到5倍。不过...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
00:06
52d ago
Hacker News 首页· rssEN00:06 · 08·02
温室与透镜:AI Agent 的两种工作模式
Aaron Brethorst 把 AI agent 的工作方式分成两种:温室模式——低成本试错,让模型随便生成一堆东西,再挑好用的,适合探索和碰运气;透镜模式——目标明确,集中火力只做一件事,适合执行已知任务。真正的能力不是选哪个模式,而是能判断当前该用哪个,以及发现自己跑偏时能拉回来。作者举了自己的例子:用 Claude Code 做了一堆画图工具...
#Aaron Brethorst#Claude Code
一句话点评
Aaron Brethorst 把 AI agent 工作方式分成两种:温室模式(低成本试错,随便生成一堆再挑好用的)和透镜模式(目标明确,集中火力干一件事)。真正厉害的不是选哪个,而是能判断当前该用哪个,跑偏了能拉回来。他举了自己用 Claude Code 做画图工具和 Markdown 转 Word 小工具的例子——成本降到几乎为零,所以可以随便试。这点先别太激动,因为作者没给任何量化数...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0

更多

频道

后台