ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-08-21

50 items · updated 3m ago
RSS live
2026-08-21 · 星期五2026年8月21日
23:19
32d ago
r/LocalLLaMA· rssEN23:19 · 08·21
MacBook Air M2 跑 Qwen 3.8 27B 量化版做编程代理,63小时后飞行模拟器居然能跑
有人在 MacBook Air M2(24GB 内存)上跑了 3bit 量化的 Qwen 3.8 27B 模型,让它以 agent 模式写代码。整个过程花了 63 小时,但最终生成的飞行模拟器居然能正常运行。63 小时说明本地小内存跑大模型做 agent 非常慢,但能跑通也说明量化后的模型在简单编程任务上还有可用性。Reddit 正文被屏蔽,所以没有工...
#Qwen#MacBook Air M2
一句话点评
有人在 MacBook Air M2(24GB)上拿 3bit 量化的 Qwen 3.8 27B 跑 agent 写代码,花了 63 小时,最后生成的飞行模拟器居然能跑。63 小时说明本地小内存跑大模型做 agent 慢到离谱,但能跑通也说明量化后的模型在简单编程任务上还有可用性。Reddit 正文被屏蔽,没有 workflow、代码质量或 token 消耗细节,所以这个结果只能当个“能跑”...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
23:00
32d ago
最佳拍档· atomZH23:00 · 08·21
Cursor 推出代码托管平台 Origin,直接叫板 GitHub
AI 编程工具 Cursor 正式发布了自己的代码托管平台 Origin,目标就是跟 GitHub 抢开发者。标题里提到了 Stacked PR(一种把大改动拆成小 PR 的协作方式)、AI Agent 和 Copilot,暗示 Origin 会深度集成 AI 能力,比如让 AI 自动帮你管理分支、合并代码。但正文完全没披露具体功能、定价和上线时间,所...
#Code#Cursor#GitHub#Origin
一句话点评
Cursor 自己搞了个代码托管平台 Origin,明摆着要跟 GitHub 抢人。标题里提了 Stacked PR(把大改动拆成小 PR 协作)和 AI Agent,暗示会让 AI 自动管分支、合并代码。但正文一个字都没披露具体功能、定价和上线时间——这点先别太激动,目前就是个占坑宣言。如果真能靠 AI 把 Git 操作自动化,对开发者挺省事,但 GitHub 的生态和用户习惯不是那么好撬的。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R1
22:37
32d ago
TechCrunch AI· rssEN22:37 · 08·21
英伟达又砸几亿美元入股数据中心中间商 Cloverleaf
英伟达宣布与 Cloverleaf Infrastructure 达成战略合作,投了数亿美元拿少数股权。Cloverleaf 2024 年成立,之前融了 3 亿美元,干的活是在电网和数据中心之间当中间人——帮数据中心搞定电力供应和场地基础设施。这笔钱是英伟达把利润再投回 AI 基建的一部分,这周早些时候它刚给 SB Energy 投了 15 亿美元。正...
#Nvidia#Cloverleaf Infrastructure#SB Energy#Funding
一句话点评
英伟达投了数亿美元拿Cloverleaf少数股权,这家2024年成立的公司专帮数据中心搞定电网和场地,之前已融3亿美元。加上本周刚给SB Energy投15亿,英伟达在把卖芯片赚的钱再投回AI基建。但正文没披露Cloverleaf估值和具体投资额,这笔交易到底贵不贵不好说。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
22:29
32d ago
Hacker News 首页· rssEN22:29 · 08·21
成熟三步:别信自己想的每件事
前谷歌安全研究员 Thomas Dullien 在父亲去世后写了这篇反思。第一,别太焦虑自己的工作有多大影响——历史会绕过你,焦虑其实是自我感动。第二,计算机里的“单一原因决定论”是假象,真实世界是概率的、多原因的,连对齐好的模型也扛不住推理时的随机比特翻转。第三,理性和情绪不是对立的,这是西方文化编出来的;你的肠道神经元数量跟狗的大脑皮层一样多,情绪...
#Thomas Dullien#Google
一句话点评
前谷歌安全研究员 Thomas Dullien 在父亲去世后写了篇人生反思,对 AI 从业者有两处值得听:一是别太焦虑自己的工作有没有历史影响——历史会绕过你,焦虑只是自我感动;二是计算机里的“单一原因决定论”是假象,真实世界是概率的、多原因的,连对齐好的模型也扛不住推理时的随机比特翻转。他提醒:别信自己脑子里冒出来的所有想法,先检查自己的利益动机。正文没披露具体实验或数据,更像个人随笔,但...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
21:25
32d ago
The Verge · AI· rssEN21:25 · 08·21
LinkedIn 的 AI 生成帖子按钮被点了超过 100 万次
LinkedIn 新推出的 AI 写帖子功能,一个按钮就能帮你生成“专业”动态,目前已被点击超过 100 万次。但很多人吐槽生成的内容质量低,像“AI 废话”。文章没说明这个按钮具体出现在哪里,也没说有多少人真的把生成的帖子发出来了。
#LinkedIn
一句话点评
LinkedIn 的 AI 写帖按钮被点了 100 万次,但用户普遍吐槽生成内容像“AI 废话”。文章没披露按钮具体在哪、有多少人真的发了帖,所以这个点击量水分不小——点一下看看效果不等于真用。如果大部分只是尝鲜,那这功能对平台内容生态的实际影响要打折。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
19:51
32d ago
Hacker News 首页· rssEN19:51 · 08·21
一周体验:Codex 比 Claude 更技术向,但 Claude 更懂你
一位 Ruby 开发者分享了一周用 Codex 多于 Claude 的感受。Codex 生成的代码更干净,注释少、架构简单,但 Claude 在紧急调试时更顺手,猜意图也更准。Codex 改代码快,但做完主改动后跑测试、走审查的时间差不多,最终完成一个 PR 的总时长没优势。Codex 在 Jira 集成上折腾——浏览器和 CLI 来回跳,Claude...
#Codex#Claude#Lucian Ghinda
一句话点评
一位 Ruby 开发者用了一周 Codex 和 Claude 后对比:Codex 生成的代码更干净、注释少、架构简单,但 Claude 在紧急调试时更顺手,猜意图更准。Codex 改代码快,但做完主改动后跑测试、走审查的时间差不多,最终完成一个 PR 的总时长没优势。Codex 在 Jira 集成上折腾——浏览器和 CLI 来回跳,Claude 则更主动。核心差异:Claude 会多做一步,...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
19:16
32d ago
Hacker News 首页· rssEN19:16 · 08·21
Rust Glancer:一个只占 rust-analyzer 1% 内存的 LSP 服务器
Rust Glancer 是一个能用的 LSP 服务器,内存占用比 rust-analyzer 低两个数量级。作者 matklad(rust-analyzer 核心开发者)认为 rust-analyzer 的架构“像画了一半的马”——它对用户永远不会看的依赖也做增量解析,白白浪费内存。他建议学 IntelliJ 的做法:打开的文件用完整语法树,其余项目...
#Code#rust-analyzer#Rust Glancer#IntelliJ
一句话点评
Rust Glancer 是一个能用的 Rust LSP 服务器,内存占用比 rust-analyzer 低两个数量级(约 1/100)。作者 matklad(rust-analyzer 核心开发者)直言 rust-analyzer 架构“像画了一半的马”——对用户永远不会看的依赖也做增量解析,白白浪费内存。他建议学 IntelliJ:打开的文件用完整语法树,其余项目文件用紧凑的存根树,依赖...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
17:33
32d ago
Hacker News 首页· rssEN17:33 · 08·21
Circleback 把 Electron 里的会议录制引擎用 Swift 重写了
Circleback 桌面端原本在 Electron 的渲染进程里做音视频录制,但浏览器运行时的垃圾回收和节流机制经常打断实时采集,导致录制不稳定。他们花了两个月用 Swift 重写了整个引擎:macOS 上用 ScreenCaptureKit,Windows 上用 libobs,还做了个叫 Atomic 的内部工具,能自动把 Swift 里的 @Pu...
#Circleback#Electron#Swift
一句话点评
Circleback 花两个月把 Electron 里的录制引擎用 Swift 重写了,因为浏览器渲染进程的垃圾回收和节流会打断实时音视频采集。macOS 用 ScreenCaptureKit,Windows 用 libobs,还做了个叫 Atomic 的内部工具,让 Swift 的 @Published 属性自动变成 React 的 Jotai atom,省掉手写绑定代码。正文没披露具体性...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
17:30
32d ago
Hacker News 首页· rssEN17:30 · 08·21
银河指南针 2 上线 AR 模式:一个靠 AI 写代码的个人项目,开发者说 AI 没让他停止学习
开发者 Matt Webb 更新了银河指南针应用,新增 AR 模式和 Apple Watch 版。App 显示一个指向银河系中心的绿色箭头。2024 年它曾因“氛围编码”走红——Webb 把 ChatGPT 的代码直接复制粘贴到 Xcode 里。新版 AR 模式把箭头锚定在真实空间,你可以绕着它走。Watch 版因为 watchOS 不支持 Reali...
#Code#Matt Webb#Claude Fable#Apple
一句话点评
短评:氛围编码鼻祖更新了,AR 模式让箭头锚定在真实空间,Watch 版用 Claude 自建 3D 库。但别当技术突破看,更像个人项目秀。 点评:Matt Webb 的银河指南针 App 更新了,核心就两件事:AR 模式让你能绕着箭头走,Apple Watch 版用 Claude Fable 自己搭了 3D 图形库(因为 watchOS 不支持 RealityKit)。2024 年这 A...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
16:47
32d ago
Hacker News 首页· rssEN16:47 · 08·21
Proliferate:一个开源、能自己部署的编程 IDE,让多个编程智能体同时干活
Proliferate 把 Claude Code、Codex、OpenCode 这些编程智能体塞进同一个界面里,让它们能在本地或云端并行跑任务,你还可以把常用的工作流存下来重复用。项目在 GitHub 上开源,目前有 196 个星标和 49 个复刻,属于早期工具。正文没提它支持哪些模型后端、吃多少资源、延迟怎么样,所以性能这块先别太激动,得自己试了才知道。
#Code#Proliferate#Claude Code#Codex
一句话点评
Proliferate 把 Claude Code、Codex 等编程智能体塞进一个界面,支持本地或云端并行跑任务,还能存工作流复用。开源,196 星,早期工具。正文没提支持哪些模型后端、吃多少资源、延迟如何,性能先别太激动,得自己试。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
16:27
32d ago
Hacker News 首页· rssEN16:27 · 08·21
用闲置 i7 服务器搭了个全自托管 AI 软件工厂
Jake Saunders 用一台闲置的 10 代 i7 服务器(32GB 内存)搭了一套完全自托管的 AI 开发流水线。从一条提示开始,AI 能自动创建代码仓库、写代码和测试、跑 CI、部署应用并配好 HTTPS 和数据库。核心思路是把 AI 隔离在独立硬件上,不开放公网入口,只通过 Tailscale 访问。推理用的是 OpenAI Codex,每...
#Code#Jake Saunders#OpenAI Codex#Coolify
一句话点评
Jake Saunders 用一台闲置的 10 代 i7 服务器(32GB 内存)搭了一套完全自托管的 AI 开发流水线。从一条提示开始,AI 能自动创建代码仓库、写代码和测试、跑 CI、部署应用并配好 HTTPS 和数据库。核心思路是把 AI 隔离在独立硬件上,不开放公网入口,只通过 Tailscale 访问。推理用的是 OpenAI Codex,每月 20 美元。演示只做了一个简单的重量...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
16:25
32d ago
Hacker News 首页· rssEN16:25 · 08·21
Kobo 电子阅读器现在能装第三方应用了
Cobalt 是一个给 Kobo 阅读器用的开源应用平台。用 USB 装一次,之后就能在设备上通过 Wi-Fi 装、更新、删应用,重启就回到原系统。目前能用的应用包括 arXiv 论文阅读器、Hacker News 客户端、AI 聊天、有声书制作工具,还有一个叫 Sidekick 的工具,能把 Claude Code 的问题推到墨水屏上,点一下就能选答...
#BandarLabs#Cobalt#Kobo#Open source
一句话点评
Kobo 阅读器现在能装第三方应用了,USB 装一次 Cobalt 平台,之后就能 Wi-Fi 装/删应用,重启回原系统。目前有 arXiv 论文阅读器、Hacker News 客户端、AI 聊天、有声书制作工具,还有个 Sidekick 能把 Claude Code 的问题推到墨水屏上点选回答。每个应用都是独立无特权进程,签名验证后才运行。开源,但只支持 Kobo Clara BW 等型号...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
15:59
32d ago
Hacker News 首页· rssEN15:59 · 08·21
LLM 证明了 Unix 赢了
作者认为,LLM 本质上就是 Unix 哲学的最新体现:把自然语言指令翻译成 shell 管道,让不懂命令行的用户也能用上 grep、awk 这些老工具。文章用了一个具体例子——让 LLM 把“从 Python 文件里提取 url 变量中的域名并统计次数”这个需求转成一行 shell 命令,结果跟作者手写的差不多。作者没讨论模型架构、跑分或具体能力,核...
#Code#Unix#Linux#POSIX
一句话点评
这篇博客把LLM比作Unix哲学的终极体现——自然语言当管道,把不懂命令行的用户也拉进了grep/awk的世界。作者展示了一个例子:让LLM把“从Python文件提取url域名并统计”的需求转成一行shell命令,结果跟手写差不多。观点有趣,但全文是个人感悟,没有跑分、没有模型对比、也没有用户测试数据。适合当文化评论看,别当技术判断。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
15:51
32d ago
● P1Hacker News 首页· rssEN15:51 · 08·21
Nari Labs 开源 Qwen3-TTS 部署方案,首音延迟压到 50 毫秒以内
Nari Labs 开源了一套 Qwen3-TTS 1.7B 的部署方案,在一张 H100 上做到 10 并发请求时,95% 的用户听到第一个字的时间不超过 50 毫秒,且播放不卡顿。他们对比了 vLLM-Omni、SGLang-Omni 等四个引擎,默认设置下最快的 p95 首音延迟也要 277 毫秒。核心优化有两招:一是动态切掉模型开头几十毫秒的静...
#Inference-opt#Nari Labs#Qwen#NVIDIA
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Nari Labs 把 Qwen3-TTS 的首音延迟压到了 50 毫秒以内,单卡 H100 能扛 10 并发,成本约每百万字符 2 美元,比商业 API 便宜一个数量级。
锐评
这条值得关注的点是延迟和成本一起打下来了。他们用一张 H100 跑 Qwen3-TTS 1.7B 模型,在 10 个并发请求下,95% 的用户听到第一个字的时间不超过 50 毫秒,每秒能生成约 630 个字符。换算下来,满负荷运转时每百万字符的成本大概 2 美元。作为对比,正文里引用的 ElevenLabs V3 是 100 美元,Cartesia Sonic 3.5 是 49 美元,差距确实大。 不过有几个地方要先打个折。首先,这个成本是按云 GPU 的裸金属租用价算的,没算人力、运维和闲置损耗,实际跑服务的成本会更高。其次,他们只测了五分钟的压测,长时间高负载下的稳定性、音质劣化情况都没给数据。另外,方案里用了一个动态裁剪静音的小技巧来扣掉模型输出开头的空白,这 80 毫秒的优化不来自推理加速本身,别理解成模型变快了。 代码和基准测试都开源了,这点好评。但正文没披露具体的音质 MOS 分或 A/B 测试结果,只说用 Deepgram 做了转写验证可懂度。如果你在乎的是声音自然度而不是纯快,还得自己跑一遍主观评测。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
15:44
32d ago
Hacker News 首页· rssEN15:44 · 08·21
Pianoify:浏览器里免费把音频转成钢琴谱
Pianoify 是一个纯浏览器端的工具,能把音频或 YouTube 链接转成钢琴 MIDI 和五线谱(MusicXML 格式)。它会把录音裁成 10 秒片段,一边解码一边在钢琴卷帘上实时显示音符,回放用的是采样的施坦威大钢琴音色,带延音踏板,还能和原录音交叉淡入淡出。支持 MP3、WAV、语音备忘录和和弦识别。全部在浏览器里跑,免费。正文没披露用了什...
#Pianoify
一句话点评
浏览器里跑音频转钢琴谱,免费,还带施坦威音色回放。但只处理10秒片段,长曲子得自己切。正文没提用了什么转录模型,也没给延迟和准确率数字,效果先打五折。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
15:21
32d ago
Hacker News 首页· rssEN15:21 · 08·21
阿里开源 AgentSight:不改一行代码,用 eBPF 给 AI 智能体做全链路监控
AgentSight 是阿里 Anolisa 项目下的一个可观测性工具,专门盯着 AI 智能体在运行时的每一步行为。它用 eBPF 技术直接从系统内核抓数据,不需要你在代码里埋点或装 SDK,部署时只要装一个 agent,对应用本身是透明的。它能自动追踪大模型调用、工具调用、向量数据库查询和 MCP 协议交互,把这些信息串成完整的调用链。正文没提性能开...
#Alibaba#Anolisa#Open source
一句话点评
阿里开源了一个叫 AgentSight 的工具,用 eBPF 技术从系统内核抓 AI 智能体的运行数据,不用改代码就能追踪大模型调用、工具调用和向量数据库查询。好处是部署透明,坏处是正文没披露性能开销和支持的语言/框架范围,这点先别太激动。如果是真的挺省钱,但实际效果得等跑起来才知道。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R0
14:31
32d ago
Hacker News 首页· rssEN14:31 · 08·21
让 Claude 闭嘴别学 BuzzFeed 说话
一个叫 Claudette 的开源项目,用 system prompt 加输出过滤,把 Claude 回复里那种“太棒了!让我们来探索吧!”的废话砍掉,让它直接给答案。作者在 README 里贴了配置示例和用法,适合受够了 AI 寒暄的开发者。正文没提具体模型版本或效果评测,但思路很直白:少废话,说正事。
#Claudette#GitHub#Anthropic Claude#Open source
一句话点评
Claudette 是个开源小工具,用 system prompt 加输出过滤,把 Claude 回复里“太棒了!让我们来探索吧!”这类废话砍掉,直接给答案。思路很直白:少寒暄,说正事。适合受够了 AI 客套的开发者。正文没提具体模型版本或效果评测,效果取决于 prompt 写得有多狠,自己试了才知道。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
14:16
32d ago
Hacker News 首页· rssEN14:16 · 08·21
搜索不再逼你思考,我们失去了什么
一篇博客反思搜索体验的退化:SEO 堆砌和 AI 生成内容把真正有用的答案埋得很深,AI 摘要省了点击但也省了验证。作者担心长期依赖这种便利会让人慢慢丧失对比来源、判断可信度的能力——就像肌肉不用会萎缩。不是反工具,而是提醒:当工具替你思考,你就丢了思考的习惯。正文没提具体数据或实验,观点偏个人体验,但问题本身值得留意。
一句话点评
短评:搜索变差不是错觉:SEO 堆砌 + AI 生成内容把真答案埋到第三页,AI 摘要省了点击也省了验证。作者担心长期依赖会让人丧失对比来源、判断可信度的能力——像肌肉不用会萎缩。 点评:这篇博客的核心判断很直白:搜索体验在退化,原因不是单一公司作恶,而是“讨好算法比正确更赚钱”的激励结构。作者点出两个关键变化:一是 AI 生成内容让“看起来对但实际错”的页面暴增,排名系统还没跟上;二是搜...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
14:08
32d ago
Ben's Bites· rssEN14:08 · 08·21
手把手搭个人智能体:一个文件夹加几个 Markdown 文件就行
Ben 分享了他从零搭建个人智能体的实操过程。核心思路很简单:建一个文件夹,里面放几个 Markdown 文件——主指令、代码偏好、待办、记忆指针,然后把 Claude 或 ChatGPT 指向这个文件夹就能开始对话。他本来想搞自动保存记忆,但发现 git 历史已经能追踪所有文件变更,再写一个日志文件就是重复劳动,所以砍掉了。另外他提醒,Codex 这...
#Claude#ChatGPT#Codex
一句话点评
Ben 分享了一个极简个人智能体搭建法:一个文件夹 + 几个 Markdown 文件(主指令、代码偏好、待办、记忆指针),然后让 Claude 或 ChatGPT 指向这个文件夹就能开聊。他本来想写日志文件自动保存记忆,但发现 git 历史已经能追踪所有文件变更,再写就是重复劳动,所以砍掉了。这点挺实在,省得自己多维护一个文件。另外他提醒,Codex 这类编程智能体会偏向建议代码相关的内容,...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
14:01
32d ago
Product Hunt · AI· rssEN14:01 · 08·21
OpenObserve 给 AI 加监控:原生接 OpenTelemetry,盯住生产里的 agent 和 LLM
OpenObserve 新功能主打 AI 可观测性,底层直接搭在 OpenTelemetry 上,不用额外改代码就能接入。目标是监控跑在生产流程里的 agent 和 LLM,比如看调用次数、响应时间、有没有报错。正文没披露具体支持哪些模型,也没给延迟指标,所以实际性能好不好还得自己测。对已经在用 OpenTelemetry 的团队来说,集成成本应该很低。
#OpenObserve
一句话点评
OpenObserve 新功能主打 AI 可观测性,底层直接搭在 OpenTelemetry 上,不用额外改代码就能接入。目标是监控跑在生产流程里的 agent 和 LLM,比如看调用次数、响应时间、有没有报错。正文没披露具体支持哪些模型,也没给延迟指标,所以实际性能好不好还得自己测。对已经在用 OpenTelemetry 的团队来说,集成成本应该很低。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
13:26
32d ago
Hacker News 首页· rssEN13:26 · 08·21
Nvidia 的 AVO 系统在 ARC-AGI-3 交互推理测试里拿了满分
ARC-AGI-3 是个让模型通过提问和操作界面来解谜的测试,AVO 这次直接做到 100% 全对。不过目前只有一条推文,没提 AVO 具体是什么结构、用了多少参数、跑一次要花多少钱。我会先打个折,等完整报告出来再看是不是真这么强。
#Reasoning#Agent#Nvidia#ARC Prize Foundation
一句话点评
Nvidia 的 AVO 在 ARC-AGI-3 上拿了 100% 满分,这个测试要求模型通过主动提问和操作界面来解谜,比纯文本推理更接近“动手能力”。但消息只有一条推文,正文没披露 AVO 是什么架构、参数量多大、跑一次要花多少钱。ARC-AGI-3 本身是交互式推理基准,难度比前两代高,满分确实少见,不过没看到技术报告前我会先打个折——不知道是不是针对这个测试专门优化过,也不知道泛化到其...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K0·R1
13:01
32d ago
AI HOT 精选· aihot-apiZH13:01 · 08·21
面壁智能开源 MathForm,一套把数学题自动转成 Lean 4 证明的工具、数据和模型
OpenBMB 放出了一个叫 MathForm 的流水线,专门把数学题自动写成 Lean 4 能验证的证明。他们搞了个 FormalVerse 数据集,里面有 36.7 万条已经验证过的例子。在同样用 10 万条样本训练的前提下,他们的模型在一致性检查上跑到 60.32%,比 FineLeanCorpus 的 46.53% 和 NuminaMath-L...
#OpenBMB#面壁智能#Open source
一句话点评
面壁开源了 MathForm,能把数学题自动转成 Lean 4 可验证的证明。核心是 36.7 万条已验证的 FormalVerse 数据集,在 10 万条样本训练下,一致性检查 60.32%,比 FineLeanCorpus 的 46.53% 高出一截。但正文没披露模型参数量和推理速度,实际部署成本未知。如果是真的,对数学定理自动验证挺省钱。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R0
12:52
32d ago
Hacker News 首页· rssEN12:52 · 08·21
DuckDB v2.0 把用了 8 年的 SQL 解析器换掉了,换成了一套不会打架的 PEG 语法
DuckDB 宣布在 v2.0 里把从 PostgreSQL 继承来的 YACC/Bison 解析器换成了 PEG 解析器。旧解析器从 2018 年项目第一行代码就在用,但每次给 SQL 加新功能都像走钢丝——改一点语法就可能触发 shift/reduce 冲突,维护起来越来越痛苦。新 PEG 解析器在设计上就避免了这类语法冲突,还支持在运行时加载扩展...
#DuckDB#DuckDB Labs
一句话点评
DuckDB v2.0 把用了八年的老解析器(从 PostgreSQL 继承的 YACC/Bison)换成了 PEG 解析器。旧解析器每次加 SQL 新语法都容易触发 shift/reduce 冲突,改起来像走钢丝。新 PEG 设计上就避免了这类冲突,还支持运行时加载扩展。官方强调这只是解析器实现换了,DuckSQL 方言不变。正文没披露 v2.0 的发布日期。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
11:48
32d ago
Hacker News 首页· rssEN11:48 · 08·21
我正变得对 AI 内容“失明”
Rafal Cymerys 发现自己的大脑开始自动跳过那些 AI 痕迹很重的文档。比如满口“Redis 骨干重塑产品”的营销稿,或者像把大模型内心独白直接贴出来的技术规格书。他把这比作“横幅广告盲视”:被大量空洞的 AI 生成内容训练后,脑子学会了识别并直接忽略低水平的 AI 产出。文章最后附了一张菜单照片,上面的 AI 生成图把一块蛋饼拍得像长了霉,...
#Rafal Cymerys#Florian Roth
一句话点评
作者发现自己大脑开始自动屏蔽 AI 痕迹重的文档,就像当年学会无视网页横幅广告一样。他举了几个例子:设计文档满口“第一道门是真实的”这种 Claude 味表述;营销稿把 Redis 写成“骨干重塑产品”;技术规格书读起来像大模型在自言自语。这些内容共同点是词藻华丽但信息密度低,脑子被大量空洞的 AI 生成内容训练后,学会了直接跳过。文章最后附了一张菜单照片,AI 生成的蛋饼图看起来像长了霉,...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K0·R1
11:00
32d ago
FT · 科技· rssEN11:00 · 08·21
散户想冲Anthropic IPO?先看完这篇再动手
FT发了一篇给散户的提醒:别急着买Anthropic的IPO。正文没披露发行价、估值和时间表,只建议先搞懂风险。AI公司IPO通常估值高、盈利路径模糊,散户容易高位接盘。这点先别太激动,等更多信息出来再说。
#Anthropic#Financial Times
一句话点评
FT提醒散户别急着冲Anthropic的IPO,但正文没披露发行价、估值和时间表,只建议先搞懂风险。AI公司IPO通常估值高、盈利路径模糊,散户容易高位接盘。这点先别太激动,等更多信息出来再说。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
10:54
32d ago
Product Hunt · AI· rssEN10:54 · 08·21
Mastra Factory:从提需求到上线,全交给AI代理跑
这是一个号称能从issue直接跑到生产环境的AI代理工具。正文没披露具体怎么跑、支持哪些平台,但标题和描述指向全自动的代理工作流——让模型进业务流程干活。如果是真的,能省掉不少人工编排的功夫,但验证信息太少,先别太激动。
#Mastra
一句话点评
Mastra Factory 号称能从 issue 直接跑到生产环境,让 AI 代理全自动干活。如果真能省掉人工编排,确实挺省钱。但正文就一句话,没披露怎么跑、支持哪些平台,验证信息太少,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
10:33
32d ago
● P1Hacker News 首页· rssEN10:33 · 08·21
DeepSeek 推出 deepseek-v4-flash-vision-exp 视觉模型支持图像输入
DeepSeek 的 API 文档里悄悄出现了一个新模型 deepseek-v4-flash-vision-exp,支持把图片和文字一起发给模型,让它描述画面、读截图里的文字或者分析图表。支持的图片格式有 JPEG、PNG、GIF 和 WebP。传图有三种方式:直接把图片转成 base64 塞进请求里(整个请求体不能超过 48 MiB);贴一个公网图片...
#Vision#DeepSeek
精选理由
精选 · 重要度 94 · 吸引力 + 知识量
一句话点评
DeepSeek 给 Flash 系列加上了眼睛,多模态 Agent 跑分直接追平 Opus-4.8,但注意这是个实验版,正文没提价格和推理成本。
锐评
DeepSeek 在 V4-Flash 的基础上推出了一个能看图的实验版模型。最值得关注的是它在需要视觉理解的 Agent 跑分上,相比纯文本版 Flash 有“大幅跃升”,官方甚至说多模态 Agent 能力已接近 Opus-4.8。这相当于给原本只处理文字的快思考模型装上了视觉,让它能直接看懂屏幕、图表和代码界面去干活。 不过,先别太激动。第一,这是个实验性模型,稳定性、延迟和实际生产表现都是未知数。第二,正文只给了一堆基准分,比如 Terminal Bench 2.1 拿了 83.9,但完全没有提 API 调用价格、上下文窗口限制和推理速度。对于想把模型塞进业务流程的人来说,这些信息比跑分更重要。第三,纯文本能力官方说和 Flash 正式版持平,这意味着这次升级主要就是视觉模块的接入,底子没变。 还缺什么?缺价格、缺速率限制、缺真实场景下的错误率。如果后续能补上这些,并且价格不离谱,那这个模型对需要做屏幕理解、图表分析或代码界面操作的自动化任务会很有吸引力。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R0
10:00
32d ago
FT · 科技· rssEN10:00 · 08·21
Waymo 去年游说支出翻倍至 290 万美元,直接跟 Uber 抢无人出租车许可
Waymo 去年把游说(lobbying)预算翻了一倍,花掉 290 万美元,目标很明确:跟 Uber 抢无人出租车的上路许可。290 万对科技公司来说不算大钱,但翻倍说明竞争在加速。正文没披露具体盯上了哪些州或政策,但逻辑很清楚——谁先拿到监管许可,谁就能先铺开运营。Uber 也在推自己的无人出租车计划,两边都在抢路权。
#Waymo#Uber#Policy
一句话点评
Waymo去年游说预算翻倍到290万美元,直接跟Uber抢无人出租车路权。290万对科技公司不算大钱,但翻倍说明竞争在加速。正文没披露具体盯上了哪些州或政策,但逻辑很清楚——谁先拿到监管许可,谁就能先铺开运营。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
09:45
32d ago
Hacker News 首页· rssEN09:45 · 08·21
HTMLcat:42 个原生 Web 小技巧,每个都带示例和兼容性提醒
一个叫 HTMLcat 的网站,收集了 42 个原生 HTML、CSS 和 JS 的小技巧,每个都配了简短示例和兼容性说明。覆盖了 `:has()`、`dialog` 元素、滚动驱动动画这些容易被遗忘但好用的平台能力。适合前端开发者快速翻一翻,捡回一些不常用但原生就支持的功能。正文没提更新频率,作者只留了个名字 Marco Mezzavilla,背景不详。
#Marco Mezzavilla
一句话点评
42 条原生 HTML/CSS/JS 小技巧,每条配示例和兼容说明,适合前端当备忘单翻翻。覆盖 `:has()`、`dialog`、滚动驱动动画等容易忘但好用的平台能力。作者 Marco Mezzavilla,背景不详,更新频率未提,当一次性资源看就行。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K1·R0
09:18
32d ago
最佳拍档· atomZH09:18 · 08·21
李飞飞对话神经科学家:空间智能是AI的下一个前沿
这是一期李飞飞与安德鲁·休伯曼的对谈,标题列了ImageNet、计算机视觉、空间智能、具身AI、Transformer和神经网络。李飞飞最近在推空间智能——让AI理解3D空间并能与之互动,不只是看平面图。休伯曼是神经科学家,所以对话很可能从人脑怎么处理视觉开始。正文没披露具体观点、时间线或技术细节,所以没法判断有没有新东西。
#Fei-Fei Li#Andrew Huberman#ImageNet
一句话点评
李飞飞和神经科学家休伯曼聊空间智能,标题看着大,但正文一个字没给,没法判断有没有新料。李飞飞最近主推空间智能——让AI理解3D空间并互动,不只是看图。休伯曼是研究人脑视觉的,对话很可能从生物视觉切入。但具体观点、时间线、技术细节全缺,没法判断是科普还是干货。短评:标题党嫌疑,等文字版再判断。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H1·K0·R1
06:59
32d ago
Hacker News 首页· rssEN06:59 · 08·21
在苹果芯片上跑 Linux 微虚拟机:Encore 重写了 Firecracker 的底层
Encore 团队把 Firecracker 微虚拟机栈移植到了苹果芯片上,让开发者能在 Mac 本地跑和线上一样的构建环境。过去四年,工程师得 SSH 到一台共享 Linux 机器,手动转换 Docker 层、rsync 镜像、再通过 SSH 重启容器。他们用苹果的 Virtualization.framework 替换了 KVM,并为 macOS ...
#Encore#Firecracker#Apple Silicon
一句话点评
Encore 把 Firecracker 微虚拟机移植到了 Apple Silicon 上,让 Mac 开发者能在本地跑和线上一样的构建环境。过去四年他们得 SSH 到共享 Linux 机器手动转换 Docker 层、rsync 镜像、再通过 SSH 重启容器,流程很痛苦。核心是用苹果的 Virtualization.framework 替换 KVM,并重写了 Linux 镜像工具链。但苹果...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
06:24
32d ago
Hacker News 首页· rssEN06:24 · 08·21
Argentic:给AI爬虫装个比特币收费站,每次请求收0.001美元
Argentic.network 上线了一个专为AI代理设计的付费网关。每次请求返回 HTTP 402 状态码,附带一张10聪(约0.001美元)的闪电网络发票;代理支付后获得1小时会话令牌。结算时间低于40毫秒,无需注册账号或API密钥。对开发者来说单次请求很便宜,但大规模调用成本会累积。正文没说明目标网站是否需要主动接入,也没解释代理如何自动处理4...
#Argentic#Bitcoin Lightning Network
一句话点评
Argentic 给 AI 爬虫搭了个闪电网络收费站:每次请求返回 HTTP 402 状态码,附带一张 10 聪(约 0.001 美元)的发票,支付后拿到 1 小时会话令牌,结算低于 40 毫秒。不用注册、不用 API 密钥,对开发者来说单次很便宜,但大规模调用成本会累积。正文没说明目标网站是否需要主动接入,也没解释代理如何自动处理 402——如果全靠开发者自己写支付逻辑,推广门槛不低。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
05:20
32d ago
Hacker News 首页· rssEN05:20 · 08·21
Seed:一个能让 Agent 自己改代码的最小化开源框架
Seed 是一个极简的开源 agent 框架,核心卖点是 agent 可以自己修改自己的代码来适应任务。项目用 Python 写,适合想研究“自修改 agent”机制的开发者。但正文没披露支持哪些模型,也没有性能基准,所以实际效果和可用性要自己试。
#GitHub#vivekhaldar#Open source
一句话点评
短评:让 agent 自己改代码来适应任务,想法有意思,但正文没提支持哪些模型,也没跑分,先别太激动。 点评:Seed 是一个极简的开源 agent 框架,核心卖点是 agent 可以自己修改自己的代码来适应任务。项目用 Python 写,适合想研究“自修改 agent”机制的开发者。但正文没披露支持哪些模型,也没有性能基准,所以实际效果和可用性要自己试。如果是真的,这种自我迭代能力可能降...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
03:51
32d ago
Hacker News 首页· rssEN03:51 · 08·21
美光在博伊西投100亿美元建研发中心,主攻内存和AI
美光宣布在爱达荷州博伊西新建“美光研究实验室”,定位为长期创新中心,聚焦内存和AI技术。100亿美元的投资额很大,但新闻稿没说是分几年投、包不包含设备和厂房建设,所以实际落地节奏还不清楚。美光目前是HBM(高带宽内存)主要玩家之一,这笔钱大概率会砸向下一代DRAM和AI专用存储方案。对AI从业者来说,内存带宽和容量一直是训练和推理的瓶颈,美光加大研发投...
#Micron
一句话点评
美光在博伊西砸100亿美元建研究实验室,主攻内存和AI。这笔钱很大,但新闻稿没说是分几年投、包不包含厂房设备,所以落地节奏要打折。对AI从业者来说,内存带宽和容量一直是瓶颈,美光加大研发是好事,但缺具体技术路线图和量产时间表。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
03:17
32d ago
Hacker News 首页· rssEN03:17 · 08·21
OpenAI Codex 在 AWS Bedrock 上缓存失控,费用飙到 10 倍
有用户反馈,OpenAI Codex 在 AWS Bedrock 上跑的 GPT-5.6 Sol 模型,每次调用都会产生高额的缓存写入费用,比正常情况贵了 10 倍。问题出在 Codex 没有提供关闭或限制缓存的选项,导致缓存写入成本失控。目前这个 bug 已经提交到 GitHub,但正文没披露修复时间或临时方案。如果是真的,这笔额外开销对高频调用的团...
#OpenAI#AWS#GitHub
一句话点评
OpenAI Codex 在 AWS Bedrock 上跑 GPT-5.6 Sol 模型,每次调用都会产生高额缓存写入费,比正常贵 10 倍。问题在于 Codex 没提供关闭或限制缓存的选项,导致成本失控。如果是高频调用团队,这笔额外开销挺吓人。正文没披露修复时间或临时方案,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0

更多

频道

后台