ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-11

50 items · updated 3m ago
RSS live
2026-05-11 · 星期一2026年5月11日
14:54
78d ago
AI HOT 精选· aihot-apiZH14:54 · 05·11
Runway 开源 confingy:用 Python 代码替代 YAML 配置机器学习系统
Runway 开源了一个叫 confingy 的 Python 库,核心思路是用纯 Python 代码代替 YAML 来配置机器学习系统。正文说,他们之前用 OmegaConf 管理 YAML 配置,结果一个训练配置膨胀到几千行,继承自几十个文件,改起来非常痛苦——没法 cmd-click 跳转定义、类型检查失效、重构时根本不知道哪些类在生产环境被用到...
#Tools#Code#Runway#Open source
一句话点评
Runway 开源了 confingy,用纯 Python 代码替代 YAML 来配置机器学习系统。他们之前用 OmegaConf 管理 YAML,一个训练配置膨胀到几千行、继承自几十个文件,改起来没法跳转定义、类型检查失效、重构时不知道哪些类还在用。confingy 支持懒加载、类型检查和序列化,让配置像代码一样可维护。但正文没披露迁移成本、性能对比或社区反馈,实际落地效果待验证。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
14:32
78d ago
r/LocalLLaMA· rssEN14:32 · 05·11
Qwen3.6 35B-A3B 跑得比 Gemma4 快,但没披露硬件和量化
Reddit 用户说 Qwen3.6 35B-A3B 在 llama.cpp 上跑得比 Gemma4 26B-A4B 快,长上下文也不掉速。但正文没披露用了什么硬件、量化精度和跑分数据,所以这个“快”要打个折——可能是低精度或高端显卡跑出来的。
#Inference-opt#Benchmarking#Qwen#Gemma
一句话点评
Reddit 用户称 Qwen3.6 35B-A3B 在 llama.cpp 上比 Gemma4 26B-A4B 快,长上下文不掉速。但正文没披露硬件、量化精度和跑分,这个“快”要打折——可能是低精度或高端显卡跑出来的。如果是真的,说明 MoE 推理优化有进展,但缺独立验证。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
14:21
78d ago
r/LocalLLaMA· rssEN14:21 · 05·11
Unsloth 放出 Qwen3 的 MTP 模型,但正文没提效果
Reddit 上有人贴了两个 Unsloth 的 Hugging Face 链接,分别是 Qwen3.6-27B 和 Qwen3.6-35B-A3B 的 GGUF-MTP 格式模型。MTP 是让模型一次预测多个 token 来加速推理,但帖子正文被 Reddit 屏蔽了,没披露具体机制、跑分或运行条件。目前只能看到模型文件存在,实际效果和适用场景都不清楚。
#Inference-opt#Unsloth#Hugging Face#Qwen
一句话点评
Unsloth 放出了 Qwen3.6-27B 和 35B-A3B 的 MTP 版 GGUF 模型。MTP 就是一次预测多个 token,理论上能加速推理。但帖子正文被 Reddit 屏蔽了,没披露具体机制、跑分或运行条件。目前只能看到模型文件存在,实际效果和适用场景都不清楚。
HKR 分解
hook knowledge resonance
打开信源
54
SCORE
H0·K1·R1
14:18
78d ago
AI HOT 精选· aihot-apiZH14:18 · 05·11
GPT-Image-2 生图提示词框架:把画幅、主体、隐喻、风格、文字拆开写
推文分享了一套结构化提示词写法,核心是“结构越清晰,输出越好”。框架把提示拆成六个模块:先定画幅和用途,再写主体位置、占比和情绪,然后用具体元素做视觉隐喻(比如用枯树象征孤独),接着指定风格(如 Apple 风)并强调干净克制,最后规划主副标题和英文短句的文字系统,再列一个“避免清单”。正文没披露这套框架在 GPT-Image-2 上的实测效果,也没说...
#Multimodal#Vision#GPT-Image-2#Commentary
一句话点评
这套提示词框架把生图指令拆成画幅、主体、视觉隐喻、风格、文字、避坑六个模块,思路清晰,适合新手照着填。但正文没披露在 GPT-Image-2 上的实测效果,也没说跟默认 prompt 比提升多少,这点先别太激动。框架本身不依赖模型,换个生图工具也能用,通用性算加分项。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
14:12
78d ago
Hacker News 首页· rssEN14:12 · 05·11
ICE 要自己开发智能眼镜,配合人脸识别 App 抓人
美国移民执法局(ICE)计划自研智能眼镜,用来配合它的人脸识别 App Mobile Fortify——这款 App 可以让执法人员扫一下脸就查数据库,判断对方是不是公民、要不要拘留。消息来自一位 DHS 官员和一位参会者,但正文没披露眼镜的供应商、技术规格或时间表。如果真做出来,等于把手机上的扫脸功能搬到眼镜上,执法人员可以边走边扫,不用再掏手机。这...
#Vision#ICE#404 Media#Hacker News
一句话点评
ICE 想自己搞智能眼镜,配合已有的扫脸 App Mobile Fortify,执法人员边走边扫,不用掏手机。消息来自一位 DHS 官员和一位参会者,正文没披露供应商、技术规格或时间表。如果是真的,等于把手机上的扫脸功能搬到眼镜上,效率更高,但隐私风险也更大——你甚至不知道对方在看你。目前信息缺口很大,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
14:00
78d ago
The Verge · AI· rssEN14:00 · 05·11
Joanna Stern 不是机器人,但她和 AI 一起住了一年
《华尔街日报》记者 Joanna Stern 出了一本书《我不是机器人》,记录她一整年把 AI 塞进日常生活的实验。书 5 月 12 日上市。她在播客里说,很多被吹上天的 AI 硬件——尤其是人形机器人——根本还没准备好。她还自己开了家媒体公司 New Things,跟 NBC 合作。正文没披露实验具体用了哪些 AI 工具、花了多少钱,所以“没准备好”...
#Agent#Robotics#Audio#Joanna Stern
一句话点评
《华尔街日报》记者Joanna Stern花一年把AI塞进日常生活,结论是:人形机器人远没准备好。书5月12日上市,她还自创媒体公司New Things与NBC合作。但正文没披露具体用了哪些AI工具、花了多少钱,所以“没准备好”这个判断缺乏细节支撑。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
13:37
78d ago
r/LocalLLaMA· rssEN13:37 · 05·11
有人想把 MCP 服务器挂到私人 GitHub 上,让所有 AI 工具共享工作笔记
一位 Reddit 用户在 LocalLLaMA 版发帖,说自己在多个 AI 工具(Pi、Codex、LM Studio)和笔记软件(Notion、Obsidian、Microsoft 365)之间来回倒腾技能、文档和数据,快被搞疯了。他设想能不能用一个 MCP 服务器连到私人 GitHub 仓库,把任务笔记统一存进去,这样所有工具都能读写同一份知识。...
#Tools#RAG#Memory#Reddit
一句话点评
一个 Reddit 用户被 Pi、Codex、LM Studio、Notion、Obsidian 等工具搞疯了,想用 MCP 服务器连私人 GitHub 仓库统一存任务笔记,让所有工具读写同一份知识。想法很实用,但正文没披露任何现成工具、实现细节或测试结果。目前只是需求描述,不是解决方案。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H1·K0·R1
13:21
78d ago
AI HOT 精选· aihot-apiZH13:21 · 05·11
GitHub 上有人做了两个 AI skill,能批量生成专利和软著申请材料
两个 GitHub 项目分别针对发明专利和软件著作权,用 AI 自动写申请材料。正文没披露生成内容的准确率、审批通过率、审查流程是否适配,也没说这样批量生成是否合规。设计专利和实用新型门槛更低,用 Claude 或图片生成工具就能做。
#Tools#Code#GitHub#Claude
一句话点评
两个GitHub项目用AI批量写专利和软著申请材料,设计专利甚至用Claude就能搞定。正文没披露生成内容的准确率、审批通过率,也没说是否合规。如果真能过审,成本极低,但审查流程可能不买账,别急着冲。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
13:20
78d ago
● P1Hacker News 首页· rssEN13:20 · 05·11
谷歌称黑客用AI发现重大软件漏洞并发动零日攻击
谷歌说犯罪黑客用AI发现了一个重大软件漏洞,但正文没披露漏洞名称、影响的产品或攻击机制。目前只有三条链接、39个点赞和19条评论,信息量很少。这点先别太激动,等更多细节出来再说。
#Safety#Google#The New York Times#CNBC
精选理由
精选 · 重要度 94 · 吸引力 + 共鸣
一句话点评
Google首次确认有黑客用AI挖出零日漏洞,但没说是哪款AI、攻击了谁,这点先别太激动。
锐评
Google发报告说,一个犯罪黑客团伙用AI发现了一个此前未知的软件漏洞,并试图发起大规模攻击。这是安全圈担心多年的场景第一次被证实,不再是理论推演。Google称“高度确信”攻击者用AI辅助发现并武器化了这个漏洞,但正文没披露具体用了哪个AI模型、攻击目标是谁、发生在什么时间。 被发现的漏洞属于零日漏洞,也就是软件厂商自己都不知道的洞。以前这种漏洞在黑市能卖几百万美元,现在AI模型能批量挖。报告提到Anthropic的Mythos模型已经找出了几千个零日漏洞,覆盖所有主流操作系统和浏览器。这次攻击者试图绕过双因素认证,但还需要有效账号密码才能得手,Google在补丁发布前就拦截了。 还缺关键信息:攻击者用的是开源模型还是商业API?成本多低?挖一个洞要跑多少次推理?没有这些数字,很难判断AI到底把攻击门槛拉低了多少。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K0·R1
13:00
78d ago
TechCrunch AI· rssEN13:00 · 05·11
太空数据中心缺火箭,Cowboy Space 拿了 2.75 亿美元自己造
AI 算力需求把数据中心创业者逼到了天上,但问题很简单:没有足够的火箭把服务器送上去,而且发射太贵。Cowboy Space 刚融了 2.75 亿美元,打算自己造火箭来解决这个运力缺口。正文没披露火箭成本、发射时间表、客户名单或具体技术参数,所以目前只能当个方向性信号看——钱不少,但落地细节全缺。
#Cowboy Space#Funding
一句话点评
Cowboy Space 融了 2.75 亿美元,想自己造火箭把数据中心送上天。核心逻辑是:AI 算力需求太猛,地面不够用,但现有火箭运力不足且发射太贵。2.75 亿在航天领域不算小钱,但造火箭是出了名的烧钱慢,这点钱可能只够造一两枚原型。正文没披露火箭成本、发射时间表、客户名单或具体技术参数,所以目前只能当个方向性信号看——钱不少,但落地细节全缺。短评:火箭送服务器上天,想法很酷,但 2....
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
12:36
78d ago
AI HOT 精选· aihot-apiZH12:36 · 05·11
GitHub 3.3万星标:一个帮你按主题刷AI论文视频的收藏库
这个GitHub项目拿了3.3万星,专门整理AI论文相关的视频教程,来源是YouTube和B站。它按时间和主题分类,比如收录了李沐的论文精讲系列,方便你顺着一条线系统学。说白了就是个精选视频导航,省得自己到处翻。不过正文没提更新频率,如果视频链接失效或过时,体验会打折扣。
#GitHub#YouTube#Bilibili#Open source
一句话点评
GitHub 3.3 万星的项目,把 YouTube 和 B站上 AI 论文相关的视频教程按时间、主题整理成目录,比如李沐的论文精讲系列。说白了就是个精选导航,省得自己到处翻。但正文没提更新频率,如果链接失效或过时,体验会打折扣。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
12:21
78d ago
r/LocalLLaMA· rssEN12:21 · 05·11
跑 Qwen3.6 时 JSON 里多一个空格,思维链输出就没了
有用户在 llama-server v9102 上跑 Qwen3.6,发现 chat-template-kwargs 的 JSON 字符串外层多了一个空格,导致 preserve_thinking 参数解析失败,思维链内容直接不输出。去掉空格写成 {"preserve_thinking": true} 就正常了。问题在 RTX 4090 上复现,正文没...
#Reasoning#Tools#Qwen#llama-server
一句话点评
llama-server 解析 JSON 时多一个空格就吞掉思维链输出,Qwen3.6 用户注意。问题在 4090 上复现,但正文被 Reddit 屏蔽,不清楚是否跟特定版本或参数组合有关。如果是通用 bug,影响面不小——很多本地部署靠 preserve_thinking 控制推理过程可见性。建议先去掉空格试试,等官方确认。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R1
12:19
78d ago
彭博科技· rssEN12:19 · 05·11
孙正义与马克龙谈法国大型数据中心项目
软银创始人孙正义与法国总统马克龙就一个法国AI数据中心项目进行了洽谈。正文没披露投资金额、规模、选址和时间表,所以目前只知道双方在谈,具体多大、什么时候建、投多少钱都不清楚。
#SoftBank#Masayoshi Son#Emmanuel Macron#Partnership
一句话点评
软银孙正义和马克龙谈法国AI数据中心,但正文没披露投资额、规模、选址和时间表。目前只知道双方在谈,具体多大、什么时候建、投多少钱都不清楚,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
10:47
78d ago
r/LocalLLaMA· rssEN10:47 · 05·11
Hugging Face 上 GGUF 格式模型上传量两个月翻倍
Reddit 用户发现,Hugging Face 上 GGUF 格式的新模型上传量在两个月内几乎翻倍。GGUF 是本地运行大模型的主流格式,上传量翻倍说明更多人开始自己量化、打包模型,或者社区里新模型变多了。不过原帖只给了两个 X 链接,正文被 Reddit 屏蔽了,没有披露具体数字和统计口径,比如是只看新模型还是包括更新版本。
#Inference-opt#Hugging Face#Clement Delangue#Victor Mustar
一句话点评
GGUF 上传量两个月翻倍,说明本地跑模型的人确实多了。但原帖正文被 Reddit 屏蔽,只给了两个 X 链接,没披露具体数字和统计口径——是只看新模型还是包括更新版本?这点先别太激动。如果翻倍是因为更多人自己量化打包,那对推理优化和社区生态是好事;但如果只是重复上传,水分就大了。缺 Hugging Face 官方数据佐证。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
10:21
78d ago
AI HOT 精选· aihot-apiZH10:21 · 05·11
商汤 SenseNova U1 图像生成模型上线 ComfyUI,8 步出图
商汤把 SenseNova U1 模型放到了 ComfyUI 上,可以直接跑。REBEL AI 出了教程和实测,说生成速度很快,8 步就能出图,覆盖人像、超现实、文字标志和生物设计。资源在 Hugging Face、GitHub 和 Discord 都开放了。不过正文没披露任何 benchmark 分数,实际效果和竞品比怎么样还不清楚。
#Vision#Multimodal#Inference-opt#SenseTime
一句话点评
商汤把 SenseNova U1 放到了 ComfyUI 上,8 步出图,速度确实快。REBEL AI 实测覆盖人像、超现实、文字标志和生物设计,资源在 Hugging Face、GitHub、Discord 都开放了。但正文没给任何 benchmark 分数,跟 Flux、SD3 比到底怎么样还不清楚。先别太激动,等第三方跑分出来再说。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R0
10:11
78d ago
r/LocalLLaMA· rssEN10:11 · 05·11
AMD Strix Halo 微调教程:Linux 和纯 Windows 都能跑
PromptInjection_ 发了一篇 AMD Strix Halo 的微调教程,覆盖 Linux 和纯 Windows 环境,支持全量 SFT 和 LoRA。正文没披露模型大小、显存需求、跑分结果或训练耗时,所以实际效果和门槛还不清楚。如果你手头有这块 AMD 新硬件想试试微调,可以当个起点参考,但先别太激动——缺关键数据,得自己踩坑验证。
#Fine-tuning#AMD#PromptInjection_#Commentary
一句话点评
AMD Strix Halo 微调教程来了,覆盖 Linux 和纯 Windows,支持全量 SFT 和 LoRA。但正文没披露模型大小、显存需求、跑分或耗时,实际效果和门槛都不清楚。如果你手头有这块新硬件想试试,可以当个起点,但先别太激动——缺关键数据,得自己踩坑验证。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
10:04
78d ago
Hacker News 首页· rssEN10:04 · 05·11
AI 会议记录工具让律师们坐不住了
纽约时报报道,AI 会议记录工具正在引发法律界的担忧。文章标题很抓人,但正文没披露具体涉及哪些法律风险、案例、司法管辖区、厂商,也没说会议录音需要满足什么条件。目前只有 Hacker News 上 22 个点赞和 14 条评论,信息量有限。如果你在用这类工具,建议先别太激动,等更多细节出来再判断风险。
#Tools#Audio#The New York Times#Hacker News
一句话点评
纽约时报说AI会议记录工具让律师紧张,但正文没披露具体法律风险、案例或司法管辖区。目前只有HN上22个点赞和14条评论,信息量有限。如果你在用这类工具,建议先别太激动,等更多细节出来再判断。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
09:53
78d ago
Product Hunt · AI· rssEN09:53 · 05·11
Agentmemory:给 Claude Code 等编程助手装上持久记忆,号称省 92% 的上下文
Agentmemory 是一个开源工具,专门解决编程助手(如 Claude Code、Codex)每次对话都“失忆”的问题。它会把 agent 在代码库里的操作自动压缩成结构化记忆,下次对话时只把最相关的记忆塞回上下文。官方用 240 次真实编码会话做测试,说每次会话能省掉最多 95% 的 token,调用工具的次数能多 200 倍才撞上上下文上限。具...
#Code#Memory#Agent#Claude Code
一句话点评
Agentmemory 给 Claude Code 这类编程助手加了个外挂记忆,把之前的操作自动压缩成结构化记忆,下次只塞最相关的回来。官方用 240 次真实编码会话测试,说每次能省最多 95% 的 token,调用工具次数能多 200 倍才撞上下文上限。如果是真的,对长任务和大型代码库挺省钱。但正文没披露存储机制、定价和上线时间,开源但验证弱,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
09:17
78d ago
r/LocalLLaMA· rssEN09:17 · 05·11
用 Claude Code 当调度员,把代码任务派给本地小模型干
Reddit 用户 Latt 提了个架构:让 Claude Code 通过 MCP 协议调用 Pi.dev 的 RPC 模式,把子任务丢给本地 LLM 当副手,最后 Claude Code 再审查生成的 PR 代码。相当于用云端强模型做规划+质检,本地模型跑具体活。正文没披露任何测试结果、模型名称或成本数字,所以实际效果和性价比都未知。
#Agent#Code#Tools#Claude Code
一句话点评
短评:云端强模型当包工头,本地模型干苦力,想法不错但没实测。 点评:Reddit 用户 Latt 提了个分工架构:让 Claude Code 通过 MCP 协议调用 Pi.dev 的 RPC 模式,把子任务丢给本地 LLM 当副手,最后 Claude Code 再审查生成的 PR 代码。相当于用云端强模型做规划+质检,本地模型跑具体活。思路挺实用——既省 API 费,又能用本地模型处理敏感...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R1
08:53
78d ago
Product Hunt · AI· rssEN08:53 · 05·11
Pixcode:一个自托管的 AI 编程代理控制台
Pixcode 是一个自托管的 Web 界面,可以同时管理 Claude Code、Cursor CLI、OpenAI Codex、Gemini CLI、Qwen Code 和 OpenCode 等多个 AI 编程代理。它相当于给这些代理搭了一个“控制室”,支持多代理编排、文件操作、Shell 命令、Git 集成、API 密钥管理、Telegram 通...
#Agent#Code#Tools#Pixcode
一句话点评
Pixcode 是一个自托管的 Web 界面,相当于给 Claude Code、Cursor CLI 等多个 AI 编程代理搭了个“控制室”,支持多代理编排、文件操作、Shell 命令、Git 集成等。免费,但正文没披露部署要求、性能或安全细节。短评:多代理控制台,免费但信息不全。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
07:55
78d ago
AI HOT 精选· aihot-apiZH07:55 · 05·11
用ChatGPT写分镜提示词,PixVerse直接出1080p香水广告
一个用户分享的工作流:先用ChatGPT按预设镜头写多段视频提示词,严格指定品牌瓶身、包装、Logo和阿拉伯文/英文文本必须靠参考图还原,视觉风格要超奢华电影感;然后扔进PixVerse快速生成1080p视频。好处是GPT能精准控制品牌元素,PixVerse出片快,但正文没披露生成耗时、单条成本,也没说同一套提示词能否稳定复现。
#Multimodal#Tools#ChatGPT#PixVerse
一句话点评
一个用户用ChatGPT写分镜提示词,再扔进PixVerse生成1080p香水广告视频,主打品牌元素(瓶身、Logo、阿拉伯文)靠参考图还原。好处是GPT能精准控制品牌视觉,PixVerse出片快。但正文没披露生成耗时、单条成本,也没说同一套提示词能否稳定复现——如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
28
SCORE
H0·K0·R0
07:51
78d ago
r/LocalLLaMA· rssEN07:51 · 05·11
Qwen 3.6 35B A3B 本地跑论文映射,Reddit 用户说比半年前的小模型强一截
一位 Reddit 用户在 32GB 内存的机器上测试了四个本地小模型,任务是把学术论文内容映射到自己的研究代码上。Qwen 3.6 35B A3B 排名最高,Qwen 3.6 27B、Gemma 4 26B A4B 和 Nemotron 3 Nano 也明显好于几个月前的小模型。Devstral Small 2 因为长上下文塞不进 32GB 内存,直...
#Code#Reasoning#Benchmarking#Qwen
一句话点评
短评:32GB 内存跑 Qwen 3.6 35B A3B 做代码映射,效果排第一,但这是用户自测,非官方基准。 点评:Reddit 用户用 32GB 内存跑四个本地小模型,任务是把论文内容映射到自己的研究代码上。Qwen 3.6 35B A3B 排名最高,Qwen 3.6 27B、Gemma 4 26B A4B 和 Nemotron 3 Nano 也明显好于几个月前的小模型。Devstra...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
06:46
78d ago
AI 群聊日报· atomZH06:46 · 05·11
Anthropic 训练 agent 的专利:不光记你做了什么,还记你为什么这么做
群聊日报拆解了 Anthropic 一项关于 Computer Use 训练的专利(U.S. 12,437,238)。核心不是教模型推理,而是怎么采集和生成训练数据:在用户和界面之间插一层,记录操作前后状态,还让用户标注意图。然后把这些坐标操作翻译成语义命令,再用强模型把一条真实轨迹扩展出几十条变体。跟纯录屏的区别在于,后者只告诉你“用户点了哪里”,前...
#Agent#Tools#Anthropic#Commentary
一句话点评
Anthropic 的 Computer Use 专利核心不是教模型推理,而是怎么造训练数据:在用户和界面间插一层记录操作前后状态,还让用户标注意图,再用强模型把一条真实轨迹扩展出几十条变体。跟纯录屏的区别在于后者只告诉你“用户点了哪里”,前者告诉你“用户为什么点”。正文没披露数据集大小和训练细节,但思路本身挺值钱——低成本造带意图标注的 agent 数据。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
06:13
78d ago
r/LocalLLaMA· rssEN06:13 · 05·11
Unsloth 把 MiMo-V2.5 转成了 GGUF,有人跑起来了吗?
Reddit 上有人发了 unsloth/MiMo-V2.5-GGUF 的链接,只问了一句“你能跑吗?”。帖子正文被屏蔽了,看不到模型大小、量化版本、硬件要求或实际运行情况。目前只知道 Unsloth 团队把 MiMo-V2.5 转成了 GGUF 格式,适合本地部署,但具体跑不跑得动、需要多大显存,全都没说。
#Inference-opt#Unsloth#Hugging Face#Open source
一句话点评
Reddit 上有人发了 Unsloth 把 MiMo-V2.5 转成 GGUF 的链接,只问了一句“你能跑吗?”。正文被屏蔽,看不到模型大小、量化版本或硬件要求。目前只知道适合本地部署,但具体跑不跑得动、需要多大显存,全都没说。 短评:只有链接和一句“你能跑吗”,信息量约等于零。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H0·K1·R0
06:00
78d ago
● P1OpenAI 博客· rssEN06:00 · 05·11
OpenAI 成立 DeployCo 部署公司帮企业落地 AI 模型
OpenAI 新开了一家叫 OpenAI Deployment Company(DeployCo)的独立公司,专门帮企业把前沿模型真正落到生产环境里。做法是派“前线部署工程师(FDE)”进驻客户公司,跟业务负责人和一线团队一起找出 AI 最能产生价值的地方,重新设计流程,再把系统搭好、跑稳。为了从第一天就有足够人手,OpenAI 同时宣布收购应用 AI...
#OpenAI#DeployCo#Product update
精选理由
精选 · 重要度 85 · 吸引力 + 共鸣
一句话点评
OpenAI 成立了一家叫 DeployCo 的新公司,专门派工程师进企业帮你把 AI 用起来,还顺手收购了 Tomoro 拿到 150 号人。
锐评
OpenAI 这次不是发模型,是直接下场做部署服务了。新成立的 DeployCo 会派“前线部署工程师”进驻客户公司,从找场景、改流程到上线系统全包。起步就拿了超过 40 亿美元投资,投资方包括 TPG、高盛、软银,还有贝恩、麦肯锡这类咨询公司。同时收购了 Tomoro,直接带来约 150 名有经验的工程师,客户名单里有 Tesco、维珍航空这类大企业。 这件事的逻辑很清楚:模型再强,企业自己用不起来等于白搭。OpenAI 想通过控股的独立公司,把部署做成一门能规模化赚钱的生意,同时保持和自家研究的紧密连接。但文章没提具体收费模式,也没说这 150 人够不够覆盖他们画的“整个经济”的大饼。另外,收购还在等监管批准,能不能顺利落地也是个变数。
HKR 分解
hook knowledge resonance
打开信源
85
SCORE
H1·K0·R1
05:23
78d ago
r/LocalLLaMA· rssEN05:23 · 05·11
TextWeb:给AI代理用的Markdown浏览器,能跑完整JavaScript
DocWolle 开源了 TextWeb,一个把网页渲染成 Markdown 的工具,专门给 AI 代理(agent)看。它能执行完整 JavaScript,所以动态页面也能抓;还会标注按钮、链接这些可交互元素,方便代理决定点哪里。提供命令行和 MCP 服务器两种接入方式,也能直接集成进 llama.cpp 的网页界面。正文没披露延迟和 token 消...
#Agent#Tools#Code#DocWolle
一句话点评
TextWeb 把网页转成 Markdown 给 AI 代理看,能跑完整 JS 所以动态页面也能抓,还会标出按钮、链接让代理知道点哪。提供命令行和 MCP 服务器接入,也能集成进 llama.cpp 界面。但正文没披露延迟和 token 消耗,如果抓大页面成本可能不低。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
04:53
78d ago
AI HOT 精选· aihot-apiZH04:53 · 05·11
中国移动上线AI模型中转平台MoMA,国家队下场抢基础设施生意
中国移动推出了一个叫MoMA的AI模型中转平台,已经接入了DeepSeek、通义千问等300多个模型。它的定位有点像AI时代的“智能电网”——谁掌握这个中转站,谁就能在未来的模型调用和定价上说了算。用户可以去移动云官网搜“MoMA”领体验包试试。不过正文没披露具体延迟、成本或模型切换的灵活性,实际好不好用还得测了才知道。
#Tools#Inference-opt#China Mobile#DeepSeek
一句话点评
中国移动推出MoMA模型中转平台,已接入DeepSeek、通义千问等300多个模型,定位类似AI时代的“智能电网”,意在掌握模型调用和定价权。用户可去移动云官网搜“MoMA”领体验包。但正文没披露具体延迟、成本或模型切换的灵活性,实际好不好用还得测了才知道。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H1·K1·R0
04:04
78d ago
● P1量子位 · 公众号· rssZH04:04 · 05·11
OpenAI 签下 750 兆瓦算力大单,芯片公司 Cerebras 趁势把 IPO 估值抬到 350 亿美元
Cerebras 把 IPO 发行价区间上调到每股 150 到 160 美元,按上限算估值约 350 亿美元。直接推手是 OpenAI 刚签了一份 750 兆瓦的 AI 算力采购协议,交付排到 2028 年。不过原文因为微信环境验证拦截,正文内容没抓到,具体合同金额、交付节奏和 Cerebras 的财务数据都没披露,这个估值能撑多久还得看后续招股书细节。
#Inference-opt#Cerebras#OpenAI#Nvidia
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Cerebras 靠 OpenAI 一张 750 兆瓦算力大单把 IPO 估值顶到 350 亿美元,但正文被微信验证拦了,合同金额和财务数据都没看到,这估值先打个折看。
锐评
Cerebras 把发行价区间上调到 150-160 美元,估值直奔 350 亿美元,直接原因是 OpenAI 签了一份 750 兆瓦的 AI 算力采购协议,交付排到 2028 年。750 兆瓦什么概念?大概相当于一个中型数据中心的用电量,说明 OpenAI 在推理或训练端对非英伟达芯片的需求不小,也给了 Cerebras 挑战英伟达的底气。 但这条消息有个硬伤:原文因为微信环境验证没抓到正文,具体合同金额、交付节奏、Cerebras 自身的营收和亏损情况都没披露。350 亿美元估值能不能站住,得看招股书里客户集中度有多高——如果 OpenAI 这一单占了收入大头,风险就不小。另外,Cerebras 的芯片主打大尺寸晶圆级推理,实际部署规模和软件生态成熟度跟英伟达还有差距,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
04:04
78d ago
● P1量子位 · 公众号· rssZH04:04 · 05·11
菲尔兹奖得主实测 ChatGPT 5.5 Pro,17 分钟跑出论文级数学结果
陶哲轩的同事、菲尔兹奖得主 Timothy Gowers 拿 ChatGPT 5.5 Pro 试了一道加法数论里的难题,模型在 17 分 05 秒内给出了一个最优的二次上界构造,相当于直接产出了一篇小论文的核心证明。之后他又让模型把整个过程写成 LaTeX 预印本,总共花了 47 分钟。Gowers 把结果发在了自己博客上,因为 arXiv 目前拒收 ...
#Reasoning#Code#Benchmarking#Timothy Gowers
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
菲尔兹奖得主实测 ChatGPT 5.5 Pro,17 分钟解出加法数论难题的核心证明,但结果只能发博客,arXiv 不收 AI 生成的论文。
锐评
这条消息的看点不是“AI 又赢了”,而是一个顶尖数学家亲自下场当评测员。Timothy Gowers 拿一道加法数论里的构造性问题去试 ChatGPT 5.5 Pro,模型在 17 分 05 秒内给出了一个最优的二次上界构造,之后又花了约半小时把证明写成 LaTeX 预印本,全程 47 分钟。这个效率相当于把一篇小论文的核心部分从几天压缩到一小时内。 但兴奋之前得先打几个折。第一,正文没披露这道题的具体难度和背景,我们不知道它是不是模型训练数据里见过类似构造的变体。第二,Gowers 本人就是菲尔兹奖级别的专家,他能精准提问、判断输出是否正确,普通人拿同样模型未必能复现这个效果。第三,arXiv 拒收 AI 生成内容,所以这个成果目前只能挂在个人博客上,离正式学术发表还差一道同行评议的坎。 还缺什么?缺的是这道题在数学界的公认难度评级、模型是否接触过相关训练样本的分析,以及换一个非顶尖数学家来用,成功率会掉多少。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
04:00
78d ago
FT · 科技· rssEN04:00 · 05·11
AI 狂热掩盖了伊朗战争对大型企业的冲击
FT 一篇付费文章指出,冲突开始后大型企业市值增加了 5.4 万亿美元,其中半导体板块贡献了大部分涨幅。文章没有披露样本公司、图表数据或计算方法,所以这个数字到底有多少是 AI 炒作、多少是战争影响,正文没给拆分依据。
#Commentary
一句话点评
FT一篇付费文章说冲突后大公司市值涨了5.4万亿美元,半导体板块贡献最大。但正文被墙,没披露样本、图表和计算方法,这个数字到底多少是AI炒作、多少是战争影响,没法拆。标题有挑事嫌疑,数据来源和拆分依据都不透明,先打个折。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
03:31
78d ago
r/LocalLLaMA· rssEN03:31 · 05·11
同一个本地模型,OpenClaw 缓存命中率为 0,Hermes 却正常,问题出在哪?
一位用户在 Mac 上用 oMLX v0.3.8 跑 Qwen3.6-35B-A3B-RotorQuant-MLX-4bit 模型,发现 OpenClaw 发请求时缓存命中率始终为 0%,而直接重复调用 /v1/chat/completions 接口能缓存 61,440 个 token(提示词共 63,020 个),Hermes 客户端对同一个 oML...
#Agent#Inference-opt#OpenClaw#oMLX
一句话点评
oMLX 的 KV 缓存对不同客户端表现不一致:Hermes 能命中 93%,OpenClaw 却始终 0%。问题大概率出在 OpenClaw 的请求格式或对话 ID 管理上,导致服务端不认缓存。正文没披露 OpenClaw 的具体请求日志,排查得先抓包看 prompt 是否完全一致。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K1·R1
03:24
78d ago
彭博科技· rssEN03:24 · 05·11
软银要在日本造AI数据中心专用大电池
软银旗下移动部门计划在大阪堺市工厂启动电池电芯量产,专供AI数据中心用电。正文没披露产能、投资额和投产时间,所以规模多大、什么时候能用上都不清楚。但方向很明确:AI数据中心耗电太猛,软银想自己下场解决供电瓶颈,而不是只靠电网扩容。
#SoftBank Group#Product update
一句话点评
软银要在大阪堺市工厂量产电池电芯,专供AI数据中心。方向很明确:AI耗电太猛,软银想自己解决供电瓶颈,不单靠电网。但正文没披露产能、投资额和投产时间,规模多大、什么时候能用上都不清楚。如果是真的,这对数据中心供电稳定性是个新思路,但先别太激动,等具体数字出来再说。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
02:06
78d ago
Hacker News 首页· rssEN02:06 · 05·11
adamsreview:给 Claude Code 加一套多人协作的 PR 审查插件
这是一个 Claude Code 插件,提供了 6 条斜杠命令,把 PR 审查拆成多阶段流水线:并行跑多个子 agent 做深度审查、自动修复循环、交互式走查,还能注入外部工具的发现结果。支持 Claude 或 Codex 做审查引擎,审查结果存成 JSON 文件,可选通过 Codex CLI 和 PR bot 做 ensemble review(多个...
#Agent#Code#Tools#adamsreview
一句话点评
一个 Claude Code 插件,把 PR 审查拆成多阶段流水线:并行跑多个子 agent 做深度审查、自动修复循环、交互式走查,还能注入外部工具的发现结果。支持 Claude 或 Codex 做审查引擎,审查结果存成 JSON 文件,可选通过 Codex CLI 和 PR bot 做 ensemble review(多个模型交叉验证)。 短评:把单次审查拆成多 agent 流水线,思路...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
02:05
78d ago
AI HOT 精选· aihot-apiZH02:05 · 05·11
开源PPT工具鬼藏PPT技能更新:新增瑞士风格和AI自动配图
开源项目鬼藏PPT技能更新了,新增瑞士国际主义视觉风格,带克莱因蓝等四套主题色。核心升级是接入了GPT-Image 2.0,能根据PPT内容自动生成胶片质感配图、流程图和UI截图美化,不用自己找图了。还支持一键生成公众号、小红书、视频号的封面图,省去手动调整尺寸的麻烦。预设了22种版式和严格视觉规则,保证设计一致性。正文没披露生成一张图的具体成本和速度...
#Multimodal#Vision#Tools#鬼藏PPT技能
一句话点评
开源PPT工具鬼藏更新,接入了GPT-Image 2.0自动配图,省去自己找图的麻烦。新增瑞士风格和四套主题色,22种版式保证设计一致性,还能一键生成公众号、小红书封面。正文没披露生成一张图的具体成本和速度,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
01:59
78d ago
彭博科技· rssEN01:59 · 05·11
Alphabet 首次发行日元债,AI 军备竞赛烧钱要借日本钱
Alphabet 计划首次发行日元计价债券,募资用途跟 AI 投资需求挂钩。正文没披露发行规模、期限、票息、定价日和承销商,所以暂时不知道具体能融多少钱、成本多高。但选日元债这个动作本身说明:AI 军备竞赛烧钱太猛,连 Google 母公司都要去日本市场找便宜钱。
#Alphabet#Funding
一句话点评
Alphabet 首次发行日元债,募资用于 AI 投资。日元利率低,借日本的钱搞 AI 军备竞赛,成本比美元债便宜。但正文没披露规模、期限和票息,暂时不知道能融多少钱、多划算。如果是真的挺省钱,但这点先别太激动,等具体条款出来再说。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
01:22
78d ago
● P1AI HOT 精选· aihot-apiZH01:22 · 05·11
Cerebras IPO 被抢爆,超额认购超 20 倍,发行价打算上调近三成
路透社的消息说,做 AI 芯片的 Cerebras 准备上市,结果被投资人抢疯了,超额认购超过 20 倍。公司一看这架势,打算把发行价从原来的 115-125 美元提到 150-160 美元,涨了快三成,发行股票数量也计划从 2800 万股加到 3000 万股,最多能融到 48 亿美元。这可能会是 2026 年到现在全球最大的一笔 IPO。Cerebr...
#Inference-opt#Cerebras#Amazon#OpenAI
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Cerebras 上市被抢爆,20 倍超额认购直接把发行价推高了近三成。但正文没披露营收和亏损数据,光有订单和热度还看不清成色。
锐评
Cerebras 这次 IPO 的热度确实高,路透社的消息说超额认购超过 20 倍,公司顺势把发行价从最高 125 美元提到了 160 美元,发行股数也加到 3000 万股,最多能融 48 亿美元。这个数字让它可能成为 2026 年至今全球最大的一笔 IPO。市场这么捧,主要押注的是它那颗“晶圆级芯片”——芯片面积巨大,集成了很多高带宽 SRAM 缓存,天然适合 AI 推理里的解码步骤,也就是模型生成内容时一个字一个字往外蹦的那个环节。加上它手里有亚马逊和 OpenAI 的大额订单,故事听起来很顺。 但这条新闻的信息缺口也很明显。正文完全没提 Cerebras 的营收规模、毛利率和亏损情况,也没说这 20 倍超额认购里有多少是基石投资者锁定的,多少是冲着短期热度来的热钱。另外,它的芯片强项在推理,而眼下训练芯片的市场更大,英伟达的护城河依然很深。所以,IPO 被疯抢只能说明市场对 AI 算力的饥渴,不代表这家公司已经跑通了商业闭环。等招股书里的财务数据出来,才能判断这 48 亿估值到底贵不贵。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
01:21
78d ago
AI HOT 精选· aihot-apiZH01:21 · 05·11
HappyHorse AI视频引擎上线阿里云,主打物理逻辑和1080p唇形同步
HappyHorse自称是“面向生产就绪内容排名第一的AI视频引擎”,现在可以在阿里云Model Studio上直接用了。它强调两个卖点:一是能处理复杂的物理交互(比如物体碰撞、运动轨迹),二是原生1080p唇形同步(嘴型和音频对得上)。正文没披露具体延迟、成本或样本量,所以这点先别太激动。如果真能做到生产级,对做短视频、广告、虚拟主播的团队来说是个省...
#Multimodal#Vision#HappyHorse#Alibaba Cloud
一句话点评
HappyHorse 号称“生产就绪第一”的 AI 视频引擎,现在能直接在阿里云上用了。它主打的物理交互(比如物体碰撞、运动轨迹)和原生 1080p 唇形同步,听起来挺唬人。但正文没披露具体延迟、成本或样本量,这点先别太激动。如果真能做到生产级,对做短视频、广告、虚拟主播的团队来说是个省心选项。
HKR 分解
hook knowledge resonance
打开信源
38
SCORE
H0·K1·R0
00:28
78d ago
AI HOT 精选· aihot-apiZH00:28 · 05·11
OpenCLI 用命令行读微信朋友圈和群聊,把私域数据喂给 AI Agent
OpenCLI 项目做了三个命令行工具(wx-cli、tg-cli、discord-cli),能直接拉取微信、Telegram、Discord 的群消息、聊天记录、朋友圈和收藏夹。这意味着 AI Agent 不再只能看公开网页,还能读你的私人社交数据,形成真正的个人数据流。正文没披露发布版本、许可证,也没说微信会不会封这类工具。
#Agent#Tools#Memory#OpenCLI
一句话点评
OpenCLI 做了三个命令行工具,能直接拉微信、Telegram、Discord 的聊天记录和朋友圈,让 AI Agent 读到你的私人社交数据。正文没披露发布版本和许可证,也没说微信会不会封这类工具。想法挺实用,但合规风险不小,先别急着把私聊喂给 Agent。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
00:00
78d ago
● P1AI HOT 精选· aihot-apiZH00:00 · 05·11
Qwen-Image-2.0 技术报告:把视觉理解模型和扩散模型拼在一起,生图和改图用一个框架搞定
这篇技术报告介绍了 Qwen-Image-2.0,一个把生图和精确修图合到一个模型里的方案。它的做法是把 Qwen3-VL 当成“条件编码器”,去理解你输入的指令,再连上一个多模态扩散模型来出图。指令最长能塞进 1000 个 token。报告里说,这套架构在多语言文字渲染、画面排版质量、以及人工打分上都有提升,尤其适合文字多、构图复杂的场景。不过正文没...
#Multimodal#Vision#Qwen#Research release
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Qwen 把生图和修图塞进一个模型,用自家视觉模型当指令翻译官,最长能接 1000 个 token 的复杂指令。
锐评
这篇报告讲的是 Qwen-Image-2.0,一个把文生图和精确修图合二为一的模型。它的核心思路是用 Qwen3-VL 作为“条件编码器”,相当于让一个视觉语言模型先读懂你的指令,再指挥后面的扩散模型出图。指令最长能塞进 1000 个 token,意味着你可以提很复杂的构图要求。报告里说,这套架构在多语言文字渲染、画面排版质量上都有提升,人工打分也更高,尤其适合文字多、构图复杂的场景。 不过,报告正文没披露具体的模型参数量、训练数据规模和推理成本,也没给出和 Flux、SD3 等主流模型在标准基准上的直接对比数字。这些信息缺口让我没法判断它的实际性价比。另外,所有评估都来自团队内部,没有第三方验证,这点先别太激动。如果后续能放出公开可用的 demo 或 API,才能验证它是不是真的把“理解指令”和“出图质量”同时做好了。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1

更多

频道

后台