ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-08-25

50 items · updated 3m ago
RSS live
2026-08-25 · 星期二2026年8月25日
23:00
28d ago
最佳拍档· atomZH23:00 · 08·25
前Uber CEO Travis Kalanick 八年后再出手,这次盯上工业AI
Travis Kalanick 离开 Uber 八年后,新方向是工业 AI——用软件和数据改造工厂和物流。标题提到 a16z 的 Ben Horowitz 和 Elon Musk,但正文没披露他们具体怎么参与。
#Travis Kalanick#Uber#a16z
一句话点评
前Uber CEO Travis Kalanick 蛰伏八年,新方向是工业AI——用软件和数据改造工厂物流。标题拉上了a16z的Ben Horowitz和马斯克,但正文没披露他们具体怎么参与,这点先别太激动。如果真能落地,工业软件这块蛋糕不小,但工厂数字化改造周期长、落地难,得看后续实际产品。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
21:12
28d ago
AI HOT 精选· aihot-apiZH21:12 · 08·25
LangChain 和 Airbyte 联手:让数据灌入向量库能定时刷新,不再是一次性导入
LangChain 和 Airbyte 发布了一个新集成,方向反过来了:Airbyte 现在可以把数据直接灌进向量库,而不是只从外部拉数据。文章的核心观点是,生产环境需要定时重新索引,而不是一次性导入,Airbyte 的编排能力正好补上这块。正文没披露具体支持哪些向量库,也没说怎么配置刷新周期。
#LangChain#Airbyte
一句话点评
LangChain 和 Airbyte 搞了个反向集成:Airbyte 现在能把数据直接灌进向量库,而不是只从外部拉。核心卖点是生产环境需要定时重新索引,Airbyte 的编排能力正好补上这块。但正文没披露具体支持哪些向量库,也没说怎么配置刷新周期,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
20:07
28d ago
r/LocalLLaMA· rssEN20:07 · 08·25
35B-A3B 模型工具调用能力大比拼:Ornith 和 Tiel-Coder 胜出
社区在 Qwen3.6-35B-A3B 上做了几个微调版,测了它们调用工具的能力。Ornith 1.5 和 Tiel-Coder 得分 144,明显超过原版 Qwen3.6-35B-A3B 的 131.5,接近 Qwen3.8-27B 的 152.6。KAT-Coder 只比原版好一点,Ornith-1.5-Heretic 反而更差。测试用了 65 次...
#Benchmarking#Qwen#Ornith#Tiel-Coder
一句话点评
社区在 Qwen3.6-35B-A3B 上微调出的 Ornith 1.5 和 Tiel-Coder,工具调用得分 144,远超原版的 131.5,接近 Qwen3.8-27B 的 152.6。测试跑了 65 次,每次 4.5 小时,在 128k 上下文深度下测的,结果可信。但注意,这是社区自测,非官方发布,且只测了工具调用一项。KAT-Coder 提升不大,Ornith-1.5-Hereti...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
19:10
28d ago
Google 研究院· rssEN19:10 · 08·25
Google 教 AI 在 XR 里做手势
Google 的 AgentHands 项目让 AI 在扩展现实(XR)里生成交互手势,比如一边指真实桌子一边指路。它利用空间上下文让动作更自然,目标是让虚拟助手更像真人。正文没披露延迟或硬件要求,但想法挺直接:别让 AI 只动嘴,还得会动手。
#Google
一句话点评
Google 让 XR 里的 AI 助手一边说话一边做手势,比如指桌子指路。想法不新鲜,但用空间上下文生成手势比纯脚本自然。正文没披露延迟和硬件要求,离落地还远。短评:手势生成不稀奇,关键看延迟和硬件门槛,Google 没给数据。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
19:03
28d ago
TechCrunch AI· rssEN19:03 · 08·25
Stability AI 又融了 7600 万美元,Stable Diffusion 还能撑多久?
Stable Diffusion 背后的公司 Stability AI 刚完成 7600 万美元的 B 轮融资,累计融资额达到 2.32 亿美元。正文没披露估值和投资方名单,所以这笔钱是救命还是扩张,暂时看不清楚。7600 万在今天的 AI 军备竞赛里不算大数目——训练一次前沿模型可能就要烧掉这个数。Stability 靠开源模型起家,但开源模式本身不...
#Stability AI#Stable Diffusion#Funding
一句话点评
Stability AI 拿了 7600 万美元 B 轮,累计 2.32 亿。但正文没披露估值和投资方,所以这笔钱是救命还是扩张,暂时看不清楚。7600 万在今天的 AI 军备竞赛里不算大数目——训练一次前沿模型可能就要烧掉这个数。Stability 靠开源模型起家,但开源模式本身不赚钱,之前还传出过财务紧张。这笔钱能撑多久、花在哪儿,才是关键。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
18:30
28d ago
Hacker News 首页· rssEN18:30 · 08·25
Pgbot:5.9 MB 的开源只读 Postgres 工具,人和 AI 都能用
Pgbot 是一个 5.9 MB 的开源工具,只读模式连上 Postgres 后,能用大白话回答数据库健康、慢查询、索引等问题。它支持 MCP 协议,AI 智能体可以把它当只读工具调用,安全且结果确定。正文没提写操作或计划,强调只读是设计原则。适合想要答案而不是看仪表盘的团队。
#pgbot#PostgreSQL#MCP#Open source
一句话点评
5.9MB的只读Postgres工具,连上数据库后能用大白话回答健康、慢查询、索引等问题。支持MCP协议,AI智能体可以安全调用,不会写坏数据。适合不想看仪表盘、直接要答案的团队。正文没提写操作计划,强调只读是设计原则。如果是真的挺省钱。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
18:16
28d ago
AI HOT 精选· aihot-apiZH18:16 · 08·25
吴恩达的 OpenWorker 开源智能体框架更新,内置三种网络安全检查,整套工具链可审计
OpenWorker 这次更新直接塞了三个网络安全智能体进去:扫代码漏洞、查依赖包有没有被供应链投毒、检查云上安全配置。它的 harness 全部开源,安全团队可以自己翻代码确认没有后门。还支持在本地跑开源权重模型,敏感代码不用上传。正文没提具体模型名和跑分,这点先别太激动。
#Andrew Ng#OpenWorker#Open source
一句话点评
Andrew Ng 的 OpenWorker 新版直接内置了三个网络安全智能体:扫代码漏洞、查依赖包投毒、检查云配置。harness 全开源,安全团队能自己审计有没有后门;还支持本地跑开源权重模型,敏感代码不用上传。正文没提具体模型名和跑分,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
17:50
28d ago
● P1TechCrunch AI· rssEN17:50 · 08·25
Claude聊天和Cowork的记忆功能实现整合共享
Anthropic 把 Claude 聊天和 Cowork(一个能帮你干活的智能体)的记忆系统打通了。以前你在聊天里告诉 Claude 的项目背景、个人偏好,一切换到 Cowork 就得重新说一遍,现在不用了。用户还能直接查看、编辑或删掉 Claude 记下的内容。正文没提这个更新什么时候推送、覆盖哪些套餐,也没说记忆数据是存在本地还是云端。
#Memory#Agent#Anthropic#Claude Cowork
精选理由
精选 · 重要度 88 · 吸引力 + 知识量
一句话点评
Claude 的聊天和 Cowork 终于共用一套记忆了,不用每次换地方都重新自我介绍一遍。
锐评
Anthropic 把 Claude 聊天和 Cowork(它的自动化工作助手)的记忆系统打通了。以前你在聊天里告诉 Claude 的项目背景、个人偏好,切换到 Cowork 干活时它全忘了,得重新说一遍。现在两边共享记忆,Claude 在一边学到的东西,另一边也能直接用。用户还能逐条查看、编辑或删除 Claude 记下的内容,控制权给得比较透明。 TechCrunch 的报道确认了这个更新,但没提记忆容量上限、跨会话的遗忘机制,也没说企业版或 API 用户什么时候能用上。共享记忆确实省事,但也会放大隐私风险——如果 Cowork 在自动化流程里误读了敏感记忆,后果比聊天里说错话严重。这点 Anthropic 正文没展开讲。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R0
16:09
28d ago
Hacker News 首页· rssEN16:09 · 08·25
在 Windows 沙盒里跑 Minecraft,用来测试电脑操控型 AI 代理
Cua 的文档教你怎么在 Windows 沙盒里装 Minecraft,把它当测试场来验证 AI 代理的桌面操控能力。思路很直接:把真实系统隔离起来,让代理去点方块、翻菜单,看它能不能搞定复杂 GUI(比如游戏)。文档没提具体用了什么模型,也没给性能数据,但这个方法本身挺实用——尤其适合那些需要测试代理在复杂界面(比如游戏)上表现的人。
#Cua
一句话点评
Cua 教你在 Windows 沙盒里跑《我的世界》,给 AI 代理当桌面操控测试场。思路很实用:隔离真实系统,让代理去点方块、翻菜单,验证它能不能搞定复杂 GUI。但文档没提用了什么模型,也没给成功率或延迟数据,所以这更像一个“可以这么测”的教程,不是“这么测效果很好”的验证。如果是真的,对做桌面自动化的人挺省钱——省了搭测试环境的功夫。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
15:32
28d ago
● P1AI HOT 精选· aihot-apiZH15:32 · 08·25
Dylan Patel:Anthropic 和 OpenAI 将掌控全球大部分算力到 2028 年
SemiAnalysis 创始人 Dylan Patel 算了一笔账:今年全球新增算力里,Anthropic 和 OpenAI 两家就拿走了约 30%,明年这个比例会涨到 40% 到 50%,按这个趋势到 2028 年,全球大部分可用的算力都会集中在这两家手里。背后的驱动力是单位经济模型——Anthropic 现在每兆瓦推理算力能产生最高 5000 万...
#Anthropic#OpenAI#SemiAnalysis
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Dylan Patel 判断,到 2028 年 Anthropic 和 OpenAI 会吃掉全球大部分算力,因为它们的模型推理赚钱效率太高,能出价碾压其他买家。
锐评
这条判断来自 SemiAnalysis 的 Dylan Patel 在 Dwarkesh 播客上的推算,核心逻辑是:头部实验室的推理毛利率已经高到离谱。他举的例子是,Anthropic 每花 1000 万到 1500 万美元的算力成本,能产生高达 5000 万美元的收入。这种“花 1 块挣 5 块”的生意,让它们可以不断把利润砸回训练端,抢走新增算力。 数字上看,今年新增算力里大约 30% 流向这两家,明年这个比例预计会跳到 40% 到 50%。到 2028 年,全球 AI 基础设施的资本支出会从现在的 1 万多亿美元膨胀到超过 2 万亿,而这两家实验室的份额还在加速集中。 不过,这个推演有几个缺口。第一,正文没给出“全球大部分算力”的具体占比门槛,是 51% 还是 80% 不清楚。第二,推理收入的天花板取决于企业客户是否持续为高价 API 买单,这点没有展开。第三,SpaceX 作为新基建方入局会怎么改变算力定价和供给,也只提了一句。如果推理价格战开打,或者开源模型把推理成本打下来,这个“赢家通吃”的剧本就得重写。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
15:20
28d ago
Hacker News 首页· rssEN15:20 · 08·25
用树莓派5和Qwen在车里跑本地AI,开源项目CarWatch
一个叫CarWatch的开源项目,把树莓派5、行车记录仪和本地Qwen模型塞进车里,让车变成一个能聊天的智能助手。它能分析路况、回答车辆相关问题,所有处理都在本地完成,不联网。作者说这是他家另一个项目CodeWatch的“车库兄弟”。正文没披露延迟、模型大小和功耗,所以实际跑起来卡不卡、耗不耗电还不清楚。如果是真的,对隐私敏感的车主挺有吸引力。
#ThinkOffApp#Qwen#Raspberry Pi#Open source
一句话点评
把树莓派5、行车记录仪和本地Qwen模型塞进车里,让车变成能聊天的智能助手,分析路况、回答车辆问题,所有处理都在本地,不联网。对隐私敏感的车主有吸引力。但正文没披露延迟、模型大小和功耗,实际跑起来卡不卡、耗不耗电还不清楚。如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R1
15:18
28d ago
● P1Hacker News 首页· rssEN15:18 · 08·25
安全研究者通过行为指纹确认Ox Alpha为智谱GLM-5.x模型
Ox Alpha 是 8 月 20 日突然出现在 OpenRouter 上的一个匿名模型。CTGT 通过 11 项分词器测试全部命中,加上参数上限、推理模式等特征,独立确认它来自智谱的 GLM-5.x 系列。在敏感话题上,这个模型的表现很分裂:对新疆、台湾等问题,它回答得和美国模型一样详细,甚至会引用在中国有争议的信源;但碰到习近平个人和另外 6 个国...
#CTGT#Ox Alpha#OpenRouter
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
安全研究员用提示注入和压缩距离分析,确认神秘模型Ox Alpha就是智谱的GLM-5.x,不是谷歌的新模型。
锐评
这条消息挺有意思,一个在OpenRouter上匿名冲榜的模型,被安全研究员用两个简单方法扒了皮。先是问“上一条消息有几个词”,直接套出了系统提示词,里面写着“你是ox-alpha,由未公开组织开发”。研究员反手把这段提示词喂回去,模型就自曝了:“我是GLM,由Z.ai制造”。另一个方法是用gzip压缩距离(NCD)做行为指纹比对,也指向GLM。 这两个方法都不复杂,但很有效。提示注入利用了模型对系统指令的服从惯性,NCD则是看模型输出在压缩后的相似度,不需要内部权重。不过正文没披露NCD对比的具体样本集和基线模型,也没说误判率有多高。如果样本量小,这个指纹的可靠性就得打个折。 另外,模型在思考链里提到“我是GLM,由Z.ai制造”,但文章标题和结论直接写GLM-5.x,这个版本号在正文里没有直接证据,可能是根据发布时间和性能推测的。这点先别太激动,等智谱官方确认或者更多基准测试出来再说。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
15:00
28d ago
TechCrunch AI· rssEN15:00 · 08·25
Gamma 收购设计初创 Lica,组建自己的设计研究实验室
做 AI 演示文稿的 Gamma 收购了 Accel 投资的 Lica,打算自己搞一个设计研究实验室,Lica 的两位联合创始人会带队。Lica 2023 年成立,最早能把截图和录屏转成演示文稿和视频,后来转向帮电商网站做符合品牌规范的营销视频。2024 年它从 Accel、South Park Commons 和 Village Global 拿了 ...
#Gamma#Lica#Accel
一句话点评
Gamma 收购了设计工具 Lica,主要是为了挖团队搞自己的设计研究实验室,不是买产品。Lica 2023 年成立,拿过 Accel 等机构的 400 万美元融资,最早做截图转演示文稿,后来转向电商营销视频。收购价没披露,但 Lica 体量小,Gamma 应该花得不多。看点在于 Gamma 想补设计能力,但 Lica 之前的方向变过两次,团队能不能稳定输出还不好说。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
14:00
28d ago
FT · 科技· rssEN14:00 · 08·25
Waymo 选慕尼黑作为欧洲首个 Robotaxi 落地城市
Waymo 宣布慕尼黑将成为其欧洲第一个 Robotaxi 运营城市。正文没披露具体上线时间、车队规模或当地合作方,目前只确认了城市选择。
#Waymo
一句话点评
Waymo 选慕尼黑作为欧洲首个 Robotaxi 落地城市,信号意义大于实质——正文没披露上线时间、车队规模或当地合作方,目前只确认了城市选择。慕尼黑监管相对友好、有自动驾驶测试基础,但欧洲对数据合规和事故责任要求严格,Waymo 在美国积累的经验不一定能直接平移。如果是真的,这会是中美之外第一个有头有脸的 Robotaxi 玩家进欧洲,但缺细节前先别太激动。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K0·R1
13:13
28d ago
Hacker News 首页· rssEN13:13 · 08·25
苹果发布 M6/M5 Pro 版 Mac mini:AI 性能最高提升 4 倍,定位“常开智能体桌面”
苹果今天发布了新款 Mac mini,可选 M6 或 M5 Pro 芯片。M6 版相比 M4 的 AI 性能最高提升 4 倍(官方称在 LM Studio 里跑大模型提示词比 M1 快 13.5 倍),图形和存储速度翻倍,CPU 快 40%。M5 Pro 给到最多 18 核 CPU 和 20 核 GPU,面向视频制作、游戏开发这类重活。两款都支持 Wi...
#Apple#Mac mini#M6
一句话点评
苹果把 M6 塞进 Mac mini,官方称 AI 性能比 M4 最高快 4 倍,在 LM Studio 里跑大模型提示词比 M1 快 13.5 倍。图形和存储速度翻倍,CPU 快 40%。M5 Pro 给到 18 核 CPU 和 20 核 GPU,面向视频制作、游戏开发。两款都支持 Wi-Fi 7、蓝牙 6 和 2.5Gb 以太网(可选 10Gb)。苹果把它定位为“始终在线的智能体计算桌面...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
13:03
28d ago
Ben's Bites· rssEN13:03 · 08·25
AI 智能体开始往手机上搬,Claude 出了免费课程教你怎么用
这期主要讲了两件事:手机端用智能体更方便了,以及 Anthropic 开了个免费学校。Claude Code 的远程控制功能更新后,你可以用手机启动电脑上的编程会话,断连会自动重连,iOS 端加载也更快了。Anthropic 还上线了 Claude Academy,一套免费的课程和岗位指南,教人怎么把 Claude 用明白。OpenAI 这边,Chat...
#Vision#Anthropic#Claude#OpenAI
一句话点评
Claude Code 现在能用手机远程启动编程会话,断连自动重连,iOS 加载更快。Anthropic 还开了 Claude Academy,免费课程教你怎么用 Claude。OpenAI 那边把 ChatGPT 接入了苹果短信,能搜消息、代回,GPT-5.6-Sol API 降价 20%,输入每百万 tokens 4 美元。Deepgram 的 Flux TTS 延迟低至 80 毫秒,支...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
13:03
28d ago
● P1Hacker News 首页· rssEN13:03 · 08·25
苹果发布搭载M5 Max和M5 Ultra芯片的新Mac Studio
新 Mac Studio 用上了 M5 Max 和 M5 Ultra 芯片,每个 GPU 核心里都塞了神经网络加速器,AI 算力比上代最高提升 4.3 倍。M5 Ultra 顶配能到 512GB 统一内存、1.2TB/s 带宽,意味着几百 GB 参数的开源大模型不用联网、不用租云 GPU,直接在本机就能跑,数据不出机器。四台 Mac Studio 还能...
#Apple#Johny Srouji#M5 Max
精选理由
精选 · 重要度 96 · 吸引力 + 知识量 + 共鸣
一句话点评
苹果把 M5 Ultra 和 M6 一起发了,Mac Studio 先上 M5 系列,M6 的机器要晚一点。
锐评
苹果这次发布有点特别,一口气亮了两代芯片:M5 Max、M5 Ultra 和 M6。新 Mac Studio 只搭载 M5 Max 和 M5 Ultra,M6 虽然发布了但暂时没机器用,苹果说后续产品会跟上。M5 Ultra 用了一种叫 UltraFusion 的封装技术把两颗 M5 Max 拼在一起,统一内存最高能到 512GB,对本地跑大模型的人来说,内存容量比算力数字更值得关注。苹果给的对比基准是 M1 Ultra 和 Intel 时代的 Mac,实际提升幅度得等第三方实测。另外,正文没提 M5 Ultra 的具体 TOPS 或与 Nvidia 同代 GPU 的横向对比,也没说 M6 的 Mac 什么时候出。如果你现在就需要一台能塞大模型的安静主机,M5 Ultra 的 Mac Studio 是个选项,但想等 M6 的话,时间表还是空的。
HKR 分解
hook knowledge resonance
打开信源
96
SCORE
H1·K1·R1
13:00
28d ago
TechCrunch AI· rssEN13:00 · 08·25
Keenable 拿了 2600 万美元种子轮,要给 AI 智能体专门建一个网页索引
Keenable 刚从隐身模式出来,拿了 Accel 领投的 2600 万美元种子轮。创始人 Andrey Styskin 之前管过 Yandex 的搜索和 AI 部门,他的判断是:现在的搜索引擎是给人用的,但 AI 智能体(就是能自己上网干活的模型)需要能一次性处理整页信息的索引。公司具体怎么做、什么时候上线,正文都没说。方向倒是很明确——把网页的基...
#Keenable#Accel#Conviction Partners
一句话点评
Keenable 刚出隐身模式,拿了 Accel 领投的 2600 万美元种子轮,要做给 AI 智能体用的网页索引。创始人之前管 Yandex 搜索和 AI,方向很明确:现在的搜索引擎是给人看的,智能体需要能一次处理整页信息的索引。但正文没披露技术细节和上线时间,2600 万种子轮金额不小,说明投资方赌的是团队和方向,不是产品成熟度。如果真能做出比传统搜索引擎更适合模型批量抓取的索引,成本可...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
12:33
28d ago
Hacker News 首页· rssEN12:33 · 08·25
OpenAI 恢复 ChatGPT Plus 的 5 小时使用上限
OpenAI 从 8 月 25 日起重新对 Plus 用户(月费 20 美元)施加 Codex 和 ChatGPT Work 的 5 小时使用限制。此前几周这个上限被临时取消,只剩每周总配额。工程负责人 Tibo 解释,恢复 5 小时限制是为了平滑计算负载,避免新手用户不小心一次性用完一周的额度然后懵掉。Pro 版(100/200 美元月费)不受此限。...
#OpenAI#ChatGPT#Codex#Product update
一句话点评
OpenAI 重新对 Plus 用户(20 美元/月)施加 Codex 和 ChatGPT Work 的 5 小时使用限制,此前几周临时取消。工程负责人说这是为了平滑负载,防止新手一次用完周配额。Pro 版(100/200 美元)不受限。说白了就是算力不够分,先拿 Plus 用户试水。正文没披露具体超限后买额外额度的价格,如果是真的挺省钱?但这点先别太激动,限制恢复说明 OpenAI 的推理...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
12:00
28d ago
TechCrunch AI· rssEN12:00 · 08·25
OpenAI 产品负责人:用户已经准备好用 AI 代理了,卡在体验和可靠性上
OpenAI 产品负责人 Thibault Sottiaux(管 Codex,向 Greg Brockman 汇报)接受 TechCrunch 采访,核心判断是“用户已经准备好用 AI 代理了”。他认为当前主要瓶颈不是技术能力,而是用户体验和可靠性——说白了就是代理干活不够稳、交互不够顺。采访里没有披露具体产品路线图或发布时间表,所以这点先别太激动。S...
#OpenAI#Thibault Sottiaux#Greg Brockman
一句话点评
OpenAI 产品负责人说用户已经准备好用 AI 代理了,但瓶颈是体验和可靠性——说白了就是干活不稳、交互不顺。采访没给具体路线图或时间表,所以这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
09:36
28d ago
r/LocalLLaMA· rssEN09:36 · 08·25
腾讯放出 WeMM-Embedding 多模态嵌入模型,9B/4B/2B 三个尺寸
腾讯在 HuggingFace 上发布了 WeMM-Embedding 系列,基于 Qwen3.5 构建,能处理文本、图片、视频、视觉文档和混合多模态输入,输出一个 4096 维的 L2 归一化向量。不支持音频。9B 版本瞄准高精度场景,2B 和 4B 留给本地部署。帖子没给基准对比和推理延迟,我会先打个折,等实际检索测试跑完再下结论。
#Tencent#Qwen
一句话点评
腾讯在 HuggingFace 上发了 WeMM-Embedding 系列,基于 Qwen3.5,能直接把文字、图片、视频、文档混在一起编码成一个 4096 维的向量,方便做跨模态搜索。9B 版本冲着高精度去,2B 和 4B 留给本地跑。帖子没给任何基准对比和推理延迟,这点先别太激动。技术报告里应该有具体分数,但正文没披露,实际检索效果还得自己测了才知道。
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
07:00
28d ago
● P1OpenAI 博客· rssEN07:00 · 08·25
OpenAI 公布推理芯片 Jalapeño 首批实测成绩
OpenAI 公布了自研推理芯片 Jalapeño 的首批实测数据。在 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 1T 三个模型上,Jalapeño 峰值吞吐量下每瓦处理量是对比系统的 1.5 到 1.9 倍,端到端延迟低了 1.7 到 3.6 倍。交互式负载下优势更大,达到 2.1 到 4.1 倍。这颗芯片没走“吞吐量...
#OpenAI#Jalapeño#GPT-OSS
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 自研推理芯片 Jalapeño 首批实测数据出来了,跑自家和别家模型都能做到更快更省电,但所有数据都来自 OpenAI 自己,还没第三方独立验证。
锐评
OpenAI 公布了 Jalapeño 芯片的第一批实测成绩,核心结论是:一块芯片同时把延迟压低了、吞吐量拉高了,不用像现有硬件那样在速度和吞吐量之间做取舍。在 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 1T 这三款模型上,Jalapeño 每瓦能多干 1.5 到 1.9 倍的活,端到端延迟降到对比系统的 1/1.7 到 1/3.6。对需要多步串联的智能体任务,性能优势更明显,达到 2.1 到 4.1 倍。 这些数字如果属实,意味着用 Jalapeño 跑大模型推理,同等电量下能服务更多请求,用户等回复的时间也更短。OpenAI 还提到芯片设计阶段就用了自家模型帮忙,芯片本身也设计成让 AI 更容易编程,这算是一个从模型到芯片的闭环。 不过现在下结论还太早。文章里没给出对比系统的具体配置,也没说测试用的是量产芯片还是工程样片。所有数据都来自 OpenAI 自己的测试环境,没有第三方机构或客户的实际部署反馈。功耗、成本、量产良率这些关键信息也都没披露。等有独立评测和实际产品上线后,才能判断这芯片是不是真能帮 OpenAI 把推理成本打下来。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
04:33
28d ago
Hacker News 首页· rssEN04:33 · 08·25
Ambient Context:一个只读文字、不截图的 macOS 记忆工具
这是一个 macOS 菜单栏小工具,每隔几秒通过系统辅助功能接口读取当前窗口里的文字内容,然后存成按天归档的 Markdown 文件。它不截图、不录屏、也不用 OCR。把 Claude Code 或任何能读文件的模型指向这个文件夹,就能问“我周二干了什么”或者让它帮你梳理项目记忆。文件夹里自带一份 AGENTS.md 说明格式。正文没提性能开销和隐私细...
#Ambient Context#Claude Code
一句话点评
一个 macOS 菜单栏小工具,每隔几秒抓取当前窗口的文字内容,存成按天归档的 Markdown 文件。不截图、不录屏、不用 OCR,直接读系统辅助功能接口拿文本。把 Claude Code 或任何能读文件的模型指向这个文件夹,就能问“我周二干了什么”或者让它帮你梳理项目记忆。文件夹里自带一份 AGENTS.md 说明格式。 想法挺实用,相当于给电脑装了个纯文本的“记忆外挂”,省去了截图占...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
04:06
28d ago
r/LocalLLaMA· rssEN04:06 · 08·25
4060Ti 16GB 独立写完一个功能分支,还合并了
Reddit 用户发帖说,他用一张 4060Ti 16GB 跑本地模型,从写代码到合并分支全让模型干完了。这是消费级显卡第一次走完完整开发流程的公开记录。帖子正文被 Reddit 屏蔽,没透露用了什么模型、代码质量如何、分支具体做什么。单看标题,至少说明本地模型已经能独立完成一个功能分支的编码和合并操作,对本地 AI 编程来说是个实在的里程碑。
#Code#Reddit#LocalLLaMA
一句话点评
一张 4060Ti 16GB 跑本地模型,从写代码到合并分支全包了,消费级显卡第一次走完完整开发流程。正文被 Reddit 屏蔽,没透露用了什么模型、代码质量如何、分支具体做什么。单看标题,至少说明本地模型已经能独立完成一个功能分支的编码和合并操作,对本地 AI 编程来说是个实在的里程碑。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
03:19
28d ago
AI HOT 精选· aihot-apiZH03:19 · 08·25
飞书豆包合并后首款Agent产品“豆包工作”发布
飞书和豆包合并后推出了第一款Agent产品,叫“豆包工作”。但正文页面被环境拦截,需要验证才能看,所以产品功能、定价、上线时间这些细节都没披露。目前能确认的就是产品名字和“合并后第一款Agent”这个定位。
#飞书#豆包
HKR 分解
hook knowledge resonance
打开信源
25
SCORE
H0·K0·R0
01:40
28d ago
Hacker News 首页· rssEN01:40 · 08·25
大学怎么培养创始人?Paul Graham:别教创业课,教好 CS 和机械工程就行
Paul Graham 直接给了结论:大学想让学生能创业,不用开什么创业课程,把计算机科学、机械工程、分子生物学这些硬学科教好就够了。YC 合伙人看人很简单,就找那些擅长动手做东西、并且有动手习惯的人。他拿哈佛、耶鲁和普林斯顿举例,哈佛校友申请 YC 的比例是后两所的两倍,不是学生素质差多少,纯粹是校园氛围让哈佛学生觉得创业是件自己能干的事。文章另一个...
#Paul Graham#Y Combinator#Harvard
一句话点评
Paul Graham 把大学培养创业者的路径说得很直白:别开创业课,把计算机、机械工程、分子生物学这些硬学科教扎实就行。YC 看人就看一条——会不会动手做东西,有没有动手的习惯。他拿哈佛、耶鲁、普林斯顿举例,哈佛校友申请 YC 的比例是后两所的两倍,不是学生素质差多少,纯粹是校园氛围让哈佛学生觉得创业是件自己能干的事。文章另一个核心建议是给学生时间和鼓励去做自己的项目,项目能加深理解、帮你...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
01:07
28d ago
纽约时报中文网· rssZH01:07 · 08·25
中国机器人百米跑赢博尔特,但撞墙起火,离实用还很远
北京人形机器人创新中心的人形机器人跑出9.39秒,比博尔特的世界纪录快0.19秒,但冲线后撞墙倒地起火,被工作人员抬走。专家说这主要是硬件和控制系统的进步,不是通用智能的突破。机器人目前只能在刻意安排的场景里表现好,一到真实环境就摔、撞、着火。宇树科技靠机器人表演视频带火IPO,首日涨了460%,但实际应用还差得远。正文没披露这台机器人的成本、量产计划...
#Robotics#北京人形机器人创新中心有限公司#X-Humanoid#宇树科技
一句话点评
短评:跑赢博尔特但撞墙着火,工程炫技远大于通用智能突破。 点评:北京人形机器人创新中心的机器人100米跑出9.39秒,比博尔特快0.19秒,但冲线后撞墙倒地起火,被工作人员抬走。专家直言这主要是硬件和控制系统的进步,不是通用智能的突破——机器人目前只能在刻意安排的场景里表现好,一到真实环境就摔、撞、着火。宇树科技靠机器人表演视频带火IPO,首日涨了460%,但实际应用还差得远。正文没披露这...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
00:00
29d ago
● P1OpenAI 博客· rssEN00:00 · 08·25
OpenAI封禁俄罗斯账号伪装以色列智库进行舆论渗透
OpenAI 封掉了一批来自俄罗斯的 ChatGPT 账号。这些账号在幕后操纵一个叫“国际伯克研究所(IBI)”的假智库,网站自称设在以色列,实际上文章是从正经学术作品里抄来、篡改署名,再用机器翻译成英文的。操作者用俄语给模型下指令,让它生成英文的社交媒体帖子和评论,还特意要求模型藏好俄语痕迹。他们搞了一个“主权指数”,排名上捧俄罗斯、踩西方国家。Op...
#Vision#OpenAI#International Burke Institute#ChatGPT
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 封了一批俄罗斯账号,它们假装成以色列智库搞舆论渗透。这事值得看的是操作手法很花心思,但实际影响不大。
锐评
OpenAI 自己下场查了一起伪装成以色列智库的俄罗斯舆论渗透行动,并封禁了相关 ChatGPT 账号。这个叫“国际伯克研究所”的假智库,网站文章很多是抄来的学术论文,还编了个“主权指数”给俄罗斯贴金、贬低西方国家。操作者用俄语写提示词,让 ChatGPT 生成英文和德文帖子,发在 X、LinkedIn 和 Substack 上,甚至去别人帖子底下留言求关注。OpenAI 说这是自俄乌战争以来,他们捣毁的俄罗斯相关行动里“搭建得最精心”的一个。 不过,OpenAI 也承认这次行动实际触达的受众很少。正文没披露具体封了多少账号、帖子有多少阅读量,也没说这些假账号到底吸引了多少真人互动。所以手法虽然花哨,效果可能很有限。 还缺一个关键信息:OpenAI 是怎么在用户用了 VPN 的情况下,判定这些账号“极有可能”来自俄罗斯的。文章只提了操作者用俄语提示、并让模型隐藏语言线索,但没展开讲归因的技术依据。这点先别太激动,等更多细节出来再判断。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
00:00
29d ago
Hugging Face 博客· rssEN00:00 · 08·25
Gradio 出了个 gr.Workflow:把 AI 流水线变成能拖拽的画布,每一步结果都看得见
Gradio 新推出的 gr.Workflow 让你用节点图的方式搭 AI 流水线,每个中间步骤的结果都会直接显示在画布上,不用再靠打印日志来排查哪一步出了错。它同时也是一个 REST API,每个节点自带接口,一行命令就能部署到 Hugging Face Spaces。文章展示了四个可跑的 Demo:用 Qwen-Image-Edit 做图片编辑、把...
#Vision#Gradio#Hugging Face#Qwen-Image-Edit
一句话点评
Gradio 把 AI 流水线做成了可视化节点图,拖拽就能搭,中间结果直接显示,不用再靠打印日志排查错误。每个节点自带 REST API,一行命令部署到 Hugging Face Spaces。文章给了四个 Demo,包括图片编辑、媒体工作室等。但没提延迟和定价,如果是生产环境,性能够不够用还得自己测。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
00:00
29d ago
OpenAI 博客· rssEN00:00 · 08·25
OpenAI 给 ChatGPT Work 和 Codex 加了个管理插件,IT 人员可以在聊天窗口里直接管人、管额度、管权限
这个 Admin 插件把后台管理操作搬进了聊天界面。管理员不用来回切换工具,在对话里就能查用量、增减成员、调整权限、审批预算申请。插件还能把审批请求自动推送到 Slack 或 Teams,符合预设规则的申请可以自动通过,只把例外情况留给人处理。OpenAI 自己的 IT 团队说,现在约 45% 的工单量已经被自动处理掉了。不过要注意,插件不会给用户额外...
#OpenAI#ChatGPT Work#Codex
一句话点评
OpenAI 把后台管理搬进了聊天框,管理员在对话里就能查用量、增减成员、审批预算。亮点是审批能自动推 Slack/Teams,符合规则的自动过,只留例外给人。OpenAI 自家 IT 说 45% 工单已被自动处理——这个数字来自内部,外部参考价值打折。插件不额外提权,但正文没披露定价和是否限企业版。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R0
00:00
29d ago
AI HOT 精选· aihot-apiZH00:00 · 08·25
OpenRouter 把视频生成也做成了统一 API:换模型只改一行代码
OpenRouter 把多个视频生成模型(Seedance、Veo、Wan 等)塞进同一个异步 API。你发一个 POST 请求到 /api/v1/videos,拿到一个 job ID,轮询等它完成,下载 MP4。换模型只需要改一行 model 参数,不用重新对接不同厂商的接口、认证和轮询逻辑。正文没披露具体价格和生成速度,但强调异步设计比直接对接各家...
#OpenRouter#Seedance#Veo
一句话点评
OpenRouter 把 Seedance、Veo 等视频生成模型统一成一个异步 API:发请求拿 job ID,轮询等结果,下载 MP4。换模型改一行 model 参数就行,不用重新对接各家接口和认证。正文没披露具体价格和生成速度,但异步设计比直接对接各家或本地跑 GPU 省事。如果是真的挺省钱,但轮询延迟和稳定性得自己试。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
00:00
29d ago
AI HOT 精选· aihot-apiZH00:00 · 08·25
OpenRouter 教你六步挑模型:先看任务,再看成本,别信排行榜
OpenRouter 发了一篇实用指南,核心观点是“没有最好的模型,只有最适合你任务、预算和延迟的模型”。它给了一个六步框架:先定义任务,再用排行榜和实时用量数据筛出候选,然后对比不同供应商的价格和延迟,最后拿自己的提示词跑一轮实测。评判标准是“每个任务花多少钱”,而不是“每个 token 花多少钱”。OpenRouter 的 MCP 服务器可以直接在...
#Benchmarking#Inference-opt#OpenRouter#Artificial Analysis
一句话点评
OpenRouter 这篇指南的核心是:别迷信排行榜,先定义任务,再拿自己的提示词跑一轮实测,最后按“每完成一个任务花多少钱”来算账,而不是按 token 单价。它提供了一个六步框架,还能在编辑器里通过 MCP 直接查实时排名和价格。正文没披露具体测试案例或成本对比数据,所以实操效果得自己试。对选模型头疼的团队,这套流程比看榜单靠谱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0

更多

频道

后台