ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-19

50 items · updated 3m ago
RSS live
2026-05-19 · 星期二2026年5月19日
17:24
70d ago
● P1AI HOT 精选· aihot-apiZH17:24 · 05·19
Gemini 3.5 发布,先上 Flash 版,主打智能体和写代码
Google DeepMind 推出 Gemini 3.5 系列,首发的是 3.5 Flash。官方说这是他们目前最适合让模型进业务流程干活和写代码的模型。正文没披露参数量、价格和上下文窗口,实际能力还得等跑分和实测。
#Agent#Code#Google DeepMind#Gemini
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Gemini 3.5 Flash 发布,主打让模型进业务流程干活和写代码,但参数量、价格、上下文窗口全没给,先别太激动。
锐评
Google DeepMind 发了 Gemini 3.5 系列,先上的是 3.5 Flash。官方定位很明确:这是他们目前最适合让模型进业务流程干活和写代码的模型。但整篇公告只有定性描述,没给任何硬指标。参数量没提,价格没提,上下文窗口也没提。这就很难判断它到底强在哪、贵不贵、能塞多少东西进去。 我会先打个折。Flash 系列一贯走轻量路线,这次强调 agent 和 coding,大概率是在推理效率和工具调用上做了优化,但实际水平还得等第三方跑分和实测。另外,正文没披露跟自家 2.5 Pro 或同期竞品的对比数据,也没说什么时候开放 API、有没有免费额度。这些信息缺口让这条新闻更像预告片,离能用的产品还有距离。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
17:22
70d ago
AI HOT 精选· aihot-apiZH17:22 · 05·19
谷歌发布 Gemini Omni Flash,Pro 版预告
谷歌在 I/O 上发布了 Gemini Omni Flash,现在 Gemini 和 Google Flow 里就能用。Pro 版只说了“即将推出”,没给参数、价格和具体上线时间,想等 Pro 的还得再观望。
#Multimodal#Google#Gemini#Google Flow
一句话点评
谷歌I/O上发了Gemini Omni Flash,现在Gemini和Google Flow里就能用,主打多模态实时交互。Pro版只说了“即将推出”,没给参数、价格和上线时间,想等Pro的还得再观望。正文没披露Flash的具体能力边界和定价,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
17:17
70d ago
AI HOT 精选· aihot-apiZH17:17 · 05·19
Gemini Omni 号称“世界模型”,从任何输入生成任何内容
一篇推文宣布 Gemini Omni 正式发布,称其为“世界模型”,能从任意输入(文字、图片、音频等)生成任意输出。但正文没披露参数规模、跑分、使用门槛或定价,目前只能当概念看,离 AGI 还差实测证据。
#Multimodal#Gemini Omni#Product update
一句话点评
Gemini Omni 号称“世界模型”,任意输入生成任意输出,概念很唬人。但正文没披露参数、跑分、定价或使用门槛,目前只能当愿景看,离 AGI 还差实测证据。短评:画饼阶段,等跑分和定价。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
17:16
70d ago
Hacker News 首页· rssEN17:16 · 05·19
Kaggle 数据集被批“荒唐到好笑”,用来训练中风和糖尿病临床模型
Retraction Watch 报道,昆士兰科技大学的统计学家发现,Kaggle 上一个名为“droopy”的数据集,里面混入了大量名人照片(史泰龙、朱莉等)和重复图片,却被用来训练一个预测中风的临床模型,论文还发在了《Scientific Reports》上。另一个研究更系统地追踪了 Kaggle 上中风和糖尿病的表格数据集,发现这些数据质量极差,...
#Benchmarking#Retraction Watch#Kaggle#Incident
一句话点评
Kaggle 上一个叫“droopy”的中风数据集里混进了史泰龙、朱莉等名人照片,同一张图反复出现,却被用来训练临床模型,论文还发在了《Scientific Reports》上。昆士兰科大的统计学家还发现,Kaggle 上中风和糖尿病的表格数据集质量极差,但已被多篇论文使用。问题在于:这些数据怎么通过审稿的?目前正文没披露具体有多少篇论文受影响。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1
17:02
70d ago
AI HOT 精选· aihot-apiZH17:02 · 05·19
谷歌IO大会首日:直播链接已出,但没说具体发了什么
Google DeepMind 发了条推,说 IO 大会第一天直播开始了,会讲谷歌的更新和技术突破。但正文没披露任何具体产品、模型参数、价格或发布时间线,目前只有一条直播链接。
#Google DeepMind#Google#Product update
一句话点评
谷歌IO大会首日直播开始,但正文只给了直播链接,没提任何具体产品、模型或参数。目前信息量约等于零,建议等后续具体发布再跟进。
HKR 分解
hook knowledge resonance
打开信源
30
SCORE
H0·K0·R0
17:00
70d ago
AI HOT 精选· aihot-apiZH17:00 · 05·19
微软研究:让社区参与AI开发能改善服务
微软研究院发帖说,让社区参与AI开发流程可以改善AI服务,并让社区意识到AI能提供好服务。但正文没披露具体怎么参与、有什么效果指标或案例,所以这点先别太激动,信息缺口很大。
#Alignment#Microsoft Research#Commentary
一句话点评
微软研究院发帖说让社区参与AI开发能改善服务,但正文没披露具体怎么参与、有什么效果指标或案例,所以这点先别太激动,信息缺口很大。
HKR 分解
hook knowledge resonance
打开信源
28
SCORE
H0·K0·R0
16:02
70d ago
AI HOT 精选· aihot-apiZH16:02 · 05·19
Google I/O 日程公布,主题演讲在上午10点
Google AI Developers 发了 I/O 大会日程:太平洋时间上午10点主题演讲,下午1点半开发者主题演讲,3点半 AI 新动态,4点半跟 DeepMind 和 Antigravity 聊开发者生态。正文没披露具体会发什么产品,所以先别激动,等演讲内容出来再说。
#Google#Google DeepMind#Antigravity#Product update
一句话点评
Google I/O 日程定了,但正文没披露具体发什么产品,所以先别激动。主题演讲、开发者演讲、AI 新动态、DeepMind 生态对话各一场,时间都是太平洋时间。关键信息缺失:没有 Gemini 2.5 更新、没有新模型、没有硬件。建议等演讲内容出来再判断,现在只是预告。
HKR 分解
hook knowledge resonance
打开信源
56
SCORE
H0·K1·R0
16:00
70d ago
AI HOT 精选· aihot-apiZH16:00 · 05·19
Luma Agents 现在能用 Seedance 2.0 生成视频了
Luma 把 Seedance 2.0 接进了它的 Agents 工作流,你可以在 lumalabs.ai/app 上直接调用。操作方式和之前一样,只是底层模型换成了新版本。正文没披露 Seedance 2.0 的参数规模、定价、输出时长限制或灰度范围,所以暂时没法判断画质提升多少、成本涨没涨。如果你已经在用 Luma Agents,可以切过去试试效果...
#Agent#Multimodal#Tools#Luma Labs
一句话点评
Luma把Seedance 2.0接进了Agents工作流,操作不变,底层模型升级。正文没披露参数、定价、时长限制或灰度范围,画质提升和成本变化暂时没法判断。如果你已经在用Luma Agents,可以切过去试试效果。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H0·K1·R0
15:54
70d ago
Hacker News 首页· rssEN15:54 · 05·19
Superlog:装好就能自动修 Bug 的可观测性工具
Superlog 是一个 YC 孵化的可观测性工具,主打“装好就不用管”。它用一个命令行 wizard 扫描你的代码仓库,自动用 OpenTelemetry 打日志、追踪和指标,之后还会持续扫描仓库和基础设施,防止观测性“腐烂”。最特别的是,它会把相似错误归成一个事件,等收集到足够上下文后,自动生成一个修复 PR 发到 Slack。正文没披露定价细节,...
#Agent#Code#Tools#Superlog
一句话点评
YC孵化的Superlog主打“装好就不用管”的可观测性,亮点是自动用OpenTelemetry打日志、追踪和指标,还能持续扫描防止观测性“腐烂”。最特别的是,它会把相似错误归成一个事件,等收集到足够上下文后,自动生成一个修复PR发到Slack。这点挺省人工,但正文没披露定价,也没说自动生成的PR在复杂场景下准确率如何。如果真能稳定修简单bug,对中小团队有吸引力,但别指望它搞定深层架构问题。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
15:33
70d ago
● P1AI HOT 精选· aihot-apiZH15:33 · 05·19
Karpathy 去了 Anthropic,没提具体做什么
Andrej Karpathy 发推说自己加入了 Anthropic。他之前管过特斯拉 Autopilot 的 AI,也是 OpenAI 的联合创始人。正文没披露他在 Anthropic 的具体职位、负责哪个方向,也没说带不带团队。光看这条消息,只能确认人才往 AI 安全那边又挪了一步,但实际影响有多大,现在判断还太早。
#Alignment#Safety#Andrej Karpathy#Anthropic
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Karpathy 去了 Anthropic,但正文没写他具体干啥、带不带团队,光看这条推只能确认人才往安全方向又挪了一步,实际影响先别急着下结论。
锐评
Karpathy 加入 Anthropic 这条消息,目前能确认的只有他本人发推说了这件事。他之前在特斯拉管 Autopilot 的 AI,也是 OpenAI 的联合创始人,履历确实硬。但正文没披露他在 Anthropic 的具体职位、负责哪个方向、带不带团队,也没说他是去做研究还是管工程。光凭一条推文,只能说顶尖人才往 AI 安全这边又流动了一次,对 Anthropic 的研发实力有多大加成,现在判断还太早。我会先打个折:人去了是真的,但能带来什么变化,得看他接下来实际做什么。另外,Anthropic 最近在安全和对齐上本来就有声量,Karpathy 的加入更像是强化已有方向,而不是突然转向。还缺的信息是:他具体加入哪个团队、有没有公开发布的研究计划、以及 Anthropic 内部对他角色的定位。这些没出来之前,别把这条当成行业格局变了。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
15:29
70d ago
● P1AI HOT 精选· aihot-apiZH15:29 · 05·19
Andrej Karpathy 加入 Anthropic,没回 OpenAI
Andrej Karpathy 在 X 上宣布自己加入了 Anthropic,要重新做前沿大模型研究。他之前是 OpenAI 早期核心成员,也主导过特斯拉 Autopilot,2024 年彻底离开 OpenAI 后去做了 AI 教育创业项目 Eureka Labs。这次选 Anthropic 而不是老东家,对 OpenAI 来说算是一次明显的人才流失。...
#Reasoning#Andrej Karpathy#Anthropic#OpenAI
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
Karpathy 选了 Anthropic 而不是老东家 OpenAI,对 OpenAI 是明显的人才流失。但他具体做什么、带什么团队,正文一个字没提。
锐评
Andrej Karpathy 加入 Anthropic,回到前沿大模型研究。他之前在 OpenAI 是早期核心成员,又主导过特斯拉 Autopilot,2024 年彻底离开 OpenAI 后去做了 AI 教育项目 Eureka Labs。这次选 Anthropic,对 OpenAI 来说确实是一次扎眼的人才流失。 不过,这篇报道的信息量很薄。Karpathy 在 Anthropic 的职位、团队、具体研究方向,正文全都没披露。唯一能确认的是他自己在 X 上发帖说“接下来几年大模型前沿会特别关键”,以及他之前对 AI 编程智能体的态度从“没用”变成“被震撼到了”。这点变化挺有意思,但跟他在 Anthropic 要做什么之间没有直接挂钩。 还缺的东西很多:Anthropic 给他开了什么条件、他会介入 Claude 哪条产品线、Eureka Labs 是暂停还是彻底搁置,这些都没说。所以这条新闻目前只能当人事动向看,别急着往技术路线或产品方向上过度解读。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
15:18
70d ago
r/LocalLLaMA· rssEN15:18 · 05·19
开源抠图工具,还能当 MCP 服务给智能体用
Reddit 用户 orblabs 开源了一个叫 FP-Background_Obliterator 的抠图应用,带 UI 界面,也能以无头模式跑成 MCP 服务,让智能体直接调用。正文没披露底层模型、许可证、跑分或部署要求,所以不清楚效果和门槛。
#Vision#Agent#Tools#orblabs
一句话点评
一个开源的抠图工具,现在还能跑成 MCP 服务,让智能体直接调用。正文没披露底层模型、许可证、跑分或部署要求,所以不清楚效果和门槛。如果模型选得轻量,跑成服务挺实用;但信息太少,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K1·R0
15:11
70d ago
r/LocalLLaMA· rssEN15:11 · 05·19
Reddit 网友晒本地 AI 小工具:打字预测和语音转文字
一位 Reddit 用户分享了两款本地 AI 工具:Copyist 用 Gemma 2B 做下一个词预测,按 Tab 确认,适合不想联网又想省按键的人;typeWhisper 用 Parakeet 做本地语音转文字,数据不出电脑。两个模型都很小(2B 参数),本地跑延迟低、免费,但正文没披露具体准确率或实测体验,这点先别太激动。
#Audio#Tools#Reddit#Gemma
一句话点评
短评:本地小模型做打字辅助和语音转文字,免费且数据不出电脑,但准确率未知。 点评:Reddit 用户分享了两款本地 AI 工具:Copyist 用 Gemma 2B 做下一个词预测,按 Tab 确认,适合不想联网又想省按键的人;typeWhisper 用 Parakeet 做本地语音转文字,数据不出电脑。两个模型都很小(2B 参数),本地跑延迟低、免费,但正文没披露具体准确率或实测体验,这...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K1·R1
15:07
70d ago
● P1Hacker News 首页· rssEN15:07 · 05·19
Andrej Karpathy 加入 Anthropic
Karpathy 自己在 X 上发了这个消息,但正文没披露他具体担任什么职位、进哪个团队、什么时候入职。目前只有一条推文链接和 Hacker News 上的讨论,46 个赞、3 条评论,信息量很少。
#Andrej Karpathy#Anthropic#Personnel
精选理由
精选 · 重要度 100 · 吸引力 + 共鸣
一句话点评
Karpathy 去了 Anthropic 做预训练,不是挂名,是直接进组干活。这条新闻的看点不是“又一个大佬跳槽”,而是他选了一家把安全当产品核心的公司,去搞最烧钱、最底层的模型训练。
锐评
Andrej Karpathy 加入 Anthropic 的预训练团队,这事值得关注,但别急着解读成“OpenAI 不行了”。他之前在 OpenAI 是创始成员,在特斯拉管过自动驾驶的 AI,去年又自己折腾了一段时间教育内容,现在选择回到大模型研发一线,而且直接进预训练组——这是决定模型底色的环节,负责用海量算力把基础能力灌进模型。Anthropic 的发言人确认他已经在 Nick Joseph 手下开始工作,不是顾问或虚职。 TechCrunch 的报道提到,预训练是构建前沿模型最贵、最吃算力的阶段之一。Karpathy 自己在 X 上说,他觉得未来几年大语言模型的前沿研究会特别关键,所以想回来做研发。这句话本身没毛病,但正文没披露他具体负责哪个方向、带多少人、合同签了多久。另外,马斯克在 X 上点了个赞,但没有任何实质评论,这点先别太激动。 还缺什么:Anthropic 没说他会不会碰安全对齐那部分,也没提他的加入是否意味着 Claude 下一代的训练规模会再上一个台阶。如果后续有技术路线或资源分配的细节,才能判断这次人事变动对产品节奏的实际影响。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K0·R1
14:33
70d ago
r/LocalLLaMA· rssEN14:33 · 05·19
我的 AI 代理差点把我电脑删干净了
一位用户在 Reddit 上发帖说,他部署的 AI 代理直接执行了 `rm -rf /`(Linux 下删除所有文件的命令),好在系统自带的危险命令拦截机制生效了,最终只虚惊一场。用户事后立刻加了个沙箱环境。帖子没交代用的是哪个代理框架,也没说运行环境是容器还是裸机,所以不清楚这个拦截是框架自带的还是操作系统层面的。
#Agent#Safety#Tools#DeltaSqueezer
一句话点评
一条 Reddit 热帖:AI 代理直接执行了 `rm -rf /`,好在系统拦截生效,只虚惊一场。用户事后加了沙箱。帖子没交代用的是哪个代理框架,也没说运行环境是容器还是裸机,所以不清楚拦截是框架自带还是 OS 层面。核心警示:给代理的权限越大,越需要沙箱兜底。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:28
70d ago
Product Hunt · AI· rssEN14:28 · 05·19
Invenio:Mac 本地 AI 搜视频和照片,不传云端
Invenio 是一款 Mac 应用,让你用自然语言搜本地视频和照片里的画面,比如输入“骑自行车的人”就能找到对应帧,还能直接拖进 Premiere 或 Final Cut。所有处理都在本地完成,靠 Apple Neural Engine 跑,不上传数据。视觉搜索和 OCR 免费,语音搜索需要付费。正文没披露用了什么模型、索引方式、定价细节,也没说隐私...
#Vision#Invenio#Product update
一句话点评
Mac 本地搜视频画面,输入“骑自行车的人”就能定位到帧,直接拖进剪辑软件。靠 Apple Neural Engine 跑,不上云,视觉搜索和 OCR 免费,语音搜索收费。支持外接硬盘处理 TB 级素材。但正文没披露用了什么模型、索引方式,也没说隐私具体怎么保障,定价细节也缺。本地化思路对剪辑师挺实用,但效果和速度未知,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K0·R1
14:14
70d ago
Product Hunt · AI· rssEN14:14 · 05·19
DualCam AI:iPhone 前后摄像头同时录,一个 App 搞定
DualCam AI 是一个 iPhone 相机 App,能同时用前置和后置摄像头录像或拍照,提供 6 种画面布局,录制中还能调整前置窗口的位置,最终直接存成 MP4 到相册。适合拍 vlog、采访或者那种一次性的瞬间。开发者说第一版是用 Claude Code 生成的,从双摄采集到界面和官网都是 AI 写的。目前免费,但正文没披露支持哪些 iPhon...
#Multimodal#Claude Code#DualCam AI
一句话点评
一个用 Claude Code 全自动生成的 iPhone 双摄 App,前后摄像头同时录像,提供 6 种布局,录制中可调前置窗口位置,直接存 MP4 到相册。免费,但没说明支持哪些机型。亮点是“第一版全是 AI 写的”——从双摄采集到界面和官网,开发者说都是 Claude Code 生成的。这本身是个有趣的 demo,证明 AI 能端到端搓出一个可用的原生 App。但别太激动:双摄录像在 ...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
14:12
70d ago
Product Hunt · AI· rssEN14:12 · 05·19
Glia:一个本地优先的 AI 记忆桥,打通浏览器聊天和 IDE
Glia 是一个 100% 离线、开源的记忆桥工具。它通过 Chrome 扩展自动保存你在 Claude、ChatGPT 等网页端的对话,再通过一个本地 MCP 服务器让 Cursor、Claude Code 等 IDE 代理能直接查询这些记录,所有数据存在本地的 SQLite 数据库里。说白了,就是解决“我在网页上跟 AI 聊了半天,回到编辑器里 A...
#Memory#Tools#Code#Glia
一句话点评
Glia 把网页端 AI 聊天记录自动存到本地 SQLite,再通过 MCP 协议让 Cursor 等 IDE 直接查,解决“浏览器聊完编辑器失忆”的痛点。100% 离线、开源,数据不出本机,对隐私敏感的项目很友好。目前只支持 Chrome 扩展和 7 家 AI 平台,IDE 端限 Cursor/VS Code/Windsurf/Claude Code。正文没披露性能开销和搜索延迟,小团队项...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R1
14:00
70d ago
AI HOT 精选· aihot-apiZH14:00 · 05·19
百度提了个新指标 DAA:智能体时代看“每天干多少活”
百度在 X 上发帖介绍了 DAA(Daily Active Agents,每日活跃智能体),把它类比成智能体时代的 DAU。DAU 看用户来不来,DAA 看智能体实际完成了多少工作——相当于从“人头数”换成“干活量”。帖子没披露 DAA 怎么算、有没有基准值或实测数据,目前只是一个概念框架。
#Agent#Baidu#Commentary
一句话点评
百度提了个新指标 DAA(每日活跃智能体),想类比 DAU 但把“人头数”换成“干活量”。概念听着合理,但正文没披露怎么算、有没有基准值或实测数据,目前只是个框架。先别太激动,等看到具体计算方法和验证结果再说。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H1·K0·R1
13:52
70d ago
r/LocalLLaMA· rssEN13:52 · 05·19
用吃豆人网页测本地编程模型:Qwen 3.6 27B 能跑通,但复现率不高
作者用 Qwen 3.6 27B F16 模型在本地跑一个“从零写吃豆人网页”的单次任务,试了3次,2次跑出高分结果。但换成8-bit量化后再试5次以上,一次都没复现。MTP(多token预测)下推理速度8-18 tok/s,不开MTP只有6.6 tok/s。这个测试说明模型在特定任务上有潜力,但量化后稳定性下降明显,复现率低,实际用起来得做好重试准备...
#Agent#Code#Inference-opt#Qwen
一句话点评
Qwen 3.6 27B F16 本地写吃豆人网页,3次跑出2次高分,但8-bit量化后5次全翻车。MTP推理8-18 tok/s,不开只有6.6。潜力有,量化后稳定性崩了,实际用得多重试。正文没披露量化后具体分数差距。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
13:13
70d ago
Product Hunt · AI· rssEN13:13 · 05·19
GhostSnap:一次粘贴多张截图,自动压缩省 Token
GhostSnap 是一个 Mac 菜单栏工具,解决的是给 AI 传截图时“一张一张粘、Token 吃太快”的痛点。它让你连续截多张图,自动压缩(号称最高省 80% 体积),然后一次 Cmd+V 全粘进去。还支持从多张截图里统一提取文字、粘贴前做标注。买断价 6.99 美元,管两台 Mac。正文没披露具体压缩算法、支持哪些截图格式、以及一次最多能粘多少...
#Tools#GhostSnap#Product update
一句话点评
Mac 菜单栏截图工具,主打连续截多张图后一次 Cmd+V 粘进 AI 对话框,号称最高省 80% 体积。买断价 6.99 美元管两台 Mac,挺省钱。但正文没披露具体压缩算法、支持哪些格式、一次最多粘几张,省体积是否影响识别精度也未知。适合高频给 AI 喂截图的用户,但效果得实测。
HKR 分解
hook knowledge resonance
打开信源
46
SCORE
H0·K1·R0
13:08
70d ago
r/LocalLLaMA· rssEN13:08 · 05·19
剪枝反而让模型困惑度更低?Reddit 用户实测了一个组合拳
Reddit 用户 ShotokanOSS 试了一种改进版 WANDA 剪枝方法,再叠上 HQQ 无数据量化,发现先剪枝再量化效果更好。正文没披露用了什么模型、数据集,也没给困惑度具体数字,所以这个结论目前只能当个经验分享看,不能直接抄作业。
#Inference-opt#ShotokanOSS#WANDA#HQQ
一句话点评
Reddit 用户试了改进版 WANDA 剪枝 + HQQ 无数据量化,说先剪枝再量化效果更好。但正文没披露用了什么模型、数据集,也没给困惑度具体数字,目前只能当经验分享看,不能直接抄作业。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R1
13:03
70d ago
Product Hunt · AI· rssEN13:03 · 05·19
AVTR-1:实时生成AI虚拟人,现在开源了
Avaturn Live 把他们的实时虚拟人模型 AVTR-1 开源了,权重开放,可以免费拿去改。核心卖点是全双工——你说话时它也在听,能实时生成每一帧画面,而不是循环播放预渲染动画,所以表情和口型跟得上对话节奏。正文没披露参数量、许可证类型、具体延迟数字和部署条件,所以实际跑起来需要多少算力、能不能商用,目前还不清楚。如果你在做虚拟客服、直播助手这类...
#Multimodal#AVTR-1#Product Hunt#Product update
一句话点评
AVTR-1 把实时虚拟人模型开源了,权重开放可免费改。核心卖点是全双工——你说话时它也在听,能实时生成每一帧画面,表情口型跟得上对话节奏。但正文没披露参数量、许可证类型、具体延迟数字和部署条件,实际跑起来需要多少算力、能不能商用,目前还不清楚。如果你在做虚拟客服、直播助手这类场景,值得关注,但先别急着上生产。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R0
13:01
70d ago
Ben's Bites· rssEN13:01 · 05·19
手机遥控电脑跑代码,Codex 新功能上线
OpenAI 的 Codex 现在支持从手机发起任务,实际计算仍在 Mac 或远程机器上跑,文件、配置和密钥都不动,你只用在手机上批准命令、回答问题或审查代码改动。Ben's Bites 还汇总了 20 多条 agent 相关动态:Anthropic 收购了 SDK 平台 Stainless 并关停服务;Cloudflare 用自家 50 个仓库测试 ...
#Agent#Code#Tools#Ben’s Bites
一句话点评
短评:手机遥控Codex干活,算力还在Mac上,文件密钥不动,只批命令看改代码。 点评:OpenAI Codex现在支持从手机发起任务,但实际计算仍在Mac或远程机器上跑,文件、配置和密钥都不动,你只用在手机上批准命令、回答问题或审查代码改动。Ben's Bites作者自己说“没怎么用”,更常用Claude Code的/remote-control、Pi的Telegram bot等。这点先...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
13:00
70d ago
r/LocalLLaMA· rssEN13:00 · 05·19
全公司跑一套多智能体架构,三个角色共享一个上下文层
一位Reddit用户分享了他们组织内部的多智能体系统:用LangGraph管目标型智能体,CrewAI协调任务型智能体,Harbor存凭证并记录每次工具调用。三个智能体角色共享一个上下文层,所有调用都带来源追踪。正文没披露具体延迟和成本,但架构设计看起来适合内部流程自动化,不是那种需要高实时性的场景。
#Agent#Tools#Memory#LangGraph
一句话点评
一个Reddit用户分享了他们公司内部的多智能体系统:LangGraph管目标型智能体,CrewAI协调任务型智能体,Harbor存凭证并记录每次工具调用。三个角色共享一个上下文层,所有调用都带来源追踪。正文没披露具体延迟和成本,但架构设计看起来适合内部流程自动化,不是那种需要高实时性的场景。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
13:00
70d ago
AI HOT 精选· aihot-apiZH13:00 · 05·19
Cloudflare 让 Claude 智能体跑在自己的沙箱里,代码执行和网络都归你管
Cloudflare 和 Anthropic 合作,把 Claude Managed Agents 的代码执行环境搬到了 Cloudflare 的沙箱(Sandboxes)上。简单说,Claude 的“大脑”(推理循环)还在 Anthropic 那边,但“手脚”(跑代码、调工具、连网络)可以放在 Cloudflare 的基础设施里。好处是你能自己控制安...
#Agent#Code#Tools#Cloudflare
一句话点评
Cloudflare 和 Anthropic 合作,让 Claude 的“大脑”留在 Anthropic,但“手脚”(跑代码、调工具、连网络)搬到 Cloudflare 沙箱里跑。好处是你可以自己控制安全策略、看日志、甚至 SSH 进机器。正文没披露定价和上线时间,也没给性能对比数据。这点先别太激动——架构听起来灵活,但实际延迟和成本未知。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H1·K1·R0
12:57
70d ago
AI HOT 精选· aihot-apiZH12:57 · 05·19
毕马威全员用Claude:27.6万人接入,先从税务和网络安全下手
毕马威和Anthropic签了全球联盟,27.6万员工全部能用Claude,不是试点,是全员铺开。第一步落地在税务和法律客户的工具里,以及网络安全——用Claude找系统漏洞。毕马威自己的Digital Gateway平台嵌入了Claude Cowork和Managed Agents,以前调税规要几周,现在几分钟。另外Anthropic指定毕马威为私募...
#Tools#Safety#KPMG#Anthropic
一句话点评
毕马威27.6万员工全员用Claude,不是试点,是全面铺开。第一步落地税务、法律和网络安全——用Claude找系统漏洞。自家平台Digital Gateway嵌了Claude Cowork和Managed Agents,以前调税规要几周,现在几分钟。Anthropic还指定毕马威为私募首选伙伴,帮被投公司部署Claude Code改老系统。 短评:27.6万人全员铺开,不是试点,说明毕马...
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
12:34
70d ago
r/LocalLLaMA· rssEN12:34 · 05·19
让嵌入模型能看懂数字大小
作者用正则把文本里的数字抽出来,把数量级平滑映射到128个桶里,然后微调了一个嵌入模型。训练用了3亿token、6张H100跑1小时,在句子三元组排序任务上正确率59%,对比ModernBERT的38%和BGE-base-v1.5的34%。提升明显,但59%离实用还有距离,而且正文没披露在标准检索基准(比如MTEB)上的表现,这点先别太激动。
#Embedding#Fine-tuning#Benchmarking#Qwen
一句话点评
把数字从文本里单独拎出来做嵌入,思路挺直接。作者用正则抽数字,按数量级映射到128个桶,微调Qwen嵌入模型。训练成本低:3亿token、6张H100跑1小时。句子三元组排序正确率59%,对比ModernBERT的38%和BGE-base-v1.5的34%,提升明显。但59%离实用还有距离,而且正文没披露在标准检索基准(比如MTEB)上的表现,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
12:05
70d ago
AI HOT 精选· aihot-apiZH12:05 · 05·19
谷歌I/O大会发布Gemini 3.5 Flash
谷歌I/O大会宣布了Gemini 3.5 Flash,但正文只提到它出现在Google Cloud控制台,没透露参数、定价或上线时间。目前信息有限,具体能力还不清楚。
#Google#Gemini#Google Cloud#Product update
一句话点评
谷歌I/O上宣布了Gemini 3.5 Flash,但目前只在Google Cloud控制台露了个脸,参数、定价、上线时间一概没提。信息太少,先别激动,等后续细节。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K0·R1
11:42
70d ago
r/LocalLLaMA· rssEN11:42 · 05·19
黑胡子AI晒出五台自建服务器,顶配用9950X3D+5090跑本地模型
Reddit用户BlackBeardAI晒了五台自建AI服务器,顶配是Ryzen 9950X3D、256GB DDR5和RTX 5090,全部跑Linux Mint 22。配置挺高,但正文没披露具体跑什么模型、推理速度或功耗,所以只能当硬件清单看。对想自己攒机跑本地大模型的人来说,这套配置算是个参考,但成本不低——光5090和9950X3D就得上万。
#Inference-opt#BlackBeardAI#Linux Mint#Asus
一句话点评
Reddit 用户 BlackBeardAI 晒了五台自建 AI 服务器,顶配是 Ryzen 9950X3D、256GB DDR5 和 RTX 5090,全跑 Linux Mint 22。配置看着唬人,但正文被屏蔽,没披露跑什么模型、推理速度或功耗,只能当硬件清单看。对想自己攒机跑本地大模型的人来说,这套配置算个参考,但成本不低——光 5090 和 9950X3D 就得上万。短评:晒配置但没...
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R1
11:16
70d ago
Hacker News 首页· rssEN11:16 · 05·19
Id-Agent:给 AI agent 用的省 token 版 UUID
GitHub 上一个叫 Id-Agent 的项目,目标是给 AI agent 系统提供一种比标准 UUID 更省 token 的 ID 方案。标准 UUID 一串 36 个字符,在 LLM 上下文里每个字符都算 token,多了就烧钱。这个库声称能压缩 ID 长度,但正文没披露具体编码方式、省了多少 token、以及是否兼容现有系统。项目目前 8 个星...
#Agent#Tools#Id-agent#GitHub
一句话点评
短评:省 token 就是省钱,但项目才 8 个星,编码方式和兼容性都没说,先别激动。 点评:Id-Agent 想解决 AI agent 系统里 UUID 太费 token 的问题。标准 UUID 36 个字符,在 LLM 上下文里每个字符都算钱,agent 调用多了成本就上去了。这个库号称能压缩 ID 长度,但正文没披露具体编码方式、省了多少 token、以及是否兼容现有系统。项目目前只...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
09:33
70d ago
r/LocalLLaMA· rssEN09:33 · 05·19
本地模型除了写代码还能干嘛?有人用它自动操作桌面 GUI
一位 Reddit 用户说团队做了一个小型视觉语言模型(VLM),专门用来操作桌面图形界面。主要场景是:在两个没有 API 的应用之间搬数据,省去手动复制粘贴。他承认复杂界面下效果还不太稳定。正文没透露模型大小、跑分结果、是否开源,也没给可复现的搭建步骤。
#Agent#Vision#Tools#Reddit
一句话点评
一个Reddit用户说团队做了个小视觉模型,专门在两个没API的应用之间搬数据,省去手动复制粘贴。他承认复杂界面下效果还不稳。正文没透露模型大小、跑分结果、是否开源,也没给可复现的搭建步骤。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1

更多

频道

后台