ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-19

50 items · updated 3m ago
RSS live
2026-05-19 · 星期二2026年5月19日
18:37
70d ago
r/LocalLLaMA· rssEN18:37 · 05·19
两个开源模型在 Arena 编码榜上超过了 Gemini 3.5 Flash
Reddit 帖子引用 Arena 编码排行榜,称 GLM 排第 7、Mimo 排第 9,而 Gemini 3.5 Flash 只排第 12。帖子没交代测试样本量、评分机制和具体模型版本,所以这个排名只能当参考,不能直接说谁更强。
#Code#Benchmarking#GLM#Mimo
一句话点评
Reddit 帖子说 GLM 和 Mimo 在编码排行榜上超过 Gemini 3.5 Flash,但正文被屏蔽,看不到样本量和评分细节。这个排名只能当参考,不能直接说谁更强。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
18:34
70d ago
Hacker News 首页· rssEN18:34 · 05·19
Google 改了搜索框,但正文只给了三个媒体链接
Google 发了一篇博客,标题说搜索框变了,但正文只列了三个媒体链接,外加 Hacker News 上 83 个点赞和 214 条评论。具体怎么改、什么时候上线、覆盖多少用户,正文都没说。
#Google#Hacker News#Product update
一句话点评
Google 说搜索框要变,但博客正文只给了三个媒体链接和 Hacker News 的 83 个点赞、214 条评论。具体怎么改、什么时候上线、覆盖多少用户,全都没说。标题党嫌疑重,建议等官方详细说明再跟进。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
18:34
70d ago
AI HOT 精选· aihot-apiZH18:34 · 05·19
Gemini 3.5 Flash 上线 OpenRouter,性能超 3.1 Pro 但价格还是 Flash 档
Google DeepMind 的 Gemini 3.5 Flash 已经在 OpenRouter 上架。它在编码、智能体任务和工具使用上超过了 Gemini 3.1 Pro,但价格和速度依然保持在 Flash 系列的水平。支持 100 万 token 上下文(能一次塞进整本小说)、最大输出 6.5 万 token(写长报告够用),还支持多模态。输入每...
#Agent#Tools#Multimodal#OpenRouter
一句话点评
Gemini 3.5 Flash 上线 OpenRouter,编码和智能体任务比自家 Pro 还强,价格却保持 Flash 的低价:输入 $1.5/百万 token,输出 $9/百万 token。支持 100 万上下文(整本小说)和 6.5 万输出(长报告)。但来源是 OpenRouter 的推文,Google 官方还没发 benchmark,性能水分未知。如果是真的,这性价比能打 Clau...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
18:28
70d ago
AI HOT 精选· aihot-apiZH18:28 · 05·19
Google Flow 接入 Gemini Omni,批量改剧本、角色更稳定
Google DeepMind 宣布将 Gemini Omni 模型集成到 Google Flow 中,新增批量编辑和角色一致性改进,目标是让用户更容易创作出电影感的故事。正文没披露模型参数、定价或上线范围,所以实际效果和可用性还不清楚。
#Multimodal#Vision#Tools#Google DeepMind
一句话点评
短评:Gemini Omni 进 Google Flow,主打电影感故事创作和角色一致性,但没给参数和定价,先别激动。 点评:Google DeepMind 把 Gemini Omni 塞进 Google Flow,说能批量编辑、角色更一致,目标是让普通人也能搞出电影感。听起来像给视频创作加了个 AI 外挂,但正文没披露模型参数、定价或上线范围,所以实际效果和可用性还是黑盒。如果是真的,批...
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H0·K1·R1
18:25
70d ago
AI HOT 精选· aihot-apiZH18:25 · 05·19
Google 把 Gemini CLI 停了,换成一个叫 Antigravity 的新命令行工具
Google 宣布将在 2026 年 6 月 18 日关停面向个人和免费用户的 Gemini CLI,取而代之的是基于 Go 语言重写的 Antigravity CLI。新工具主打多 Agent 协作——你可以同时让几个 Agent 在后台分工干活,比如做大范围代码重构或并行研究几个话题,终端不会被锁住。迁移窗口不到一个月,个人免费用户必须在此之前完成...
#Agent#Tools#Code#Google
一句话点评
Google 把面向个人和免费用户的 Gemini CLI 关了,6月18日停服,迁移窗口不到一个月。替代品 Antigravity CLI 用 Go 重写,主打多 Agent 后台并行干活,终端不会被锁住。但正文没提免费额度是否保留,也没说个人用户迁移后要不要付费。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
18:23
70d ago
AI HOT 精选· aihot-apiZH18:23 · 05·19
Gemini Omni 被吹成“世界模型”,但正文没给任何细节
一条推文把 Gemini Omni 称为“迈向 AGI 的世界模型”,声称它能从任意输入生成任意内容。听起来很疯狂,但原文没披露参数规模、发布时间、支持哪些模态、跑过什么基准、怎么访问、能不能复现。目前只能当一句口号看,别太激动。
#Multimodal#Gemini Omni#Commentary
一句话点评
一条推文把 Gemini Omni 吹成“迈向 AGI 的世界模型”,说能从任意输入生成任意内容。正文没披露参数、发布时间、支持哪些模态、跑过什么基准、怎么访问。目前只能当一句口号看,别太激动。
HKR 分解
hook knowledge resonance
打开信源
28
SCORE
H0·K0·R0
18:19
70d ago
AI HOT 精选· aihot-apiZH18:19 · 05·19
Google 发布 Gemini Spark:一个永远在线的个人 AI 代理
Google 在 I/O 大会上预告了 Gemini Spark,定位是“全天候个人 AI 代理”,能按用户指令主动干活,而不只是回答问题。但正文没披露它具体能做什么任务、权限怎么控制、要不要额外付费、以及什么时候上线。目前看更像一个方向性预告,离实际可用还有距离。
#Agent#Google#Gemini#Product update
一句话点评
Google 在 I/O 上画了个饼叫 Gemini Spark,说是“全天候个人 AI 代理”,能主动干活而不是光回答问题。但正文没披露它具体能做什么任务、权限怎么控制、要不要额外付费、以及什么时候上线。目前看更像一个方向性预告,离实际可用还有距离。短评:画饼阶段,别急着充会员。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R0
18:15
70d ago
AI HOT 精选· aihot-apiZH18:15 · 05·19
Google 推出每日简报,帮你把收件箱、日历和任务整理成晨间摘要
Google 在 I/O 大会上发布了 Daily Brief,一个每天早晨自动生成的个性化摘要。它会从你的 Gmail 收件箱、日历和待办任务里抓取信息,按优先级排好,再建议你接下来该做什么。说白了就是帮你省掉早上翻一堆 App 的功夫,直接给一个“今天重点看什么、做什么”的清单。目前只说了是超简洁的晨间摘要,具体支持哪些任务来源、能不能自定义筛选规...
#Agent#Tools#Google#Product update
一句话点评
Google 在 I/O 上推 Daily Brief,每天早上一键汇总 Gmail、日历和待办,按优先级排好并建议下一步。说白了就是省掉你翻多个 App 的功夫,直接给个“今天重点看什么”的清单。目前只说了是超简洁晨间摘要,具体支持哪些任务来源、能不能自定义筛选规则,正文没披露。如果真能跨应用智能排序,对打工人挺实用;但隐私和准确度是隐忧,毕竟要读你的邮件和日程。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
18:05
70d ago
AI HOT 精选· aihot-apiZH18:05 · 05·19
Gemini 3.5 Flash 在 AI Studio 上线测试
Google I/O 上刚宣布,Gemini 3.5 Flash 现在可以在 AI Studio 里试用了。不过目前只有一条简短推文,没提模型参数、上下文窗口、定价和开放范围,具体能力要等实测。
#Google#Gemini#TestingCatalog#Product update
一句话点评
Gemini 3.5 Flash 刚在 AI Studio 上线,可以上手试了。但消息就一条推文,没提上下文窗口、定价、开放范围,具体能力得实测。短评:Google 画饼快,细节全靠等。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
18:01
70d ago
● P1AI HOT 精选· aihot-apiZH18:01 · 05·19
谷歌发布 Gemini 3.5 系列,先上 Flash 版,主攻智能体和编程
谷歌 AI 在 X 上宣布推出 Gemini 3.5 系列,首发的是 Gemini 3.5 Flash。官方说这个版本重点强化了智能体(让模型进业务流程干活)和编程能力。正文没披露参数量、价格、跑分成绩和上下文窗口大小,所以实际提升有多大、成本划不划算,现在还没法判断。
#Agent#Code#Google AI#Gemini
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
谷歌发了 Gemini 3.5 Flash,说智能体和编程能力更强,但没给任何跑分、价格和参数,实际提升先打个问号。
锐评
谷歌在 X 上宣布 Gemini 3.5 系列,先出的是 Flash 版本,主打两个方向:让模型进业务流程干活(智能体)和写代码。但这条推文本质上是个预告片,正文没披露参数量、上下文窗口、跑分成绩,也没提价格。所以现在只能知道谷歌在继续推 Flash 这条轻量线,但没法判断它比上一代快多少、省不省钱、在哪些任务上真有提升。 对开发者来说,Flash 的定位通常是低延迟、低成本,适合大批量调用。如果这次 3.5 Flash 能在保持低价的同时把智能体调用的稳定性和代码生成准确率拉上来,那对做自动化流程和编程辅助的产品会有直接帮助。但这一切都取决于后续放出的技术报告和定价页。 另外,推文里用“从理解世界到思考推理再到把想法变现实”串了三代模型,听着像品牌叙事,不是技术指标。建议等跑分和 API 文档出来再评估,别被“前沿性能”四个字带节奏。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
18:01
70d ago
● P1AI HOT 精选· aihot-apiZH18:01 · 05·19
谷歌搜索 25 年来最大改版:用 Gemini 3.5 Flash 把搜索框变成聊天框
谷歌在 I/O 大会上宣布搜索业务改版,核心是把搜索入口从“敲关键词”改成“直接说完整需求”。底层用新发布的 Gemini 3.5 Flash 模型跑响应,官方说速度是 GPT-5.5 的四倍,但没给具体延迟数据。AI Mode 上线一年后月活过了 10 亿,查询量每季度翻倍,说明用户确实在用。交互上,搜索框会动态变大,支持文字、图片、视频、文件甚至当...
#Agent#Multimodal#Tools#Google
精选理由
精选 · 重要度 89 · 吸引力 + 知识量 + 共鸣
一句话点评
谷歌把搜索框改成了能聊天的对话框,但“速度是GPT-5.5的四倍”没给实测延迟,这点先别太激动。
锐评
谷歌这次改版,说白了就是把搜索从“你迁就机器敲关键词”变成了“机器迁就你,让你说人话”。底层用新发布的 Gemini 3.5 Flash 模型来跑,官方说响应速度是 GPT-5.5 的四倍,但正文没披露具体的延迟毫秒数,所以这个“快”到底有多快,还得等上手再看。 用户数据倒是挺实在:AI Mode 上线一年,月活过了 10 亿,查询量每个季度翻倍。这说明大家确实在用,不是纯摆设。交互上,搜索框能动态变大,支持文字、图片、视频甚至 Chrome 标签页直接提问,还能在 AI 概览里连续追问,上下文会保留。 比较有意思的是“搜索智能体”,计划 24 小时在后台帮你盯房价、球鞋发售这些信息,但今年夏天只对 Google AI Pro 和 Ultra 付费用户开放。另外,个人智能功能会扩展到 98 种语言,能连 Gmail 和相册来理解你的个人背景再回答,但日历接入还在“未来”。整体看,功能铺得很开,但很多都标着“夏季上线”或“仅限付费”,实际体验和覆盖范围还得等落地后再看。
HKR 分解
hook knowledge resonance
打开信源
89
SCORE
H1·K1·R1
17:59
70d ago
● P1AI HOT 精选· aihot-apiZH17:59 · 05·19
Gemini 3.5 Flash 发布,跑分超 3.1 Pro,生成速度是其他顶尖模型的 4 倍
Google 在 I/O 后开放了 Gemini 3.5 Flash,产品端和 API 都能用。官方说它在多数基准测试上比 3.1 Pro 强,编程能力提升明显,每秒吐 token 的速度是其他前沿模型的 4 倍。不过帖子没给具体跑分数字和测试条件,这点先别太激动。
#Code#Inference-opt#Benchmarking#Google
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
Gemini 3.5 Flash 开放了,官方说比 3.1 Pro 强、吐字快 4 倍,但没给具体跑分,先别太激动。
锐评
Sundar Pichai 这条帖子宣布 Gemini 3.5 Flash 在 I/O 后正式上线,产品和 API 都能用。核心卖点是两个:性能比自家上一代 3.1 Pro 强,尤其是写代码;推理速度是其他前沿模型的 4 倍。但帖子没附任何基准测试的具体数字,也没说明对比的是哪些模型、在什么条件下测的。4 倍这个数听起来很猛,可如果对比对象是推理本来就慢的模型,或者测试环境不对等,实际体验会打折。另外,Flash 系列一向是轻量版,它和完整版 3.5 Pro 的差距有多大,帖子也没提。想认真评估的人,得等第三方跑分和实际 API 延迟数据出来再说。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
17:54
70d ago
● P1The Verge · AI· rssEN17:54 · 05·19
Google I/O 2026发布13个AI更新Gemini 3.5成默认模型
Google 在 I/O 2026 上发布了新模型 Gemini 3.5 Flash,今天起它就是 Gemini 应用和搜索里 AI Mode 的默认模型了。更强的 Gemini 3.5 Pro 下个月才来。文章只提了这俩模型、搜索、Gmail 和智能眼镜 Project Aura 有更新,但没把 13 个发布全列出来,想看完整清单得去 The Ver...
#Multimodal#Google#Sundar Pichai#Gemini
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
Gemini 3.5 Flash 直接上线,推理快了 4 倍,但运行成本比上代贵了 5.5 倍,省钱这事得看具体任务。
锐评
Google I/O 这次把 Gemini 3.5 Flash 直接推上线,没搞分批等待,这点挺实在。模型主打代理和写代码场景,上下文窗口 100 万 token,一次最多能吐 6.5 万 token,还加了四个思考档位,能记住上一轮的思考过程。官方说它比自家 3.1 Pro 强,在终端操作、前端代码等测试上分数更高,推理速度比同类前沿模型快 4 倍。 但第三方测试机构 Artificial Analysis 的数据得看仔细:它的智能指数评分 55,比上代 3 Flash 高了 9 分,可运行成本也贵了 5.5 倍,甚至比 3.1 Pro 还贵 75%。输出速度确实快,每秒超 280 个 token,价格是每百万输入/输出 token 收 1.5 和 9 美元。所以“快”是真的,“便宜”得打个问号,除非你的任务对延迟极度敏感。 另外,现场演示的 Omni 视频生成和 Spark 后台代理看着热闹,但正文没给出具体的延迟数据、失败率或第三方评测,目前只能当方向性展示。3.5 Pro 下个月才来,现在下结论还早。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
17:52
70d ago
● P1AI HOT 精选· aihot-apiZH17:52 · 05·19
谷歌发布 Gemini 3.5 Flash,智商分涨到 55,速度超 280 tokens/秒,但运行成本贵了 5.5 倍
谷歌把 Gemini Flash 系列更新到了 3.5 版,智商评分从上一代的 46 分提到 55 分,直接超过了 Grok 4.3 和 Claude Sonnet 4.6。进步主要在两方面:一是让模型进业务流程干活(代理任务)更靠谱了,二是知识真实性提升,幻觉明显减少。输出速度超过每秒 280 个 token,在速度和智商之间卡了个好位置。多模态评测...
#Agent#Multimodal#Benchmarking#Google
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
智商涨了9分,但运行成本涨了5.5倍,这笔账得看具体任务值不值。
锐评
Gemini 3.5 Flash 把智商评分从46拉到55,超过了Grok 4.3和Claude Sonnet 4.6,每秒能吐280多个token,速度和脑子都算能打。进步集中在两点:让模型进业务流程干活更稳,以及知识真实性提升、幻觉少了。多模态评测MMMU-Pro拿了最高分,说明看图说话这类任务也有长进。 但成本涨了5.5倍,正文只说是输入token用量和定价上涨导致的,没拆开讲是模型变大了还是推理更费算力。如果是真的靠堆资源换分数,那这个“Flash”的性价比标签就有点挂不住了。 还缺实际业务场景的对比数据,比如在客服、代码生成这些具体任务上,多花的钱到底换回了多少准确率提升。另外,幻觉减少的程度也没有量化,只说“明显减少”,没法判断是质的飞跃还是小幅优化。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
17:49
70d ago
● P1Hacker News 首页· rssEN17:49 · 05·19
Google 发布 Gemini 3.5 模型系列,强调智能体和行动能力
Google 在 I/O 大会上推出了 Gemini 3.5 系列模型,定位是“前沿智能加行动能力”。官方博客只给了一句介绍,正文没披露参数量、上下文窗口、定价和具体发布时间。Hacker News 上目前只有 19 个赞和 1 条评论,讨论热度不高。我会先打个折:这更像一个预告,实际能干什么、成本多高都还是未知数。
#Agent#Google#Gemini#Product update
精选理由
精选 · 重要度 100 · 吸引力 + 共鸣
一句话点评
谷歌发了 Gemini 3.5 Flash,输出速度号称是 GPT-5.5 的 4 倍,但价格也涨了,先别急着喊真香。
锐评
这次 Gemini 3.5 系列最大的变化不是跑分,而是谷歌把宝押在了“让模型干活”上。Flash 版本输出速度达到每秒 289 个 token,是 Claude Opus 4.7 和 GPT-5.5 高推理模式的 4 倍。速度快意味着在让模型进业务流程干活(也就是所谓的 agent workflow)时,等待时间更短,体验会流畅不少。谷歌内部用 Antigravity 工具做了个实验,12 小时启动 93 个子智能体,生成了 26 亿个 token,从零搭出一个能跑的操作系统核心,这个案例很直观地展示了模型在复杂任务里的调度能力。 不过,有信源提到 Flash 的价格“显著上涨”,具体涨了多少、跟竞品比性价比如何,正文没给数字。速度快但更贵,对高频调用场景来说,成本账得重新算。另外,基准测试只说“优于 3.1 Pro”,没放具体跑分对比,实际能力提升幅度还得看后续第三方评测。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K0·R1
17:45
70d ago
● P1AI HOT 精选· aihot-apiZH17:45 · 05·19
谷歌发布 Gemini 3.5 Flash,专治复杂、跑得久的自动化流程
谷歌在 I/O 大会上掏出了 Gemini 3.5 系列的第一个模型 Flash,定位很明确:让模型进业务流程干活,处理那种步骤多、周期长的任务。在 Terminal-Bench 和 MCP Atlas 这两个考编程和代理能力的测试里,它的分数压过了自家上一代的 3.1 Pro。速度方面,比别家顶尖模型快 4 倍,如果放在谷歌自己的 Antigravi...
#Agent#Code#Benchmarking#Google
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
谷歌发了 Gemini 3.5 Flash,专为让模型跑复杂业务流程设计,速度比别家顶尖模型快 4 倍,用自家 Antigravity 能快 12 倍。但正文没给具体延迟数字和任务成功率,这点先别太激动。
锐评
谷歌这次把 Gemini 3.5 Flash 定位得很清楚:不是聊天机器人,是塞进业务流程里干活的。它要处理的是步骤多、周期长的任务,比如让多个子代理协同工作、反复迭代去解决实际问题。在 Terminal-Bench 和 MCP Atlas 这两个考编程和代理能力的测试里,分数压过了自家上一代 3.1 Pro,说明在代码执行和工具调用上确实有提升。速度方面,比别家前沿模型快 4 倍,用谷歌自己的 Antigravity 环境能飙到 12 倍,这对跑长流程来说成本优势明显。 不过正文没披露具体延迟是多少毫秒、任务完成率有多高,也没说对比的是哪些“别家前沿模型”。快 12 倍是在 Antigravity 这个特定环境下的数字,换到别的地方还能不能保持,不知道。另外,代理工作流最怕中间步骤出错后没法恢复,模型能不能自己纠错、容错能力怎么样,这些都没提。建议等看到实际业务场景的跑分和失败案例再下判断。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
17:45
70d ago
● P1TechCrunch AI· rssEN17:45 · 05·19
Google 在 I/O 2026 发布 Gemini Spark 24 小时 AI 助手
Google 在 I/O 大会上掏出了 Gemini Spark,一个基于 Gemini 模型和 Antigravity 智能体框架(让模型进业务流程干活)搭起来的个人助手,主打 24 小时在线。它最大的卖点是直接连你的 Gmail,能读邮件、替你处理任务。不过文章没细说它能具体操作 Gmail 里的哪些事,也没提价格和什么时候能用上。这点先别太激动,...
#Agent#Tools#Google#Gemini
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
Google 把 Gmail 变成 AI 助手的训练场,这招比做模型更狠——它直接拿到了你最全的个人上下文。
锐评
Google 在 I/O 2026 发布的 Gemini Spark,本质上是一个能全天候自主干活的个人 AI 助手,底层用了 Gemini 模型和 Antigravity 的代理框架。它最核心的卖点不是模型多强,而是直接接入了 Gmail。这意味着它能读你的邮件、日历,用你已有的个人数据来安排日程或处理杂事,不需要你从头教它。 TechCrunch 的报道点出了 Google 的隐蔽优势:别人还在拼模型跑分,Google 手里已经有几十亿用户的邮件数据。但文章没给出 Spark 具体能自主执行哪些任务、错误率多少、隐私边界怎么划。这些才是决定它到底是“高级邮件过滤器”还是真正能替你干活的代理的关键。 目前信息都来自发布会演示,没有第三方实测。我会先打个折:接入 Gmail 是强场景,但“全天候自主”听着像愿景,实际能稳定跑通多少业务流程,还得等上线后看翻车率。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
17:45
70d ago
● P1AI HOT 精选· aihot-apiZH17:45 · 05·19
Gemini 3.5:把前沿模型和动手执行绑在一起
Google 在 I/O 大会上发布了 Gemini 3.5 系列模型,主打“前沿智能 + 行动能力”,意思是模型不光能回答问题,还能直接帮你操作软件、完成任务。但正文没披露参数量、上下文窗口、定价和具体发布时间,目前只有一篇博客公告,缺少可验证的技术细节和跑分对比。我会先打个折:概念听起来实用,但能不能打、贵不贵、什么时候能用上,都还是未知数。
#Agent#Google#Gemini#Product update
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
Google 在 I/O 发了 Gemini 3.5,主打“能说又能干”,但博客没给参数量、价格和发布时间,先当预告看。
锐评
这篇博客宣布了 Gemini 3.5 系列,核心卖点是“前沿智能加行动能力”,也就是模型不仅能聊天,还能直接上手操作软件、执行任务。这个方向本身不新鲜,但 Google 把它作为主线来推,说明他们想用“干活”来和对手拉开差距。 不过,正文里关键信息全是空白:没提模型参数规模、上下文窗口长度、推理成本,也没给任何基准测试的跑分对比。连具体什么时候能用、是开放 API 还是先在自家产品里灰度,都没说清楚。目前这只是一篇概念性公告,离实际评估还差得远。 我会先打个折:想法听起来实用,但能不能打、贵不贵、什么时候上手,全是未知数。等有技术报告或实测数据出来,再判断它是不是真把“行动”做成了护城河。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
17:45
70d ago
TechCrunch AI· rssEN17:45 · 05·19
Google Docs 和 Keep 现在支持语音写稿、记笔记和搜邮件
Google 在 I/O 大会上给 Workspace 加了个语音指令功能,你对着 Docs 说话就能生成草稿,比如从 Drive 调简历、从邮件里拉活动信息,还能加段搞笑段子。Keep 和 Gmail 也支持语音记笔记和搜邮件。Google 说语音可以一次说长句子、同时干好几件事,中途改主意也能当场改。CEO 还画了个饼:以后能用语音全程创建和编辑文...
#Audio#Tools#Google#Product update
一句话点评
Google 在 Docs 和 Keep 里加了语音指令,说话就能生成草稿、记笔记、搜邮件。比如对着 Docs 说“调简历加段笑话”,它能从 Drive 和邮件里拉信息。好处是长句指令和实时改口,不用打字。但正文没披露支持哪些语言、管理员能不能关、以及是否额外收费。目前看更像语音版“帮我写”,不是新能力,体验好不好得看识别准确率和延迟。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R0
17:45
70d ago
AI HOT 精选· aihot-apiZH17:45 · 05·19
Google 发了一篇 AI Mode 上线一年的行为变化报告,但没给具体数据
Google 官方博客说,AI Mode(搜索里那个能直接回答问题的对话模式)上线一年后,美国用户从敲关键词慢慢转向用自然语言提问。这个方向本身不意外——AI Mode 本来就是为了让人用大白话搜东西。但整篇正文没披露任何硬数字:用了多少人、跟谁比、怎么测的、自然语言查询占比涨了多少,全都没说。所以这个结论目前只能当个方向性信号,没法量化评估影响。
#Tools#Google#Product update
一句话点评
Google 官方博客说 AI Mode 上线一年后,美国用户从敲关键词转向用自然语言提问。但整篇没披露任何硬数字:用了多少人、自然语言查询占比涨了多少、跟谁比、怎么测的,全都没说。结论只能当方向性信号,没法量化评估影响。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K0·R1
17:45
70d ago
AI HOT 精选· aihot-apiZH17:45 · 05·19
Google Workspace 新增语音输入和 AI 收件箱,还出了个叫 Google Pics 的设计工具
Google 给 Gmail、Docs 和 Keep 加上了语音功能,可以直接用嘴打字;同时推出了一个叫 Google Pics 的新设计工具。AI Inbox 也做了升级,但正文没披露具体的技术机制、上线时间、定价和地区。功能本身挺实用,但信息缺口不小,先别太激动。
#Audio#Tools#Google#Google Workspace
一句话点评
Google Workspace 给 Gmail、Docs、Keep 加了语音输入,还出了个设计工具 Google Pics。AI Inbox 也升级了,但没提具体技术、上线时间、定价和地区。功能实用,信息缺口太大,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
17:45
70d ago
TechCrunch AI· rssEN17:45 · 05·19
Google 推出 Universal Cart,一个跨设备跨商家的统一购物车
Google 在 I/O 大会上发布了 Universal Cart,一个能跨设备、跨商家、跨几天跟踪你购物全程的智能购物车。它本质上是一个 AI 代理,帮你把在不同网站看中的商品集中到一个地方管理,未来还能授权代理替你付款。正文没披露具体上线时间、数据怎么跟商家共享、支持哪些零售商,以及隐私控制细节。
#Google#Product update
一句话点评
Google 在 I/O 上发布了 Universal Cart,一个跨设备、跨商家、跨几天的 AI 购物车代理,帮你把散落在各网站的商品集中管理,未来还能代你付款。想法很实用,但正文没披露上线时间、数据怎么跟商家共享、支持哪些零售商,以及隐私控制细节。这点先别太激动,目前更像一个产品概念演示。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K1·R0
17:45
70d ago
AI HOT 精选· aihot-apiZH17:45 · 05·19
Google I/O 2026:一堆AI更新,但没提模型名字、价格和上线时间
Google在I/O 2026上发了一堆AI更新,覆盖开发者工具、用户应用和日常场景,核心思路是让AI更好用、更普及。但正文没披露具体模型名称、参数、定价或发布时间,所以这些更新到底有多大、什么时候能用,目前还不清楚。
#Tools#Google#Product update
一句话点评
Google I/O 2026 发了一堆 AI 更新,但全是方向性描述,没给具体模型名、参数、定价或上线时间。目前只能当画饼看,别急着激动。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
17:45
70d ago
AI HOT 精选· aihot-apiZH17:45 · 05·19
Google I/O 2026:AI搜索进入智能体时代
Google在I/O 2026上宣布了搜索与AI深度融合的下一步,核心方向是让AI智能体(能自主执行任务的模型)直接参与搜索流程。官方博客称这次更新“结合了搜索引擎的广度与AI的理解力”,但正文没有披露具体功能列表、上线时间、定价或任何基准测试数据。简单说,Google画了一张“搜索+智能体”的大饼,但细节几乎为零——什么时候能用、效果如何、成本多少,...
#Google#Product update
一句话点评
Google I/O 2026 宣布搜索将深度整合 AI 智能体(能自主执行任务的模型),但正文没给具体功能、上线时间、定价或任何基准测试。画了个“搜索+智能体”的大饼,细节为零。短评:方向对,但全是口号,等真东西出来再激动。
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K0·R0
17:43
70d ago
r/LocalLLaMA· rssEN17:43 · 05·19
用 LLM 写 Blender 代码,自动生成带活动关节的 3D 模型
开发者 mhb-11 开源了 Nova3D 前端,核心思路是让 LLM 直接写 Blender Python 脚本,生成带关节、可活动的 3D 模型(比如洗衣机、机器狗、微波炉),输出为 GLB 格式,保留部件层级和转轴。这套流程不绑定特定模型,换 GPT 或本地模型都能跑。目前验证还比较初步,正文没披露生成成功率或复杂场景下的稳定性,但思路挺直接:把...
#Code#Tools#Nova3D#Blender
一句话点评
一个叫 Nova3D 的开源前端,让 LLM 直接写 Blender Python 脚本生成带关节的 3D 模型(洗衣机、机器狗),输出 GLB 保留部件层级。不绑定模型,GPT 或本地模型都能跑。思路很直接:把 3D 建模变成代码生成任务。但正文没披露生成成功率,复杂场景稳定性未知,目前更像一个有趣的 demo 而非生产工具。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R0
17:39
70d ago
r/LocalLLaMA· rssEN17:39 · 05·19
手写CUDA编译器:5000行Python把TinyLlama跑出PyTorch 96%性能
NoVibeCoding 发了一个三篇连载,用5000行Python加原生CUDA,自己写了一个编译器,把TinyLlama和Qwen2.5-7B经过六层中间表示(IR)降级成CUDA内核。在RTX 5090上跑,几何平均性能达到PyTorch生产栈的0.96倍——也就是说,手写编译器只比PyTorch慢4%,这个差距对研究原型来说已经很小了。正文没披...
#Code#Inference-opt#Tools#NoVibeCoding
一句话点评
有人用5000行Python+原生CUDA手写了一个LLM编译器,把TinyLlama和Qwen2.5-7B经过六层中间表示降级成CUDA内核。在RTX 5090上跑,性能达到PyTorch生产栈的0.96倍——只慢4%,对研究原型来说差距很小。正文没披露编译时间、内存开销和是否支持动态形状,这些对实际部署很关键。短评:手写编译器只比PyTorch慢4%,但别急着换,验证场景还太窄。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
17:38
70d ago
● P1AI HOT 精选· aihot-apiZH17:38 · 05·19
谷歌发布 Gemini 3.5 Flash,输出速度跑到每秒 289 个 token,是 GPT-5.5 的四倍
谷歌在 I/O 大会上推出了 Gemini 3.5 Flash,官方说它在很多基准测试里比自家 3.1 Pro 强。最直观的卖点是快:输出速度达到每秒 289 个 token,对比的是 Claude Opus 4.7 和 GPT-5.5 xhigh,快了大约四倍。谷歌内部还用 Antigravity 工具做了个实验,让 93 个子智能体协作,12 小时...
#Inference-opt#Benchmarking#Agent#Google
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
谷歌说 Gemini 3.5 Flash 输出速度是 GPT-5.5 的四倍,但没提推理质量有没有打折,这点先别太激动。
锐评
谷歌在 I/O 大会上扔出的 Gemini 3.5 Flash,核心卖点就一个字:快。每秒 289 个 token,比 Claude Opus 4.7 和 GPT-5.5 xhigh 快了大约四倍。这个数字对需要低延迟的场景确实有吸引力,比如实时对话或批量跑任务。但文章只给了速度对比,没放任何基准测试的具体分数,只说“比自家 3.1 Pro 强”——这等于没比。 另一个值得看的是内部用 Antigravity 工具做的实验:93 个子智能体协作,12 小时生成 26 亿个 token,搭出一个能跑的操作系统内核。听着很唬人,但正文没披露这个系统的复杂度、代码质量或后续验证结果,更像是一次工程极限测试,离实用还有距离。 整体来看,这条消息的价值在于速度指标和智能体协作的尝试,但缺了质量评估和成本数据,没法判断是“真快又好”还是“牺牲质量换速度”。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
17:37
70d ago
Hacker News 首页· rssEN17:37 · 05·19
Cursor 云代理又挂了,用户反馈启动排队超 10 分钟
Cursor 的 Cloud Agents 功能在 5 月 19 日出现服务降级,有用户发帖说云代理完全起不来,等了十多分钟都没反应,而前一天还能正常用。官方在状态页确认了这次故障,但具体影响范围、根因和恢复时间正文都没披露。一个让人有点恼火的细节是:状态页顶部还挂着“所有系统正常”的绿条,底下却写着服务降级,官方人员承认这确实矛盾,说会反馈给相关团队...
#Agent#Cursor#Incident
一句话点评
Cursor Cloud Agents 在5月19日挂了,用户等十多分钟都起不来,官方状态页却还挂着“所有系统正常”的绿条,自己人也承认这很矛盾。正文没披露影响范围、根因和恢复时间,信息缺口明显。
HKR 分解
hook knowledge resonance
打开信源
49
SCORE
H1·K0·R1
17:35
70d ago
● P1AI HOT 精选· aihot-apiZH17:35 · 05·19
谷歌发布 Antigravity 2.0,用 93 个并行子智能体 12 小时搭出一个操作系统
谷歌在 I/O 大会上放出了 Antigravity 2.0 平台,已经对全球用户开放。现场演示里,他们让智能体从零构建了一个能跑起来的操作系统,只用了 12 小时。具体做法是同时跑 93 个子智能体,总共调了超过 1.5 万次模型、处理了 26 亿个 token,最后算下来 API 成本不到 1000 美元。平台本身集成了新的智能体系统和自然语音交互...
#Agent#Audio#Inference-opt#Google
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
12小时、93个智能体、不到1000美元拼出一个操作系统,数字很炸,但演示不等于产品化,先打七折看。
锐评
谷歌在 I/O 上拿 Antigravity 2.0 做了一场压力测试:让 93 个子智能体同时干活,12 小时内从零搭出一个能跑的操作系统。总共调了 1.5 万次模型,吞了 26 亿个 token,API 账单不到 1000 美元。这个成本确实低,相当于雇一个工程师干两周的活只花了几百块电费。 不过正文没披露这个操作系统到底能干什么、代码质量怎么样、有没有人工中途接手。演示场景和真实开发之间差着无数个 corner case,12 小时跑通一个 demo 和做出能维护的系统是两码事。另外,93 个智能体并行调度本身就有工程复杂度,正文也没说失败率、重试次数和 token 浪费比例。 我会把这条当成谷歌在秀多智能体协同的调度能力和 Gemini 3.5 Flash 的推理速度(号称快了 12 倍),但离“AI 自己写操作系统”还远。想看的是这套东西在真实业务里跑一次,而不是在舞台上跑一次。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
17:26
70d ago
● P1AI HOT 精选· aihot-apiZH17:26 · 05·19
谷歌发布 Gemini Omni 模型,任意输入都能生成任意输出,一句话就能改视频
谷歌在 I/O 2026 大会上推出了 Gemini Omni,这是 Gemini 家族目前能力最全的版本,能同时处理文字、图片、音频和视频,并直接生成这些格式的内容。现场演示了对话式视频编辑,用户说句话就能换掉视频里的角色或背景。先放出来的是速度更快的 Gemini Omni Flash,已经在 Gemini App、Google Flow 和 Yo...
#Multimodal#Vision#Audio#Google
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
谷歌发了能同时看懂和生成文字、图片、音频、视频的 Gemini Omni,现场演示一句话改视频挺直观,但正文没给任何性能数据或成本信息,先当个 demo 看。
锐评
谷歌在 I/O 大会上把 Gemini Omni 定位成“全能模型”,核心卖点是任意模态输入、任意模态输出,现场演示的对话式视频编辑确实降低了视频修改的门槛。但文章只说了“即日起可用”的是速度更快的 Omni Flash 版本,而且只限 Gemini App、Google Flow 和 YouTube Shorts 这几个自家产品,API 什么时候开放、收费多少、完整版 Omni 什么时候来,正文全都没提。 对开发者来说,现在能判断的东西很少。没有推理成本、延迟、生成质量对比,也没说视频编辑的时长上限或分辨率限制。如果只是把多模态生成能力打包进一个模型,那和现有方案的区别有多大,还得等实际跑起来再看。 另外,文章引用的演示视频来自微博,不是官方技术博客或论文,信息量有限。建议等 API 上线后看定价和实际效果,再判断它是不是真的“全能”。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1

更多

频道

后台