ax@ax-radar:~/curated $ grep -l 'curated=true' sources/
33 srcsignal 72%cycle 04:32

AX 严选

37 · updated 3m ago
按日期浏览411 · 59
2026-09-02 · 星期三2026年9月2日
00:30
21d ago
AI HOT 精选· aihot-apiZH00:30 · 09·02
Anthropic 发了 Claude Fable 5.1 和 Mythos 5.1,一位深度用户给了两条实用建议
Thariq 在 X 上说这两个模型他用了很久,觉得不错,完整评测后面会出。他提了两个实操点:一是对验证要求不高、边界情况少的任务,可以把 effort 调低,省点算力;二是现在切换 effort 不会清掉 prompt cache 了,这对频繁调参的人是个好消息。
#Code#Anthropic#Thariq
一句话点评
Anthropic 发了两个新模型,Claude Fable 5.1 和 Mythos 5.1,主打编程和知识类任务。作者 Thariq 实测后给了两条实用建议:对验证要求不高、边界情况少的任务,可以把 effort 调低省算力;现在切换 effort 不会清掉 prompt cache 了,调参党会舒服很多。正文没给具体跑分、延迟或成本数据,只说“模型不错”,完整评测还没出。这点先别太激动...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
2026-09-01 · 星期二2026年9月1日
2026-08-31 · 星期一2026年8月31日
17:03
22d ago
AI HOT 精选· aihot-apiZH17:03 · 08·31
Runway 发布 Solaris:用一句话就能实时生成一个能点能拖的操作系统界面
Runway 放出了一个叫 Solaris 的新模型,他们管它叫“界面世界模型”。你输入文字描述,它直接吐出一个能交互的桌面、窗口和控件,不是静态设计稿,是活的、可以操作的界面。目前只有一段演示视频和一篇博客,没公开任何技术细节、模型参数,也没开放试用。视频看着很流畅,但正文没说明是实时推理还是提前渲染好的,也没提延迟、支持哪些应用、跑在什么硬件上。这...
#Runway
一句话点评
Runway 发了个叫 Solaris 的模型,说输入文字就能实时生成一个能点能拖的操作系统界面,不是设计稿,是活的。演示视频看着很流畅,但正文没说是实时推理还是录好的,也没提延迟、跑在什么硬件上、支持哪些应用。如果是真的,做原型和交互设计会省很多事,但这点先别太激动,信息缺口太大。短评:视频很酷,但没开放试用,没技术细节,先当概念片看。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
00:36
23d ago
AI HOT 精选· aihot-apiZH00:36 · 08·31
有人用 MiniMax H3 Max 搭了个 24 小时 AI 直播网站
正文被微信屏蔽了,看不到具体内容、成本、延迟或直播形式。只知道用了 MiniMax H3 Max 模型,跑 24 小时不间断直播。信息缺口很大:不清楚是实时生成画面还是循环播放,也不知道每分钟花多少钱、延迟能不能接受。如果是真的挺省钱,但这点先别太激动——没数据支撑。
#MiniMax#H3 Max
一句话点评
有人用 MiniMax H3 Max 搭了个 24 小时 AI 直播站,但原文被微信屏蔽,看不到具体玩法。关键信息全缺:是实时生成画面还是循环播放?每分钟成本多少?延迟能不能接受?如果是真·实时生成,成本控制得住的话挺有意思,但这点先别太激动——没数据支撑。
HKR 分解
hook knowledge resonance
打开信源
25
SCORE
H0·K0·R0
2026-08-30 · 星期日2026年8月30日
2026-08-29 · 星期六2026年8月29日
04:31
24d ago
● P1AI HOT 精选· aihot-apiZH04:31 · 08·29
智谱开源GLM-5.3模型权重,主打代码编程和网络安全
智谱放出了 GLM-5.3 的模型权重,支持本地部署和商用。这个模型在 AA 综合智能指数上拿了 60 分,跟 Claude Fable 5、GPT-5.6 Sol 这些闭源旗舰差不多,和 Kimi K3 并列开源第一。它主要强在复杂编程、防御性网络安全和长链条任务上。因为网络安全能力太强,智谱在发布前专门多花了两周做安全评估。另外,年收入超过 100...
#Agent#Code#Zhipu#GLM-5.3
精选理由
精选 · 重要度 96 · 吸引力 + 知识量 + 共鸣
一句话点评
智谱把GLM-5.3的模型权重直接开源了,主打写代码和网络攻防,参数更小但跑分能跟闭源旗舰掰手腕。
锐评
智谱这次开源GLM-5.3,最实在的一点是权重直接给,支持本地跑和商用,只有年收入超100亿美元的大厂对外提供服务时才需要安全审查。官方说它在AA综合智能指数上拿了60分,跟Claude Fable 5、GPT-5.6 Sol这些闭源模型在同一档,还和Kimi K3并列开源第一。这个分数覆盖知识、推理、编码和智能体任务,说明不是单项刷榜,综合能力确实上来了。 但要注意,正文没披露具体参数规模,只说“更小的参数规模与更低的调用成本”,到底多小、成本降了多少,都没给数字。另外,因为模型在网络安全方面能力较强,发布前专门多做了两周安全评估,这个动作本身说明能力是真的,但也意味着滥用风险不低。 如果你做代码助手或安全工具,这个模型值得上手试。如果是想拿它当通用底座,最好等社区跑出更多实际任务评测,光看AA指数还不够。
HKR 分解
hook knowledge resonance
打开信源
96
SCORE
H1·K1·R1
2026-08-28 · 星期五2026年8月28日
00:00
26d ago
AI HOT 精选· aihot-apiZH00:00 · 08·28
Open ASR 排行榜新增印地语和印度英语评测,首次覆盖非欧洲语言
Voice Arena 和 Hugging Face 给 Open ASR 排行榜加了两个新评测集:Monsoon en-IN(印度英语)和 Monsoon hi-IN(印地语)。印地语是排行榜多语言板块里第一个非欧洲语言,这点挺有代表性。数据集有公开和私有两部分,共 4,888 位说话人,还记录了 12 项说话人属性(比如地区、年龄、性别),目的是暴...
#Benchmarking#Hugging Face#Voice Arena#Benchmark
一句话点评
印地语终于进了 Open ASR 排行榜,这是多语言板块第一个非欧洲语言。数据集有 4,888 位说话人,还标了地区、年龄、性别等 12 项属性,能看出模型在哪些人群上翻车。但正文没披露评测集总时长和具体模型表现,不知道实际难度和当前 SOTA 水平。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
2026-08-27 · 星期四2026年8月27日
23:32
26d ago
AI HOT 精选· aihot-apiZH23:32 · 08·27
Midjourney 开放 V8.2 图像编辑模型测试
Midjourney 开始公测 V8.2 图像编辑模型,支持用文字指令改图、最多同时参考4张图生成、局部重绘(inpainting)和扩图(outpainting),还能用 moodboard 做个性化风格。网页和 alpha 版 UI 都更新了,但团队说边缘情况很多,需要用户帮忙报 bug。正文没提 V8.2 相比 V8 或 V8.1 具体改进了什么...
#Vision#Midjourney
一句话点评
Midjourney 公测 V8.2 编辑模型,支持文字改图、最多4张参考图生成、局部重绘和扩图,还加了 moodboard 个性化风格。团队说边缘情况很多,需要用户帮忙报 bug。正文没提 V8.2 相比 V8 或 V8.1 具体改进了什么,也没说模型参数或推理速度。如果是真的挺省钱,但效果和稳定性还得看实测。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
20:52
26d ago
AI HOT 精选· aihot-apiZH20:52 · 08·27
诉讼称 xAI 用儿童性虐待材料训练 Grok
一份新诉讼指控马斯克的 xAI 在训练 Grok 模型时使用了真实和 AI 生成的儿童性虐待内容。原告认为这些数据被混进了训练集,可能导致模型生成或传播有害输出。正文没有披露具体用了哪个数据集、哪个模型版本,也没说训练时间线。
#xAI#Elon Musk#Grok
一句话点评
诉讼指控 xAI 在训练 Grok 时混入了真实和 AI 生成的儿童性虐待材料。正文没披露具体用了哪个数据集、哪个模型版本,也没说训练时间线,所以这点先别太激动——指控本身严重,但证据细节全在原告方手里,xAI 还没回应。如果属实,意味着训练数据清洗流程有重大漏洞,不光法律风险大,模型也可能学会生成有害内容。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
16:11
26d ago
AI HOT 精选· aihot-apiZH16:11 · 08·27
Gemini Omni 1.1 Flash 发布,主打给开发者更细的视频生成控制
Google DeepMind 发了 Gemini Omni 1.1 Flash,核心卖点是让开发者在生成视频时能调得更细。不过现在这篇公告正文只有标题和网站导航栏,没写具体新增了哪些控制参数、延迟有没有改善、怎么收费。我会先打个折,等完整细节放出来再看值不值得跟进。
#Google DeepMind#Gemini Omni 1.1 Flash
一句话点评
Google DeepMind 发了 Gemini Omni 1.1 Flash,号称给开发者更强的视频生成控制。但正文只有标题和导航栏,没写新增了哪些参数、延迟有没有降、价格怎么算。我会先打个折,等完整细节出来再判断值不值得跟进。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
09:05
26d ago
AI HOT 精选· aihot-apiZH09:05 · 08·27
央视称国内日均 token 调用量超 500 万亿,大模型迭代压到 4–6 周一次
央视报道了一个数字:截至 2026 年 6 月,国内日均 token 调用量突破 500 万亿。这个数字说明 AI 服务的使用频率在快速拉高,但正文没披露统计口径和覆盖范围,所以 500 万亿具体怎么算出来的还不清楚。稀宇科技的冯雯说,模型发布节奏已经从每季度一次压缩到每 4 到 6 周一次,厂商基本在按月赛跑。腾讯的刘峰给了一个对比:混元 3 上线第...
#Agent#Reasoning#MiniMax#Tencent
一句话点评
央视报了个500万亿token/天的数字,说明国内AI调用量确实在猛涨。但正文没披露统计口径——是只算API还是包括端侧?混元3上线首周token量比上代涨了68倍,这个对比挺实在。稀宇说模型发布从每季度一次压缩到4-6周,厂商基本在按月赛跑。竞争焦点从刷榜转向智能体落地和锁算力,这点先别太激动,落地效果还得看实际场景。缺的是这500万亿里推理和训练各占多少,以及统计覆盖了哪些厂商。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
00:00
27d ago
AI HOT 精选· aihot-apiZH00:00 · 08·27
Claude Console 新增个人密钥和服务账号密钥,离职自动失效
Anthropic 在 Claude Console 里加了两种新 API 密钥:个人密钥(权限跟你本人一样)和服务账号密钥(权限跟服务账号一样)。关键区别是,这两种密钥在关联账号离开组织后会自动失效,管理员可以按账号追踪用量,还能把密钥限制到某个工作区或管理端。原来的工作区 API 密钥保留作为旧版选项。对团队来说,这比之前更安全——不怕离职员工密钥...
#Anthropic#Claude Console
一句话点评
Claude Console 新增了两种 API 密钥:个人密钥(权限跟你本人一样)和服务账号密钥(权限跟服务账号一样)。关键区别是,关联账号离开组织后密钥自动失效,管理员可按账号追踪用量,还能把密钥限制到某个工作区或管理端。原来的工作区 API 密钥保留为旧版选项。对团队来说,这比之前更安全——不怕离职员工密钥还在用。 短评:API 密钥管理终于跟上企业安全基本要求,离职自动失效是刚需。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
2026-08-26 · 星期三2026年8月26日
20:10
27d ago
AI HOT 精选· aihot-apiZH20:10 · 08·26
Google 发布血糖监测基础模型 GlucoFM,用海量真实数据预训练后能适配多种下游任务
Google Research 放出了一个叫 GlucoFM 的基础模型,专门处理连续血糖监测(CGM)数据。它先用大规模真实 CGM 数据做预训练,学出通用的血糖时间序列表征,然后可以微调去做血糖波动预测、异常检测之类的任务。好处是减少了对每个病人单独训练的需求。正文没披露模型参数量、训练数据具体规模,也没给和现有方法的对比 benchmark,所以...
#Google Research
一句话点评
Google Research 出了个专门分析血糖数据的基座模型 GlucoFM,用大量真实 CGM 数据预训练,能省去给每个病人单独训练模型的工作。但正文没披露模型参数量、训练数据具体规模,也没给和现有方法的对比 benchmark,所以效果到底多好、成本能降多少,目前只能打个问号。
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K0·R0
17:02
27d ago
AI HOT 精选· aihot-apiZH17:02 · 08·26
Warp 在 Claude 上搞了个让智能体自己改进自己的模式
Warp 在 Claude 上设计了一套开发模式,能让智能体自己改进自己。文章没透露具体实现细节,但说这个模式可以直接拿来用。
#Warp#Claude#Anthropic
一句话点评
Warp 在 Claude 上搞了个让智能体自己改自己的开发模式,说可以直接拿来用。但正文没披露具体怎么实现的,比如用了什么反馈信号、改进了哪些环节。如果是真的,能省不少人工调优成本,但没细节前先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
14:00
27d ago
● P1AI HOT 精选· aihot-apiZH14:00 · 08·26
智谱开源GLM-5.3-Flash:320B多模态模型性能对标Claude Opus
智谱上线并开源了GLM-5.3-Flash,一个总参数320B、激活参数18B的原生多模态模型。它在AA综合智能指数上拿了57分,和Anthropic的Claude Opus 4.8持平,编程表现也相当,但API定价只有Opus 4.8的四十分之一。模型用了稀疏注意力和线性注意力的混合架构,长文本下的注意力计算量比GLM-5.3低了3倍多。它还能在写代...
#Code#Zhipu AI#Anthropic#Claude Opus 4.8
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
智谱开源了320B多模态模型,跑分追平Claude Opus但价格只要四十分之一,还全程用国产芯片提供服务。
锐评
智谱这次放出的GLM-5.3-Flash,简单说就是用更小的激活参数量(18B)和更低的成本,在AA综合智能指数上拿到了和Claude Opus 4.8一样的57分。价格直接打到Opus的1/40,限时折扣内甚至只有自家GLM-5.3的1/20,这个定价策略很激进。 技术上值得看的是它的混合注意力架构,把稀疏注意力和线性注意力揉在一起,长文本下的计算量和KV缓存分别比GLM-5.3降了3倍和4倍多。不过官方也承认,KV缓存还是比Kimi-K3和DeepSeek-V4-Flash大一点,这是后续要补的课。另外,模型在代码场景里能自己看渲染结果、自己迭代修改,这个视觉反馈的闭环设计挺实用。 最让我意外的是,过去一周的公开测试流量全跑在国产芯片集群上,通过EPD分离式架构和一堆内存优化,硬是把单token成本做到了和英伟达GPU相当的水平。但正文没披露具体用了哪款国产芯片,也没给出1M长上下文下的实际延迟数据,这些缺口让“极致低成本”的说法还得再观察。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
08:27
27d ago
AI HOT 精选· aihot-apiZH08:27 · 08·26
飞书豆包合体后首个Agent实测:8个使用技巧
文章标题说飞书和豆包合并后推出了第一个Agent,叫“豆包工作”,还给了8个使用技巧。但正文被微信屏蔽,只看到环境异常提示,没披露这个Agent具体能干什么、技巧是什么。信息缺口很大,没法判断是办公自动化还是对话助手。
#Feishu#Doubao
HKR 分解
hook knowledge resonance
打开信源
25
SCORE
H0·K0·R0
08:04
27d ago
AI HOT 精选· aihot-apiZH08:04 · 08·26
腾讯混元把端侧翻译模型压到440MB,已落地B站直播弹幕翻译
腾讯混元把1.8B参数的翻译模型Hy-MT2压缩到440MB,已经用在B站直播弹幕翻译上。440MB在手机上算很小,但正文没披露用了什么压缩技术、推理延迟多少、精度损失多大。如果是真的,这个体积对端侧部署挺友好,但实际效果和速度还得看实测。
#Tencent Hunyuan#Bilibili
一句话点评
腾讯混元把1.8B参数的翻译模型压到440MB,已落地B站直播弹幕翻译。440MB在手机上算很小,但正文没披露用了什么压缩技术、推理延迟多少、精度损失多大。如果是真的,这个体积对端侧部署挺友好,但实际效果和速度还得看实测。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
2026-08-25 · 星期二2026年8月25日
21:12
28d ago
AI HOT 精选· aihot-apiZH21:12 · 08·25
LangChain 和 Airbyte 联手:让数据灌入向量库能定时刷新,不再是一次性导入
LangChain 和 Airbyte 发布了一个新集成,方向反过来了:Airbyte 现在可以把数据直接灌进向量库,而不是只从外部拉数据。文章的核心观点是,生产环境需要定时重新索引,而不是一次性导入,Airbyte 的编排能力正好补上这块。正文没披露具体支持哪些向量库,也没说怎么配置刷新周期。
#LangChain#Airbyte
一句话点评
LangChain 和 Airbyte 搞了个反向集成:Airbyte 现在能把数据直接灌进向量库,而不是只从外部拉。核心卖点是生产环境需要定时重新索引,Airbyte 的编排能力正好补上这块。但正文没披露具体支持哪些向量库,也没说怎么配置刷新周期,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
18:16
28d ago
AI HOT 精选· aihot-apiZH18:16 · 08·25
吴恩达的 OpenWorker 开源智能体框架更新,内置三种网络安全检查,整套工具链可审计
OpenWorker 这次更新直接塞了三个网络安全智能体进去:扫代码漏洞、查依赖包有没有被供应链投毒、检查云上安全配置。它的 harness 全部开源,安全团队可以自己翻代码确认没有后门。还支持在本地跑开源权重模型,敏感代码不用上传。正文没提具体模型名和跑分,这点先别太激动。
#Andrew Ng#OpenWorker#Open source
一句话点评
Andrew Ng 的 OpenWorker 新版直接内置了三个网络安全智能体:扫代码漏洞、查依赖包投毒、检查云配置。harness 全开源,安全团队能自己审计有没有后门;还支持本地跑开源权重模型,敏感代码不用上传。正文没提具体模型名和跑分,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
15:32
28d ago
● P1AI HOT 精选· aihot-apiZH15:32 · 08·25
Dylan Patel:Anthropic 和 OpenAI 将掌控全球大部分算力到 2028 年
SemiAnalysis 创始人 Dylan Patel 算了一笔账:今年全球新增算力里,Anthropic 和 OpenAI 两家就拿走了约 30%,明年这个比例会涨到 40% 到 50%,按这个趋势到 2028 年,全球大部分可用的算力都会集中在这两家手里。背后的驱动力是单位经济模型——Anthropic 现在每兆瓦推理算力能产生最高 5000 万...
#Anthropic#OpenAI#SemiAnalysis
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Dylan Patel 判断,到 2028 年 Anthropic 和 OpenAI 会吃掉全球大部分算力,因为它们的模型推理赚钱效率太高,能出价碾压其他买家。
锐评
这条判断来自 SemiAnalysis 的 Dylan Patel 在 Dwarkesh 播客上的推算,核心逻辑是:头部实验室的推理毛利率已经高到离谱。他举的例子是,Anthropic 每花 1000 万到 1500 万美元的算力成本,能产生高达 5000 万美元的收入。这种“花 1 块挣 5 块”的生意,让它们可以不断把利润砸回训练端,抢走新增算力。 数字上看,今年新增算力里大约 30% 流向这两家,明年这个比例预计会跳到 40% 到 50%。到 2028 年,全球 AI 基础设施的资本支出会从现在的 1 万多亿美元膨胀到超过 2 万亿,而这两家实验室的份额还在加速集中。 不过,这个推演有几个缺口。第一,正文没给出“全球大部分算力”的具体占比门槛,是 51% 还是 80% 不清楚。第二,推理收入的天花板取决于企业客户是否持续为高价 API 买单,这点没有展开。第三,SpaceX 作为新基建方入局会怎么改变算力定价和供给,也只提了一句。如果推理价格战开打,或者开源模型把推理成本打下来,这个“赢家通吃”的剧本就得重写。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
03:19
28d ago
AI HOT 精选· aihot-apiZH03:19 · 08·25
飞书豆包合并后首款Agent产品“豆包工作”发布
飞书和豆包合并后推出了第一款Agent产品,叫“豆包工作”。但正文页面被环境拦截,需要验证才能看,所以产品功能、定价、上线时间这些细节都没披露。目前能确认的就是产品名字和“合并后第一款Agent”这个定位。
#飞书#豆包
HKR 分解
hook knowledge resonance
打开信源
25
SCORE
H0·K0·R0
00:00
29d ago
AI HOT 精选· aihot-apiZH00:00 · 08·25
OpenRouter 把视频生成也做成了统一 API:换模型只改一行代码
OpenRouter 把多个视频生成模型(Seedance、Veo、Wan 等)塞进同一个异步 API。你发一个 POST 请求到 /api/v1/videos,拿到一个 job ID,轮询等它完成,下载 MP4。换模型只需要改一行 model 参数,不用重新对接不同厂商的接口、认证和轮询逻辑。正文没披露具体价格和生成速度,但强调异步设计比直接对接各家...
#OpenRouter#Seedance#Veo
一句话点评
OpenRouter 把 Seedance、Veo 等视频生成模型统一成一个异步 API:发请求拿 job ID,轮询等结果,下载 MP4。换模型改一行 model 参数就行,不用重新对接各家接口和认证。正文没披露具体价格和生成速度,但异步设计比直接对接各家或本地跑 GPU 省事。如果是真的挺省钱,但轮询延迟和稳定性得自己试。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
00:00
29d ago
AI HOT 精选· aihot-apiZH00:00 · 08·25
OpenRouter 教你六步挑模型:先看任务,再看成本,别信排行榜
OpenRouter 发了一篇实用指南,核心观点是“没有最好的模型,只有最适合你任务、预算和延迟的模型”。它给了一个六步框架:先定义任务,再用排行榜和实时用量数据筛出候选,然后对比不同供应商的价格和延迟,最后拿自己的提示词跑一轮实测。评判标准是“每个任务花多少钱”,而不是“每个 token 花多少钱”。OpenRouter 的 MCP 服务器可以直接在...
#Benchmarking#Inference-opt#OpenRouter#Artificial Analysis
一句话点评
OpenRouter 这篇指南的核心是:别迷信排行榜,先定义任务,再拿自己的提示词跑一轮实测,最后按“每完成一个任务花多少钱”来算账,而不是按 token 单价。它提供了一个六步框架,还能在编辑器里通过 MCP 直接查实时排名和价格。正文没披露具体测试案例或成本对比数据,所以实操效果得自己试。对选模型头疼的团队,这套流程比看榜单靠谱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
2026-08-24 · 星期一2026年8月24日

更多

频道

后台