ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-09-02

50 items · updated 3m ago
RSS live
2026-09-02 · 星期三2026年9月2日
23:00
20d ago
彭博科技· rssEN23:00 · 09·02
Uber 联手英国自动驾驶公司 Wayve 在伦敦上线 Robotaxi,直接叫板 Waymo
Uber 和英国自动驾驶公司 Wayve 今天在伦敦正式推出 Robotaxi 服务,这是 Uber 在欧洲的第一个无人驾驶打车项目,技术由 Wayve 提供。文章被 Bloomberg 的付费墙挡住,所以运营区域、车队规模、定价、有没有安全员这些关键信息都没披露。能确认的就一句话:Uber 终于在欧洲落地了,对手是 Waymo。
#Uber#Wayve#Waymo
一句话点评
Uber 和英国自动驾驶公司 Wayve 在伦敦上线了 Robotaxi 服务,这是 Uber 在欧洲的首个无人驾驶打车项目,直接对标 Waymo。但全文被 Bloomberg 付费墙挡住,运营区域、车队规模、定价、有没有安全员这些关键信息都没披露。能确认的就一句话:Uber 终于在欧洲落地了,对手是 Waymo。 短评:欧洲首战,但细节全无,先别激动。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R1
22:45
20d ago
Hacker News 首页· rssEN22:45 · 09·02
THEYFELL:把你的项目链接丢进去,AI 会给你写一篇毫不留情的讣告
一个叫 THEYFELL 的免费工具,你给它一个网址或一段文字,它就用 AI 生成一份“你项目/事业的讣告”,语气非常毒舌。作者先拿自己的项目试了刀:一个叫 bitrep 的字节级可复现性工具库,GitHub 上 2 个星、0 个 fork,死因是“在所有架构上验证通过,但没人用”。免费版给一张墓碑卡片和两行悼词;花 3.99 美元解锁完整尸检报告,包...
#TheyFell.com#bitrep#Kyle Clouthier
一句话点评
一个免费工具,输入网址或文字,AI 就生成一份毒舌版项目讣告。作者先拿自己只有2星0 fork的bitrep开刀,死因是“所有架构验证通过,但没人用”。免费版给墓碑卡片和两行悼词;3.99美元解锁完整尸检报告,含死因、时间线和作弊码;49美元给30天复活计划。正文没披露底层模型,但说只读真实内容并脱敏。 短评:自己先吃毒药再卖解药,挺诚实。但讣告质量取决于AI毒舌水平,3.99的尸检报告值...
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R1
22:44
20d ago
TechCrunch AI· rssEN22:44 · 09·02
Palo Alto Networks 花 5 亿美元现金加股票,买下做 AI 帮手的 Console
Palo Alto Networks 用 5 亿美元现金加股票收购了成立两年的初创公司 Console。Console 做的是让 AI 代理自动处理 IT 部门那些重复性的杂活,比如重置密码、排查网络故障。这家公司之前总共只融了 2900 万美元,上一轮估值 1.57 亿美元,投资人包括 Thrive Capital 和 DST Global,这笔交易...
#Palo Alto Networks#Console#Thrive Capital
一句话点评
Palo Alto Networks 花 5 亿美元现金加股票买了一家才成立两年的小公司 Console,这笔钱是它上一轮估值的 3 倍多。Console 做的是让 AI 自动干 IT 杂活,比如重置密码、查网络故障。投资人 Thrive Capital 和 DST Global 赚了快钱,公司总共才融了 2900 万美元。Palo Alto Networks 打算把这套技术塞进自己的安全平...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
21:39
20d ago
● P1AI HOT 精选· aihot-apiZH21:39 · 09·02
Meta发布Muse Spark 1.3,智力评分62接近Claude和GPT
Meta 五个月内发了第四个 Muse Spark 版本,这次是 1.3。最强的 max 变体在 Artificial Analysis 的智力指数上拿了 62 分,已经贴近 Claude 和 GPT-5.6 的水平。不过这个 max 版目前只是给合作伙伴的限时预览,正文没提参数量、推理成本,也没说什么时候公开。
#Meta#Muse Spark#Artificial Analysis
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Meta 新模型智力评分 62,接近 Claude 和 GPT,但正文没披露具体测试条件和模型规模,先别太激动。
锐评
Meta 放出了 Muse Spark 1.3,主打智能体任务和科学推理,智力评分 61-62 分,这个分数已经逼近 Claude 和 GPT-5.6 的水平。数字看着挺能打,但得先打个折:目前只有 RSS 标题和摘要,正文是空的,具体评测基准、模型参数量、推理成本这些关键信息全都没披露。 智力评分 62 这个数字本身需要上下文——它是在什么测试集上跑的,对比的 Claude 和 GPT 具体是哪个版本,测试条件是否对等,这些都不知道。另外,模型叫 Spark,听起来像是轻量级路线,如果真是小模型跑出接近大模型的分数,那成本优势会是个看点。但正文没给任何架构细节,也没提是开源还是闭源,这些缺口让判断只能停在标题层面。 等完整技术报告出来,重点要看推理延迟、硬件需求和实际任务上的稳定性,光一个智力评分说明不了太多。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
20:57
20d ago
● P1Hacker News 首页· rssEN20:57 · 09·02
纽约市教育局长下令禁用AI工具在全市公立学校
纽约市教育局长 Mamdani 发布了一项禁令,全市公立学校不得使用 AI 工具。目前只有一条标题,正文没披露禁令的具体范围、怎么执行、从哪天开始生效。Hacker News 上讨论热度还行,67 分、14 条评论,但想了解细节还得等完整文章出来。
#Mamdani#New York City Department of Education
精选理由
精选 · 重要度 88 · 吸引力 + 共鸣
一句话点评
纽约公立学校一刀切禁用AI,直到高中才解禁。正文没给具体理由,先别急着站队。
锐评
纽约市教育局长直接下令,全市公立学校的学生在升入高中前都不能用AI工具。这条禁令来自Verge和Hacker News的标题,但两篇正文都是空的,我们看不到禁令的具体范围、例外条款和处罚措施。 从现有信息看,这更像是一种风险规避式的行政决策,而不是基于教学效果的评估。学校系统对AI的态度往往两极分化:要么全面拥抱,要么彻底封堵。纽约这次选了后者,但没解释是担心作弊、数据隐私,还是觉得低龄学生用AI会阻碍基础能力培养。 我会先打个折:禁令的落地效果取决于执行力度,学生在家用手机访问ChatGPT根本拦不住。真正值得关注的是后续有没有配套的AI素养课程,以及高中阶段会以什么方式重新引入这些工具。如果只是禁而不教,这条政策的价值就很有限。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K0·R1
20:42
20d ago
彭博科技· rssEN20:42 · 09·02
美国拉着G20签了一份“轻监管”AI协议,给企业松绑
美国跟G20成员国签了一份AI监管协议,基调是“轻触式”——不搞重手监管,给公司更多灵活空间。正文没披露具体条款,所以到底哪些管、哪些不管还不清楚。但方向很明确:偏向创新优先,而不是欧盟那种强监管路线。对做AI产品的团队来说,短期内合规压力可能没那么大,但具体落地还得看各国后续怎么执行。
#US#G20
一句话点评
美国拉着G20签了份AI监管协议,基调是“轻触式”——不搞重手监管,给公司更多灵活空间。方向明确偏向创新优先,跟欧盟的强监管路线对着干。但正文没披露具体条款,所以到底哪些管、哪些不管还不清楚。对做AI产品的团队来说,短期内合规压力可能没那么大,但具体落地还得看各国后续怎么执行。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K0·R1
19:53
20d ago
FT · 科技· rssEN19:53 · 09·02
谷歌逃过广告技术业务拆分,但反垄断紧箍咒没摘
美国联邦法官认定谷歌垄断了在线广告市场,但没要求拆分它的广告技术部门。谷歌必须向竞争对手开放广告工具、停止偏袒自家服务,并接受外部监督。谷歌表示会上诉。文章没提具体执行时间表,也没说罚多少钱。
#Google#US Department of Justice#Policy
一句话点评
谷歌躲过了拆分,但没躲过整改。法官认定它在在线广告市场搞垄断,要求向对手开放广告工具、不准再偏袒自家服务,还得接受外部监督。谷歌嘴上说要上诉,但正文没给出具体执行时间表,也没提罚款金额。
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
19:25
20d ago
● P1Hacker News 首页· rssEN19:25 · 09·02
Meta 发布代码模型 Muse Spark 1.3 增强智能体和编程能力
Meta 今天在 Muse Code 和自家 API 上线了新模型 Muse Spark 1.3。它主要强化了两件事:一是写代码和当“数字员工”干活的能力,二是处理那种步骤多、容易跑偏的长任务。具体来说,这个模型现在会在指令模糊时主动问你,卡住了会求助,要执行重要操作前会先跟你确认。跑分上,它在智能体、编程、指令遵循和长文本理解这几个项目里,都超过了自...
#Agent#Code#Meta#Muse Spark 1.3
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Meta 发了新代码模型 Muse Spark 1.3,主要强化了让模型自己规划步骤、调用工具干活的能力,但没给具体跑分和参数量。
锐评
Muse Spark 1.3 这次升级的重点不是刷代码生成榜单,而是让模型更像一个能独立干活的“智能体”。官方说法是它能处理更长的任务链,在多轮对话里自己查漏补缺、主动问清楚模糊指令,甚至能同时跟进几个不同的工作流。这听起来像是给模型装了个更靠谱的任务管理器。 不过,这篇博客更像产品更新说明,而不是技术报告。它展示了一个用 CFD 数据写仿真报告、一个修音频的演示,但关键的硬指标——比如在 SWE-bench 这类标准智能体测试上到底多少分、模型参数规模多大、推理成本如何——正文全都没提。只给了一张和 GPT 5.6、Opus 5 对比的柱状图,但没标具体数值,也没说测试条件。 所以我的判断是:方向对,演示看着也实用,但在看到独立跑分和成本数据之前,先别急着把它当成智能体领域的“新王”。如果你正在选型,可以等第三方评测出来再动手。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
18:44
20d ago
● P1FT · 科技· rssEN18:44 · 09·02
美国司法部支持OpenAI在纽约时报版权案中主张合理使用
美国司法部在《纽约时报》诉 OpenAI 的版权案中提交了一份意见书,核心观点是:用公开文章训练 AI 模型,提取的是不受版权保护的事实、语言模式和统计信息,而不是原文的独创表达,因此属于“合理使用”,不构成侵权。这份文件没有法律约束力,但代表了联邦政府的官方立场,可能会影响法官对合理使用边界的划定。正文没披露预计什么时候出判决。
#OpenAI#The New York Times#US Department of Justice
精选理由
精选 · 重要度 99 · 吸引力 + 知识量 + 共鸣
一句话点评
美国司法部下场站队 OpenAI,认为用版权材料训练大模型算合理使用。这对纽约时报是个坏消息,但别急着下结论,这只是政府意见书,不是法院判决。
锐评
这条新闻的核心是:特朗普政府的司法部向法院提交了一份 20 页的意见书,明确支持 OpenAI 在训练大模型时未经许可使用版权材料属于“合理使用”。他们的理由很直白——美国要保持 AI 全球领先,不能让版权法拖慢产业。这立场跟拜登政府时期没太大区别,说明在 AI 训练这件事上,两党罕见地站到了一起。 但得说清楚,这只是政府作为“法庭之友”提交的意见,不是判决,法官可以不采纳。纽约时报的官司还在打,最终怎么判,还得看法院对“合理使用”四要素的解释,尤其是 AI 输出会不会直接替代原作品的市场。目前公开信息里没看到法院排期或预期判决时间,这点先别太激动。 还缺什么?意见书全文虽然公开了,但报道没提政府是否对“模型输出可能复述原文”这个争议点表态。如果只谈训练不谈输出,那对内容创作者的保护缺口依然很大。
HKR 分解
hook knowledge resonance
打开信源
99
SCORE
H1·K1·R1
17:09
20d ago
TechCrunch AI· rssEN17:09 · 09·02
Pangram CEO:互联网离“死网理论”成真已经非常近了
Pangram 的 CEO Max Spero 在 Equity 播客里说,AI 生成的文字已经大量涌入求职申请、产品评论甚至保险理赔,互联网的信任基础在快速崩塌。他的公司刚拿了 900 万美元融资,还跟 Substack 合作,帮读者识别哪些 newsletter 是用 AI 写的。Spero 认为,比起简单贴个“是或不是 AI”的标签,搞清楚一段内...
#Pangram#Max Spero#Substack
一句话点评
Pangram CEO 在播客里说互联网快被 AI 文字淹死了——求职信、商品评论、保险理赔里全是机器写的。他们刚拿了 900 万美元融资,跟 Substack 合作给 newsletter 打 AI 标签。想法是:光贴“是/否 AI”不够,得量化用了多少 AI。但问题在于,检测工具本身准确率存疑,而且 Substack 上很多作者本来就用 AI 辅助,一刀切标签可能误伤。短评:检测 AI ...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
17:04
20d ago
Hacker News 首页· rssEN17:04 · 09·02
独立开发者实测:ChatGPT 广告定位烂到流量基本没价值
独立开发者 Andy Brice 花了 289 英镑给自家排座软件投 ChatGPT 广告,2988 次点击只换来 14 次安装,转化率 0.46%。同期 Google 广告转化率 5.3%,ChatGPT 免费引荐流量也有 4.2%。他排除了点击造假、素材差和机器人刷量(FouAnalytics 标记约 30% 可疑,但多数是真人),发现 88% 的...
#OpenAI#ChatGPT#Google Ads
一句话点评
一个独立开发者花 289 英镑在 ChatGPT 上投广告,2988 次点击只换来 14 次安装,转化率 0.46%。同期 Google 广告转化率 5.3%,ChatGPT 免费引荐流量也有 4.2%。他排除了点击造假、素材差和机器人刷量,发现 88% 的访客动了鼠标但没点任何东西,平均停留 7 秒。结论很直接:ChatGPT 的付费广告定向太差,流量基本没价值。免费推荐能精准,付费反而拉...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R1
16:49
20d ago
Hacker News 首页· rssEN16:49 · 09·02
Tangle:Shopify 开源的可拖拽 ML 流水线编辑器
Shopify 把内部用的 ML 流水线编辑器 Tangle 开源了。核心卖点是拖拽式可视化搭建,团队可以一起编辑、克隆、跑不同版本,支持任意语言和框架(把现有代码包进容器就行)。中间结果会按内容缓存,重复跑的时候省时间省算力。有在线 Playground 可以直接试,代码在 GitHub。适合不想写胶水代码、想快速搭实验流程的团队。
#Shopify#Tangle#GitHub#Open source
一句话点评
Shopify 把内部用的 ML 流水线编辑器 Tangle 开源了,主打拖拽式可视化搭建,团队能一起编辑、克隆、跑不同版本,支持任意语言和框架(现有代码包进容器就行)。中间结果按内容缓存,重复跑时省时间省算力。有在线 Playground 可直接试,代码在 GitHub。适合不想写胶水代码、想快速搭实验流程的团队。 短评:拖拽搭 ML 流程,团队协作+缓存省算力,适合快速实验。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
16:35
20d ago
AI HOT 精选· aihot-apiZH16:35 · 09·02
Google AI 团队分享:怎么给“用模型当裁判”写一份靠谱的评分标准
这是 Google AI 系列文章的第二篇,讲的是怎么让“用大模型给大模型打分”这件事更靠谱。核心思路是把评分标准写成一组严格、客观的是非题,而不是让裁判模型去“感觉”答案好不好。文章给了四条规则:每条问题只检查一个点,别把多个要求塞进一句话;不同问题之间别重复检查同一个东西,否则一个错误会被扣两次分;用布尔判断(是/否)代替主观打分;把评分标准当成正...
#Benchmarking#Google AI#Jan-Felix Schmakeit
一句话点评
Google AI 这篇博客讲的是怎么让“用大模型给大模型打分”更靠谱。核心思路是把评分标准拆成一组严格的是非题,而不是让裁判模型凭感觉打分。文章给了四条规则:每条只查一个点、不同问题别重复扣分、用是/否代替主观打分、把标准当正式规格写。但正文没披露他们用哪个模型当裁判,也没给定量对比数据,所以实际能提升多少稳定性还不清楚。
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
16:25
20d ago
FT · 科技· rssEN16:25 · 09·02
AI 几小时就能发现金融系统的安全漏洞,但银行要几周甚至几个月才能补上
FT 报道了一个行业通病:AI 安全工具扫描金融系统漏洞只需几小时,但银行和券商受制于合规和变更管理流程,打补丁要几周甚至几个月。这个速度差让攻击窗口越拉越大。文章没点名具体公司或产品,但点出了一个普遍痛点——安全团队被 AI 逼着加速,后台流程却跟不上。
#Financial Times
一句话点评
AI 扫漏洞只要几小时,银行打补丁却要几周甚至几个月——FT 这篇报道点出了一个行业级的速度差。攻击窗口被越拉越大,问题不在 AI 工具本身,而在合规和变更管理流程拖了后腿。文章没点名具体公司或产品,更像一个普遍痛点描述。如果是真的,安全团队得想办法让后台流程跟上 AI 的节奏,否则漏洞扫描再快也是白搭。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K0·R0
16:01
20d ago
TechCrunch AI· rssEN16:01 · 09·02
印度首富想把旧电脑变成AI电脑,靠云服务不用换硬件
Reliance Jio 把 JioPC 云电脑服务开放给所有印度网民了,不再只限自家宽带用户。旧电脑(最老能撑8年)可以从云端拿到8个虚拟CPU、16GB内存、1TB硬盘,直接跑AI应用,不用换机器。价格挺便宜:两个月约11美元,一年套餐42到53美元。印度2025年有超过6500万台PC,其中约3400万台是旧机器,这个市场不小。但正文没披露延迟和...
#Reliance Jio#Mukesh Ambani#JioPC
一句话点评
Reliance Jio把云电脑JioPC开放给所有印度网民,旧电脑(最老8年)能云端拿到8核CPU、16GB内存、1TB硬盘,直接跑AI应用,不用换机。价格很便宜:两月约11美元,一年42-53美元。印度2025年有超6500万台PC,其中约3400万台是旧机,市场不小。但正文没披露延迟和带宽要求,这点先别太激动。如果是真的,对印度低端市场是个低成本AI入口。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
15:28
20d ago
AI HOT 精选· aihot-apiZH15:28 · 09·02
Google 解释 harness 工程:给编程 AI 套上缰绳,让它自己改 bug
Shir Meir Lador 把 harness 工程讲得很直白:别让 AI 编程助手裸奔,要用一套确定性的规则把它框住——比如限定工作区、自动抓错误日志喂回去让它自己修、让代码仓库结构清晰方便它逐步理解上下文。她引用了 OpenAI 的一个实验,3 个工程师一行手写代码都没写就交付了一个内部测试版产品。文章还给了段代码示例,用 Google 的 A...
#Google#Google ADK 2.0#Google Antigravity SDK
一句话点评
Google 的人把 harness 工程讲得很直白:别让 AI 编程助手裸奔,要用一套确定性的规则把它框住——限定工作区、自动抓错误日志喂回去让它自己修、让代码仓库结构清晰方便它逐步理解上下文。文章引用了 OpenAI 的一个实验,3 个工程师一行手写代码都没写就交付了一个内部测试版产品,所有代码由 Codex 生成。这个数字挺唬人,但正文没披露产品复杂度、测试覆盖率和后续维护成本,所以别...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
14:56
20d ago
TechCrunch AI· rssEN14:56 · 09·02
亚马逊Alexa购物助手新增诈骗短信识别功能
亚马逊给 Alexa for Shopping 加了个新功能:你把可疑的邮件或短信转发给它,AI 会拿官方发过的几十亿条消息做比对——看发件人、内容、时间戳和元数据,然后告诉你这条是不是真的。每年大约有 36 万用户找客服问“这消息是亚马逊发的吗”,现在可以直接问 AI。用户举报越多,系统识别能力越强。正文没披露上线时间和地区范围。
#Amazon#Alexa for Shopping
一句话点评
亚马逊把Alexa购物助手升级成反诈工具,能帮你鉴定收到的邮件、短信是不是真来自亚马逊。它拿官方发出的数十亿条消息做比对,分析发件人、内容、元数据来判断。每年有36万用户找客服问真假,现在AI直接答。但注意:它只能识别亚马逊官方的消息,其他平台的诈骗管不了。正文没披露误报率,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
14:35
20d ago
● P1The Verge · AI· rssEN14:35 · 09·02
OpenAI因加拿大枪击案遭30起新诉讼指控协助教唆
30 名在 Tumbler Ridge 校园枪击案现场的师生和校长,本周三在加州联邦法院起诉 OpenAI 和 Sam Altman。诉状称,OpenAI 的自动审核系统曾标记出枪手 Jesse Van Rootselaar 与 ChatGPT 聊过枪支暴力,但公司没有采取行动,这构成了“实质性协助和鼓励”。这个法律逻辑和今年 4 月遇难者家属提起的诉...
#OpenAI#Sam Altman#Jesse Van Rootselaar
精选理由
精选 · 重要度 94 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 被 30 起新诉讼指控“协助教唆”加拿大校园枪击案,法律风险从内容安全直接升级到刑事共犯层面。
锐评
这批诉讼把 OpenAI 推到了一个很危险的位置。之前大家讨论 AI 风险,更多是担心它生成仇恨言论或虚假信息,但这次是直接指控它“协助教唆”一起真实的校园枪击案。原告的逻辑是,枪手在作案前使用了 ChatGPT,OpenAI 提供了“实质性帮助和鼓励”。这个说法在法律上能不能成立还不好说,但 30 起诉讼同时发起,显然是有组织的法律行动,不是零星的个人索赔。 目前公开的报道里,没有披露枪手具体问了什么、ChatGPT 又回了什么,这是最大的信息缺口。如果只是普通的问答,很难构成教唆;但如果对话里出现了具体的犯罪指导,那 OpenAI 要面对的问题就严重得多。另外,这 30 起诉讼是在加拿大枪击案之后提起的,但报道没说明原告是受害者家属还是其他相关方,诉讼的具体诉求和索赔金额也没提。 这件事的看点不在于 OpenAI 会不会立刻输掉官司,而在于它可能迫使法院去界定一个模糊地带:当通用 AI 工具被用于策划暴力犯罪时,平台的责任边界在哪里。对从业者来说,这意味着模型安全不再只是过滤敏感词,而是要面对更复杂的法律归因问题。
HKR 分解
hook knowledge resonance
打开信源
94
SCORE
H1·K1·R1
14:02
20d ago
Hacker News 首页· rssEN14:02 · 09·02
WebLLM:浏览器里直接跑大模型,不用装显卡驱动
MLC-AI 开源的 WebLLM 让你在浏览器里直接跑 Llama、Gemma 等大模型,靠 WebGPU 加速,在普通消费级显卡上能达到接近原生的速度。好处是隐私数据不出本地,离线也能用,适合做个人助手或敏感场景。代价是首次加载要下载几个 GB 的模型权重,内存占用也高,别指望它能替代云端推理。
#MLC-AI#WebLLM
一句话点评
WebLLM 让你在浏览器里直接跑 Llama、Gemma,靠 WebGPU 加速,普通显卡就能接近原生速度。隐私数据不出本地,离线也能用。代价是首次要下载几个 GB 模型,内存占用高,别指望替代云端推理。正文没披露具体延迟数据,实际体验取决于显卡和模型大小。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H0·K1·R0
13:03
20d ago
Hacker News 首页· rssEN13:03 · 09·02
别被对数刻度骗了:大模型智商和成本的真实关系
OpenTeams 工程师 Guido Imperiale 认为 ArtificialAnalysis 那张“智商 vs 成本”图会误导人。对数刻度把最便宜和最贵模型之间 250 倍的真实价差给抹平了,反而放大了便宜货之间那点微不足道的价格差异。他自己用线性刻度重画了三张图,并且把官方 API 价格换成了 OpenRouter 上能找到的最便宜的第三方...
#Benchmarking#OpenTeams#Guido Imperiale#ArtificialAnalysis
一句话点评
AA的“智商vs成本”图用对数坐标,把最便宜和最贵模型之间250倍的真实价差抹平了,反而放大了便宜货之间那点微不足道的价格差异。OpenTeams工程师用线性刻度重画,改用OpenRouter最低价和本地模型电费计算,结果很直观:智商超过50分后,每多花一块钱买到的智能提升急剧下降。正文没披露电费的具体计算公式,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
12:30
20d ago
Hacker News 首页· rssEN12:30 · 09·02
Mistral 默认拿用户对话训练模型,企业版除外
Mistral 现在默认用免费和 Pro 用户的输入输出数据训练模型,企业版不受影响。用户可以在设置里关掉这个选项。正文没说明关掉后历史数据是否会被追溯删除,也没说训练数据具体保留多久。如果你在用免费版或 Pro 版,且不想自己的对话被拿去训练,记得手动去设置里关掉。
#Mistral
一句话点评
Mistral 默认用免费和 Pro 用户的对话数据训练模型,企业版不受影响。用户可在设置里关闭,但正文没说明关掉后历史数据是否会被追溯删除,也没说数据保留多久。如果你在用免费或 Pro 版,记得手动去设置里关掉。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
12:23
20d ago
Hacker News 首页· rssEN12:23 · 09·02
Anthropic 上线了一个文件检测工具,能看图片、视频或音频是不是 Claude 生成的
这个工具在浏览器里跑,上传文件后只读取文件里嵌的 C2PA 凭证(一种数字水印),不会把文件传出去。如果凭证显示文件被 Claude 处理过,工具就会告诉你。它不判断内容真假,也查不出文件是不是 AI 编的。没查到凭证不代表文件跟 Claude 无关——凭证可能被洗掉了,或者生成文件的模型、平台压根不支持打标。支持 JPG、PNG、MP4、MP3 等格...
#Anthropic#Claude
一句话点评
Anthropic 上线了一个浏览器端工具,上传图片/音视频后只读文件里的 C2PA 数字水印,不传文件,查到就告诉你这是 Claude 做的。但查不到不代表不是——水印可能被洗掉,或者模型/平台压根没打标。工具不判断内容真假,也查不出纯 AI 生成。支持 JPG/PNG/MP4/MP3 等格式,上限 100MB。 短评:一个诚实的“查水印”工具,不是 AI 检测器。对内容审核流程来说,聊...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
12:00
20d ago
最佳拍档· atomZH12:00 · 09·02
Anthropic 发布 MHS:让 Claude 直接操作实验室设备,相当于物理世界的 MCP
Anthropic 推出了 MHS(模型硬件标准),可以理解为 MCP 的物理版——让 Claude 这类模型直接控制实验仪器或机器人。标题提到了“实验室自动化”和“具身智能”,但正文没披露协议细节、支持哪些设备、以及什么时候能用。目前信息有限,先别太激动。
#Anthropic#Claude
一句话点评
Anthropic 出了个 MHS(模型硬件标准),可以理解为 MCP 的物理版——让 Claude 直接控制实验仪器或机器人。标题提了“实验室自动化”和“具身智能”,但正文没披露协议细节、支持哪些设备、以及什么时候能用。目前信息有限,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
11:07
20d ago
Hacker News 首页· rssEN11:07 · 09·02
LLM 裁判只会检查“有没有”,不会发现“缺了什么”:AI 病历漏写检测的盲点
用大模型当裁判去检查 AI 写的病历,发现它特别不擅长抓“漏写”——信息在问诊里提到了,但病历没记。论文建了一个 500 对的测试集,每对只有一处改动。对于“多写了”或“改写了”的内容,裁判的识别准确率在 0.79-0.94 之间;但对于“漏写了”,准确率只有 0.50-0.63,基本等于瞎猜。换个做法能救:先让模型把问诊记录里所有事实列出来,再逐条核...
#Benchmarking#ComposoAI
一句话点评
大模型当裁判查AI写的病历,发现它特别不擅长抓“漏写”——信息在问诊里提到了,但病历没记。论文建了500对测试集,每对只改一处。对于“多写”或“改写”,裁判识别准确率0.79-0.94;对于“漏写”,准确率只有0.50-0.63,基本等于瞎猜。换个做法能救:先让模型把问诊记录里所有事实列出来,再逐条核对病历。两步走的方法误报率仅2.7%;单步提示能多抓12%的遗漏,误报率6.2%,成本只有前...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
03:50
20d ago
AI HOT 精选· aihot-apiZH03:50 · 09·02
美团 LongCat-2.0 在 Cline 上免费试用
美团 LongCat-2.0 现在可以在 Cline 上免费试用了。不过正文没披露模型规格、能力或试用时长,只有标题确认了这件事。
#Meituan#LongCat-2.0#Cline
一句话点评
美团 LongCat-2.0 在 Cline 上开放免费试用,但正文没披露模型规格、能力或试用时长,只有标题确认了这件事。目前只能判断美团在推模型落地,但具体水平、适用场景、是否限时都不清楚。如果是真的,对开发者多一个选择,但信息太少,建议等详细说明再评估。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
03:32
20d ago
AI HOT 精选· aihot-apiZH03:32 · 09·02
UU远程新版上线:完整终端界面渲染,支持多会话管理,专为远程Vibe Coding优化
UU远程发布了新版本,核心是两个功能:完整TUI渲染(终端界面能完整显示,不只是文字流)和多终端会话管理(可以同时连多个远程终端,切换方便)。目标场景是远程Vibe Coding——即一边写代码一边让AI实时辅助的编程方式。正文没披露版本号、发布日期或技术实现细节,信息量有限,但标题确认了这两项更新。
#UU Remote
一句话点评
UU远程新版主打完整TUI渲染和多终端会话管理,专为远程Vibe Coding场景优化。TUI渲染意味着终端界面能完整显示,不只是文字流;多终端会话管理可同时连多个远程终端,切换方便。但正文被屏蔽,未披露版本号、发布日期或技术细节,信息量有限。如果是真的,对远程AI编程体验有实际提升,但需验证具体实现和稳定性。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
00:30
21d ago
AI HOT 精选· aihot-apiZH00:30 · 09·02
Anthropic 发了 Claude Fable 5.1 和 Mythos 5.1,一位深度用户给了两条实用建议
Thariq 在 X 上说这两个模型他用了很久,觉得不错,完整评测后面会出。他提了两个实操点:一是对验证要求不高、边界情况少的任务,可以把 effort 调低,省点算力;二是现在切换 effort 不会清掉 prompt cache 了,这对频繁调参的人是个好消息。
#Code#Anthropic#Thariq
一句话点评
Anthropic 发了两个新模型,Claude Fable 5.1 和 Mythos 5.1,主打编程和知识类任务。作者 Thariq 实测后给了两条实用建议:对验证要求不高、边界情况少的任务,可以把 effort 调低省算力;现在切换 effort 不会清掉 prompt cache 了,调参党会舒服很多。正文没给具体跑分、延迟或成本数据,只说“模型不错”,完整评测还没出。这点先别太激动...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0

更多

频道

后台