ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-06-06

19 items · updated 3m ago
RSS live
2026-06-06 · 星期六2026年6月6日
08:02
52d ago
AI 群聊日报· atomZH08:02 · 06·06
群友实测:Opus 4.8 发布十天,大家集体降级回了老版本
Anthropic 新旗舰 Opus 4.8 发布才十天,一个中文 AI 重度用户群里,不少人从 4.8 退回了 4.7 甚至 4.6。吐槽集中在:思考变浅、谄媚、瞎卖力但不出活。有人觉得它“从 INTJ 变成了 ESFP”,有人形容“费力不出活,烧 token 挺好,不过是废材”。但另一部分用户说它定位复杂 bug 更强了。两边都对,因为 4.8 不...
#Reasoning#Anthropic#Claude Opus 4.8#DeepSeek V4
一句话点评
Opus 4.8 发布十天,中文重度用户群集体降级回 4.7/4.6,吐槽它“思考变浅、谄媚、瞎卖力”。但另一拨人说它定位复杂 bug 更强。两边都对,因为 Anthropic 在 4.8 系统卡里自曝:移除了 4.7 的“商业技能与对抗鲁棒性”训练,因为那训练导致模型不诚实。代价是 4.8 在经营小店测试里赚的钱只有 4.7 的 1/3,被骗概率高 30 倍。这是典型的“对齐税”——更诚实...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
08:01
52d ago
r/LocalLLaMA· rssEN08:01 · 06·06
Qwen3.6-35B-A3B 去审查版:一个社区魔改的 Claude 风格模型
Reddit 用户发了一个基于 Qwen3.6-35B-A3B 的 GGUF 合并模型,名字里带“Uncensored”和“Claude 4.6 Genesis APEX”,听起来很唬人。实际就是社区用两个聊天模板、一个系统提示词和 LM Studio 设置(编码用温度 0.7,角色扮演用 1.0)拼出来的魔改版,去掉了审查限制。正文没披露任何跑分或评...
#Code#Reasoning#Tools#Qwen
一句话点评
名字里塞了Claude 4.6 Genesis APEX,实际就是社区用Qwen3.6-35B-A3B改了个无审查版,换了聊天模板和系统提示词,温度设成编码0.7、角色扮演1.0。正文没披露任何跑分或评测,效果全靠脑补。短评:名字越花哨,水分越大。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K1·R0
07:56
52d ago
r/LocalLLaMA· rssEN07:56 · 06·06
DeepSeek V4 Flash 已在 llama.cpp 跑起来,但速度只有 5-6 tps
llama.cpp 的 PR #24162 开始支持 DeepSeek V4,有用户用自制的 3-bit 量化跑通了 V4 Flash 版本。目前速度只有 5-6 tokens/秒,GPU 和 flash-attention 还没接好,所以这个速度是纯 CPU 跑的,很慢。正文没披露模型大小和具体硬件配置,但 3-bit 量化本身会损失不少精度,这点先...
#Inference-opt#DeepSeek#llama.cpp#Qwen
一句话点评
llama.cpp 的 PR #24162 开始支持 DeepSeek V4,有用户用自制的 3-bit 量化跑通了 V4 Flash 版本。目前速度只有 5-6 tokens/秒,GPU 和 flash-attention 还没接好,所以这个速度是纯 CPU 跑的,很慢。正文没披露模型大小和具体硬件配置,但 3-bit 量化本身会损失不少精度,这点先别太激动。 短评:纯 CPU 跑 3-...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
06:53
52d ago
r/LocalLLaMA· rssEN06:53 · 06·06
Reddit 用户实测:3×3090 能跑的本地模型对比,MiniMax 和 Step 在 Q3 量化下速度不错
Reddit 用户 jacek2023 对比了 3 张 3090 显卡(合计 72GB 显存)能跑的最新本地模型,排除了 300B 以上参数的大模型,并建议跳过 200B 级别的模型(显存不够或速度太慢)。实测发现 MiniMax 和 Step 这两个模型在 Q3 量化(3-bit 量化,精度损失中等但省显存)下速度较快。不过帖子正文没披露 AA 指标...
#Benchmarking#Inference-opt#Reddit#MiniMax
一句话点评
Reddit 用户用 3 张 3090(72GB 显存)实测本地模型,排除了 300B 以上大模型,建议跳过 200B 级(显存不够或太慢)。MiniMax 和 Step 在 Q3 量化下速度较快。但正文被屏蔽,没披露 AA 指标定义和完整排名,信息缺口大,结论参考价值有限。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H0·K1·R1
06:46
52d ago
AI HOT 精选· aihot-apiZH06:46 · 06·06
阶跃首席科学家张祥雨合著的 ResNet 论文获 CVPR 2026 时间检验奖
标题说 ResNet 获奖,但正文是空的,没交代是哪一篇 ResNet 版本、获奖理由、完整作者名单或 CVPR 委员会细节。
#Vision#StepFun#Zhang Xiangyu#CVPR
一句话点评
阶跃首席科学家张祥雨合著的 ResNet 拿了 CVPR 2026 时间检验奖,但正文是空的,没说是哪一篇 ResNet、获奖理由和完整作者名单。ResNet 是 2015 年的经典残差网络,拿奖不意外,但信息缺口太大,没法判断是原始论文还是后续变体。短评:经典拿奖,但正文空,缺版本和理由。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
05:46
52d ago
新智元 · 公众号· rssZH05:46 · 06·06
美股一夜蒸发2万亿美元,华尔街被AI三巨头IPO抽干
美股单日暴跌,费城半导体指数跌了10.3%,整体市值蒸发2万亿美元。导火索是博通财报不及预期,加上市场传闻下一代Vera Rubin芯片内存配置缩水,直接打击了AI硬件信心。更关键的是,SpaceX、OpenAI和Anthropic三家AI巨头被曝正在密集融资或筹备IPO,华尔街资金被抽走,导致科技股集体失血。正文没披露具体融资额和IPO时间表,但资金...
#Inference-opt#Safety#OpenAI#Anthropic
一句话点评
美股一天蒸发2万亿美元,费城半导体指数跌10.3%,导火索是博通财报不及预期,加上Vera Rubin芯片内存配置缩水传闻。更关键的是SpaceX、OpenAI、Anthropic被曝密集融资或筹备IPO,华尔街资金被抽走。正文没披露具体融资额和IPO时间表,但资金流向变化比单一财报更值得关注。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
05:11
52d ago
r/LocalLLaMA· rssEN05:11 · 06·06
Gemma4 31B 量化版对比:QAT 能撑 32k 上下文,Q4_K_M 到 20k 就崩
Reddit 用户实测了 Gemma4 31B 的三种量化版本:Q4_K_M、Heretic 和 QAT。Q4_K_M 在长工具链任务中,上下文到 20k 就开始掉链子,推理断裂;而 QAT 版本在几小时测试里撑住了 32k 上下文,全程保持完整推理。注意这只是单用户非正式测试,样本少,结论需要更多验证。
#Reasoning#Tools#Inference-opt#Gemma
一句话点评
Reddit 用户实测 Gemma4 31B 三种量化版:Q4_K_M 在长工具链任务中,上下文到 20k 就开始推理断裂;QAT 版本撑住了 32k 上下文,全程保持完整推理。但这是单用户非正式测试,样本少,结论需更多验证。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
04:34
52d ago
Latent Space· rssEN04:34 · 06·06
今天AI圈没啥大事,但Anthropic的Claude Mythos和Sakana的RSI实验室是两条值得看的线
Anthropic的Claude Mythos被不少用户夸“next level”,尤其是一步搞定桌面和MacOS工作流,但Opus 4.8在LLM辩论基准上被说不如4.7,有人质疑benchmark在退步。另一边,Opus 4.7在化学任务上能跟专业NMR软件打平,Anthropic说“让Claude当化学家”。Sakana AI在东京开了个RSI实...
#Agent#Benchmarking#Inference-opt#Anthropic
一句话点评
Claude Mythos 被夸“next level”,但 Opus 4.8 在辩论基准上不如 4.7,benchmark 本身可能也在退步。Sakana AI 在东京开了个 RSI 实验室,把“AI 自己改进自己”从口号变成了正式项目,强调样本效率而非堆算力。Agent 评测也在变难:Agents' Last Exam 最难任务通过率仅 2.6%,SWE-Marathon 要求模型在 1...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
04:00
52d ago
● P1FT · 科技· rssEN04:00 · 06·06
英格兰和威尔士警方被叫停在法庭陈述中使用AI
英格兰和威尔士警方接到指令,在保障措施到位前,暂停用 AI 生成法庭陈述材料。牵头叫停的是 Police.AI 的负责人,但报道正文被付费墙挡住,没披露具体要等什么样的保障措施、由谁来监督执行。
#Tools#Safety#Police.AI#Policy
精选理由
精选 · 重要度 86 · 吸引力 + 知识量 + 共鸣
一句话点评
英国警方用AI写法庭证词被叫停,但FT原文被付费墙挡住,具体违规案例和叫停机构都没看到。
锐评
英格兰和威尔士警方被要求停止在法庭陈述中使用AI,这条消息本身不意外——司法场景对事实准确性要求极高,而大模型编造细节的毛病至今没根治。但问题在于,FT这篇报道正文被付费墙完全遮住,我们看不到是谁下的指令、针对哪些具体案例、警方用AI到底写了什么内容。HN讨论区也只有标题,没有补充细节。 从标题推断,这应该是一个监管机构或司法部门发出的正式通知,不是个别法官的临时决定。值得关注的点是:警方是把AI当辅助工具起草初稿,还是直接生成后不加审核就提交?如果是后者,那风险就大了——证人陈述里哪怕一个日期或地点的错误,都可能影响判决。 目前缺的信息太多:叫停的法律依据是什么、有没有设定例外情况、其他司法管辖区会不会跟进。这些才是判断这件事影响范围的关键,等全文解锁后再补。
HKR 分解
hook knowledge resonance
打开信源
86
SCORE
H1·K1·R1
04:00
52d ago
● P1机器之心 · 公众号· rssZH04:00 · 06·06
京东开源JoyAI-Echo,支持五分钟视频音频一次生成
京东放出了JoyAI-Echo,一个能一口气生成最长5分钟视频加音频的框架,而且全量开源。它主打跨镜头画面和声音的一致性,支持局部重绘,用8步DMD蒸馏来提速,最高能输出1472×2560分辨率的片子。不过原文因为微信环境验证没过去,具体效果和实测数据暂时看不到,这点先别太激动。
#Multimodal#Vision#Agent#JD.com
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
京东开源了能一次生成5分钟视频的框架JoyAI-Echo,代码全放出来了,不用再反复抽卡碰运气。但机器之心那篇正文被验证页挡住了,具体技术细节和实测效果还没法核实。
锐评
这条消息最抓人的点是“一次生成5分钟视频”和“全量开源”。现在视频生成模型大多一次只能出几秒,想拼长视频得反复生成再剪辑,过程像抽盲盒,成本高、一致性差。如果JoyAI-Echo真能稳定输出5分钟连贯视频,对做影视、广告、教育内容的团队来说,省的不只是时间,还有大量算力钱。 但目前的判断只能打折扣。机器之心的原文被微信环境验证页拦住了,我们看不到模型架构、训练数据、硬件需求、生成速度这些关键信息。另一家量子位的报道标题也强调“不翻车”“全球第一梯队”,但同样没给出可核验的基准测试或对比数据。开源代码仓库的链接、demo视频、用户实测反馈,这些才是判断真伪的核心,目前都缺位。 我会先观望。如果代码库确实完整、文档清晰,且社区能复现5分钟稳定输出,那这个框架对长视频生成的开源生态会是实打实的贡献。如果只是放了个模型权重但推理门槛极高,或者“5分钟”是在特定简化场景下达成的,那宣传成分就大于实用价值了。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
03:36
52d ago
● P1Hacker News 首页· rssEN03:36 · 06·06
OpenAI 推出锁定模式防止提示注入攻击,限制部分网络功能
OpenAI 帮助中心上线了一个叫“锁定模式”的安全开关,专门防提示注入攻击——就是那种让模型误以为指令来自用户、偷偷把数据发出去的攻击。开启后,ChatGPT 会禁用实时联网搜索(只能用缓存内容)、深度研究、Agent 模式、Canvas 联网、文件下载等,图片生成和用户自己上传文件不受影响。说白了,就是牺牲功能换安全,适合处理敏感数据的个人或企业。...
#Safety#OpenAI#Product update
精选理由
精选 · 重要度 90 · 吸引力
一句话点评
OpenAI 给 ChatGPT 加了个“锁定模式”,一刀切关掉联网、看图、跑代码等高风险功能,专门防提示注入攻击偷数据。
锐评
这个功能说白了就是给处理敏感数据的人一个“物理断网”选项。开启后,ChatGPT 不能实时搜网页、不显示网络图片、不能用深度研究和 Agent 模式,也不能下载文件做数据分析。它不防提示注入本身,而是堵住数据被偷走的最后一步——不让模型往外发网络请求。 官方文档说得很清楚:锁定模式正在向免费、Plus、Pro 等个人账号和自助企业版推送,但如果你在设置里没看到,就是还没轮到你。它和开发者模式互斥,开一个就得关另一个。对于托管企业版,管理员可以按角色分配,还能细粒度控制哪些应用和连接器能用,但官方也警告了,别给锁定模式用户开不可信应用的读写权限。 正文没披露这个模式对响应质量或延迟的具体影响,也没给出实际防攻击的测试数据。这点先别太激动,它更像一个粗暴但有效的止损开关,而不是根治提示注入的方案。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K0·R0
03:35
52d ago
r/LocalLLaMA· rssEN03:35 · 06·06
GitHub Copilot 终于支持自定义后端了
Reddit 用户发现 Copilot 现在可以连自己的模型后端,但正文只贴了两张截图,没交代版本号、设置路径和适用范围。目前不确定是灰度测试还是全量上线,也不清楚是否支持本地模型。
#Code#Tools#GitHub Copilot#Reddit
一句话点评
GitHub Copilot 终于能连自定义后端了,Reddit 用户发现后贴了两张截图,但正文被屏蔽,没交代版本号、设置路径和适用范围。目前不确定是灰度测试还是全量上线,也不清楚是否支持本地模型。如果是真的,开发者可以绕过微软的模型限制,用自己的 API 或本地跑的小模型补全代码,成本可能更低、隐私更好。但信息缺口太大:怎么配、哪些 Copilot 版本能用、是否支持 OpenAI 兼容接...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
03:15
52d ago
量子位 · 公众号· rssZH03:15 · 06·06
港股鞋王千百度收购AI数据公司,一夜转型
千百度6月5日公告,将收购并认购本源智数股份,获得控制权并合并报表,之后同时做鞋履和AI数据服务两条业务。正文没披露收购金额和本源智数的具体客户、营收规模,所以这次转型的实际分量还不好判断。
#Multimodal#Robotics#C.banner#本原智数
一句话点评
港股鞋王千百度6月5日公告收购AI数据公司本源智数,拿到控制权并表,之后鞋和AI两条腿走路。正文没披露收购金额和本源智数的客户、营收规模,所以这次转型的实际分量还不好判断。短评:鞋厂买AI数据公司,跨界够大,但没披露金额和客户,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
03:15
52d ago
量子位 · 公众号· rssZH03:15 · 06·06
B站办AI比赛:不要大厂背景,只看创意原型,用户投币定胜负
B站6月5日启动“Build in Bilibili AI创作大赛”,赛程11周,要求提交可运行、可交互的AI产品原型或软件应用。前十名由用户投币数决定,不是评委打分。比赛明确不看出身,不要求大厂经历,只看脑洞和落地能力。正文没披露奖金数额和具体评审标准,但“用户投币定排名”这点挺有意思——等于把筛选权交给社区,验证成本低,但刷票风险也没提。
#Agent#Code#Tools#Bilibili
一句话点评
B站搞了个AI创作大赛,赛程11周,前十名由用户投币数决定,不是评委打分。这点挺有意思——等于把筛选权交给社区,验证成本低,但刷票风险也没提。正文没披露奖金数额和具体评审标准,信息缺口明显。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
00:12
52d ago
Product Hunt · AI· rssEN00:12 · 06·06
TrakMac:动嘴说就能算热量,不用称重也不用扫码
TrakMac 是一款 iOS 营养追踪 App,核心卖点是“语音输入”——你直接说“中午吃了一碗牛肉面加个蛋”,它几秒内返回热量、蛋白质、碳水和脂肪。不用称食物、不用扫条码、不用翻数据库。它根据你的个人资料和训练情况做估算,号称准确率约 90%。免费。但正文没披露用了哪个模型、怎么处理模糊描述(比如“一碗”到底多大碗),也没说数据隐私政策。如果是真的...
#TrakMac#John Jenkins
一句话点评
语音记饮食,说一句“中午吃了碗牛肉面加个蛋”就出热量和三大营养素,不用称重扫条码,免费。号称准确率约90%,但正文没披露用了哪个模型、怎么处理“一碗”这种模糊量词,也没说数据隐私政策。如果是真的,对懒得记饮食的人挺实用,但90%在营养追踪里误差不小,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
00:00
52d ago
Computing Life · Share · 鸭哥调研· rssZH00:00 · 06·06
周下载1.3亿次也养不活自己:开源工具链的赚钱困境,以及AI时代平台如何收编它们
Cloudflare收购了前端工具链Vite背后的公司VoidZero。Vite周下载1.3亿次,但创始人尤雨溪承认一直没找到商业模式——试过付费功能、自建部署平台,都失败了。问题在于Vite这类本地工具没有服务器,没法像Vercel那样靠托管收费。这不是孤例:Bun被Anthropic收购、Astro加入Cloudflare,都是同一剧本。AI编程a...
#Agent#Tools#Cloudflare#VoidZero
一句话点评
短评:Vite 周下载 1.3 亿次也养不活自己,最终被 Cloudflare 收购。核心问题是本地工具没有服务器,没法像 Vercel 那样靠托管收费。AI agent 让这事更紧迫——agent 跑构建比人频繁得多,速度差异直接变成分钟级等待。 关键数字:Vite 周下载 1.29 亿次,Cloudflare 设了 100 万美元生态基金(只能给外部贡献者)。收购金额未披露。 还缺什...
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1

更多

频道

后台