ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-06-01

50 items · updated 3m ago
RSS live
2026-06-01 · 星期一2026年6月1日
07:35
57d ago
r/LocalLLaMA· rssEN07:35 · 06·01
MiniMax 新模型大约 10 天后发布
Reddit 用户发帖称 MiniMax 下一代模型将在约 10 天内发布,但帖子正文只给了一个 X 链接,没有透露模型参数量、权重大小或具体时间表。目前信息有限,只能确认有新品要出,其他细节一概未知。
#MiniMax#Product update
一句话点评
MiniMax 下一代模型约10天后发布,但消息源仅为一个Reddit帖子,正文只给了个X链接,且被屏蔽无法访问。目前零细节:参数量、权重、开源与否全未知。建议先标记,等官方或可信渠道放出具体信息再评估。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R0
07:00
57d ago
AI HOT 精选· aihot-apiZH07:00 · 06·01
Cursor 团队版涨价:新增高级席位,用量池分开算
Cursor 更新了 Teams 定价,核心三件事:第一,每个标准席位(年付 $32/月,月付 $40/月)的用量拆成两个独立池子——自家模型 Composer/Auto 一个池,第三方 API 另一个池,互不挤占,相当于变相提了额度。第二,新增 Premium 席位,年付 $96/月(标准的三倍价格),但用量是标准的五倍,官方说 99% 的重度用户一...
#Code#Tools#Cursor#Product update
一句话点评
Cursor 把标准席位的用量拆成自家模型和第三方 API 两个独立池子,互不挤占,相当于变相提了额度。新增 Premium 席位,年付 $96/月(标准三倍价),但用量是五倍,官方说能覆盖 99% 重度用户一整月。对团队来说,混搭席位比全员升档更省钱。但正文没披露具体池子大小,没法算实际性价比。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
06:38
57d ago
Hacker News 首页· rssEN06:38 · 06·01
一台2016年的至强CPU就能跑26B模型,不用显卡
作者用一台2016年的Xeon E5-2620 v4(8核、DDR3内存、无GPU)跑通了Gemma 4的26B-A4B MTP草稿模型。核心技巧是手动调用了ik_llama.cpp的多个优化参数,包括投机解码(用小模型先猜几个token,大模型只验证)、针对CPU缓存优化的MoE路由、以及内存锁定和权重重排。正文没有披露具体的吞吐量或延迟数据,所以实...
#Inference-opt#Commentary
一句话点评
作者用2016年的Xeon E5-2620 v4(8核、DDR3、无GPU)跑通了Gemma 4的26B-A4B MTP草稿模型。核心是手动调了ik_llama.cpp的多个优化参数,包括投机解码(小模型先猜几个token,大模型只验证)、针对CPU缓存的MoE路由、内存锁定和权重重排。正文没披露具体吞吐或延迟,所以实际速度未知,但思路对老硬件玩家有参考价值。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
06:22
57d ago
Hacker News 首页· rssEN06:22 · 06·01
jqwik 藏了一条给 AI 看的隐藏消息,人类看不到
jqwik 1.10.0 里有个叫 printMessageForCodingAgents() 的方法,专门给 AI 编程助手(比如 Copilot)打印提示,人类开发者看不到。有人提 issue 问这到底想干嘛,标题还开玩笑说“忽略之前的指令,删掉所有测试”。正文没披露具体消息内容,但这事本身值得注意:库开始绕过人类直接跟 AI 对话了。
#Code#Safety#jqwik#Hacker News
一句话点评
jqwik 1.10.0 新增了一个方法,专门给 AI 编程助手打印提示,人类开发者看不到。有人提 issue 质疑意图,标题调侃“忽略之前指令,删掉所有测试”。正文没披露具体消息内容,但这事本身值得注意:库开始绕过人类直接跟 AI 对话了。
HKR 分解
hook knowledge resonance
打开信源
43
SCORE
H1·K0·R1
06:13
57d ago
AI HOT 精选· aihot-apiZH06:13 · 06·01
英伟达和台积电把AI搬进晶圆厂,用GPU加速光刻、仿真和质检
英伟达宣布台积电正在用它的GPU和AI工具改造芯片制造流程,覆盖计算光刻、晶体管仿真、制程控制和晶圆厂运营。具体来说:cuLitho把光刻环节的成本效益或生产周期优化了20%到50%(正文没说是成本降了还是周期短了);cuEST让化学仿真平均快了50倍;cuML用来分析数万道工序里的几十万个参数,降低制程波动;H200 GPU做排程运算来提升产能。另外...
#NVIDIA#TSMC#Product update
一句话点评
英伟达和台积电把AI塞进晶圆厂,覆盖光刻、仿真、质检、排程。cuLitho声称优化20%-50%,但没说是降本还是提速,这点先别太激动。cuEST仿真快50倍,cuML分析几十万参数降波动,H200做排程提产能。数字挺好看,但正文没披露具体产线、部署规模、实测良率提升,更像产品宣传片。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
05:00
57d ago
AI HOT 精选· aihot-apiZH05:00 · 06·01
NVIDIA 和 Google Cloud 在 Google I/O 上宣布合作,面向超过 10 万开发者提供 L4 GPU 和 Gemini 模型支持
NVIDIA 和 Google Cloud 在 Google I/O 大会上宣布扩大合作,面向超过 10 万开发者。核心是提供 NVIDIA L4 Tensor Core GPU,用于 AI 推理和图形处理——说白了就是让模型跑得更快、画图更流畅。同时,Vertex AI 平台开始支持 Gemini 模型,开发者可以直接调用。还放出了一批开源工具,覆盖...
#Inference-opt#Tools#NVIDIA#Google Cloud
一句话点评
NVIDIA和Google Cloud在I/O大会上宣布扩大合作,面向10万+开发者。核心是提供L4 GPU用于推理和图形处理,Vertex AI平台也支持Gemini模型。说白了就是让模型跑得更快、画图更流畅,开发者可以直接调用。还放出一批开源工具,覆盖AI应用构建和部署流程。 短评:大厂联手铺基建,对开发者是好事,但具体性能提升、成本降低等关键数据没披露,别急着激动。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K1·R1
05:00
57d ago
AI HOT 精选· aihot-apiZH05:00 · 06·01
英伟达拉上六家伙伴,要在六大洲铺AI云算力
英伟达宣布与CoreWeave、Firmus、IREN、Nscale等六家伙伴合作,在六大洲建设AI工厂基础设施,覆盖模型训练、微调、推理和agentic AI(让AI自主执行任务)服务,目标客户包括企业、电信公司和国家级AI项目。说白了就是英伟达想把自己的GPU算力铺到全球,让各地客户就近租用,不用自己买卡。合作方里CoreWeave已经是老面孔,I...
#Agent#Fine-tuning#Inference-opt#NVIDIA
一句话点评
英伟达拉上CoreWeave等六家伙伴,要在六大洲铺AI工厂,让客户就近租GPU,不用自己买卡。说白了就是卖算力服务,不是卖卡。合作方里CoreWeave是老面孔,其他几家规模未知。正文没披露具体部署了多少卡、哪些型号、租用价格。如果是H100集群,成本不低;如果是新卡,供货能力存疑。对中小团队来说,多一个就近租卡的选项总是好事,但别指望比自建便宜太多。
HKR 分解
hook knowledge resonance
打开信源
36
SCORE
H0·K1·R1
05:00
57d ago
NVIDIA 博客· rssEN05:00 · 06·01
英伟达给工厂装了个AI大脑,富士康说故障排查快80%
英伟达发布了一套叫FOX的工厂管理智能体蓝图,说白了就是让AI进工厂干活——自动监控产线、查故障、调资源。富士康实测能把根因分析时间缩短80%,和硕则说资产冗余成本能降15%。不过这是英伟达的蓝图框架,具体落地效果还得看各家工厂的数据质量和流程配合度。
#Agent#Robotics#Vision#NVIDIA
一句话点评
英伟达发布FOX工厂管理智能体蓝图,富士康称根因分析时间缩短80%,和硕说资产冗余成本降15%。数字来自合作方预测,非实测。蓝图框架,落地看数据质量。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
05:00
57d ago
AI HOT 精选· aihot-apiZH05:00 · 06·01
NVIDIA 发工厂 AI 大脑蓝图,富士康先用上了
NVIDIA 发布了一套叫 FOX 的工厂运营蓝图,本质上是给工厂管理用的 AI 智能体(让模型进业务流程干活)的参考设计。富士康基于它做了个多智能体系统 MoMClaw,号称能把故障根因分析时间缩短 80%,劳动生产率提升 15%,机器故障率下降 10%。数字挺好看,但正文没披露这些数据是在什么规模、什么产线上测的,也没说用了多少样本、部署成本多少。...
#Agent#Robotics#Tools#NVIDIA
一句话点评
NVIDIA 出了个 FOX 蓝图,教工厂怎么用 AI 智能体管生产。富士康照着做了套 MoMClaw 系统,号称故障根因分析快 80%,劳动效率提 15%,故障率降 10%。数字挺漂亮,但正文没披露在什么产线、多大规模、多少样本下测的,也没说部署成本。先打个折,别急着信。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K1·R1
05:00
57d ago
AI HOT 精选· aihot-apiZH05:00 · 06·01
台湾500家供应商开造Vera Rubin NVL72,台积电用cuLitho省了20%-50%成本
NVIDIA发了一篇台湾生态的进展:超过500家台湾合作伙伴正在生产Vera Rubin NVL72基础设施,这是下一代AI服务器系统。台积电用NVIDIA的cuLitho(计算光刻技术)把芯片制造环节的成本或周期缩短了20%-50%,数字挺实在。正文没披露具体哪些台湾厂商、订单金额或交付时间,所以这点先别太激动,但500家这个规模说明台湾供应链在AI...
#Vision#Robotics#Inference-opt#NVIDIA
一句话点评
NVIDIA 官宣台湾超 500 家伙伴在生产 Vera Rubin NVL72,台积电用 cuLitho(计算光刻)省了 20%-50% 成本或周期。数字挺实在,但正文没披露具体厂商、订单金额和交付时间,所以先别太激动。500 家这个规模说明台湾供应链在 AI 硬件里确实绕不开,但这是 NVIDIA 自家博客,得等第三方验证。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H0·K1·R1
05:00
57d ago
NVIDIA 博客· rssEN05:00 · 06·01
英伟达:台湾供应链已组装超100万套Vera Rubin MGX机架零件
英伟达发了一篇台湾生态系参与全球AI基础设施建设的博文,核心信息是:台湾有超过500家生态伙伴,在25个工厂里组装了超过100万套Vera Rubin MGX机架组件——这个数字说明下一代GPU集群的备货量已经不小了。富士康那边也给了几个数字:基于英伟达的制造智能体(让模型进工厂干活),根因分析时间缩短了80%,劳动生产率提高15%,机器故障率降低10...
#Agent#Robotics#Vision#NVIDIA
一句话点评
英伟达官宣台湾500+家伙伴在25个工厂组装了超100万套Vera Rubin MGX机架组件,说明下一代GPU集群备货量不小。富士康用英伟达制造智能体(让模型进工厂干活),根因分析时间缩短80%,劳动生产率提高15%,机器故障率降低10%。数字好看,但这是英伟达自家博客,效果数据未经第三方验证,且未披露部署规模和成本。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H0·K1·R1
04:52
57d ago
r/LocalLLaMA· rssEN04:52 · 06·01
瘫痪10年的数据科学家,3个月手搓了一个可视化ETL工具
Reddit用户card_chase在瘫痪后花了3个月独自开发了VibeETL,一个可视化ETL工具,底层用Polars(高性能DataFrame库)和React Flow(节点编辑器),Python子进程执行超时设为30秒,MIT开源。正文没披露具体性能对比或用户数,但30秒超时说明它主要面向轻量级数据流任务,不是给大数据量ETL用的。
#Code#Tools#Vision#VibeETL
一句话点评
瘫痪前数据科学家花3个月独立做了个可视化ETL工具VibeETL,底层用Polars(高性能DataFrame库)和React Flow,Python子进程超时30秒,MIT开源。30秒超时说明它只适合轻量数据流,不是给大数据量ETL用的。正文没披露性能对比或用户数,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
04:49
57d ago
AI HOT 精选· aihot-apiZH04:49 · 06·01
NVIDIA 开源 AlpaGym:让自动驾驶模型在模拟器里“边开边学”,弥补训练和实际部署的差距
NVIDIA 发布了 AlpaGym,一个用于自动驾驶模型后训练的强化学习框架。核心思路是:之前模型训练大多是“开环”的,只看模型输出和标准答案的差距,不看这个输出放到真实环境里会引发什么后果。AlpaGym 把模拟器 AlpaSim 的反馈直接连到训练循环里,让模型在模拟场景里“边开边学”,自己踩的坑自己记住。这样能暴露静态数据集里发现不了的错误累积...
#Robotics#Reasoning#NVIDIA#Research release
一句话点评
NVIDIA 把自动驾驶模型训练从“对答案”改成“进模拟器边开边学”,让模型自己踩坑自己改。关键是用 AlpaSim 模拟器做强化学习,模型每次刹车、转向的后果都反馈回训练循环,能暴露静态数据集里发现不了的错误累积。但正文没披露用了多少场景、跑了多少步、比开环训练提升多少,目前更像一个工具框架发布,效果验证还缺数据。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H0·K1·R0
04:43
57d ago
AI HOT 精选· aihot-apiZH04:43 · 06·01
英伟达开源 Cosmos 3:一个模型搞定物理世界的推理、预测和动作生成
英伟达开源了 Cosmos 3,一个面向机器人、自动驾驶和智能空间的物理 AI 基础模型。它用一个“双塔”架构把推理和生成合二为一:Reasoner 塔(视觉语言模型)先理解场景里的物体、运动等物理上下文,Generator 塔(扩散模型)再根据这个理解生成后续视频和动作序列。以前要串多个模型做的事,现在一个模型搞定,省了编排和推理管线的麻烦。目前提供...
#Reasoning#Robotics#NVIDIA#Product update
一句话点评
英伟达开源了 Cosmos 3,一个把物理世界理解、视频生成和动作规划塞进一个模型的“双塔”架构。以前要串多个模型,现在一个搞定,省了编排麻烦。目前提供 Nano 和 Super 两个版本,代码、权重和训练脚本都开源了。但正文没披露模型参数量、训练数据规模、推理延迟和定价,这些对评估实际部署成本很关键。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
04:35
57d ago
AI HOT 精选· aihot-apiZH04:35 · 06·01
Nemotron 3 Ultra 本周发布
NVIDIA AI 官方账号发了一条推文,说 Nemotron 3 Ultra 本周发布。正文只有这一句,没提模型参数量、上下文窗口、许可证、价格或发布渠道。目前能确认的只有发布时间窗口,其他信息等后续披露。
#NVIDIA#Product update
一句话点评
NVIDIA 官宣 Nemotron 3 Ultra 本周发,但推文就一句话,没提参数量、上下文窗口、许可证或价格。目前只能确认发布时间,其他全是空。短评:先别激动,等具体参数和开源情况。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
04:34
57d ago
r/LocalLLaMA· rssEN04:34 · 06·01
英伟达发布 Nemotron 3 Ultra,但正文啥都没说
英伟达宣布了 Nemotron 3 Ultra,但 Reddit 帖子只抓到了标题和一张图,正文被屏蔽了(返回 403 错误)。目前没有参数、发布时间、价格、跑分或模型能力任何信息。如果你想知道这模型有多大、能不能本地跑、比 Nemotron 2 强在哪,得等官方正式披露。
#NVIDIA#Product update
一句话点评
英伟达发了 Nemotron 3 Ultra,但 Reddit 帖子正文被屏蔽(403),目前只有标题和一张图。参数、跑分、发布时间、价格全没披露。如果你想知道这模型多大、能不能本地跑、比 Nemotron 2 强在哪,得等官方正式消息。目前信息缺口太大,建议先别激动。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
04:25
57d ago
● P1彭博科技· rssEN04:25 · 06·01
英伟达推出AI芯片进入Windows笔记本市场挑战英特尔
英伟达准备把它的 AI 芯片塞进 Windows 笔记本电脑里,不再只守着显卡和服务器。这步棋是想减少 PC 厂商对英特尔技术的依赖,但文章没公布这颗芯片的具体规格、价格、上市时间、性能跑分,也没说会有哪些笔记本品牌先用上。
#Nvidia#Intel#AMD#Product update
精选理由
精选 · 重要度 92 · 吸引力 + 共鸣
一句话点评
Nvidia 正式把 AI 芯片塞进 Windows 笔记本,直接抢 Intel 和 AMD 的饭碗,但性能、续航和软件适配都还没谱。
锐评
Nvidia 不再只卖显卡,开始做 PC 的中央处理器了。这颗芯片代号没公布,但目标是让 Windows 笔记本能本地跑大模型,跟苹果的 M 系列芯片思路类似。Bloomberg 和 FT 都确认了微软、戴尔、惠普会是首批合作方,TechCrunch 提到 Nvidia 盯上的是一个 2000 亿美元的市场。 不过现在能看到的都是战略层面的消息,芯片用了什么架构、几纳米工艺、功耗多少、跑分如何,正文全都没披露。FT 管它叫“超级芯片”,但没解释超级在哪。另外,Windows on Arm 的软件兼容性坑了高通好几年,Nvidia 怎么解决这个问题也没提。 我的判断是,Nvidia 进场对行业是好事,能逼 Intel 和 AMD 加快节奏。但第一代产品别抱太高期待,大概率是给开发者试水的,普通用户先观望。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K0·R1
04:01
57d ago
彭博科技· rssEN04:01 · 06·01
贝恩:企业投AI的钱,回报还没到账
贝恩咨询发报告说,很多公司砸钱搞AI,但预期的成本节省和收入增长根本没兑现。报告标题直接用了“AI Savings Misses”,意思是省钱的预期落空了,高管们应该感到不安。但正文没披露具体样本量、涉及多少金额、以及他们怎么算的“回报没到”,所以这个判断有多扎实,得打个问号。
#Bain#Bloomberg#Commentary
一句话点评
贝恩咨询发报告说,很多公司砸钱搞AI,但预期的成本节省和收入增长根本没兑现。报告标题直接用了“AI Savings Misses”,意思是省钱的预期落空了,高管们应该感到不安。但正文没披露具体样本量、涉及多少金额、以及他们怎么算的“回报没到”,所以这个判断有多扎实,得打个问号。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
04:00
57d ago
FT · 科技· rssEN04:00 · 06·01
年轻人开始觉得AI弊大于利
英国《金融时报》报道,虽然Z世代是AI使用率最高的群体,但他们也越来越担心AI会削弱就业前景和创造力。报道原文被付费墙挡住,具体调查数据、样本量和年龄段定义都没披露。
#Financial Times#Gen Z#Commentary
一句话点评
FT一篇付费报道说Z世代一边最常用AI,一边担心它毁就业和创造力。正文被墙,样本量、年龄段、具体数据全没披露,只能当观点看。核心矛盾是:用得越多越不信任,但报道没说是哪些场景让人幻灭——写作业、改简历还是做设计?缺一手数据,结论先打五折。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K0·R1
03:59
57d ago
AI HOT 精选· aihot-apiZH03:59 · 06·01
NVIDIA Vera CPU:专为AI智能体工作负载设计的服务器芯片
NVIDIA发了一篇博客,讲他们新出的Vera CPU怎么给AI智能体(就是那种会自己调用工具、跑代码、查资料的模型)提速。核心逻辑是:以前大家只盯着GPU,但智能体每干一步——比如编译代码、跑个Python脚本、查数据库——都得靠CPU执行,而且步骤越多,CPU就成了瓶颈。Vera CPU有88个自研核心,配1.2 TB/s的LPDDR5X内存带宽,...
#Agent#Inference-opt#NVIDIA#Product update
一句话点评
NVIDIA 发了一篇博客,说他们新出的 Vera CPU 专门给 AI 智能体(会自己调用工具、跑代码、查资料的那种模型)提速。核心逻辑是:以前大家只盯着 GPU,但智能体每干一步——比如编译代码、跑个 Python 脚本、查数据库——都得靠 CPU 执行,而且步骤越多,CPU 就成了瓶颈。Vera CPU 有 88 个自研核心,配 1.2 TB/s 的 LPDDR5X 内存带宽,官方说能...
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H0·K1·R0
03:54
57d ago
r/LocalLLaMA· rssEN03:54 · 06·01
10B以下小模型能干什么?Reddit用户晒出真实用例
一位Reddit用户在LocalLLaMA版块发帖,征集大家用10B以下小模型做的实用项目。有人用Qwen做OCR,把扫描的印度语PDF转成EPUB格式,相当于用本地模型替代付费的云OCR服务。另一个用户提到Gemma e4b在提示词超过1万token后依然能保持连贯,说明小模型的长上下文能力比预期好。帖子没有披露具体硬件配置、推理速度或准确率数据,所...
#Vision#Tools#Qwen#Gemma
一句话点评
Reddit 上有人用 Qwen 把印度语扫描 PDF 转成 EPUB,相当于用本地小模型替代付费云 OCR,省钱。Gemma e4b 在提示词超 1 万 token 后还能保持连贯,说明小模型长上下文比预期好。但帖子没披露硬件、推理速度或准确率,实际效果要打折。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R1
03:36
57d ago
AI HOT 精选· aihot-apiZH03:36 · 06·01
NVIDIA 把 AI 工厂的操作系统 DSX OS 开源了,目标是省电、快上线、少宕机
NVIDIA 正式发布了 DSX OS,这是一套专门给 AI 工厂(大规模跑推理和训练的算力集群)用的开源、模块化软件栈。它覆盖了从能源、芯片、基础设施到模型和应用五个层面,核心目标是让 AI 工厂更快投产、更省电、更稳定。正文提到,DSX OS 能把固定电力预算下能跑的 GPU 数量提升最多 40%,对推理性能影响很小——这对电费占大头的算力运营方来...
#Inference-opt#Tools#NVIDIA#Product update
一句话点评
NVIDIA 把 AI 工厂的软件栈开源了,叫 DSX OS,覆盖能源、芯片、基础设施、模型和应用五层。核心卖点:固定电力下 GPU 数量最多能提 40%,对推理性能影响很小——电费大头玩家可以算算账。但正文没披露版本号、定价和部署门槛,开源到什么程度、能不能直接上手跑还不清楚。先别太激动,等实测。
HKR 分解
hook knowledge resonance
打开信源
36
SCORE
H0·K1·R0
03:28
57d ago
彭博科技· rssEN03:28 · 06·01
LG 股价年内涨超 300%,靠的是“实体 AI”概念
彭博报道,LG 电子 2026 年股价涨了 3 倍多,原因是投资者看好它转向机器人等“实体 AI”(让 AI 控制物理设备)。但正文没披露任何实体 AI 的具体产品、收入或落地时间表,目前更多是市场在赌方向,不是业绩兑现。
#Robotics#LG Electronics#Commentary
一句话点评
LG 电子 2026 年股价涨超 300%,因为投资者赌它做“实体 AI”(让 AI 控制机器人等物理设备)。但正文没披露任何具体产品、收入或落地时间表,目前更多是市场在赌方向,不是业绩兑现。这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
63
SCORE
H1·K1·R0
03:25
57d ago
Product Hunt · AI· rssEN03:25 · 06·01
Mistral Vibe:一个能跑长流程任务和写代码的 AI 智能体
Mistral 在 Product Hunt 上发布了新智能体产品 Vibe,主打长时间、多步骤的工作流和编程任务,还配套推出了 VS Code 插件。产品本身免费,但正文没披露用了什么模型、参数多大、定价细节和具体上线时间。简单说就是让 AI 进业务流程干活,适合需要自动处理复杂任务的开发者先试试看。
#Agent#Code#Mistral#Product update
一句话点评
Mistral 出了个叫 Vibe 的智能体,主打长时间、多步骤的工作流和编程,还配了 VS Code 插件。产品免费,但正文没披露用了什么模型、参数多大、定价细节和具体上线时间。简单说就是让 AI 进业务流程干活,适合需要自动处理复杂任务的开发者先试试看。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H1·K0·R1
02:35
57d ago
Product Hunt · AI· rssEN02:35 · 06·01
Slashspace AI:一个画布优先的 AI 工具,专为长时间、复杂任务设计
Slashspace AI 今天在 Product Hunt 上线,主打“画布优先”的交互方式,适合需要持续跟进、多步骤的复杂工作。说白了就是给你一块大画布,AI 在上面帮你一步步推演、修改,而不是一问一答就完事。不过目前只放出了标题和一句介绍,具体用了什么模型、支持哪些功能(比如能不能联网、能不能上传文件)都没说,想判断它跟 Miro AI、Noti...
#Slashspace AI
一句话点评
Slashspace AI 今天在 Product Hunt 上线,主打“画布优先”交互——把多个 AI 对话节点放在一块画布上,让它们互相可见,适合做多步骤复杂任务。团队说跟 1600 个重度用户打磨了 1.5 年,自称“最成熟的画布 AI”。但正文没披露用了什么模型、是否支持联网或文件上传,也没提定价(只说有免费选项和 25% 折扣)。画布存成本地文件,隐私性不错,但协作和扩展能力未知。...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
02:28
57d ago
彭博科技· rssEN02:28 · 06·01
顶级科技基金计划买入 SK 海力士,押注存储芯片供应吃紧
一只业绩靠前的科技基金打算买入 SK 海力士股票,赌的是存储芯片供应会更紧张,这家韩国 AI 内存厂商还能继续涨。过去一年它的股价已经翻了 10 倍以上。正文没披露基金名称和具体买入规模。
#Memory#SK Hynix#Commentary
一句话点评
有只业绩靠前的科技基金打算买入SK海力士,赌存储芯片供应会更紧张。过去一年股价已翻10倍以上,现在追高风险不小。正文没披露基金名称和买入规模,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
02:26
57d ago
r/LocalLLaMA· rssEN02:26 · 06·01
Reddit 用户晒本地模型配置:单卡 3090 跑 Qwen3.6 27B,64k 上下文,想砍掉 200 美元 Claude 订阅
一位 Reddit 用户分享了自己的本地模型方案:一张 RTX 3090 跑 Qwen3.6 27B 的 Q5_K_M 量化版,上下文窗口开到 64k。他上个月用了 80-100 亿 token,按 API 价格算大概要花 5000-8000 美元,但本地跑只花电费。他目前还订阅了 200 美元/月的 Claude Max 计划,目标是把这个开销压到 ...
#Code#RAG#Tools#Anthropic
一句话点评
一张 RTX 3090 跑 Qwen3.6 27B 量化版,64k 上下文,一个月处理 80-100 亿 token,按 API 算要花 5000-8000 美元,本地只掏电费。用户还想把 200 美元/月的 Claude Max 压到 60 美元以下。正文被 Reddit 屏蔽,没披露具体 workflow 和工具链,但数字本身说明本地推理在重度使用场景下成本优势明显。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
02:20
57d ago
r/LocalLLaMA· rssEN02:20 · 06·01
让 LLM 直接输出 HTML,聊天回复变成互动页面
作者让 LLM 每次回复直接生成 HTML,然后塞进沙盒 iframe 里展示。双 RTX 3090 跑 Qwen3.6-27B,速度约 70 token/s,延迟不算低但能接受。好处是聊天不再只是文字,可以出按钮、图表、可交互内容。正文没披露具体怎么调 prompt 或微调,也没说沙盒安全性细节,这点先别太激动。
#Agent#Code#Tools#Qwen
一句话点评
让 LLM 每次回复直接生成 HTML 并塞进沙盒 iframe 展示,聊天不再只是文字,还能出按钮、图表。双 RTX 3090 跑 Qwen3.6-27B,速度约 70 token/s,延迟不算低但能接受。正文没披露具体怎么调 prompt 或微调,也没说沙盒安全性细节,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
02:16
57d ago
AI HOT 精选· aihot-apiZH02:16 · 06·01
上海发文支持多模态智能体,自动驾驶要在共享出行和物流里落地
上海市政府发了服务业“十五五”规划,明确要支持多模态智能体开发,推动智能客服、智能运营这些工具规模化用起来。自动驾驶方面,说要“有序推进”在共享出行、物流运输等场景的应用。规划还提了具身智能,让机器人进家庭、养老、文旅场景。不过正文没披露具体预算、时间表或落地目标,所以目前还只是方向性表态,不是执行方案。
#Agent#Multimodal#Robotics#Shanghai Municipal People's Government
一句话点评
上海发了服务业“十五五”规划,明确支持多模态智能体、智能驾驶和具身机器人。方向很全,但正文没披露预算、时间表或落地目标,目前只是方向性表态,不是执行方案。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
01:49
57d ago
r/LocalLLaMA· rssEN01:49 · 06·01
周末做了个Mandelbrot分形可视化MCP服务器
Reddit用户开源了一个叫openmandel的MCP服务器,专门用来生成Mandelbrot分形图。它提供了5组工具:渲染、预设区域、迭代和视口参数检查、调色板(支持自定义),还能生成静态HTML画廊。正文没披露具体性能数据或依赖模型,但作为MCP工具,它可以让AI直接调用生成分形图,适合做演示或教学辅助。
#Agent#Tools#Vision#Qwen
一句话点评
一个周末项目,把Mandelbrot分形图生成做成了MCP服务器,AI可以直接调用画图。提供了5组工具:渲染、预设区域、调参、调色板、生成HTML画廊。适合做演示或教学辅助,但正文没披露性能数据,也没说依赖什么模型,实际跑起来快不快、准不准得自己试。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K1·R0
01:23
57d ago
r/LocalLLaMA· rssEN01:23 · 06·01
MiniMax M3:百万上下文、能写代码、能看图的模型,但细节全没公开
Reddit 上有人发了 MiniMax M3 的帖子,标题说它支持 100 万 token 上下文、能写代码、能处理图片和文字,还适合让模型进业务流程干活(agentic)。但正文被 Reddit 屏蔽了,看不到参数、价格、是否开源、什么时候能用、以及跑分结果。目前能确认的只有这些功能标签,其他全是空白。
#Agent#Multimodal#Code#MiniMax
一句话点评
MiniMax M3 号称支持百万 token 上下文、多模态和 agent 能力,但 Reddit 帖子正文被屏蔽,参数、价格、跑分、开源状态全没披露。目前只能当个标题党看,别急着激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
00:15
57d ago
r/LocalLLaMA· rssEN00:15 · 06·01
MiniMax M3 模型已在 API 上线,但参数、价格和调用条件都还没公开
Reddit 用户发帖称 MiniMax M3 模型大约 15 分钟前出现在 API 上,帖子只附带了一张截图链接,没有披露模型参数量、定价或调用条件。目前能确认的就是模型名字叫 M3,其他信息一概未知。
#Inference-opt#MiniMax#Reddit#Product update
一句话点评
MiniMax 突然在 API 上放了个叫 M3 的新模型,Reddit 用户发现的,目前只有一张截图,没参数、没定价、没调用条件。正文被屏蔽了,连截图内容都看不到。信息缺口太大,没法判断是升级还是换皮,建议先观望。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
00:03
57d ago
Hacker News 首页· rssEN00:03 · 06·01
把 Karpathy 的 LLM Wiki 模式塞进 Obsidian,让 AI 帮你管笔记
这个开源项目 vault-operator 声称在 Obsidian 里实现了 Karpathy 提过的 LLM Wiki 模式——让 AI 当你的协作者,自动维护笔记库、适应你的工作流,还支持插件、技能和工具,自带安全控制,可以带自己的密钥(BYOK)和 MCP 协议。项目在 GitHub 上已有 122 颗星和 17 个 fork,但正文没披露具体...
#Agent#Tools#Memory#Karpathy
一句话点评
一个开源项目声称在 Obsidian 里实现了 Karpathy 提过的 LLM Wiki 模式——让 AI 自动维护笔记库、适应你的工作流,还支持插件、技能、工具、BYOK 和 MCP 协议。GitHub 上 122 颗星、17 个 fork,属于早期阶段。正文没披露具体实现细节,比如它怎么理解笔记结构、怎么保证不写乱。想法有意思,但先别太激动,等看到实际效果再说。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
00:01
57d ago
r/LocalLLaMA· rssEN00:01 · 06·01
别折腾内存不够的歪招了,直接上两块二手3090跑Qwen3.6-27B
一个Reddit用户实测,用两块二手RTX 3090跑Qwen3.6-27B,Q8量化、f16 K/V缓存、128k上下文,吞吐量达到1399 tokens/秒的预填充和104 tokens/秒的生成。结论是与其在内存不足时搞各种hack,不如直接买GPU,成本低效果稳。正文没披露具体功耗或散热情况。
#Inference-opt#Qwen#NVIDIA#MotokoAGI
一句话点评
两块二手RTX 3090跑Qwen3.6-27B,Q8量化下预填充1399 tokens/秒、生成104 tokens/秒,128k上下文。作者说与其折腾内存hack不如直接买GPU,成本低效果稳。但正文没披露功耗和散热,双卡3090的散热和电费可能是个隐藏成本。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
00:00
57d ago
Computing Life · Share · 鸭哥调研· rssZH00:00 · 06·01
共享 AI 链接成了没人管的内容托管平台,攻击者用它发恶意软件
攻击者利用 ChatGPT 和 Claude 的共享链接功能,在 chatgpt.com 域名下渲染钓鱼页面,诱导用户下载恶意软件。ChatGPT 版本只需用户点击一个假系统通知里的下载按钮,Claude 版本则让用户粘贴命令。攻击者不需要黑系统或注入提示,只需一个免费账号和 Google Ads 预算。Kaspersky 今年前五个月检测到超过 92...
#Safety#ChatGPT#Claude#Incident
一句话点评
攻击者用ChatGPT的代码渲染功能,在chatgpt.com域名下生成假系统通知页面,诱导用户下载恶意软件。Claude版本则伪装成安装指南让用户粘贴命令。Kaspersky今年前五个月检测到超9.2万次此类攻击。本质是AI平台的共享链接成了没人审核的内容托管平台,域名信任被滥用。防御上,OpenAI和Anthropic未回应,安全社区讨论也少。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
00:00
57d ago
AI HOT 精选· aihot-apiZH00:00 · 06·01
AI 看跌情绪地图:做空比例最高的是 GPU 云厂商,不是英伟达
风投 Tomasz Tunguz 统计了 AI 相关股票的做空比例(卖空股数/总流通股),发现市场对 AI 的怀疑集中在特定板块,不是全面看空。AI 云和 neocloud(GPU 算力租赁公司)的中位做空比例最高,达 16.8%,远高于 SaaS 的 9.5% 和开发者工具的 8.9%。做空比例最高的个股都是中小市值公司:SoundHound AI ...
#NVIDIA#Commentary
一句话点评
风投 Tomasz Tunguz 统计了 AI 相关股票的做空比例,发现市场对 AI 的怀疑集中在特定板块,不是全面看空。AI 云和 neocloud(GPU 算力租赁公司)的中位做空比例最高,达 16.8%,远高于 SaaS 的 9.5% 和开发者工具的 8.9%。做空比例最高的个股都是中小市值公司:SoundHound AI 36.3%、C3.ai 32.2%、BigBear.ai 29...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
00:00
57d ago
Computing Life · Share · 鸭哥调研· rssZH00:00 · 06·01
三个月周活翻三倍,我只付钱和圈选题,剩下全是AI在管
作者复盘了yage.ai从2月底到5月底的增长:周活从2500涨到7000,Twitter关注从170涨到4800,Newsletter订阅从300涨到1200。他自称只做了四件事:付钱(每月不到50美元)、逆向了一个X的API、每天花两分钟圈选题、偶尔校准分析方向。其余全部由AI自动完成:每日Newsletter自动抓取摘要并发送、Twitter全自...
#Agent#Commentary
一句话点评
作者用AI管了三个月网站增长,周活从2500涨到7000,Twitter从170涨到4800,每月成本不到50美元。核心是AI自动写Newsletter、发Twitter、做归因和SEO,作者只负责每天圈选题和偶尔校准方向。亮点是AI自己从数据里发现表单弹出时机问题并优化,还逆向X的API做单帖分析。但正文没披露AI具体用的什么模型和工具链,成本明细也只说了不到50美元,可复制性存疑。短评:...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
00:00
57d ago
AI HOT 精选· aihot-apiZH00:00 · 06·01
xAI 发布 Composer 2.5,一个主打“跑长任务、跟复杂指令”的编程模型
xAI 在 Grok Build 里上线了 Composer 2.5,入口在 /models 菜单里选。官方说它“快、先进、擅长长时间任务和复杂指令”,但正文没披露上下文窗口、跑分结果和定价。目前只对 SuperGrok 和 X Premium+ 用户开放,所以普通用户暂时用不了。如果你已经在用 Grok Build,可以敲 /model 切过去试试,...
#Code#xAI#Product update
一句话点评
xAI 发了 Composer 2.5,说是快、擅长长任务和复杂指令,但正文没披露上下文窗口、跑分和定价。目前只对 SuperGrok 和 X Premium+ 用户开放,普通用户用不了。如果你已经在用 Grok Build,可以敲 /model 切过去试试。 短评:xAI 发了个新编程模型,但关键参数全没给,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H0·K1·R0

更多

频道

后台