ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-11

50 items · updated 3m ago
RSS live
2026-05-11 · 星期一2026年5月11日
23:18
77d ago
AI HOT 精选· aihot-apiZH23:18 · 05·11
AWS 发了一篇长文,讲怎么搭大模型训练和推理的基础设施
AWS 在 Hugging Face 上发了一篇博客,把大模型从训练到推理需要的基础设施拆成三层:计算(H100、H200、Blackwell B200/B300 这些 GPU 实例)、网络(NVLink 和 EFA)、存储(分布式共享存储)。上层用 Slurm 或 Kubernetes 管资源,再往上跑 PyTorch、JAX 这些框架,监控用 Pr...
#Inference-opt#AWS#NVIDIA#Hugging Face
一句话点评
AWS 把大模型从训练到推理所需的基础设施拆成三层:计算(H100/H200/B200/B300 GPU)、网络(NVLink+EFA)、存储(分布式共享),上层用 Slurm 或 K8s 管资源,再跑 PyTorch/JAX。说白了就是一份 AWS 云上搭模型工厂的硬件选型清单,适合正在选云方案的人快速对齐。但全文基本是产品介绍,没给任何实测数据或成本对比,比如 H200 比 H100 快...
HKR 分解
hook knowledge resonance
打开信源
35
SCORE
H0·K1·R0
23:10
77d ago
AI HOT 精选· aihot-apiZH23:10 · 05·11
纳德拉出庭反击马斯克:你有我手机号,从没抱怨过微软与OpenAI的合作
微软CEO纳德拉在马斯克诉OpenAI案中作证,核心反驳两点:一是马斯克2016年曾发邮件感谢微软给OpenAI提供折扣算力,微软当时甚至亏了1500万美元(约1.02亿人民币);二是马斯克有纳德拉手机号,但直到2024年起诉前,从未对双方合作表达过不满。纳德拉还评价2023年奥尔特曼被董事会短暂解雇是“业余之举”,称自己当时出面稳住局面是为了防止员工...
#Safety#Satya Nadella#Elon Musk#OpenAI
一句话点评
纳德拉出庭甩出2016年马斯克感谢邮件,证明他当年支持微软给OpenAI打折算力,微软甚至亏了1500万美元。关键点是马斯克有纳德拉手机号,但直到2024年起诉前从未抱怨过合作。纳德拉还吐槽2023年奥尔特曼被董事会短暂解雇是“业余之举”。这案子核心是马斯克想证明OpenAI背弃非营利承诺,但纳德拉的证词直接打脸他“早不反对、现在才告”。正文没披露陪审团倾向,但微软和OpenAI的防守逻辑很...
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
22:19
77d ago
● P1The Verge · AI· rssEN22:19 · 05·11
Mira Murati 的 Thinking Machines 展示交互式 AI 模型实时处理音视频文字
Thinking Machines 周一公布了他们的方向——做“交互模型”。按他们的说法,这种模型能同时接收音频、视频和文字,实时理解、回应并行动,而不是像现在的模型那样等你打完字或说完话才开始反应。正文没披露模型规模、发布时间、定价和最终产品形态,所以这东西到底多能打、什么时候能用上,现在都还是未知数。
#Agent#Multimodal#Audio#Thinking Machines
精选理由
精选 · 重要度 87 · 吸引力 + 知识量 + 共鸣
一句话点评
Mira Murati 的新公司 Thinking Machines 亮出了第一个产品方向:一个能同时看、听、读文字的交互模型。但两家报道都没给具体数据和实测效果,先当概念展示看。
锐评
Mira Murati 离开 OpenAI 后创立的 Thinking Machines 终于有了动静。他们展示了一个能实时处理音频、视频和文字的多模态交互模型,目标是让 AI 在对话中真正“边听边想”,而不是等你说完再反应。这个方向本身不新,但由 Murati 带队,行业关注度自然高。 目前的信息都来自 The Verge 和 TechCrunch 的简短报道,正文没有披露模型规模、训练数据、延迟指标或任何基准测试结果。TechCrunch 的标题强调“边说话边听”,但文章里也没给出具体的技术实现细节。两家媒体都只发了快讯,没有深度评测。 我会先打个折:概念听起来实用,但没看到实测之前,没法判断这是真突破还是包装过的多模态流水线。还缺的东西很多——模型参数量、推理成本、是否开源、有没有第三方对比测试,这些才是决定它能不能落地的关键。
HKR 分解
hook knowledge resonance
打开信源
87
SCORE
H1·K1·R1
21:04
77d ago
Hacker News 首页· rssEN21:04 · 05·11
我用AI搭了个工具,找出半夜吵醒我的元凶
作者住在嘈杂的城市,经常半夜被吵醒却不知道原因。他用一个周末(约8小时)让AI帮忙搭了一套工具:树莓派+两个USB麦克风,只在睡觉时录音,结合Garmin手表睡眠数据和Home Assistant传感器事件,生成一个像音乐编辑器的可视化界面。AI没用来识别声音(还是自己戴耳机听),但把搭建成本从“懒得搞”降到了“周末搞定”。结果发现吵醒他的主要是邻居关...
#Code#Tools#Commentary
一句话点评
作者用树莓派+两个USB麦克风,只在睡觉时录音,结合Garmin手表睡眠数据和Home Assistant传感器事件,生成一个像音乐编辑器的可视化界面。AI没用来识别声音(还是自己戴耳机听),但把搭建成本从“懒得搞”降到了“周末搞定”。结果发现吵醒他的主要是邻居关门和街上卡车。 短评:AI没帮你听声音,但帮你省了8小时搭工具,值了。 点评:核心价值不在AI识别能力,而在AI降低了个人工具...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R1
20:56
77d ago
FT · 科技· rssEN20:56 · 05·11
纳德拉:OpenAI 2023年罢免奥特曼那事,干得太业余了
微软CEO萨提亚·纳德拉在马斯克诉OpenAI案中作证,称OpenAI董事会2023年试图罢免山姆·奥特曼的操作是“业余水平”。他解释了当时为何力挺奥特曼,但正文未披露证词全文、具体法律主张或微软内部的决策过程。
#Satya Nadella#OpenAI#Elon Musk#Incident
一句话点评
纳德拉在马斯克诉OpenAI案中作证,称2023年OpenAI董事会试图罢免奥特曼的操作是“业余水平”。他解释了微软当时为何力挺奥特曼,但正文被FT付费墙挡住,看不到证词全文、具体法律主张或微软内部决策过程。短评:纳德拉公开吐槽OpenAI董事会“业余”,但关键细节都在付费墙后,目前只能看个标题。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
20:54
77d ago
AI HOT 精选· aihot-apiZH20:54 · 05·11
Luma Agents:扔几张参考图,自动生成一条完整广告
Luma Labs 发了个新工具 Luma Agents,说只要上传参考素材、定个创意方向,就能自动从情绪板变成一条完整广告。正文没披露生成耗时、模型细节、可控参数和定价,所以实际效果和成本都还不清楚。如果真能一步到位,对做素材的团队来说省不少事,但先别太激动,等实测。
#Agent#Multimodal#Tools#Luma Labs
一句话点评
Luma Labs 说新工具 Luma Agents 能拿参考素材和创意方向,自动从情绪板生成一条完整广告。正文没披露生成耗时、模型细节、可控参数和定价,所以实际效果和成本都不清楚。如果真能一步到位,对做素材的团队来说省不少事,但先别太激动,等实测。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
20:49
77d ago
r/LocalLLaMA· rssEN20:49 · 05·11
48GB显存跑50万token上下文,写代码每秒21个token
Reddit用户发帖称,用双TITAN RTX显卡(共48GB显存)跑Nemotron-3-Super-64B-A12B-Math-REAP-GGUF模型,实现了50万token的上下文窗口,写代码速度约21 token/秒。50万token大概能塞进三本《三体》的体量,21 tok/s在本地推理里算中等偏快。但帖子正文被屏蔽,没披露用了什么量化精度、...
#Code#Inference-opt#Reddit#Hugging Face
一句话点评
50万token上下文在48GB显存上跑出21 tok/s,这个数字挺亮眼——相当于三本《三体》塞进本地模型,写代码速度也够用。但帖子正文被屏蔽,没披露量化精度、具体prompt和可复现条件,所以这个成绩要打个问号。如果是真的,对长上下文本地部署是个好消息,但先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
20:26
77d ago
Hacker News 首页· rssEN20:26 · 05·11
E2a:给AI智能体配一个开源邮箱网关
Mnexa-AI 开源了一个叫 E2a 的工具,作用是让 AI 智能体(比如自动客服、邮件助手)能收发邮件。它做了几件事:自动把同一话题的邮件归到一个线程里,发出的邮件可以让人先审核一遍,几分钟就能配好一个邮箱地址,还支持 WebSocket 或至少送达一次的 webhook 推送。不过项目刚起步,DMARC 防伪造、多区域部署、应用层加密、SOC 2...
#Agent#Tools#Mnexa-AI#E2a
一句话点评
Mnexa-AI 开源了 E2a,一个让 AI 智能体收发邮件的网关。它自动把同一话题的邮件归入一个线程,发出的邮件可以让人先审核,几分钟就能配好邮箱,还支持 WebSocket 或至少送达一次的 webhook 推送。不过项目刚起步,DMARC 防伪造、多区域部署、应用层加密、SOC 2 等安全认证都还没做。 短评:给 AI 加个邮箱接口,开源、能审、能推,但安全合规还差得远。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
20:23
77d ago
Hacker News 首页· rssEN20:23 · 05·11
高中生开源了 Google Antigravity 的纯 JS 克隆版,零安装、自带终端和侧边栏 agent
一个高中生开发者用纯 HTML/CSS/JS 复刻了 Google Antigravity 的界面,项目叫 OpenGravity,目前是 alpha 阶段。亮点是零安装——靠 WebContainer API 和 xterm.js 在浏览器里跑了一个终端,能直接同步本地文件系统,侧边栏还有个 agent 可以执行命令和编辑文件。BYOK 模式意味着你...
#Agent#Code#Tools#OpenGravity
一句话点评
一个高中生用纯前端技术复刻了 Google Antigravity 的界面,亮点是零安装——靠 WebContainer API 在浏览器里跑终端,还能同步本地文件。BYOK 模式把 API key 存 localStorage,安全性自己掂量。目前才 13 个 HN 点赞,alpha 阶段,别当生产工具用。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
20:16
77d ago
Product Hunt · AI· rssEN20:16 · 05·11
Whisper Island:把语音转文字塞进 Mac 刘海
Coddo 新发了一个 Mac 小工具 Whisper Island,核心功能是语音转文字并直接粘贴到当前激活的 App(Slack、Notion、IDE 等)。界面藏在 MacBook 刘海或悬浮胶囊里,不占屏幕。用的是 OpenAI Whisper 模型,支持多语言。需要 Coddo 账号登录,和 Coddo 共享配额。免费,但正文没披露具体配额限...
#Audio#Coddo#Product Hunt#Product update
一句话点评
把语音转文字塞进MacBook刘海,不占屏幕,直接粘贴到当前App。免费但没披露配额限制,如果是重度用户可能很快用完。用OpenAI Whisper,延迟和离线支持都没提,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
19:51
77d ago
AI HOT 精选· aihot-apiZH19:51 · 05·11
OpenAI 给开发者加了 Codex 插件,写 AI 应用和智能体能快一点
OpenAI 在开发者工具里塞了个 Codex 插件,说能帮你更快地搭 AI 应用和智能体。但正文没披露具体快多少、有没有版本号、要不要额外付费——目前只能当个功能预告看,别急着升级。
#Agent#Code#Tools#OpenAI
一句话点评
OpenAI 给开发者工具加了个 Codex 插件,号称能加速搭 AI 应用和智能体。但正文没披露具体快多少、要不要额外付费、有没有版本号——目前只能当个功能预告看,别急着升级。短评:OpenAI 画了个 Codex 插件的饼,说能加速开发,但没给数据、价格和版本号,先观望。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R1
19:13
77d ago
彭博科技· rssEN19:13 · 05·11
Rezolve AI CEO 公开批评 Commerce.com 增长“丢人”,发起敌意收购
Rezolve AI 的 CEO Dan Wagner 在 Bloomberg 采访中直接开火,说 Commerce.com 的增长速度“令人尴尬”,并确认公司已发起敌意收购。正文没披露收购金额、股权结构、持股门槛和交易时间表,所以目前只能看个态度。Wagner 的潜台词是:你们自己做得太慢,不如我们来。对 AI 从业者来说,这更像一个商业资本动作,跟...
#Rezolve AI#Dan Wagner#Commerce.com#Funding
一句话点评
Rezolve AI CEO 公开批评 Commerce.com 增长“令人尴尬”,并确认已发起敌意收购。正文没披露收购金额、股权结构或时间表,目前只能看个态度。对 AI 从业者来说,这更像一个商业资本动作,跟技术关系不大。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R0
18:57
78d ago
r/LocalLLaMA· rssEN18:57 · 05·11
Qwen-3.6-27B 在 Codex 里跑着跑着就停了?
有用户在 Reddit 反映,把 4-bit 量化后的 Qwen-3.6-27B 放进 Codex 测试框架并开启思考模式后,任务经常卡在“我要用这个工具”这类中间消息上,没法正常跑完。正文没披露日志、报错码或最小复现步骤,所以目前只能确认现象,没法判断是模型本身不稳定、量化精度损失还是 Codex 的兼容问题。如果你也在用这个组合,建议先关掉 thi...
#Agent#Code#Tools#Qwen
一句话点评
有用户反映4-bit量化的Qwen-3.6-27B在Codex测试框架里开思考模式会卡在中间消息上跑不完。正文没贴日志或报错码,所以目前只能确认现象,没法判断是模型不稳、量化精度损失还是Codex兼容问题。如果你也在用这个组合,建议先关掉thinking模式试试。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H0·K1·R1
18:54
78d ago
AI HOT 精选· aihot-apiZH18:54 · 05·11
Anthropic 估值五天涨了 2000 亿美元,年收入从 1 亿跳到 450 亿
Anthropic 的市场隐含估值五天从 1.2 万亿涨到 1.4 万亿美元,暴增 2000 亿。链上 Pre-IPO 数据显示,其年化收入从 2023 年的 1 亿美元飙到现在的 450 亿,一年翻了 14 倍。估值自 2025 年 10 月已涨 1067%,最近 24 天又涨 40%。这些数字来自 Jupiter 等链上平台交易的 Pre-IPO ...
#Anthropic#Jupiter#Funding
一句话点评
Anthropic五天估值涨2000亿美元,从1.2万亿跳到1.4万亿。链上Pre-IPO数据说年收入从2023年1亿飙到450亿,一年翻14倍。但这是链上交易工具反映的隐含估值,不是官方数字,流动性差、样本少,实际IPO定价可能打折。正文没披露450亿收入是确认收入还是合同额,也没说利润。如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
18:43
78d ago
AI HOT 精选· aihot-apiZH18:43 · 05·11
Claude Code 小版本更新,具体改了啥没写
Anthropic 在 GitHub 上发布了 Claude Code v2.1.139,仓库目前有 12.3 万星标和 2.02 万 fork,热度很高。但这次版本的发布说明正文是空的,没有披露任何改动内容、修复或新功能。如果你想知道具体更新了什么,得去翻 commit 记录或者等后续补充。
#Code#Anthropic#GitHub#Claude Code
一句话点评
Anthropic 发了 Claude Code v2.1.139,仓库 12.3 万星标热度很高,但发布说明正文是空的,没写任何改动。想确认修了什么 bug 或加了什么功能,得自己去翻 commit 记录。
HKR 分解
hook knowledge resonance
打开信源
34
SCORE
H0·K0·R0
18:20
78d ago
彭博科技· rssEN18:20 · 05·11
Circle CEO:利率只是稳定币增长的一个因素
Circle CEO 说 AI agent 正在接近能实际做金融交易,同时公司一季度收入涨了 20%,但因为加密货币市场波动,净利润反而下降了。正文没披露具体净利润数字和 AI agent 交易落地的技术细节,这点先别太激动。
#Agent#Circle#Jeremy Allaire#Bloomberg
一句话点评
Circle CEO 说 AI agent 快能实际做金融交易了,但正文没披露任何技术细节或落地案例,这点先别太激动。公司一季度收入涨了20%,净利润反而下降,说明加密货币市场波动对稳定币发行商的影响不小。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
18:06
78d ago
AI HOT 精选· aihot-apiZH18:06 · 05·11
MiniMax 周三在旧金山办模型开发者活动,到场送 30 美元 API 额度
MiniMax 联合 Vercel、Anthropic 和 Moonshot 在旧金山办线下活动,时间是美国太平洋时间 5 月 13 日下午 5:30。每位参与者能拿到 30 美元 API 积分,还有额外抽奖池。活动本身是开发者交流性质,不是产品发布,正文没披露具体议程或嘉宾名单。
#Tools#MiniMax#Vercel#Anthropic
一句话点评
MiniMax 联合 Vercel、Anthropic 和 Moonshot 在旧金山办线下开发者活动,每人送 30 美元 API 积分,还有抽奖池。活动是交流性质,不是产品发布,正文没披露具体议程或嘉宾名单。短评:送 30 美元 API 积分算实在,但议程和嘉宾都没说,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H0·K0·R0
17:30
78d ago
AI HOT 精选· aihot-apiZH17:30 · 05·11
PixVerse 用 GPT Image 2 生成了一组时尚大片,8 张图拼成杂志内页
有用户晒出一组 2×4 的时尚编辑图,每张都是男模穿街头潮牌、拿滑板或吉他,背景是纯色或渐变,打光柔和、皮肤逼真,没有文字和 logo。这组图是用 GPT Image 2 在 PixVerse 上生成的,走的是奢侈品广告风。正文没披露生成耗时和成本,但效果看起来已经接近商业摄影了。
#Vision#Multimodal#PixVerse#GPT Image 2
一句话点评
GPT Image 2 在 PixVerse 上生成的 2×4 时尚编辑图,8 张男模街拍,打光柔和、皮肤逼真,接近商业摄影。但正文没披露生成耗时和成本,也没说是否一次出图还是多次抽卡。效果看着不错,但离真正替代摄影棚还有距离——单张图可以,要保证 8 张风格、光影、肤色一致,目前看只是单图展示。如果是真的挺省钱,但得等实测。
HKR 分解
hook knowledge resonance
打开信源
32
SCORE
H0·K0·R0
17:29
78d ago
r/LocalLLaMA· rssEN17:29 · 05·11
PowerColor 发了个 32GB 显存的 AI 显卡,单槽被动散热
PowerColor 推出了 Radeon AI PRO R9600D,配备 32GB GDDR6 显存,单槽被动散热设计,用 12V-2x6 供电接口。32GB 显存能跑不少本地大模型,但正文没披露功耗、价格和上市时间,也没跑分数据。被动散热意味着风扇都没有,适合塞进服务器机柜,但家用得自己保证风道。
#Inference-opt#PowerColor#Radeon#Product update
一句话点评
PowerColor 出了一张 32GB 显存的单槽被动散热显卡 R9600D,专为本地跑大模型设计。32GB 显存能塞下 70B 模型量化版,单槽被动散热意味着没风扇,适合塞机柜,家用得自己搞风道。但正文没披露功耗、价格和上市时间,也没跑分,实际推理速度未知。如果是真的,这卡比 RTX 4090 便宜不少,但被动散热和未知功耗让人犹豫。短评:32GB 显存挺香,但没功耗和价格,先别激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
17:10
78d ago
r/LocalLLaMA· rssEN17:10 · 05·11
Gemma 4 在浏览器里完全离线跑,还能用 WebSerial 控制机器人
有人在 Reddit 上晒了段演示:用 Transformers.js 在 WebGPU 上完全离线运行 Gemma 4,并通过 WebSerial 控制 Reachy Mini 机器人。正文没披露模型大小、延迟、浏览器或硬件条件,所以实际跑起来有多流畅、占多少显存都不清楚。亮点是“完全离线+控制外设”这个组合,说明浏览器端推理已经能接真实硬件了,但性...
#Robotics#Tools#Inference-opt#Gemma
一句话点评
有人在浏览器里完全离线跑 Gemma 4,还通过 WebSerial 连上了 Reachy Mini 机器人。亮点是“浏览器推理+控制真实硬件”这个组合,说明前端推理已经能接外设了。但正文没披露模型大小、延迟、浏览器或硬件条件,所以实际跑起来有多流畅、占多少显存都不清楚。如果是小模型,那演示意义大于实用;如果是大模型,那 WebGPU 优化可能有点东西。短评:浏览器跑模型不新鲜,但能离线控制...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
17:02
78d ago
TechCrunch AI· rssEN17:02 · 05·11
Digg 又活过来了,这次改做 AI 新闻聚合器
Digg 在三月刚关停过一次,原因是没管住机器人刷帖,也没跟 Reddit 拉开差距。现在它给内测用户发邮件说,新版会用 AI 追踪某个领域里最有影响力的声音,把真正值得看的新闻挑出来。正文没披露用了什么模型、什么时候上线、怎么收费,所以这点先别太激动。
#Digg#Product update
一句话点评
短评:老牌聚合站 Digg 又活了,这次说用 AI 挑新闻。但模型、上线时间、收费全没提,先别激动。 点评:Digg 三月刚关停,原因是机器人刷帖和跟 Reddit 没拉开差距。现在给内测用户发邮件说新版会用 AI 追踪某个领域里最有影响力的声音,把真正值得看的新闻挑出来。想法不新鲜,很多 AI 新闻产品都在做类似的事。关键信息缺口很大:用了什么模型、什么时候上线、怎么收费,正文都没披露。...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
16:44
78d ago
r/LocalLLaMA· rssEN16:44 · 05·11
Orc:把AI工作流写成可审计的声明式配置文件
Typhoonsg1 在做一个叫 ORC 的开源项目,核心是用 .orc 文件定义 LLM 工作流,把 agent、工具、数据 schema、执行步骤、验证规则和输出产物全写在一个配置文件里。好处是流程可审计、可复现,不像写代码调 chain 那样黑盒。目前项目还很早期,代码没公开,正文也没披露性能数据或跟 LangChain、Dify 的对比。
#Agent#Tools#Typhoonsg1#Ollama
一句话点评
Typhoonsg1 在 Reddit 上预告了一个叫 ORC 的开源项目,核心是用 .orc 配置文件把 agent、工具、数据 schema、执行步骤、验证规则和输出产物全写在一起,让 LLM 工作流可审计、可复现,不像调 LangChain 那样黑盒。目前项目还很早期,代码没公开,正文也没披露性能数据或跟 Dify 的对比。想法不错,但缺实测,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K1·R0
16:44
78d ago
Product Hunt · AI· rssEN16:44 · 05·11
Crade AI:一个能看见你屏幕的 ChatGPT
Crade AI 是一款桌面 AI 助手,支持 Mac 和 Windows,核心卖点是它能直接“看见”你的屏幕,不用截图、复制粘贴或上传文件。你遇到 bug、Excel 公式、看不懂的德文发票或报错信息,直接问就行,答案会浮窗显示在当前窗口上方。免费版每天 200 次额度,Pro 版每月 7.99 美元(约 57 元人民币)给 1000 次额度,复杂任...
#Vision#Crade AI#ChatGPT#Product update
一句话点评
Crade AI 是个桌面助手,能直接“看”你屏幕,不用截图或复制粘贴,问 bug、Excel 公式、德文发票直接浮窗回答。免费版每天 200 次,Pro 每月 7.99 美元(约 57 元)给 1000 次。听起来方便,但正文没披露它怎么获取屏幕内容——是录屏、截图还是 API 权限?隐私和安全性存疑。另外“复杂任务用更聪明 AI”没说具体模型,免费额度够轻量用,重度用户成本不高。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R0
16:04
78d ago
r/LocalLLaMA· rssEN16:04 · 05·11
4张RTX 5060 Ti组本地推理,能打过两张RTX 3090吗?
Reddit用户ziphnor想组一套4张RTX 5060 Ti的本地推理机,跑Qwen 3.6 27B的int8/fp8模型,问跟双RTX 3090比怎么样。每张5060 Ti有16GB显存,4张一共64GB,比双3090的48GB多。价格方面,两张打折的5060 Ti大概960欧元,比双3090便宜。但问题是PCIe通道分配:一张走x8,另外三张只...
#Inference-opt#NVIDIA#Qwen#ziphnor
一句话点评
Reddit 用户 ziphnor 想用 4 张 RTX 5060 Ti(每张 16GB,共 64GB)跑 Qwen 3.6 27B 的 int8/fp8 模型,比双 RTX 3090(48GB)显存多 16GB,价格也更低(两张打折约 960 欧元)。但 PCIe 通道分配是硬伤:一张走 x8,另外三张只能走 x4,多卡通信带宽严重受限,大模型推理延迟可能比双 3090 还高。正文没披露具...
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R1
16:03
78d ago
AI HOT 精选· aihot-apiZH16:03 · 05·11
谷歌DeepMind和Coursera合开Gemini开发者课,教你把模型接进业务流程
这门课分三块:一是让模型能推理并执行复杂任务(不只是聊天),二是通过函数调用把Gemini连上真实工具(比如数据库、API),三是教你怎么部署和测试可扩展的AI系统。课程已开放注册,但正文没披露价格和时长。适合想用Gemini做生产级应用的开发者,不是入门科普。
#Agent#Tools#Google DeepMind#Coursera
一句话点评
谷歌DeepMind和Coursera出了门Gemini开发课,分三块:让模型能推理干活、用函数调用连数据库和API、以及部署可扩展系统。适合想拿Gemini做生产级应用的开发者,不是入门科普。但正文没披露价格和时长,注册前得自己掂量。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K1·R0
16:03
78d ago
AI HOT 精选· aihot-apiZH16:03 · 05·11
Claude 在 AWS 上全线开放,用 AWS 账号就能调 API
Claude 现在 AWS 上全面可用,AWS 客户可以直接用 AWS 的身份验证、计费和承诺金抵扣来调用全套 Claude API。正文没披露定价、上线区域和具体时间表。
#Tools#Claude#AWS#Product update
一句话点评
Claude 在 AWS 上全面可用,AWS 客户可直接用自家身份验证、计费和承诺金抵扣来调用全套 API。这对已有 AWS 合同的企业很友好,省去单独签约和付费的麻烦。但正文没披露定价、上线区域和具体时间表,实际可用性要打问号。如果是真的,能降低企业接入门槛,但别急着冲。
HKR 分解
hook knowledge resonance
打开信源
38
SCORE
H0·K1·R1
15:53
78d ago
Hacker News 首页· rssEN15:53 · 05·11
UCF 人文学院毕业生对毕业演讲嘉宾喝倒彩,只因她说 AI 是“下一次工业革命”
中佛罗里达大学人文与传播学院的毕业典礼上,演讲嘉宾 Gloria Caulfield 刚说出“AI 是下一次工业革命”,台下数千名毕业生就发出嘘声,还有人喊“AI 烂透了”。演讲者本人似乎没预料到这个反应,转身摊手问“怎么了”。正文没有披露 Caulfield 的具体职务背景,也没说她之后怎么圆场的。这件事本身不是技术新闻,但能看出 AI 在普通文科生...
#404 Media#UCF#Hacker News#Commentary
一句话点评
中佛罗里达大学人文学院毕业典礼上,演讲嘉宾刚说“AI是下一次工业革命”,台下数千毕业生就嘘声一片,还有人喊“AI烂透了”。演讲者转身摊手问“怎么了”。正文没披露她之后怎么圆场,也没说她的具体背景。这事不是技术新闻,但能看出AI在普通文科生中的口碑——至少在这个场合,情绪是抵触的。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K0·R1
15:51
78d ago
r/LocalLLaMA· rssEN15:51 · 05·11
用户对比Strix Halo与DGX Spark家庭本地大模型服务器方案
一个 Reddit 用户在纠结:花 3388 美元买 AMD Strix Halo 的 Framework 台式机,还是花 3500 美元买 Nvidia DGX Spark(华硕版),用来在家跑大模型。目标是在 Ubuntu 上搭 Open WebUI,跑 Qwen 3.6 35B A3B 和 GPT OSS 120B 这类模型,量化到 Q4_K_M...
#Inference-opt#Tools#Vision#AMD
一句话点评
用户拿AMD Strix Halo和NVIDIA DGX Spark比谁更适合在家跑大模型。Strix Halo是APU,显存共享系统内存,成本低但带宽受限;DGX Spark是NVIDIA的桌面AI盒子,有专用显存和CUDA生态,但贵。正文被Reddit屏蔽,没看到具体配置和跑分。关键缺口:没披露模型规模、推理速度、功耗和价格。如果只是跑7B以下模型,Strix Halo性价比可能更高;要...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
15:39
78d ago
彭博科技· rssEN15:39 · 05·11
贝莱德CIO:AI不是泡沫,但短期通胀和地缘风险会先来
贝莱德全球固定收益CIO Mike Pyle在彭博访谈中表示,AI不是泡沫,短期会推高通胀(因为企业大量投资硬件和基建),长期才会带来生产率提升。他还说传统的60/40股债组合已经失效,投资者需要重新配置。另外提到伊朗、石油供应和霍尔木兹海峡的地缘风险是当前最大的经济不确定性。访谈是视频形式,正文没有给出具体数据或模型细节。
#BlackRock#Mike Pyle#Bloomberg#Commentary
一句话点评
贝莱德CIO说AI不是泡沫,短期推高通胀,长期才提生产率。传统60/40股债组合已失效,需重新配置。地缘风险(伊朗、霍尔木兹海峡)是最大不确定性。视频访谈,无具体数据或模型细节,观点仅供参考。
HKR 分解
hook knowledge resonance
打开信源
52
SCORE
H0·K0·R1
15:30
78d ago
AI HOT 精选· aihot-apiZH15:30 · 05·11
MiniMax组了个“10x团队”,请行业专家来教模型干活
MiniMax 宣布成立“10x团队”,邀请各领域专家直接参与模型研发——不是当顾问,而是亲自定义问题、搭评估、设计工作流,成果会开源。团队目标是把大模型从“能演示”推到“真能用”。提供上海、北京、香港、旧金山、伦敦五个办公地,薪酬含股权。但正文没披露团队规模、招聘人数和薪资范围,实际落地节奏还不清楚。
#Benchmarking#Tools#MiniMax#Personnel
一句话点评
MiniMax 搞了个“10x团队”,直接拉行业专家进研发一线,不是挂名顾问,而是亲自定问题、搭评估、设计工作流,成果还开源。目标是把模型从“能演示”推到“真能用”,听着挺实在。但正文没披露团队规模、招聘人数和薪资范围,实际落地节奏还不清楚。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K1·R0
15:09
78d ago
Hacker News 首页· rssEN15:09 · 05·11
BotCost.dev:免费工具算算 AI 爬虫吃了你多少带宽费
一个免费工具,上传 Nginx、Cloudflare 等日志,就能算出 GPTBot、ClaudeBot 等 18 种 AI 爬虫占了多少带宽、折合多少钱。页面宣称典型月访客 5 万的站点,AI 爬虫每月能吃掉 180 美元带宽费;验证延迟不到 10 毫秒,跑在 Cloudflare 边缘节点上,不影响真实用户。工具在浏览器本地处理日志,不上传。最后还...
#Botcost.dev#Hacker News#Product update
一句话点评
一个免费工具,上传 Nginx 或 Cloudflare 日志,就能算出 GPTBot 等 18 种 AI 爬虫吃了多少带宽、折合多少钱。典型月访客 5 万的站点,AI 爬虫每月能吃掉 180 美元带宽费;验证延迟不到 10 毫秒,跑在 Cloudflare 边缘节点上,不影响真实用户。工具在浏览器本地处理日志,不上传。最后还生成一行 WAF 规则帮你屏蔽。 短评:算账工具,不是防御工具。...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
15:00
78d ago
OpenAI 博客· rssEN15:00 · 05·11
OpenAI 发 2026 年 Q1 数据:ChatGPT 用户画像变宽,35 岁以上和女性用户增长最快
OpenAI 发布 2026 年 Q1 消费版 ChatGPT 使用数据,核心结论是用户结构在变宽。女性用户(按名字推断)占比已过半,且增速继续领先;35 岁以上用户的消息量占比在提升,虽然 35 岁以下仍是主力。地域上,拉美、亚太、非洲一些国家的人均消息量排名上升最快,比如多米尼加、海地、日本、墨西哥、坦桑尼亚。工作场景里,写文档和做图仍是主流,但增...
#OpenAI#ChatGPT#Commentary
一句话点评
ChatGPT 用户结构在变宽:女性用户(按名字推断)已过半,35 岁以上用户消息占比上升,拉美、非洲一些国家人均消息量排名涨得最快。工作场景里写文档做图仍是主流,但增速放缓,更专业的任务(如医疗文档、信息检索)在变多。不过正文没披露具体用户数、增长率、地域渗透率,也没说怎么定义“采用率”。结论方向对,但缺硬数字支撑,先别当拐点论。
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H0·K1·R1
15:00
78d ago
AI HOT 精选· aihot-apiZH15:00 · 05·11
ChatGPT 2026 年第一季度用户画像:35 岁以上和女性用户增长最快
OpenAI 发布 2026 年 Q1 数据,称 ChatGPT 用户结构正在变宽:35 岁以上用户的消息占比在上升,女性用户(按名字推断)已超过可推断性别用户的一半。地域上,拉美、亚太和非洲一些国家的人均消息量排名上升最快,比如多米尼加和日本都跳了 8-9 位。工作场景里,写文档、做图这类通用任务占比在下降,医疗文档、信息检索等更垂直的用途在变多。不...
#OpenAI#ChatGPT#Product update
一句话点评
OpenAI 发了一组 Q1 数据,说 ChatGPT 用户结构在变宽:35 岁以上用户的消息占比在涨,女性用户(按名字推断)已过半。地域上,拉美、亚太和非洲一些国家的人均消息量排名上升最快,比如多米尼加和日本都跳了 8-9 位。工作场景里,写文档、做图这类通用任务占比在下降,医疗文档、信息检索等更垂直的用途在变多。不过正文没披露具体增长率、样本量、地域覆盖范围,也没说怎么推断性别和年龄。这...
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1

更多

频道

后台