ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-05-14

50 items · updated 3m ago
RSS live
2026-05-14 · 星期四2026年5月14日
17:52
75d ago
r/LocalLLaMA· rssEN17:52 · 05·14
NVIDIA 8B 嵌入模型被压到 2-bit,MLX 用户可以直接跑
Reddit 用户 kexxty 在 Hugging Face 上传了 nvidia/llama-embed-nemotron-8b 的四个 MLX 量化版本:fp16、8-bit、4-bit 和 2-bit。这意味着你可以在 Apple Silicon 上用 mlx-embeddings 直接加载,不用再绕道 llama-server 跑 GGUF。...
#Embedding#Inference-opt#NVIDIA#Hugging Face
一句话点评
Nvidia的8B嵌入模型现在能在Apple Silicon上直接跑MLX量化版了,有fp16、8-bit、4-bit和2-bit四种精度。2-bit版本内存占用极低,但精度损失多大正文没披露。好处是不用再绕道llama-server跑GGUF,mlx-embeddings直接加载,流程简化不少。不过这是社区用户上传的,非官方发布,稳定性没保证。短评:Mac用户跑嵌入终于不用绕路了,但2-b...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R1
17:40
75d ago
The Verge · AI· rssEN17:40 · 05·14
一张地图告诉你:你家后院可能藏着数据中心
俄勒冈居民 Isabelle Reksopuro 发现谷歌在当地大举收购公共用地建数据中心,于是自己做了一张交互地图,追踪全美数据中心建设和 AI 政策。地图显示,达尔斯市曾申请获得胡德山国家森林150英亩土地,理由是人口增长需要用水——但正文没披露地图覆盖了哪些地区、数据来源是否完整。
#Isabelle Reksopuro#Google#The Verge#Policy
一句话点评
俄勒冈居民自己做了张地图,追踪全美数据中心和AI政策,起因是谷歌在当地大量收购公共用地。地图显示达尔斯市曾申请获得胡德山国家森林150英亩土地,理由是人口增长需要用水——但正文没披露地图覆盖了哪些地区、数据来源是否完整。短评:民间监督比官方透明,但数据缺口得自己补。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
16:45
75d ago
r/LocalLLaMA· rssEN16:45 · 05·14
VS Code 新窗口能用本地模型,但还得联网+买 Copilot 会员
VS Code 新出的“Agents window”允许开发者调用本地 AI 模型,但前提是必须联网且拥有 GitHub Copilot 付费计划。帖子吐槽“想要个好东西真难”,但正文没披露具体支持哪些本地模型、需要什么 VS Code 版本,也没说离线时到底哪些功能不能用。简单说:本地跑模型省了 API 费,但 Copilot 会员和网络连接这两道门...
#Agent#Code#Tools#VS Code
一句话点评
VS Code 新出的 Agents 窗口号称能用本地模型,但必须联网+有 GitHub Copilot 付费计划。帖子没披露支持哪些本地模型、需要什么 VS Code 版本,也没说离线时哪些功能不能用。简单说:本地跑模型省了 API 费,但 Copilot 会员和网络连接这两道门槛还在。 短评:本地模型省 API 费,但 Copilot 会员+联网两道门槛还在,正文没披露模型接口和离线限制。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
16:09
75d ago
AI HOT 精选· aihot-apiZH16:09 · 05·14
Recraft AI V4.1 上线 OpenRouter,六款模型覆盖高美学、SVG 和克制风产品图
OpenRouter 刚上架了 Recraft AI 的 V4.1 系列,一共六个模型:V4.1 和 V4.1 Pro 主攻高美学出图,V4.1 Vector 和 Pro Vector 专做 SVG 插画,V4.1 Utility 和 Utility Pro 则偏向克制风格的产品图像。官方说照片级真实感更自然、渐变更平滑,短提示词也能更准命中,不用反复...
#Vision#Multimodal#OpenRouter#Recraft AI
一句话点评
Recraft V4.1 上了 OpenRouter,六个模型分三组:高美学出图、SVG 插画、克制风产品图。官方说照片级真实感更自然、短提示词更准。但没给定价和跑分,实际效果和性价比未知,先别急着冲。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
15:35
75d ago
AI HOT 精选· aihot-apiZH15:35 · 05·14
Suno 应用更新,但没说具体改了啥
Suno 在 X 上发帖说应用刚更新了,过去几周也陆续改了些东西,还准备开个帖子聊亮点。但正文没披露功能列表、版本号、灰度范围或发布日期,所以目前只能知道它更新了,具体更新了什么还不清楚。
#Suno#Product update
一句话点评
Suno 说应用更新了,但正文没披露任何具体功能、版本号或灰度范围。目前只能确认它确实改了点东西,具体改了啥还得等后续帖子。
HKR 分解
hook knowledge resonance
打开信源
28
SCORE
H0·K0·R0
15:21
75d ago
● P1彭博科技· rssEN15:21 · 05·14
AI芯片公司Cerebras上市融55.5亿美元,首日股价涨68%
Cerebras 做的是巨型 AI 训练芯片,跟英伟达走完全不同的路线。这次上市融了 55.5 亿美元,首日收盘涨了 68%。不过正文没披露 IPO 发行价和对应估值,也没说这 55.5 亿是发行收入还是包含超额配售。我会先打个折——股价涨得猛,但公司长期得证明自己的芯片在训练大模型时真能比英伟达更省钱、更好用,目前还没看到客户结构或营收细节。
#Inference-opt#Cerebras Systems#Funding
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
Cerebras 上市首日涨了 68%,但它的芯片强项在推理,不是训练,别直接当英伟达第二来看。
锐评
Cerebras 这次 IPO 最终融了 55.5 亿美元,是 2026 年目前最大的一笔。从过程看,市场确实很买账:路透社的消息说认购超了 20 倍,公司顺势把发行价从最高 125 美元提到了 160 美元,涨了近三成。上市当天股价又冲了 68%,创始人账面身家直接到了 32 亿美元。 但这里有几个点要先打个折。Cerebras 的核心卖点是“晶圆级芯片”,一颗芯片就占满一整片晶圆,上面集成了大量高速缓存(SRAM)。这带来的直接好处是,做 AI 推理里的解码步骤时速度很快,这也是它能拿到亚马逊和 OpenAI 大单的原因。不过,正文没披露这些订单的具体金额和交付节奏,也没提公司目前的营收和亏损情况。光靠大客户名字和 IPO 热度,还判断不了它能不能持续赚钱。 另外,它的芯片强项在推理,不是训练。现在市场最缺的算力还是在训练端,Cerebras 在这个主战场能抢到多少份额,目前还看不清楚。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
15:20
75d ago
TechCrunch AI· rssEN15:20 · 05·14
Khosla 投 1000 万美元给一位曾搞垮公司的创始人,这次做 AI 记账
Khosla Ventures 给 Ian Crosby 的新公司 Synthetic 投了 1000 万美元,做的是全自动 AI 记账服务,目标客户是其他初创公司。Crosby 上一家公司 Bench 已经倒闭了,所以这次算是赌他第二次能成。正文没披露这轮估值、产品上线时间,也没说技术架构,信息缺口挺大。
#Agent#Khosla Ventures#Ian Crosby#Synthetic
一句话点评
Khosla 赌 1000 万美元给 Ian Crosby 再创业,做全自动 AI 记账。他上一家公司 Bench 已经倒闭,这次算二次押注。正文没披露估值、上线时间和技术架构,信息缺口大,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
15:15
75d ago
Hacker News 首页· rssEN15:15 · 05·14
Anthropic 与盖茨基金会达成 2 亿美元合作,主攻全球健康和教育
Anthropic 宣布与盖茨基金会达成一项为期四年的合作,总投入 2 亿美元,形式包括拨款、Claude 使用额度以及技术支持。重点领域是全球健康、生命科学、教育以及经济流动性。最大一块用在低收入和中等收入国家的健康改善上,比如用 Claude 加速疫苗和药物筛选、帮政府做健康数据决策,还会针对被忽视的疾病(如脊灰、HPV、子痫前期)做研究。教育方面...
#Anthropic#Gates Foundation#Partnership
一句话点评
Anthropic 与盖茨基金会达成 2 亿美元四年合作,大头用于中低收入国家的健康改善,比如用 Claude 加速疫苗筛选、帮政府做健康数据决策。教育方面覆盖 K-12 数学辅导和职业指导,经济流动性则聚焦小农户农业。合作形式包括拨款、Claude 使用额度和技术支持。 关键数字:4.6 亿人缺基本医疗服务,HPV 每年致死 35 万(90% 在中低收入国家)。这些数字说明合作方向确实对...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
15:08
75d ago
AI HOT 精选· aihot-apiZH15:08 · 05·14
Anthropic 与盖茨基金会合作,承诺 2 亿美元支持全球发展项目
Anthropic 宣布与盖茨基金会合作,承诺提供 2 亿美元,形式包括赠款、Claude 使用额度(即调用模型的额度)和技术支持,用于全球健康、生命科学、教育、农业和经济流动领域的项目。2 亿美元金额不小,但正文没披露具体分配比例和项目周期,所以暂时看不出这笔钱是长期投入还是一次性承诺。
#Anthropic#Gates Foundation#Claude#Partnership
一句话点评
Anthropic 与盖茨基金会合作,承诺投入 2 亿美元(含赠款、Claude 调用额度和技术支持),用于全球健康、教育等公益项目。金额不小,但正文没披露具体分配比例和项目周期,所以暂时看不出是长期投入还是一次性承诺。短评:2 亿美元买公益口碑,但没细说钱怎么分、项目跑多久,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R0
15:08
75d ago
AI HOT 精选· aihot-apiZH15:08 · 05·14
Perplexity 直连 Snowflake,能直接查公司实时数据了
Perplexity 现在可以直接连上 Snowflake 数据仓库,用 SQL、源表、筛选器和指标实时查询公司内部数据,相当于给每个团队配了一个随时可用的数据科学助手。正文没披露具体怎么连的、权限怎么管、定价多少、什么时候能用,所以实际落地细节还不清楚。
#Agent#Tools#Perplexity#Snowflake
一句话点评
Perplexity 直连 Snowflake,让非技术人员用自然语言查公司实时数据,省去写 SQL 的麻烦。但正文没披露权限模型、定价和上线时间,实际落地细节不明。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
15:00
75d ago
AI HOT 精选· aihot-apiZH15:00 · 05·14
PixVerse 上线 F1 进站肖像特效,一键生成电视直播风格图
PixVerse 在网页端推出了 PitCrewMoment 肖像特效,能把任何照片一键变成 F1 直播里进站时刻的电视画面风格。目前正文没披露定价、模型版本或生成参数,所以不清楚是免费还是收费、生成速度如何。
#Vision#PixVerse#Product update
一句话点评
PixVerse 上线了“PitCrewMoment”特效,能把任何照片一键变成 F1 进站时的电视直播画面风格,效果挺有临场感。但正文没披露定价、模型版本或生成速度,所以不清楚是免费还是收费、出图要等多久。如果是免费且秒出,适合做社交头像;如果收费或排队,就只是尝鲜。
HKR 分解
hook knowledge resonance
打开信源
48
SCORE
H1·K0·R0
14:51
75d ago
Hacker News 首页· rssEN14:51 · 05·14
MIT 研究生新生减少 20%:校长称联邦拨款和人才管道双双承压
MIT 校长 Kornbluth 在 5 月 14 日的视频讲话中透露,相比 2024 年,2026 年秋季入学的研究生新生(除 Sloan 商学院和 EECS 硕士项目外)减少了近 20%,相当于约 500 人。直接原因是联邦研究经费实际到账和新增项目数均下降超过 20%,加上对捐赠收益征收 8% 的新税,导致各系谨慎招生。校长还提到,部分联邦机构正...
#MIT#Policy
一句话点评
MIT校长证实,2026年秋季入学研究生新生(除商学院和EECS硕士项目)比2024年少了近20%,约500人。直接原因是联邦经费实际到账和新项目数均降超20%,外加捐赠收益被征8%新税,各系不敢招人。校长还提到部分联邦机构正考虑按地域而非学术质量分配经费。正文没披露哪些院系受影响最重、国际生比例变化,以及非联邦经费增长的具体来源。
HKR 分解
hook knowledge resonance
打开信源
58
SCORE
H1·K1·R1
14:49
75d ago
Hacker News 首页· rssEN14:49 · 05·14
Claude AI 帮人找回 11 年前的比特币钱包,价值 40 万美元
一个比特币交易者用 Claude AI 恢复了 11 年前丢失的比特币钱包密码,拿回了里面约 40 万美元的资产。AI 尝试了 3.5 万亿个密码组合才成功。正文没披露具体用了什么方法、花了多久、以及是否依赖钱包备份文件本身没损坏。如果方法可复现,这比雇专业恢复公司便宜很多,但前提是你得留着旧钱包文件。
#Agent#Tools#Claude AI#Tom's Hardware
一句话点评
Claude AI 试了 3.5 万亿次密码,帮人找回 11 年前价值 40 万美元的比特币钱包。听着很猛,但正文没披露具体怎么试的——是暴力穷举还是利用了旧备份的线索?也没说花了多久、钱包文件是否完好。如果方法可复现,这比雇专业恢复公司便宜很多,但前提是你得留着旧钱包文件。这点先别太激动,先等更多技术细节出来。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H1·K0·R1
14:32
75d ago
r/LocalLLaMA· rssEN14:32 · 05·14
TinySearch:给本地小模型用的轻量联网搜索工具
Reddit 用户 Scared-Tip7914 开源了一个叫 TinySearch 的 MCP 工具,专门给本地小模型做网页搜索。它走 DuckDuckGo 搜,用 Crawl4AI 抓页面,再通过稠密检索加 BM25 风格召回和重排序,最后只给模型返回一小段上下文。作者说在 M4 Mac 和老款联想 ThinkPad 上,一次完整搜索大概 5–12...
#Agent#RAG#Tools#TinySearch
一句话点评
TinySearch 是一个给本地小模型用的开源网页搜索 MCP 工具,走 DuckDuckGo 搜,用 Crawl4AI 抓页面,再稠密检索加 BM25 重排序,最后只返回一小段上下文。作者说在 M4 Mac 和老款 ThinkPad 上,一次搜索 5–12 秒——对小模型来说算快的,但没披露召回率和准确率。短评:小模型终于有个轻量搜索方案,但效果如何还得自己试。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
14:24
75d ago
r/LocalLLaMA· rssEN14:24 · 05·14
MIT 新方法 RLCR:教模型说“我不确定”,而不是硬编答案
MIT CSAIL 提出 RLCR 训练方法,专门解决推理模型过度自信的问题——模型不会的题也硬编答案。核心思路是用强化学习让模型学会表达不确定性,据说不会牺牲准确率。但正文没披露任何基准测试或实验数据,所以效果到底多好、在哪些任务上有效、训练成本高不高,目前都不清楚。对做模型对齐或安全的人来说方向有价值,但具体结论得等论文细节。
#Reasoning#Alignment#Safety#MIT CSAIL
一句话点评
MIT 搞了个 RLCR 训练法,让推理模型在不会的时候老实说“不确定”,而不是硬编答案。方向很对,模型过度自信是常见毛病。但正文没给任何基准测试或实验数据,效果多好、在哪些任务上有效、训练成本高不高,一概不知。对做对齐和安全的人值得关注,但具体结论得等论文细节。
HKR 分解
hook knowledge resonance
打开信源
71
SCORE
H1·K1·R1
14:10
75d ago
AI HOT 精选· aihot-apiZH14:10 · 05·14
百度发全栈AI云,专为大规模智能体应用设计
百度在Create大会上宣布推出全栈AI云,主要面向大规模智能体应用场景,升级覆盖智能体基础设施和AI基础设施两层。自研昆仑芯AI芯片搭建的专用集群,已经用来训练了文心ERNIE 5.1系列里的一个关键模型。正文没披露这个集群的具体规模或训练成本,但用自研芯片做训练,至少说明百度在硬件上想减少对英伟达的依赖。
#Agent#Inference-opt#Baidu#Shen Dou
一句话点评
百度发全栈AI云,专为智能体(让模型进业务流程干活)设计。自研昆仑芯集群已训练了文心ERNIE 5.1的一个关键模型,但没披露集群规模或成本,这点先别太激动。用自研芯片训练至少说明想减少对英伟达依赖,但实际效果和性价比未知。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H1·K1·R1
14:03
75d ago
AI HOT 精选· aihot-apiZH14:03 · 05·14
三天搓出1.5万行代码,这个开源工具让AI Agent直接生成能用的HTML
一个叫html-anything的开源项目,核心功能是让AI Agent把任意数据转成设计水准不错的HTML代码。作者三天写了约1.5万行代码,内置75套Skills(可以理解为预设的转换模板)和9种导出格式,兼容Claude Code、Codex等主流代码生成Agent。三天出这个规模,开发效率挺高,但正文没披露75套Skills具体覆盖哪些场景,也...
#Agent#Code#Tools#html-anything
一句话点评
三天肝出1.5万行代码,内置75个转换模板和9种导出格式,兼容Claude Code等主流Agent,开发效率确实高。但75套Skills具体覆盖哪些场景没披露,模板质量也未知,这点先别太激动。如果模板真能稳定产出设计级HTML,对快速生成前端页面挺实用。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
14:00
75d ago
TechCrunch AI· rssEN14:00 · 05·14
Wirestock 融资 2300 万美元,转型给 AI 实验室卖多模态数据
Wirestock 在 2023 年转型为数据供应商,现在向 AI 实验室提供图片、视频、设计素材、游戏和 3D 内容的数据集。这次 2300 万美元融资说明市场对高质量多模态数据有需求,但正文没披露投资方、估值、数据集规模、授权条款或客户名单,所以暂时没法判断这笔钱花得值不值。
#Multimodal#Wirestock#Funding
一句话点评
Wirestock 拿了 2300 万美元融资,专门给 AI 公司卖图片、视频、3D 素材等数据集。这事说明高质量多模态数据确实稀缺,但正文没披露投资方、估值、数据集规模、授权条款或客户名单,所以暂时没法判断这笔钱花得值不值。短评:数据中间商赚差价,但缺细节,先打个折。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H0·K1·R1
13:39
75d ago
r/LocalLLaMA· rssEN13:39 · 05·14
M4 Max 本地跑 Qwen 3.5/3.6,断网也能生成会议纪要
Hedy 把会议纪要、详细笔记、聊天记录和实时辅导全部搬到了本地,用 llama.cpp 跑 Qwen 3.5 4B 模型。演示时关掉 Wi-Fi,一段约 10 分钟的会议录音转文字后,模型花了大约 15 秒生成摘要。这个速度在本地部署里算快的,M4 Max 的推理能力够用。正文没披露具体用了多少显存、是否做了量化,也没说长会议(比如 1 小时)会不会...
#Inference-opt#Audio#Tools#Hedy
一句话点评
M4 Max 本地跑 Qwen 3.5 4B,10 分钟会议录音转文字后 15 秒出摘要,关 Wi-Fi 演示挺唬人。速度在本地部署里算快的,但正文没披露显存占用和是否量化,长会议(1 小时)会不会崩也不知道。短评:本地会议摘要能跑通,但别急着吹未来。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
13:31
75d ago
Ben's Bites· rssEN13:31 · 05·14
给AI agent看录屏当反馈,它自己生成HTML报告
Ben's Bites作者分享了一个新工作流:录屏30分钟,把视频丢给AI agent,agent自动生成一份HTML反馈报告,包含文字转录、带时间戳的关键帧截图、短GIF动图,以及一个待办清单。作者觉得这种方式比打字、语音转文字、截图反馈都更直观,还能在报告里展示其他网站或App的“好样子”。不过他也承认,处理视频很耗token,对预算敏感的用户不友...
#Agent#Multimodal#Tools#Ben’s Bites
一句话点评
录屏30分钟丢给AI agent,自动生成带时间戳截图、GIF和待办清单的HTML反馈报告。作者觉得比打字截图直观,还能展示其他App的“好样子”。但处理视频很耗token,预算敏感慎用。正文没披露具体模型和成本,实用性待验证。
HKR 分解
hook knowledge resonance
打开信源
69
SCORE
H1·K1·R1
13:23
75d ago
AI HOT 精选· aihot-apiZH13:23 · 05·14
用AI写代码时顺便学技能:一个GitHub工具让你边用Copilot边练手
开发者DrCatHicks发布了一个GitHub工具,能在你用Claude或Codex(AI编程助手)写代码时,主动生成针对某个知识点的代码示例和解释,帮你刻意练习薄弱技能。项目在Hacker News上获得104个点赞,说明社区对“用AI学AI写代码”这个方向有兴趣。不过正文没披露用了什么模型、效果有没有验证,也没说生成示例的准确率。思路挺实用——把...
#Code#GitHub#Hacker News#Open source
一句话点评
一个GitHub工具,能在你用Claude或Codex写代码时,主动生成针对某个知识点的代码示例和解释,帮你刻意练习薄弱技能。Hacker News上104个点赞,说明社区对“用AI学AI写代码”这个方向有兴趣。但正文没披露用了什么模型、效果有没有验证,也没说生成示例的准确率。思路挺实用——把AI从“代写”变成“教练”,但缺验证,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
13:02
75d ago
Product Hunt · AI· rssEN13:02 · 05·14
Standboy:AI 干活时,你的 Game Boy 会醒过来
一个开源小工具,放在代码编辑器侧边栏里。AI agent 开始跑任务时,屏幕上的 Game Boy 就亮屏开机,agent 停下来它就合上。纯视觉反馈,没有实际游戏功能,就是给开发者一个“AI 在忙”的可爱提示。免费、开源,但正文没披露具体怎么接入编辑器、支持哪些 IDE,也没说会不会吃性能。
#Agent#Product Hunt#Standboy#Product update
一句话点评
一个开源小玩具:AI agent 跑任务时,编辑器侧栏里的 Game Boy 会亮屏开机,停下来就合上。纯视觉反馈,没有实际游戏功能,就是给开发者一个“AI 在忙”的可爱提示。免费、开源,但正文没披露具体怎么接入编辑器、支持哪些 IDE,也没说会不会吃性能。
HKR 分解
hook knowledge resonance
打开信源
42
SCORE
H1·K0·R0
13:01
75d ago
Hacker News 首页· rssEN13:01 · 05·14
刚付完钱就被封号?Claude 新账号秒封,钱还不退
一位 Hacker News 用户发帖称,自己刚注册 Claude 账号、信用卡扣款成功,同一分钟内就收到了发票和违反服务条款的封号邮件。有回复说换张信用卡能绕过,但被封的账号照样扣了钱。发帖人尝试联系 Anthropic 客服,发现 support@anthropic.com 只有 AI 机器人回复,无法转接人工。帖子没有披露具体触发了哪条规则,也没...
#Safety#Anthropic#Claude#Hacker News
一句话点评
刚付完钱就被封号,同一分钟收到发票和违规通知,Anthropic 的 AI 客服还拒绝转人工。有用户说换张信用卡能绕过,但被封照样扣钱。正文没披露具体触发了哪条规则,也没说 Anthropic 是否回应。这种自动封号+扣钱不退的流程,对用户信任伤害很大。
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K0·R1
13:00
75d ago
● P1OpenAI 博客· rssEN13:00 · 05·14
OpenAI 在 ChatGPT 手机应用中添加 Codex 代码编写功能
Codex 现在可以在 ChatGPT 手机 App 里用了,目前是预览版。你可以在手机上实时查看、审批和指挥 Codex 在你电脑或远程开发机上跑的任务,比如修 bug、做重构。它通过一个安全的中继层连接你的设备,不会把机器直接暴露到公网。文章说每周有超过 400 万人用 Codex,但没提手机端功能的具体定价、推送范围和支持的手机系统。另外,远程 ...
#Code#Tools#OpenAI#Product update
精选理由
精选 · 重要度 90 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 把 Codex 搬进了手机 App,让你不在电脑前也能审批、改方向或看进度。但别指望手机写代码,它更像一个远程指挥面板。
锐评
Codex 上手机这件事,核心不是让你在手机上敲代码,而是解决一个很实际的痛点:当 Codex 在后台跑长任务时,你人不在电脑前,它卡住了需要你拍板怎么办。现在你可以用手机随时查看进度、批准操作、切换模型,甚至发起新任务。官方说每周有超过 400 万人用 Codex,这个量级下,减少等待和返工确实能省不少时间。 技术上,手机端通过一个安全中继层连接你跑 Codex 的机器,不会把本地文件直接暴露到公网。企业版还支持远程 SSH 接入托管开发环境,并新增了程序化令牌、钩子和 HIPAA 合规支持。 不过,正文没披露手机端的延迟表现和离线能力,也没提复杂操作在触屏上的交互到底好不好用。目前 Windows 端的手机连接也还没开放。这些缺口意味着,实际体验可能比宣传片里展示的要打折。
HKR 分解
hook knowledge resonance
打开信源
90
SCORE
H1·K1·R1
13:00
75d ago
MIT 科技评论· rssEN13:00 · 05·14
企业开始抢回AI和数据的主权:70%高管认为必须自建平台
EDB对2050多名高管的调查显示,70%的人认为成功需要自建主权AI和数据平台。核心焦虑是:把数据喂给第三方大模型,等于把IP交给别人,对方改个政策你就没保护了。黄仁勋在2026达沃斯也喊话各国自己建AI基础设施。正文没披露受访者的行业分布,也没说这些高管来自什么规模的公司。
#Agent#EDB#MIT Technology Review#NVIDIA
一句话点评
EDB调查2050多名高管,70%认为企业成功需要自建主权AI和数据平台。核心焦虑:把数据喂给第三方大模型等于交出自己的IP,对方改个政策就没保护了。黄仁勋在2026达沃斯也喊话各国自己建AI基础设施。但正文没披露受访者行业分布和公司规模,这个70%要打折。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
13:00
75d ago
MIT 科技评论· rssEN13:00 · 05·14
金融业搞 Agentic AI,先过数据这一关
MIT 科技评论的一份报告指出,超过一半的金融团队已经在用或计划用 Agentic AI(能自己规划并执行任务的 AI,不只是回答问题)。但文章核心观点是:金融业搞 Agentic AI,瓶颈不在模型多聪明,而在数据能不能被快速搜索、安全管控、并且带上上下文。因为金融监管要求每一步都能审计——你不能只说“数据进去、结果出来”,还得解释模型从哪找到的信息...
#Agent#RAG#Memory#MIT Technology Review
一句话点评
MIT科技评论与Elastic联合报告:金融业搞Agentic AI(能自己规划执行任务的AI),瓶颈不在模型多聪明,而在数据能不能被快速搜索、安全管控并带上上下文。超一半金融团队已用或计划用,但监管要求每一步都能审计,不能只给个黑箱结果。报告是赞助内容,观点偏Elastic,但数据准备确实是真问题。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
12:53
75d ago
r/LocalLLaMA· rssEN12:53 · 05·14
英伟达把月之暗面Kimi K2.6压到4比特,跑在自家显卡上
英伟达发布了Kimi K2.6和K2.5的NVFP4量化版,就是用Model Optimizer工具把原模型压缩到4比特精度,让它在自家GPU上跑得更省显存。评测时设了温度1.0、top_p 0.95、最大12.8万token上下文,跑了六个基准。正文没披露具体跑分和显存节省量,所以实际效果要等实测。不过4比特量化通常意味着推理成本能降一大截,适合本地部署。
#Inference-opt#Benchmarking#Nvidia#Moonshot AI
一句话点评
英伟达给Kimi K2.6和K2.5出了4比特量化版,用自家Model Optimizer工具压的,目标是在NVIDIA GPU上省显存跑本地。评测设了温度1.0、top_p 0.95、最大12.8万token上下文,跑了六个基准。但正文没披露具体跑分和显存节省量,所以实际效果要等实测。4比特量化通常能大幅降低推理成本,适合本地部署,但精度损失和速度提升得看后续数据。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R1
12:40
75d ago
r/LocalLLaMA· rssEN12:40 · 05·14
调低学习率比什么花活都管用:一次 QLoRA 微调实测
作者用 QLoRA 微调 Llama 3.1 8B,任务是对约 8000 条样本做分类。试了一圈后发现,把学习率从 2e-4 降到 1e-4、同时把训练轮数从 3 提到 5,效果最好。正文没披露具体指标,所以这点先别太激动。另外作者还手动砍掉了大约三分之一标注错误或模糊的数据——这步可能比调参更关键。
#Fine-tuning#Llama#Hyperai#Commentary
一句话点评
QLoRA微调Llama 3.1 8B做分类,8000条样本。作者试了一圈发现:学习率从2e-4降到1e-4、轮数从3提到5效果最好。但正文没披露具体指标,这点先别太激动。更关键的是他手动砍掉了约三分之一标注错误或模糊的数据——这步可能比调参更省钱。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R1
12:29
75d ago
r/LocalLLaMA· rssEN12:29 · 05·14
Scenema Audio 开源:零样本语音克隆,8步扩散就能跑
ScenemaAI 把语音克隆模型 Scenema Audio 的权重和推理代码开源了,MIT 协议。核心是扩散模型,但把去噪步数从常见的 50 步砍到 8 步,延迟低了不少。打包成 Docker REST API 提供服务,显存需求分三档:16GB、24GB、48GB,最低配置一张消费级显卡就能跑。零样本的意思是,给一段没听过的语音就能克隆,不用额外...
#Audio#Fine-tuning#Tools#ScenemaAI
一句话点评
Scenema Audio 开源了,MIT 协议,8 步去噪就能生成语音,比常见 50 步快很多。最低 16GB 显存就能跑,消费级显卡友好。零样本克隆给一段语音就能学,不用微调。但正文被屏蔽,没披露训练数据来源和声音相似度评测,克隆效果和泛化能力存疑。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K1·R1
12:27
75d ago
Hacker News 首页· rssEN12:27 · 05·14
Sam Altman 的商业交易在 OpenAI 上市前被共和党盯上
WSJ 报道称,Sam Altman 的一些商业交易在 OpenAI 准备 IPO 之际,正面临共和党方面的审查。但 HN 帖子正文没披露具体是哪些交易、审查到什么程度,只给了 33 个点赞和 11 条评论。信息缺口明显:不知道是利益冲突、关联交易还是其他问题,也不知道审查来自哪个委员会或机构。
#Sam Altman#OpenAI#WSJ#Policy
一句话点评
WSJ 爆料 Sam Altman 在 OpenAI 准备上市前,其商业交易正被共和党审查。但 HN 帖子正文没披露具体是哪些交易、审查到什么程度,只给了 33 个点赞和 11 条评论。信息缺口明显:不知道是利益冲突、关联交易还是其他问题,也不知道审查来自哪个委员会或机构。 短评:标题吓人,但正文没细节,先别急着下结论。
HKR 分解
hook knowledge resonance
打开信源
70
SCORE
H1·K0·R1
12:10
75d ago
MIT 科技评论· rssEN12:10 · 05·14
AI 色情片盗用成人演员身体,Gemini 泄露真实手机号
MIT Tech Review 报道了两个 AI 风险:一是 AI 色情深度伪造不仅换脸,还盗用成人内容创作者的原始身体影像,训练模型后生成未经同意的内容,创作者几乎没有法律保护;二是 Gemini 至少暴露了三类私人手机号案例:WhatsApp 客服请求、同事手机号、以及打给律师的电话被错误转接。专家认为问题出在训练数据包含个人身份信息,且受害者很难阻止。
#Multimodal#Safety#MIT Technology Review#Gemini
一句话点评
短评:AI 色情伪造不止换脸,还偷身体;Gemini 泄露手机号,受害者难阻止。 点评:MIT Tech Review 这篇双线报道,每条都值得点开。第一条讲 AI 色情深度伪造的“身体盗用”——成人内容创作者的原始身体影像被拿去训练模型,生成未经同意的内容,而法律几乎不保护他们。这不是换脸,是连身体一起偷。第二条是 Gemini 至少暴露了三类私人手机号:WhatsApp 客服请求、同事...
HKR 分解
hook knowledge resonance
打开信源
67
SCORE
H1·K1·R1
11:48
75d ago
r/LocalLLaMA· rssEN11:48 · 05·14
TinyHarness:一个省内存的本地 AI 工具,作者求吐槽
一位开发者用非 Python/JS 语言写了个叫 TinyHarness 的本地 AI 工具,核心卖点是内存占用低——因为不用 Python 那套运行时,能省下更多内存跑本地模型。目前支持 Ollama、Llama.cpp 和 vLLM,还能通过 Ollama 的网页搜索 API 上网。作者说目标是跟 pi 和 opencode 这类工具竞争,但现阶段...
#Agent#Tools#TinyHarness#Ollama
一句话点评
TinyHarness 用非 Python/JS 语言写,省掉运行时内存,给本地模型腾空间。目前支持 Ollama、Llama.cpp 和 vLLM,还能通过 Ollama 的网页搜索 API 上网。作者想跟 pi 和 opencode 竞争,但现阶段功能还比较基础,正文没披露具体内存节省数据。
HKR 分解
hook knowledge resonance
打开信源
64
SCORE
H0·K1·R1
11:38
75d ago
r/LocalLLaMA· rssEN11:38 · 05·14
5090 跑 Qwen3.6-27B 实测:450W 下提示处理 2273 tokens/s,生成 49.3 tokens/s
Reddit 用户用 5090 跑 llama.cpp,加载 Qwen3.6-27B 的 Q6_K_P 量化版,输入 3 万 token 的提示,对比了 400W 到 600W 功耗下的性能。450W 时提示处理速度 2273 tokens/s,比 4090 的 2113 快约 7.6%;生成速度 49.3 tokens/s,比 4090 的 41 快...
#Inference-opt#Benchmarking#Reddit#Qwen
一句话点评
5090 跑 Qwen3.6-27B 量化版,450W 功耗下提示处理 2273 tokens/s,比 4090 快 7.6%;生成 49.3 tokens/s,快 20%。但这是 Reddit 用户自测,对比的 4090 数据来自另一帖子,硬件和设置不完全一样,不能直接当胜负结论。功耗从 400W 拉到 600W,提示处理速度提升明显,生成速度几乎不变,说明瓶颈不在功耗。正文没披露显存占用...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
11:07
75d ago
r/LocalLLaMA· rssEN11:07 · 05·14
跑本地模型卡顿?试试关掉 Windows 的内存压缩
一位 Reddit 用户说,在 Windows 管理员终端里跑一行命令 Disable-mmagent -mc,就能解决本地 AI 推理时的卡顿问题。他是在 AMD 显卡上试的,而且当时开着游戏。但帖子没交代具体模型、驱动版本、内存大小,也没贴跑分对比。所以这个技巧可以一试,但效果因人而异,别指望一劳永逸。
#Inference-opt#Microsoft#AMD#Reddit
一句话点评
短评:关掉Windows内存压缩可能提速,但帖子没给跑分,先别太激动。 点评:Reddit用户称在管理员终端跑一行Disable-mmagent -mc就能缓解本地AI推理卡顿,实测条件是AMD显卡+开着游戏。原理是内存压缩会占用CPU周期,关掉后给推理模型腾出带宽。但帖子没交代具体模型、驱动版本、内存大小,也没贴跑分对比,效果因人而异。如果你正被卡顿困扰,可以一试,成本极低(一行命令),...
HKR 分解
hook knowledge resonance
打开信源
66
SCORE
H1·K1·R1
11:00
75d ago
The Verge · AI· rssEN11:00 · 05·14
个人软件革命来了:用自然语言就能给自己写个App
The Verge 提出一个观点:AI 让普通人也能为自己写软件了,不再只能等大厂出产品。文章把这种用自然语言描述需求、让 AI 直接生成应用的做法叫做“vibe coding”。但正文没有披露具体用了哪个模型、花了多少钱、跑了多久、效果如何,也没有给出一个可复现的例子。所以这个方向值得关注,但先别太激动——目前还缺实测数据来支撑“人人都能当开发者”的结论。
#Code#The Verge#Commentary
一句话点评
The Verge 提出“vibe coding”概念,说普通人用自然语言就能让 AI 生成软件,不用再等大厂出产品。方向有意思,但正文没披露用了哪个模型、花了多少钱、跑了多久、效果如何,也没有可复现的例子。目前缺实测数据支撑“人人都能当开发者”的结论,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
61
SCORE
H1·K0·R1

更多

频道

后台