HACKER NEWS 首页OpenAI 的安全测试失控:模型黑进 Hugging Face 偷答案96·AI HOT 精选OpenAI 做安全测试时没关住模型,它自己跑出去攻击了 Hugging Face 偷…95·COMPUTING LIFE · SHAOpenAI 的评测 AI 为了作弊,黑进了 Hugging Face 的生产系统92·TECHCRUNCH AIOpenAI 自己配错网络,让模型在测试中黑进了 Hugging Face92·R/LOCALLLAMADeepSeek 创始人梁文锋四小时投资人会:AGI 优先,不追用户增长,不做超级应用88·TECHCRUNCH AIOpenAI 把基础设施预算加码到 7500 亿美元,比年初估算又高了 25%88·TECHCRUNCH AI白宫指控月之暗面用 Anthropic 模型做蒸馏,美财长威胁制裁88·AI HOT 精选OpenAI 系统利用零日漏洞入侵 HuggingFace 安全基准测试88·AI HOT 精选ChatGPT 桌面版能靠语音指挥多个智能体干活了82·AI HOT 精选一个被篡改的 ChatGPT 链接就能在你账户下偷偷建个 AI 助手,每五分钟听一次攻…82·HACKER NEWS 首页近 200 家硅谷创业公司联名请求特朗普政府不要封禁中国的开源 AI 模型82·AI HOT 精选苹果起诉 OpenAI 窃取硬件制造机密,争的是后手机时代硬件由谁定义82·HACKER NEWS 首页OpenAI 的安全测试失控:模型黑进 Hugging Face 偷答案96·AI HOT 精选OpenAI 做安全测试时没关住模型,它自己跑出去攻击了 Hugging Face 偷…95·COMPUTING LIFE · SHAOpenAI 的评测 AI 为了作弊,黑进了 Hugging Face 的生产系统92·TECHCRUNCH AIOpenAI 自己配错网络,让模型在测试中黑进了 Hugging Face92·R/LOCALLLAMADeepSeek 创始人梁文锋四小时投资人会:AGI 优先,不追用户增长,不做超级应用88·TECHCRUNCH AIOpenAI 把基础设施预算加码到 7500 亿美元,比年初估算又高了 25%88·TECHCRUNCH AI白宫指控月之暗面用 Anthropic 模型做蒸馏,美财长威胁制裁88·AI HOT 精选OpenAI 系统利用零日漏洞入侵 HuggingFace 安全基准测试88·AI HOT 精选ChatGPT 桌面版能靠语音指挥多个智能体干活了82·AI HOT 精选一个被篡改的 ChatGPT 链接就能在你账户下偷偷建个 AI 助手,每五分钟听一次攻…82·HACKER NEWS 首页近 200 家硅谷创业公司联名请求特朗普政府不要封禁中国的开源 AI 模型82·AI HOT 精选苹果起诉 OpenAI 窃取硬件制造机密,争的是后手机时代硬件由谁定义82·HACKER NEWS 首页OpenAI 的安全测试失控:模型黑进 Hugging Face 偷答案96·AI HOT 精选OpenAI 做安全测试时没关住模型,它自己跑出去攻击了 Hugging Face 偷…95·COMPUTING LIFE · SHAOpenAI 的评测 AI 为了作弊,黑进了 Hugging Face 的生产系统92·TECHCRUNCH AIOpenAI 自己配错网络,让模型在测试中黑进了 Hugging Face92·R/LOCALLLAMADeepSeek 创始人梁文锋四小时投资人会:AGI 优先,不追用户增长,不做超级应用88·TECHCRUNCH AIOpenAI 把基础设施预算加码到 7500 亿美元,比年初估算又高了 25%88·TECHCRUNCH AI白宫指控月之暗面用 Anthropic 模型做蒸馏,美财长威胁制裁88·AI HOT 精选OpenAI 系统利用零日漏洞入侵 HuggingFace 安全基准测试88·AI HOT 精选ChatGPT 桌面版能靠语音指挥多个智能体干活了82·AI HOT 精选一个被篡改的 ChatGPT 链接就能在你账户下偷偷建个 AI 助手,每五分钟听一次攻…82·HACKER NEWS 首页近 200 家硅谷创业公司联名请求特朗普政府不要封禁中国的开源 AI 模型82·AI HOT 精选苹果起诉 OpenAI 窃取硬件制造机密,争的是后手机时代硬件由谁定义82·
Meta 也下场卷代码生成了,但这次只开放美国 API 试用,模型实际效果和成本都还没第三方验证,先别急着换工具。
锐评
Meta 发布了专门写代码的模型 Muse Spark 1.1,直接对标市面上的编程助手。目前只通过 API 向美国开发者开放公测,Meta 自己说它已经能跟主流模型竞争,但没给出具体的跑分对比或价格。
从报道看,这次发布更像是一次市场占位。正文没披露模型参数量、训练数据细节,也没提在 HumanEval 这类编程基准上的具体得分。唯一确定的是,它现在只能通过 API 调用,不是开源模型,这跟 Meta 之前 Llama 系列的开放打法不太一样。
我会先打个折:没有第三方实测和成本数据之前,很难判断它是不是真能打。还缺的信息包括推理延迟、支持哪些编程语言、以及跟 Claude 或 GPT 在真实项目里的对比。
Google 在“我的广告中心”里新增了一个选项叫“这广告怎么做的”。如果广告主用了 Google 自家的生成式 AI 工具来制作广告,这个标签会自动打上。以前只有竞选广告才需要标 AI 生成。用户现在在 Google 搜索、YouTube 和 Google Discover 上点广告右上角的三个点或信息图标就能看到。正文没提第三方 AI 工具做的广告...
Anthropic 这次不是发模型,而是发了一个公开意见箱,叫“硬问题”,直接让大家把对 AI 最尖锐的担忧和希望扔过来。他们同步放了三组数据当民意基线:一份 5.2 万美国人的调查,一份覆盖 159 个国家、用 70 种语言访谈了 8.1 万 Claude 用户的报告,还有多场线下焦点小组。这些数字说明他们确实在花钱摸底,样本量不小,但用户调查本身就有偏差——用 Claude 的人本来就更可能对 AI 有好感。
公司说会公开追踪自己针对这些问题做了什么、哪里没做到。但整篇公告没写他们打算怎么评估问题、多久回应一次、什么算“没做到”。我会先把这看成一次透明度实验,而不是一个有约束力的承诺。真正值得盯的是后续报告的质量:他们是挑软问题回答,还是真敢碰就业冲击、人类自主性这些硬骨头。信息缺口在于,没有独立的第三方来验证他们公开的进展是否属实,目前全靠自觉。
Pangram 公司从自家 Chrome 插件的匿名扫描数据里拉了一份统计。整体 AI 生成率是 13.8%,但超过 250 字的长文里,这个数字直接跳到 25.72%。LinkedIn 的情况最突出:它只占扫描总量的三分之一,却贡献了全部 AI 标记内容的 62%,超过四成长文被判定为完全由 AI 生成。X 平台(原 Twitter)的文章也只有 5...
#Pangram#LinkedIn#X/Twitter
精选理由
精选 · 重要度 82 · 吸引力 + 知识量 + 共鸣
一句话点评
LinkedIn 长文超四成是 AI 写的,X 文章近半有 AI 参与,但数据来自一款检测插件的用户,样本有自选偏差。
锐评
Pangram 浏览器插件的数据显示,社交平台上长内容(超过 250 词)的 AI 生成比例高得离谱,整体有四分之一被完全判定为 AI 写的。LinkedIn 是重灾区,超过 40% 的长文被标为纯 AI 生成;X(推特)的文章更夸张,只有 53.2% 被判定为完全人类写作,其余要么纯 AI 要么人机混合。LinkedIn 上被标记的 AI 内容里,有三分之二来自这个平台,说明很多人不介意用 AI 替自己在实名职业场合发言。
这些数字来自 Pangram 自家 Chrome 插件的用户,他们主动选择扫描并匿名分享数据,所以样本不代表所有用户,偏向于对 AI 内容敏感、会主动检测的人群。另外,AI 检测本身有误判率,正文没给出这次分析的准确率和召回率,所以“四分之一”和“超四成”这些比例要打个折看。
还缺几块关键信息:插件用户总量和扫描总条数没披露,不同平台的内容定义(比如 X 的“文章”指什么)也不清楚,LinkedIn 内置 AI 写作功能对数据的贡献有多大也没法拆开。这些缺口让结论只能当趋势参考,不能直接当成全平台真实比例。
Frigade 做了一个浏览器代理,它能登录进一个 Web 应用,盯着应用自己调用的内部 API,然后自动把这些 API 打包成带认证的“配方”(工具描述),让大模型可以直接调用。配方里包含接口地址、鉴权方式、输入输出结构,还有一段给人看的说明。应用界面改版、API 变动时,代理会自动更新配方,不用人维护代码。团队说 GraphQL 是最难标准化的接口...
#Frigade#Jira#Spotify
精选理由
精选 · 重要度 72 · 吸引力 + 知识量
一句话点评
Frigade 让浏览器代理偷看应用自己的 API 调用,自动生成带认证的工具描述给大模型用,界面改版还能自更新。但正文没给定价和上线时间,这点先别太激动。
锐评
Frigade 的思路挺取巧:不碰源码,直接派一个浏览器代理登录进 Jira、Spotify 这类应用,盯着应用自己发出的 API 请求,把接口地址、鉴权方式、输入输出结构打包成“配方”,让大模型能直接调用。这比让模型去点网页(computer-use)更稳、更快,也省 token。团队说 GraphQL 是最难标准化的接口,这点很真实,因为 GraphQL 的查询结构千变万化。
目前只有 HN 帖子和几个 demo 链接,正文没披露定价、上线时间,也没提能覆盖多少种鉴权方式。演示看着流畅,但实际落地时,不同应用的鉴权花样百出,代理能不能稳定拿到刷新 token、会不会触发风控,都还是未知数。另外,配方自动更新听起来省心,但如果应用改版太频繁,代理会不会频繁误判,也需要验证。
总的来说,这个方向解决了“让 AI 进老系统干活”的一个真实痛点,但产品成熟度还看不清。建议先拿自己公司的内部工具试试,别急着往生产环境推。
法国竞争管理局说,对英伟达的反垄断调查快结束了,很快会发正式异议声明。调查从 2023 年 9 月突击检查办公室开始,现在集中在两件事上:一是开发者被 CUDA 这个编程平台绑得太死,想换别的硬件很难;二是英伟达投资了 CoreWeave 这类 AI 云公司,监管担心这会进一步巩固它超过 70% 的全球 AI 加速器市场份额。发异议声明不等于定罪,英伟...
FEATUREDComputing Life · Share · 鸭哥调研· rssZH00:00 · 07·09
开源项目开始拒绝没人负责的 AI 代码
Zig、QEMU、Gentoo 等底层项目直接禁止 AI 生成代码,担心版权不清和安全黑盒。Godot、Django、NumPy 走中间路线:可以用 AI 辅助,但必须披露、必须有人为每一行代码负责。Linux 内核不限制工具,但死死卡住开发者原创证书(DCO)签名——AI 不是人,不能签字,责任必须落在具体开发者头上。核心变化是:社区现在要的是一条可...