ax@ax-radar:~/feed $ tail -f signal.log
33 srcsignal 65%cycle 04:32

热点聚合 · 2026-09-14

22 signals · updated 3m ago
live · 88 today·policy v2
AI HOT 精选OpenAI 发布 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6…97·HACKER NEWS 首页OpenAI 发布 GPT-6 Sol 和 Luna,API 价格砍半,主打便宜又能打96·AI HOT 精选OpenAI 在 OpenRouter 上架 GPT-6 Sol 和 Luna,价格直…95·OPENAI 博客OpenAI 成立数学顾问团,自家模型已解出 100 多道未解难题95·AI HOT 精选OpenAI 在 ChatGPT Work 和 Codex 里推送了 GPT-6 So…90·AI HOT 精选五角大楼调查:操作员太信 Maven AI 的标注,导致美军误炸伊朗学校88·AI HOT 精选Claude Opus 5.5 发布:价格砍半、速度提三成,但安全演习中约一半运行出现…88·AI HOT 精选Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1…88·HACKER NEWS 首页五角大楼报告:过度依赖 AI 导致美军导弹误炸伊朗学校88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 Luna,API 价格直接砍半88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GP…88·AI HOT 精选Claude Opus 5.5 在智能评测中拿了最高分 58,还降了 20% 的价格88·AI HOT 精选OpenAI 发布 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6…97·HACKER NEWS 首页OpenAI 发布 GPT-6 Sol 和 Luna,API 价格砍半,主打便宜又能打96·AI HOT 精选OpenAI 在 OpenRouter 上架 GPT-6 Sol 和 Luna,价格直…95·OPENAI 博客OpenAI 成立数学顾问团,自家模型已解出 100 多道未解难题95·AI HOT 精选OpenAI 在 ChatGPT Work 和 Codex 里推送了 GPT-6 So…90·AI HOT 精选五角大楼调查:操作员太信 Maven AI 的标注,导致美军误炸伊朗学校88·AI HOT 精选Claude Opus 5.5 发布:价格砍半、速度提三成,但安全演习中约一半运行出现…88·AI HOT 精选Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1…88·HACKER NEWS 首页五角大楼报告:过度依赖 AI 导致美军导弹误炸伊朗学校88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 Luna,API 价格直接砍半88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GP…88·AI HOT 精选Claude Opus 5.5 在智能评测中拿了最高分 58,还降了 20% 的价格88·AI HOT 精选OpenAI 发布 GPT-6 Sol 和 Luna,API 价格比 GPT-5.6…97·HACKER NEWS 首页OpenAI 发布 GPT-6 Sol 和 Luna,API 价格砍半,主打便宜又能打96·AI HOT 精选OpenAI 在 OpenRouter 上架 GPT-6 Sol 和 Luna,价格直…95·OPENAI 博客OpenAI 成立数学顾问团,自家模型已解出 100 多道未解难题95·AI HOT 精选OpenAI 在 ChatGPT Work 和 Codex 里推送了 GPT-6 So…90·AI HOT 精选五角大楼调查:操作员太信 Maven AI 的标注,导致美军误炸伊朗学校88·AI HOT 精选Claude Opus 5.5 发布:价格砍半、速度提三成,但安全演习中约一半运行出现…88·AI HOT 精选Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1…88·HACKER NEWS 首页五角大楼报告:过度依赖 AI 导致美军导弹误炸伊朗学校88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 Luna,API 价格直接砍半88·AI HOT 精选OpenAI 发了 GPT-6 Sol 和 GPT-6 Luna,API 价格比 GP…88·AI HOT 精选Claude Opus 5.5 在智能评测中拿了最高分 58,还降了 20% 的价格88·
RSS live
2026-09-14 · 星期一2026年9月14日
19:56
8d ago
● P1Hacker News 首页· rssEN19:56 · 09·14
Entelligence对比GPT-5.6Luna与GPT-6Astra的代码审查能力和成本
Entelligence 用 50 个真实 PR 测了这两个模型做代码审查。Luna 每百万输出 token 只要 1.2 美元,Astra 要 50 美元,单次审查成本差了 28 倍。最终 Luna 找到 69 个确认 bug,Astra 找到 92 个。但 Luna 的误报率高得多,93 条意见里有 24 条是错的,Astra 只有 4 条。在 S...
#Benchmarking#Entelligence#GPT-5.6 Luna#GPT-6 Astra
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
Luna 做代码审查每次只要 0.0041 美元,Astra 要 0.113 美元,便宜了 28 倍,但每四条评论就有一条是错的,别让它单独看权限代码。
锐评
Entelligence 拿 50 个真实 PR 测了 GPT-5.6 Luna 和 GPT-6 Astra 的代码审查能力。Luna 找出 69 个确认 bug,Astra 找出 92 个,但 Luna 总花费才 0.20 美元,Astra 花了 5.66 美元。算下来,每发现一个真 bug,Luna 的成本是 Astra 的二十分之一。 便宜归便宜,代价是准确率。Luna 提了 93 条意见,24 条被验证为误报,准确率 74%;Astra 提了 96 条,只有 4 条是错的,准确率 96%。开发团队如果每天收到一堆 AI 评论,四分之一是噪音,很快就会懒得看。 按代码库拆开看,差距主要在安全相关逻辑。在 Sentry、Discourse 和 Grafana 上,Luna 和 Astra 的差距只有一两个 bug;但在做身份认证的 Keycloak 上,Luna 只找到 6 个确认 bug,Astra 找到 14 个,而且 Luna 在 Keycloak 上的准确率掉到了 50%。安全类 bug 整体上 Luna 只抓到 9 个,Astra 抓到 19 个。 测试方法有个小瑕疵:Astra 自己也是验证裁判之一,可能略微偏向自己。正文没披露裁判模型的具体版本和 prompt 细节。另外,50 个 PR 的样本量不算大,结论能不能推广到其他语言或框架还不清楚。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
10:41
8d ago
● P1Hacker News 首页· rssEN10:41 · 09·14
Anthropic CEO 呼吁监管减速前沿 AI 研发,律师质疑监管权力风险
Anthropic 的 CEO Dario Amodei 发了篇文章,主张用监管给 AI 研发踩刹车,具体包括往公司里安插第三方评估员、让头部实验室统一安全标准。律师 Preston Byrne 直接怼了回去,他过去一年半都在跟网络审查机构打官司。他的核心反驳是:在美国,写代码属于言论自由,往公司里塞 NGO 评估员,跟之前搞出“审查工业复合体”的 G...
#Anthropic#Dario Amodei#OpenAI
精选理由
精选 · 重要度 100 · 吸引力 + 知识量 + 共鸣
一句话点评
Anthropic 和 OpenAI 的 CEO 同时喊刹车,但两家都没说清楚“慢下来”具体怎么量、谁来查,先别太激动。
锐评
Anthropic 的 CEO Dario Amodei 发了一篇博客,呼吁给最前沿的 AI 研发“踩刹车”,并提了三条大致方向。Sam Altman 随后在 X 上跟帖说 OpenAI 也会跟进其中一条,即开放独立评估者访问。这事的背景是 Anthropic 内部刚有安全研究员辞职,公开说大厂在“拿人命赌博”。Amodei 的博客没直接回应辞职事件,但整篇基调明显是在接住这波压力。 TechCrunch 这篇报道把各方表态串了起来,但关键细节是缺的:Amodei 说的“单方面承诺”到底覆盖哪些模型、什么能力阈值才触发减速,正文没披露。Altman 的附议也停留在社交平台一句话,没有正式政策文件。另外,Cohere 的 CEO 等人公开质疑他俩的真实动机,认为这可能是大厂在给自己筑护城河。 如果这两家真能拿出一套可验证的降速标准,比如算力上限或评测分数红线,那确实值得看。现在只有呼吁和表态,缺执行方案和第三方监督机制,说服力要打个折。
HKR 分解
hook knowledge resonance
打开信源
100
SCORE
H1·K1·R1
10:28
8d ago
● P1Hacker News 首页· rssEN10:28 · 09·14
AI巨头推出前沿限速监管框架引发监管俘获争议
Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman、微软的 Satya Nadella 和 Elon Musk 罕见地共同提出了一套叫“Pace the frontier”的监管方案。这套方案只盯着他们口中“最前沿的模型”管,小公司和开源项目完全不受影响。The Register 直接点破:这就是典型的监管俘获——...
#Anthropic#OpenAI#Microsoft
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
AI 巨头联手推了个“前沿限速”监管框架,名字好听,但本质是让大厂自己定规则,小玩家可能直接被挡在门外。
锐评
这事说白了就是几个 AI 大厂的老板——Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman、微软的 Nadella 还有马斯克——坐在一起搞了个叫“Pace the frontier”的监管方案,想让政府按他们的节奏来管 AI。The Register 直接把这叫“监管俘获”,意思是大公司通过参与制定规则,把监管变成自己的护城河。 目前文章没披露这个框架的具体技术门槛,比如算力达到多少 FLOPs 就要报备、模型参数量多大算“前沿”。但核心逻辑是让现有巨头来定义什么是危险的 AI,然后由政府背书。好处是如果真的能统一标准,能避免各州或各国各管各的;坏处也很明显,新创公司可能连入场券都拿不到,因为合规成本会被拉得极高。 还缺两个关键信息:一是这个方案有没有给开源模型留活路,二是除了这几家发起方,有没有独立的第三方机构参与监督。如果最后只是几个大厂关起门来写规则,那与其说是监管,不如说是行业垄断协议。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1

更多

频道

后台