ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部

50 items · updated 3m ago
RSS live
2026-07-05 · 星期日2026年7月5日
21:00
23d ago
FT · 科技· rssEN21:00 · 07·05
英国金融监管机构警告:金融机构抢着用AI,监管快跟不上
英国金融行为监管局(FCA)说,金融机构在交易、风控和客服上抢着部署AI,已经形成一场“军备竞赛”,监管机构必须拼命追赶。FCA担心,如果AI用得又快又广,可能带来系统性风险——比如多个机构用同一套模型,一出错就连锁反应。正文没披露具体案例或时间表,所以这点先别太激动,但监管的焦虑是真实的。
#Financial Conduct Authority (FCA)
一句话点评
英国FCA警告金融机构在交易、风控和客服上抢着用AI,已经形成监管追不上部署的“军备竞赛”。FCA最担心的是系统性风险——如果多家机构用同一套模型,一出错就是连锁反应。正文没披露具体案例或时间表,所以这点先别太激动,但监管的焦虑是真实的。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
18:47
23d ago
Hacker News 首页· rssEN18:47 · 07·05
达特茅斯统计课试点:AI 教材把期末成绩拉高了 0.71 到 1.30 个标准差
达特茅斯学院在一门 151 人的统计入门课上试用了叫 Phosphor 的 AI 学习平台。平台把 AI 批改的小测验直接嵌进阅读材料里,学生可以反复刷,不计分、不强制。结果 90.2% 的学生主动用了,而老师估计平时只有 10% 到 15% 的人会看教材。在控制先前考试成绩后,完整使用平台的学生期末成绩提升了 0.71 个标准差;不控制的话,提升幅度...
#RAG#Dartmouth College#Phosphor#Claude Sonnet 4.6
一句话点评
达特茅斯一门统计课试了个叫 Phosphor 的 AI 平台,把 AI 批改的小测验直接塞进阅读材料里,结果 90% 的学生主动用了,而老师估计平时只有 10% 到 15% 的人会看教材。在控制先前成绩后,完整使用的学生期末成绩提升了 0.71 个标准差,不控制的话是 1.30 个标准差。这个效果量不小,但得打个折:论文没报告 AI 批改和人工批改的一致性有多高,而且因为学生抱怨 AI 批改...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
17:43
23d ago
AI HOT 精选· aihot-apiZH17:43 · 07·05
三周前,我不小心创办了一家小公司
一位父亲为不会说话的自闭症儿子做了个沟通App,第一次带去言语治疗候诊室,所有妈妈和治疗师都看哭了。他意外找到了产品-市场匹配,决定即使再忙也要把这个App做出来。文章还详细讲了发现孩子语言发育迟缓的漫长过程,以及如何避开各种伪科学骗局。
一句话点评
一位父亲为不会说话的自闭症儿子做了个沟通App,第一次带去言语治疗候诊室,所有妈妈和治疗师都看哭了。他意外找到了产品-市场匹配,决定即使再忙也要把这个App做出来。文章还详细讲了发现孩子语言发育迟缓的漫长过程,以及如何避开各种伪科学骗局。
HKR 分解
hook knowledge resonance
打开信源
39
SCORE
H1·K0·R1
17:05
23d ago
● P1Hacker News 首页· rssEN17:05 · 07·05
扎克伯格承认AI智能体进展不及预期
扎克伯格在内部全员会上说,AI 智能体(让模型进业务流程干活的代理)的开发速度没达到高管预期。Meta 5 月刚裁了约 8000 人,又把 7000 人转岗到 AI 部门,但他承认这次裁员不够“干净”,新的 AI 架构也还没见到回报。他预计未来 3 到 6 个月能看到 AI 投资的成效。Meta 今年计划在 AI 基础设施上砸最多 1450 亿美元。不...
#Agent#Meta#Mark Zuckerberg
精选理由
精选 · 重要度 96 · 吸引力 + 知识量 + 共鸣
一句话点评
扎克伯格对内承认 AI 智能体没他想的快,裁员换岗也没换来效率,这盆冷水比外部报告真实。
锐评
Meta 砸了 1450 亿美元搞 AI 基建,结果 CEO 自己在内部会上说,让模型进业务流程干活的进度没达到预期。这等于官方盖章了之前工程师吐槽“AI 部门像苦力营”的说法。年初裁了 8000 人、调了 7000 人去做 AI 转型,扎克伯格现在承认这次调整不够干净,预期的正面效果还没兑现。他押注未来三到六个月能看到回报,但正文没给出任何具体指标或产品数据来支撑这个时间表。这条新闻的价值在于,它来自内部会议而非公关稿,直接暴露了顶级大厂在 AI 落地上的真实卡点:钱砸了、人动了,但让 AI 真正替代复杂人工流程,比预想中难得多。
HKR 分解
hook knowledge resonance
打开信源
96
SCORE
H1·K1·R1
15:00
23d ago
FT · 科技· rssEN15:00 · 07·05
数据中心是检验美国工业决心的试金石
FT这篇评论认为,大规模建数据中心不只是AI基础设施问题,更是美国制造业能力的政治测试。审批流程、电网容量、供应链全暴露了短板。如果连数据中心都建不顺,其他高端制造也别想。正文没给具体数字或案例,但逻辑很直接:基建能力是工业实力的底牌。
#Financial Times
一句话点评
FT这篇评论把数据中心建设拔高到了“美国工业决心”的政治测试。核心逻辑很直接:如果连审批、电网、供应链这些基建环节都搞不定,那AI基础设施和高端制造都是空谈。正文没给具体数字或案例,更像一篇立场鲜明的社论。对从业者来说,提醒了一个容易被忽视的非技术瓶颈——基建能力。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R1
13:39
23d ago
Product Hunt · AI· rssEN13:39 · 07·05
CodeMote:用 iPhone 远程操控 Claude Code 和 Codex
CodeMote 是一个 iOS 应用,让你在 iPhone 上远程控制电脑或 VPS 上的命令行 AI 代理(比如 Claude Code、Codex 这类 CLI 工具)。它把终端直接搬到锁屏上,代理需要你批准时会推送通知,还能看完整的代码差异和 Git 操作流程。连接是端到端加密的,你的代码不会经过他们的服务器。正文没披露具体定价,只说有免费选项...
#CodeMote#Claude Code#Codex
一句话点评
短评:iPhone 远程批准 AI 代理操作,锁屏看终端,挺实用。 点评:CodeMote 把 Claude Code、Codex 这类命令行 AI 代理的终端搬到了 iPhone 锁屏上,代理需要你批准时会推送通知,还能看完整代码差异和 Git 操作流程。连接是端到端加密的,代码不经过他们的服务器——这点对担心代码泄露的团队比较友好。但正文没披露具体定价,只说有免费选项和 1 个月免费试...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
13:33
23d ago
Product Hunt · AI· rssEN13:33 · 07·05
Nixmac:用大白话描述 Mac 配置,它自动生成 Nix 代码
Nixmac 让你用自然语言描述想要的 Mac 环境,比如“装个 Node 18 和 VS Code”,它自动转成 Nix 配置并安全应用。目标用户是那些想用 Nix-darwin 做可复现、版本控制的系统,但不想手写 Nix 的开发者。刚在 Product Hunt 上线,免费开源。正文没披露用了哪个模型做自然语言到 Nix 的翻译,也没说准确率或回...
#Nixmac#Nix#Nix-darwin#Open source
一句话点评
用自然语言描述 Mac 环境(比如“装 Node 18 和 VS Code”),自动转成 Nix 配置并安全应用。目标用户是想要可复现、版本控制系统的开发者,但不想手写 Nix。免费开源,刚上 Product Hunt。正文没披露用了哪个模型做翻译,也没说准确率或回滚机制。如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
12:31
23d ago
Product Hunt · AI· rssEN12:31 · 07·05
Mozaik:让AI Agent团队自己组织自己干活的TypeScript运行时
Mozaik 是一个 TypeScript 运行时,专门用来搭建能自我组织的 AI Agent 团队。它让多个 Agent 可以同时干活、根据事件自动触发响应、互相沟通,并且在执行过程中自主决定怎么协作。说白了,就是不用你手写一堆编排逻辑,Agent 们自己商量着来。目前正文没披露具体的性能基准或技术实现细节,所以效率提升幅度和资源消耗还不清楚。对做复...
#Mozaik#JigJoy
一句话点评
Mozaik 是一个 TypeScript 运行时,让多个 AI Agent 自己商量着干活,不用你手写编排逻辑。它支持并发、事件触发和自主协作,听起来挺省事。但正文没披露性能基准和资源消耗,效率提升幅度要打个问号。对做复杂多 Agent 系统的开发者来说,值得关注,但先别急着上生产。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R0
07:59
23d ago
Hacker News 首页· rssEN07:59 · 07·05
知识不该被锁在格式墙里:Google OKF 让 LLM 直接读纯 Markdown
Formaly 这篇博客的核心观点是:过去几年大家做 RAG(外挂资料库),把文档切碎、转成向量、塞进向量数据库,最后知识变成只能通过 API 查询的东西,人反而读不了。但 Claude Code、Codex 这些工具已经证明,LLM 最喜欢读的就是纯 Markdown 文件,比如 CLAUDE.md。Andrej Karpathy 提出的 LLM W...
#Google#Andrej Karpathy#Formaly
一句话点评
RAG 把文档切碎塞进向量库,人反而读不了。Karpathy 的 LLM Wiki 模式反其道:三层纯 Markdown 文件(sources/、wiki/、schema),模型自己维护知识库,每次查询省掉“检索税”。Google 刚出的 Open Knowledge Format v0.1 想把它变成厂商中立标准。正文没披露任何基准测试或落地案例,所以“格式墙比付费墙更可怕”这个判断还缺验...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H0·K1·R0
07:50
23d ago
AI HOT 精选· aihot-apiZH07:50 · 07·05
LlamaIndex 开源 legal-kb:给大模型配四个工具,像律师助理一样翻法律文档
LlamaIndex 开源了一个叫 legal-kb 的参考应用,基于 Index v2 构建。核心思路是给模型配四个工具——retrieve(检索)、find(定位)、read(读取)、grep(关键词搜索),让它像律师助理一样在大量法律文档里找信息。正文没披露任何性能数据或真实落地案例,但方向挺实在:把让模型进业务流程干活(agent workfl...
#LlamaIndex#Open source
一句话点评
LlamaIndex 开源了一个法律文档检索参考应用,核心是给模型配四个工具:检索、定位、读取和关键词搜索,让它像律师助理一样干活。方向很实在,但正文没披露任何性能数据或真实案例,效果未知。如果是真的,这种把模型塞进专业流程的思路比通用聊天机器人靠谱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
07:25
23d ago
Hacker News 首页· rssEN07:25 · 07·05
软件快就是好:速度是工程质量的信号
Craig Mod 认为软件速度是工程质量和信任的代理指标。他举了 nvALT 和 Sublime Text 的例子:毫秒级的响应让工具感觉像身体的一部分,而 Ulysses 偶尔的卡顿会侵蚀信心。Adobe Lightroom 和 Photoshop 越来越慢,导致他花钱买了 Affinity Photo 和 Figma——后者虽然是浏览器里的,但快...
#Craig Mod#nvALT#Sublime Text
一句话点评
Craig Mod 这篇讲软件快就是好,举了 nvALT 和 Sublime Text 秒开不卡顿的例子,说慢会让人怀疑工程质量甚至丢数据。他因为 Lightroom 变慢,自己掏钱买了 Affinity Photo 和 Figma——后者虽然是浏览器里的,但快得让他惊喜。核心观点:速度是信任的代理指标,也是商业资产,Sketch 当年就是靠比 Adobe 快抢了市场。不过全文都是个人体验,...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
05:01
23d ago
Hacker News 首页· rssEN05:01 · 07·05
Mouse:给AI编程助手上个“手术刀”,改文件不再靠瞎替换
HIC Mouse 是一个 VS Code 插件,专门解决 AI 编程助手改代码时只会“全文替换”的毛病。它提供了 INSERT、DELETE、ADJUST 等六种基于坐标的编辑指令,让 AI 能像做手术一样精准修改文件,而不是整段替换。所有改动会先暂存,你可以逐条检查、批准、驳回甚至让 AI 重新改,改错了也能一键回滚。工具返回的信息里还自带风险提示...
#Code#HIC AI#HIC Mouse
一句话点评
短评:AI 编程助手改代码终于不用全文替换了,像用手术刀一样精准插入、删除、调整,改完还能逐条审批或回滚。 点评:HIC Mouse 是个 VS Code 插件,核心卖点是让 AI 编程助手不再只会“全文替换”改代码。它提供 INSERT、DELETE、ADJUST 等六种基于坐标的编辑指令,AI 可以像做手术一样精准修改文件某一行或某一段,而不是整段重写。所有改动会先暂存,你可以逐条检查...
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
02:54
23d ago
Hacker News 首页· rssEN02:54 · 07·05
Backon:Python 重试库,零依赖、自带熔断、原生异步
Backon 是一个 Python 重试库,主打零外部依赖、原生支持异步,还内置了熔断器(电路 breaker,防止反复请求已挂的服务)。适合给微服务或 API 调用加容错。目前 HN 上 5 分、0 评论,热度不高但设计扎实。正文没给基准测试,也没跟 tenacity 对比,性能得自己跑一下。
#Backon#GitHub#Open source
一句话点评
Backon 是一个 Python 重试库,零依赖、原生支持异步,还内置了熔断器(防止反复请求已挂的服务)。适合给微服务或 API 调用加容错。目前 HN 上 5 分、0 评论,热度不高但设计扎实。正文没给基准测试,也没跟 tenacity 对比,性能得自己跑一下。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
00:00
23d ago
AI HOT 精选· aihot-apiZH00:00 · 07·05
ResearchStudio-Reel:一篇论文自动生成海报、视频和博客,还能用PPT再编辑
微软开源了一套管线,能把一篇论文自动转成可编辑的海报、讲解视频和双语博客。核心思路是只提取一次论文内容,然后复用给下游所有生成任务。在海报生成基准上,它比之前的自动化系统和单次调用的大模型在84%到93%的论文上表现更好。不过正文没披露跑一次要花多少钱、延迟多高,这点先别太激动。
#Microsoft#Claude Code#Codex
一句话点评
微软开源了一套管线,能把论文自动转成可编辑的海报、讲解视频和双语博客。核心思路是只提取一次论文内容,然后复用给下游所有生成任务。在海报生成基准上,它比之前的自动化系统和单次调用的大模型在84%到93%的论文上表现更好。不过正文没披露跑一次要花多少钱、延迟多高,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
2026-07-04 · 星期六2026年7月4日
23:51
23d ago
Hacker News 首页· rssEN23:51 · 07·04
Zo Computer:一个用自然语言控制的云电脑,能帮你建站、跑业务、调AI模型
Zo Computer 是一个云端的个人电脑,你通过聊天就能操作它——建网站、跑业务、调用AI模型。它集成了 OpenAI、Anthropic、Google、DeepSeek 等模型,还能连 Slack、Discord、Gmail 等1000多个工具。有用户说用它替换了12个工具,几分钟就建好了网站。免费版有每日用量限制,付费才能解锁全部模型。Zo 自...
#Agent#Zo Computer#OpenAI#Anthropic
一句话点评
Zo Computer 是一个聊天就能操作的云端电脑,号称能替代12个工具,几分钟建站。它集成了 OpenAI、Anthropic 等模型和1000多个外部工具(Slack、Gmail 等),免费版有每日用量限制。 短评:听起来像“AI 版操作系统”,但更像一个套了聊天界面的自动化工作流平台。 关键信息缺口:正文没披露具体定价、模型版本和延迟。用户案例全是个人建站,没提企业级场景或复杂业...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
23:25
23d ago
Hacker News 首页· rssEN23:25 · 07·04
RidgeText 用内存图层队列拼地图,让大模型不用碰 GeoJSON 原始数据
RidgeText 的做法是把地图数据留在服务器内存里,大模型只收到“已排队 847 个要素”这种轻量回执,最后调用 generate_map 合成一张图。单一个野火数据集就能吃掉 12.5 万 token,直接塞进上下文又贵又容易出错。他们的方案模仿了 Mapbox 的图层模型:每个 retrieve_* 工具往内存队列里追加一个图层,渲染时按调用顺...
#RidgeText#Mapbox
一句话点评
RidgeText 把地图数据留在服务器内存,大模型只收到“已排队 847 个要素”这种轻量回执,最后调用 generate_map 合成一张图。单一个野火数据集就能吃掉 12.5 万 token,直接塞进上下文又贵又容易出错。他们的方案模仿了 Mapbox 的图层模型:每个 retrieve_* 工具往内存队列里追加一个图层,渲染时按调用顺序叠加。队列 30 分钟过期。渲染器目前用 Map...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
21:51
24d ago
Hacker News 首页· rssEN21:51 · 07·04
有人发现 GPT-5.5 Codex 的推理 token 总扎堆在 516、1034、1552 这几个位置,怀疑这会拉低复杂任务的代码质量
这是一条来自 OpenAI Codex 仓库的社区反馈,不是官方公告。发帖人观察到 GPT-5.5 在生成代码时,它的“思考过程”(推理 token)会规律性地聚集在第 516、1034 和 1552 个 token 附近。发帖人觉得这种扎堆现象不是巧合,可能意味着模型在处理复杂逻辑时,注意力被某些固定位置带偏了,导致最终写出来的代码质量下降。不过,帖...
#Code#Reasoning#OpenAI#GPT-5.5
一句话点评
有人在 OpenAI Codex 仓库报了个 bug:GPT-5.5 写代码时,推理 token 会规律性地在第 516、1034、1552 个位置扎堆,怀疑是注意力被固定位置带偏,导致复杂任务代码质量下降。目前只是社区观察,没有复现步骤、基准测试或 OpenAI 回应,先别太激动。如果是真的,说明模型内部推理路径可能被训练数据里的某种模式锁死了,修起来不一定容易。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
19:50
24d ago
● P1Hacker News 首页· rssEN19:50 · 07·04
AI冲击初级程序员就业但软件开发者总人数仍在增长
斯坦福数字经济实验室根据 ADP 工资单数据发现,美国 22 到 25 岁软件开发者的就业人数比 2022 年底的高点跌了 19%,而 41 到 49 岁的反而涨了 14%。就算排除公司自身经营波动的影响,在 AI 能直接替代人干活的岗位上,年轻从业者还是相对减少了 16%。初级岗位招聘量少了 28%,计算机专业毕业生失业率到了 6.1%,比文科生还高...
#Code#Stanford Digital Economy Lab#ADP#Bureau of Labor Statistics
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
初级程序员岗位确实被AI烧了,但写代码的人反而更多了,只是他们不再叫“程序员”。
锐评
这条信息最核心的判断是:AI并没有消灭编程工作,而是消灭了“初级程序员”这个岗位名称。斯坦福基于ADP工资单的数据显示,22-25岁美国软件开发者就业人数从峰值跌了19%,而41-49岁群体同期涨了14%。这个对比很残酷,也直接反驳了“大环境不好”的笼统说法——如果只是市场差,被裁的应该是更贵、更年长的员工,而不是最便宜的年轻人。 数字背后的结构变化更值得看。美国劳工统计局的数据显示,“计算机程序员”(按别人的规格写代码)这个职业一年内掉了16%,而数据分析师涨了12%。同时,GitHub一年新增3600万账号,80%的新人第一周就用上了Copilot;苹果App Store新应用提交量在连跌八年后,2025年反弹了24%。这说明写代码的门槛被AI打下来了,大量新人涌入,但他们干的是直接出产品的活,不再从“按规格写代码”的初级岗位做起。 文章没给出这些新人的收入中位数和留存率,也没说清“不再叫程序员”的人具体被统计进了哪些职业分类。如果这部分数据缺失,我们就没法判断这波新增到底是健康的职业扩散,还是低薪零工化的前兆。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
18:00
24d ago
TechCrunch AI· rssEN18:00 · 07·04
Midjourney 要求好莱坞片厂在版权官司中公开自己怎么用 AI
Midjourney 跟迪士尼、环球、华纳兄弟的版权官司打到了证据开示阶段。片厂去年告 Midjourney 能生成他们版权的角色,Midjourney 辩称训练属于合理使用。现在 Midjourney 反过来要求片厂交出自己内部用 AI 的细节,法官已裁定片厂必须提供部分信息,但具体要交哪些文件双方还在扯皮。
#Vision#Midjourney#Disney#Universal
一句话点评
Midjourney 在版权官司里反手要求迪士尼、环球、华纳交出自己用 AI 的内部记录,法官已经裁定片厂必须提供部分信息。这招挺聪明:你不是说我用你的角色训练模型吗,那你先说说自己有没有用 AI 生成剧本、概念图或者做后期。目前双方还在为具体交哪些文件扯皮,正文没披露片厂实际用了多少 AI 工具。如果真能逼出内部数据,这场官司的焦点可能从“AI 偷素材”变成“大家都在用,只是说不说”。
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R1
16:55
24d ago
Hacker News 首页· rssEN16:55 · 07·04
Plein Air:根据你窗外的天气,给你挑一幅名画
打开网站,它用你的实时天气(免费 Open-Meteo 数据)从大都会、芝加哥艺术馆等博物馆的公有领域藏画里,随机挑一幅应景的——下雨就给你看莫奈的干草堆,起雾就找一幅雾中河景。点标题能看为什么选这幅。不依赖 AI,纯靠天气标签匹配,所以匹配精度有限,但胜在简单浪漫。正文没提移动端适配和加载速度,不过画是高清图,网络差时可能会等。
#The Metropolitan Museum of Art#Art Institute of Chicago#Cleveland Museum of Art
一句话点评
一个浪漫的小项目:根据你当下的实时天气,从大都会、芝加哥艺术馆等博物馆的公有领域藏画里随机挑一幅应景的——下雨看莫奈干草堆,起雾找雾中河景。不依赖AI,纯靠天气标签匹配,所以匹配精度有限,但胜在简单。画是高清图,网络差时可能会等,正文没提移动端适配。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
16:30
24d ago
Hacker News 首页· rssEN16:30 · 07·04
Zig 把包管理全挪出编译器,二进制体积缩小 4%
Zig 语言作者 Andrew Kelley 把包管理相关的所有逻辑(包下载、HTTP 客户端、TLS、Git 协议、压缩库等)从编译器进程移到了构建系统进程里。现在这些代码以源码形式分发,而不是编译进二进制,用户可以直接修改,不用重新编译编译器。编译器二进制从 14.1 MiB 缩到 13.5 MiB,小了 4%。网络相关代码现在跑在 Release...
#Zig#Andrew Kelley#ZLS
一句话点评
Zig 把包管理从编译器拆到构建进程,编译器二进制从 14.1 MiB 缩到 13.5 MiB(-4%)。网络代码现在跑在 ReleaseSafe 模式,安全检查和 CPU 优化都开了。用户可以直接改源码,不用重编编译器。但还有 4 个阻塞问题没解决,作者说最快 8 月初才能收尾。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
15:51
24d ago
TechCrunch AI· rssEN15:51 · 07·04
Mistral AI 不是欧洲版 OpenAI,别抱错期待
TechCrunch 给法国 AI 实验室 Mistral 做了个全景扫描,核心观点是:把它当成“欧洲的 OpenAI”来评判,注定会失望。它的聊天产品 Vibe(原名 Le Chat)品牌认知度远不如 ChatGPT,连巴黎 Station F 创业园区的创始人里,用 Claude 的都比用 Mistral 多。Mistral 2023 年成立以来融...
#Mistral AI#OpenAI#Anthropic#Open source
一句话点评
Mistral 被 TechCrunch 定性为“欧洲的 OpenAI”这个标签不准确。文章指出其聊天产品 Vibe 品牌认知度远低于 ChatGPT,连巴黎创业园区里用 Claude 的人都比用它的多。关键信息缺口:文章没披露 Mistral 的具体融资额、估值、营收或用户数,所以无法判断其商业健康度。短评:别拿 OpenAI 的尺子量 Mistral,它更像一个开源模型公司,C 端产品目...
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H0·K0·R0
14:17
24d ago
Product Hunt · AI· rssEN14:17 · 07·04
Scarlett. 把 AI 同事塞进 Slack 和 iMessage
Scarlett. 今天在 Product Hunt 上线,定位是“AI 同事”,不是普通聊天机器人。它直接跑在 Slack 和 iMessage 里,号称能自动跑流程甚至让公司“自动驾驶”。背后是 Ben Lang 团队,模型用 Anthropic Claude。免费档送 2 倍积分(标价 200 美元)。但正文没具体说支持哪些工作流,也没提延迟。S...
#Agent#Scarlett.#Ben Lang#Anthropic Claude
一句话点评
Scarlett. 把自己包装成“AI 同事”而非聊天机器人,直接嵌入 Slack 和 iMessage,口号是让公司“自动驾驶”。背后是 Ben Lang 团队,模型用 Anthropic Claude。免费档送 2 倍积分(标价 200 美元),但正文没披露具体支持哪些工作流,也没提延迟。Slack 机器人遍地都是,能不能真当同事看,得看集成深度。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
05:37
24d ago
Hacker News 首页· rssEN05:37 · 07·04
2026 年 Unslop AI 小说比赛结果:1 万美元大奖颁给《六月》
Hyperstition 的 Unslop 比赛结果出炉,A. Best 凭《六月》拿走 1 万美元大奖。流程:约 120 人报名,每人拿到一个月的 Claude Code 订阅或等值现金,用来写一条 prompt 生成一篇短篇小说。评委从约 15 篇半决赛作品中选出 6 篇决赛作品,每人再交第二篇故事。正文没披露评委是谁、评分标准是什么。
#Hyperstition#A. Best#Aaron Silverbook
一句话点评
A. Best 用 Claude Code 写的小说《六月》拿了 1 万美元大奖。比赛流程:120 人报名,每人拿一个月 Claude Code 订阅或等值现金,写一条 prompt 生成一篇短篇。评委从约 15 篇半决赛里挑出 6 篇决赛,每人再交第二篇。正文没披露评委是谁、评分标准,所以这个奖的含金量不好判断。但至少说明,用 AI 写小说已经能产出让人愿意读的东西了。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
04:00
24d ago
FT · 科技· rssEN04:00 · 07·04
这件裙子到底是谁设计的?时尚界对AI的焦虑
FT这篇报道讲的是时尚圈对生成式AI的版权焦虑。品牌和设计师担心,AI生成的图案、版型甚至整件设计没有法律保护,人和机器的创作边界越来越模糊。文章举了个例子:有个品牌用Midjourney出图后被指控抄袭独立设计师。欧盟要求披露训练数据的新规,也可能影响时装周。目前没有统一解决方案,品牌们各自在试水印、区块链溯源和内部伦理指南。
#Financial Times#Midjourney#European Union
一句话点评
时尚圈开始怕AI了——用Midjourney出图可能被指控抄袭,因为AI生成的图案、版型没有版权保护。FT这篇报道点出一个核心矛盾:欧盟要求披露训练数据的新规可能影响时装周,但品牌目前只能自己试水印、区块链溯源和内部伦理指南,没有统一解法。正文没披露具体品牌因AI吃官司的案例数量,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
50
SCORE
H0·K0·R0
01:30
24d ago
Hacker News 首页· rssEN01:30 · 07·04
CueBench 上线:给你的 AI 编程操作打分
CueBench 发布了一个工具:上传你与 AI 编程助手的对话日志,它会从四个维度给你打 0-100 分,并给出改进建议。分数只有你自己能看到,日志文件评分后即删除。正文没披露具体是哪四个技能,也没说支持哪些 AI 工具。
#CueBench#Benchmark
一句话点评
CueBench 出了个新工具:上传你与 AI 编程助手的对话日志,它会从四个维度给你打 0-100 分,并给出改进建议。分数只有你自己能看到,日志文件评分后即删除。正文没披露具体是哪四个技能,也没说支持哪些 AI 工具。如果是真的,挺省钱——不用请人评审,自己就能复盘。但这点先别太激动:评分标准不透明,样本只有你自己的日志,验证弱。
HKR 分解
hook knowledge resonance
打开信源
45
SCORE
H1·K0·R0
00:00
24d ago
Computing Life · Share · 鸭哥调研· rssZH00:00 · 07·04
AI 跑分就像电车比零百:能赢关注,赢不了定价权
文章用汽车文化解释 AI 模型刷榜。零百加速是电车最容易赢的指标,就像 MMLU 或 SWE-bench 分数之于模型,一个数字定输赢,成了粉丝“赛博斗蛐蛐”的战场。但 Dodge Demon 170 零百约 1.7 秒,价格却卖不过法拉利。MIT 跟踪 OpenRouter 五个月数据发现,开源模型 13 周内就能在跑分上追平闭源,但闭源模型仍拿走 ...
#Benchmarking#MIT#OpenRouter#Ferrari
一句话点评
这篇把 AI 刷榜比作电车比零百加速,比喻很准。MIT 的数据是硬货:开源模型 13 周就能在跑分上追平闭源,但闭源仍拿走 80% 用量和 96% 收入。这说明 benchmark 只是入场券,不是定价权。文章没给解法,但点出了关键:13 周窗口期里,把高分转化成用户工作流里的默认位置,才可能在分数被追平后继续收费。缺的是具体案例——到底哪些产品靠“不可复制”的上下文或工作流深度守住了定价,...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
2026-07-03 · 星期五2026年7月3日
22:34
25d ago
Hacker News 首页· rssEN22:34 · 07·03
GitFut:把你的 GitHub 主页做成世界杯球星卡
GitFut 是一个把 GitHub 用户数据转成 FIFA 风格球星卡的小工具,评分上限 99。输入用户名就能生成一张卡,比如 Linus Torvalds 拿到 96 分,属性包括 PAC(速度)、SHO(射门)、DEF(防守)等。项目已有 921 个 GitHub Star,累计生成了 15 万张卡。正文没披露评分算法和属性权重,只展示了前端输出...
#GitHub#Younes#Mawsis
一句话点评
GitHub 数据被做成了 FIFA 球星卡,Linus Torvalds 96 分,ThePrimeagen 94 分。项目已生成 15 万张卡,921 个 Star。但评分算法和属性权重完全没披露,PAC、SHO 这些数值怎么算出来的?目前就是个前端玩具,别当真。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
22:31
25d ago
Dwarkesh Patel 访谈· atomEN22:31 · 07·03
数学家以后的工作可能是当艺术策展人
Grant Sanderson 在视频里说,未来数学发现可能由 AI 自动完成,而人类数学家会转向策展——挑选和解读那些有美感的数学结果。正文没展开讲具体怎么操作或时间线,所以这点先别太激动,但方向挺有意思:如果发现变成流水线,审美和判断就成了稀缺能力。
#Grant Sanderson
一句话点评
Grant Sanderson 说未来数学家会变成艺术策展人——AI 自动做数学发现,人类负责挑好看的。方向有意思,但正文没披露具体怎么操作或时间线,所以先别太激动。如果发现真变成流水线,审美和判断确实就成了稀缺能力。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
21:49
25d ago
Hacker News 首页· rssEN21:49 · 07·03
Wafer 在 AMD MI355X 上跑 GLM5.2,每节点吞吐 2626 tok/s,成本不到 Blackwell 的一半
Wafer 用 AMD MI355X 部署了 GLM-5.2 模型,在 20k 输入、1k 输出、60% 缓存命中的典型负载下,单节点跑到每秒 2626 个 token,同时首 token 延迟控制在 0.81 秒以内。这个速度大约是 B200 的八成,但每块钱能买到的性能明显更高——他们估算成本不到 Blackwell 方案的一半。具体做法是把模型用...
#Inference-opt#Wafer#AMD#MI355X
一句话点评
Wafer 在 AMD MI355X 上跑 GLM-5.2,单节点吞吐量做到每秒 2626 token,单流解码 213 tok/s。他们估算成本不到 B200 方案的一半,但速度只有 B200 的八成左右。这个性价比挺实在,不过正文没披露具体定价和可用区域,所以“便宜一半”这个数得先打个折。 他们用了 MXFP4 量化,精度损失很小,推理框架选了 sglang,还修了两个 MTP 的 b...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
21:28
25d ago
Hacker News 首页· rssEN21:28 · 07·03
软件,从第一性原理讲起
一篇54分钟的长文,从机械计算器一路讲到操作系统和网络,目标是让非程序员也能搞懂计算机到底怎么工作。作者用齿轮模拟器解释进位机制,用芯片显微照片展示内存和逻辑电路的区别——你能肉眼看出左边规整的方块是缓存,右边不规则的区域是运算单元。全文不涉及任何具体模型、框架或公司产品,纯粹是概念科普。适合想补计算机基础但不想啃教材的人,但如果你已经在做AI工程,这...
一句话点评
一篇54分钟的计算机原理科普,从齿轮计算器讲到操作系统和网络,用芯片显微照片直观展示内存和逻辑电路的区别。不涉及任何AI模型或框架,纯概念扫盲。适合想补基础的非程序员,但对AI从业者来说信息密度偏低,没有实操价值。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
21:14
25d ago
Product Hunt · AI· rssEN21:14 · 07·03
Termi Protocol:给AI编程Agent套上3D可视化皮肤,像看游戏一样看它写代码
Termi Protocol 是一个3D模拟层,给AI编程Agent分配一张脸、一张桌子和一个房间,实时可视化它们的读、写、运行操作,效果像游戏画面。你仍然跑Agent,它只负责把过程画出来。正文没披露支持哪些Agent框架、是否开源,也没说性能开销有多大——这点先别太激动,如果可视化本身很重,反而可能拖慢Agent干活。
#Termi Protocol
一句话点评
给AI编程Agent加一层3D可视化,每个Agent有脸有桌有房间,读、写、运行操作实时渲染成游戏画面。想法挺酷,但正文没披露支持哪些Agent框架、是否开源,也没说性能开销有多大——这点先别太激动,如果可视化本身很重,反而可能拖慢Agent干活。如果是真的轻量,调试和演示场景会很有用。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
21:03
25d ago
Hacker News 首页· rssEN21:03 · 07·03
ContextCodeCache:用 Rust 缓存 LLM 上下文,省 token 降延迟
这是一个开源的 Rust 工具,把 LLM 的上下文窗口缓存起来,重复输入不用重新算。高频场景比如代码补全或聊天历史,能省 token 费用和延迟。正文没披露具体节省了多少或基准测试,所以先别太激动,但思路挺直接:缓存上下文,减少重复计算。
#ContextCodeCache#Rust
一句话点评
一个用 Rust 写的开源工具,把 LLM 的上下文窗口缓存起来,重复输入不用重新算。思路很直接:高频场景(比如代码补全、聊天历史)能省 token 费用和延迟。但正文没披露具体省了多少、有没有基准测试,所以先别太激动。如果是真的,挺省钱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0

更多

频道

后台