ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
40 srcsignal 72%cycle 04:32

全部 · 2026-07-08

50 items · updated 3m ago
RSS live
2026-07-08 · 星期三2026年7月8日
22:41
19d ago
TechCrunch AI· rssEN22:41 · 07·08
瑞典“氛围编程”公司 Lovable 被曝正谈新一轮融资,估值要翻倍到 132 亿美元
Lovable 是一家成立不到三年的瑞典公司,主打“氛围编程”——你只要用自然语言描述需求,它就能自动生成软件。据 Sifted 报道,它正在谈一笔 3 亿美元的融资,估值 132 亿美元,正好是去年 12 月 66 亿美元估值的两倍,领投方预计是 Menlo Ventures。今年 6 月,它的年化收入跑到了 5 亿美元,客户里既有个人开发者和设计师...
#Lovable#Menlo Ventures#Workday
一句话点评
Lovable 成立不到三年,靠“用自然语言描述需求就能自动生成软件”做到年化收入 5 亿美元,现在又要融 3 亿、估值翻倍到 132 亿美元。这个增速很猛,但正文没披露利润、续费率或客户留存情况,也没说这轮钱具体要花在哪。估值半年翻一倍,如果收入质量跟不上,这个数字就有点虚。另外,报道只引用了 Sifted 的消息,官方还没确认,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
22:21
19d ago
AI HOT 精选· aihot-apiZH22:21 · 07·08
Seedream 5.0 Pro 上线 Runway,图片里能写14种语言的清晰文字
Runway 接入了 Seedream 5.0 Pro,你可以用提示词或参考图生成高细节图片,而且图片里的文字能清晰显示,支持14种语言。这对做海报、广告图、带文案的视觉内容挺实用。不过正文没披露模型参数、定价和生成速度,实际体验和成本还得自己试。
#Vision#Runway#Seedream
一句话点评
Runway 接入了 Seedream 5.0 Pro,主打生成带清晰文字的图片,支持14种语言,做海报、广告图挺实用。但正文没披露模型参数、定价和生成速度,实际体验和成本得自己试。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
20:37
19d ago
TechCrunch AI· rssEN20:37 · 07·08
Google 的 SynthID 水印帮 Snopes 拆穿了一张麦康奈尔病危的 AI 假照片
一张参议员麦康奈尔浑身插管躺在病床上的照片在网上疯传,Snopes 用 Google 的 SynthID 水印验出它是 AI 生成的。这个水印是藏在图片里的隐形签名,截图转发也不会丢。Gemini 和 OpenAI 的模型现在都会打上这个水印,但 Anthropic 还没加入。
#Google#SynthID#Snopes
一句话点评
一张麦康奈尔插管病床照被Snopes用Google SynthID水印识破为AI生成。水印是藏在图里的隐形签名,截图转发也不丢。Gemini和OpenAI已支持,Anthropic还没加入。亮点是水印在真实谣言场景中起了作用,但正文没披露检测成功率或误报率,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K1·R0
20:09
19d ago
Hacker News 首页· rssEN20:09 · 07·08
Onboard-CLI:用 LLM 加代码结构分析,自动给新项目画地图
一个开源命令行工具,结合大模型和 AST(代码语法树)分析,自动生成代码库的可视化图和摘要。主要帮刚接手项目的开发者快速看懂代码结构。正文没交代支持哪些编程语言、LLM 后端怎么配,但思路挺直接:先让 AST 把代码骨架拆出来,再用 LLM 补上业务逻辑说明。目前只有 6 个点赞和 1 条评论,验证还很弱,别急着当成熟方案用。
#Code#Open source
一句话点评
一个开源 CLI 工具,用 AST 拆代码骨架 + LLM 补业务说明,自动生成代码库可视化图。思路挺直接,适合新人上手项目。但正文没交代支持哪些语言、LLM 后端怎么配,目前只有 6 个点赞和 1 条评论,验证还很弱,别急着当成熟方案用。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
19:30
19d ago
彭博科技· rssEN19:30 · 07·08
Meta 要在加拿大建第一个数据中心,算力继续往北扩
Meta 宣布将在加拿大建第一个数据中心,作为全球基础设施扩张的一部分。正文没披露具体选址、投资金额和建设时间表。对 AI 从业者来说,这信号很直接:Meta 在持续加码算力,为更大规模的模型训练和推理做准备,同时把北美算力版图往北推。
#Meta
一句话点评
Meta 要在加拿大建第一个数据中心,算力版图往北推。正文没披露选址、投资额和时间表,信息量有限。对 AI 从业者来说,信号是 Meta 还在持续砸钱买卡,为更大规模训练和推理做准备。但没具体数字,不好判断规模。短评:Meta 加拿大建数据中心,算力继续北扩,但缺钱和工期细节。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
18:55
20d ago
Product Hunt · AI· rssEN18:55 · 07·08
Sim:开源版 AI 智能体工作台,今天在 Product Hunt 上线
Sim 是一个开源的工作台,用来搭建智能体工作流(让模型进业务流程干活)。它接入了 1000 多个第三方工具和大模型,今天在 Product Hunt 上拿了日榜第一。正文没披露具体支持哪些模型,也没说有没有内置编排引擎,但开源+广泛集成的定位对想自己搭智能体管道的团队挺实用。
#Sim#Product Hunt
一句话点评
Sim 是一个开源智能体工作台,接了 1000+ 第三方工具和大模型,今天在 Product Hunt 拿了日榜第一。开源+广泛集成的定位对想自己搭管道的团队挺实用。但正文没披露具体支持哪些模型,也没说有没有内置编排引擎,这点先别太激动。如果是真的,省去自己挨个接 API 的功夫。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R1
18:52
20d ago
Product Hunt · AI· rssEN18:52 · 07·08
Coasty:每个 AI agent 独享一台虚拟机,用完即毁,比 AWS 便宜
Coasty 今天在 Product Hunt 上重新发布,核心卖点是给每个 AI agent 分配一台独立的云虚拟机,而不是共享容器。一个 agent 一个 VM,进程不混跑、没有“吵闹的邻居”,一个 agent 被攻破也不会波及别的。用完自动销毁,干净利落。价格比 AWS 和 GCP 低。支持代码执行、浏览器自动化、多 agent 流水线。另外还有...
#Coasty#AWS#GCP
一句话点评
给每个AI agent配一台独立云虚拟机,而不是共享容器——进程不混跑、没有“吵闹的邻居”,一个被攻破也不会波及别的。价格比AWS和GCP低,但正文没披露具体定价和VM规格。另一个产品是桌面软件操作agent,在OSWorld Verified上跑359个任务拿到82.81%,接近榜首。已在医疗预授权、旧版EHR自动化、数据隐私清除场景落地,正往保险和税务会计扩展。隔离思路对安全敏感场景有价...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
18:43
20d ago
彭博科技· rssEN18:43 · 07·08
美国银行对OpenAI改口,给了5.2亿美元信贷额度
美国银行(BofA)之前对OpenAI态度谨慎,现在反手给了5.2亿美元(约37.7亿人民币)的信贷额度。正文被彭博的机器人检测页挡住了,没披露这笔钱的具体用途、利率或期限。5.2亿对OpenAI这种烧钱大户来说不算大数,但信号意义更强——银行愿意给钱,说明OpenAI的信用风险在金融机构眼里有所改善。至于BofA之前为什么犹豫、现在为什么改主意,正文...
#Bank of America#OpenAI#Funding
一句话点评
美国银行反手给了OpenAI 5.2亿美元信贷额度,信号意义大于金额——银行愿意借钱,说明OpenAI的信用风险在金融机构眼里有所改善。但正文被彭博的机器人检测页挡住了,没披露这笔钱的具体用途、利率或期限。5.2亿对OpenAI这种烧钱大户来说不算大数,如果是真的挺省钱。至于BofA之前为什么犹豫、现在为什么改主意,正文没披露。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
18:30
20d ago
TechCrunch AI· rssEN18:30 · 07·08
Google Photos 新增 AI 视频混剪工具,几秒改光线、换背景
Google Photos 上线了“Video Remix”功能,基于 Gemini Omni 模型,能在几秒内完成视频编辑:给暗光片段加电影级补光、把普通背景换成温室或晨光、套用水彩或油画风格。操作入口在“Create”标签页,不需要专业软件。这是 Google 把生成式 AI 塞进自家 App 的最新动作,直接对标 Apple、OpenAI 和 A...
#Google#Google Photos#Gemini Omni
一句话点评
Google Photos 上线了“Video Remix”,用 Gemini Omni 模型几秒就能给视频补光、换背景、套滤镜,操作在“Create”标签页里,不用专业软件。这对普通用户很友好,但正文没提支持哪些设备、要不要付费,也没给生成效果的对比样本。如果是免费的,那确实能抢走一批剪映用户;要是只给 Pixel 或付费订阅用户,吸引力就大打折扣。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K0·R0
18:00
20d ago
● P1Hacker News 首页· rssEN18:00 · 07·08
SpaceXAI 发布 Grok 4.5 模型,专注编程和自动化任务
Grok 4.5 是 SpaceXAI 目前最强的模型,专门为写代码、让模型进业务流程干活和知识类工作优化。在 SWE Bench Pro 这类编程基准测试里,它的解决率是 64.7%,虽然比 Fable 和 GPT 5.5 低,但有个很实在的优点:平均每次任务只输出约 1.6 万个 token,比 Opus 4.8 少了 4.2 倍,意味着推理成本更...
#Code#Reasoning#SpaceXAI#Cursor
精选理由
精选 · 重要度 98 · 吸引力 + 知识量 + 共鸣
一句话点评
SpaceXAI 发了 Grok 4.5,主打编程和自动化,自称比别家省一半 token 成本,但没给第三方跑分,先别太激动。
锐评
SpaceXAI 上市几周后推出了 Grok 4.5,定位是干编程、写文档这类自动化任务的“工兵型”模型。Elon Musk 管它叫“Opus 级”,对标的是 Anthropic 的 Claude Opus,但 TechCrunch 的报道里没给出任何独立评测或第三方基准来验证这个说法。公司自己放出的跑分看起来能跟一线模型掰手腕,不过自家数据得打个折看。 真正值得关注的是成本:SpaceXAI 声称 Grok 4.5 的 token 效率是其他领先模型的两倍。如果属实,意味着跑同样任务花的钱能砍半,这对用量大的企业用户诱惑不小。但文章没披露具体定价,也没说这个效率是在什么任务、什么负载下测出来的,信息缺口很大。 另外,报道只引用了公司博客,没有用户实测反馈,也没有技术细节(比如模型规模、训练数据、架构变化)。现在能判断的只有一点:SpaceXAI 想用“省钱”当卖点切入企业自动化市场,但能不能兑现,还得等有人真金白银跑过才知道。
HKR 分解
hook knowledge resonance
打开信源
98
SCORE
H1·K1·R1
17:56
20d ago
Hacker News 首页· rssEN17:56 · 07·08
Foreman:一个自托管的大模型网关,按成本自动选模型
Foreman 是一个自托管的 LLM 网关,核心功能是根据成本自动路由请求——你发一个请求,它帮你挑最便宜的模型来回答。主打确定性行为(每次返回一致结果)、低延迟和默认隐私保护。适合想控制 API 开销又不想手动切换模型的团队。正文没披露具体基准测试数据或支持哪些模型,所以性能到底多好、能接哪些厂商还得自己试。如果是真的,对预算敏感的小团队挺省钱。
#Northwood Systems
一句话点评
一个自托管LLM网关,核心卖点是按成本自动路由请求——你发一个请求,它帮你挑最便宜的模型来回答。主打确定性(每次返回一致结果)、低延迟和默认隐私保护。正文没披露具体基准测试数据或支持哪些模型,所以性能到底多好、能接哪些厂商还得自己试。如果是真的,对预算敏感的小团队挺省钱。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
17:47
20d ago
TechCrunch AI· rssEN17:47 · 07·08
CEO 认为游戏数据比互联网更适合训练 AI,补上物理直觉短板
General Intuition 的 CEO 在采访里说,LLM 文本能力很强,但不懂物体在空间和时间里怎么动——这是实现通用智能的关键。他的解法是用游戏数据来补这个缺口,因为游戏里天然有大量物理交互和运动轨迹。不过这篇是视频访谈,没披露具体怎么用、效果如何,所以先当观点看,别急着下结论。
#General Intuition
一句话点评
General Intuition 的CEO认为LLM文本强但不懂物体在时空里怎么动,想用游戏数据补这个缺口。游戏里天然有大量物理交互和运动轨迹,比互联网数据更适合训练物理直觉。但这是视频访谈,没披露具体方法、模型效果或对比实验,先当观点看。如果真能用游戏数据低成本补上物理理解短板,对具身智能和AGI路线影响不小,但验证还很弱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
17:33
20d ago
Product Hunt · AI· rssEN17:33 · 07·08
Speechify 推出 Simba Voice Agents:号称延迟低于 100 毫秒的语音代理平台
Speechify 发布了 Simba Voice Agents,一个基于自家 Simba 3.2 语音模型的代理构建平台。核心卖点是延迟低于 100 毫秒(人几乎感觉不到等待),支持流式输出、真实情感和 SSML(语音合成标记语言,用来控制语速、停顿等)。这是 Speechify 开发者平台的一部分。正文没披露定价和具体使用场景,所以暂时不好判断它跟...
#Speechify#Simba#Artificial Analysis
一句话点评
Speechify 出了个语音代理平台 Simba Voice Agents,主打延迟低于 100 毫秒(人基本感觉不到等待),支持流式输出和真实情感。用的是自家 Simba 3.2 模型,在 Artificial Analysis 上排第一。但正文没披露定价和具体场景,所以暂时不好判断它跟现有方案比到底强在哪。如果是真的,这个延迟水平做客服、语音助手挺省钱。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
17:11
20d ago
TechCrunch AI· rssEN17:11 · 07·08
Meta 给 AI 眼镜加了防篡改 LED 锁,但同周还在推更多收集个人数据的功能
Meta 宣布了一项更新:如果有人遮挡或破坏 AI 眼镜上提示正在录像的 LED 灯,摄像头会自动停用。这明显是在回应外界对眼镜偷拍的隐私担忧。但文章指出,就在同一周,Meta 还在推其他产品和功能,要求用户交出更多个人数据。正文没有具体列出这些功能是什么,只点出了这种一边防偷拍、一边多要数据的矛盾。
#Meta#Kylie Jenner#Policy
一句话点评
Meta给AI眼镜加了个防偷拍机制:如果有人遮挡录像指示灯,摄像头自动停用。这招挺直接,但文章自己说了,同一周Meta还在推其他功能,要求用户交出更多个人数据。正文没具体说是哪些功能,只点出这种矛盾。短评:防偷拍是好事,但一边堵摄像头一边多要数据,诚意打折。
HKR 分解
hook knowledge resonance
打开信源
68
SCORE
H1·K0·R1
16:55
20d ago
AI HOT 精选· aihot-apiZH16:55 · 07·08
Claude Code 的两种调优方式:换大模型 vs. 让模型多干活
Claude Code 提供两种提升输出的手段:Model(换更大的模型,基准测试分数更高)和 Effort(让模型花更多时间思考、读文件、跑测试)。Effort 高时模型会主动多做事,低时则倾向于问你要上下文。模型幻觉本质上是权重产生了看似合理但错误的 token 序列。正文没对比两种方式在实际输出质量上的差异。
#Claude Code
一句话点评
Claude Code 给了两个调优旋钮:换大模型(benchmark 更高)和加 effort(多思考、多读文件、多跑测试)。Effort 高时模型主动干活,低时反问你要什么。正文没对比两种方式在实际任务上的质量差异,也没说 effort 具体多耗时长。如果是真的,effort 可能比换模型更省钱——但得自己试。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
16:19
20d ago
● P1Hacker News 首页· rssEN16:19 · 07·08
Cognition 发布编程模型 SWE-1.7,性能接近 GPT-5.5
Cognition 推出了新的编程模型 SWE-1.7,它是在 Kimi K2.7 的基础上用强化学习(RL)做后训练得到的。在 FrontierCode 1.1 这个编程基准上,SWE-1.7 的通过率是 42.3%,很接近 GPT-5.5 的 43.0%,比自家上一代 SWE-1.6 的 9.4% 高出一大截。在 Terminal-Bench 2....
#Code#Cognition#Devin#Kimi K2.7
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Cognition 用 Kimi K2.7 基座训出 SWE-1.7,编程跑分接近 GPT-5.5,但成本低很多。不过正文没给具体价格,这点先别太激动。
锐评
SWE-1.7 是 Cognition 在 Kimi K2.7 基础上继续做强化学习(RL)训出来的编程模型。从跑分看,它在 FrontierCode 1.1 上拿了 42.3%,跟 GPT-5.5 的 43% 几乎打平,比自家上一代 SWE-1.6 的 9.4% 翻了四倍多,进步幅度很大。在 Terminal-Bench 和 SWE-Bench 多语言版上也接近头部模型。 这篇技术博客主要讲训练方法,而不是产品定价。他们提到用了跨三大洲的多集群训练、靠对象存储传权重更新,还通过 top-p 采样防止模型在长线 RL 训练里“熵崩塌”——简单说就是避免模型越训越死板、不再探索新解法。另外,模型学会了“自我压缩”,能把长任务的中间状态总结出来,突破原始上下文窗口限制。 但要注意,所有跑分都来自 Cognition 自己发布的基准测试,没有第三方独立验证。正文也没披露 SWE-1.7 的具体推理成本或 API 价格,只说“成本低很多”。实际用起来到底省多少钱、在真实项目里表现是否稳定,都还需要外部评测和用户反馈来确认。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
16:11
20d ago
Product Hunt · AI· rssEN16:11 · 07·08
Constellation Gate AI:防提示注入+省Token,号称16个测试集第一
今天在Product Hunt上线的Gate AI,主打两件事:防提示注入攻击和节省Token用量。它在16个公开的注入测试集上都拿了第一,同时通过压缩和缓存能省20-40%的Token,而且不改模型输出结果。你可以把已有的Claude或ChatGPT订阅路由到Gate里用,也可以按量付费选100多个模型。装个桌面应用就能用,不用写代码。不过正文没披露...
#Constellation Gate AI#Product Hunt
一句话点评
Gate AI 今天在 Product Hunt 上线,主打防提示注入和节省 Token。它在 16 个公开注入测试集上拿了第一,同时通过压缩和缓存能省 20-40% 的 Token,且不改模型输出。你可以把已有的 Claude 或 ChatGPT 订阅路由过去用,也可以按量付费选 100 多个模型,装个桌面应用就能用,不用写代码。不过正文没披露具体定价和完整模型列表,省 Token 的效果...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
16:06
20d ago
Hacker News 首页· rssEN16:06 · 07·08
TypeScript 7 发布:编译器用 Go 重写,构建速度提升 8 到 12 倍
微软把 TypeScript 编译器用 Go 语言重写了一遍,今天正式发了 7.0 版。最直观的变化是快:VS Code 项目完整构建从 125.7 秒降到 10.6 秒,快了 11.9 倍;其他几个大型开源项目也普遍有 8 到 9 倍的提速。这次重写没改编译逻辑,主要是换了运行环境,用上了原生代码的速度、共享内存多线程,还支持了语言服务器协议(LSP...
#Code#Microsoft#TypeScript#Go
一句话点评
微软把 TypeScript 编译器用 Go 重写了,7.0 版正式发布。最直观的变化是快:VS Code 项目完整构建从 125.7 秒降到 10.6 秒,快了 11.9 倍;其他大型项目也普遍有 8 到 9 倍的提速。这次重写没改编译逻辑,主要是换了运行环境,用上了原生代码的速度、共享内存多线程,还支持了语言服务器协议(LSP),编辑器响应会更顺滑。安装方式不变,还是 npm insta...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
15:42
20d ago
AI HOT 精选· aihot-apiZH15:42 · 07·08
OpenRouter 推 Grok 最新版路由,上线后自动切到 4.5
OpenRouter 上线了一个叫 ~x-ai/grok-latest 的模型端点,现在指向 Grok 4.3,等 Grok 4.5 发布后会自动升级,用户不用改任何代码。好处是省事,坏处是正文没披露 Grok 4.5 什么时候发、性能怎么样,所以现在只能当个占位符用。
#OpenRouter#xAI#Grok
一句话点评
OpenRouter 搞了个叫 ~x-ai/grok-latest 的端点,现在指向 Grok 4.3,等 Grok 4.5 一发布就自动切过去,用户不用改代码。省事是真省事,但正文没披露 Grok 4.5 什么时候发、性能怎么样,所以现在只能当个占位符用。如果是真的挺省钱,但这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
15:41
20d ago
TechCrunch AI· rssEN15:41 · 07·08
AI 创业公司营收加速增长,但各家算 ARR 的方法不一样
TechCrunch 汇总了一批声称营收加速增长的 AI 创业公司,它们达到下一个里程碑的速度越来越快。但文章提醒,各家口中的“ARR”口径不同:有的指已签约但未开票的年化经常性收入,有的按最近一个月收入推算全年,还有的算的是已签约但未上线的合同。Gusto 报的是实际过去 12 个月收入。数字看着漂亮,但横向对比要小心。
#TechCrunch#Gusto
一句话点评
TechCrunch 汇总了一批声称营收加速增长的 AI 创业公司,但各家“ARR”口径不同:有的算已签约未开票,有的按单月收入推算全年,还有的算已签约未上线合同。Gusto 报的是实际过去 12 个月收入。数字看着漂亮,但横向对比要小心。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
15:35
20d ago
AI HOT 精选· aihot-apiZH15:35 · 07·08
Runway 开放视频模型 API,开发者可以自己搭视频工具了
Runway 今天上线了 Runway Dev,一个让开发者直接调用其视频生成模型的 API 平台。说白了就是你可以把 Runway 的视频能力嵌到自己应用里,不用再绕一圈手动生成再搬运。正文没披露定价、具体模型列表和调用频率限制,只说“开发者现在可以自己造视频工具了”。对正在做视频产品的团队是个好消息,但成本高不高、生成快不快这些关键信息都还缺着,先...
#Runway
一句话点评
Runway 今天把视频生成模型做成了 API,开发者可以直接调,不用再手动生成再搬运。正文没披露定价、具体模型列表和调用频率限制,只说“开发者现在可以自己造视频工具了”。对正在做视频产品的团队是个好消息,但成本高不高、生成快不快这些关键信息都还缺着,先别急着冲。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R1
15:25
20d ago
Hacker News 首页· rssEN15:25 · 07·08
Kastor:用 Terraform 那套声明式语法来定义 AI Agent
Kastor 是一个开源工具,让你用 HCL(Terraform 用的那种配置文件)来声明式地定义 AI Agent——包括用什么模型、调什么工具、写什么提示词。写完可以编译到主流框架,也能在托管平台上做 plan/apply(类似基础设施即代码的“预览再部署”流程)。目前 GitHub 上只有 6 个星,正文没披露具体支持哪些框架和平台,所以实际能用...
#Kastor#weirdGuy#Open source
一句话点评
短评:把 Terraform 那套 HCL 搬来定义 AI Agent,想法不错,但才 6 个星,别急着用。 点评:Kastor 想让你像写基础设施代码一样写 AI Agent——用 HCL 声明模型、工具和提示词,然后 plan/apply 预览再部署。思路对:现在配 Agent 全靠手写框架代码或拖拽界面,版本管理和复现都是坑。但正文没披露支持哪些框架(LangChain?CrewAI...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
15:00
20d ago
AI HOT 精选· aihot-apiZH15:00 · 07·08
Replit 上线社区档案和力量排名,给“氛围编程”玩家一个晒工作量的主页
Replit 这周推出了社区档案功能,相当于给“vibe coders”(靠感觉写代码的爱好者)一个工作证明面板。档案里会显示你用了多少次 AI 智能体、检查点活跃度图表,还有面向付费用户的“力量排名”。正文没披露排名算法和奖励是什么,但功能已经上线——登录就能认领档案、挑出最好的项目分享出去。简单说就是给 AI 编程社区加了个社交主页和排行榜,具体怎...
#Replit
一句话点评
Replit 给“靠感觉写代码”的爱好者加了个社交主页,显示用了多少次AI智能体、活跃度图表,付费用户还有“力量排名”。相当于给AI编程社区加了工作证明面板和排行榜。正文没披露排名算法和奖励是什么,功能已上线。如果是真的,挺能刺激社区活跃度,但排名含金量得看算法是否公平。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
14:57
20d ago
AI HOT 精选· aihot-apiZH14:57 · 07·08
OpenRouter 聊天室加了个一键隐私开关,对比模型不留数据
OpenRouter 聊天室上线了一键零数据保留(ZDR)开关,打开后你可以并排对比不同模型,且对话完全不留记录。对隐私敏感的场景(比如测敏感内容或公司内部试用)挺实用。不过正文没披露开启后是否影响响应速度或功能(比如历史记录、上下文记忆),这点先别太激动。
#OpenRouter
一句话点评
OpenRouter聊天室加了个一键零数据保留开关,打开后并排对比模型且不留记录,适合测敏感内容或公司内部试用。但正文没披露开启后是否影响响应速度或功能(比如历史记录、上下文记忆),这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
14:54
20d ago
Hacker News 首页· rssEN14:54 · 07·08
Abralo:一个窗口同时跑多个 Claude Code 智能体,免费支持最多 4 个
Abralo 把原本跑在终端里的 Claude Code 装进桌面窗口,让你能同时盯多个智能体干活。它把终端输出重新排版成卡片,一眼就能看出哪个智能体在等你给指令,还会显示每个智能体的 token 消耗速度和剩余额度。免费版最多同时跑 4 个智能体,不需要额外注册,但你必须有自己的 Claude Pro 或 Max 订阅。作者说 VS Code 插件在...
#Abralo#Anthropic#Claude Code
一句话点评
Abralo 把 Claude Code 从黑乎乎的终端里捞出来,装进一个能同时盯多个智能体的桌面窗口。它把终端输出重新排版成卡片,一眼就能看出哪个在等你给指令,还会显示每个智能体的 token 消耗速度和剩余额度。免费版最多同时跑 4 个智能体,不需要额外注册,但你必须有自己的 Claude Pro 或 Max 订阅。作者说 VS Code 插件跑 3 个以上就崩,所以做了这个轻量原生应用...
HKR 分解
hook knowledge resonance
打开信源
72
SCORE
H1·K1·R0
13:30
20d ago
● P1OpenAI 博客· rssEN13:30 · 07·08
OpenAI发布国家安全原则划定技术使用边界
OpenAI 在 7 月 8 日公开了一套国家安全原则,讲清楚自己的技术给政府和执法部门用的时候,哪些能做、哪些不能做。三条硬杠杠是:不准搞大规模国内监控、不准指挥自主武器系统、不准做高风险的全自动决策。同时,它正在把自家的 Daybreak 网络防御计划和 GPT‑Rosalind 生物安全模型,开放给美国及其盟友用,包括澳大利亚、加拿大、日本、韩国...
#OpenAI#David Kris#ENISA
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 自己发了一份国家安全合作原则,核心是划出三条红线:不搞大规模国内监控、不指挥自主武器、不做高风险自动决策。
锐评
OpenAI 这次主动公开了跟政府、军方合作时的底线,相当于自己先立规矩,免得以后被架在火上烤。文件里明确写了三条硬约束:技术不能用于大规模国内监控、不能用来指挥自主武器系统、不能做高风险的全自动决策。这些限制已经写进了他们和美国国防部(文中叫“战争部”)的合同里。 同时,他们也在扩大跟盟友的网络安全和生物安全合作,比如通过“Daybreak”项目跟澳大利亚、加拿大、日本、韩国、法国、德国等九个国家及欧盟机构建立了网络防御的信任访问通道,生物安全方面也向特定政府伙伴开放了 GPT‑Rosalind 模型。 不过,这份原则目前只是 OpenAI 单方面的声明,正文没披露外部审计机制或违约后的具体惩罚措施。它到底是一份有牙齿的承诺,还是主要为了缓解外界对“AI 军事化”的担忧,还得看后续有没有独立的第三方监督和实际执行案例。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
13:00
20d ago
● P1OpenAI 博客· rssEN13:00 · 07·08
OpenAI审计SWE-Bench Pro发现约三成题目存在缺陷
OpenAI 对编程评测集 SWE-Bench Pro 做了一次质量审查,估计里面大约 30% 的题目是坏的。他们先用自动管线筛出 286 道可疑题目,再让基于 Codex 的调查 agent 和五位资深工程师分别复核。工程师最终标记出 249 道(34.1%)有缺陷的题目,主要毛病是测试太死板、题目描述漏要求、测试覆盖不足,以及题目描述误导模型。Op...
#Code#Benchmarking#OpenAI#SWE-Bench Pro
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 自己审了一遍 SWE-Bench Pro,发现约三成题目有坑,不再推荐用它来测编程能力。
锐评
OpenAI 对 SWE-Bench Pro 做了一次质量审计,结论是大约 30% 的题目本身有问题,建议别太依赖这个榜单的分数。他们用自动筛查加人工复核的方式,从 731 道公开题里揪出了 200 到 249 道有毛病的题。主要坑点有四类:测试太死板,卡了题目里没要求的实现细节;题目描述漏了关键需求,但隐藏测试又强行检查;测试覆盖太弱,不完整的方案也能蒙混过关;还有题目描述直接把人带沟里。 这个发现挺打脸的,因为 SWE-Bench Pro 本来就是冲着解决旧版缺陷去的,结果自己也没站稳。OpenAI 的审计方法本身有点意思,他们让模型当“调查员”去翻代码库、跑测试,再结合五位工程师背对背标注,比纯人工筛效率高。但正文没披露这几位工程师是否来自 OpenAI 内部,也没说他们和出题方有没有利益关系,这点会让结论的独立性打个折扣。 对从业者来说,这条新闻最大的提醒是:别光看榜。一个模型在 SWE-Bench Pro 上从 23% 冲到 80% 可能有一小半是题目放水或题目有 bug 贡献的。选模型做开发任务,还是得用自己的代码库和真实场景跑一遍。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
13:00
20d ago
● P1TechCrunch AI· rssEN13:00 · 07·08
General Intuition融资3.2亿美元押注游戏数据赋能机器人
General Intuition 刚拿了 3.2 亿美元融资,估值 23 亿。CEO Pim de Witte 在播客里说,ChatGPT 这类大语言模型对空间和时间的理解很差,而游戏数据正好能补上这个缺口。他们用 8 分钟的真实世界数据就让一个机器人能在办公室里自己认路,这点挺有意思。公司还拒绝了 OpenAI 的收购,自己做了个叫 Nerve 的...
#Robotics#General Intuition#Pim de Witte#Coatue
精选理由
精选 · 重要度 88 · 吸引力 + 知识量 + 共鸣
一句话点评
用游戏数据训练机器人,思路不新,但融了3.2亿美元说明有人愿意赌。正文没披露具体技术指标,这点先别太激动。
锐评
General Intuition 拿了 3.2 亿美元,估值 23 亿,投资人包括 Coatue 和贝索斯。他们想用游戏里产生的操作数据来训练机器人,让机器学会物体在空间和时间里怎么动,补上纯语言模型不懂物理世界的短板。CEO 在播客里提了一个例子:只用 8 分钟的真实办公室数据,就让机器人能在陌生环境里自己导航。这个数字听起来很省数据,但正文没交代成功率、重复实验次数,也没说这 8 分钟数据具体包含什么场景,所以实际泛化能力要打个问号。 公司是从游戏录屏平台 Medal TV 分出来的,还做了一个叫 Nerve 的众包平台,让玩家接数据标注和远程操控的活儿,算是给自己铺数据管道。他们拒绝过 OpenAI 的收购要约,选择独立发展。整篇报道来自一期播客对谈,不是技术论文或产品发布,很多细节停留在口头描述,缺可复现的基准测试和第三方验证。
HKR 分解
hook knowledge resonance
打开信源
88
SCORE
H1·K1·R1
12:08
20d ago
AI HOT 精选· aihot-apiZH12:08 · 07·08
研究生开源Skill管理工具:用标签+流程图管住互相调用的AI技能
在校研究生Kunkun开源了一套管理大量互相调用Skill的方法。核心是搭一个HTML后台,给每个Skill打上运行模式(手动/自动)、链路位置、专业领域三类标签,方便筛选;再把调用链画成Mermaid流程图,debug或加新功能时能直接定位到相关技能组。还仿照Matt的“ask me”技能做了一个自定义版本,把路由决策浓缩成上下文喂给模型,避免让模型...
#Kunkun#Matt#GitHub
一句话点评
短评:给多技能互相调用的场景搭了个可视化后台,debug 和加新功能时能直接看调用链,挺实用。 点评:Kunkun 这套方案解决的是多 Skill 互相调用时的管理痛点——靠 HTML 后台打标签(运行模式、链路位置、专业领域)筛选,再把调用链画成 Mermaid 流程图,debug 或加新功能时能直接定位到相关技能组。还仿 Matt 的“ask me”技能做了自定义版本,把路由决策浓缩成...
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
10:00
20d ago
OpenAI 博客· rssEN10:00 · 07·08
OpenAI 给美国 K-12 老师办暑期实操班,号称每周省 5.9 小时
OpenAI 学院联合沃尔顿家族基金会,今年夏天在美国 8 个城市办 AI Skills Jam,面向 K-12 教师和行政人员,预计覆盖 1600 多人。现场有 OpenAI 导师带着做教案、写家长沟通邮件、处理行政杂活。引用了一份 Walton-Gallup 的调查数据:每周用 AI 的老师平均省 5.9 小时,换算成一个学年大概能省出六周。不过正...
#OpenAI#OpenAI Academy#Walton Family Foundation
一句话点评
OpenAI 联合沃尔顿家族基金会,暑假在 8 个美国城市办线下工作坊,预计覆盖 1600+ 教师和行政人员。现场有 OpenAI 导师带着做教案、写家长信、处理行政杂活。引用 Walton-Gallup 调查:每周用 AI 的老师平均省 5.9 小时,换算成一学年约六周。但正文没披露具体用哪个模型或工具,也没说这 5.9 小时是来自 ChatGPT 还是其他产品。如果是真的,对缺时间的老师...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K1·R0
08:46
20d ago
Hacker News 首页· rssEN08:46 · 07·08
优衣库T恤背面印了一段base64加密的bash脚本,有人把它解码了
Akamai为优衣库'Peace for All'系列设计了一款T恤,背面印着一大段base64编码的字符串。有人用OCR加Claude把它抄下来解码,发现是一段bash脚本,运行后会在终端里用彩色正弦波循环打出'PEACE FOR ALL'。解码过程挺折腾——base64没有纠错能力,抄错一个字符就跑不起来。同系列另一件T恤的代码是截断的,根本没法运行。
#Akamai#Uniqlo#Claude
一句话点评
Akamai 给优衣库'Peace for All'系列设计的 T 恤,背面印了一段 base64 编码的 bash 脚本,解码后能在终端里用彩色正弦波循环打出'PEACE FOR ALL'。有人用 OCR 加 Claude 才抄下来,因为 base64 没有纠错能力,抄错一个字符就跑不起来。同系列另一件 T 恤的代码是截断的,根本没法运行。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
08:37
20d ago
Hacker News 首页· rssEN08:37 · 07·08
Geosql:让 Claude 直接帮你查地理数据
一个开源工具,让 Claude 或 Codex 能直接跑地理空间 SQL 查询。比如问“这个区域有多少加油站”,模型自动生成 SQL 并返回结果,省去手动写空间查询的麻烦。仓库目前 157 星、22 个 fork,但正文没披露支持哪些数据源,也没说准确率。思路很直接:用自然语言查地理数据库,相当于给大模型配了个“外挂资料库”。
#Code#Claude#Codex#dekart-xyz
一句话点评
给 Claude/Codex 配了个地理空间 SQL 外挂,问“这区域多少加油站”直接出结果。157 星,思路实用,但正文没披露支持哪些数据源、准确率如何,先别太激动。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
07:06
20d ago
AI 群聊日报· atomZH07:06 · 07·08
Anthropic 把 Fable 5 续了5天;OpenAI 预告周四发 GPT-5.6
Anthropic 把 Fable 5 付费访问延长到7月12日,被看作在 GPT-5.6 发布前的战术卡位。OpenAI 宣布周四发布 GPT-5.6 Sol/Terra/Luna,预览已开始扩大。方法论区有两场硬核讨论:一是把任务状态外化,实现“set and forget”式 AI;二是把所有任务变成长期运行,虽然 token 用量翻倍但人工时间...
#Anthropic#OpenAI#Metagent
一句话点评
Anthropic把Fable 5付费访问延到7月12日,OpenAI周四发GPT-5.6,这五天卡位精准:如果5.6强,Fable靠订阅续人气;不行就回API赚钱。群友实测Fable 24小时满负荷约11万美元/天,成本极高。另一场硬核讨论:把任务状态外化实现“set and forget”,以及所有任务loop化虽token翻倍但省人工。路透社称北京可能限制中国顶级AI模型海外访问,若真...
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K1·R0
06:05
20d ago
● P1AI HOT 精选· aihot-apiZH06:05 · 07·08
工信部警告:Claude Code 部分版本有后门,会偷传你的位置和身份信息
工信部发了风险提示,说 Claude Code 从 2.1.91 到 2.1.196 这几个版本里藏了监控代码,没经过你同意就把位置、身份标识这些敏感数据传到远程服务器。建议正在用的团队马上排查,要么卸载,要么升到已经去掉后门的最新版,同时把开发工具的外联权限和流量监控收紧,别让数据偷偷溜出去。正文没说是 Anthropic 自己放的还是第三方塞进去的...
#MIIT#Anthropic#Claude Code#Policy
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
Claude Code 被曝藏后门,2.1.91 到 2.1.196 版本会偷传位置和身份信息。正文没说是谁塞的,也没说影响多大,先别急着下结论,但排查和升级别拖。
锐评
工信部这次点名很直接,Claude Code 在 2.1.91 到 2.1.196 这几个版本里内置了监控代码,不经用户同意就把位置、身份标识这类敏感数据往外传。对用这个工具做开发的团队来说,风险不小——开发环境里通常躺着密钥、代码库和内部文档,一旦外联没管住,泄露面会很大。 不过原文有两个关键缺口:第一,没说是 Anthropic 自己放的还是供应链被人动了手脚;第二,没有披露实际受影响的范围和已确认的泄露事件。这两点直接决定这事是产品恶意行为还是安全事件,现在下判断还太早。 建议先做三件事:排查内部有没有在用受影响版本,有就立刻卸载或升到官方确认清理后的版本;收紧开发工具的外联权限,别让它随便往外连;把流量监控拉起来,看有没有异常外传。如果是真的后门,这事比一般的漏洞严重得多,别等官方通报了再动。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1
05:25
20d ago
● P1Hacker News 首页· rssEN05:25 · 07·08
研究人员发现GitHub Copilot跨仓库记忆漏洞可泄露私有代码
Noma Security 的研究员发现 GitHub Copilot 的 AI 编程助手有个跨仓库记忆的漏洞。他们在公开仓库里埋下诱饵代码,然后引导助手回忆它之前在私有仓库里“看”过的上下文,结果助手真的把不该公开的代码片段输出了。这个攻击不是无差别泄露,攻击者得事先知道私有库里大概有什么,但它暴露了 AI 编程工具在权限边界上的真实缺口。文章没提 ...
#GitHub#GitHub Copilot#Noma Security
精选理由
精选 · 重要度 92 · 吸引力 + 知识量 + 共鸣
一句话点评
安全团队用“跨仓库记忆”骗过 GitHub Copilot,让它把私有代码片段吐了出来。
锐评
Noma Labs 的研究人员发现,GitHub Copilot 的 AI 编程助手在处理跨仓库的上下文时,会记住并复现其他仓库里的代码。他们利用这一点,构造了一个“提示词注入”攻击:先让 Copilot 读一段精心设计的公开代码,再诱导它在私有仓库里把之前记住的敏感代码片段补全出来。 这个漏洞的核心在于 Copilot 的“记忆”机制没有做好仓库之间的隔离。原文没有披露受影响的具体版本范围和修复时间线,也没有说明 GitHub 是否已经确认并修补。目前公开的只有安全团队单方面的技术博客,缺乏 GitHub 官方的回应。 对开发者来说,这意味着如果你在 Copilot 开启的状态下编辑私有仓库,理论上存在泄露风险。但实际利用需要攻击者能控制你引用的公开代码,门槛不低。建议先关注 GitHub 后续的安全公告,别急着关掉 Copilot,但敏感项目可以暂时限制其使用范围。
HKR 分解
hook knowledge resonance
打开信源
92
SCORE
H1·K1·R1

更多

频道

后台