Typeahead 是一个 Mac 应用,能在系统里所有输入框里给你做 AI 自动补全——你打字时它会在光标处弹出建议,帮你写得更快。它用的是本地 AI 模型,所以完全离线工作,你的文字不会上传。这点对隐私敏感的用户挺友好。不过正文没披露具体用了什么模型、多大参数量,也没说定价和正式上线日期。目前 Product Hunt 上 270 票、2 条评价,...
#Tools#Typeahead#Product update
一句话点评
Typeahead 在 Mac 所有输入框里做 AI 自动补全,打字时弹出建议,本地模型离线运行,数据不上传,隐私友好。但正文没披露具体模型、参数量、定价和上线日期,Product Hunt 上 270 票、2 条评价,验证很弱。短评:本地离线补全挺省心,但模型和效果未知,先别太激动。
消息来自《论坛报》和《金融时报》,软银自己还没官宣。750 亿欧元这个数字很大——作为对比,法国之前公布的“法国 2030”计划里给整个 AI 的预算大约是 25 亿欧元。这笔钱主要投向 AI 数据中心,也就是给大模型训练和推理提供算力的基础设施。不过正文没披露具体建多少座、选址在哪、分几期投入,也没说软银是独资还是拉上当地伙伴一起干。我会先打个折:这...
Parallax把之前Local Linear Attention(LLA)里用数值求解器算KV协方差那步,换成了一个类似query的投影层,让模型自己学怎么从KV里提取协方差信息。作者在0.6B和1.7B参数规模上做了预训练验证,困惑度有改善,下游任务也跟着涨。更实际的是,他们写了一个解码推理的kernel,在多种batch size和上下文长度下速...
RTX 5090跑4B小模型只有200-250 TPS,GPU利用率才50%,明显没喂饱。问题可能出在Docker on Windows的虚拟化开销,或者llama.cpp的调度没跟上新架构。正文没披露CPU内存带宽和电源设置,这两点常是瓶颈。如果是纯推理瓶颈,这速度对4B模型算偏低,但如果是交互场景(比如聊天)其实够用。
#Inference-opt#The Wall Street Journal#Hacker News#Commentary
精选理由
精选 · 重要度 82 · 吸引力 + 共鸣
一句话点评
AI 账单来了,美国公司开始给员工设用量上限。省钱是真疼,但正文没给具体涨了多少。
锐评
这条新闻说的不是 AI 不好用,而是用不起了。WSJ 报道,美国企业因为 AI 成本飙升,开始对内部使用进行配给,也就是限制谁可以用、能用多少。这跟过去两年“全员上 AI”的画风完全不同,说明财务部门开始算账了——模型调用、API 费用、算力消耗这些隐性成本,在规模化推广时会被迅速放大。
文章没披露具体的成本涨幅数字,也没说限制的是哪种模型或场景,所以没法判断是通用大模型太贵,还是企业自己没做优化。但信号很明确:AI 在企业里正从“战略投资”变成需要审批的日常开销。如果你所在的公司还没感受到账单压力,可能只是用量还没到临界点。
在新加坡的香格里拉对话会上,有安全专家提出,AI 给战略稳定带来的威胁现在比核武器更大。核心论据是 AI 会大幅压缩决策时间——人还没反应过来,系统可能已经给出一个看似确定的判断,逼着决策者在几秒内做选择,容易导致误判和冲突升级。文章没有披露具体的演讲者名单和量化对比数据,所以这个“超过核武器”的结论更像是一种警示性排序,而不是有严格指标支撑的评估。
Google 把两个新图像模型 Nano Banana Pro 和 Nano Banana 2 挂上了 Gemini API
Google AI Developers 发推说 Nano Banana Pro(对应 gemini-3-pro-image)和 Nano Banana 2(对应 gemini-3.1-flash-image)已经正式发布,可以直接通过 Gemini API 调用。推文里贴了一些社区示例展示效果,但正文没披露定价、跑分、单次生成耗时或调用频率上限,想上...
#Multimodal#Vision#Tools#Google AI Developers
精选理由
精选 · 重要度 76 · 吸引力 + 知识量 + 共鸣
一句话点评
Google 发了两个新图像模型,Pro 和 Flash 版,但正文没给定价、速度和并发限制,想上生产先问清楚成本。
锐评
Google 把两个图像生成模型挂上了 Gemini API,Pro 版走 gemini-3-pro-image,Flash 版走 gemini-3.1-flash-image,现在就能直接调用。推文贴了些社区示例,看起来效果不错,但官方没放任何硬指标——没跑分、没单次生成耗时、没并发上限,也没提价格。对想接生产的人来说,这些比示例图重要得多。Flash 版按命名惯例应该是轻量低价路线,Pro 版可能质量更高但更慢更贵,不过这都是猜的,正文一个字没提。建议先拿自己的场景跑几组对比,别光看社区精选图就下单。
Shadow AI:一个纯本地的 Windows 语音助手,自带记忆和提醒,但得自己掏 Gemini 的 API 钱
一个叫 Shadow AI 的开源项目,让你在 Windows 上跟 AI 语音聊天,支持多语言、连续对话,还能联网搜索(用的 SearXNG)、记事情、设提醒,甚至能连 Google 日历。所有东西都跑在你自己的电脑上(127.0.0.1),数据不出门。但注意,它不包模型费用——你得自己搞一个 Gemini API key 塞进去,相当于你买了个车但...
#Audio#Tools#Memory#Shadow AI
一句话点评
Shadow AI 是个 Windows 本地语音助手,开源,但模型得自己带——插个 Gemini API key 才能用。支持多语言连续对话、联网搜索、记提醒、连 Google 日历,全跑在本地 127.0.0.1,数据不出门。好处是隐私可控,坏处是 Gemini 按量收费,长期用成本不低。正文没披露延迟和语音识别精度,这点先别太激动。如果是轻度尝鲜或隐私敏感场景,值得一试。
Steve Yegge 发了一篇长文,说传统技术面试已经走到头了。他在 Amazon 当过 Bar Raiser(面试把关人),在 Google 干过招聘委员会,结论是:面试评分跟实际工作表现几乎没关系,同一个候选人两个面试官能给出“强烈推荐”和“直接拒”两种结果,Google 内部统计也证实了这一点。文章正文没披露具体替代方案,只说要彻底换一套评估人...
#Steve Yegge#Medium#Hacker News#Commentary
一句话点评
Steve Yegge(前Amazon Bar Raiser、Google招聘委员会成员)发文判死刑:传统技术面试评分跟实际工作表现几乎没关系,同一个候选人两个面试官能给出“强烈推荐”和“直接拒”两种结果。Google内部统计也证实了这一点。正文没披露具体替代方案,只说要彻底换一套评估人的方式。短评:面试圈最敢说的人之一盖章了,但替代方案没给,这点先别太激动。