ax@ax-radar:~/all $ grep -v 'tier=excluded' stream.log
33 srcsignal 72%cycle 04:32

全部 · 2026-08-23

17 items · updated 3m ago
RSS live
2026-08-23 · 星期日2026年8月23日
15:04
30d ago
r/LocalLLaMA· rssEN15:04 · 08·23
450M小模型用5万张浏览器截图微调,得分从1/100涨到44/100
有人在Reddit上发帖,说用5万张浏览器截图微调了一个4.5亿参数的视觉语言模型,评测得分从1/100跳到44/100。数据量和参数量都确认了,但正文被屏蔽,没披露用了什么架构、训练方法、评测任务。44分虽然比1分好看,但绝对值不高,离实用还有距离。
#Fine-tuning
一句话点评
用5万张浏览器截图微调一个4.5亿参数的视觉语言模型,评测得分从1/100跳到44/100。数据量和参数量都确认了,但正文被屏蔽,没披露用了什么架构、训练方法、评测任务。44分虽然比1分好看,但绝对值不高,离实用还有距离。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0
15:00
30d ago
TechCrunch AI· rssEN15:00 · 08·23
用受版权保护的书籍训练AI,到底合不合法?答案很模糊
大多数出过书的作者,在不知情也没同意的情况下,成了训练AI的素材——而这些AI工具反过来又在威胁他们的饭碗。这事听起来肯定违法吧?但现实是,法律还没给个准话。文章梳理了“合理使用”原则、几家AI公司和出版社签的授权协议,以及一堆正在打的官司,结论是法院至今没给出明确答案。
#ChatGPT#Gemini#Claude
一句话点评
法律还没跟上AI训练用书的节奏。文章梳理了合理使用、授权协议和一堆官司,结论是法院没给准话。关键信息:作者不知情、没同意,AI工具反过来威胁他们饭碗。但正文没披露任何具体判例或立法进展,所以这点先别太激动——现状就是悬而未决。
HKR 分解
hook knowledge resonance
打开信源
60
SCORE
H1·K0·R1
07:05
30d ago
AI 群聊日报· atomZH07:05 · 08·23
Qwen 3.8-27B 在单卡 5090 上跑出全网最快推理速度,代价是编译时打爆了 126GB 内存
群友 @细心的熊猫 在 SGLang 0.5.17 上叠了四五个补丁,把 Qwen 3.8-27B 在单卡 5090 上推到 239.7 tok/s(2K 上下文),超过 SGLang 官方 206.1 tok/s 和 NInfer 的 213–231 tok/s。启用 DFLASH2 甚至能到 300 tok/s。代价是编译时 MAX_JOBS=16...
#Inference-opt#Qwen#SGLang#NVIDIA 5090
一句话点评
群友在单卡5090上把Qwen 3.8-27B压到239.7 tok/s,比官方快15%,开DFLASH2甚至能到300 tok/s。代价是编译时64个进程同时跑,126GB服务器直接OOM。另一个看点:Opus 5和Sol近期遗忘问题集中爆发,社区解法是“约束先行、文件为王”——对话框输入不可靠,只能引用文件。AI课程测评站aicoursesignal.com几小时搓出来,但分发比产品更难...
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R0
06:38
30d ago
r/LocalLLaMA· rssEN06:38 · 08·23
Agent Quest 更新:Claude Code 和 Codex 跑完活会弹窗+响铃提醒你
Agent Quest 是一个开源工具,能把 Claude Code 和 Codex 的会话变成屏幕上的 2D 小角色。最新版加了视觉和声音提醒,四种状态:工作中、等你输入、跑完了、出错了。不用一直盯着终端看,适合同时跑好几个 agent 的场景。项目完全开源,在 GitHub 上。正文没提具体支持哪些通知系统或声音格式。
#Claude Code#Codex#Agent Quest#Open source
一句话点评
把 Claude Code 和 Codex 的终端会话变成桌面 2D 小角色,四种状态(工作中、等你输入、跑完了、出错了)带视觉和声音提醒,不用一直盯着终端看。适合同时跑多个 agent 的场景。开源,GitHub 可下。正文没披露支持哪些通知系统或声音格式,实际效果得自己试。
HKR 分解
hook knowledge resonance
打开信源
62
SCORE
H1·K1·R0
05:57
30d ago
彭博科技· rssEN05:57 · 08·23
DeepSeek 取消 API 周末高峰定价,今天起统一价格
DeepSeek 从今天起取消了 API 调用的周末高峰定价,之前周末比工作日贵。正文没披露统一后的新价格,也没说具体打了多少折。如果是真的降价,对经常在周末跑批量的开发者来说能省一笔,但幅度未知,这点先别太激动。
#DeepSeek
一句话点评
DeepSeek 取消了周末 API 高峰定价,之前周末比工作日贵。正文没披露统一后的新价格,也没说具体打了多少折。如果是真的降价,对经常在周末跑批量的开发者来说能省一笔,但幅度未知,这点先别太激动。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H0·K0·R0
04:00
30d ago
FT · 科技· rssEN04:00 · 08·23
法律科技公司把AI塞进合同审查,但幻觉一出谁担责?
FT报道,一批法律科技创业公司把大模型塞进合同审查和诉讼预测,号称能替代初级律师。问题在于模型会编造法条和判例,给出错误的法律意见。传统律所有多层风控和职业责任险,这些初创公司基本没有。文章没点名具体公司或模型,但点出了核心矛盾:AI提效明显,但法律行业零容错,出了错责任算谁的?
#Financial Times#Policy
一句话点评
法律科技公司把大模型塞进合同审查和诉讼预测,号称能替代初级律师。问题在于模型会编造法条和判例,给出错误的法律意见。传统律所有多层风控和职业责任险,这些初创公司基本没有。文章没点名具体公司或模型,但点出了核心矛盾:AI提效明显,但法律行业零容错,出了错责任算谁的?
HKR 分解
hook knowledge resonance
打开信源
65
SCORE
H1·K1·R1
01:30
30d ago
r/LocalLLaMA· rssEN01:30 · 08·23
16GB显存微调Gemma 4 12B,工具调用能力提升2.7倍
一位开发者在16GB显存的显卡上微调了Gemma 4 12B模型,工具调用准确率提升了2.7倍。他选这个模型是因为显存不够跑更大的模型。正文被屏蔽了,没披露训练数据量、微调方法、评估基准。2.7倍这个数字看着不错,但没说明是从多少分提到多少分,也没说测试集多大,所以先别太激动。如果是真的,这个成本挺省——16GB显存现在很常见。
#Fine-tuning#Gemma 4 12B
一句话点评
一位开发者在16GB显存上微调Gemma 4 12B,工具调用准确率提升2.7倍。选这个模型纯粹因为显存放不下更大的。正文被屏蔽,没披露训练数据量、微调方法、评估基准。2.7倍看着不错,但没说明是从多少分提到多少分,测试集多大,所以先别太激动。如果是真的,这个成本挺省——16GB显存现在很常见。
HKR 分解
hook knowledge resonance
打开信源
55
SCORE
H1·K0·R0

更多

频道

后台