FEATURED量子位 · 公众号· rssZH02:42 · 05·02
腾讯混元开源 440MB 翻译模型,手机离线跑,自称翻译质量超谷歌
腾讯混元放出了一个叫 Hy-MT1.5-1.8B-1.25bit 的翻译模型,把原本 1.8B 参数的模型压到了 440MB,能在骁龙 888、8GB 内存的安卓手机上离线跑。它支持 33 种语言、1056 个翻译方向。压缩的关键是一种叫 Sherry 1.25 比特量化的技术,做法是每 4 个权重里,3 个用 1 比特存,1 个直接置零。官方说翻译质...
#Inference-opt#Tencent Hunyuan#QbitAI#Google
精选理由
精选 · 重要度 80 · 吸引力 + 知识量 + 共鸣
一句话点评
腾讯把1.8B翻译模型压到440MB,手机离线能跑33种语言,但正文没披露具体翻译质量对比数据和延迟,这点先别太激动。
锐评
腾讯混元开源了一个翻译模型,把原本18亿参数的模型压缩到440MB,能在骁龙888、8GB内存的安卓手机上离线运行。支持33种语言、1056个翻译方向,覆盖面确实广。压缩用的是Sherry 1.25比特量化技术,简单说就是每4个权重里,3个用1比特存,1个直接扔掉,这样模型体积大幅缩小。官方说翻译质量超过谷歌,但正文没给出具体的评测基准、测试集或延迟数据,只说“翻译质”就断了,信息缺口很大。
这个工作的价值在于让翻译模型真正能在普通手机上离线用,不用联网、不耗流量,对隐私敏感或网络差的场景有用。但“超谷歌”这个说法需要看具体在哪些语言对、什么指标上超,以及是否在同等硬件条件下对比。另外,440MB对手机存储来说不算小,实际下载和加载体验如何也没提。如果后续能补上完整的评测数据和端侧延迟,这个开源才更有说服力。
HKR 分解
hook ✓knowledge ✓resonance ✓