腾讯这次没急着上70B大模型,反而先把翻译模型压成了笔记本能扛的体量。新发布的Hy-MT2-1.8B-GGUF,1.8B参数,支持33种语言互译,还能塞进llama.cpp里跑。
我第一时间下载试了一下,这个小模型确实有点东西。它能接术语、文风、JSON/字幕这类结构化指令,不是简单的逐句翻译。按官方说法,综合表现能压过一部分商用翻译API。更狠的是,如果再压到1.25-bit,大约只剩440MB,手机都能跑。
同系列还有7B和30B-A3B版本,不过1.8B这个体量对大多数人来说够用了。我拿它翻译了一段技术文档,术语处理比预期好很多,不会出现那种机翻味。
有个坑要注意:官方GGUF得靠llama.cpp的STQ kernel(PR #22836),随手抓个量化版本未必跑得起来。建议直接用官方提供的版本。
Apache-2.0协议,商用也没问题。不过厂商的榜单终归是厂商的,建议自己扔段字幕上去验验效果。
项目地址:huggingface.co/tencent/Hy-MT2…
22 浏览 0 评论
0 反应














