1.8B参数,33种语言互译,还能塞进llama.cpp。腾讯这回没先甩70B,…

AI大土豆 @suanwan
1.8B参数,33种语言互译,还能塞进llama.cpp。腾讯这回没先甩70B,先把翻译模型做成能塞进笔记本的东西。 Hy-MT2-1.8B-GGUF能跟术语、文风、JSON/字幕这类结构化指令。官方说小模型综合表现能打过部分商用翻译API;再压到1.25-bit大约440MB。系列还有7B和30B-A3B。 坑:官方GGUF依赖llama.cpp的STQ kernel(PR # 22836),随便下一个量化不一定能跑。 Apache-2.0。厂商榜单归厂商,自己丢一段字幕试试。 项目地址:huggingface.co/tencent/Hy-MT2…
话题来源 @XAMTO_AI 5K阅读 ❤️42 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单