腾讯混元极低bit翻译模型,3.3GB压缩至440MB
发布日期:2026-08-27
事件概述
2026年8月,腾讯混元将端侧翻译模型Hy-MT2-1.8B通过2-bit与1.25-bit两套极致量化压缩到几百MB,翻译质量几乎无损。FLORES-200评测优于微软、豆包等商业翻译API。
核心要点
- 原始大小:3.3GB(1.8B参数)
- 压缩后:440MB(1.25-bit量化)
- 压缩比:约7.5倍
- 质量:FLORES-200评测优于微软、豆包等商业API
- 部署:专为端侧设计,可在手机上离线运行
行业意义
极低bit量化让1.8B参数模型压缩到U盘大小,且翻译质量超越商业API。这意味着端侧AI已从"能用"走向"好用",对依赖云端的翻译服务构成直接威胁。当模型压缩到几百MB且质量无损,端侧AI的最后一公里正在被打通。