MOSS-TTS-Nano
更新于 2026-09-02 23:49:54
MOSS-TTS-Nano 是 MOSI.AI 与 OpenMOSS 团队开源的多语言微型语音生成模型,参数只有 0.1B(1 亿),专为实时语音生成设计。它最大的卖点是"够小":无需 GPU,直接在 CPU 上跑,部署栈简单到适合本地演示、Web 服务和轻量产品集成。
它做什么
- 实时语音合成:低延迟出声,适合对话、配音、语音播报。
- 多语言:支持 20 种语言,覆盖主流语种。
- 极轻部署:4 核 CPU 流畅跑,普通笔记本就能本地体验。
工程视角
0.1B 的体量意味着它不追求"最像人",而追求"够用且到处能跑"。对想在边缘设备、本地服务里塞一个 TTS 的人,它是少有的又小又开源的选择。
一句话总结
MOSS-TTS-Nano 把"语音合成"做成了 1 亿参数的微型模型:CPU 能跑、20 语言、实时出声,本地集成零负担。