开源多语言微型文本转语音系统,基于 Python 与深度学习技术, 实现超低资源占用的高保真语音合成
采用轻量化架构设计,在 CPU 上即可实现实时语音合成,RTF < 0.1,适用于边缘设备部署。
支持中英日法德等 10+ 种语言,采用统一音素体系,实现跨语言语音克隆与代码切换。
基于 MIT 协议开源,提供完整的 Python 推理接口与训练代码,支持 ONNX 导出与量化压缩。