数据集

2 个数据集
已选筛选: 文本转语音 PTH 模型 清除所有筛选
openbmb/VoxCPM1.5 已完整同步
VoxCPM1.5 是一个无需分词器的文本转语音(TTS)系统,能够生成上下文感知、富有表现力的语音,并实现逼真的零样本声音克隆。该模型基于 MiniCPM4-0.5B,采用扩散自回归架构直接生成连续语音表示,在 180 万小时双语语料上训练。相比前代版本,它支持 44.1kHz 高采样率输出,提高了音质,同时将 token 率降至 6.25Hz,提升效率。支持流式合成,实时因子低至 0.17,并可通过 SFT 或 LoRA 进行微调,适配个性化语音模型。
GITATTRIBUTESJSONMDPNGPTHSAFETENSORS Apache License 2.0 1.8 GiB 10 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
MYZY-AI/Muyan-TTS 已完整同步
Muyan-TTS是一个面向播客应用的可训练文本转语音模型。它在超过10万小时的播客音频数据上进行了预训练,支持零样本高质量语音合成,并能通过短短几分钟的目标语音实现说话人自适应,从而灵活地定制个性化声音。
GITATTRIBUTESJSONMDPTHSAFETENSORS Apache License 2.0 6.8 GiB 11 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00