✨ 新一代神经语音合成
MOSS-TTS-Nano · 灵声工坊
极致逼真的多语种语音克隆与情感迁移,一键生成媲美真人的自然语音。
🎙️ 秒级声音克隆
📖 智能文本正则化
⚡ 实时流式播放
🎚️ 精细采样控制
🎛️ 语音合成控制台
🎭 声音预设 / 示例
-- 请选择声音预设 (或上传参考音频) --
🎤 参考音频 (声音克隆源)
💡 提示:可以选择上传音频文件,或使用下方的预设声音
📂 本地上传
🔄 清除上传
📝 待合成文本
⚙️ 高级生成参数 (调节音质与性能)
最大音频帧数
克隆文本最大Token
TTS批次大小
Codec批次大小
CPU线程数
Attention后端
默认
SDPA
Eager
随机种子
文本温度
文本Top-P
音频温度
音频Top-P
重复惩罚系数
启用采样
WeTextProcessing 正则化
增强TTS文本清洗
🌊 实时流式解码
初始播放延迟(秒)
文本Top-K
音频Top-K
✨ 立即合成语音
⏸️ 暂停/恢复
🔄 刷新状态
📡 运行状态 & 合成结果
🔥 模型预热状态
加载中...
📖 文本正则化状态
就绪
⚡ 合成进度
空闲
📄 正则化后文本
🎵 逐句播放脚本 (高亮跟随)
等待合成…
🎧 合成音频预览
💡 提示:请选择声音预设或上传参考音频,然后输入文本进行合成。