TTS MultiModel v2.1.0 - Triple Engine Release
TTS MultiModel v2.1.0
多模型语音合成平台 - VoxCPM2 + IndexTTS 2.0 + dots.tts 三引擎正式发布
🎯 三引擎架构
| 引擎 | 说明 | 特色功能 |
|---|---|---|
| VoxCPM2 | OpenBMB 开源 TTS | 声音设计、极致克隆、剧本配音、LoRA 微调、流式生成 |
| IndexTTS 2.0 | IndexTeam 开源 TTS | 声音克隆、情绪控制、高质量合成 |
| dots.tts | dots-studio/dots.tts-base | 轻量高性能声音克隆 |
✨ 核心功能
- 一站式平台: 三引擎集成,声音克隆、声音设计、剧本配音、LoRA 微调
- 多角色剧本配音: 自动分配说话人,批量生成配音
- LoRA 微调训练: 自定义数据集微调 VoxCPM2
- 流式生成: 长文本实时流式音频输出 (SSE)
- 9 种预置音色: 开箱即用
- 多语言界面: 中文 / English / 日本語 / 한국어
- 多 GPU 后端: NVIDIA CUDA / Apple MPS / CPU
🖥️ Web UI
- FastAPI + HTMX + Jinja2 现代化响应式界面
- 暗色 / 亮色主题切换
- 批量处理 + 历史记录管理 (SQLite 全文搜索)
🚀 快速开始
Windows (内置 WinPython):
`�ash
git clone https://github.com/ReSerendipity/TTS_MultiModel.git
cd TTS_MultiModel
install.bat
下载模型后
start.bat
`
Docker:
`�ash
docker compose up -d
访问 http://localhost:7869
`
📦 技术栈
- Web: FastAPI + Uvicorn + HTMX + Jinja2 + Bootstrap
- TTS: VoxCPM2 + IndexTTS 2.0 + dots.tts
- ASR: SenseVoiceSmall
- 音频: speech_zipenhancer + FFmpeg + SoX
- 深度学习: PyTorch + Transformers + FunASR
- 容器: Docker + Docker Compose
📝 许可证
Apache License 2.0