Skip to content

v0.2.0: TTS 多引擎配音 + 渲染流程重构

Latest

Choose a tag to compare

@chenwr727 chenwr727 released this 02 Sep 07:31

新增

  • TTS 多引擎配音:支持 Edge(免密钥)、阿里云百炼 CosyVoice、阿里云百炼 Qwen-Audio-TTS、火山引擎 Seed-TTS 四种引擎,按需配置启用
  • 引擎 / 音色全部由配置驱动,新增模型只需改配置、无需改代码
  • 渲染设置面板支持选择引擎 / 音色 / 语速 / 音量,支持二次渲染

变更

  • 渲染流程改用 @remotion/renderer JS API,新增 Chromium 自动探测与启动时清理
  • 依赖从 playwright 改为 playwright-core
  • 桌面端打包仅输出免安装 zip 包(不再生成 NSIS 安装程序)

修复

  • 修复开发模式下保存配置后连接重置的问题(等待后端端口释放)

文档

  • 新增 docs/TTS.md
  • 更新 API / 架构 / 配置 / 部署 / 桌面端文档

下载

文件 体积 说明
TextToTalk-0.2.0-win-portable.zip 199 MB Windows x64,免安装版,解压即用