Skip to content

windows-v4.12

Latest

Choose a tag to compare

@jianchang512 jianchang512 released this 06 Sep 05:36
· 18 commits to main since this release

v4.12 Win10/11 预打包版本下载

MacOS/Linux系统请使用源码部署
  1. 安装依赖:

    # macOS
    brew install libsndfile git
    
    brew tap homebrew-ffmpeg/ffmpeg
     
    brew install homebrew-ffmpeg/ffmpeg/ffmpeg
    
    # Ubuntu/Debian
    sudo apt-get install ffmpeg libsndfile1-dev
  2. 安装 uv:

    curl -LsSf https://astral.sh/uv/install.sh | sh
  3. 克隆并启动:

    git clone https://github.com/jianchang512/pyvideotrans.git
    cd pyvideotrans
    uv sync
    uv run sp.py

更新日志/Changelos

  • parakeet日语(内置)识别渠道替换为Nemotron-3.5-asr-0.6b(内置)模型,支持欧洲系及日韩越等40种语言
  • Huggingface_ASR(内置)增加nvidia/parakeet-tdt-0.6b-v3模型,支持10多种欧洲语言
  • 移除whisper预分割音频合并邻近短字幕
  • 优化 VAD 切分算法
  • 优化翻译提示词
  • LLM重新断句调整为LLM纠错,只修改错别字和恢复标点,不重新断句,可在高级选项-通用设置-LLM纠错AI渠道调整,默认 DeepSeek
  • 二次识别固定使用faster-whisper,以增强语言支持和兼容性,默认使用large-v3-turbo模型,可在高级选项-语音识别参数区域-二次识别所用模型调整
  • 语音转录/文字合成/翻译字幕 独立功能显示全部可用的80种语言
  • 视频翻译发音语言下拉列表增加自动检测
  • GeminiAI语音识别渠道固定使用gemini-3.5-transcribe模型
  • 升级 transformers到 5.13.1
  • 修复其他已知bug

v4.12 完整包下载(2.7G)

v4.12 补丁包下载(360MB)

补丁包不可单独使用,仅用于覆盖旧包, 覆盖后如果闪退或报错,请下载完整包。


解压注意事项
  • 解压7z压缩包,解压后,找到 sp.exe 文件,双击即可启动软件,不可在压缩包内双击运行。
  • 不要将软件解压到桌面或 C 盘的 Program Files 等需要管理员权限的文件夹下。
  • 避免路径错误: 解压路径中不要包含中文、空格或特殊符号。
  • 如果使用7zip软件解压提示错误,请尝试使用 Bandizip360压缩软件 进行解压

如果新版遇到问题可继续使用上个版本(v4.11/v4.03)

v4.11 完整包下载(2.7G)

v4.09 完整包下载(2.7G)

v4.03 完整包下载(2.7G)

New Contributors

Full Changelog: v4.11...v4.12