SubForge v1.1.6
SubForge v1.1.6
本次发布集中修复长任务恢复、字幕漏翻与错位、桌面端 ASR 子进程以及 Windows 安装兼容性,并重新整理设置与主工作区。当前安装包基于提交 4a0350f 重新构建。
转录与时间轴
- DeepFilterNet3、FasterWhisper 和 WhisperX 使用独立 Worker 运行,统一心跳、取消和强制退出流程,降低转录卡死及关闭应用时残留进程的概率。
- DeepFilterNet3 会识别并修复损坏或不完整的模型缓存;MPS 不可用时提供明确诊断并保留 CPU 回退路径。
- 加强 Silero VAD、词级对齐和字幕边界校验,减少句尾未覆盖完整语音、紧邻字幕断错位置及时间轴异常。
- 多人模式继续优先使用原始音轨,避免过度降噪吞掉较弱说话人;说话人元数据可贯穿断句和翻译流程。
- 转录和字幕处理通过统一任务上下文发布进度、实时预览、取消状态与恢复信息。
断句与翻译质量
- 文档级审计覆盖漏翻、空译文、占位说明、重复译文、批量提前或延后,以及中文主语、地点、时间状语和从句错位。
- 修复仅作用于审计确认的局部窗口,并继续校验字幕索引、原文、时间轴和信息完整性,避免对正确字幕进行全片重写。
- 加强英语短语、地名、车型、比较结构、关系从句及谓语边界保护,提高中文阅读顺序的完整性。
- DeepSeek、MiniMax 和 NVIDIA 等服务在限流或临时网络错误时按策略等待和重试;恢复文件会保留已经完成的有效翻译。
- Microsoft 翻译已切换到官方 Azure AI Translator v3 接口,支持 Endpoint、API Key、Region、批量请求和限流重试。原有
bing配置标识继续兼容。
桌面应用与设置
- LLM 供应商配置按服务分别保存 Base URL、API Key 和模型,切换供应商不再错误复用其他服务的密钥。
- 语音识别设置明确展示当前引擎、转录模型和语言对齐模型,并保留模型检测、下载和连接测试入口。
- 主工作区文案、空状态和处理阶段改为面向用户任务的说明;导入、转录、断句、翻译和导出职责更加清晰。
- 原生文件选择获得会话级路径授权,Windows 用户目录中的
Videos也可直接访问;应用日志可从界面打开。 - Windows 安装升级前会清理旧
_internal运行时,避免旧 DLL/PYD 残留导致新版本启动失败。 - Windows 安装包会完整携带 FFmpeg 所需动态库,并补齐新版 WhisperX VAD 导入所需的轻量兼容类型;打包目录和安装后目录均已通过实际运行检查。
- 桌面构建固定使用兼容的
static-ffmpeg 2.13,DMG、EXE 和应用界面统一显示版本1.1.6。
工程质量
- 引入统一设置模型、CLI/FastAPI 兼容适配器、接口无关的任务上下文、翻译质量模块及 ASR Worker 公共生命周期。
- 增加架构边界测试,阻止核心层反向依赖 FastAPI、CLI 或冻结的旧 PyQt 界面。
- 验证结果:
1004 passed, 18 skipped,Ruff 全部通过,Pyright0 errors,Next.js 生产构建通过。
安装包
- macOS Apple Silicon:
SubForge-1.1.6-macos-arm64.dmg - Windows x64:
SubForge-1.1.6-windows-x64-setup.exe
Whisper、forced alignment、Community-1 和 DeepFilterNet 模型继续按需下载,不会打包进安装程序。