dsh-voice-scribe v0.2.0
dsh-voice-scribe v0.2.0 — 本地离线识别引擎(零配置 · 零 API key)
🧠 核心变化:新增「本地离线识别」引擎
- 引擎:SenseVoice(sherpa-onnx,CPU 推理),支持中文自动标点、中/英/日/韩/粤
- 音频完全在本机处理,不出本机、不依赖任何云端 API/API Key
- 首次使用自动后台下载模型(约 230MB,国内镜像 hf-mirror.com),之后完全离线可用
- 不受浏览器限制:天然规避 Chrome 被墙 / Edge Stable 回归 / 离线环境
⚙️ 默认引擎改为「自动(auto)」
- 本地模型就绪 → 直接本地识别(100% 可靠)
- 未就绪 → 先用浏览器 Web Speech;不可用时自动切换本地并自动下载模型
- 从 0.1.x 升级的用户会自动迁移到「自动」模式
🐛 修复
- 超大请求体不再挂起(真正返回 413)
- 润色失败不再卡状态条;插件注册名统一为 dsh-voice-scribe
- trustedHosts 校验移到启动期(坏配置不再拖垮全部请求)
- 语言码不再截断(粤语 yue 等 3 字母码)
- 热键不再误触非输入框;本地转写解码修复(杜绝卡死)
- 客户端 abort 透传服务端;设置页支持清除已存 key、URL 校验
📌 关于 Web Speech(重要说明)
浏览器内置识别(Web Speech)依赖 Google/Microsoft 语音服务:
- Chrome 在中国大陆被墙(Google 服务不可达)
- Edge Stable 有已知回归(微软官方确认:Stable/Beta 的 SpeechRecognition 报 network 错误,Dev/Canary 正常,后续版本修复)
- 插件不再依赖它作为主路径;「自动」模式会无缝使用本地引擎
- 若显式选择「浏览器内置识别」遇到网络错误,这是浏览器/网络限制,请切换「本地离线识别」或「云端 ASR」
🔧 安装 / 升级
dsh plugin --profile web add dsh-voice-scribe@0.2.0
# 重启 dsh web 后生效- 新增原生依赖 sherpa-onnx-node(预编译,win/mac/linux)
- 首次使用本地引擎时自动下载模型(约 230MB,只需一次)