Skip to content

Releases: Rio-promax/dsh-voice-input

DSH 语音输入插件 1.1

Choose a tag to compare

@Rio-promax Rio-promax released this 07 Sep 12:15

DSH 语音输入插件 1.1

在 DeepSeek Harness 输入栏直接进行语音输入,支持实时听写和整段录音。

主要能力

  • 支持浏览器内置 ASR、本地 Whisper、本地 FunASR、OpenAI 兼容云 ASR 和豆包云 ASR
  • 支持实时听写与整段录音识别
  • 支持 AI 精修,可优化标点、同音字和专业术语
  • 支持结合最近聊天语境进行 AI 精修
  • 设置可跨浏览器持久化
  • 本地模型支持按需下载和自定义保存目录
  • 提供 Windows、macOS 和 Linux 安装说明

安装前提

  • Node.js:22.19+ 或 24+,并确保 npm/npx 可用
  • Windows 一键安装需要 PowerShell 7(命令为 pwsh)
  • Python:仅使用本地 Whisper/FunASR 时需要,推荐 Python 3.10–3.12
  • 浏览器录音需要 HTTPS 或 localhost,推荐 Chrome 或 Edge
  • 首次使用本地识别引擎时需要下载模型

快速安装

  1. 先确认 DSH 可以启动并初始化配置:
npx @deepseek-ai/dsh web --no-open

初始化完成后按 Ctrl+C 停止进程。

  1. 下载仓库 ZIP 并解压,或使用 Git:
git clone https://github.com/Rio-promax/dsh-voice-input.git
  1. Windows 在仓库根目录执行:
pwsh -ExecutionPolicy Bypass -File .\install.ps1
  1. 安装完成后重启 DSH:
npx @deepseek-ai/dsh web

macOS/Linux 请按仓库中的 voice-input-plugin/DISTRIBUTION.md 完成手动部署;首次使用本地引擎时,再按说明下载模型。

隐私说明

使用本地 Whisper/FunASR 时,音频不会离开本机。使用云 ASR 或 AI 精修时,对应音频或文本会发送给第三方服务。