实时面试提词助手:监听在线会议系统音频,识别面试官问题,结合你的简历流式生成参考答案。
- 系统音频环回采集(Zoom / Teams / 腾讯会议等)
- 实时语音转写(支持腾讯云、OpenAI Realtime、阿里云 DashScope)
- 自动检测面试问题
- AI 流式生成参考答案(支持 OpenAI、阿里云 Qwen、Ollama)
- 简历上传(PDF / DOCX / TXT),回答时按需引用
- Node.js 22+
- Windows 10/11
- 对应 AI 服务的 API Key(Ollama 除外)
npm install
npm run dev# 当前平台
npm run dist
# 指定平台
npm run dist:win
npm run dist:mac推送版本 tag 后会自动构建 Windows / macOS 安装包并创建 Release:
git tag v1.0.0
git push origin v1.0.0也可在 GitHub → Actions → Build & Release 中手动触发(仅上传构建产物;打 tag 才会创建 Release)。
macOS 仅构建 Apple Silicon (arm64) dmg,未签名;首次打开可能需在「系统设置 → 隐私与安全性」中允许。
首次启动会弹出设置页,需配置:
| 配置项 | 说明 |
|---|---|
| STT Provider | 语音识别服务 |
| STT API Key | 对应服务的 API Key |
| LLM Provider | 大模型服务 |
| LLM API Key | 对应服务的 API Key(Ollama 无需) |
| 模型 | 可自定义,有默认值 |
在设置中选择 腾讯云 实时语音识别,填入:
| 字段 | 说明 |
|---|---|
| SecretId | 腾讯云 API 密钥 ID |
| SecretKey | 腾讯云 API 密钥 Key |
| AppId | 语音识别应用 AppId |
| 引擎模型 | 默认 16k_zh(中文普通话) |
获取方式:登录 腾讯云语音识别控制台 → 创建应用 → 查看 AppId,在 API 密钥管理 获取 SecretId / SecretKey。
在设置中选择 本地 Whisper,然后点击「下载 / 加载本地模型」按钮。
- 应用会自动从 Hugging Face 下载对应模型(首次需要网络,几百 MB)。
- 支持
small/medium/large-v3-turbo。 - 下载后完全离线运行,无需任何外部服务器或命令行。
- 你的 Ryzen 8845H + 32GB 推荐使用
medium。
首次点击「开始监听」时也会自动触发模型下载/加载。后续使用秒开。
- 腾讯云 STT:
16k_zh - OpenAI STT:
gpt-4o-transcribe - OpenAI LLM:
gpt-4o-mini - DashScope STT:
paraformer-realtime-v2 - DashScope LLM:
qwen-plus - Ollama LLM:
qwen2.5:7b - 本地 Whisper: 由用户启动 whisper.cpp server(推荐 medium / small)
- 在设置中填入 API Key
- 上传简历(可选但推荐)
- 打开在线会议
- 点击「开始监听」
- 面试官提问后,右侧自动出现 AI 参考答案
- 可「复制」或「重新生成」答案
- 仅捕获系统音频(会议扬声器输出),不会录制你的麦克风
- API Key 仅存储在本地,不会上传到任何第三方服务器
- 简历解析在本地完成,仅将文本发送给你选择的大模型 API