v0.1.0-beta
Pre-release
Pre-release
首个带版本号的 baseline release。
主要能力
- 本地优先会议转写:上传录音(会后高质量处理)+ 实时字幕(会中)双路径
- 多人说话人分离(pyannote 离线)+ 声纹匹配已登记人物(严格阈值,可校正)
- ASR 多引擎运行时切换(qwen3 / sensevoice / paraformer / paraformer_streaming)
- 声纹引擎切换(CamPlus / ERes2Net / Wespeaker),compare_and_identify 上提到基类
- LLM 摘要/行动项/纪要(prompt 持久化 + map-reduce + 自适应篇幅),默认本地 TextRank 兜底
- FTS5 全文搜索、说话人合并/拆分、WebSocket 自动重连、浏览器内录音 + HTTPS
- 4 格式导出(Markdown / SRT / WebVTT / JSON)
安全
- 0 字节外传:音频/转写/声纹永不离本机;LLM 默认关,公网 LLM 需显式 opt-in 且只发转写文本
- LLM endpoint DNS pinning(防 rebinding)、JWT 鉴权、WS/HTTP 限流、可配置上传大小
- 本地优先部署:默认绑定 127.0.0.1
平台
- macOS(MPS 优先,90s 超时回退 CPU)、Linux、Windows;单进程(WORKERS=1)
- Python 3.10–3.12(CI 验证 3.12)、Node 20+
- Docker CPU 镜像