-
Notifications
You must be signed in to change notification settings - Fork 0
Chinese Simplified Conversation Recording
Dan edited this page Aug 21, 2026
·
1 revision
会话录音捕获多人讨论,将语音转录为文本,并将发言分配给检测到的说话者。该功能除了使用普通的转录模型外,还使用独立的说话者识别模型。
- 打开 设置 → 会话录音。
- 选择一个说话者识别模型。
- 使用 管理模型 下载所需文件。
- 返回会话录音标签页并启用录音。
可用的模型系列具有不同的许可和质量特性:
- 标准版 使用 Pyannote Segmentation 3.0 和 CAM++ 嵌入。它紧凑且采用宽松的 MIT/Apache 2.0 许可证,适合商业使用。
- 高质量版 使用 Reverb Diarization 和 NVIDIA TitaNet-Large 嵌入以实现更强的说话人分离。其模型许可证仅允许非商业使用。
在选择用于专业或商业录音的模型之前,请检查模型许可证。
- 新段落的暂停时长(秒) 控制何时暂停开始一个新的对话段落。
- 预期说话人数 可以保持自动,也可以在适当情况下设置为已知人数。
- 实时和最终段落显示各自的当前状态。
- 检测到的说话人将获得通用名称,如说话人 1,直到你重命名他们。
- 你可以重命名段落、重命名说话人,并将一段话重新分配给另一个说话人。
在对话录音活动期间,全局听写和语音命令快捷键被禁用。
说话者分离灵敏度 改变相似声音被分开的容易程度:
- 较低的灵敏度倾向于将相似声音合并。
- 较高的灵敏度更积极地区分相似声音,但可能产生额外的说话者。
语音检测灵敏度 控制将检测到的音块视为语音的音量阈值。较高的值更强烈地拒绝点击声和背景噪音;较低的值能检测到更安静的语音。
- 复制个人贡献。
- 删除一段或整个部分。
- 打开完整对话,并可选择包括时间戳。
- 当不再需要时,清除完整的对话历史记录。
启用事实核查以让已配置的本地人工智能(AI)增强模型识别可核查的声明,并将其与维基百科证据进行比较。裁定可以是“准确”、“部分准确”、“不准确”或“无法验证”,并包括置信值和来源链接。
隐私边界:对话文本由配置的AI运行时处理。使用内置模型时,数据保持本地。只有简短的百科搜索词——而非整个对话——会被发送到维基百科。事实核查需要配置AI增强。
说话人识别是概率性的。将说话人分配和事实核查裁定视为辅助,而非权威记录。
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động