-
Notifications
You must be signed in to change notification settings - Fork 0
Chinese Traditional Conversation Recording
Dan edited this page Aug 21, 2026
·
1 revision
會話錄音可以捕捉多人的討論,轉錄語音,並將貢獻分配給檢測到的說話者。此功能除了使用普通的轉錄模型外,還使用了獨立的說話者識別模型。
- 打開 設定 → 會話錄音。
- 選擇一個說話者識別模型。
- 使用 管理模型 下載所需檔案。
- 返回會話錄音分頁並啟用錄音。
可用的模型系列具有不同的授權和質量特性:
- 標準版 使用 Pyannote Segmentation 3.0 搭配 CAM++ 嵌入。它體積小,採用寬鬆的 MIT/Apache 2.0 授權,適合商業使用。
- 高品質版 使用 Reverb Diarization 搭配 NVIDIA TitaNet-Large 嵌入,以實現更強的講者分離。其模型授權僅允許非商業用途。
在選擇用於專業或商業錄音之前,請先檢查模型授權。
- 新段落的暫停秒數 控制何時暫停開始新的對話段落。
- 預期講者數 可保持自動,或在適當情況下設置為已知數量。
- 即時和已完成的段落會顯示其當前狀態。
- 偵測到的講者會被暫時命名為 Speaker 1 等,直到你重命名他們。
- 你可以重命名段落、重命名講者,並將文字段落重新分配給其他講者。
當對話錄音正在進行時,全域聽寫和語音指令快捷鍵將被禁用。
揚聲器分離靈敏度 會改變相似聲音被分割的容易程度:
- 較低的靈敏度傾向將相似的聲音合併。
- 較高的靈敏度會更積極地區分相似聲音,但可能產生額外的揚聲器。
語音偵測靈敏度 控制將偵測到的區塊視為語音的音量門檻。較高的數值能更強烈地拒絕點擊聲和背景噪音;較低的數值則可偵測較安靜的語音。
- 複製單一貢獻。
- 刪除一段內容或整個章節。
- 打開完整對話,並可選擇包含時間戳記。
- 當不再需要時,清除完整的對話歷史記錄。
啟用事實查核以讓已配置的本地人工智慧(AI)增強模型識別可檢查的主張,並將其與維基百科的證據進行比較。裁決可以是「準確」、「部分準確」、「不準確」或「無法驗證」,並包括信心水準及來源鏈接。
隱私界限:對話文字由已配置的 AI 執行環境處理。使用內建模型時資料保持在本地。僅將簡短的百科搜尋詞——而非對話本身——發送至維基百科。事實查核需要配置 AI 增強功能。
說話者識別是概率性的。將說話者分配和事實查核裁決視為輔助工具,而非權威記錄。
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động