-
Notifications
You must be signed in to change notification settings - Fork 0
Japanese Conversation Recording
Dan edited this page Aug 21, 2026
·
1 revision
会話の録音は、複数人による議論を記録し、発話を文字起こしし、検出された話者に貢献を割り当てます。この機能は、通常の文字起こしモデルに加えて、別々の話者認識モデルを使用します。
- 設定 → 会話の録音 を開きます。
- 話者認識モデルを選択します。
- モデルの管理 を使用して、必要なファイルをダウンロードします。
- 会話の録音タブに戻り、録音を有効にします。
利用可能なモデルファミリーは、ライセンスと品質の特性が異なります:
- Standard は CAM++ 埋め込みを使用した Pyannote Segmentation 3.0 を使用します。コンパクトで、商業利用に適した寛容な MIT/Apache 2.0 ライセンスを使用しています。
- High quality は Reverb Diarization と NVIDIA TitaNet-Large 埋め込みを使用して、より強力な話者分離を実現します。そのモデルライセンスは非商用利用のみを許可します。
プロフェッショナルまたは商業録音で使用する前に、モデルのライセンスを確認してください。
- 新しいセクションのための秒単位のポーズ は、ポーズが新しい会話セクションを開始するタイミングを制御します。
- 予想される話者数 は自動のままにするか、適切な場合は既知の人数に設定できます。
- ライブおよび確定済みのセクションは現在の状態を表示します。
- 検出された話者には、名前を変更するまで Speaker 1 などの一般的な名前が付けられます。
- セクションの名前変更、話者の名前変更、または発言を他の話者に割り当て直すことができます。
会話の録音がアクティブな間は、グローバルなディクテーションおよび音声コマンドのショートカットは無効になります。
話者分離感度 は、類似した声をどれだけ容易に分離するかを変更します:
- 感度を低くすると、類似した声が統合されやすくなります。
- 感度を高くすると、類似した声をより積極的に区別しますが、余分な話者が作られることがあります。
音声検出感度 は、検出されたブロックを音声として扱う音量の閾値を制御します。値を高くするとクリック音や背景雑音をより強く拒否し、値を低くするとより静かな音声を検出します。
- 個別の発言をコピーします。
- 段落やセクション全体を削除します。
- 会話全体を開き、必要に応じてタイムスタンプを含めます。
- もう必要でなくなった場合は、会話履歴全体をクリアします。
事実確認を有効にすると、設定されたローカル人工知能(AI)強化モデルが検証可能な主張を特定し、Wikipedia の証拠と比較できるようになります。判定は「正確」「部分的に正確」「不正確」「検証不可能」となり、信頼度とソースリンクが含まれます。
プライバシーの境界: 会話テキストは設定された AI 実行環境で処理されます。組み込みモデルを使用している場合は、これがローカルに留まります。Wikipedia には、会話自体ではなく、短い百科事典の検索用語のみが送信されます。事実確認には AI 強化の設定が必要です。
話者認識は確率的です。話者の割り当てや事実確認の判定は支援として扱い、権威ある記録とはみなさないでください。
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động