-
Notifications
You must be signed in to change notification settings - Fork 0
Japanese Speech to Text
音声からテキストへの変換は通常のディクテーションワークフローです。Voice2Winは、グローバルショートカットが有効な間に録音を行い、音声をローカルで文字起こしし、必要に応じてローカルAIで結果を改善し、録音開始時にアクティブだったアプリケーションに最終テキストを挿入します。
このモードは音声からテキストへの変換と音声コマンドショートカットで共通です。
| モード | 動作方法 |
|---|---|
| ホールド | 話している間ショートカットを押し続けます。放すと録音が終了し、文字起こしが始まります。 |
| ラッチ | 一度押して離すと録音が開始され、話した後、再度押して離すと録音が停止します。 |
| ハイブリッドダブルタップ | 通常通り押し続けるか、ショートカットを素早く2回押してラッチモードに入ります。ラッチした録音を停止するには、もう一度押します。 |
モードは 設定 → キーコンビネーション から選択できます。
- ターゲットアプリケーションに切り替え、カーソルを配置します。
- 設定されたショートカットで録音を開始します。
- 自然に話します。画面上の録音インジケーターがVoice2Winが聞いていることを確認します。
- 録音を終了します。設定によっては、仮のテキストがすでに表示されている場合があります。
- Voice2Winが文字起こし、フォーマット、必要に応じた強化を行い、結果を挿入します。
文字起こしやAI操作が異常に長くかかっている場合、キャンセルヒントが表示されたときにEscapeを押します。
主に話す言語、そしてテキストが書かれるべき言語を選択します。これは、口述に一般的な外国語が含まれていても正しい選択となります。頻繁に言語を変更する場合は自動検出が便利ですが、固定言語の方が通常はより信頼できます。
設定 → 音声文字起こし で カスタム専門用語と名前 を使用して、名前、略語、製品用語、または特殊なスペルを追加できます。これらのエントリは Whisper の認識を導くものであり、自動的なテキスト置換ではありません。
音声文字起こしの設定では、挿入前に次のフォーマットを適用できます。
- 話された句読点を変換 は、「period(ピリオド)、comma(コンマ)、new line(改行)」などの単語を句読点に変換します。ドイツ語と英語のコマンドは同時に認識されます。
- テキスト末尾のピリオドを削除 は、検索ボックスや短い形式のフィールドに便利です。
- 最初の文字を小文字にする は、カーソル位置で文を続けるのに役立ちます。
- 連続した音声入力を接続 は、同じアプリケーション内での前回の挿入に基づいて先頭の空白や大文字化を調整します。
Voice2Winはデバイスに日ごとの履歴を保存します。次のことができます:
- 別の日を閲覧し、その日の項目を検索する。
- 項目をコピーするか、完全に統合されたテキストを表示する。
- 該当するWaveform Audio File Format(WAV)ファイルが保存されている場合に録音を再生する。
- 現在のモデルで再文字起こしを行い、項目を置き換えるか新しい項目を作成する。
- 個別の項目を削除する。
近くの録音は統合グループとして表示できます。WAV録音を保存すると再生および再文字起こしが可能になりますが、ディスク容量が多く必要です。WAVファイルを削除すると、テキストは保持されますが、該当録音の再生と再文字起こしは永久に削除されます。
Voice2Winは3つの挿入方法をサポートしています:
- クリップボード — 長文や特殊文字に対して迅速で信頼性があります。Voice2Winは一時的にクリップボードを置き換え、通常は以前の内容を復元します。
- Unicode — キーボードレイアウトに依存せず、macOSやLinuxでのデフォルトですが、一部のWindowsアプリケーションではシミュレートされたUnicodeを正確に処理できない場合があります。
- スキャンコード — 物理的なキーボード入力に似ており、難しいWindowsアプリケーションで役立つことがありますが、アクティブなキーボードレイアウトに依存します。
文字が欠けている場合は、キーボードシミュレーションの遅延を増やしてください。リモートデスクトップアプリケーションでは、スキャンコード、Unicode、または代替のクリップボード貼り付けショートカットが必要な場合があります。トラブルシューティングを参照してください。
録音インジケーターは他のアプリケーションの上に表示されたままで、異なる表示スタイル、色、位置、サイズを使用することができます。開始音と停止音は、音声認識とボイスコマンドで個別に有効にでき、それぞれ音、持続時間、音量の設定が可能です。カスタム合成音プリセットもサポートされています。
話している間に表示されるテキストについては、リアルタイム文字起こしを続けてください。
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động