-
Notifications
You must be signed in to change notification settings - Fork 0
Deutsch Sprache zu Text
Sprache zu Text ist der normale Diktierablauf. Voice2Win nimmt auf, solange die globale Tastenkombination aktiv ist, transkribiert das Audio lokal, verbessert das Ergebnis optional mit lokaler KI und fügt den fertigen Text in die Anwendung ein, die beim Aufnahmestart aktiv war.
Der Modus gilt gemeinsam für die Tastenkombinationen von Sprache zu Text und Sprachbefehl.
| Modus | Funktionsweise |
|---|---|
| Gedrückt halten | Halte die Tastenkombination beim Sprechen gedrückt. Das Loslassen beendet die Aufnahme und startet die Transkription. |
| Einrasten | Drücke die Tastenkombination einmal kurz zum Starten und ein weiteres Mal zum Beenden. |
| Hybrid mit Doppeltippen | Halte die Kombination normal gedrückt oder drücke sie zweimal kurz, um den Einrastmodus zu starten. Ein weiterer Tastendruck beendet die eingerastete Aufnahme. |
Der Modus wird unter Einstellungen → Tastenkombination ausgewählt.
- Wechsle zur Zielanwendung und platziere den Cursor.
- Starte die Aufnahme mit der konfigurierten Tastenkombination.
- Sprich natürlich. Die Aufnahmeanzeige bestätigt, dass Voice2Win zuhört.
- Beende die Aufnahme. Abhängig von den Einstellungen kann bereits vorläufiger Text sichtbar sein.
- Voice2Win transkribiert, formatiert und verbessert den Text optional, bevor er eingefügt wird.
Drücke Escape, wenn eine Transkription oder KI-Verarbeitung ungewöhnlich lange dauert und der Hinweis zum Abbrechen sichtbar ist.
Wähle die Sprache, die du hauptsächlich sprichst und in der der Text geschrieben werden soll. Dies ist auch dann die richtige Wahl, wenn das Diktat häufige Fremdwörter enthält. Die automatische Erkennung ist bei oft wechselnden Sprachen nützlich, eine feste Sprache ist jedoch normalerweise zuverlässiger.
Unter Einstellungen → Audiotranskription kannst du bei Eigene Fachbegriffe und Namen Namen, Abkürzungen, Produktbegriffe und ungewöhnliche Schreibweisen ergänzen. Diese Einträge unterstützen die Whisper-Erkennung; sie sind keine automatischen Textersetzungen.
Die Einstellungen der Audiotranskription können vor dem Einfügen folgende Formatierungen anwenden:
- Gesprochene Satzzeichen umwandeln ersetzt Wörter wie „Punkt“, „Komma“ und „neue Zeile“ durch Satzzeichen. Deutsche und englische Befehle werden gleichzeitig erkannt.
- Punkt am Textende entfernen eignet sich für Suchfelder und kurze Formulareingaben.
- Ersten Buchstaben kleinschreiben hilft beim Fortsetzen eines Satzes an der Cursorposition.
- Aufeinanderfolgende Diktate verbinden passt Leerzeichen und Großschreibung anhand der vorherigen Einfügung in derselben Anwendung an.
Voice2Win speichert auf dem Gerät einen täglichen Verlauf. Du kannst:
- Einen anderen Tag öffnen und dessen Einträge durchsuchen.
- Einen Eintrag kopieren oder den vollständig zusammengeführten Text anzeigen.
- Die Aufnahme wiedergeben, wenn die zugehörige WAV-Datei gespeichert wurde.
- Eine Aufnahme mit dem aktuellen Modell neu transkribieren und den Eintrag ersetzen oder einen neuen Eintrag erstellen.
- Einzelne Einträge löschen.
Zeitlich benachbarte Aufnahmen können als zusammengeführte Gruppe angezeigt werden. Das Speichern von WAV-Dateien ermöglicht Wiedergabe und erneute Transkription, benötigt aber zusätzlichen Speicherplatz. Werden WAV-Dateien gelöscht, bleibt der Text erhalten; Wiedergabe und erneute Transkription dieser Aufnahmen sind anschließend dauerhaft nicht mehr möglich.
Voice2Win unterstützt drei Methoden:
- Zwischenablage — schnell und zuverlässig bei langen Texten und Sonderzeichen. Voice2Win ersetzt den Inhalt der Zwischenablage vorübergehend und stellt ihn normalerweise wieder her.
- Unicode — unabhängig vom Tastaturlayout und Standard unter macOS und Linux. Einige Windows-Anwendungen verarbeiten simulierte Unicode-Eingaben jedoch nicht zuverlässig.
- Scancode — ähnelt einer physischen Tastatureingabe und kann bei schwierigen Windows-Anwendungen helfen, ist aber vom aktiven Tastaturlayout abhängig.
Erhöhe bei fehlenden Zeichen die Verzögerung der Tastatursimulation. Remotedesktop-Anwendungen benötigen möglicherweise Scancodes, Unicode oder eine andere Tastenkombination zum Einfügen. Siehe Problembehandlung.
Die Aufnahmeanzeige bleibt über anderen Anwendungen sichtbar und bietet verschiedene Darstellungsarten, Farben, Positionen und Größen. Start- und Stopptöne können für Sprache zu Text und Sprachbefehl getrennt aktiviert sowie in Klang, Dauer und Lautstärke angepasst werden. Eigene synthetische Tonsignal-Vorlagen werden ebenfalls unterstützt.
Soll Text bereits während des Sprechens erscheinen, lies unter Echtzeit-Transkription weiter.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động