Skip to content

Deutsch Sprache zu Text

Dan edited this page Aug 21, 2026 · 1 revision

Sprache zu Text

Sprache zu Text ist der normale Diktierablauf. Voice2Win nimmt auf, solange die globale Tastenkombination aktiv ist, transkribiert das Audio lokal, verbessert das Ergebnis optional mit lokaler KI und fügt den fertigen Text in die Anwendung ein, die beim Aufnahmestart aktiv war.

Aufnahmemodi

Der Modus gilt gemeinsam für die Tastenkombinationen von Sprache zu Text und Sprachbefehl.

Modus Funktionsweise
Gedrückt halten Halte die Tastenkombination beim Sprechen gedrückt. Das Loslassen beendet die Aufnahme und startet die Transkription.
Einrasten Drücke die Tastenkombination einmal kurz zum Starten und ein weiteres Mal zum Beenden.
Hybrid mit Doppeltippen Halte die Kombination normal gedrückt oder drücke sie zweimal kurz, um den Einrastmodus zu starten. Ein weiterer Tastendruck beendet die eingerastete Aufnahme.

Der Modus wird unter Einstellungen → Tastenkombination ausgewählt.

Normaler Ablauf

  1. Wechsle zur Zielanwendung und platziere den Cursor.
  2. Starte die Aufnahme mit der konfigurierten Tastenkombination.
  3. Sprich natürlich. Die Aufnahmeanzeige bestätigt, dass Voice2Win zuhört.
  4. Beende die Aufnahme. Abhängig von den Einstellungen kann bereits vorläufiger Text sichtbar sein.
  5. Voice2Win transkribiert, formatiert und verbessert den Text optional, bevor er eingefügt wird.

Drücke Escape, wenn eine Transkription oder KI-Verarbeitung ungewöhnlich lange dauert und der Hinweis zum Abbrechen sichtbar ist.

Sprachauswahl und Fachbegriffe

Wähle die Sprache, die du hauptsächlich sprichst und in der der Text geschrieben werden soll. Dies ist auch dann die richtige Wahl, wenn das Diktat häufige Fremdwörter enthält. Die automatische Erkennung ist bei oft wechselnden Sprachen nützlich, eine feste Sprache ist jedoch normalerweise zuverlässiger.

Unter Einstellungen → Audiotranskription kannst du bei Eigene Fachbegriffe und Namen Namen, Abkürzungen, Produktbegriffe und ungewöhnliche Schreibweisen ergänzen. Diese Einträge unterstützen die Whisper-Erkennung; sie sind keine automatischen Textersetzungen.

Formatierung des Diktats

Die Einstellungen der Audiotranskription können vor dem Einfügen folgende Formatierungen anwenden:

  • Gesprochene Satzzeichen umwandeln ersetzt Wörter wie „Punkt“, „Komma“ und „neue Zeile“ durch Satzzeichen. Deutsche und englische Befehle werden gleichzeitig erkannt.
  • Punkt am Textende entfernen eignet sich für Suchfelder und kurze Formulareingaben.
  • Ersten Buchstaben kleinschreiben hilft beim Fortsetzen eines Satzes an der Cursorposition.
  • Aufeinanderfolgende Diktate verbinden passt Leerzeichen und Großschreibung anhand der vorherigen Einfügung in derselben Anwendung an.

Transkriptionsverlauf

Voice2Win speichert auf dem Gerät einen täglichen Verlauf. Du kannst:

  • Einen anderen Tag öffnen und dessen Einträge durchsuchen.
  • Einen Eintrag kopieren oder den vollständig zusammengeführten Text anzeigen.
  • Die Aufnahme wiedergeben, wenn die zugehörige WAV-Datei gespeichert wurde.
  • Eine Aufnahme mit dem aktuellen Modell neu transkribieren und den Eintrag ersetzen oder einen neuen Eintrag erstellen.
  • Einzelne Einträge löschen.

Zeitlich benachbarte Aufnahmen können als zusammengeführte Gruppe angezeigt werden. Das Speichern von WAV-Dateien ermöglicht Wiedergabe und erneute Transkription, benötigt aber zusätzlichen Speicherplatz. Werden WAV-Dateien gelöscht, bleibt der Text erhalten; Wiedergabe und erneute Transkription dieser Aufnahmen sind anschließend dauerhaft nicht mehr möglich.

Methoden der Texteinfügung

Voice2Win unterstützt drei Methoden:

  • Zwischenablage — schnell und zuverlässig bei langen Texten und Sonderzeichen. Voice2Win ersetzt den Inhalt der Zwischenablage vorübergehend und stellt ihn normalerweise wieder her.
  • Unicode — unabhängig vom Tastaturlayout und Standard unter macOS und Linux. Einige Windows-Anwendungen verarbeiten simulierte Unicode-Eingaben jedoch nicht zuverlässig.
  • Scancode — ähnelt einer physischen Tastatureingabe und kann bei schwierigen Windows-Anwendungen helfen, ist aber vom aktiven Tastaturlayout abhängig.

Erhöhe bei fehlenden Zeichen die Verzögerung der Tastatursimulation. Remotedesktop-Anwendungen benötigen möglicherweise Scancodes, Unicode oder eine andere Tastenkombination zum Einfügen. Siehe Problembehandlung.

Aufnahmeanzeige und Tonsignale

Die Aufnahmeanzeige bleibt über anderen Anwendungen sichtbar und bietet verschiedene Darstellungsarten, Farben, Positionen und Größen. Start- und Stopptöne können für Sprache zu Text und Sprachbefehl getrennt aktiviert sowie in Klang, Dauer und Lautstärke angepasst werden. Eigene synthetische Tonsignal-Vorlagen werden ebenfalls unterstützt.

Soll Text bereits während des Sprechens erscheinen, lies unter Echtzeit-Transkription weiter.

Languages
English

Features

Configuration

Help

Deutsch

Funktionen

Konfiguration

Hilfe

Español

Funciones

Configuración

Ayuda

Français

Fonctionnalités

Configuration

Aide

Português (Brasil)

Recursos

Configuração

Ajuda

Italiano

Funzionalità

Configurazione

Aiuto

Nederlands

Functies

Configuratie

Help

Polski

Funkcje

Konfiguracja

Pomoc

Svenska

Funktioner

Konfiguration

Hjälp

简体中文

功能

配置

帮助

日本語

機能

設定

ヘルプ

한국어

기능

구성

도움말

हिन्दी

सुविधाएँ

कॉन्फ़िगरेशन

सहायता

繁體中文

功能

設定

說明

Bahasa Indonesia

Fitur

Konfigurasi

Bantuan

Tiếng Việt

Tính năng

Cấu hình

Trợ giúp

ไทย

คุณสมบัติ

การกำหนดค่า

วิธีใช้

العربية

الميزات

الإعداد

المساعدة

Türkçe

Özellikler

Yapılandırma

Yardım

Русский

Возможности

Настройка

Справка

Українська

Функції

Налаштування

Довідка

Clone this wiki locally