Skip to content

Francais Reference des parametres

Dan edited this page Aug 22, 2026 · 2 revisions

Référence des paramètres

Ouvrez Paramètres avec le bouton en forme d'engrenage. OK enregistre les modifications ; Annuler les annule. Les modifications affectant les modèles, les environnements d'exécution, les emplacements de stockage ou les services réseau peuvent prendre un moment à s'appliquer et peuvent recharger un composant.

Cette référence est destinée à servir de guide d'ajustement, pas seulement comme une liste de contrôles. Les valeurs par défaut représentent un bon point de départ pour la plupart des installations Windows locales. Modifiez un paramètre associé à la fois, testez-le dans l'application où vous dictez réellement, et conservez la valeur précédente jusqu'à ce que le résultat soit clairement meilleur.

Points de départ utiles

Objectif Point de départ recommandé
Dictée quotidienne fiable dans les applications de bureau normales Langue de transcription fixe, insertion via Presse-papiers, restauration du presse-papiers activée, délais par défaut, normalisation audio activée
Dictée dans un terminal ou sur un bureau à distance Essayez Unicode d'abord si le transfert du presse-papiers n'est pas disponible. Sinon, conservez Presse-papiers et sélectionnez le raccourci de collage accepté par la cible distante. Utilisez Code de balayage pour les applications qui répondent uniquement de manière fiable aux entrées similaires aux touches physiques.
Documents longs Langue fixe, ponctuation parlée, formatage en chaîne, mode de raccourci verrouillé ou hybride, enregistrements WAV sauvegardés
Champs de recherche courts, chats et commandes Supprimez le point final ; utilisez éventuellement le format de lettre initiale en minuscule ; le mode de raccourci maintenu évite de laisser l’enregistrement actif par accident

| Utilisation silencieuse ou sensible à la confidentialité | Désactiver les enregistrements WAV sauvegardés, vérifier la conservation des transcriptions, désactiver l’insertion dans le presse-papiers si les applications de surveillance du presse-papiers posent problème, et éviter les environnements d'exécution à distance | | Latence perçue la plus faible | Désactiver l’aperçu en temps réel sauf si utile, utiliser un modèle/environnement d'exécution de transcription local rapide, maintenir les délais d’insertion faibles et ne pas collecter la sortie IA avant l’insertion |

Transcription audio

Langue et termes spécialisés

  • Langue de transcription : Sélectionnez la langue que vous parlez le plus souvent. Une langue fixe démarre normalement plus rapidement et est plus fiable que Automatique, surtout pour les dictées courtes, les noms et les mots au son similaire. Utilisez la détection automatique uniquement lorsque vous changez réellement de langue entre les enregistrements ; la détection de la langue dispose de moins de preuves dans une courte phrase et peut se tromper.
  • Termes et noms spécialisés personnalisés : Ajoutez des noms rares, des termes de produit, des abréviations et l’orthographe que vous voulez que Whisper privilégie. Conservez la liste concise : elle guide la reconnaissance mais n’est pas une règle de recherche-remplacement garantie, et une grande liste de mots ordinaires peut introduire un biais indésirable. Ces indications sont destinées à Whisper ; un autre moteur de transcription peut ne pas les utiliser de la même manière.

Méthode d’insertion de texte

La meilleure méthode d'insertion dépend de l'application cible. Testez-la dans le programme le plus difficile que vous utilisez, pas seulement dans un éditeur simple.

  • Presse-papiers : Le meilleur choix général sur Windows et généralement le plus rapide pour les textes longs, les caractères spéciaux et l'Unicode complexe. Voice2Win remplace temporairement le presse-papiers, envoie une commande de collage et peut restaurer le contenu précédent. Les gestionnaires de presse-papiers ou autres applications peuvent observer le texte temporaire, et le transfert du presse-papiers peut être désactivé dans une session distante.

  • Unicode : Indépendant de la disposition et une bonne première alternative pour les sessions à distance, les systèmes non Windows et les textes contenant des caractères qui ne sont pas présents sur la disposition actuelle du clavier. Certains jeux, terminaux, applications héritées et fenêtres élevées n'acceptent pas l'Unicode simulé de manière fiable.

  • Code de numérisation : Se comporte le plus comme une saisie au clavier physique et peut aider avec des applications cibles anciennes ou inhabituelles. Il dépend de la disposition de clavier active ; un caractère qui n'a pas de touche correspondante sur cette disposition peut être manquant ou incorrect. Il est généralement plus lent qu’un simple collage depuis le presse-papier pour un texte long.

  • Délai de simulation du clavier (0–50 ms) : Laissez-le bas sauf si l’insertion Unicode ou par code de numérisation perd ou réorganise des caractères. Augmentez-le par petites étapes pour les applications lentes, les machines virtuelles ou les bureaux à distance. Ce paramètre ralentit uniquement les frappes simulées ; il n’améliore pas la reconnaissance vocale.

  • Utiliser le presse-papiers pour les applications cibles problématiques : Gardez ceci activé lors de l'utilisation de l'Unicode ou du Scan Code, sauf si l'utilisation du presse-papiers est interdite. Voice2Win peut alors se replier sur les applications connues qui n'acceptent pas bien l'entrée simulée. Désactivez-le uniquement lorsque la confidentialité du presse-papiers ou le transfert du presse-papiers est la raison pour laquelle vous avez délibérément choisi la simulation du clavier.

Détails de l'insertion depuis le presse-papiers

  • Temps d'attente avant l'insertion (0–2000 ms, par défaut 40 ms) : Temps nécessaire pour que la nouvelle valeur du presse-papiers soit disponible avant l'envoi du raccourci de collage. Augmentez-le lorsque la cible colle parfois la valeur précédente du presse-papiers ou rien du tout, notamment lors de la synchronisation du presse-papiers à distance. Une valeur plus grande ajoute le même délai à chaque insertion.

  • Combinaison de touches pour coller : Utilisez Ctrl+V pour les applications Windows normales. Essayez Ctrl+Maj+V ou Maj+Inser lorsqu'un terminal, un bureau à distance ou un outil d'IA traite Ctrl+V comme autre chose qu'un collage en texte brut. Choisissez le raccourci attendu par la cible finale, pas nécessairement par la fenêtre locale du bureau à distance.

  • Collecter le texte pendant l'amélioration de l'IA et l'insérer en une seule étape : Activez cette option lorsque la sortie progressive de l'IA déplace le curseur, déclenche le formatage ou la saisie semi-automatique, ou crée plusieurs étapes d'annulation. Désactivez-la lorsque voir le résultat le plus tôt possible est plus important ; la collecte attend que le résultat de l'IA soit complet avant toute insertion.

  • Restaurer le presse-papiers précédent : Gardez cette option activée pour le travail normal afin que Voice2Win ne supprime pas ce que vous avez copié avant la dictée. Désactivez-la uniquement si vous souhaitez intentionnellement que le résultat dicté reste dans le presse-papiers ou si une cible spécifique lit le presse-papiers après que le raccourci de collage ait déjà été exécuté.

  • Temps d'attente avant restauration (0–2000 ms, défaut 120 ms) : Augmentez-le lorsque la cible n'insère rien ou seulement une partie du texte parce que la valeur précédente du presse-papiers est restaurée trop rapidement. Gardez-le seulement aussi élevé que nécessaire : pendant cet intervalle, le texte dicté reste disponible pour les applications compatibles avec le presse-papiers.

Formatage de la dictée

Ces options modifient le texte reconnu avant l'insertion. Elles sont les plus utiles lorsque vos dictées suivent un schéma cohérent.

  • Ponctuation parlée : Activez-la pour les textes plus longs lorsque vous souhaitez que des expressions telles que « virgule », « point d’interrogation » ou leurs équivalents spécifiques à la langue soient converties en ponctuation. Désactivez-la lorsque ces mots peuvent être du contenu littéral, ou lorsque vous préférez la ponctuation automatique du modèle de transcription.

  • Supprimer le point final : Utile pour les champs de recherche, les messages de chat, les champs de formulaire, les noms de fichiers et les commandes vocales où un point final ajouté automatiquement est indésirable. Laissez-le désactivé pour les phrases complètes dans les documents et les e-mails.

  • Mettre la première lettre en minuscule : Utile lorsque la dictée est normalement insérée au milieu d’une phrase existante. Laissez-le désactivé pour les nouvelles phrases, les titres, les noms et les messages autonomes.

  • Connecter les dictées consécutives dans la même application : Activez cette option lorsque vous construisez un seul paragraphe à partir de plusieurs enregistrements ; Voice2Win peut maintenir l'espacement et le contexte des phrases entre eux. Désactivez-la lorsque les enregistrements consécutifs vont généralement dans des champs différents, ou lorsque vous déplacez fréquemment le curseur manuellement entre les dictées.

Détection et enregistrement de la parole

  • Sensibilité à la détection de la parole (0–100, valeur par défaut 35%) : Des valeurs plus basses acceptent une parole plus douce mais peuvent également prendre en compte la respiration, les clics ou le bruit de fond comme de la parole. Des valeurs plus élevées filtrent le bruit de manière plus agressive mais peuvent rejeter une voix faible ou la fin des mots. Commencez avec la valeur par défaut et modifiez-la par petits incréments tout en surveillant le niveau d'entrée ; rapprocher le microphone est souvent préférable à l'utilisation d'une valeur extrême.

  • Nettoyage du début de l'enregistrement (0–500 ms, valeur par défaut 250 ms) : Supprime le clic de la touche de raccourci, le bruit de manipulation et le silence initial au début. Augmentez si la première partie des enregistrements contient un clic de touche ; réduisez si la première syllabe est coupée ou si vous dictez des mots très courts immédiatement après avoir appuyé sur le raccourci.

  • Normaliser l'enregistrement (activé par défaut, cible 85%) : Recommandé pour les microphones ordinaires et les variations de distance de parole, car cela fournit un niveau plus constant au modèle. Désactivez-le pour une entrée de studio/virtuelle déjà normalisée, ou lorsque la normalisation augmente de manière notable le bruit de fond constant. La cible n'est pas un contrôle du gain du microphone et ne peut pas récupérer un audio saturé.

  • Enregistrer les enregistrements WAV (activé par défaut) : Gardez cette option activée lorsque vous souhaitez la lecture, la retranscription, la comparaison de qualité ou les preuves diagnostiques. Désactivez-la lorsque l'utilisation du stockage ou la confidentialité sont plus importantes. L'audio consomme normalement beaucoup plus d'espace que le texte.

  • Supprimer les enregistrements WAV enregistrés : Supprime l'audio stocké tout en conservant le texte de la transcription. Utilisez-le après avoir vérifié que vous n'avez plus besoin de lecture ou de retranscription ; la suppression ne peut pas recréer l'audio original.

Combinaison de touches

Mode d'enregistrement

  • Maintenir : L'enregistrement ne dure que tant que le raccourci est maintenu. Idéal pour des dictées courtes et fréquentes, et c'est le mode le plus sûr lorsque l'on doit éviter un enregistrement du fond par accident.
  • Verrouiller : Appuyez une fois pour démarrer et à nouveau pour arrêter. Idéal pour de longs passages, l'utilisation en accessibilité ou la parole mains libres, mais nécessite une action d'arrêt délibérée.
  • Hybride / double tap : Maintenez pour un enregistrement court ou double-tapez pour verrouiller. C'est le paramètre par défaut le plus flexible pour un travail mixte. Utilisez "Maintenir" à la place si de doubles tapes accidentels laissent parfois l'enregistrement actif.

Raccourci et choix de retour

  • Assignez des raccourcis séparés pour Dictée vocale et Commande vocale. Privilégiez des combinaisons qui ne sont pas déjà utilisées par le système d'exploitation, le pilote du clavier, le bureau à distance ou l'application cible. Les raccourcis dupliqués de Voice2Win sont rejetés.

  • Sous Windows, Voice2Win ne peut généralement pas s'injecter dans une application exécutée avec des privilèges élevés. Exécutez Voice2Win avec élévation uniquement lorsque la dictée dans des applications élevées est réellement nécessaire ; l'accès global aux entrées avec élévation augmente l'impact de toute erreur de configuration ou d'application.

  • Couper la sortie audio globale pendant que la touche de raccourci est enfoncée est utile avec des haut-parleurs car l'audio système ne peut pas revenir dans le micro. Désactivez cette option lors de l'utilisation d'écouteurs ou lorsque l'écoute d'une réunion ou d'une source multimédia pendant l'enregistrement est nécessaire.

  • Des signaux de démarrage et d'arrêt séparés rendent l'état du verrou/hybride clair lorsque l'indicateur n'est pas visible. Gardez les sons courts et discrets lorsque vous utilisez des haut-parleurs afin que le microphone ne les capte pas. Augmentez la durée ou le volume pour l'accessibilité, pas pour résoudre une détection de raccourci clavier peu fiable.

Général

Affichage

  • Langue de l'interface modifie uniquement les menus et les étiquettes ; elle ne sélectionne pas la langue de transcription.
  • Thème sombre est une préférence visuelle et n'affecte ni la reconnaissance ni les performances.
  • Style de l'indicateur : un affichage simple du niveau est le moins distrayant ; l'onde ou les barres facilitent l'évaluation de l'activité vocale ; les affichages de type spectre montrent plus de détails mais sont visuellement plus chargés. Choisissez le style qui vous aide à confirmer l'activité du microphone sans couvrir l'application cible.
  • Schéma de couleurs, position et taille : utilisez un schéma à fort contraste et placez-le loin des barres d'outils, des légendes et du curseur de texte. Un indicateur plus grand aide à l'accessibilité et au texte en temps réel ; un plus petit est préférable lorsque seul l'état de l'enregistrement compte.

Comportement de l'application

  • Démarrage automatique désactivé est préférable lorsque Voice2Win est utilisé occasionnellement. Démarrage automatique via le registre est le choix normal de Windows pour démarrer après la connexion. Planificateur de tâches est utile lorsque l'ordre de démarrage ou l'exécution avec élévation est nécessaire. Sur Linux, l'application utilise le mécanisme de démarrage automatique par utilisateur du bureau.

  • Exécuter avec élévation via le Planificateur de tâches doit rester désactivé sauf si vous devez dicter dans des applications administrateur. L'élévation n'est pas une option de performance ; elle change la frontière de sécurité de l'accès global au clavier.

  • Afficher la boîte de dialogue de confirmation du démarrage automatique est utile lors de la validation d'une nouvelle configuration de démarrage automatique ou sur un ordinateur partagé. Désactivez-la uniquement lorsque le démarrage est fiable et doit être sans surveillance.

  • Afficher l'écran de démarrage est utile lorsque l'initialisation du modèle/runtime prend un temps notable. Désactivez-le pour un démarrage plus discret, de type icône dans la barre système.

  • Son prêt confirme que le démarrage et la préparation du modèle sont terminés, en particulier lorsque Voice2Win démarre en mode réduit. Désactivez-le dans les environnements calmes ; ajustez uniquement la durée et le volume suffisamment pour être reconnaissable.

  • Réduire lors de la fermeture (activé par défaut) garde les raccourcis globaux disponibles après la fermeture de la fenêtre principale. Désactivez-le lorsque le bouton de fermeture de la fenêtre doit quitter l'application à la place.

  • Vérifier les mises à jour automatiquement (activé par défaut) est recommandé pour les correctifs, la compatibilité modèle/runtime et les mises à jour de sécurité. Désactivez-le uniquement pour les installations gérées délibérément ou hors ligne et vérifiez manuellement à la place.

  • Désactiver la boîte de dialogue d'information hebdomadaire masque l'avis d'information récurrent après que vous n'en avez plus besoin ; cela ne désactive pas les messages fonctionnels ou d'erreur.

  • Statut de l'automatisation des entrées Linux est une information de diagnostic. L'automatisation des entrées compatible X11 est prise en charge ; une session Wayland pure peut restreindre les raccourcis globaux et l'injection de texte. Si elle n'est pas disponible, utilisez une session X11 ou le mode de compatibilité proposé par l'environnement de bureau.

Emplacements de stockage et conservation

  • Chemin de stockage des transcriptions : Choisissez un dossier local fiable. Utilisez un emplacement chiffré pour les dictées sensibles et assurez-vous que les logiciels de sauvegarde/synchronisation ne créent pas de conflits avec les fichiers encore en cours d’écriture. Un lecteur réseau lent ou disponible de manière intermittente peut retarder les opérations d’historique.

  • Supprimer les anciennes transcriptions / âge maximum : Activez la conservation automatique lorsque la politique de confidentialité ou l’utilisation du disque est importante. Choisissez un âge qui couvre encore votre fenêtre réaliste de correction et de retranscription. Les fichiers WAV sauvegardés constituent normalement la plus grande partie de l’historique.

  • Chemin de stockage du modèle : Privilégiez un SSD local rapide avec suffisamment d’espace libre. Les lecteurs amovibles et réseau rendent le chargement des modèles moins fiable et peuvent transformer un lecteur déconnecté en modèle apparemment manquant.

  • Utiliser une racine de données personnalisée / déplacer toutes les données de l'application : Utile pour les configurations portables, les sauvegardes contrôlées ou pour garder de grandes données hors du disque système. Sélectionnez un dossier avec des permissions appropriées et suffisamment d'espace libre, puis redémarrez lorsqu'on vous le demande. Cela déplace les données locales ; cela ne les chiffre pas et ne les télécharge pas automatiquement.

Transcription en temps réel

La transcription en temps réel est un aperçu pendant que vous parlez encore. La transcription finale normale reste le résultat faisant autorité. Laissez le mode temps réel désactivé lorsqu'un aperçu n'est pas utile : cela minimise l'utilisation des ressources et évite que les mots préliminaires changent à l'écran.

Choisir un mode

  • Bloc exécute de manière répétée le modèle principal de transcription Whisper sur un audio chevauchant. Choisissez-le lorsque vous voulez que l’aperçu ressemble au résultat final de Whisper et que vous disposez d’un GPU pris en charge avec suffisamment de mémoire. Il fournit plus de contexte mais génère un travail GPU répétitif important.
  • Flux utilise un modèle de streaming Sherpa-ONNX séparé. Choisissez-le pour obtenir un retour incrémental le plus rapide ou lorsque le mode bloc n’est pas disponible. Son aperçu peut être plus approximatif et ne prend en charge que les langues listées dans les paramètres ; la transcription finale normale peut toujours différer.
  • Hauteur d’affichage maximale limite la portion de l’écran que l’aperçu peut occuper. Augmentez-la pour un usage en accessibilité de longue durée ; réduisez-la lorsque l’indicateur couvre l’application cible. Cela ne modifie pas la qualité de la reconnaissance.

Paramètres du bloc

Les valeurs par défaut sont équilibrées et interdépendantes. Restaurez-les avant de dépanner et ne changez qu'un seul paramètre à la fois.

  • Taille de la fenêtre (par défaut 10 s) : Augmentez-la lorsque le contexte de la phrase est insuffisant ou lorsque de longues phrases changent trop entre les instantanés. Des fenêtres plus grandes prennent plus de temps et utilisent davantage de ressources informatiques/mémoire. Réduisez-la pour des mises à jour individuelles plus rapides sur du matériel capable, en acceptant moins de contexte.

  • Intervalle de saut (par défaut 3 s) : Réduisez-le pour obtenir des mises à jour de prévisualisation plus fréquentes ; augmentez-le lorsque la charge du GPU est trop élevée. Un saut plus petit lance plus de transcriptions et ne rend pas chaque exécution plus rapide.

  • Recoupement / contexte (par défaut 20 s) : Augmentez-le lorsque des mots aux limites des blocs sont dupliqués, omis ou mal fusionnés. Réduisez-le pour diminuer le travail répété. Un recoupement trop faible supprime les éléments nécessaires pour concilier les instantanés adjacents.

  • Délai de stabilité (par défaut 6 s) : Augmentez-le lorsque les mots sont validés trop tôt et que le contexte ultérieur les aurait corrigés. Réduisez-le lorsque le texte stable apparaît trop lentement, en acceptant plus de révisions.

  • Limite de temps de silence (par défaut 1000 ms) : Réduisez-la lorsque le texte doit se stabiliser rapidement après une pause. Augmentez-la lorsque les hésitations naturelles divisent ou finalisent les pensées trop tôt.

  • Vérifications supplémentaires des limites de phrase (par défaut 2) : Augmentez uniquement lorsque les transitions de phrases sont systématiquement incorrectes et que la capacité GPU est disponible. Chaque transcription supplémentaire décalée coûte du temps. Réglez-la sur 0 pour désactiver les exécutions supplémentaires ; la vérification principale des limites reste en place.

  • Facteur de décalage (20 % par défaut) : Contrôle la distance de déplacement des fenêtres de vérification supplémentaires par rapport à la taille de la fenêtre. Augmentez-le lorsque la vérification d'une zone plus large autour d'une limite est utile ; réduisez-le lorsque le contexte proche est suffisant. Cela n'a d'importance qu'en combinaison avec des vérifications supplémentaires.

Paramètres de flux et modèles mis en cache

  • Exécution : CPU offre la compatibilité la plus large. DirectML peut réduire la latence sur les GPU Windows supportés, mais utilise des ressources GPU qui peuvent également être nécessaires au modèle principal.
  • Variante de modèle : Choisissez Rapide pour une faible latence et une utilisation réduite des ressources. Choisissez Précis lorsque la qualité de l'aperçu importe plus que la vitesse.
  • Fenêtre de raffinement des phrases (1–8, par défaut 2) : Une valeur de 1 permet une finalisation de phrase la plus rapide. Des valeurs plus grandes conservent davantage de contexte de phrase pour le raffinement, mais retardent la stabilisation et augmentent le travail. La valeur par défaut est un compromis pratique.
  • Modèles mis en cache : Supprimer un modèle mis en cache inutilisé libère de l’espace disque. Si cette combinaison langue/exécution/modèle est sélectionnée plus tard, elle doit être téléchargée à nouveau avant que l’aperçu soit prêt.

Voir Transcription en temps réel pour le flux de travail complet et les exigences de disponibilité.

Modèles d'IA

Moteur de transcription et modèle

  • Whisper est le choix général pour le support linguistique large et les variantes de modèles établies. Parakeet peut être attrayant lorsque ses langues prises en charge et le matériel disponible correspondent à votre cas d'utilisation. Sélectionnez en fonction de vos enregistrements réels ; les évaluations par étoiles et les estimations de vitesse sont des guides, pas un substitut à la vérification de votre microphone, de votre langue et de votre vocabulaire.
  • Les modèles plus grands ou de meilleure qualité nécessitent généralement plus de mémoire et de temps, mais peuvent améliorer l'audio difficile. Commencez par le plus petit modèle qui est suffisamment précis de manière fiable. Un modèle qui provoque une pression mémoire ou de longues files d'attente peut être moins utile qu'un modèle légèrement plus petit qui s'exécute de manière cohérente.
  • Le gestionnaire de modèles télécharge et supprime les fichiers de modèles locaux. Ne supprimez pas un modèle encore nécessaire à un moteur sélectionné ou à un flux de travail hors ligne.

Affectation de l’environnement d’exécution

  • Assignez la transcription audio et l'amélioration IA indépendamment. Un GPU est généralement préférable pour un travail local répété ; le CPU est une solution de repli compatible mais peut être beaucoup plus lent. Répartir les deux tâches sur différents appareils peut éviter la contention de mémoire GPU lorsque les deux sont utilisés en même temps.

  • Pour Ollama ou LM Studio, sélectionnez le type de serveur, l'adresse, le port et le modèle chargé. Utilisez la découverte uniquement sur un réseau de confiance et vérifiez que le modèle choisi est réellement disponible sur le serveur.

  • Un serveur IA distant ou un autre ordinateur Voice2Win peut transférer le travail depuis une machine plus faible, mais cela introduit une latence réseau et envoie l'audio ou le texte de la tâche à ce système. Utilisez uniquement des hôtes et des réseaux de confiance.

  • Partager le runtime local uniquement lorsqu'une autre installation de Voice2Win de confiance en a besoin. Utilisez un mot de passe, autorisez le port à travers le pare-feu seulement sur le profil réseau prévu, et désactivez le partage lorsqu'il n'est plus nécessaire. Les avertissements de client connecté et de version aident à identifier les clients inattendus ou incompatibles.

Paramètres d’amélioration par IA

  • Taille du contexte (par défaut 4096) : Augmentez-la pour un texte sélectionné long, des instructions longues ou des transformations nécessitant plus de contexte environnant. Un contexte plus large consomme plus de mémoire et peut être plus lent. Cela n’améliore pas automatiquement les corrections courtes.

  • Nombre maximum de jetons (par défaut 512) : Augmentez-le lorsque de longues réécritures sont tronquées. Réduisez-le pour limiter le temps de réponse et éviter une sortie inattendue trop longue. Une correction de dictée normale n’a que rarement besoin d’une valeur très élevée.

  • Température (par défaut 0,2) : Les valeurs basses sont plus répétables et conviennent mieux à la correction, au formatage et à la préservation du sens. Augmentez-la seulement pour une réécriture délibérément créative ; des valeurs plus élevées peuvent changer plus librement le phrasé ou les faits.

  • Longueur minimale de transcription pour l'amélioration par IA (20 caractères par défaut) : Diminuez-la lorsque même de très courtes phrases doivent être traitées. Augmentez-la pour éviter le démarrage/la latence du modèle et les réécritures surprenantes pour de minuscules entrées telles que « oui » ou un nom.

  • Invite système : Il s'agit de l'instruction permanente pour l'amélioration par IA par défaut. Indiquez la langue souhaitée, si le sens et le ton doivent être préservés, et que seul le texte final doit être retourné. Testez les modifications de l'invite sur un texte non critique : une invite trop générale peut répondre à la dictée, la traduire, ou ajouter des explications au lieu de la corriger.

  • Stockage alternatif du modèle IA : Utilisez un disque local rapide avec un espace suffisant. Copier les modèles existants évite un nouveau téléchargement ; changer seulement le dossier ne rend pas un modèle manquant ou incompatible utilisable.

Voir Modèles et matériel d'IA et Amélioration de l'IA.

Enregistrement de la conversation

  • Qualité du modèle de reconnaissance vocale : Privilégiez le modèle de meilleure qualité lorsque la séparation de voix similaires est importante et que l'ordinateur dispose de mémoire/performance suffisante. Utilisez un modèle plus léger pour de longues sessions sur du matériel limité. Les modèles téléchargés deviennent immédiatement sélectionnables.

  • Sensibilité de la séparation des locuteurs : Commencez avec Par défaut. Augmentez-la lorsque deux voix différentes mais similaires sont fusionnées à plusieurs reprises ; le compromis est que la voix changeante, la distance ou l’angle du micro d’une personne peut être divisée en plusieurs locuteurs. Réduisez-la lorsque qu’une personne est affichée à plusieurs reprises comme plusieurs locuteurs ; le compromis est que des voix véritablement similaires peuvent être fusionnées.

  • Sensibilité à la détection de la parole : Augmentez-la lorsque des clics, du bruit ambiant ou des blocs silencieux sont transcrits. Réduisez-la lorsque des interlocuteurs silencieux sont omis. Cette étape décide si un bloc est envoyé pour transcription ; un bloc rejeté de manière agressive ne peut pas être récupéré par un modèle de transcription plus précis.

  • Pause de finalisation (par défaut 10 s, sur la page d'enregistrement de conversation) : Utilisez une pause plus courte lorsque les sections doivent se fermer rapidement après l'arrêt des locuteurs. Utilisez une pause plus longue pour les discussions réfléchies avec de longues hésitations ; les résultats apparaissent plus tard, mais une contribution est moins susceptible d'être divisée.

  • Intervenants attendus (Automatique par défaut, sur la page Enregistrement de la conversation) : Conservez Automatique lorsque les participants peuvent rejoindre ou quitter. Définissez le nombre connu pour une réunion fixe lorsque le regroupement automatique produit un nombre incorrect. Un nombre fixe incorrect peut obliger des voix non liées à être regroupées ou diviser une seule voix pour satisfaire le nombre demandé.

La séparation des intervenants est probabiliste. La distance du microphone, le chevauchement, les échos et le bruit de fond variable sont importants ; une correction manuelle des voix peut encore être nécessaire. Voir Enregistrement de la conversation.

Connexions clientes

Cette section réservée aux développeurs configure le client compagnon de bureau séparé qui diffuse un microphone depuis un autre ordinateur sur le même réseau local.

  • Activez le service uniquement lorsque les microphones des clients sont nécessaires. Choisissez l'adaptateur réseau accessible depuis le client ; les adaptateurs VPN et virtuels produisent souvent une adresse de jumelage que l'autre ordinateur ne peut pas atteindre.

  • Conservez le port par défaut sauf s'il est en conflit avec un autre service. Si le client ne peut pas se connecter, vérifiez l'adaptateur sélectionné, le pare-feu local et si les deux systèmes sont sur le même réseau de confiance avant de changer de ports aléatoires.

  • Traitez l'URL/token de jumelage comme un secret. Quiconque peut accéder au service et possède un token valide peut tenter de se connecter. Régénérez ou redistribuez l'URL après avoir changé l'adaptateur, l'adresse, le port ou le token.

  • Le statut du client connecté montre quels clients sont disponibles et leurs capacités. L'audio est diffusé depuis le client sélectionné comme périphérique d'enregistrement ; le simple fait de connecter un client ne fait pas que tous les microphones connectés enregistrent en même temps.

  • Il n'y a pas de relais cloud. Cela améliore la confidentialité mais signifie que le routage, le pare-feu, le mode veille et la qualité du Wi-Fi affectent directement la disponibilité et la latence.

Voir Client Companion.

Un ordre pratique pour le dépannage

  1. Reproduisez le problème dans une application cible avec l'amélioration IA et l'aperçu en temps réel désactivés.
  2. Pour les mots incorrects, corrigez le niveau du microphone/le bruit, sélectionnez une langue fixe, et testez un autre modèle de transcription avant de modifier les paramètres d'insertion de texte.
  3. Pour le texte correct qui est inséré incorrectement, changez d'abord la méthode d'insertion, puis le raccourci de collage, puis augmentez uniquement le délai pertinent.
  4. Pour la parole silencieuse manquante, baissez légèrement la sensibilité à la détection de la parole ; pour le bruit interprété comme de la parole, augmentez-la légèrement.
  5. En cas de charge élevée, désactivez le mode temps réel ou augmentez son intervalle de saut avant de réduire la qualité finale de la transcription.
  6. Restaurez les paramètres par défaut dans la section concernée si plusieurs modifications ont rendu le résultat difficile à interpréter.
Languages
English

Features

Configuration

Help

Deutsch

Funktionen

Konfiguration

Hilfe

Español

Funciones

Configuración

Ayuda

Français

Fonctionnalités

Configuration

Aide

Português (Brasil)

Recursos

Configuração

Ajuda

Italiano

Funzionalità

Configurazione

Aiuto

Nederlands

Functies

Configuratie

Help

Polski

Funkcje

Konfiguracja

Pomoc

Svenska

Funktioner

Konfiguration

Hjälp

简体中文

功能

配置

帮助

日本語

機能

設定

ヘルプ

한국어

기능

구성

도움말

हिन्दी

सुविधाएँ

कॉन्फ़िगरेशन

सहायता

繁體中文

功能

設定

說明

Bahasa Indonesia

Fitur

Konfigurasi

Bantuan

Tiếng Việt

Tính năng

Cấu hình

Trợ giúp

ไทย

คุณสมบัติ

การกำหนดค่า

วิธีใช้

العربية

الميزات

الإعداد

المساعدة

Türkçe

Özellikler

Yapılandırma

Yardım

Русский

Возможности

Настройка

Справка

Українська

Функції

Налаштування

Довідка

Clone this wiki locally