Skip to content

Italiano Settings Reference

Dan edited this page Aug 22, 2026 · 2 revisions

Riferimento alle impostazioni

Apri Impostazioni con il pulsante dell'ingranaggio. OK salva le modifiche; Annulla le scarta. Le modifiche che influenzano modelli, runtime, posizioni di archiviazione o servizi di rete possono richiedere un momento per essere applicate e potrebbero ricaricare un componente.

Questo riferimento è pensato come una guida di regolazione, non solo come un elenco di controlli. I valori predefiniti sono un buon punto di partenza per la maggior parte delle installazioni locali di Windows. Modifica una sola impostazione correlata alla volta, testala nell'applicazione in cui effettivamente detti, e mantieni il valore precedente fino a quando il risultato non è chiaramente migliore.

Punti di partenza utili

Obiettivo Punto di partenza consigliato
Dettatura quotidiana affidabile in applicazioni desktop normali Lingua di trascrizione fissa, Incolla dal Clipboard, ripristino del clipboard abilitato, ritardi predefiniti, normalizzazione audio abilitata
Dettatura in un terminale o desktop remoto Provare prima Unicode se l'inoltro del clipboard non è disponibile. Altrimenti mantenere Clipboard e selezionare la scorciatoia di incolla accettata dalla destinazione remota. Usare Scan Code per applicazioni che rispondono in modo affidabile solo a input simili a tasti fisici.
Documenti lunghi Lingua fissa, punteggiatura parlata, formattazione concatenata, modalità hotkey a scatto o ibrida, registrazioni WAV salvate
Campi di ricerca brevi, chat e comandi Rimuovere il punto finale; opzionalmente usare la formattazione con prima lettera minuscola; la modalità hotkey da tenere premuta evita di lasciare accidentalmente la registrazione attiva

| Uso silenzioso o sensibile alla privacy | Disabilita le registrazioni WAV salvate, controlla la conservazione delle trascrizioni, disabilita l’inserimento negli appunti se le applicazioni di monitoraggio degli appunti sono un problema e evita runtime remoti | | Minima latenza percepita | Disabilita l’anteprima in tempo reale a meno che non sia utile, utilizza un modello/runtime di trascrizione locale veloce, mantieni bassi i ritardi di inserimento e non raccogliere l’output AI prima dell’inserimento |

Trascrizione Audio

Lingua e termini specialistici

  • Lingua della trascrizione: Seleziona la lingua che parli più spesso. Una lingua fissa di solito parte più velocemente ed è più affidabile di Automatico, specialmente per dettati brevi, nomi e parole dal suono simile. Usa il rilevamento automatico solo quando cambi veramente lingua tra le registrazioni; il rilevamento della lingua ha meno evidenza in una breve frase e può scegliere in modo errato.
  • Termini specialistici e nomi personalizzati: Aggiungi nomi insoliti, termini di prodotto, abbreviazioni e la grafia che vuoi che Whisper preferisca. Mantieni la lista focalizzata: guida il riconoscimento ma non è una regola garantita di ricerca e sostituzione, e una lista ampia di parole comuni può introdurre bias indesiderati. Questa guida è pensata per Whisper; un altro motore di trascrizione potrebbe non usarla allo stesso modo.

Metodo di inserimento del testo

Il metodo di inserimento migliore dipende dall'applicazione di destinazione. Testalo nel programma più difficile che usi, non solo in un editor semplice.

  • Appunti: La scelta generale migliore su Windows e solitamente la più veloce per testi lunghi, caratteri speciali e Unicode complesso. Voice2Win sostituisce temporaneamente gli appunti, invia un comando di incolla e può ripristinare il contenuto precedente. I gestori di appunti o altre applicazioni possono osservare il testo temporaneo e l'inoltro degli appunti può essere disabilitato in una sessione remota.

  • Unicode: Indipendente dal layout e una buona prima alternativa per sessioni remote, sistemi non Windows e testi contenenti caratteri non presenti nell'attuale layout di tastiera. Alcuni giochi, terminali, applicazioni legacy e finestre elevate non accettano l'Unicode simulato in modo affidabile.

  • Codice scansione: Si comporta più come l'input della tastiera fisica e può aiutare con applicazioni target più vecchie o particolari. Dipende dal layout della tastiera attivo; un carattere che non ha un tasto corrispondente su quel layout potrebbe essere assente o sbagliato. Di solito è più lento di un singolo incolla dagli appunti per testi lunghi.

  • Ritardo simulazione tastiera (0–50 ms): Lascialo basso a meno che l'inserimento Unicode o con codice scansione non perda o riorgani i caratteri. Aumentalo a piccoli passi per applicazioni lente, macchine virtuali o desktop remoti. Questa impostazione rallenta solo i tasti simulati; non migliora il riconoscimento vocale.

  • Usa gli appunti per le applicazioni target problematiche: Mantieni abilitato questo quando utilizzi Unicode o Codice di scansione a meno che l'uso degli appunti non sia vietato. Voice2Win può quindi tornare utile per le applicazioni conosciute che non accettano bene l'input simulato. Disabilitalo solo quando la privacy degli appunti o l'inoltro degli appunti è il motivo per cui hai scelto deliberatamente la simulazione della tastiera.

Dettagli sull'inserimento dagli appunti

  • Tempo di attesa prima dell'inserimento (0–2000 ms, predefinito 40 ms): Tempo necessario affinché il nuovo valore degli appunti diventi disponibile prima che venga inviato il comando di incolla. Aumentalo quando il destinatario incolla occasionalmente il valore precedente degli appunti o nulla, specialmente tramite sincronizzazione remota degli appunti. Un valore più alto aggiunge lo stesso ritardo a ogni inserimento.

  • Combinazione di tasti per incollare: Usa Ctrl+V per le applicazioni Windows normali. Prova Ctrl+Shift+V o Shift+Insert quando un terminale, desktop remoto o strumento AI considera Ctrl+V come qualcosa di diverso dall'incolla in testo semplice. Scegli il collegamento atteso dal destinatario finale, non necessariamente dalla finestra locale del desktop remoto.

  • Raccogli il testo durante l'incremento dell'IA e inseriscilo in un solo passaggio: Abilita questa opzione quando l'output progressivo dell'IA sposta il cursore, attiva la formattazione o il completamento automatico, o crea diversi passaggi di annullamento. Disabilitala quando è più importante vedere il risultato il prima possibile; la raccolta aspetta che il risultato dell'IA sia completo prima di inserire qualsiasi cosa.

  • Ripristina gli appunti precedenti: Mantieni questa opzione abilitata per il lavoro normale in modo che Voice2Win non distrugga ciò che hai copiato prima della dettatura. Disabilitala solo se desideri intenzionalmente che il risultato dettato rimanga negli appunti o se un obiettivo specifico legge gli appunti dopo che la scorciatoia per incollare ha già restituito il contenuto.

  • Tempo di attesa prima del ripristino (0–2000 ms, predefinito 120 ms): Aumentalo quando il destinatario non inserisce nulla o solo una parte del testo perché il valore precedente degli appunti viene ripristinato troppo velocemente. Mantienilo solo al livello necessario: durante questo intervallo, il testo dettato rimane disponibile alle applicazioni che utilizzano gli appunti.

Formattazione della dettatura

Queste opzioni modificano il testo riconosciuto prima dell'inserimento. Sono più utili quando le tue dettature seguono uno schema coerente.

  • Punteggiatura parlata: Attivala per testi più lunghi quando vuoi che frasi come “virgola”, “punto interrogativo” o i loro equivalenti nella lingua specifica vengano convertite in punteggiatura. Lasciala disattivata quando queste parole possono essere contenuto letterale, o quando preferisci la punteggiatura automatica del modello di trascrizione.

  • Rimuovi punto finale: Utile per campi di ricerca, messaggi di chat, moduli, nomi di file e comandi vocali dove un punto finale aggiunto automaticamente non è desiderato. Lascialo disattivato per frasi complete in documenti ed email.

  • Minuscola alla prima lettera: Utile quando la dettatura viene normalmente inserita nel mezzo di una frase esistente. Lascialo disattivato per nuove frasi, intestazioni, nomi e messaggi autonomi.

  • Collega dettature consecutive nella stessa applicazione: Attivalo quando costruisci un paragrafo da più registrazioni; Voice2Win può mantenere lo spazio e il contesto della frase tra di esse. Disattivalo quando registrazioni consecutive solitamente vanno in campi diversi, o quando sposti frequentemente il cursore manualmente tra le dettature.

Rilevamento e registrazione della voce

  • Sensibilità al rilevamento della voce (0–100, predefinito 35%): Valori più bassi accettano discorsi più deboli ma possono anche considerare respirazioni, clic o rumore di fondo come voce. Valori più alti filtrano il rumore in modo più aggressivo ma possono rifiutare una voce debole o le estremità delle parole. Inizia con il valore predefinito e modificalo a piccoli passi osservando il livello d'ingresso; avvicinare il microfono è spesso migliore che utilizzare un valore estremo.

  • Pulizia dell’inizio della registrazione (0–500 ms, predefinito 250 ms): Sopprime il clic del tasto di scelta rapida, i rumori di gestione e il silenzio iniziale. Aumentalo se la prima parte delle registrazioni contiene un clic del tasto; riducilo se la prima sillaba viene tagliata o se detti parole molto brevi subito dopo aver premuto il tasto di scelta rapida.

  • Normalizza la registrazione (attivato di default, obiettivo 85%): Consigliato per microfoni ordinari e per distanze di parlato variabili, perché fornisce un livello più coerente al modello. Disattivarlo per ingressi da studio/virtuali già normalizzati o quando la normalizzazione aumenta visibilmente il rumore di fondo costante. L'obiettivo non è un controllo del guadagno del microfono e non può recuperare audio clippato.

  • Salva registrazioni WAV (attivato di default): Lascialo attivo quando desideri riprodurre, ritrascrivere, confrontare la qualità o ottenere prove diagnostiche. Disattivalo quando lo spazio di archiviazione o la riservatezza sono più importanti. L'audio normalmente consuma molto più spazio del testo.

  • Elimina registrazioni WAV salvate: Rimuove l'audio memorizzato mantenendo il testo della trascrizione. Usalo dopo aver verificato che non serve più la riproduzione o la ritrascrizione; la cancellazione non può ricreare l'audio originale.

Combinazione di tasti

Modalità di registrazione

  • Tieni premuto: La registrazione dura solo mentre il collegamento rapido è premuto. Ideale per dettature brevi e frequenti ed è la modalità più sicura quando è necessario evitare registrazioni accidentali in background.
  • Blocca: Premi una volta per avviare e di nuovo per fermare. Ideale per passaggi lunghi, uso accessibile o per parlare a mani libere, ma richiede un’azione deliberata per fermarsi.
  • Ibrido / doppio tocco: Tieni premuto per una registrazione breve o tocca due volte per bloccare. Questo è il predefinito più flessibile per lavori misti. Usa Tieni premuto se i doppi tocchi accidentali a volte lasciano la registrazione attiva.

Scelte di collegamento rapido e feedback

  • Assegna scorciatoie separate per Da Voce a Testo e Comando Vocale. Preferisci combinazioni non già gestite dal sistema operativo, dal driver della tastiera, dal desktop remoto o dall'applicazione di destinazione. Le scorciatoie duplicate di Voice2Win vengono rifiutate.

  • Su Windows, Voice2Win di solito non può iniettare un'applicazione con privilegi più elevati. Esegui Voice2Win con privilegi elevati solo quando la dettatura in applicazioni elevate è realmente necessaria; l'accesso globale elevato aumenta l'impatto di eventuali errori dell'applicazione o della configurazione.

  • Disattiva l'audio globale mentre il tasto di scelta rapida è premuto è utile con gli altoparlanti perché l'audio di sistema non può essere reimmesso nel microfono. Disattivalo quando usi le cuffie o quando è necessario ascoltare una riunione o una fonte multimediale durante la registrazione.

  • Segnali di avvio e arresto separati rendono chiaro lo stato a scatto/ibrido quando l'indicatore non è visibile. Mantieni i suoni brevi e silenziosi quando usi gli altoparlanti in modo che il microfono non li catturi. Aumenta la durata o il volume per l'accessibilità, non per risolvere la rilevazione inaffidabile dei tasti di scelta rapida.

Generale

Schermo

  • Lingua dell'interfaccia cambia solo i menu e le etichette; non seleziona la lingua della trascrizione.
  • Tema scuro è una preferenza visiva e non influisce sul riconoscimento o sulle prestazioni.
  • Stile dell'indicatore: una semplice visualizzazione del livello è la meno distraente; forma d'onda o barre rendono più facile valutare l'attività vocale; le visualizzazioni in stile spettro mostrano più dettagli ma sono visivamente più impegnative. Scegli lo stile che ti aiuta a confermare l'attività del microfono senza coprire l'applicazione principale.
  • Schema dei colori, posizione e dimensione: Usa uno schema ad alto contrasto e una posizione lontana da barre degli strumenti, didascalie e cursore del testo. Un indicatore più grande aiuta con l'accessibilità e il testo in tempo reale; uno più piccolo è migliore quando conta solo lo stato di registrazione.

Comportamento dell'applicazione

  • Avvio automatico disabilitato è la scelta migliore quando Voice2Win viene utilizzato occasionalmente. Avvio automatico tramite registro di sistema è la scelta normale di Windows per l'avvio dopo l'accesso. Utilità di Pianificazione attività è utile quando è necessario controllare l'ordine di avvio o l'esecuzione con privilegi elevati. Su Linux, l'app utilizza il meccanismo di avvio automatico per utente del desktop.

  • Esegui con privilegi elevati tramite Pianificazione attività dovrebbe rimanere disattivato a meno che non sia necessario dettare in applicazioni amministrative. L'elevazione non è un'opzione per le prestazioni; cambia il confine di sicurezza dell'accesso globale da tastiera.

  • Mostra la finestra di conferma dell'avvio automatico è utile durante la validazione di una nuova configurazione di avvio automatico o su un computer condiviso. Disattivala solo quando l'avvio è affidabile e deve essere senza sorveglianza.

  • Mostra schermata iniziale è utile quando l'inizializzazione del modello/runtime richiede un tempo notevole. Disattivala per un avvio più silenzioso in stile tray.

  • Suono pronto conferma che l'avvio e la preparazione del modello sono completati, soprattutto quando Voice2Win parte minimizzato. Disattivalo in ambienti silenziosi; regola durata e volume solo quanto basta per essere riconoscibile.

  • Minimizza alla chiusura (attivo di default) mantiene disponibili le scorciatoie globali dopo la chiusura della finestra principale. Disattivalo quando il pulsante di chiusura della finestra dovrebbe uscire dall'applicazione.

  • Controlla automaticamente gli aggiornamenti (attivo di default) è consigliato per correzioni, compatibilità modello/runtime e aggiornamenti di sicurezza. Disattivalo solo per installazioni gestite deliberatamente o offline e verifica manualmente al posto suo.

  • Disabilita il dialogo informativo settimanale nasconde la notifica ricorrente dopo che non ne hai più bisogno; non disabilita messaggi funzionali o di errore.

  • Stato dell'automazione dell'input su Linux è informazioni diagnostiche. L'automazione dell'input compatibile con X11 è supportata; una sessione puramente Wayland può limitare le scorciatoie globali e l'inserimento di testo. Se non disponibile, usare una sessione X11 o la modalità di compatibilità offerta dall'ambiente desktop.

Posizioni di archiviazione e conservazione

  • Percorso di memorizzazione delle trascrizioni: Scegli una cartella locale affidabile. Usa una posizione criptata per dettature sensibili e assicurati che il software di backup/sincronizzazione non entri in conflitto con i file ancora in scrittura. Un drive di rete lento o disponibili intermittentemente può rallentare le operazioni di cronologia.

  • Eliminazione delle trascrizioni vecchie / età massima: Abilita la conservazione automatica quando la privacy o l'utilizzo del disco lo richiedono. Scegli un'età che copra ancora la finestra realistica per correzioni e ritrascrizioni. I file WAV salvati sono normalmente la parte più grande della cronologia.

  • Percorso di memorizzazione del modello: Preferisci un SSD locale veloce con spazio libero sufficiente. Drive rimovibili e di rete rendono il caricamento del modello meno affidabile e possono far sembrare mancante un modello se il drive è disconnesso.

  • Usa una cartella dati personalizzata / sposta tutti i dati dell'applicazione: Utile per configurazioni portatili, backup controllati o per mantenere grandi quantità di dati fuori dall'unità di sistema. Seleziona una cartella con autorizzazioni e spazio libero appropriati, quindi riavvia quando richiesto. Questo sposta i dati locali; non li cripta né li carica automaticamente.

Trascrizione in tempo reale

La trascrizione in tempo reale è un'anteprima mentre stai ancora parlando. La trascrizione finale normale rimane il risultato autorevole. Lascia disabilitata la modalità in tempo reale quando un'anteprima non è utile: ciò riduce l'uso delle risorse e evita che le parole preliminari cambino sullo schermo.

Scelta di una modalità

  • Block esegue ripetutamente il modello principale di trascrizione Whisper su audio sovrapposto. Sceglilo quando vuoi che l'anteprima assomigli al risultato finale di Whisper e hai una GPU supportata con memoria sufficiente. Fornisce più contesto ma genera un lavoro GPU ripetuto sostanziale.
  • Stream utilizza un modello di streaming separato Sherpa-ONNX. Sceglilo per il feedback incrementale più rapido o quando la modalità block non è disponibile. La sua anteprima può essere più approssimativa e supporta solo le lingue elencate nelle impostazioni; la trascrizione normale finale può comunque differire.
  • Altezza massima di visualizzazione limita quanto dello schermo può occupare l'anteprima. Aumentala per l'accessibilità a lungo termine; riducila quando l'indicatore copre l'applicazione target. Non cambia la qualità del riconoscimento.

Parametri dei blocchi

I valori predefiniti sono bilanciati e interdipendenti. Ripristinali prima di risolvere i problemi e cambia solo un parametro alla volta.

  • Dimensione della finestra (predefinita 10 s): Aumentala quando il contesto della frase è insufficiente o le frasi lunghe cambiano troppo tra uno snapshot e l'altro. Finestre più grandi richiedono più tempo e maggiore uso di calcolo/memoria. Riducila per aggiornamenti individuali più rapidi su hardware capace, accettando meno contesto.

  • Intervallo di salto (predefinito 3 s): Riducilo per aggiornamenti di anteprima più frequenti; aumentalo quando il carico sulla GPU è troppo alto. Un salto più piccolo avvia più esecuzioni di trascrizione e non rende ciascuna esecuzione più veloce.

  • Sovrapposizione / contesto (predefinito 20 s): Aumentala quando le parole ai confini dei blocchi sono duplicate, omesse o combinate male. Riducila per ridurre il lavoro ripetuto. Troppa poca sovrapposizione elimina le prove necessarie per riconciliare snapshot adiacenti.

  • Ritardo di stabilità (predefinito 6 s): Aumentalo quando le parole vengono confermate troppo presto e il contesto successivo le avrebbe corrette. Riducilo quando il testo stabile appare troppo lentamente, accettando più revisioni.

  • Limite di tempo di silenzio (predefinito 1000 ms): Riducilo quando il testo dovrebbe stabilizzarsi rapidamente dopo una pausa. Aumentalo quando esitazioni naturali dividono o finalizzano i pensieri troppo presto.

  • Controlli aggiuntivi dei confini delle frasi (predefinito 2): Aumentali solo quando le transizioni tra le frasi sono ripetutamente errate e c'è margine sulla GPU. Ogni trascrizione extra richiede tempo. Impostalo a 0 per disabilitare le esecuzioni supplementari; il controllo centrale del confine rimane comunque.

  • Fattore di spostamento (predefinito 20%): Controlla quanto si spostano le finestre di verifica aggiuntive rispetto alla dimensione della finestra. Aumentalo quando è utile controllare un'area più ampia attorno a un confine; riducilo quando il contesto vicino è sufficiente. Conta solo insieme ai controlli aggiuntivi.

Parametri di flusso e modelli memorizzati nella cache

  • Runtime: CPU offre la compatibilità più ampia. DirectML può ridurre la latenza sulle GPU Windows supportate, ma utilizza risorse GPU che potrebbero essere necessarie anche dal modello principale.
  • Variante del modello: Scegli Fast per bassa latenza e minore utilizzo di risorse. Scegli Accurate quando la qualità dell'anteprima è più importante della velocità.
  • Finestra di raffinamento delle frasi (1–8, default 2): Un valore di 1 fornisce la finalizzazione più rapida delle frasi. Valori più grandi mantengono più contesto della frase per il raffinamento, ma ritardano la finalizzazione e aumentano il carico. Il valore predefinito è un compromesso pratico.
  • Modelli memorizzati nella cache: Eliminare un modello memorizzato nella cache e non utilizzato libera spazio su disco. Se quella combinazione di lingua/runtime/modello viene selezionata in seguito, dovrà essere scaricata di nuovo prima che l’anteprima sia pronta.

Consulta Trascrizione in tempo reale per il flusso di lavoro completo e i requisiti di disponibilità.

Modelli di IA

Motore di trascrizione e modello

  • Whisper è la scelta generale per il supporto linguistico ampio e per varianti di modello consolidate. Parakeet può essere interessante quando le lingue supportate e l'hardware disponibile corrispondono al tuo caso d'uso. Seleziona in base alle tue registrazioni reali; le valutazioni a stelle e le stime di velocità sono solo indicazioni, non un sostituto per testare il tuo microfono, la lingua e il vocabolario.
  • Modelli più grandi o di qualità superiore generalmente necessitano di più memoria e tempo, ma possono migliorare l'audio difficile. Inizia con il modello più piccolo che sia affidabilmente sufficientemente accurato. Un modello che causa pressione sulla memoria o lunghe code può essere meno utile di un modello leggermente più piccolo che completa in modo consistente.
  • Il gestore dei modelli scarica e rimuove i file dei modelli locali. Non eliminare un modello ancora necessario da un motore selezionato o da un flusso di lavoro offline.

Assegnazione dell’ambiente di esecuzione

  • Assegna trascrizione audio e miglioramento AI in modo indipendente. Una GPU è solitamente la migliore per lavori locali ripetuti; la CPU è il fallback di compatibilità ma può essere molto più lenta. Suddividere i due compiti tra dispositivi può evitare conflitti nella memoria GPU quando entrambi vengono usati contemporaneamente.

  • Per Ollama o LM Studio, seleziona il tipo di server, l'indirizzo, la porta e il modello caricato. Usa la scoperta solo su una rete affidabile e verifica che il modello scelto sia effettivamente disponibile sul server.

  • Un server AI remoto o un altro computer Voice2Win può spostare il lavoro da una macchina più debole, ma introduce latenza di rete e invia l'audio o il testo del compito a quel sistema. Usa solo host e reti affidabili.

  • Condividi l'ambiente di esecuzione locale solo quando un'altra installazione affidabile di Voice2Win ne ha bisogno. Usa una password, consenti la porta attraverso il firewall solo sul profilo di rete desiderato e disabilita la condivisione quando non è più necessaria. Avvisi sui client connessi e sulle versioni aiutano a identificare client inattesi o incompatibili.

Parametri di miglioramento dell'IA

  • Dimensione del contesto (predefinito 4096): Aumentala per testi selezionati lunghi, istruzioni lunghe o trasformazioni che necessitano di più contesto circostante. Un contesto più ampio consuma più memoria e può essere più lento. Non migliora automaticamente le correzioni brevi.

  • Token massimi (predefinito 512): Aumentali quando riscritture lunghe vengono tagliate. Riducili per limitare il tempo di risposta e prevenire output inaspettatamente lunghi. La correzione normale della dettatura raramente necessita di un valore molto grande.

  • Temperatura (predefinito 0,2): Valori bassi sono più ripetibili e sono migliori per correzione, formattazione e conservazione del significato. Aumentala solo per riscritture deliberatamente creative; valori più alti possono cambiare liberamente la formulazione o i fatti.

  • Lunghezza minima della trascrizione per il miglioramento AI (default 20 caratteri): Abbassala quando anche frasi molto brevi devono essere elaborate. Alzala per evitare tempi di avvio/del modello e riscritture sorprendenti per input minuscoli come “sì” o un nome.

  • Prompt di sistema: Questa è l'istruzione permanente per il miglioramento AI di default. Indica la lingua desiderata, se significato e tono devono essere preservati, e che deve essere restituito solo il testo finale. Testa le modifiche del prompt su testi non critici: un prompt troppo generico può rispondere alla dettatura, tradurla, o aggiungere spiegazioni invece di correggerla.

  • Archiviazione di modelli AI alternativi: Usa un disco locale veloce con spazio adeguato. Copiare i modelli esistenti evita un ulteriore download; cambiare solo la cartella non rende un modello mancante o incompatibile utilizzabile.

Vedi Modelli AI e hardware e Miglioramento AI.

Registrazione della conversazione

  • Qualità del modello di riconoscimento vocale: Preferire il modello di qualità superiore quando è importante separare voci simili e la macchina ha memoria/performance sufficienti. Usare un modello più leggero per sessioni lunghe su hardware limitato. I modelli scaricati diventano selezionabili immediatamente.

  • Sensibilità alla separazione dei parlanti: Iniziare con Predefinito. Aumentarla quando due voci diverse ma simili vengono ripetutamente unite; il compromesso è che la voce di una persona che cambia, la distanza o l'angolo del microfono potrebbero essere interpretati come speaker aggiuntivi. Ridurla quando una persona viene ripetutamente mostrata come più parlanti; il compromesso è che voci genuinamente simili potrebbero essere unite.

  • Sensibilità al rilevamento della voce: Aumentala quando clic, rumore della stanza o blocchi silenziosi vengono trascritti. Riducila quando i parlanti silenziosi vengono omessi. Questa soglia decide se un blocco viene inviato per la trascrizione; un blocco respinto in modo aggressivo non può essere recuperato da un modello di trascrizione più accurato.

  • Pausa di finalizzazione (default 10 s, nella pagina Registrazione Conversazioni): Usa una pausa più breve quando le sezioni devono chiudersi rapidamente dopo che i parlanti smettono. Usa una pausa più lunga per discussioni riflessive con lunghe esitazioni; i risultati appariranno più tardi, ma è meno probabile che un contributo venga diviso.

  • Relatori previsti (Automatico per impostazione predefinita, nella pagina di Registrazione della Conversazione): Mantieni Automatico quando i partecipanti possono entrare o uscire. Imposta il numero noto per una riunione fissa quando il raggruppamento automatico produce un numero sbagliato. Un numero fisso errato può costringere voci non correlate insieme o dividere una voce per soddisfare il numero richiesto.

La separazione dei parlanti è probabilistica. La distanza del microfono, la sovrapposizione, gli echi e il rumore di fondo variabile sono importanti; può ancora essere necessaria una correzione manuale dei parlanti. Vedi Registrazione della Conversazione.

Connessioni client

Questa sezione solo per sviluppatori configura il client desktop separato che trasmette un microfono da un altro computer sulla stessa rete locale.

  • Abilitare il servizio solo quando sono necessari i microfoni del client. Scegliere l'adattatore di rete raggiungibile dal client; VPN e adattatori virtuali spesso producono un indirizzo di pairing che l'altro computer non può raggiungere.

  • Mantenere la porta predefinita a meno che non sia in conflitto con un altro servizio. Se il client non riesce a connettersi, controllare l'adattatore selezionato, il firewall locale e se entrambi i sistemi sono sulla stessa rete attendibile prima di cambiare porte casuali.

  • Trattare l'URL/token di pairing come un segreto. Chiunque possa raggiungere il servizio e possieda un token valido può tentare di connettersi. Rigenerare o ridistribuire l'URL dopo aver cambiato l'adattatore, l'indirizzo, la porta o il token.

  • Lo stato del client connesso mostra quali client sono disponibili e le loro capacità. L'audio viene trasmesso in streaming dal client selezionato come dispositivo di registrazione; Semplicemente collegare un client non fa registrare tutti i microfoni collegati contemporaneamente.

  • Non c'è un relè di nuvole. Questo migliora la privacy ma significa che routing, firewall, modalità sospensione e qualità Wi-Fi influenzano direttamente la disponibilità e la latenza.

Vedi Cliente Compagno.

Un ordine pratico di risoluzione dei problemi

  1. Riproduci il problema in un'applicazione di destinazione con miglioramento AI e anteprima in tempo reale disattivati.
  2. Per parole errate, correggi il livello del microfono/rumore, seleziona una lingua fissa e prova un altro modello di trascrizione prima di modificare le impostazioni di inserimento del testo.
  3. Per testo corretto che viene inserito in modo errato, cambia prima il metodo di inserimento, poi la scorciatoia di incolla, quindi aumenta solo il ritardo pertinente.
  4. Per discorsi poco udibili, diminuisci leggermente la sensibilità del rilevamento del parlato; per rumore interpretato come parlato, aumentala leggermente.
  5. Per carichi elevati, disattiva la modalità in tempo reale o aumenta il suo intervallo di salto prima di ridurre la qualità finale della trascrizione.
  6. Ripristina i valori predefiniti nella sezione interessata se più modifiche hanno reso difficile interpretare il risultato.
Languages
English

Features

Configuration

Help

Deutsch

Funktionen

Konfiguration

Hilfe

Español

Funciones

Configuración

Ayuda

Français

Fonctionnalités

Configuration

Aide

Português (Brasil)

Recursos

Configuração

Ajuda

Italiano

Funzionalità

Configurazione

Aiuto

Nederlands

Functies

Configuratie

Help

Polski

Funkcje

Konfiguracja

Pomoc

Svenska

Funktioner

Konfiguration

Hjälp

简体中文

功能

配置

帮助

日本語

機能

設定

ヘルプ

한국어

기능

구성

도움말

हिन्दी

सुविधाएँ

कॉन्फ़िगरेशन

सहायता

繁體中文

功能

設定

說明

Bahasa Indonesia

Fitur

Konfigurasi

Bantuan

Tiếng Việt

Tính năng

Cấu hình

Trợ giúp

ไทย

คุณสมบัติ

การกำหนดค่า

วิธีใช้

العربية

الميزات

الإعداد

المساعدة

Türkçe

Özellikler

Yapılandırma

Yardım

Русский

Возможности

Настройка

Справка

Українська

Функції

Налаштування

Довідка

Clone this wiki locally