-
Notifications
You must be signed in to change notification settings - Fork 0
Nederlands Settings Reference
Open Instellingen met de tandwielknop. OK slaat de wijzigingen op; Annuleren maakt ze ongedaan. Wijzigingen die modellen, runtimes, opslaglocaties of netwerksdiensten beïnvloeden, kunnen even duren om toe te passen en kunnen een component opnieuw laden.
Deze referentie is bedoeld als een afstemmingsgids, niet alleen als een lijst van besturingselementen. De standaardinstellingen zijn een goed startpunt voor de meeste lokale Windows-installaties. Wijzig telkens één gerelateerde instelling, test dit in de toepassing waarin je daadwerkelijk dicteert, en behoud de vorige waarde totdat het resultaat duidelijk beter is.
| Doel | Aanbevolen startpunt |
|---|---|
| Betrouwbare dagelijkse dictatie in normale desktoptoepassingen | Vaste transcriptietaal, Klembord invoeging, klembordherstel ingeschakeld, standaardvertragingen, audio-normalisatie ingeschakeld |
| Dictatie in een terminal of op een externe desktop | Probeer eerst Unicode als klemborddoorsturing niet beschikbaar is. Anders houd Klembord en selecteer de plak-sneltoets die door het externe doel wordt geaccepteerd. Gebruik Scan Code voor toepassingen die alleen betrouwbaar reageren op fysiek-toetsachtige invoer. |
| Lange documenten | Vaste taal, gesproken interpunctie, gekoppelde opmaak, vergrendel- of hybride sneltoetsmodus, opgeslagen WAV-opnamen |
| Korte zoekvelden, chats en opdrachten | Verwijder de eindpunt; gebruik eventueel kleineletter-eerste letter-opmaak; houd de sneltoetsmodus ingedrukt om te voorkomen dat de opname per ongeluk actief blijft |
| Stil of privacy-gevoelig gebruik | Schakel opgeslagen WAV-opnames uit, controleer het bewaren van transcripties, schakel het plakken van het klembord uit als klembord-monitoring applicaties een zorg zijn, en vermijd externe runtimes | | Laagst waargenomen latency | Schakel realtimevoorvertoning uit tenzij nuttig, gebruik een snel lokaal transcriptiemodel/runtime, houd invoervertragingen laag, en verzamel de AI-uitvoer niet vóór invoer |
- Transcriptietaal: Selecteer de taal die je het meest spreekt. Een vaste taal start normaal gesproken sneller en is betrouwbaarder dan Automatisch, vooral bij korte dictaten, namen en vergelijkbaar klinkende woorden. Gebruik automatische detectie alleen wanneer je echt van taal wisselt tussen opnamen; taalherkenning heeft minder bewijs bij een korte zin en kan verkeerd kiezen.
- Aangepaste specialistische termen en namen: Voeg ongebruikelijke namen, producttermen, afkortingen en de spelling toe die je wilt dat Whisper prefereert. Houd de lijst gericht: het begeleidt de herkenning, maar is geen gegarandeerde zoek-en-vervangregel, en een grote lijst met gewone woorden kan ongewenste vooroordelen introduceren. Deze richtlijn is bedoeld voor Whisper; een andere transcriptiemotor kan dit niet op dezelfde manier gebruiken.
De beste invoegmethode hangt af van de doeltoepassing. Test het in het meest moeilijke programma dat je gebruikt, niet alleen in een eenvoudige editor.
-
Klembord: De beste algemene keuze op Windows en meestal de snelste voor lange teksten, speciale tekens en complexe Unicode. Voice2Win vervangt tijdelijk het klembord, stuurt een plakopdracht en kan de vorige inhoud herstellen. Klembordbeheerders of andere applicaties kunnen de tijdelijke tekst observeren, en klemborddoorsturing kan in een externe sessie worden uitgeschakeld.
-
Unicode: Onafhankelijk van het toetsenbordindeling en een goed eerste alternatief voor externe sessies, niet-Windows-systemen en tekst met tekens die niet op het huidige toetsenbord aanwezig zijn. Sommige games, terminals, legacy-applicaties en verhoogde vensters accepteren gesimuleerde Unicode niet betrouwbaar.
-
Scan Code: Gedraagt zich het meest als invoer vanaf een fysiek toetsenbord en kan helpen bij oudere of ongebruikelijke doelapplicaties. Het is afhankelijk van de actieve toetsenbordindeling; een teken dat geen overeenkomstige toets heeft op die indeling kan ontbreken of incorrect zijn. Het is meestal langzamer dan een enkel klembordplak voor lange tekst.
-
Toetsenbordsimulatievertraging (0–50 ms): Houd deze laag tenzij Unicode- of Scan Code-invoer tekens verliest of in de verkeerde volgorde plaatst. Verhoog deze in kleine stappen voor trage applicaties, virtuele machines of externe bureaubladen. Deze instelling vertraagt alleen de gesimuleerde toetsaanslagen; het verbetert de spraakherkenning niet.
-
Gebruik het klembord voor problematische doeltoepassingen: Laat dit ingeschakeld wanneer u Unicode of Scan Code gebruikt, tenzij het gebruik van het klembord verboden is. Voice2Win kan dan terugvallen op bekende toepassingen die slecht reageren op gesimuleerde invoer. Schakel het alleen uit wanneer klembordprivacy of klemborddoorsturing de reden is waarom u bewust hebt gekozen voor toetsenbordsimulatie.
-
Wachttijd voor invoeging (0–2000 ms, standaard 40 ms): Tijd die nodig is voordat de nieuwe klembordwaarde beschikbaar is voordat de plak-sneltoets wordt verzonden. Verhoog deze indien het doel af en toe de vorige klembordwaarde of helemaal niets plakt, vooral bij synchronisatie van een klembord op afstand. Een hogere waarde voegt dezelfde vertraging toe aan elke invoeging.
-
Plak-toetscombinatie: Gebruik Ctrl+V voor normale Windows-toepassingen. Probeer Ctrl+Shift+V of Shift+Insert wanneer een terminal, remote desktop of AI-tool Ctrl+V behandelt als iets anders dan platte tekst plakken. Kies de sneltoets die door het uiteindelijke doel wordt verwacht, niet noodzakelijk door het lokale remote-desktopvenster.
-
Tekst verzamelen tijdens AI-verbetering en in één stap invoegen: Schakel dit in wanneer progressieve AI-uitvoer de cursor verplaatst, opmaak of automatische aanvulling activeert of meerdere undo-stappen creëert. Schakel het uit wanneer het belangrijker is om het resultaat zo vroeg mogelijk te zien; verzamelen wacht totdat het AI-resultaat compleet is voordat iets wordt ingevoegd.
-
Vorige klembord herstellen: Houd dit ingeschakeld voor normaal werk zodat Voice2Win niet overschrijft wat je eerder hebt gekopieerd voordat de dictatie begon. Schakel het alleen uit als je opzettelijk wilt dat het gedicteerde resultaat op het klembord blijft of een specifieke doeltoepassing het klembord leest nadat de plak-snelkoppeling al is uitgevoerd.
-
Wachttijd vóór herstel (0–2000 ms, standaard 120 ms): Verhoog dit wanneer het doel niets invoegt of slechts een deel van de tekst, omdat de vorige klembordwaarde te snel wordt hersteld. Houd het alleen zo hoog als nodig: tijdens dit interval blijft de gedicteerde tekst beschikbaar voor klembordbewuste applicaties.
Deze opties wijzigen de herkende tekst vóór invoeging. Ze zijn het meest nuttig wanneer je dictaten een consistent patroon volgen.
-
Gesproken interpunctie: Schakel dit in voor langere proza wanneer je wilt dat woorden zoals “komma”, “vraagteken” of de taal-specifieke equivalenten worden omgezet in interpunctie. Laat het uit wanneer die woorden letterlijk als inhoud bedoeld zijn, of wanneer je de automatische interpunctie van het transcriptiemodel verkiest.
-
Verwijder laatste punt: Handig voor zoekvelden, chatberichten, formulierinvulvelden, bestandsnamen en spraakopdrachten waarbij een automatisch toegevoegd eindpunt ongewenst is. Laat het uit voor volledige zinnen in documenten en e-mails.
-
Kleine beginletter: Handig wanneer dicteren normaal gesproken in het midden van een bestaande zin wordt ingevoegd. Laat het uit voor nieuwe zinnen, koppen, namen en zelfstandige boodschappen.
-
Verbind opeenvolgende dictaten in dezelfde toepassing: Schakel dit in wanneer u één alinea bouwt uit meerdere opnamen; Voice2Win kan de spatiëring en zinscontext ertussen behouden. Schakel dit uit wanneer opeenvolgende opnamen meestal in verschillende velden gaan, of wanneer u vaak de cursor handmatig tussen dictaten verplaatst.
-
Spreekdetectiesensitiviteit (0–100, standaard 35%): Lagere waarden accepteren stillere spraak, maar kunnen ook ademhaling, klikken of achtergrondgeluiden als spraak beschouwen. Hogere waarden filteren ruis agressiever, maar kunnen een zachte stem of het einde van woorden afwijzen. Begin bij de standaardwaarde en wijzig deze in kleine stappen terwijl je het invoerniveau in de gaten houdt; de microfoon dichterbij brengen is vaak beter dan een extreme waarde te gebruiken.
-
Opname-start opschonen (0–500 ms, standaard 250 ms): Onderdrukt de hotkey-klik, afhandelingsgeluid en voorlijdende stilte aan het begin. Verhoog dit als het eerste deel van de opname een toetsklik bevat; verlaag het als de eerste lettergreep wordt weggesneden of als je zeer korte woorden dicteert direct na het indrukken van de hotkey.
-
Normaliseer opname (standaard aan, doel 85%): Aanbevolen voor gewone microfoons en wisselende spreekafstand omdat het een consistenter niveau aan het model presenteert. Schakel het uit voor een reeds genormaliseerde studio-/virtuele ingang, of wanneer normalisatie merkbaar constant achtergrondgeluid verhoogt. Het doel is geen microfoonversterkingsregeling en kan geen geknipte audio herstellen.
-
Sla WAV-opnames op (standaard aan): Houd dit ingeschakeld wanneer je afspelen, herschrijven, kwaliteitsvergelijking of diagnostisch bewijs wilt. Schakel het uit wanneer opslaggebruik of vertrouwelijkheid belangrijker is. Audio neemt normaliter veel meer ruimte in dan tekst.
-
Verwijder opgeslagen WAV-opnames: Verwijdert opgeslagen audio terwijl transcriptietekst behouden blijft. Gebruik dit nadat je hebt gecontroleerd dat je afspelen of herschrijven niet meer nodig hebt; verwijdering kan de originele audio niet herstellen.
- Vasthouden: De opname duurt alleen zolang de snelkoppeling wordt vastgehouden. Het is het beste voor korte, frequente dictaten en de veiligste modus wanneer per ongeluk op de achtergrond opnemen moet worden vermeden.
- Vergrendelen: Druk één keer om te starten en nogmaals om te stoppen. Het is het beste voor lange passages, toegankelijkheidsgebruik of handsfree spreken, maar het vereist een bewuste stopactie.
- Hybride / dubbel tikken: Houd vast voor een korte opname of dubbel tik om te vergrendelen. Dit is de meest flexibele standaard voor gemengd werk. Gebruik in plaats daarvan Vasthouden als per ongeluk dubbel tikken soms de opname actief laat.
-
Wijs aparte sneltoetsen toe voor Spraak naar Tekst en Stemcommando. Geef de voorkeur aan combinaties die niet al door het besturingssysteem, het toetsenbordstuurprogramma, een externe desktop of de doeltoepassing worden gebruikt. Dubbele Voice2Win-sneltoetsen worden geweigerd.
-
Op Windows kan Voice2Win meestal niet injecteren in een toepassing die met hogere privileges wordt uitgevoerd. Voer Voice2Win alleen verhoogd uit wanneer dicteren in verhogde toepassingen echt nodig is; verhoogde globale invoertoegang vergroot de impact van eventuele toepassing- of configuratiefouten.
-
Dempen van de globale audio-uitvoer terwijl de sneltoets wordt ingedrukt is handig bij luidsprekers omdat systeemgeluid niet kan terugkoppelen naar de microfoon. Schakel dit uit bij gebruik van koptelefoons of wanneer het nodig is om tijdens het opnemen een vergadering of mediasource te horen.
-
Gescheiden start- en stopsignalen maken de latch/hybride toestand duidelijk wanneer de indicator niet zichtbaar is. Houd geluiden kort en zacht bij het gebruik van luidsprekers, zodat de microfoon ze niet opvangt. Verhoog de duur of het volume voor toegankelijkheid, niet om onbetrouwbare sneltoetsdetectie op te lossen.
- Interface-taal verandert alleen menu's en labels; het selecteert niet de transcriptietaal.
- Donker thema is een visuele voorkeur en beïnvloedt de herkenning of prestaties niet.
- Indicatorstijl: een eenvoudige niveaweergave is het minst afleidend; golfvormen of balken maken spraakactiviteit gemakkelijker te beoordelen; spectrum-stijlweergaven tonen meer details maar zijn visueel drukker. Kies de stijl die je helpt om de microfoonactiviteit te bevestigen zonder de doentoepassing te bedekken.
- Kleurschema, positie en grootte: Gebruik een hoogcontrastschema en een positie weg van werkbalken, bijschriften en de tekstcursor. Een grotere indicator helpt bij toegankelijkheid en realtime tekst; een kleinere is beter wanneer alleen de opname-status van belang is.
-
Automatisch starten uitgeschakeld is het beste wanneer Voice2Win af en toe wordt gebruikt. Register automatisch starten is de normale Windows-optie voor starten na aanmelding. Taakplanner is nuttig wanneer de opstartvolgorde of verhoogde uitvoering vereist is. Op Linux gebruikt de app het per-gebruiker desktop automatisch starten mechanisme.
-
Verhoogd uitvoeren met Taakplanner moet uitgeschakeld blijven tenzij u in administrator-toepassingen moet dicteren. Verhoging is geen prestatieoptie; het verandert de beveiligingsgrens van wereldwijde toetsenbordinvoer.
-
Toon dialoogvenster automatisch starten is nuttig bij het valideren van een nieuwe automatische startinstelling of op een gedeelde computer. Schakel het alleen uit wanneer opstarten vertrouwd is en unattended zou moeten zijn.
-
Toon opstartscherm helpt wanneer model/runtime-initialisatie merkbare tijd in beslag neemt. Schakel het uit voor een stillere tray-stijl start.
-
Klaargeluid bevestigt dat de opstart en modelvoorbereiding voltooid zijn, vooral wanneer Voice2Win geminimaliseerd start. Schakel het uit in stille omgevingen; pas duur en volume alleen aan zodat het herkenbaar blijft.
-
Minimaliseren bij sluiten (standaard aan) houdt globale sneltoetsen beschikbaar na het sluiten van het hoofdvenster. Schakel dit uit wanneer de sluitknop van het venster de applicatie moet afsluiten.
-
Automatisch controleren op updates (standaard aan) wordt aanbevolen voor fixes, model-/runtime-compatibiliteit en beveiligingsupdates. Schakel dit alleen uit voor bewust beheerde of offline installaties en controleer handmatig in plaats daarvan.
-
Wekelijkse informatiedialoog uitschakelen verbergt de terugkerende informatiemelding nadat u deze niet meer nodig hebt; het schakelt functionele of foutmeldingen niet uit.
-
Status van Linux-invoeringsautomatisering is diagnostische informatie. X11-compatibele invoeringsautomatisering wordt ondersteund; een pure Wayland-sessie kan globale sneltoetsen en tekstinjectie beperken. Als dit niet beschikbaar is, gebruik dan een X11-sessie of de compatibiliteitsmodus die door de desktopomgeving wordt aangeboden.
-
Pad voor opslag van transcripties: Kies een betrouwbare lokale map. Gebruik een versleutelde locatie voor gevoelige dictaten en zorg ervoor dat back-up-/synchronisatiesoftware geen conflicten veroorzaakt met bestanden die nog worden geschreven. Een langzaam of slechts af en toe beschikbaar netwerkstation kan het bijwerken van de geschiedenis vertragen.
-
Verwijder oude transcripties / maximale leeftijd: Schakel automatische bewaring in wanneer privacybeleid of schijfruimte belangrijk is. Kies een leeftijd die uw realistische correctie- en hertranscriptieperiode nog dekt. Opgeslagen WAV-bestanden vormen normaal gesproken het grootste deel van de geschiedenis.
-
Pad voor modelopslag: Geef de voorkeur aan een snelle lokale SSD met voldoende vrije ruimte. Verwijderbare en netwerkstations maken het laden van modellen minder betrouwbaar en kunnen een losgekoppeld station veranderen in een ogenschijnlijk ontbrekend model.
-
Gebruik een aangepaste data root / verplaats alle applicatiegegevens: Handig voor draagbare configuraties, gecontroleerde back-ups of om grote data van de systeemschijf te houden. Selecteer een map met de juiste machtigingen en voldoende vrije ruimte, en herstart wanneer daarom wordt gevraagd. Dit verplaatst lokale gegevens; het versleutelt deze niet en uploadt ze ook niet automatisch.
Live transcriptie is een voorbeeld terwijl je nog spreekt. De normale definitieve transcriptie blijft het gezaghebbende resultaat. Laat de live-modus uitgeschakeld wanneer een voorbeeld niet nuttig is: dat minimaliseert het gebruik van middelen en voorkomt dat voorlopige woorden op het scherm veranderen.
- Block voert herhaaldelijk het hoofd-Whisper-transcriptiemodel uit over overlappende audio. Kies dit wanneer je wilt dat de preview lijkt op het uiteindelijke Whisper-resultaat en je een ondersteunde GPU met voldoende geheugen hebt. Het biedt meer context maar genereert aanzienlijke herhaalde GPU-werking.
- Stream gebruikt een apart Sherpa-ONNX-streamingmodel. Kies dit voor de vroegste incrementele feedback of wanneer de block-modus niet beschikbaar is. De preview kan ruw zijn en ondersteunt alleen de talen die in de instellingen zijn vermeld; de uiteindelijke normale transcriptie kan nog steeds verschillen.
- Maximale weergavehoogte beperkt hoeveel van het scherm de preview mag innemen. Verhoog dit voor toegankelijkheid bij lange teksten; verlaag het wanneer de indicator de doelapplicatie bedekt. Dit verandert de herkenningskwaliteit niet.
De standaardinstellingen zijn gebalanceerd en onderling afhankelijk. Herstel ze voordat je problemen oplost en wijzig slechts één parameter tegelijk.
-
Venstergrootte (standaard 10 s): Vergroot deze wanneer de context van de zin onvoldoende is of lange zinsdelen te veel veranderen tussen snapshots. Grotere vensters duren langer en gebruiken meer rekenkracht/geheugen. Verklein het voor snellere individuele updates op geschikte hardware, met acceptatie van minder context.
-
Hop-interval (standaard 3 s): Verklein het voor frequentere preview-updates; vergroot het wanneer de GPU-belasting te hoog is. Een kleinere hop start meer transcriptieruns en maakt elke run niet sneller.
-
Overlap / context (standaard 20 s): Vergroot dit wanneer woorden op blokgrenzen worden gedupliceerd, weggelaten of slecht samengevoegd. Verklein het om herhaalde werkzaamheden te verminderen. Te weinig overlap verwijdert het bewijs dat nodig is om aangrenzende snapshots te verzoenen.
-
Stabiliteitsvertraging (standaard 6 s): Verhoog deze wanneer woorden te vroeg worden bevestigd en latere context ze had kunnen corrigeren. Verlaag deze wanneer stabiele tekst te langzaam verschijnt, waardoor meer herzieningen worden geaccepteerd.
-
Stilte tijdslimiet (standaard 1000 ms): Verlaag deze wanneer tekst na een pauze snel moet worden vastgesteld. Verhoog deze wanneer natuurlijke aarzeling gedachten te vroeg splijt of afsluit.
-
Extra zin-eindcontrole (standaard 2): Verhoog alleen wanneer zins overgangen herhaaldelijk fout zijn en er GPU-capaciteit beschikbaar is. Elke extra verplaatste transcriptie kost tijd. Stel dit in op 0 om de extra controles uit te schakelen; de centrale einde-controle blijft nog steeds bestaan.
-
Verschuivingsfactor (standaard 20%): Bepaalt hoe ver de extra verificatievensters verschuiven ten opzichte van de venstergrootte. Verhoog dit wanneer het controleren van een groter gebied rond een grens helpt; verlaag het wanneer de nabije context voldoende is. Het is alleen van belang in combinatie met extra controles.
- Runtime: CPU biedt de breedste compatibiliteit. DirectML kan de latentie verminderen op ondersteunde Windows GPU's, maar gebruikt GPU-bronnen die mogelijk ook door het hoofdmodel nodig zijn.
- Modelvariant: Kies Fast voor lage latentie en lager resourcegebruik. Kies Accurate wanneer de previewkwaliteit belangrijker is dan de snelheid.
- Zinsverfijningsvenster (1–8, standaard 2): Een waarde van 1 zorgt voor de snelste zinsafwerking. Hogere waarden behouden meer zinscontext voor verfijning, maar vertragen het afronden en verhogen de werklast. De standaardwaarde is een praktische balans.
- Gecachte modellen: Het verwijderen van een ongebruikt gecachte model maakt schijfruimte vrij. Als die taal/runtime/model-combinatie later weer wordt gekozen, moet het opnieuw worden gedownload voordat de preview klaar is.
Zie Real-Time Transcription voor de volledige workflow en beschikbaarheidseisen.
- Whisper is de algemene keuze voor brede taalondersteuning en gevestigde modelvarianten. Parakeet kan aantrekkelijk zijn wanneer de ondersteunde talen en beschikbare hardware passen bij uw gebruikssituatie. Kies op basis van uw echte opnames; sterbeoordelingen en snelheidsramingen zijn richtlijnen, geen vervanging voor het testen van uw microfoon, taal en vocabulaire.
- Grotere of modellen van hogere kwaliteit hebben over het algemeen meer geheugen en tijd nodig, maar kunnen moeilijke audio verbeteren. Begin met het kleinste model dat betrouwbaar nauwkeurig genoeg is. Een model dat geheugenproblemen of lange wachtrijen veroorzaakt, kan minder nuttig zijn dan een iets kleiner model dat consistent voltooit.
- De modelbeheerder downloadt en verwijdert lokale modelbestanden. Verwijder een model niet dat nog nodig is door een geselecteerde engine of offline workflow.
-
Wijs audiotranscriptie en AI-verbetering onafhankelijk toe. Een GPU is meestal het beste voor herhaald lokaal werk; CPU is de compatibiliteitsval, maar kan veel langzamer zijn. Het splitsen van de twee taken over apparaten kan GPU-geheugenconflicten vermijden wanneer beide tegelijkertijd worden gebruikt.
-
Voor Ollama of LM Studio, selecteer het servertype, adres, poort en geladen model. Gebruik ontdekking alleen op een betrouwbaar netwerk en verifieer dat het gekozen model daadwerkelijk beschikbaar is op de server.
-
Een extern AI-server of een andere Voice2Win-computer kan werk verplaatsen van een zwakker apparaat, maar introduceert netwerkvertraging en stuurt de audio of tekst van de taak naar dat systeem. Gebruik alleen vertrouwde hosts en netwerken.
-
De lokale runtime delen alleen wanneer een andere vertrouwde Voice2Win-installatie dit nodig heeft. Gebruik een wachtwoord, sta de poort toe via de firewall alleen op het bedoelde netwerkprofiel, en schakel delen uit wanneer het niet langer nodig is. Waarschuwingen voor verbonden clients en versies helpen onverwachte of incompatibele clients te identificeren.
-
Contextgrootte (standaard 4096): Verhoog dit voor lange geselecteerde tekst, lange instructies of transformaties die meer omringende context nodig hebben. Grotere context verbruikt meer geheugen en kan trager zijn. Het verbetert kortere correcties niet automatisch.
-
Maximum tokens (standaard 512): Verhoog dit wanneer lange herschrijvingen worden afgebroken. Verlaag het om de responstijd te beperken en onverwacht lange output te voorkomen. Normale dictatiecorrectie heeft zelden een zeer grote waarde nodig.
-
Temperatuur (standaard 0.2): Lage waarden zijn consistenter en het beste voor correctie, opmaak en het behouden van betekenis. Verhoog dit alleen voor bewust creatieve herschrijvingen; hogere waarden kunnen de bewoording of feiten vrijer veranderen.
-
Minimale transcriptielengte voor AI-versterking (standaard 20 tekens): Verlaag dit wanneer zelfs zeer korte zinnen verwerkt moeten worden. Verhoog het om modelopstart/trage respons en verrassende herschrijvingen voor kleine invoer zoals “ja” of een naam te vermijden.
-
Systeemprompt: Dit is de standaardinstructie voor AI-versterking. Geef de gewenste taal aan, of betekenis en toon behouden moeten worden, en dat alleen de eindtekst moet worden geretourneerd. Test promptwijzigingen op niet-kritische tekst: een te brede prompt kan de dictatie beantwoorden, vertalen of uitleg toevoegen in plaats van correcties uit te voeren.
-
Opslag van alternatieve AI-modellen: Gebruik een snelle lokale schijf met voldoende ruimte. Het kopiëren van bestaande modellen voorkomt een nieuwe download; alleen het wijzigen van de map maakt een ontbrekend of incompatibel model niet bruikbaar.
Zie AI-modellen en hardware en AI-verbetering.
-
Kwaliteit van sprekersherkenningsmodel: Geef de voorkeur aan het model van hogere kwaliteit wanneer het belangrijk is om vergelijkbare stemmen te scheiden en de machine genoeg geheugen/prestatie heeft. Gebruik een lichter model voor lange sessies op beperkte hardware. Gedownloade modellen worden onmiddellijk selecteerbaar.
-
Gevoeligheid van sprekersscheiding: Begin met Standaard. Verhoog dit wanneer twee verschillende maar vergelijkbare stemmen herhaaldelijk samengevoegd worden; het nadeel is dat de veranderende stem, afstand of microfoonhoek van één persoon kan leiden tot extra sprekers. Verlaag het wanneer één persoon herhaaldelijk als meerdere sprekers wordt weergegeven; het nadeel is dat echt vergelijkbare stemmen samengevoegd kunnen worden.
-
Gevoeligheid spraakdetectie: Verhoog deze wanneer klikken, kamergeluiden of stille blokken worden getranscribeerd. Verlaag deze wanneer rustige sprekers worden weggelaten. Deze poort bepaalt of een blok wordt verzonden voor transcriptie; een agressief geweigerd blok kan niet worden hersteld door een nauwkeuriger transcriptiemodel.
-
Pauze bij finalisatie (standaard 10 s, op de pagina Gespreksopname): Gebruik een kortere pauze wanneer secties snel moeten sluiten nadat sprekers stoppen. Gebruik een langere pauze voor weloverwogen discussies met lange aarzeling; de resultaten verschijnen later, maar één bijdrage wordt minder snel gesplitst.
-
Verwachte sprekers (Automatisch standaard, op de pagina Gespreksopname): Laat Automatisch ingesteld wanneer deelnemers kunnen komen of gaan. Stel het bekende aantal in voor een vaste vergadering wanneer automatische clustering het verkeerde aantal produceert. Een verkeerd vastgesteld aantal kan ertoe leiden dat niet-gerelateerde stemmen worden samengevoegd of dat één stem wordt opgesplitst om aan het gevraagde aantal te voldoen.
Sprekersscheiding is probabilistisch. Microfoonafstand, overlap, echo's en veranderend achtergrondgeluid zijn belangrijk; handmatige sprekercorrectie kan nog steeds nodig zijn. Zie Gespreksopname.
Deze sectie alleen voor ontwikkelaars configureert de aparte desktop-companion client die een microfoon streamt vanaf een andere computer op hetzelfde lokale netwerk.
-
Schakel de service alleen in wanneer de microfoons van de cliënt nodig zijn. Kies de netwerkadapter die bereikbaar is vanaf de cliënt; VPN- en virtuele adapters geven vaak een koppelingsadres dat de andere computer niet kan bereiken.
-
Houd de standaardpoort tenzij deze in conflict is met een andere service. Als de cliënt geen verbinding kan maken, controleer dan de geselecteerde adapter, de lokale firewall en of beide systemen op hetzelfde vertrouwde netwerk zitten voordat u willekeurige poorten wijzigt.
-
Behandel de koppelings-URL/token als een geheim. Iedereen die de service kan bereiken en een geldig token heeft, kan proberen verbinding te maken. Genereer of herverdeel de URL na het wijzigen van de adapter, het adres, de poort of het token.
-
De status van de verbonden cliënt toont welke cliënten beschikbaar zijn en hun mogelijkheden. Audio wordt gestreamd van de cliënt die als opnameapparaat is geselecteerd; het simpelweg verbinden van een cliënt zorgt er niet voor dat elke verbonden microfoon tegelijkertijd opneemt.
-
Er is geen cloudrelais. Dit verbetert de privacy, maar betekent dat routering, firewall, slaapstand en Wi-Fi-kwaliteit direct de beschikbaarheid en latentie beïnvloeden.
Zie Companion Client.
- Reproduceer het probleem in één doelsysteem met AI-versterking en realtimevoorbeeld uitgeschakeld.
- Voor verkeerde woorden, corrigeer het microfoonniveau/ruis, selecteer een vaste taal en test een ander transcriptiemodel voordat u de tekstinvoeginstellingen wijzigt.
- Voor correcte tekst die verkeerd wordt ingevoegd, wijzig eerst de invoegmethode, daarna de plakknop en verhoog alleen de relevante vertraging.
- Voor ontbrekende zachte spraak, verlaag de spraakdetectiesensitiviteit licht; voor ruis die als spraak wordt geïnterpreteerd, verhoog deze licht.
- Bij hoge belasting, schakel de realtime-modus uit of verhoog het hopinterval ervan voordat u de uiteindelijke transcriptiekwaliteit verlaagt.
- Herstel de standaardinstellingen in het getroffen gedeelte als meerdere wijzigingen het resultaat moeilijk interpreteerbaar hebben gemaakt.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động