-
Notifications
You must be signed in to change notification settings - Fork 0
Svenska Settings Reference
Öppna Inställningar med kugghjulsikonen. OK sparar ändringarna; Avbryt kastar dem. Ändringar som påverkar modeller, körningar, lagringsplatser eller nätverkstjänster kan ta ett ögonblick att tillämpa och kan ladda om en komponent.
Denna referens är avsedd som en finjusteringsguide, inte bara som en lista över kontroller. Standardinställningarna är en bra utgångspunkt för de flesta lokala Windows-installationer. Ändra en relaterad inställning åt gången, testa den i den applikation där du faktiskt dikterar, och behåll föregående värde tills resultatet är tydligt bättre.
| Mål | Rekommenderad startpunkt |
|---|---|
| Pålitlig vardagsdiktering i normala skrivbordsprogram | Fast transkriptionsspråk, Urklipp-infogning, återställning av urklipp aktiverad, standardfördröjningar, ljudnormalisering aktiverad |
| Diktering i ett terminalfönster eller fjärrskrivbord | Prova Unicode först om urklippsvidarebefordran inte är tillgänglig. Annars behåll Urklipp och välj klistra in-genvägen som accepteras av den fjärrstyrda enheten. Använd Scan Code för program som endast reagerar pålitligt på tangenttryckningar som liknar fysiska tangenter. |
| Långa dokument | Fast språk, uttalad interpunktion, kedjad formatering, lås- eller hybridgenvägsläge, sparade WAV-inspelningar |
| Korta sökfält, chattar och kommandon | Ta bort avslutande punkt; använd eventuellt liten bokstav som första bokstav; håll-genvägsläge undviker att inspelningen lämnas aktiv av misstag |
| Tyst eller sekretesskänslig användning | Inaktivera sparade WAV-inspelningar, granska hur transkriptioner sparas, inaktivera urklippsinsättning om appar som övervakar urklipp är en oro, och undvik fjärrkörningar | | Lägst upplevd fördröjning | Inaktivera förhandsvisning i realtid om det inte är användbart, använd en snabb lokal transkriptionsmodell/körning, håll insättningsfördröjningar låga och samla inte AI-output innan insättning |
- Transkriptionsspråk: Välj det språk du talar oftast. Ett fast språk startar normalt snabbare och är mer pålitligt än Automatiskt, särskilt för korta dikteringar, namn och liknande ord. Använd automatisk detektion endast när du verkligen byter språk mellan inspelningar; språkdetection har mindre underlag i en kort fras och kan välja fel.
- Anpassade specialisttermer och namn: Lägg till ovanliga namn, produkttermer, förkortningar och stavningen du vill att Whisper ska föredra. Håll listan fokuserad: den vägleder igenkänningen men är inte en garanterad sök-och-ersätt-regel, och en stor lista med vanliga ord kan introducera oönskad bias. Den här vägledningen är avsedd för Whisper; en annan transkriptionsmotor kan inte använda den på samma sätt.
Den bästa infogningsmetoden beror på målprogrammet. Testa den i det svåraste programmet du använder, inte bara i en enkel redigerare.
-
Urklipp: Det bästa allmänna valet på Windows och vanligtvis snabbast för lång text, specialtecken och komplex Unicode. Voice2Win ersätter tillfälligt urklippet, skickar ett klistra-in-kommando och kan återställa det tidigare innehållet. Urklippshanterare eller andra program kan observera den tillfälliga texten, och urklippsvidarebefordran kan vara inaktiverad i en fjärrsession.
-
Unicode: Layout-oberoende och ett bra första alternativ för fjärrsessioner, icke-Windows-system och text som innehåller tecken som inte finns på det nuvarande tangentbordsuppsättningen. Vissa spel, terminaler, äldre program och fönster med förhöjda rättigheter accepterar inte simulerad Unicode pålitligt.
-
Scan Code: Fungerar mest som fysisk tangentbordsinmatning och kan hjälpa med äldre eller ovanliga målprogram. Det beror på den aktiva tangentbordslayouten; ett tecken som inte har motsvarande tangent på den layouten kan saknas eller bli fel. Det är vanligtvis långsammare än en enkel klistra in-händelse för lång text.
-
Tangentbordssimulering fördröjning (0–50 ms): Lämna den låg om inte Unicode- eller Scan Code-inmatning tappar eller ordnar om tecken. Öka den i små steg för långsamma program, virtuella maskiner eller fjärrskrivbord. Denna inställning saktar bara ner de simulerade tangenttryckningarna; den förbättrar inte taligenkänning.
-
Använd urklipp för problematiska målprogram: Håll detta aktiverat när du använder Unicode eller Skanningskod om inte användning av urklipp är förbjudet. Voice2Win kan då falla tillbaka för kända program som inte tar emot simulerad inmatning väl. Inaktivera det endast när urklippsintegritet eller vidarebefordran av urklipp är anledningen till att du medvetet valde tangentbordssimulering.
-
Väntetid före insättning (0–2000 ms, standard 40 ms): Tid för det nya urklippsvärdet att bli tillgängligt innan klistra in-genvägen skickas. Öka den om målet ibland klistrar in det tidigare urklippsvärdet eller ingenting alls, särskilt vid synkronisering av urklipp på distans. Ett större värde lägger till samma fördröjning vid varje insättning.
-
Kombination för klistra in: Använd Ctrl+V för vanliga Windows-applikationer. Prova Ctrl+Shift+V eller Shift+Insert när en terminal, fjärrskrivbord eller AI-verktyg behandlar Ctrl+V som något annat än enkel textklistring. Välj den genväg som förväntas av det slutliga målet, inte nödvändigtvis av det lokala fjärrskrivbordsfönstret.
-
Samla text under AI-förbättring och infoga den i ett steg: Aktivera detta när progressivt AI-resultat flyttar markören, utlöser formatering eller autokomplettering, eller skapar flera ångra-steg. Inaktivera det när det är viktigare att se resultatet så tidigt som möjligt; insamlingen väntar tills AI-resultatet är färdigt innan något infogas.
-
Återställ tidigare urklipp: Behåll detta aktiverat för normalt arbete så att Voice2Win inte förstör det du kopierade innan diktering. Inaktivera det endast om du avsiktligt vill att det dikterade resultatet ska förbli på urklippet eller om ett specifikt mål läser urklippet efter att klistra in-genvägen redan har återvänt.
-
Väntetid innan återställning (0–2000 ms, standard 120 ms): Öka den när målet inte infogar något eller endast en del av texten eftersom det föregående urklippsvärdet återställs för snabbt. Håll den endast så hög som krävs: under denna tidsperiod förblir den dikterade texten tillgänglig för urklippsmedvetna program.
Dessa alternativ ändrar den igenkända texten innan infogning. De är mest användbara när dina dikteringar följer ett konsekvent mönster.
-
Talad interpunktion: Aktivera det för längre prosa när du vill att fraser som “komma”, “frågetecken” eller deras språksspecifika motsvarigheter ska omvandlas till interpunktion. Lämna det avstängt när dessa ord kan vara bokstavligt innehåll, eller när du föredrar transkriptionsmodellens automatiska interpunktion.
-
Ta bort avslutande punkt: Användbart för sökfält, chattmeddelanden, formulärfält, filnamn och röstkommandon där en automatiskt tillagd slutpunkt inte önskas. Lämna det avstängt för kompletta meningar i dokument och e-post.
-
Gör första bokstaven gemen: Användbart när diktat normalt infogas mitt i en befintlig mening. Lämna det avstängt för nya meningar, rubriker, namn och fristående meddelanden.
-
Koppla samman på varandra följande dikteringar i samma program: Aktivera det när du skapar ett stycke från flera inspelningar; Voice2Win kan behålla avstånd och meningssamband mellan dem. Inaktivera det när på varandra följande inspelningar vanligtvis går till olika fält, eller när du ofta flyttar markören manuellt mellan dikteringar.
-
Taligenkänningens känslighet (0–100, standard 35%): Lägre värden accepterar tystare tal men kan också tolka andning, klickljud eller bakgrundsljud som tal. Högre värden filtrerar ljud mer aggressivt men kan avvisa en mjuk röst eller slutet av ord. Börja med standardvärdet och ändra i små steg medan du observerar ingångsnivån; att flytta mikrofonen närmare är ofta bättre än att använda ett extremt värde.
-
Rensa upp inspelningsstarten (0–500 ms, standard 250 ms): Undertrycker hotkey-klicket, hanteringsljud och inledande tystnad i början. Öka det om första delen av inspelningarna innehåller ett tangentklick; minska det om den första stavelsen blir avkapad eller om du dikterar mycket korta ord direkt efter att ha tryckt på hotkey.
-
Normalisera inspelning (standard på, mål 85%): Rekommenderas för vanliga mikrofoner och varierande talavstånd eftersom det ger en mer konsekvent nivå för modellen. Inaktivera det för redan normaliserad studio-/virtuell ingång, eller när normalisering märkbart höjer konstant bakgrundsljud. Målet är inte en mikrofonförstärkningskontroll och kan inte återställa klippt ljud.
-
Spara WAV-inspelningar (standard på): Håll det aktiverat när du vill spela upp, transkribera om, jämföra kvalitet eller ha diagnostiska bevis. Inaktivera det när lagringsanvändning eller sekretess är viktigare. Ljud tar normalt sett mycket mer utrymme än text.
-
Radera sparade WAV-inspelningar: Tar bort lagrat ljud samtidigt som transkriberad text behålls. Använd det efter att du kontrollerat att du inte längre behöver uppspelning eller att transkribera igen; radering kan inte återskapa originalljudet.
- Håll: Inspelningen pågår endast medan genvägen hålls ned. Bäst för korta, frekventa dikteringar och det säkraste läget när oavsiktlig bakgrundsinspelning måste undvikas.
- Lås: Tryck en gång för att starta och igen för att stoppa. Bäst för långa avsnitt, tillgänglighetsanvändning eller tal utan händer, men det kräver en medveten stoppåtgärd.
- Hybrid / dubbeltryck: Håll ned för en kort inspelning eller dubbeltryck för att låsa. Detta är det mest flexibla standardvalet för blandat arbete. Använd Håll istället om oavsiktliga dubbeltryck ibland lämnar inspelningen aktiv.
-
Tilldela separata kortkommandon för Tal till Text och Röstkommando. Föredra kombinationer som inte redan hanteras av operativsystemet, tangentbordsdrivrutinen, fjärrskrivbordet eller målprogrammet. Dubbletter av Voice2Win-kortkommandon avvisas.
-
På Windows kan Voice2Win vanligtvis inte injicera i ett program som körs med högre behörigheter. Kör Voice2Win med förhöjda rättigheter endast när diktat till förhöjda program verkligen krävs; förhöjd global inmatningstillgång ökar påverkan av eventuella applikations- eller konfigurationsfel.
-
Stäng av global ljudutgång medan snabbkommandot trycks ned är användbart med högtalare eftersom systemets ljud inte kan återföras till mikrofonen. Inaktivera det när du använder hörlurar eller när det är nödvändigt att höra ett möte eller mediekälla under inspelning.
-
Separata start- och stopsignaler gör latch-/hybridläge klart när indikatorn inte är synlig. Håll ljuden korta och tysta när du använder högtalare så att mikrofonen inte plockar upp dem. Öka varaktighet eller volym för tillgänglighet, inte för att lösa opålitlig snabbknappupptäckt.
- Gränssnittsspråk ändrar endast menyer och etiketter; det väljer inte transkriptionsspråk.
- Mörkt tema är en visuell preferens och påverkar inte igenkänning eller prestanda.
- Indikatorstil: en enkel nivåvisning är minst distraherande; vågforms- eller stapeldiagram gör talaktivitet lättare att bedöma; spektrumstil visar mer detaljer men är visuellt mer upptagen. Välj den stil som hjälper dig att bekräfta mikrofonaktivitet utan att täcka målprogrammet.
- Färgschema, position och storlek: Använd ett högkontrastschema och en position bort från verktygsfält, bildtexter och textmarkören. En större indikator hjälper med tillgänglighet och realtidstext; en mindre är bättre när endast inspelningsstatus är viktig.
-
Autostart inaktiverad är bäst när Voice2Win används ibland. Autostart via register är det normala Windows-valet för att starta efter inloggning. Uppgiftsschemaläggaren är användbar när startordning eller förhöjd körning krävs. På Linux använder appen autostartmekanismen per användares skrivbord.
-
Kör med förhöjda rättigheter via Uppgiftsschemaläggaren bör vara avstängd såvida du inte måste diktera i administratörsprogram. Förhöjning är inte ett prestationsalternativ; det ändrar säkerhetsgränsen för global tangentbordsåtkomst.
-
Visa bekräftelsedialog för autostart är användbar när en ny automatstartinställning testas eller på en delad dator. Stäng av den endast när start är betrodd och ska ske utan tillsyn.
-
Visa startsida (splash screen) är hjälpsam när modell-/runtime-initialisering tar märkbar tid. Stäng av den för en tystare start i systemfältstil.
-
Klar-ljud bekräftar att uppstart och modellförberedelse är klar, särskilt när Voice2Win startar minimerat. Inaktivera det i tysta miljöer; justera varaktighet och volym endast så mycket att det är igenkännbart.
-
Minimera vid stängning (på som standard) håller globala kortkommandon tillgängliga efter att huvudfönstret stängts. Inaktivera det när stängknappen i fönstret istället ska avsluta applikationen.
-
Kontrollera uppdateringar automatiskt (på som standard) rekommenderas för fixar, modell-/körtidskompatibilitet och säkerhetsuppdateringar. Inaktivera det endast för medvetet hanterade eller offlineinstallationer och kontrollera manuellt istället.
-
Inaktivera veckodialog för information döljer den återkommande informationsnotisen efter att du inte längre behöver den; det inaktiverar inte funktionella eller felmeddelanden.
-
Status för Linux-indataautomation är diagnostisk information. X11-kompatibel indataautomation stöds; en ren Wayland-session kan begränsa globala kortkommandon och textinjektion. Om det inte är tillgängligt, använd en X11-session eller kompatibilitetsläget som erbjuds av skrivbordsmiljön.
-
Sökväg för transkriptionslagring: Välj en pålitlig lokal mapp. Använd en krypterad plats för känslig diktering och se till att säkerhetskopierings-/synkroniseringsprogramvara inte stör filer som fortfarande skrivs. En långsam eller intermittent tillgänglig nätverksenhet kan fördröja historikoperationer.
-
Ta bort gamla transkriptioner / maxålder: Aktivera automatisk radering när sekretesspolicy eller diskutrymme är viktigt. Välj en ålder som fortfarande täcker ditt realistiska korrigerings- och återtranskriptionsfönster. Sparade WAV-filer är normalt den största delen av historiken.
-
Sökväg för modellagring: Föredra en snabb lokal SSD med tillräckligt med ledigt utrymme. Flyttbara och nätverksenheter gör modellinläsning mindre pålitlig och kan förvandla en frånkopplad enhet till en till synes saknad modell.
-
Använd en anpassad datarot / flytta all applikationsdata: Användbart för bärbara installationer, kontrollerade säkerhetskopior eller för att hålla stora data borta från systemdriven. Välj en mapp med lämpliga behörigheter och ledigt utrymme, och starta sedan om när det begärs. Detta flyttar lokal data; det krypterar den inte eller laddar upp den automatiskt.
Transkribering i realtid är en förhandsvisning medan du fortfarande talar. Den normala slutliga transkriberingen förblir det auktoritativa resultatet. Låt realtidsläget vara avstängt när en förhandsvisning inte är användbar: det minimerar resursanvändning och undviker att preliminära ord ändras på skärmen.
- Block kör upprepade gånger huvudanvändningsmodellen Whisper för transkription över överlappande ljud. Välj detta när du vill att förhandsvisningen ska likna det slutliga Whisper-resultatet och har ett stöd för GPU med tillräckligt minne. Det ger mer kontext men genererar betydande upprepat arbete på GPU:n.
- Stream använder en separat Sherpa-ONNX strömningsmodell. Välj detta för tidig inkrementell återkoppling eller när blockläge inte är tillgängligt. Dess förhandsvisning kan vara mer grov och stöder endast de språk som listas i inställningarna; den slutliga normala transkriptionen kan fortfarande skilja sig.
- Maximum display height begränsar hur mycket av skärmen förhandsvisningen kan upptaga. Öka den för långformat åtkomstanvändning; minska den när indikatorn täcker målprogrammet. Det förändrar inte igenkänningskvaliteten.
Standardinställningarna är balanserade och beroende av varandra. Återställ dem innan felsökning och ändra bara en parameter åt gången.
-
Fönsterstorlek (standard 10 s): Öka den när meningskontexten är otillräcklig eller när långa fraser ändras mycket mellan snuttar. Större fönster tar längre tid och använder mer beräkningskraft/minne. Minska den för snabbare individuella uppdateringar på kapabel hårdvara och acceptera mindre kontext.
-
Hop-intervall (standard 3 s): Minska det för mer frekventa förhandsvisningsuppdateringar; öka det när GPU-belastningen är för hög. Ett mindre hop startar fler transkriberingar och gör varje körning inte snabbare.
-
Överlappning / kontext (standard 20 s): Öka det när ord vid blockgränser dupliceras, utelämnas eller slås ihop på ett dåligt sätt. Minska det för att sänka upprepat arbete. För liten överlappning tar bort bevis som behövs för att förena intilliggande snuttar.
-
Stabilitetsfördröjning (standard 6 s): Öka den när ord förs in för tidigt och senare sammanhang skulle ha rättat dem. Minska den när stabil text visas för långsamt, och acceptera fler korrigeringar.
-
Tystnadstidsgräns (standard 1000 ms): Minska den när texten bör stabiliseras snabbt efter ett uppehåll. Öka den när naturliga tvekan delar upp eller avslutar tankar för tidigt.
-
Ytterligare kontroll av meningsgränser (standard 2): Öka endast när övergångar mellan meningar upprepade gånger blir fel och GPU:n har ledig kapacitet. Varje extra förskjuten transkription tar tid. Sätt den till 0 för att inaktivera extra körningar; den centrala gränskontrollen kvarstår ändå.
-
Förskjutningsfaktor (standard 20%): Styr hur långt de extra verifieringsfönstren flyttas i förhållande till fönstrets storlek. Öka den när det hjälper att kontrollera ett bredare område runt en gräns; minska den när närliggande kontext räcker. Det spelar roll endast tillsammans med ytterligare kontroller.
- Körtid: CPU erbjuder den bredaste kompatibiliteten. DirectML kan minska latensen på stödda Windows-GPU:er men använder GPU-resurser som också kan behövas av huvudmodellen.
- Modellvariant: Välj Snabb för låg latens och lägre resursanvändning. Välj Noggrann när förhandsvisningskvaliteten är viktigare än hastigheten.
- Fönster för meningsförfining (1–8, standard 2): Värdet 1 ger snabbast avslutning av meningar. Större värden behåller mer meningskontext för förfining men fördröjer avslut och ökar arbetsbelastningen. Standardvärdet är en praktisk balans.
- Cachelagrade modeller: Att ta bort en oanvänd cachelagrad modell frigör diskutrymme. Om den språks-/körtids-/modellkombinationen väljs senare måste den laddas ner igen innan förhandsvisningen är klar.
Se Real-Time Transcription för hela arbetsflödet och krav på tillgänglighet.
- Whisper är det generella valet för bred språksupport och etablerade modellvarianter. Parakeet kan vara attraktivt när dess stödda språk och tillgänglig hårdvara matchar ditt användningsområde. Välj baserat på dina verkliga inspelningar; stjärnbetyg och hastighetsuppskattningar är vägledning, inte en ersättning för att testa din mikrofon, språk och vokabulär.
- Större eller högre kvalitetsmodeller behöver generellt mer minne och tid men kan förbättra svår ljudinspelning. Börja med den minsta modellen som är tillförlitligt noggrann. En modell som orsakar minnesbelastning eller långa köer kan vara mindre användbar än en något mindre modell som genomför processen konsekvent.
- Modellhanteraren laddar ner och tar bort lokala modelfiler. Ta inte bort en modell som fortfarande behövs av en vald motor eller ett offlinearbetsflöde.
-
Tilldela ljudtranskription och AI-förbättring oberoende av varandra. En GPU är vanligtvis bäst för upprepade lokala uppgifter; CPU är kompatibilitetsalternativet men kan vara mycket långsammare. Att dela upp de två uppgifterna över olika enheter kan undvika konflikter i GPU-minnet när båda används samtidigt.
-
För Ollama eller LM Studio, välj servertype, adress, port och laddad modell. Använd upptäckt endast på ett betrott nätverk och verifiera att den valda modellen faktiskt är tillgänglig på servern.
-
En fjärra AI-server eller en annan Voice2Win-dator kan flytta arbete från en svagare maskin, men medför nätverksfördröjning och skickar uppgiftens ljud eller text till det systemet. Använd endast betrodda värdar och nätverk.
-
Dela lokal runtime endast när en annan betrodd Voice2Win-installation behöver det. Använd ett lösenord, tillåt porten genom brandväggen endast på den avsedda nätverksprofilen, och inaktivera delning när det inte längre behövs. Varningsmeddelanden för anslutna klienter och versioner hjälper till att identifiera oväntade eller inkompatibla klienter.
-
Contextsstorlek (standard 4096): Öka den för lång markerad text, långa instruktioner eller transformationer som behöver mer omgivande kontext. Större kontext kräver mer minne och kan vara långsammare. Det förbättrar inte automatiskt korta korrigeringar.
-
Maximalt antal tokens (standard 512): Öka det när långa omskrivningar avbryts. Minska det för att begränsa svarstiden och förhindra oväntat långa svar. Vanlig dikteringskorrigering behöver sällan ett mycket stort värde.
-
Temperatur (standard 0,2): Låga värden är mer repetitiva och är bäst för korrigering, formatering och att bevara betydelsen. Höj det endast för avsiktligt kreativ omskrivning; högre värden kan ändra formuleringar eller fakta mer fritt.
-
Minsta transkriptionslängd för AI-förbättring (standard 20 tecken): Sänk den när även mycket korta fraser bör bearbetas. Höj den för att undvika modellstart/fördröjning och överraskande omskrivningar för små inmatningar som “ja” eller ett namn.
-
Systemprompt: Detta är den stående instruktionen för standard AI-förbättring. Ange önskat språk, om betydelse och ton måste bevaras, och att endast sluttexten ska returneras. Testa promptförändringar på icke-kritisk text: en alltför bred prompt kan besvara dikteringen, översätta den eller lägga till förklaringar istället för att korrigera den.
-
Alternativ lagring av AI-modell: Använd en snabb lokal disk med tillräckligt utrymme. Kopiering av befintliga modeller förhindrar en ny nedladdning; att byta mapp ensam gör inte en saknad eller inkompatibel modell användbar.
Se AI-modeller och hårdvara och AI-förbättring.
-
Kvalitet på talarigenkänningsmodell: Föredra högkvalitetsmodellen när det är viktigt att skilja på liknande röster och maskinen har tillräckligt med minne/prestanda. Använd en lättare modell för långa sessioner på begränsad hårdvara. Nedladdade modeller blir valbara omedelbart.
-
Känslighet för talarseparation: Börja med Standard. Öka den när två olika men liknande röster upprepade gånger slås ihop; kompromissen är att en persons förändrade röst, avstånd eller mikrofonvinkel kan delas upp i extra talare. Minska den när en person upprepade gånger visas som flera talare; kompromissen är att verkligen liknande röster kan slås ihop.
-
Taligenkänningens känslighet: Öka den när klick, rumsbrus eller tysta block transkriberas. Minska den när tysta talare utelämnas. Denna grind avgör om ett block skickas för transkribering; ett aggressivt avvisat block kan inte återställas av en mer exakt transkriptionsmodell.
-
Avslutningspaus (standard 10 s, på sidan för konversationsinspelning): Använd en kortare paus när sektioner bör avslutas snabbt efter att talare slutar. Använd en längre paus för eftertänksamma diskussioner med långa tvekan; resultaten visas senare, men ett bidrag är mindre sannolikt att delas upp.
-
Förväntade talare (Automatiskt som standard, på sidan för Konversationsinspelning): Behåll Automatiskt när deltagare kan gå med eller lämna. Ange det kända antalet för ett fast möte när automatisk klustring ger fel nummer. Ett felaktigt fast antal kan tvinga ihop orelaterade röster eller dela en röst för att uppfylla det begärda antalet.
Talardelning är probabilistisk. Avstånd till mikrofon, överlappning, eko och förändrande bakgrundsljud spelar roll; manuell korrigering av talare kan fortfarande vara nödvändig. Se Konversationsinspelning.
Denna sektion endast för utvecklare konfigurerar den separata skrivbordskompanjonklienten som strömmar en mikrofon från en annan dator på samma lokala nätverk.
-
Aktivera tjänsten endast när klientmikrofoner behövs. Välj nätverkskortet som är nåbart från klienten; VPN och virtuella adaptrar ger ofta en parningsadress som den andra datorn inte kan nå.
-
Behåll standardporten om den inte störs av en annan tjänst. Om klienten inte kan ansluta, kontrollera det valda nätverkskortet, den lokala brandväggen och om båda systemen finns på samma betrodda nätverk innan du ändrar slumpmässiga portar.
-
Behandla parnings-URL:en/token som en hemlighet. Alla som kan nå tjänsten och har en giltig token kan försöka ansluta. Generera om eller distribuera URL:en på nytt efter att du ändrat adapter, adress, port eller token.
-
Status för ansluten klient visar vilka klienter som är tillgängliga och deras kapabiliteter. Ljud strömmas från den klient som valts som inspelningsenhet; att bara ansluta en klient gör inte att alla anslutna mikrofoner spelar in samtidigt.
-
Det finns ingen molnrelay. Detta förbättrar integriteten, men innebär att rutter, brandvägg, viloläge och Wi-Fi-kvalitet direkt påverkar tillgänglighet och fördröjning.
Se Companion Client.
- Reproducera problemet i en målanvändning med AI-förbättring och förhandsgranskning i realtid avstängd.
- För felaktiga ord, åtgärda mikrofonnivå/brus, välj ett fast språk och testa en annan transkriptionsmodell innan du ändrar inställningarna för textinfogning.
- För korrekt text som infogas felaktigt, ändra först infogningsmetoden, sedan klistra in-genvägen och öka sedan endast relevant fördröjning.
- För bortfallen tyst tal, sänk taligenkänningens känslighet något; för brus som tolkas som tal, höj den något.
- Vid hög belastning, inaktivera realtidsläge eller öka dess hoppintervall innan du sänker den slutliga transkriptionskvaliteten.
- Återställ standardinställningarna i den berörda sektionen om flera ändringar har gjort resultatet svårt att tolka.
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động