-
Notifications
You must be signed in to change notification settings - Fork 0
Hindi Settings Reference
गियर बटन के साथ सेटिंग्स खोलें। ओके परिवर्तनों को सहेजता है; रद्द करें उन्हें खारिज कर देता है। जो परिवर्तन मॉडल, रनटाइम, स्टोरेज स्थान, या नेटवर्क सेवाओं को प्रभावित करते हैं उन्हें लागू होने में कुछ समय लग सकता है और एक घटक को पुनः लोड करना पड़ सकता है।
यह संदर्भ केवल नियंत्रणों की सूची के रूप में नहीं, बल्कि ट्यूनिंग गाइड के रूप में बनाया गया है। अधिकांश स्थानीय Windows इंस्टॉलेशनों के लिए डिफ़ॉल्ट सेटिंग्स एक अच्छा प्रारंभिक बिंदु हैं। एक बार में केवल एक संबंधित सेटिंग बदलें, इसे उस एप्लिकेशन में परीक्षण करें जहां आप वास्तव में बोलते हैं, और पिछले मान को तब तक रखें जब तक परिणाम स्पष्ट रूप से बेहतर न हो।
| लक्ष्य | अनुशंसित प्रारंभिक बिंदु |
|---|---|
| सामान्य डेस्कटॉप अनुप्रयोगों में विश्वसनीय दैनिक डिक्टेशन | निर्धारित ट्रांसक्रिप्शन भाषा, क्लिपबोर्ड सम्मिलन, क्लिपबोर्ड पुनर्स्थापन सक्षम, डिफ़ॉल्ट विलंब, ऑडियो सामान्यीकरण सक्षम |
| टर्मिनल या रिमोट डेस्कटॉप में डिक्टेशन | यदि क्लिपबोर्ड फ़ॉरवर्डिंग उपलब्ध नहीं है, तो पहले यूनिकोड आज़माएँ। अन्यथा क्लिपबोर्ड रखें और रिमोट लक्ष्य द्वारा स्वीकार किए गए पेस्ट शॉर्टकट का चयन करें। उन अनुप्रयोगों के लिए जो केवल भौतिक-कुंजी-जैसे इनपुट पर विश्वसनीय रूप से प्रतिक्रिया देते हैं, स्कैन कोड का उपयोग करें। |
| लंबे दस्तावेज़ | निर्धारित भाषा, बोले गए विराम चिह्न, जुड़ी हुई स्वरूपण, लैच या हाइब्रिड हॉटकी मोड, सहेजे गए WAV रिकॉर्डिंग |
| छोटे खोज फ़ील्ड, चैट और कमांड | अंतिम अवधि हटाएँ; वैकल्पिक रूप से पहले अक्षर को छोटे अक्षर में प्रारूपित करें; हॉटकी मोड को दबाए रखने से रिकॉर्डिंग गलती से सक्रिय रहने से बचता है |
| शांत या गोपनीयता-संवेदनशील उपयोग | सहेजे गए WAV रिकॉर्डिंग को अक्षम करें, ट्रांसक्रिप्शन रिटेंशन की समीक्षा करें, यदि क्लिपबोर्ड मॉनिटरिंग ऐपlications चिंता का विषय हैं तो क्लिपबोर्ड इन्सर्शन अक्षम करें, और रिमोट रनटाइम से बचें | | सबसे कम अनुभव की गई विलंबता | जब तक उपयोगी न हो, रियल-टाइम पूर्वावलोकन को अक्षम करें, तेज़ स्थानीय ट्रांसक्रिप्शन मॉडल/रनटाइम का उपयोग करें, इन्सर्शन विलंब को कम रखें, और इन्सर्शन से पहले AI आउटपुट एकत्र न करें |
- ट्रांसक्रिप्शन भाषा: वह भाषा चुनें जिसे आप सबसे अधिक बोलते हैं। एक निश्चित भाषा आमतौर पर स्वचालित की तुलना में तेजी से शुरू होती है और अधिक भरोसेमंद होती है, खासकर छोटे डिक्टेशन, नामों और समान ध्वनि वाले शब्दों के लिए। केवल तब स्वचालित पहचान का उपयोग करें जब आप वास्तव में रिकॉर्डिंग के बीच भाषाएँ बदलते हैं; छोटे वाक्यांश में भाषा पहचान के लिए कम साक्ष्य होते हैं और यह गलत चयन कर सकती है।
- कस्टम विशेषज्ञ शब्द और नाम: असामान्य नाम, उत्पाद शब्द, संक्षिप्त रूप, और वह वर्तनी जोड़ें जिसे आप चाहते हैं कि व्हिस्पर प्राथमिकता दे। सूची को केंद्रित रखें: यह पहचान को मार्गदर्शन देती है लेकिन यह खोज-बदल का गारंटीकृत नियम नहीं है, और सामान्य शब्दों की बड़ी सूची अवांछित पक्षपात को उत्पन्न कर सकती है। यह मार्गदर्शन व्हिस्पर के लिए है; कोई अन्य ट्रांसक्रिप्शन इंजन इसे इसी तरह उपयोग नहीं कर सकता।
सबसे अच्छा इनसर्शन तरीका लक्ष्य एप्लिकेशन पर निर्भर करता है। इसे केवल एक सरल संपादक में नहीं, बल्कि अपने सबसे कठिन प्रोग्राम में परीक्षण करें।
-
क्लिपबोर्ड: Windows पर सबसे आम विकल्प और लंबे टेक्स्ट, विशेष वर्णों और जटिल यूनिकोड के लिए आमतौर पर सबसे तेज़। Voice2Win अस्थायी रूप से क्लिपबोर्ड को बदल देता है, एक पेस्ट कमांड भेजता है, और पिछली सामग्री को पुनर्स्थापित कर सकता है। क्लिपबोर्ड प्रबंधक या अन्य एप्लिकेशन अस्थायी टेक्स्ट का निरीक्षण कर सकते हैं, और रिमोट सत्र में क्लिपबोर्ड फॉरवर्डिंग अक्षम हो सकती है।
-
यूनिकोड: लेआउट-स्वतंत्र और रिमोट सत्रों, गैर-Windows सिस्टम, और टेक्स्ट जिसमें वर्तमान कीबोर्ड लेआउट पर मौजूद नहीं होने वाले वर्ण शामिल हों, के लिए एक अच्छा पहला विकल्प। कुछ गेम, टर्मिनल, पुराने एप्लिकेशन और उच्च मानक वाले विंडोज़ सिम्युलेटेड यूनिकोड को विश्वसनीय रूप से स्वीकार नहीं करते।
-
स्कैन कोड: यह भौतिक कीबोर्ड इनपुट की तरह सबसे अधिक कार्य करता है और पुराने या असामान्य लक्ष्य एप्लिकेशन के लिए मददगार हो सकता है। यह सक्रिय कीबोर्ड लेआउट पर निर्भर करता है; उस लेआउट पर जिसका कोई मिलान कुंजी नहीं है, वह पात्र गायब या गलत हो सकता है। लंबे टेक्स्ट के लिए यह आम तौर पर एकल क्लिपबोर्ड पेस्ट से धीमा होता है।
-
कीबोर्ड सिमुलेशन विलंब (0–50 मिलीसेकंड): इसे तब तक कम ही रहने दें जब तक कि यूनिकोड या स्कैन कोड सम्मिलन पात्रों को खो न दे या क्रम बदल न दे। धीमे एप्लिकेशन, वर्चुअल मशीन या रिमोट डेस्कटॉप के लिए इसे छोटे कदमों में बढ़ाएँ। यह सेटिंग केवल सिम्युलेटेड कीस्ट्रोक्स को धीमा करती है; यह स्पीच रिकग्निशन को सुधारती नहीं है।
-
समस्या वाले लक्ष्य अनुप्रयोगों के लिए क्लिपबोर्ड का उपयोग करें: यूनिकोड या स्कैन कोड का उपयोग करने पर इसे सक्षम रखें जब तक कि क्लिपबोर्ड का उपयोग निषिद्ध न हो। Voice2Win तब उन ज्ञात अनुप्रयोगों के लिए वापस जा सकता है जो अनुकरण इनपुट को अच्छी तरह से स्वीकार नहीं करते हैं। इसे केवल तभी अक्षम करें जब क्लिपबोर्ड गोपनीयता या क्लिपबोर्ड फॉरवर्डिंग कारण हों जिससे आपने जानबूझकर कीबोर्ड अनुकरण चुना हो।
-
सन्निवेश से पहले प्रतीक्षाकाल (0–2000 मिलीसेकंड, डिफ़ॉल्ट 40 मिलीसेकंड): नई क्लिपबोर्ड मान उपलब्ध होने से पहले पेस्ट शॉर्टकट भेजे जाने का समय। इसे तब बढ़ाएँ जब लक्षित कभी-कभी पिछले क्लिपबोर्ड मान या कोई मान बिल्कुल भी पेस्ट न करे, खासकर रिमोट क्लिपबोर्ड सिंक्रनाइजेशन के माध्यम से। एक बड़ा मान हर सन्निवेश पर वही विलंब जोड़ता है।
-
पेस्ट कुंजी संयोजन: सामान्य Windows अनुप्रयोगों के लिए Ctrl+V का उपयोग करें। जब टर्मिनल, रिमोट डेस्कटॉप, या AI टूल Ctrl+V को साधारण-पाठ पेस्ट के रूप में न समझे, तब Ctrl+Shift+V या Shift+Insert आज़माएँ। अंतिम लक्ष्य द्वारा अपेक्षित शॉर्टकट चुनें, जरूरी नहीं कि स्थानीय रिमोट-डेस्कटॉप विंडो द्वारा ही हो।
-
एआई संवर्धन के दौरान टेक्स्ट एकत्रित करें और इसे एक ही चरण में डालें: इसे सक्षम करें जब प्रगतिशील एआई आउटपुट कर्सर को स्थानांतरित करता है, फ़ॉर्मेटिंग या ऑटोकम्प्लीट को ट्रिगर करता है, या कई अनडू स्टेप बनाता है। इसे अक्षम करें जब परिणाम को यथाशीघ्र देखना अधिक महत्वपूर्ण हो; संग्रह तब तक प्रतीक्षा करता है जब तक एआई परिणाम पूरा नहीं हो जाता और कुछ भी डाला नहीं जाता।
-
पिछले क्लिपबोर्ड को पुनर्स्थापित करें: सामान्य काम के लिए इसे सक्षम रखें ताकि Voice2Win आपके डिक्टेशन से पहले कॉपी किए गए डेटा को न नष्ट करे। इसे केवल तभी अक्षम करें जब आप जानबूझकर चाहते हों कि डिक्टेशन का परिणाम क्लिपबोर्ड पर रहे या कोई विशिष्ट लक्ष्य पेस्ट शॉर्टकट लौटने के बाद क्लिपबोर्ड पढ़ता है।
-
पुन्हःस्थापना से पहले प्रतीक्षा समय (0–2000 मिलीसेकंड, डिफ़ॉल्ट 120 मिलीसेकंड): इसे बढ़ाएँ जब लक्ष्य कुछ भी नहीं डालता है या केवल पाठ का एक हिस्सा डालता है क्योंकि पिछला क्लिपबोर्ड मान बहुत जल्दी पुनःस्थापित हो जाता है। इसे केवल आवश्यकतानुसार ही उच्च रखें: इस अवधि के दौरान, निर्देशित पाठ क्लिपबोर्ड-संवेदनशील अनुप्रयोगों के लिए उपलब्ध रहता है।
ये विकल्प पाठ को डालने से पहले संशोधित करते हैं। ये सबसे अधिक तब उपयोगी होते हैं जब आपकी डिक्टेशन में एक सुसंगत पैटर्न का पालन होता है।
-
बोली जाने वाली विराम चिह्न: इसे लंबे निबंध के लिए सक्षम करें जब आप 'कॉमा', 'प्रश्न चिन्ह', या उनके भाषा-विशिष्ट समतुल्य को विराम चिह्न में बदलना चाहते हैं। इसे बंद रखें जब ये शब्द वास्तविक सामग्री हो सकते हैं, या जब आप ट्रांसक्रिप्शन मॉडल के स्वचालित विराम चिह्न को पसंद करते हैं।
-
अंतिम पूर्णविराम हटाएँ: खोज फील्ड, चैट संदेश, फॉर्म फील्ड, फ़ाइल नाम, और वॉइस कमांड के लिए उपयोगी है जहाँ स्वचालित रूप से जोड़ा गया अंतिम पूर्णविराम अनचाहा हो। दस्तावेज़ों और ईमेल में पूरे वाक्यों के लिए इसे बंद रखें।
-
पहले अक्षर को छोटा करें: यह तब उपयोगी है जब डिक्टेशन सामान्यतः किसी मौजूदा वाक्य के बीच में डाला जाता है। नए वाक्यों, शीर्षकों, नामों, और स्वतंत्र संदेशों के लिए इसे बंद रखें।
-
एक ही एप्लिकेशन में लगातार डिक्टेशन को कनेक्ट करें: इसे तब सक्षम करें जब आप कई रिकॉर्डिंग्स से एक पैराग्राफ बनाते हैं; Voice2Win इनके बीच रिक्ति और वाक्य संदर्भ बनाए रख सकता है। इसे तब अक्षम करें जब लगातार रिकॉर्डिंग्स आमतौर पर अलग-अलग फील्ड में जाती हैं, या जब आप अक्सर डिक्टेशन के बीच कॅरेट को मैन्युअली स्थानांतरित करते हैं।
-
स्पीच डिटेक्शन सेंसिटिविटी (0–100, डिफ़ॉल्ट 35%): कम मान शांत बोलने को स्वीकार करते हैं लेकिन सांस लेने, क्लिक या पृष्ठभूमि शोर को भी भाषण मान सकते हैं। उच्च मान शोर को अधिक प्रभावी ढंग से फ़िल्टर करते हैं लेकिन नरम आवाज़ या शब्दों के अंत को अस्वीकार कर सकते हैं। डिफ़ॉल्ट से शुरू करें और छोटे-छोटे कदमों में बदलें, इनपुट स्तर को देखते हुए; माइक्रोफोन को करीब लाना अक्सर चरम मान का उपयोग करने से बेहतर होता है।
-
रिकॉर्डिंग की शुरुआत साफ़ करें (0–500 ms, डिफ़ॉल्ट 250 ms): हॉटकी क्लिक, हैंडलिंग शोर, और शुरुआत में लीडिंग साइलेंस को दबाता है। अगर रिकॉर्डिंग के पहले भाग में की क्लिक दिखाई दे, तो इसे बढ़ाएँ; अगर पहला स्वर काट जाता है या आप हॉटकी दबाने के तुरंत बाद बहुत छोटे शब्द डिक्टेट करते हैं तो इसे कम करें।
-
रिकॉर्डिंग को सामान्य करें (डिफ़ॉल्ट चालू, लक्ष्य 85%): साधारण माइक्रोफोन और बोलने की दूरी बदलने के लिए अनुशंसित क्योंकि यह मॉडल को एक अधिक सुसंगत स्तर प्रस्तुत करता है। पहले से ही सामान्यीकृत स्टूडियो/वर्चुअल इनपुट के लिए इसे अक्षम करें, या जब सामान्यीकरण स्पष्ट रूप से सतत पृष्ठभूमि शोर बढ़ा देता है। लक्ष्य माइक्रोफोन गेन नियंत्रण नहीं है और यह कट गई ऑडियो को पुनः प्राप्त नहीं कर सकता।
-
WAV रिकॉर्डिंग सहेजें (डिफ़ॉल्ट चालू): इसे चालू रखें जब आप प्लेबैक, पुनःट्रांसक्रिप्शन, गुणवत्ता की तुलना, या डायग्नोस्टिक साक्ष्य चाहते हों। जब संग्रहण उपयोग या गोपनीयता अधिक महत्वपूर्ण हो तो इसे अक्षम करें। ऑडियो आमतौर पर टेक्स्ट की तुलना में बहुत अधिक स्थान लेता है।
-
सहेजी गई WAV रिकॉर्डिंग हटाएँ: ट्रांसक्रिप्शन टेक्स्ट को रखते हुए संग्रहित ऑडियो को हटा देता है। इसका उपयोग तब करें जब आप यह सुनिश्चित कर लें कि आपको अब प्लेबैक या पुनःट्रांसक्रिप्शन की आवश्यकता नहीं है; हटाने से मूल ऑडियो को पुनः नहीं बनाया जा सकता।
- होल्ड: रिकॉर्डिंग केवल तब तक चलती है जब तक शॉर्टकट दबाया रहता है। छोटे, बार-बार होने वाले डिक्टेशन के लिए सबसे अच्छा और सबसे सुरक्षित मोड है, जब गलती से पृष्ठभूमि रिकॉर्डिंग से बचना आवश्यक हो।
- लैच: शुरू करने के लिए एक बार दबाएँ और रोकने के लिए फिर से दबाएँ। लंबे हिस्सों, एक्सेसिबिलिटी उपयोग, या हैंड्स-फ्री बोलने के लिए सबसे अच्छा, लेकिन इसके लिए जानबूझकर रोकने की कार्रवाई की आवश्यकता होती है।
- हाइब्रिड / डबल टैप: छोटी रिकॉर्डिंग के लिए होल्ड करें या लैच करने के लिए डबल-टैप करें। यह मिश्रित काम के लिए सबसे लचीला डिफ़ॉल्ट है। यदि कभी-कभी गलती से डबल टैप रिकॉर्डिंग को सक्रिय छोड़ देता है, तो इसके बजाय होल्ड का उपयोग करें।
-
स्पीच टू टेक्स्ट और वॉइस कमांड के लिए अलग शॉर्टकट असाइन करें। ऐसे संयोजनों को प्राथमिकता दें, जो पहले से ऑपरेटिंग सिस्टम, कीबोर्ड ड्राइवर, रिमोट डेस्कटॉप, या लक्ष्य एप्लिकेशन द्वारा हैंडल न किए गए हों। डुप्लिकेट Voice2Win शॉर्टकट अस्वीकार कर दिए जाते हैं।
-
विंडोज़ पर, Voice2Win आमतौर पर उच्च प्रिविलेज़ के साथ चल रहे एप्लिकेशन में इंजेक्ट नहीं कर सकता। केवल तब Voice2Win को एलीवेटेड रूप में चलाएं जब वास्तव में उच्च प्रिविलेज़ वाले एप्लिकेशन में डिक्टेशन की आवश्यकता हो; एलीवेटेड ग्लोबल इनपुट एक्सेस किसी भी एप्लिकेशन या कॉन्फ़िगरेशन त्रुटि का प्रभाव बढ़ा देता है।
-
जब हॉटकी दबाई जाए तो ग्लोबल ऑडियो आउटपुट म्यूट करें स्पीकर्स के साथ उपयोगी है क्योंकि सिस्टम ऑडियो को माइक्रोफोन में फीडबैक नहीं दिया जा सकता। हेडफ़ोन का उपयोग करते समय या रिकॉर्डिंग के दौरान मीटिंग या मीडिया स्रोत सुनने की आवश्यकता होने पर इसे अक्षम करें।
-
अलग स्टार्ट और स्टॉप सिग्नल लाइट इंडिकेटर दिखाई न देने पर लैच/हाइब्रिड स्टेट को स्पष्ट बनाते हैं। स्पीकर का उपयोग करते समय ध्वनियों को छोटा और शांत रखें ताकि माइक्रोफ़ोन उन्हें न पकड़ ले। पहुँच सुविधा के लिए अवधि या ध्वनि बढ़ाएँ, अनपेक्षित हॉटकी डिटेक्शन को हल करने के लिए नहीं।
- इंटरफ़ेस भाषा केवल मेनू और लेबल बदलती है; यह ट्रांसक्रिप्शन भाषा का चयन नहीं करती।
- डार्क थीम एक दृश्य पसंद है और यह पहचान या प्रदर्शन को प्रभावित नहीं करती।
- संकेतक शैली: एक साधारण स्तर डिस्प्ले सबसे कम विचलित करने वाला होता है; वेवफ़ॉर्म या बार से भाषण गतिविधि का मूल्यांकन करना आसान होता है; स्पेक्ट्रम-शैली प्रदर्शन अधिक विवरण दिखाते हैं लेकिन दृश्य रूप से व्यस्त होते हैं। वह शैली चुनें जो माइक्रोफ़ोन गतिविधि की पुष्टि करने में मदद करे बिना लक्षित एप्लिकेशन को ढकें।
- रंग योजना, स्थिति और आकार: उच्च विरोधाभासी योजना का उपयोग करें और टूलबार, शीर्षक और टेक्स्ट कॅरेट से दूर स्थिति चुनें। एक बड़ा संकेतक पहुंच और वास्तविक समय के पाठ के लिए मददगार होता है; एक छोटा संकेतक तब बेहतर होता है जब केवल रिकॉर्डिंग स्थिति महत्वपूर्ण हो।
-
ऑटॉस्टार्ट अक्षम सबसे अच्छा है जब Voice2Win का कभी-कभार उपयोग किया जाता है। रजिस्ट्री ऑटॉस्टार्ट सामान्य विंडोज़ विकल्प है साइन-इन के बाद शुरू करने के लिए। टास्क शेड्यूलर तब उपयोगी होता है जब स्टार्टअप क्रम या उच्च स्तरीय निष्पादन की आवश्यकता होती है। लिनक्स पर, ऐप per-user डेस्कटॉप ऑटॉस्टार्ट तंत्र का उपयोग करता है।
-
टास्क शेड्यूलर के साथ उच्च स्तरीय निष्पादन करें तब तक बंद रहना चाहिए जब तक कि आपको व्यवस्थापक एप्लिकेशन में डिक्टेट करना न हो। उच्च स्तरीय निष्पादन प्रदर्शन विकल्प नहीं है; यह वैश्विक कीबोर्ड पहुंच की सुरक्षा सीमा को बदलता है।
-
ऑटॉस्टार्ट पुष्टि डायलॉग दिखाएँ नए ऑटोमैटिक-स्टार्ट सेटअप को मान्य करते समय या साझा कंप्यूटर पर उपयोगी है। इसे केवल तब अक्षम करें जब स्टार्टअप विश्वसनीय हो और बिना निगरानी के चलना चाहिए।
-
स्प्लैश स्क्रीन दिखाएँ तब मदद करता है जब मॉडल/रनटाइम इनिशियलाइजेशन में महत्वपूर्ण समय लगता है। इसे एक शांत ट्रे-स्टाइल स्टार्टअप के लिए अक्षम करें।
-
रेडी साउंड यह पुष्टि करता है कि स्टार्टअप और मॉडल की तैयारी पूरी हो गई है, विशेष रूप से जब Voice2Win मिनिमाइज़्ड स्थिति में शुरू होता है। शांत वातावरण में इसे अक्षम करें; अवधि और वॉल्यूम केवल इतने ही समायोजित करें कि इसे पहचाना जा सके।
-
क्लोज़ पर मिनिमाइज़ करें (डिफ़ॉल्ट ऑन) मुख्य विंडो बंद करने के बाद भी ग्लोबल शॉर्टकट्स उपलब्ध रखते हैं। जब विंडो का बंद बटन एप्लिकेशन को बंद करना चाहिए, तो इसे अक्षम करें।
-
स्वचालित रूप से अपडेट की जांच करें (डिफ़ॉल्ट ऑन) फिक्स, मॉडल/रनटाइम संगतता और सुरक्षा अपडेट के लिए अनुशंसित है। इसे केवल जानबूझकर प्रबंधित या ऑफलाइन इंस्टॉलेशनों के लिए अक्षम करें और इसके बजाय मैन्युअल रूप से जांचें।
-
साप्ताहिक जानकारी संवाद अक्षम करें आवर्ती सूचना नोटिस को छुपाता है जब आपको इसकी आवश्यकता नहीं होती; यह कार्यात्मक या त्रुटि संदेशों को अक्षम नहीं करता।
-
लिनक्स इनपुट ऑटोमेशन स्थिति डायग्नोस्टिक जानकारी है। X11-संगत इनपुट ऑटोमेशन समर्थित है; एक शुद्ध वेइलैंड सत्र वैश्विक शॉर्टकट और टेक्स्ट इंजेक्शन को प्रतिबंधित कर सकता है। यदि उपलब्ध नहीं है, तो X11 सत्र या डेस्कटॉप वातावरण द्वारा दिया गया संगतता मोड उपयोग करें।
-
प्रतिलेखन संग्रह पथ: एक विश्वसनीय स्थानीय फ़ोल्डर चुनें। संवेदनशील डिक्टेशन के लिए एन्क्रिप्टेड स्थान का उपयोग करें और सुनिश्चित करें कि बैकअप/सिंकिंग सॉफ़्टवेयर उन फ़ाइलों के साथ संघर्ष न करे जो अभी लिखी जा रही हैं। एक धीमा या कभी-कभी उपलब्ध नेटवर्क ड्राइव इतिहास संचालन में देरी कर सकता है।
-
पुराने प्रतिलेखों को हटाएँ / अधिकतम आयु: गोपनीयता नीति या डिस्क उपयोग महत्वपूर्ण होने पर स्वचालित प्रतिधारण सक्षम करें। ऐसी आयु चुनें जो अभी भी आपके वास्तविक सुधार और पुन: प्रतिलेखन विंडो को कवर करे। सहेजे गए WAV फ़ाइलें सामान्यतः इतिहास का सबसे बड़ा हिस्सा होती हैं।
-
मॉडल संग्रह पथ: पर्याप्त खाली स्थान वाले तेज़ स्थानीय SSD को प्राथमिकता दें। हटाने योग्य और नेटवर्क ड्राइवों पर मॉडल लोडिंग कम विश्वसनीय हो सकती है और एक डिस्कनेक्टेड ड्राइव को प्रतीततः गायब मॉडल में बदल सकती है।
-
कस्टम डेटा रूट का उपयोग करें / सभी एप्लिकेशन डेटा स्थानांतरित करें: पोर्टेबल सेटअप, नियंत्रित बैकअप, या बड़ी डेटा को सिस्टम ड्राइव से दूर रखने के लिए उपयोगी। उपयुक्त अनुमति और खाली स्थान वाले फ़ोल्डर का चयन करें, फिर अनुरोध किए जाने पर पुनः आरंभ करें। यह स्थानीय डेटा को स्थानांतरित करता है; यह इसे एन्क्रिप्ट नहीं करता या स्वचालित रूप से अपलोड नहीं करता।
रियल-टाइम प्रतिलेखन एक पूर्वावलोकन है जब आप अभी बोल रहे हैं। सामान्य अंतिम प्रतिलेखन प्राधिकृत परिणाम रहता है। जब पूर्वावलोकन उपयोगी न हो, तो रियल-टाइम मोड को अक्षम छोड़ दें: इससे संसाधनों का उपयोग कम होता है और स्क्रीन पर प्रारंभिक शब्द बदलने से बचा जा सकता है।
- ब्लॉक मुख्य व्हिस्पर ट्रांस्क्रिप्शन मॉडल को बार-बार ओवरलैपिंग ऑडियो पर चलाता है। इसे तब चुनें जब आप चाहते हैं कि प्रीव्यू अंतिम व्हिस्पर परिणाम के समान हो और आपके पास समर्थित GPU पर्याप्त मेमोरी के साथ हो। यह अधिक संदर्भ प्रदान करता है लेकिन पर्याप्त बार GPU पर कार्य करता है।
- स्ट्रीम एक अलग शेरपा-ONNX स्ट्रीमिंग मॉडल का उपयोग करता है। इसे सबसे प्रारंभिक इनक्रिमेंटल फीडबैक के लिए चुनें या जब ब्लॉक मोड उपलब्ध न हो। इसका प्रीव्यू थोड़ी कठिन हो सकती है और यह केवल सेटिंग्स में सूचीबद्ध भाषाओं का समर्थन करता है; अंतिम सामान्य ट्रांस्क्रिप्शन अभी भी भिन्न हो सकता है।
- अधिकतम डिस्प्ले ऊँचाई यह सीमित करता है कि प्रीव्यू स्क्रीन का कितना हिस्सा घेर सकता है। लंबी अवधि की पहुँच के उपयोग के लिए इसे बढ़ाएं; जब संकेतक लक्ष्य एप्लिकेशन को ढकता है, तो इसे कम करें। यह पहचान की गुणवत्ता को नहीं बदलता।
डिफ़ॉल्ट सेटिंग्स संतुलित और आपसी निर्भर हैं। समस्या निवारण से पहले उन्हें पुनर्स्थापित करें और एक समय में केवल एक पैरामीटर बदलें।
-
विंडो साइज़ (डिफ़ॉल्ट 10 सेकंड): इसे तब बढ़ाएँ जब वाक्य संदर्भ अपर्याप्त हो या लंबे वाक्यांश स्नैपशॉट्स के बीच बहुत बदल जाएँ। बड़ी विंडोज़ को अधिक समय लगता है और अधिक कंप्यूट/मेमोरी की आवश्यकता होती है। सक्षम हार्डवेयर पर अधिक तेज़ व्यक्तिगत अपडेट के लिए इसे घटाएँ, कम संदर्भ स्वीकार करते हुए।
-
हॉप अंतराल (डिफ़ॉल्ट 3 सेकंड): अधिक बार पूर्वावलोकन अपडेट के लिए इसे घटाएँ; जब GPU लोड बहुत अधिक हो तो इसे बढ़ाएँ। छोटी हॉप अधिक ट्रांसक्रिप्शन रन शुरू करती है लेकिन प्रत्येक रन को तेज़ नहीं बनाती।
-
ओवरलैप / संदर्भ (डिफ़ॉल्ट 20 सेकंड): जब ब्लॉक सीमाओं पर शब्द दोहराए जाते हैं, छूट जाते हैं, या ठीक से मर्ज नहीं होते, तो इसे बढ़ाएँ। दोहराए गए काम को कम करने के लिए इसे घटाएँ। बहुत कम ओवरलैप आसन्न स्नैपशॉट्स का मिलान करने के लिए आवश्यक साक्ष्य हटा देता है।
-
स्थिरता देरी (डिफ़ॉल्ट 6 सेकंड): इसे तब बढ़ाएँ जब शब्द बहुत जल्दी कमिट हो रहे हों और बाद का संदर्भ उन्हें ठीक कर सकता हो। इसे तब कम करें जब स्थिर टेक्स्ट बहुत धीमे दिखाई दे, और अधिक संशोधनों को स्वीकार करें।
-
मौन समय सीमा (डिफ़ॉल्ट 1000 मिलीसेकंड): इसे तब कम करें जब टेक्स्ट को रोकने के बाद जल्दी स्थिर होना चाहिए। इसे तब बढ़ाएँ जब प्राकृतिक हिचकिचाहट विचारों को जल्दी विभाजित या अंतिम रूप देने लगी हो।
-
अतिरिक्त वाक्य-सीमा जांच (डिफ़ॉल्ट 2): इसे केवल तब बढ़ाएँ जब वाक्य संक्रमण बार-बार गलत हों और GPU का हेडरूम उपलब्ध हो। हर अतिरिक्त स्थानांतरित ट्रांसक्रिप्शन में समय लगता है। अतिरिक्त रन को निष्क्रिय करने के लिए इसे 0 पर सेट करें; केंद्रीय सीमा जांच फिर भी बनी रहती है।
-
शिफ्ट फैक्टर (डिफ़ॉल्ट 20%): यह नियंत्रित करता है कि अतिरिक्त सत्यापन विंडो विंडो आकार के सापेक्ष कितनी दूर जाएँ। जब किसी सीमा के आसपास एक व्यापक क्षेत्र की जाँच करना मदद करता है, तो इसे बढ़ाएँ; जब निकटवर्ती संदर्भ पर्याप्त हो, तो इसे कम करें। यह केवल अतिरिक्त जांच के साथ ही मायने रखता है।
- रनटाइम: CPU सबसे व्यापक संगतता प्रदान करता है। DirectML समर्थित Windows GPU पर विलंबता कम कर सकता है लेकिन GPU संसाधनों का उपयोग करता है जिन्हें मुख्य मॉडल के लिए भी आवश्यकता हो सकती है।
- मॉडल वेरिएंट: कम विलंबता और कम संसाधन उपयोग के लिए Fast चुनें। जब पूर्वावलोकन गुणवत्ता गति से अधिक महत्वपूर्ण हो, तो Accurate चुनें।
- वाक्य सुधार विंडो (1–8, डिफ़ॉल्ट 2): 1 का मूल्य सबसे तेज़ वाक्य स्थिरीकरण देता है। बड़े मूल्य अधिक वाक्य संदर्भ सुधार के लिए रखते हैं लेकिन स्थिर होने में देरी करते हैं और कार्य बढ़ाते हैं। डिफ़ॉल्ट एक व्यावहारिक संतुलन है।
- कैश्ड मॉडल: किसी अप्रयुक्त कैश्ड मॉडल को हटाने से डिस्क स्थान खाली होता है। अगर भविष्य में वह भाषा/रनटाइम/मॉडल संयोजन चुना जाता है, तो preview तैयार होने से पहले इसे फिर से डाउनलोड करना होगा।
पूर्ण वर्कफ़्लो और उपलब्धता आवश्यकताओं के लिए रीयल-टाइम ट्रांसक्रिप्शन देखें।
- व्हिस्पर व्यापक भाषा समर्थन और स्थापित मॉडल संस्करणों के लिए सामान्य विकल्प है। पैरीकीट तब आकर्षक हो सकता है जब इसके समर्थित भाषाएँ और उपलब्ध हार्डवेयर आपके उपयोग के मामले से मेल खाते हों। अपने वास्तविक रिकॉर्डिंग के आधार पर चयन करें; स्टार रेटिंग और गति अनुमान मार्गदर्शन हैं, परीक्षण के विकल्प नहीं। अपने माइक्रोफोन, भाषा और शब्दावली का परीक्षण करना जरूरी है।
- बड़े या उच्च गुणवत्ता वाले मॉडल सामान्यतः अधिक मेमोरी और समय की मांग करते हैं लेकिन कठिन ऑडियो में सुधार कर सकते हैं। सबसे छोटे मॉडल से शुरू करें जो विश्वसनीय रूप से पर्याप्त सटीक हो। ऐसा मॉडल जो मेमोरी दबाव या लंबी कतारें उत्पन्न करता है, उससे थोड़ा छोटा मॉडल जो लगातार पूरा हो जाए, अधिक उपयोगी हो सकता है।
- मॉडल प्रबंधक स्थानीय मॉडल फाइलों को डाउनलोड और हटा देता है। किसी भी मॉडल को हटा न दें जो अभी भी चुने हुए इंजन या ऑफ़लाइन वर्कफ़्लो के लिए आवश्यक है।
-
ऑडियो ट्रांसक्रिप्शन और एआई एन्हांसमेंट को स्वतंत्र रूप से असाइन करें। स्थानीय कार्यों को बार-बार करने के लिए आमतौर पर GPU सबसे अच्छा होता है; CPU संगतता के लिए बैकअप है लेकिन यह बहुत धीमा हो सकता है। दोनों कार्यों को अलग-अलग उपकरणों पर विभाजित करने से GPU-मेमोरी संघर्ष से बचा जा सकता है जब दोनों एक साथ उपयोग किए जाते हैं।
-
ओल्लामा या LM स्टूडियो के लिए, सर्वर प्रकार, पता, पोर्ट और लोडेड मॉडल चुनें। डिस्कवरी का उपयोग केवल विश्वसनीय नेटवर्क पर करें और यह सुनिश्चित करें कि चुना गया मॉडल वास्तव में सर्वर पर उपलब्ध है।
-
एक रिमोट एआई सर्वर या किसी अन्य Voice2Win कंप्यूटर से काम को कमजोर मशीन से दूर ले जाया जा सकता है, लेकिन इससे नेटवर्क विलंबता बढ़ती है और कार्य का ऑडियो या टेक्स्ट उस सिस्टम पर भेजा जाता है। केवल विश्वसनीय होस्ट और नेटवर्क का उपयोग करें।
-
स्थानीय रनटाइम साझा करें केवल तब जब किसी अन्य विश्वसनीय Voice2Win इंस्टॉलेशन को इसकी आवश्यकता हो। पासवर्ड का उपयोग करें, फ़ायरवॉल के माध्यम से पोर्ट केवल इच्छित नेटवर्क प्रोफ़ाइल पर अनुमति दें, और जब यह आवश्यक न हो तो साझा करना अक्षम कर दें। जुड़े हुए क्लाइंट और संस्करण चेतावनी अप्रत्याशित या असंगत क्लाइंट की पहचान करने में मदद करती हैं।
-
संदर्भ आकार (डिफ़ॉल्ट 4096): लंबे चयनित पाठ, लंबे निर्देश, या उन रूपांतरणों के लिए बढ़ाएँ जिन्हें अधिक आसपास के संदर्भ की आवश्यकता होती है। बड़ा संदर्भ अधिक मेमोरी खाता है और धीमा हो सकता है। यह छोटे सुधारों को स्वचालित रूप से बेहतर नहीं बनाता।
-
अधिकतम टोकन (डिफ़ॉल्ट 512): इसे तब बढ़ाएँ जब लंबे पुनर्लेखन कट जाते हैं। प्रतिक्रिया समय को सीमित करने और अप्रत्याशित रूप से लंबे आउटपुट को रोकने के लिए इसे कम करें। सामान्य डिक्टेशन सुधार के लिए आम तौर पर बहुत बड़ी संख्या की आवश्यकता नहीं होती।
-
तापमान (डिफ़ॉल्ट 0.2): कम मान अधिक दोहराने योग्य होते हैं और सुधार, स्वरूपण और अर्थ बनाए रखने के लिए सबसे अच्छे हैं। केवल जानबूझकर रचनात्मक पुनर्लेखन के लिए इसे बढ़ाएँ; उच्च मान शब्दों या तथ्यों को अधिक स्वतंत्र रूप से बदल सकते हैं।
-
एआई संवर्धन के लिए न्यूनतम ट्रांसक्रिप्शन लंबाई (डिफ़ॉल्ट 20 वर्ण): इसे तब कम करें जब बहुत ही छोटे वाक्यांशों को भी प्रोसेस करना आवश्यक हो। इसे बढ़ाकर मॉडल स्टार्टअप/विलंब और 'हां' या किसी नाम जैसे छोटे इनपुट के लिए असाधारण पुनर्लेखन से बचा जा सकता है।
-
सिस्टम प्रॉम्प्ट: यह डिफ़ॉल्ट एआई संवर्धन के लिए स्थायी निर्देश है। वांछित भाषा बताएं, अर्थ और स्वर की सुरक्षा करनी है या नहीं, और केवल अंतिम पाठ ही लौटाना है। गैर-महत्वपूर्ण पाठ पर प्रॉम्प्ट परिवर्तन का परीक्षण करें: बहुत व्यापक प्रॉम्प्ट डिक्टेशन का उत्तर देने, उसका अनुवाद करने, या सुधार करने के बजाय स्पष्टीकरण जोड़ सकता है।
-
वैकल्पिक एआई मॉडल स्टोरेज: पर्याप्त स्थान वाले तेज़ स्थानीय ड्राइव का उपयोग करें। मौजूदा मॉडलों की प्रतिलिपि करने से दूसरी डाउनलोडिंग से बचा जा सकता है; केवल फ़ोल्डर बदलने से अनुपलब्ध या असंगत मॉडल का उपयोग संभव नहीं होता।
देखें एआई मॉडल और हार्डवेयर और एआई संवर्धन।
-
स्पीकर-मान्यता मॉडल गुणवत्ता: जब समान आवाज़ों को अलग करना महत्वपूर्ण हो और मशीन के पास पर्याप्त मेमोरी/प्रदर्शन हो, तो उच्च गुणवत्ता वाला मॉडल चुनें। सीमित हार्डवेयर पर लंबी सत्रों के लिए हल्का मॉडल उपयोग करें। डाउनलोड किए गए मॉडल तुरंत चयन योग्य हो जाते हैं।
-
स्पीकर पृथक्करण संवेदनशीलता: डिफ़ॉल्ट से शुरू करें। इसे तब बढ़ाएँ जब दो अलग लेकिन समान आवाज़ें बार-बार मर्ज हो जाएँ; इसके विपरीत, किसी व्यक्ति की बदलती आवाज़, दूरी, या माइक्रोफोन कोण अतिरिक्त स्पीकर में विभाजित हो सकता है। इसे तब कम करें जब एक व्यक्ति बार-बार कई स्पीकर के रूप में दिखे; इसके विपरीत, वास्तव में समान आवाज़ों को मर्ज किया जा सकता है।
-
भाषण पहचान संवेदनशीलता: इसे तब बढ़ाएं जब क्लिक, कमरे की आवाज़, या मौन ब्लॉकों का प्रतिलेखन हो। इसे तब कम करें जब शांत वक्ताओं को अनदेखा किया जाता है। यह गेट तय करता है कि कोई ब्लॉक प्रतिलेखन के लिए भेजा जाए या नहीं; किसी ब्लॉक को आक्रामक रूप से अस्वीकार करने के बाद इसे अधिक सटीक प्रतिलेखन मॉडल से पुनर्प्राप्त नहीं किया जा सकता।
-
अंतिमकरण विराम (डिफ़ॉल्ट 10 सेकंड, वार्ता रिकॉर्डिंग पेज पर): जब वक्ताओं के रुकते ही अनुभाग तुरंत बंद होना चाहिए, तो छोटा विराम उपयोग करें। लंबी सोच और लंबी हिचकिचाहट वाले विचारशील चर्चाओं के लिए लंबा विराम उपयोग करें; परिणाम बाद में दिखाई देगा, लेकिन एक योगदान कम संभावना है कि वह विभाजित हो।
-
अपेक्षित वक्ता (Conversation Recording पृष्ठ पर डिफ़ॉल्ट रूप से Automatic): जब प्रतिभागी जुड़ सकते हैं या छोड़ सकते हैं, तो Automatic रखें। जब ऑटोमैटिक क्लस्टरिंग गलत संख्या दिखाए तब एक निश्चित बैठक के लिए ज्ञात संख्या सेट करें। गलत निश्चित संख्या अप्रासंगिक आवाज़ों को एक साथ जोड़ सकती है या एक आवाज़ को विभाजित कर सकती है ताकि अनुरोधित संख्या पूरी हो सके।
वक्ता अलगाव संभाव्य है। माइक्रोफ़ोन की दूरी, ओवरलैप, इको, और बदलता हुआ पृष्ठभूमि शोर महत्वपूर्ण हैं; मैनुअल वक्ता सुधार फिर भी आवश्यक हो सकता है। देखें Conversation Recording।
यह केवल डेवलपर के लिए अनुभाग अलग डेस्कटॉप कंपेनियन क्लाइंट को कॉन्फ़िगर करता है जो उसी लोकल नेटवर्क पर किसी अन्य कंप्यूटर से माइक्रोफ़ोन को स्ट्रीम करता है।
-
सेवा को केवल तभी सक्षम करें जब क्लाइंट माइक्रोफ़ोन की आवश्यकता हो। उस नेटवर्क एडॉप्टर को चुनें जिसे क्लाइंट से पहुँचा जा सके; VPN और वर्चुअल एडॉप्टर अक्सर एक ऐसा पेयरिंग पता उत्पन्न करते हैं जिसे दूसरा कंप्यूटर नहीं पहुँच सकता।
-
डिफ़ॉल्ट पोर्ट रखें जब तक कि यह किसी अन्य सेवा से टकरा न जाए। यदि क्लाइंट कनेक्ट नहीं कर सकता है, तो रैंडम पोर्ट बदलने से पहले चुने हुए एडॉप्टर, स्थानीय फ़ायरवॉल, और दोनों सिस्टम समान विश्वसनीय नेटवर्क पर हैं या नहीं, इसकी जाँच करें।
-
पेयरिंग URL/टोकन को एक गुप्त के रूप में मानें। जो कोई भी सेवा तक पहुँच सकता है और उसके पास वैध टोकन है, वह कनेक्ट करने का प्रयास कर सकता है। एडॉप्टर, पता, पोर्ट, या टोकन बदलने के बाद URL को फिर से उत्पन्न करें या पुनः वितरित करें।
-
कनेक्टेड-क्लाइंट स्थिति दिखाती है कि कौन से क्लाइंट उपलब्ध हैं और उनकी क्षमताएं क्या हैं। ऑडियो उस क्लाइंट से स्ट्रीम किया जाता है जिसे रिकॉर्डिंग डिवाइस के रूप में चुना गया है; केवल किसी क्लाइंट को कनेक्ट करना हर जुड़े माइक्रोफोन को एक साथ रिकॉर्ड करने के लिए सक्षम नहीं बनाता है।
-
कोई क्लाउड रिले नहीं है। यह गोपनीयता में सुधार करता है लेकिन इसका मतलब है कि रूटिंग, फ़ायरवॉल, स्लीप मोड, और वाई-फ़ाई की गुणवत्ता सीधे उपलब्धता और लेटेंसी को प्रभावित करती है।
Companion Client देखें।
- एक लक्ष्य एप्लिकेशन में समस्या को दोहराएँ जहाँ AI संवर्द्धन और रीयल-टाइम पूर्वावलोकन अक्षम हों।
- गलत शब्दों के लिए, माइक्रोफोन स्तर/शोर को ठीक करें, एक निश्चित भाषा चुनें, और टेक्स्ट-इन्सर्शन सेटिंग्स बदलने से पहले किसी अन्य ट्रांसक्रिप्शन मॉडल का परीक्षण करें।
- सही टेक्स्ट जो गलत तरीके से डाला गया है, उसके लिए पहले इन्सर्शन विधि बदलें, फिर पेस्ट शॉर्टकट बदलें, और केवल संबंधित विलंब बढ़ाएँ।
- खोई हुई धीमी बोल-ने के लिए, स्पीच-डिटेक्शन संवेदनशीलता को थोड़ा कम करें; शोर को भाषण समझे जाने पर, इसे थोड़ा बढ़ाएँ।
- उच्च लोड के लिए, रीयल-टाइम मोड अक्षम करें या अंतिम ट्रांसक्रिप्शन गुणवत्ता को कम करने से पहले इसका हॉप इंटरवल बढ़ाएँ।
- प्रभावित अनुभाग में डिफ़ॉल्ट पुनर्स्थापित करें यदि कई बदलावों ने परिणाम को समझने में कठिन बना दिया हो।
Languages
English
Deutsch
Español
Français
Português (Brasil)
Italiano
Nederlands
Polski
Svenska
简体中文
日本語
한국어
हिन्दी
繁體中文
Bahasa Indonesia
Tiếng Việt
- Chuyển Giọng Nói Thành Văn Bản
- Chuyển Văn Bản Thời Gian Thực
- Tăng cường AI
- Lệnh Giọng Nói
- Ghi âm Cuộc trò chuyện
- Điều Khiển Từ Xa Thiết Bị Di Động