मुख्य सामग्री पर जाएं

ट्रांसक्राइबर को अपने नाम और तकनीकी शब्द सिखाएँ

लेखक: प्रकाशित: अंतिम समीक्षा:

एक सामान्य-उद्देश्य भाषण इंजन में उत्पाद कोडनाम, एक क्षेत्रीय उपनाम, या एक आंतरिक संक्षिप्त नाम के लिए कम संदर्भ होता है जिसे आपकी टीम दस बार उपयोग करती है एक बैठक. अनुसंधान अपेक्षित शब्दों प्रासंगिक पूर्वाग्रह की ओर पहचान को आगे बढ़ाने की तकनीक कहता है, और 2025 W3C वेब स्पीच सत्र ने इसे क्रोम में क्षमता शिपिंग के रूप में वर्णित किया है। Hushscript उस विचार को चार शब्दावली नियंत्रणों में बदल देता है, जिसमें एक फ़ाइल के लिए एक बार जोड़ने से लेकर एक स्थायी सेटअप तक शामिल है जिसे आप पुन: उपयोग कर सकते हैं।

जहां कस्टम शब्दावली सबसे अधिक मदद करती है

तीन श्रेणियों के कारण अधिकांश मान्यताएं सामान्य-उद्देश्य वाले मॉडल से चूक जाती हैं। लोगों के नाम सबसे पहले हैं, विशेष रूप से वर्तनी जो सबसे आम प्रकार नहीं हैं। एक मॉडल के पास यह अनुमान लगाने का कोई तरीका नहीं है कि ऑडियो में “गुयेन” कहा गया है या लगभग-होमोफोन, जब तक कि कुछ यह नहीं बताता कि नाम चल रहा है। उत्पाद और ब्रांड नाम दूसरे स्थान पर हैं: “फ्लोब्रिज” जैसा नाम दो सामान्य शब्दों के रूप में सुना जाता है, न कि किसी विशिष्ट कंपनी द्वारा चुनी गई उचित संज्ञा के रूप में। आंतरिक शब्दजाल और परिवर्णी शब्द तीसरे हैं: ऐसे शब्द जो केवल एक टीम या उद्योग के अंदर कुछ मतलब रखते हैं, जो किसी भी सामान्य शब्दावली में शामिल नहीं होने वाला था। क्लिनिकल प्रैक्टिस की दवा और प्रक्रिया के नाम बड़े पैमाने पर एक ही समस्या हैं, जिसे मेडिकल ट्रांसक्रिप्शन इन शब्दावली उपकरणों के साथ एक समर्पित मोड के साथ संभालता है। एक बैठक में दस बार दोहराया गया एक संक्षिप्त शब्द या तो दस बार गलत लिखता है या दस बार सही; कोई आंशिक क्रेडिट नहीं है, इसलिए कीटर्म सूची या शब्दकोश में इसे एक बार ठीक करने से उस फ़ाइल में प्रत्येक घटना स्वचालित रूप से ठीक हो जाती है।

एकल फ़ाइल के लिए: कीटर्म और एक कस्टम प्रॉम्प्ट

यदि आप एक असामान्य रिकॉर्डिंग को ट्रांसक्रिप्ट कर रहे हैं और स्थायी सेटअप की आवश्यकता नहीं है, तो उस कार्य में सीधे कुंजीशब्द जोड़ें। अकेले उस फ़ाइल के लिए, आपके द्वारा वास्तव में कहे गए शब्दों के प्रति 1,000 कुंजीशब्दों (नाम, ब्रांड, संक्षिप्ताक्षर) तक की पूर्वाग्रह पहचान। उनके साथ, 2,000 अक्षरों तक का एक कस्टम प्रॉम्प्ट इंजन को वह संदर्भ देता है जो अकेले ऑडियो नहीं दे सकता: कौन बोल रहा है, रिकॉर्डिंग में क्या शामिल है, स्थिति के लिए विशिष्ट शब्द। नौकरी के बाद दोनों गायब हो जाते हैं; जब तक आप इसे दोबारा नहीं जोड़ते, तब तक कुछ भी अगली फ़ाइल में नहीं जाता है।

आवर्ती कार्य के लिए: सहेजे गए शब्दकोश और त्वरित प्रीसेट

यदि एक के बाद एक फ़ाइल में समान नाम और शब्दजाल आते हैं, तो एक बार की सूची फिर से टाइप करने लायक नहीं रह जाती है। एक सहेजा गया शब्दकोश इसका समाधान करता है: CSV या TSV फ़ाइल से थोक में शब्द आयात करें, उन्हें श्रेणियों में व्यवस्थित करें, और प्रत्येक विहित शब्द के लिए वर्तनी वेरिएंट संलग्न करें ताकि “मैकएलिस्टर” को पहचाना जा सके कि स्रोत ऑडियो इसे “मैकएलिस्टर” या “मैकएलस्टर” जैसा ध्वनि देता है या नहीं। प्रॉम्प्ट प्रीसेट संदर्भ के लिए उसी तरह काम करते हैं, पृष्ठभूमि को सहेजते हैं जिसे आप अन्यथा हर बार दोबारा टाइप करते हैं। किसी शब्दकोश या प्रीसेट को अपने डिफ़ॉल्ट के रूप में चिह्नित करें, और अगली बार जब आप ट्रांसक्राइब करते हैं तो यह स्वचालित रूप से पूर्व-चयनित हो जाता है, इसलिए एक स्थायी सेटअप को हर फ़ाइल पर फिर से चयन करने की आवश्यकता नहीं होती है।

वे संयोजित होते हैं, वे एक-दूसरे को प्रतिस्थापित नहीं करते हैं

एक स्थायी शब्दकोश और एक बार का जोड़ दो विकल्पों के बीच कोई विकल्प नहीं हैं; वे एक ही नौकरी के लिए एक साथ आवेदन करते हैं। अपनी टीम के उत्पाद नामों का एक डिफॉल्ट शब्दकोष रखें और एक डिफॉल्ट संकेत बताएं कि आपकी रिकॉर्डिंग आमतौर पर क्या हैं, फिर अतिथि के नाम के लिए एक-ऑफ़ कीवर्ड जोड़ें जो केवल इस सप्ताह की फ़ाइल के लिए प्रासंगिक है। स्थायी सेटअप आवर्ती शब्दावली को कवर करता है; एकमुश्त जोड़ इस रिकॉर्डिंग के लिए विशिष्ट चीज़ों को कवर करता है। किसी को भी इस बात का हिसाब नहीं देना है कि दूसरा पहले से ही क्या संभाल रहा है।

यह क्या नहीं छूता है

कस्टम शब्दावली अपने चार रूपों में से किसी एक में वह आकार देती है जो इंजन प्रतिलेख करते समय सुनता है, और यह बाद के Insights कार्य को कॉन्फ़िगर नहीं करता है। Insights परिणामी प्रतिलेख के विरुद्ध चलती है। शब्दावली को पहले से ठीक कर लेने से Insights द्वारा पढ़े जाने वाले स्रोत पाठ में सुधार हो सकता है, बिना Insights द्वारा उत्पन्न किए गए को बदले।

एक काम किया हुआ उदाहरण

एक साप्ताहिक पॉडकास्ट प्रत्येक एपिसोड में एक अलग अतिथि का साक्षात्कार लेता है लेकिन हमेशा नाम से समान तीन उत्पाद लाइनों को कवर करता है। होस्ट एक बार एक सहेजा गया शब्दकोश बनाता है, उत्पाद नामों और टीम के स्वयं के नामों की एक स्प्रेडशीट से आयात किया जाता है, जिस तरह से शो वास्तव में उन्हें कहता है, उसकी वर्तनी करता है, और इसे डिफ़ॉल्ट के रूप में चिह्नित करता है। हर हफ्ते के एपिसोड से अपने आप फायदा होता है। उस सप्ताह के अतिथि के लिए, एक ऐसा नाम जिसे शब्दकोश में जानने का कोई कारण नहीं है, मेजबान उस फ़ाइल के लिए विशिष्ट, अपलोड करने से पहले एक कीवर्ड जोड़ता है। स्थायी शब्दकोश और वन-ऑफ कीवर्ड दोनों एक ही प्रतिलेख पर लागू होते हैं, और किसी को भी दूसरे को छूने की आवश्यकता नहीं होती है।

इसे कहां सेट करें

शब्दावली विकल्प ऑडियो से टेक्स्ट पर अन्य प्रति-फ़ाइल सेटिंग्स के साथ बैठते हैं, चाहे आप एकल अपलोड में वन-ऑफ़ कीवर्ड जोड़ रहे हों या सहेजे गए को प्रबंधित कर रहे हों आवर्ती कार्य के लिए शब्दकोश. वे उसी तरह से काम करते हैं, भले ही Hushscript रिकॉर्डिंग में लगभग 99 भाषाओं में से कौन सी भाषा का स्वतः पता लगाता है, और भाषा पृष्ठ में पूरी सूची होती है, साथ ही किन भाषाओं को शीर्ष स्तरीय सटीकता मिलती है। शब्दावली के बारे में चिंता करने से पहले प्रतिलेख प्राप्त करने के बारे में अधिक जानकारी के लिए, इस उदाहरण के अनुसार आवर्ती-अतिथि वर्कफ़्लो के लिए पॉडकास्ट को कैसे ट्रांसक्रिप्ट करें देखें।

स्वतंत्र स्रोत और मानक

Hushscript ने इन स्वतंत्र, गैर-प्रतिस्पर्धी स्रोतों का संदर्भ लिया है। ये शोध, मानकों या प्लेटफ़ॉर्म के काम करने के तरीके को समझाते हैं और Hushscript का समर्थन नहीं करते।

स्रोतों की समीक्षा:

अक्सर पूछे जाने वाले सवाल

कुंजीशब्दों और सहेजे गए शब्दकोश के बीच क्या अंतर है?

कीटर्म एकबारगी होते हैं: आप उन्हें एक फ़ाइल में जोड़ते हैं और वे केवल उस कार्य पर लागू होते हैं। एक सहेजा गया शब्दकोश पुन: प्रयोज्य है: इसे एक बार बनाएं, यदि आप इसे स्वचालित रूप से पूर्व-चयनित करना चाहते हैं तो इसे डिफ़ॉल्ट के रूप में चिह्नित करें, और यह आपके द्वारा बाद में कुछ भी दोबारा दर्ज किए बिना ट्रांसक्रिप्ट की गई प्रत्येक फ़ाइल पर लागू होता है।

मैं एक फ़ाइल में कितने कुंजीशब्द जोड़ सकता हूं?

प्रति फ़ाइल 1,000 तक। इसमें नाम, ब्रांड और संक्षिप्ताक्षर शामिल हैं, आप चाहते हैं कि इंजन उस एक रिकॉर्डिंग के लिए सही ढंग से सुनने की ओर अग्रसर हो।

कस्टम प्रॉम्प्ट कितने समय का हो सकता है?

2,000 वर्ण तक। यह उस एकल फ़ाइल के लिए संदर्भ है: पृष्ठभूमि, ऑडियो अकेले इंजन नहीं दे सकता, जैसे कि कौन बोल रहा है या रिकॉर्डिंग किस बारे में है।

क्या मैं एक समय में एक शब्द टाइप करने के बजाय थोक में एक शब्दकोश आयात कर सकता हूं?

हां. एक CSV या TSV फ़ाइल आयात करें, प्रविष्टियों को श्रेणियों में व्यवस्थित करें, और प्रत्येक विहित शब्द के लिए वर्तनी वेरिएंट संलग्न करें, ताकि शब्दकोश उन विभिन्न तरीकों को पहचान सके जो नाम या शब्द सामने आ सकते हैं।

क्या कस्टम शब्दावली Insights को प्रभावित करती है?

सीधे नहीं। शब्दकोश, प्रॉम्प्ट प्रीसेट, कुंजीशब्द और कस्टम प्रॉम्प्ट वाक् पहचान को आकार देते हैं। परिणामी प्रतिलेख के विरुद्ध Insights बाद में चलती है, इसलिए बेहतर शब्दावली स्रोत पाठ में सुधार कर सकती है लेकिन Insights कार्य को कॉन्फ़िगर नहीं करती है।

30 मुफ़्त मिनट के साथ शुरू करें

शुरू करें – 30 मुफ़्त मिनट