ट्रांसक्राइबर को अपने नाम और तकनीकी शब्द सिखाएँ
लेखक: Hushscript प्रकाशित: अंतिम समीक्षा:
एक सामान्य-उद्देश्य भाषण इंजन में उत्पाद कोडनाम, एक क्षेत्रीय उपनाम, या एक आंतरिक संक्षिप्त नाम के लिए कम संदर्भ होता है जिसे आपकी टीम दस बार उपयोग करती है एक बैठक. अनुसंधान अपेक्षित शब्दों प्रासंगिक पूर्वाग्रह की ओर पहचान को आगे बढ़ाने की तकनीक कहता है, और 2025 W3C वेब स्पीच सत्र ने इसे क्रोम में क्षमता शिपिंग के रूप में वर्णित किया है। Hushscript उस विचार को चार शब्दावली नियंत्रणों में बदल देता है, जिसमें एक फ़ाइल के लिए एक बार जोड़ने से लेकर एक स्थायी सेटअप तक शामिल है जिसे आप पुन: उपयोग कर सकते हैं।
जहां कस्टम शब्दावली सबसे अधिक मदद करती है
तीन श्रेणियों के कारण अधिकांश मान्यताएं सामान्य-उद्देश्य वाले मॉडल से चूक जाती हैं। लोगों के नाम सबसे पहले हैं, विशेष रूप से वर्तनी जो सबसे आम प्रकार नहीं हैं। एक मॉडल के पास यह अनुमान लगाने का कोई तरीका नहीं है कि ऑडियो में “गुयेन” कहा गया है या लगभग-होमोफोन, जब तक कि कुछ यह नहीं बताता कि नाम चल रहा है। उत्पाद और ब्रांड नाम दूसरे स्थान पर हैं: “फ्लोब्रिज” जैसा नाम दो सामान्य शब्दों के रूप में सुना जाता है, न कि किसी विशिष्ट कंपनी द्वारा चुनी गई उचित संज्ञा के रूप में। आंतरिक शब्दजाल और परिवर्णी शब्द तीसरे हैं: ऐसे शब्द जो केवल एक टीम या उद्योग के अंदर कुछ मतलब रखते हैं, जो किसी भी सामान्य शब्दावली में शामिल नहीं होने वाला था। क्लिनिकल प्रैक्टिस की दवा और प्रक्रिया के नाम बड़े पैमाने पर एक ही समस्या हैं, जिसे मेडिकल ट्रांसक्रिप्शन इन शब्दावली उपकरणों के साथ एक समर्पित मोड के साथ संभालता है। एक बैठक में दस बार दोहराया गया एक संक्षिप्त शब्द या तो दस बार गलत लिखता है या दस बार सही; कोई आंशिक क्रेडिट नहीं है, इसलिए कीटर्म सूची या शब्दकोश में इसे एक बार ठीक करने से उस फ़ाइल में प्रत्येक घटना स्वचालित रूप से ठीक हो जाती है।
एकल फ़ाइल के लिए: कीटर्म और एक कस्टम प्रॉम्प्ट
यदि आप एक असामान्य रिकॉर्डिंग को ट्रांसक्रिप्ट कर रहे हैं और स्थायी सेटअप की आवश्यकता नहीं है, तो उस कार्य में सीधे कुंजीशब्द जोड़ें। अकेले उस फ़ाइल के लिए, आपके द्वारा वास्तव में कहे गए शब्दों के प्रति 1,000 कुंजीशब्दों (नाम, ब्रांड, संक्षिप्ताक्षर) तक की पूर्वाग्रह पहचान। उनके साथ, 2,000 अक्षरों तक का एक कस्टम प्रॉम्प्ट इंजन को वह संदर्भ देता है जो अकेले ऑडियो नहीं दे सकता: कौन बोल रहा है, रिकॉर्डिंग में क्या शामिल है, स्थिति के लिए विशिष्ट शब्द। नौकरी के बाद दोनों गायब हो जाते हैं; जब तक आप इसे दोबारा नहीं जोड़ते, तब तक कुछ भी अगली फ़ाइल में नहीं जाता है।
आवर्ती कार्य के लिए: सहेजे गए शब्दकोश और त्वरित प्रीसेट
यदि एक के बाद एक फ़ाइल में समान नाम और शब्दजाल आते हैं, तो एक बार की सूची फिर से टाइप करने लायक नहीं रह जाती है। एक सहेजा गया शब्दकोश इसका समाधान करता है: CSV या TSV फ़ाइल से थोक में शब्द आयात करें, उन्हें श्रेणियों में व्यवस्थित करें, और प्रत्येक विहित शब्द के लिए वर्तनी वेरिएंट संलग्न करें ताकि “मैकएलिस्टर” को पहचाना जा सके कि स्रोत ऑडियो इसे “मैकएलिस्टर” या “मैकएलस्टर” जैसा ध्वनि देता है या नहीं। प्रॉम्प्ट प्रीसेट संदर्भ के लिए उसी तरह काम करते हैं, पृष्ठभूमि को सहेजते हैं जिसे आप अन्यथा हर बार दोबारा टाइप करते हैं। किसी शब्दकोश या प्रीसेट को अपने डिफ़ॉल्ट के रूप में चिह्नित करें, और अगली बार जब आप ट्रांसक्राइब करते हैं तो यह स्वचालित रूप से पूर्व-चयनित हो जाता है, इसलिए एक स्थायी सेटअप को हर फ़ाइल पर फिर से चयन करने की आवश्यकता नहीं होती है।
वे संयोजित होते हैं, वे एक-दूसरे को प्रतिस्थापित नहीं करते हैं
एक स्थायी शब्दकोश और एक बार का जोड़ दो विकल्पों के बीच कोई विकल्प नहीं हैं; वे एक ही नौकरी के लिए एक साथ आवेदन करते हैं। अपनी टीम के उत्पाद नामों का एक डिफॉल्ट शब्दकोष रखें और एक डिफॉल्ट संकेत बताएं कि आपकी रिकॉर्डिंग आमतौर पर क्या हैं, फिर अतिथि के नाम के लिए एक-ऑफ़ कीवर्ड जोड़ें जो केवल इस सप्ताह की फ़ाइल के लिए प्रासंगिक है। स्थायी सेटअप आवर्ती शब्दावली को कवर करता है; एकमुश्त जोड़ इस रिकॉर्डिंग के लिए विशिष्ट चीज़ों को कवर करता है। किसी को भी इस बात का हिसाब नहीं देना है कि दूसरा पहले से ही क्या संभाल रहा है।
यह क्या नहीं छूता है
कस्टम शब्दावली अपने चार रूपों में से किसी एक में वह आकार देती है जो इंजन प्रतिलेख करते समय सुनता है, और यह बाद के Insights कार्य को कॉन्फ़िगर नहीं करता है। Insights परिणामी प्रतिलेख के विरुद्ध चलती है। शब्दावली को पहले से ठीक कर लेने से Insights द्वारा पढ़े जाने वाले स्रोत पाठ में सुधार हो सकता है, बिना Insights द्वारा उत्पन्न किए गए को बदले।
एक काम किया हुआ उदाहरण
एक साप्ताहिक पॉडकास्ट प्रत्येक एपिसोड में एक अलग अतिथि का साक्षात्कार लेता है लेकिन हमेशा नाम से समान तीन उत्पाद लाइनों को कवर करता है। होस्ट एक बार एक सहेजा गया शब्दकोश बनाता है, उत्पाद नामों और टीम के स्वयं के नामों की एक स्प्रेडशीट से आयात किया जाता है, जिस तरह से शो वास्तव में उन्हें कहता है, उसकी वर्तनी करता है, और इसे डिफ़ॉल्ट के रूप में चिह्नित करता है। हर हफ्ते के एपिसोड से अपने आप फायदा होता है। उस सप्ताह के अतिथि के लिए, एक ऐसा नाम जिसे शब्दकोश में जानने का कोई कारण नहीं है, मेजबान उस फ़ाइल के लिए विशिष्ट, अपलोड करने से पहले एक कीवर्ड जोड़ता है। स्थायी शब्दकोश और वन-ऑफ कीवर्ड दोनों एक ही प्रतिलेख पर लागू होते हैं, और किसी को भी दूसरे को छूने की आवश्यकता नहीं होती है।
इसे कहां सेट करें
शब्दावली विकल्प ऑडियो से टेक्स्ट पर अन्य प्रति-फ़ाइल सेटिंग्स के साथ बैठते हैं, चाहे आप एकल अपलोड में वन-ऑफ़ कीवर्ड जोड़ रहे हों या सहेजे गए को प्रबंधित कर रहे हों आवर्ती कार्य के लिए शब्दकोश. वे उसी तरह से काम करते हैं, भले ही Hushscript रिकॉर्डिंग में लगभग 99 भाषाओं में से कौन सी भाषा का स्वतः पता लगाता है, और भाषा पृष्ठ में पूरी सूची होती है, साथ ही किन भाषाओं को शीर्ष स्तरीय सटीकता मिलती है। शब्दावली के बारे में चिंता करने से पहले प्रतिलेख प्राप्त करने के बारे में अधिक जानकारी के लिए, इस उदाहरण के अनुसार आवर्ती-अतिथि वर्कफ़्लो के लिए पॉडकास्ट को कैसे ट्रांसक्रिप्ट करें देखें।
स्वतंत्र स्रोत और मानक
Hushscript ने इन स्वतंत्र, गैर-प्रतिस्पर्धी स्रोतों का संदर्भ लिया है। ये शोध, मानकों या प्लेटफ़ॉर्म के काम करने के तरीके को समझाते हैं और Hushscript का समर्थन नहीं करते।
स्रोतों की समीक्षा: