किसी भी ऑडियो फ़ाइल को टेक्स्ट में ट्रांसक्राइब कैसे करें
लेखक: Hushscript प्रकाशित: अंतिम समीक्षा:
पॉडकास्ट एडिटर से एक MP3, आपके आईफोन से एक M4A, एक फील्ड रिकॉर्डर से एक WAV, एक वॉयस-रिकॉर्डर ऐप से एक अस्पष्ट CAF: उनमें से किसी को भी ट्रांसक्रिप्ट करने के लिए, आप वही काम करते हैं। फ़ाइल को छोड़ें, पहले से ही अलग किए गए वक्ता के साथ एक प्रतिलेख प्राप्त करें, इसे आपके लिए आवश्यक प्रारूप में निर्यात करें। जिस कंटेनर में ऑडियो आया है, वह चरणों को नहीं बदलता है।
प्रारूप किस चीज़ को प्रभावित करता है, वह थोड़ा और नीचे है: फ़ाइल कितनी बड़ी है, यह कितनी सफाई से ट्रांसक्राइब करती है, और उस दुर्लभ अवसर पर क्या करना है जब कोई फ़ाइल लोड नहीं होती है। यह मार्गदर्शिका बताती है कि कौन से ऑडियो प्रारूप काम करते हैं, एक विधि जो उन सभी को संभालती है, जब आपके पास विकल्प हो तो सबसे अच्छा प्रारूप कैसे चुनें, और जो फाइलें खराब हो जाती हैं उन्हें कैसे ठीक करें।
आपको क्या चाहिए
- एक ऑडियो (या वीडियो) फ़ाइल। नीचे दिए गए सामान्य प्रारूपों में से कोई भी। इंस्टॉल करने के लिए कुछ भी नहीं है: कोई डेस्कटॉप ऐप नहीं, कोई एक्सटेंशन नहीं। सब कुछ ब्राउज़र और आपके खाते में चलता है।
- संपूर्ण प्रतिलेख के लिए एक Hushscript खाता। प्रयास करने के लिए आपको 30 निःशुल्क मिनट मिलते हैं। उन्हें अनलॉक करने का सबसे तेज़ तरीका एक कार्ड जोड़ना है: $1 होल्ड इसे मान्य करता है, फिर तुरंत रिलीज़ कर देता है और कभी चार्ज नहीं किया जाता है। यदि आप कार्ड का उपयोग नहीं करना चाहते हैं, तो एक वैकल्पिक भुगतान विधि भी काम करती है, और आपकी पहली खरीदारी के साथ 30 मिनट लगते हैं।
30 सेकंड के पूर्वावलोकन के लिए किसी खाते की आवश्यकता नहीं है। आप साइन अप करने से पहले एक फ़ाइल छोड़ सकते हैं और वक्ता-लेबल शैली देख सकते हैं, जो कुछ भी करने से पहले आउटपुट फिट की जांच करने का ईमानदार तरीका है। निःशुल्क मिनटों के अलावा, प्रतिलेखन भुगतान के अनुसार होता है: आप केवल तभी मिनट खरीदते हैं जब आपको उनकी आवश्यकता होती है, बिना किसी सदस्यता के। लागत मूल्य निर्धारण पृष्ठ पर हैं।
कौन से ऑडियो प्रारूप काम करते हैं
Hushscript सभी मानक ऑडियो प्रारूप लेता है। यहां बताया गया है कि प्रत्येक कहां से आता है, ताकि आप पहचान सकें कि आपके पास क्या है:
नाम केवल फ़ाइल नाम परंपराएं नहीं हैं। वर्तमान IANA मीडिया प्रकार रजिस्ट्री मानकीकृत प्रकारों जैसेaudio/aac,audio/mp4,audio/mpeg,audio/ogg, और audio/opus को रिकॉर्ड करता है, यही कारण है कि कंटेनर और उसके अंदर ऑडियो एन्कोडिंग अलग-अलग प्रश्न हैं।
| प्रारूप | सामान्य स्रोत |
|---|---|
| MP3 | पॉडकास्ट, फोन रिकॉर्डिंग, अधिकांश रिकॉर्डिंग ऐप्स से निर्यात |
| M4A / AAC | iPhone वॉयस मेमो, WhatsApp वॉयस नोट्स, Apple एक्सपोर्ट |
| WAV | डिजिटल रिकॉर्डर, DAW एक्सपोर्ट, Windows वॉयस रिकॉर्डर |
| FLAC | अभिलेखीय रिकॉर्डिंग, DAW निर्यात, दोषरहित रिप्स |
| OGG | एंड्रॉइड वॉयस नोट्स, ओपन-सोर्स रिकॉर्डिंग टूल |
| AIFF / CAF | Mac और iOS ऑडियो, GarageBand |
वीडियो फ़ाइलें उसी तरह काम करती हैं। एक MP4, MOV, WebM, या MKV ड्रॉप करें और कुछ भी अपलोड करने से पहले ऑडियो ट्रैक आपके ब्राउज़र में निकाला जाता है, इसलिए वीडियो कभी भी आपके डिवाइस को नहीं छोड़ता है; केवल ऑडियो ही सर्वर तक पहुंचता है।
उपरोक्त सूची कोई बाड़ नहीं है। यह वादा समर्थित-प्रारूप तालिका की तुलना में सरल है: बस अपनी फ़ाइल छोड़ें और यह परिवर्तित और प्रतिलेखित हो जाती है। यदि आपके पास वास्तव में कुछ असामान्य है (पुराने नोकिया से एक एएमआर फ़ाइल, एक दशक पुराने एंड्रॉइड से.3gp, एक रियलऑडियो क्लिप), तो इसे वैसे भी अपलोड करने का प्रयास करें। ब्राउज़र अधिकांश मानक कंटेनरों को पढ़ सकता है, और यदि यह नहीं पढ़ सकता है, तो आपके पास दो कमियां हैं: इसे /tools पर निःशुल्क इन-ब्राउज़र टूल के साथ MP3 या WAV में कनवर्ट करें और उसे अपलोड करें, या support@hushscript.com पर ईमेल करें और हम प्रारूप जोड़ देंगे। आपको पहले से यह पता लगाने की ज़रूरत नहीं है कि आपकी फ़ाइल योग्य है या नहीं।
एक ऑडियो फ़ाइल को तीन चरणों में ट्रांसक्राइब करें
प्रवाह समान है, चाहे आप किसी भी प्रारूप से शुरू करें। पहला चरण आपके पास कोई खाता होने से पहले होता है।
- अपनी फ़ाइल का पूर्वावलोकन करने के लिए उसे छोड़ें।/audio-to-text पर जाएं और फ़ाइल को ड्रॉप ज़ोन पर खींचें, या ब्राउज़ करने के लिए क्लिक करें। पहले 30 सेकंड वहीं ब्राउज़र में, वक्ता-लेबल वाले, बिना किसी खाते की आवश्यकता के ट्रांसक्राइब होते हैं। यह आपकी जांच है कि किसी भी चीज़ के लिए साइन अप करने से पहले आउटपुट उसी तरह से पढ़ता है जैसा आप चाहते हैं।
- बाकी को ट्रांसक्राइब करने के लिए साइन अप करें। खाता बनाने के लिए अपना ईमेल दर्ज करें। जब आप कोई कार्ड जोड़ते हैं और सत्यापित करते हैं (ऊपर वर्णित $1 होल्ड) या अपनी पहली खरीदारी के साथ यदि आप किसी अन्य तरीके से भुगतान करते हैं तो आपके 30 निःशुल्क मिनट अनलॉक हो जाते हैं। पूरी फ़ाइल यहां से अपलोड होती है. एक रिकॉर्डिंग 10 घंटे तक चल सकती है, बिना किसी फ़ाइल-आकार की सीमा के - यहां तक कि एक बहुत बड़ी फ़ाइल भी सीधे ब्राउज़र में तैयार की जाती है। सेवा-सुरक्षा और सक्रिय-नौकरी सुरक्षा उपाय भी लागू होते हैं।
- प्रतिलेख प्राप्त करें और निर्यात करें। वाक् इंजन फ़ाइल को संसाधित करता है और पहले से अलग किए गए वक्ता के साथ एक प्रतिलेख लौटाता है। यदि आप चाहें तो वक्ता का नाम बदलें, फिर इसे 21 प्रारूपों (इनमें से TXT, SRT, DOCX और PDF, साथ ही उपशीर्षक और संपादक-टाइमलाइन प्रारूप) या पासवर्ड-सुरक्षित .husharchive में से किसी एक में डाउनलोड करें। प्रत्येक निर्यात शामिल है: कोई पेवॉल नहीं, कोई वॉटरमार्क नहीं।
प्रसंस्करण पृष्ठभूमि में चलता है और ऑडियो की लंबाई (रिकॉर्डिंग के प्रति घंटे लगभग कुछ मिनट) के साथ स्केल होता है, इसलिए लंबी फ़ाइल समाप्त होने पर आपको टैब खुला नहीं रखना पड़ता है।
एक काम किया गया उदाहरण: एक रिकॉर्डिंग, दो प्रारूप
मान लीजिए कि आपने 38 मिनट की बातचीत रिकॉर्ड की और आपके रिकॉर्डर ने इसे दो बार सहेजा: एक meeting.wav पूर्ण गुणवत्ता पर और एक meeting.m4a जिसे आपके फ़ोन ने उसी समय बनाया। दोनों समान तीन चरणों से गुजरते हैं, और प्रतिलेख वक्ता टर्न द्वारा खंडित होकर वापस आता है, प्रत्येक पर एक टाइमस्टैम्प के साथ:
[00:00:06] वक्ता A: शुरू करने से पहले, क्या सभी को मेरे द्वारा भेजे गए आंकड़े मिल गए?
[00:00:10] वक्ता B: वे आज सुबह मिल गए। Q3 नंबर वह है जो मैं चाहता हूं
खोजें।
[00:00:17]वक्ता A: ठीक है, तो यह वह रेखा है जो चली गई। मुझे इसे ऊपर खींचने दो.
[00:00:21] वक्ता C: जब तक आप ऐसा करते हैं - क्या हम उसके बाद काम पर रखने के लिए वापस आ सकते हैं?
दोनों फ़ाइलें अनिवार्य रूप से एक ही प्रतिलेख उत्पन्न करती हैं। WAV एक बहुत बड़ा अपलोड है और M4A एक छोटा अपलोड है, लेकिन शब्द और वक्ता लेबल एक ही तरह से आते हैं, क्योंकि दोनों में समान अंतर्निहित भाषण होता है। यहां से संपादन हल्का है: आप इसका नाम बदलने के लिए वक्ता A पर एक बार क्लिक करते हैं, और वक्ता की प्रत्येक पंक्ति में अपडेट होते हैं; आप उन मुट्ठी भर उचित संज्ञाओं को खोजते हैं जिनका इंजन अनुमान लगाता है (एक उपनाम, एक उत्पाद का नाम) और उन्हें ढूंढें-और-प्रतिस्थापन के साथ ठीक करें, जो प्रत्येक उदाहरण को एक ही बार में सही कर देता है।
यह प्रत्येक प्रारूप के लिए एक विधि का व्यावहारिक परिणाम है। आप WAV बनाम M4A बनाम MP3 के लिए एक अलग उपकरण या एक अलग मानसिक जाँच सूची नहीं रखते हैं। आपका रिकॉर्डर, आपका फोन, या किसी और का निर्यात आपको जो भी सौंपता है, वह उसी ड्रॉप जोन से गुजरता है और उसी तरह की प्रतिलेख के रूप में सामने आता है।
सटीकता के लिए सर्वोत्तम प्रारूप चुनना
अधिकांश समय आपको चुनने का मौका नहीं मिलता है। आपको जो फ़ाइल दी गई थी, उसे आप प्रतिलेखित करें और यह ठीक है। लेकिन यदि आप नियंत्रित करते हैं कि ऑडियो कैसे रिकॉर्ड किया जाता है या निर्यात किया जाता है, तो कुछ विकल्प इस बात की सीमा निर्धारित करते हैं कि परिणाम कितना साफ हो सकता है।
रिकॉर्डिंग की गुणवत्ता एक बड़े अंतर से पहले आती है। एक अच्छे क्लोज माइक्रोफोन से 128 केबीपीएस MP3 हर बार लैपटॉप के अंतर्निर्मित माइक पर पूरे कमरे में रिकॉर्ड किए गए दोषरहित WAV को हरा देगा। इससे पहले कि आप प्रारूप के बारे में सोचें, जो भी बोल रहा है उसके पास माइक लाने के बारे में सोचें। कंटेनर दूसरे नंबर पर है।
बहुत कम बिटरेट वाले MP3 से बचें। MP3 हानिप्रद है: एन्कोडिंग फ़ाइल को छोटा रखने के लिए ऑडियो के कुछ हिस्सों को हटा देती है, और बिटरेट जितना कम होगा, उतना ही यह दूर फेंकता है। वाक् पहचान व्यंजन में उच्च-आवृत्ति विवरण पर निर्भर करती है, जहां “पंद्रह” और “सोलह,” या “कर सकते हैं” और “नहीं” के बीच का अंतर रहता है। आक्रामक संपीड़न सबसे पहले उस विवरण को खा जाता है। लगभग 64 केबीपीएस से नीचे, शब्द त्रुटियाँ बढ़ती हैं। 128 केबीपीएस और उससे अधिक पर आप पहले ही उस बिंदु को पार कर चुके हैं जहां संख्या मायने रखती है; उच्च बिटरेट प्रतिलेख को बेहतर नहीं बनाएगी।
दोषरहित एक चर के रूप में प्रारूप को हटा देता है। WAV, FLAC, और AIFF इंजन को असम्पीडित ऑडियो सौंपते हैं। एक साफ रिकॉर्डिंग के लिए एक अच्छे MP3 की तुलना में सटीकता में मामूली बढ़त होती है, लेकिन यह टेबल से कंप्रेशन को पूरी तरह से हटा देता है। MDN का डिजिटल-ऑडियो गाइड अंतर्निहित व्यापार-बंद की व्याख्या करता है: दोषरहित विवरण को बड़े आकार में संरक्षित करता है, जबकि हानिपूर्ण एन्कोडिंग जानकारी को त्यागकर ऑडियो को और भी छोटा कर सकता है। यह तब उपयोगी संदर्भ है जब रिकॉर्डिंग कीमती हो और आप बाद में आश्चर्य नहीं करना चाहेंगे कि प्रारूप में आपकी कोई कीमत है या नहीं।
मोनो ठीक है; आपको स्टीरियो की आवश्यकता नहीं है। इंजन भाषण के लिए आंतरिक रूप से स्टीरियो को मोनो में मिलाता है, इसलिए एक मोनो फ़ाइल भी उतनी ही अच्छी तरह से ट्रांसक्राइब होती है और धीमे कनेक्शन पर तेजी से अपलोड होती है। एक बारीकियां: यदि आपके सेटअप ने प्रत्येक व्यक्ति को एक अलग स्टीरियो चैनल (एक “डबल-एंडर”) पर रिकॉर्ड किया है, तो अपलोड करने से पहले इसे एक मोनो ट्रैक में मिलाने से वक्ता लेबल को मदद मिलती है, क्योंकि इंजन दो अलग-अलग धाराओं के बजाय एक मिश्रित वार्तालाप सुनता है।
16 kHz से ऊपर का नमूना दर भाषण के लिए कुछ भी नहीं खरीदता है। 16 kHz से 48 kHz तक कुछ भी काम करता है, और एक वीडियो संपादक से 48 किलोहर्ट्ज़ WAV एक फ़ोन ऐप से 16 किलोहर्ट्ज़ मोनो फ़ाइल के समान ही ट्रांसक्राइब करता है, वही अंतर्निहित भाषण दिया जाता है। मॉडल को आवाज़ पर प्रशिक्षित किया जाता है, संगीत पर नहीं, इसलिए उच्च दर से सटीकता में कोई वृद्धि नहीं होती है।
दोषरहित बनाम हानिपूर्ण, और जब परिवर्तित करने में मदद मिलती है
एक सामान्य प्रश्न: क्या आपके MP3 को WAV में परिवर्तित करने से पहले सटीकता में सुधार होगा? ऐसा नहीं होगा. एक बार जब ऑडियो 128 केबीपीएस MP3 के रूप में सहेजा जाता है, तो हटा दिया गया विवरण हमेशा के लिए चला जाता है। उसी ऑडियो को WAV में लपेटने से बिना किसी अतिरिक्त जानकारी के एक बड़ी फ़ाइल बन जाती है। ऊपर की ओर कनवर्ट करना केवल उस प्रारूप के लिए समाधान के रूप में मदद करता है जो लोड नहीं होगा, सटीकता बढ़ाने के रूप में कभी नहीं।
नीचे कनवर्ट करना वास्तव में उपयोगी मामला है। एक बहु-घंटे WAV एक बहुत बड़ी फ़ाइल हो सकती है; अपलोड करने से पहले इसे 128 केबीपीएस MP3 में पुनः एन्कोड करने से यह बिना किसी सार्थक सटीकता लागत के नाटकीय रूप से सिकुड़ जाता है, जिससे धीमे लिंक पर अपलोड की गति बढ़ जाती है। मुफ़्त इन-ब्राउज़र कनवर्टर यह काम आपके डिवाइस से ऑडियो छोड़े बिना करता है। ईमानदार नियम: यदि आपकी फ़ाइल पहले से ही लोड है और छोटी-बिटरेट नहीं है, तो इसे वैसे ही ट्रांसक्राइब करें। केवल वास्तविक समस्या को हल करने के लिए कनवर्ट करें, जैसे कोई फ़ाइल जो नहीं खुलेगी या इतनी बड़ी हो कि उसे आसानी से अपलोड नहीं किया जा सके।
वक्ता लेबल, निःशुल्क शामिल है
प्रत्येक Hushscript प्रतिलेख बिना किसी अतिरिक्त लागत के स्वचालित वक्ता पृथक्करण (डायराइजेशन) के साथ आता है। इंजन अलग-अलग आवाज़ों को चुनता है और उन्हेंवक्ता A,वक्ता B, इत्यादि लेबल करता है, और आप प्रति वक्ता एक क्लिक के साथ संपादक में उन्हें वास्तविक नामों में बदल देते हैं। यह स्रोत प्रारूप की परवाह किए बिना डिफ़ॉल्ट रूप से चालू होता है, जिसमें कोई अलग वक्ता-लेबल स्तर नहीं होता है।
लेबल कितने साफ आते हैं यह रिकॉर्डिंग पर निर्भर करता है, न कि फ़ाइल प्रकार पर:
- अलग-अलग मोड़ सबसे अधिक मदद करते हैं। जब लोग बारी-बारी से एक-दूसरे से बात नहीं करते हैं, तो लेबल विश्वसनीय होते हैं। दो व्यक्तियों का साक्षात्कार आम तौर पर स्पष्ट रूप से अलग हो जाता है।
- ओवरलैप कठिन मामला है। जब दो आवाजें एक साथ आती हैं, तो इंजन तेज आवाज वाले को शब्द सौंपता है। यह आम तौर पर वक्ता पृथक्करण की सीमा है, किसी एक उपकरण की नहीं। एक जीवंत समूह कॉल में क्रॉसस्टॉक के लिए थोड़ा संपादन समय का बजट रखें।
- समान आवाजें धुंधली हो सकती हैं। बहुत समान रजिस्टर वाले दो लोग (समान-लिंग भाई-बहन, कहते हैं) किसी भी डायराइजेशन इंजन को चुनौती देंगे। एक उचित सिग्नल-टू-शोर अनुपात पूरे अलगाव में मदद करता है।
अधिकांश साक्षात्कारों, पॉडकास्ट और मीटिंगों के लिए लेबल अधिकतम कुछ पुनर्असाइनमेंट के साथ प्रयोग करने योग्य होते हैं। यदि आप विस्तार से जानना चाहते हैं कि डायराइजेशन हुड के नीचे कैसे काम करता है, तो वक्ता डायराइजेशन क्या है देखें, या फीचर अवलोकन के लिए वक्ता आइडेंटिफिकेशन पेज देखें।
जो फाइलें रफ हो जाती हैं उन्हें ठीक करना
ज्यादातर रफ ट्रांसक्रिप्ट वापस आ जाते हैं। रिकॉर्डिंग, प्रारूप या उपकरण नहीं। सामान्य अपराधी और उनके बारे में क्या करना है:
एक फ़ाइल जो लोड नहीं होगी। दुर्लभ, लेकिन यह असामान्य या दूषित कंटेनर के साथ होता है। इसे पहले MP3 या WAV के रूप में पुनः रैप करने के लिए निःशुल्क इन-ब्राउज़र कनवर्टर आज़माएं, जो अधिकांश जिद्दी फ़ाइलों को ठीक करता है। यदि यह अभी भी नहीं जाता है, तो support@hushscript.com पर ईमेल करें। प्रारूप समर्थन जोड़ना कुछ ऐसा है जो हम करते हैं।
कम वॉल्यूम। यदि रिकॉर्डिंग बहुत शांत है, तो इंजन के पास काम करने के लिए कम सिग्नल हैं और सटीकता कम हो जाती है। अपलोड करने से पहले किसी भी संपादक में ऑडियो को सामान्यीकृत या प्रवर्धित करें। कमजोर रिकॉर्डिंग के स्तर को बढ़ाना उच्चतम रिटर्न वाले सुधारों में से एक है।
पृष्ठभूमि शोर। स्थिर शोर (एक एयर कंडीशनर, सड़क पर शोर) को उचित रूप से अच्छी तरह से नियंत्रित किया जाता है। अचानक शोर जो भाषण को ओवरलैप करता है (एक दरवाजा, एक खाँसी, कटलरी) वह है जो शब्दों को गिरा देता है। अपलोड करने से पहले एक हल्का शोर कम करने वाला पास मदद कर सकता है, लेकिन इसे ज़्यादा न करें: भारी निंदा करने से ऐसी कलाकृतियाँ जुड़ जाती हैं जो शोर की तुलना में सटीकता को अधिक नुकसान पहुँचाती हैं।
भारी उच्चारण या विशेषज्ञ शब्दावली। आधुनिक इंजन उच्चारण की एक विस्तृत श्रृंखला को अच्छी तरह से संभालते हैं। विश्वसनीय गलतियाँ डोमेन शब्द हैं जिनकी इंजन के पास अपेक्षा करने का कोई कारण नहीं है: दवा के नाम, कानूनी उद्धरण, विशिष्ट ब्रांड नाम। निर्यात के बाद एक स्किम की योजना बनाएं और खोजें-और-प्रतिस्थापन पर निर्भर रहें; यदि कोई नाम हर बार एक ही तरह से गलत हो जाता है, तो एक सुधार पूरी फ़ाइल को साफ़ कर देता है।
बहुत बड़ी या बहुत लंबी फ़ाइलें। 10 घंटे की सीमा लगभग किसी भी चीज़ को कवर करती है, और इसके ऊपर कोई फ़ाइल आकार सीमा नहीं है, इसलिए लंबी रिकॉर्डिंग को टुकड़ों में काटने की कोई आवश्यकता नहीं है। यदि कोई दोषरहित फ़ाइल ब्राउज़र में तैयार करने के लिए अजीब तरह से बड़ी है, तो चीजों को गति देने के लिए पहले इसे 128 केबीपीएस MP3 (कोई वास्तविक सटीकता लागत नहीं) पर फिर से एनकोड करें। लंबे सत्र की विशिष्टताओं के लिए, लंबी-रिकॉर्डिंग मार्गदर्शिका अधिक गहराई तक जाती है।
आपकी फ़ाइल का क्या होता है
ट्रांसक्रिप्ट तैयार होते ही ऑडियो सर्वर से हटा दिया जाता है। इसमें कोई क्लाउड स्टोरेज नहीं है, मॉडल प्रशिक्षण के लिए कोई उपयोग नहीं है, और कोई अवधारण अवधि नहीं है। यदि आपने कोई वीडियो फ़ाइल छोड़ दी है, तो केवल निकाला गया ऑडियो ही सर्वर तक पहुंचता है (वीडियो आपके डिवाइस पर रहता है), और आप जब चाहें एक क्लिक में अपने डैशबोर्ड से ट्रांसक्रिप्ट को हटा सकते हैं।
अपनी प्रतिलेख निर्यात करना
प्रतिलेखन के बाद, वह प्रारूप चुनें जो पाठ के साथ आप जो कर रहे हैं उसके लिए उपयुक्त हो। यदि आप निश्चित नहीं हैं कि आपको वास्तव में किस ट्रांसक्रिप्ट प्रारूप की आवश्यकता है, तो नीचे दिए गए सामान्य चयन से शुरुआत करें:
| प्रारूप | क्या शामिल है | के लिए सर्वश्रेष्ठ |
|---|---|---|
| TXT | वक्ता लेबल, सादा पाठ | नोट्स, खोज, किसी अन्य टूल में फीड करना |
| SRT | प्रति-उच्चारण टाइमस्टैम्प, वक्ता लेबल | वीडियो कैप्शन, समय के अनुसार एक लंबी रिकॉर्डिंग नेविगेट करना |
| VTT | वेब कैप्शन टाइमस्टैम्प, वक्ता लेबल | HTML5 वीडियो प्लेयर और वेब प्रकाशन |
| CSV | वक्ता, टाइमिंग और टेक्स्ट फ़ील्ड वाली पंक्तियाँ | स्प्रेडशीट समीक्षा और हल्के डेटा हैंडऑफ़ |
| Markdown | मार्कडाउन में वक्ता-लेबल प्रतिलेख | नोट्स, दस्तावेज़, प्रकाशन वर्कफ़्लो और स्थिर साइटें |
| DOCX | वर्ड या Google के लिए स्वरूपित दस्तावेज़ | संपादन, साझाकरण, एनोटेशन |
| JSON | { speaker, start, end, text }प्रति आइटम | पाइपलाइन और कस्टम टूलींग |
| पढ़ने योग्य निश्चित-लेआउट प्रतिलेख | केवल-पढ़ने के लिए साझाकरण और संग्रहण |
प्रत्येक निर्यात में वक्ता लेबल होता है, उनमें से किसी पर कोई वॉटरमार्क नहीं होता है, और सभी निर्यात प्रारूप प्रत्येक योजना के साथ शामिल होते हैं, उनमें से 30 निःशुल्क मिनट होते हैं। SRT में टाइमस्टैम्प उच्चारण स्तर (प्रति वक्ता एक प्रविष्टि) पर बैठते हैं, जो कैप्शनिंग और उद्धरण के लिए सही ग्रैन्युलैरिटी है; यदि आपको कोड में संसाधित करने के लिए शब्द-स्तरीय संरचना की आवश्यकता है, तो JSON आपको प्रत्येक मोड़ के लिए मिलीसेकंड में प्रारंभ और समाप्ति समय देता है।
भाषाएं
Hushscript लगभग 99 भाषाओं को ट्रांसक्राइब करता है, स्वचालित रूप से पता लगाया जाता है, हाथ से सेट नहीं किया जाता है। सटीकता 18 में सबसे मजबूत है, जिसमें चार अंग्रेजी संस्करण (वैश्विक, ब्रिटिश, ऑस्ट्रेलियाई, यूएस), स्पेनिश, फ्रेंच, जर्मन, जापानी, मंदारिन, हिंदी और अरबी शामिल हैं। पूरी सूची भाषा पृष्ठ पर है।
यदि आप समान भाषा प्रतिलेख और अनुवादित प्रतिलेख के बीच निर्णय ले रहे हैं, तो ’‘ऑडियो को पाठ में अनुवाद करें’ की मार्गदर्शिका अंतर बताती है।
यही पूरा काम है (ड्रॉप, ट्रांसक्राइब, एक्सपोर्ट), और यह वही पढ़ता है जो आपने प्रारंभ किया था। प्रारूप-विशिष्ट नोट्स के लिए, सिबलिंग गाइड सबसे सामान्य मामलों को कवर करते हैं: MP3, WAV, और M4A / Apple Voice Memo। ऑडियो-टू-टेक्स्ट पृष्ठ में पूर्ण सुविधा अवलोकन है, और प्रत्येक प्रारूप उसी तरह वहां पहुंचता है: बस अपनी फ़ाइल छोड़ें।
स्वतंत्र स्रोत और मानक
Hushscript ने इन स्वतंत्र, गैर-प्रतिस्पर्धी स्रोतों का संदर्भ लिया है। ये शोध, मानकों या प्लेटफ़ॉर्म के काम करने के तरीके को समझाते हैं और Hushscript का समर्थन नहीं करते।
स्रोतों की समीक्षा: