किसी साक्षात्कार को कैसे प्रतिलेखित करें (निजी तौर पर)
लेखक: Hushscript प्रकाशित: अंतिम समीक्षा:
किसी साक्षात्कार को अच्छी तरह से लिखने का मतलब एक साथ दो चीजें हैं: सटीक पाठ और स्पष्ट एट्रिब्यूशन। शब्दों की एक ऐसी दीवार जहां आप यह नहीं बता सकते कि किसने क्या कहा, यह लगभग कच्ची रिकॉर्डिंग जितना ही काम का काम है। और जब बातचीत संवेदनशील हो, एक कानूनी मामला हो, एक गोपनीय स्रोत हो, एक एचआर स्थिति हो, तो ऑडियो को कैसे संभाला जाता है, यह ट्रांसक्रिप्ट जितना ही मायने रखता है। यह मार्गदर्शिका संपूर्ण आर्क को कवर करती है: रिकॉर्ड करने से पहले स्वच्छ ऑडियो प्राप्त करना, ट्रांसक्रिप्शन चलाना, साक्षात्कारकर्ता और विषय को अलग रखना, टाइमस्टैम्प के साथ सटीक उद्धरण देना, और पूरी चीज़ को निजी रखना।
शुरू करने से पहले आपको क्या चाहिए
सूची छोटी है। आपको ऑडियो या वीडियो फ़ाइल के रूप में साक्षात्कार की रिकॉर्डिंग की आवश्यकता होगी। Hushscript किसी भी सामान्य प्रारूप को स्वीकार करता है, इसलिए एक फोन वॉयस मेमो, एक ज़ूम रिकॉर्डिंग, एक समर्पित रिकॉर्डर का WAV, या एक MP4 स्क्रीन कैप्चर सभी रूपांतरण के बिना काम करते हैं। आपको रिकॉर्ड किए गए सभी लोगों की सहमति की आवश्यकता है, जो नीचे कवर किया गया है और वैकल्पिक नहीं है। और आपको ट्रांसक्रिप्ट को देखने और संपादित करने का एक तरीका चाहिए, जो आपके ब्राउज़र में Hushscript ऐप है। कोई इंस्टॉल नहीं, कोई प्लगइन नहीं।
आपको कोई भाषा चुनने की आवश्यकता नहीं है। Hushscript लगभग 99 भाषाओं में स्वचालित रूप से इसका पता लगाता है, इसलिए एक द्विभाषी साक्षात्कार या एक विषय जो मध्य-वाक्य बदलता है उसे आपके कुछ भी सेट किए बिना नियंत्रित किया जाता है। यदि आप पूरी सूची देखना चाहते हैं, तो भाषा पृष्ठ में यह मौजूद है।
रिकॉर्ड करने से पहले
रिकॉर्डिंग के समय ऑडियो गुणवत्ता ट्रांसक्रिप्ट सटीकता में सबसे बड़ा कारक है। कोई भी प्रतिलेखन इंजन, स्वचालित या मानव, उस शब्द को पुनर्प्राप्त नहीं कर सकता जिसे माइक्रोफ़ोन ने कभी स्पष्ट रूप से कैप्चर नहीं किया हो। कुछ विशिष्ट बातें बाद में आपके द्वारा किए गए किसी भी कार्य से अधिक लाभदायक होती हैं।
माइक्रोफ़ोन प्लेसमेंट। एक व्यक्तिगत साक्षात्कार के लिए, दोनों वक्ताों से समान दूरी पर टेबल पर रखा गया एक छोटा रिकॉर्डर आपकी जेब में छोड़े गए फ़ोन को बजाता है। यदि आप प्रत्येक व्यक्ति को अपना स्वयं का माइक्रोफ़ोन दे सकते हैं, तो ऐसा करें: एक मिश्रित कमरे की तुलना में दो साफ़ इनपुट को अलग करना आसान होता है। वीडियो कॉल पर दूरस्थ साक्षात्कार के लिए, जब प्लेटफ़ॉर्म अनुमति देता है, तो प्रत्येक पक्ष को अपने स्वयं के ट्रैक के रूप में रिकॉर्ड करें, क्योंकि दो ट्रैक एक डाउन-मिक्स्ड स्ट्रीम की तुलना में अधिक सफाई से अलग होते हैं।
एक शांत वातावरण। एचवीएसी गुंजन, एक खिड़की के माध्यम से यातायात, एक कैफे की पृष्ठभूमि की बातचीत, और नंगे कमरे की गूंज सभी सटीकता में कमी लाती है। एक छोटा कालीन वाला कमरा, या यहाँ तक कि लटकते कपड़ों की एक कोठरी, एक खुले कार्यालय से बेहतर लगती है। फ़ील्ड में, आपके विषय की ओर निर्देशित दिशात्मक माइक्रोफ़ोन उनकी आवाज़ को परिवेश से ऊपर उठाने में मदद करता है।
किसी भी चीज़ से पहले सहमति। किसी व्यक्ति की जानकारी के बिना उसकी रिकॉर्डिंग करना कई जगहों पर अवैध है और हर जगह अस्वीकार्य है। शुरू करने से पहले अपने विषय को बताएं कि आप रिकॉर्डिंग कर रहे हैं। कुछ क्षेत्राधिकारों में एक-पक्षीय सहमति होती है, लेकिन कई अमेरिकी राज्यों और कई देशों सहित कई क्षेत्रों में उपस्थित सभी लोगों की सहमति की आवश्यकता होती है। जब संदेह हो, तो रिकॉर्डिंग शुरू करने के ठीक बाद, रिकॉर्डिंग पर ही स्पष्ट रूप से हाँ बोलें, ताकि समझौता फ़ाइल का हिस्सा हो।
समझदार प्रारूप सेटिंग्स। आपको स्टूडियो गुणवत्ता की आवश्यकता नहीं है। 128 केबीपीएस या उससे अधिक पर WAV या MP3 काफी है, और 16 kHz नमूना दर या उससे अधिक आरामदायक है। एक चीज़ जिससे बचना चाहिए वह है टेलीफोन की गुणवत्ता को कम करना, लगभग 8 किलोहर्ट्ज़, जहां व्यंजन एक साथ मिल जाते हैं और सटीकता काफ़ी कम हो जाती है।
साक्षात्कार को चरण दर चरण ट्रांसक्राइब करें
प्रवाह इसलिए बनाया गया है ताकि आप प्रतिबद्ध होने से पहले गुणवत्ता देख सकें। यहां वास्तविक क्रम है।
- अपनी रिकॉर्डिंग /audio-to-text पर छोड़ें। यदि यह एक वीडियो है, तो ऑडियो पहले आपके ब्राउज़र में निकाला जाता है, इसलिए वीडियो फ़ाइल कभी भी आपके डिवाइस को नहीं छोड़ती है। यहां से केवल ऑडियो शामिल है।
- 30-सेकंड का पूर्वावलोकन पढ़ें। Hushscript पहले आधे मिनट को ट्रांसक्रिप्ट करता है और आपके खाता बनाने से पहले ही लागू किए गए वक्ता लेबल के साथ इसे आपको वापस दिखाता है। यह नो-अकाउंट चरण है: आपको वक्ता पृथक्करण और अपनी वास्तविक फ़ाइल पर शब्दों का मूल्यांकन करना है, डेमो नहीं।
- बाकी को ट्रांसक्रिप्ट करने के लिए साइन अप करें। खाता बनाने से पूर्ण ट्रांसक्रिप्शन अनलॉक हो जाता है। नए खातों को आज़माने के लिए 30 निःशुल्क मिनट मिलते हैं, जो एक छोटे साक्षात्कार या लंबे साक्षात्कार के लिए पर्याप्त हैं। Hushscript बिना किसी सदस्यता के भुगतान के रूप में उपलब्ध है, इसलिए आप केवल तभी मिनट खरीदते हैं जब आपको उनकी आवश्यकता होती है।
- रीलेबल और निर्यात। तैयार प्रतिलेख प्रति कथन एक पंक्ति के रूप में वापस आता है, प्रत्येक को एक वक्ता लेबल और एक टाइमस्टैम्प के साथ टैग किया जाता है। लेबल को वास्तविक नामों में बदलें, फिर निर्यात करें।
निःशुल्क मिनटों पर एक नोट, क्योंकि लोग पूछते हैं कि “मुक्त” भाग कैसे काम करता है। 30 मिनट एक बार दिए जाते हैं। उन्हें अनलॉक करने का सबसे तेज़ तरीका एक त्वरित कार्ड जांच है: कार्ड की पुष्टि करने के लिए $1 होल्ड को अधिकृत किया जाता है और फिर तुरंत छोड़ दिया जाता है, कभी भी शुल्क नहीं लिया जाता है। यदि आप किसी अन्य तरीके से भुगतान करना चाहते हैं, तो आपके देश में उपलब्ध एक वैकल्पिक तरीका भी काम करता है, और आपकी पहली खरीदारी के साथ 30 मिनट मिलते हैं। किसी भी तरह से कार्ड की आवश्यकता नहीं है।
साक्षात्कारकर्ता और विषय को अलग रखें
यह वह जगह है जहां एक साक्षात्कार प्रतिलेख एक प्रतिलेख के बजाय प्रयोग करने योग्य हो जाता है जिसे आपको किसी भी तरह से फिर से सुनना पड़ता है। वक्ता पहचान सुविधा बिना किसी सेटअप और बिना किसी अतिरिक्त लागत के प्रत्येक विशिष्ट आवाज को अपना स्वयं का लेबल प्रदान करती है। दो व्यक्तियों के साक्षात्कार के लिए इसका मतलब इस तरह का संवाद है:
वक्ता A [00:00:07]: क्या आप मुझे उस समय वापस ले जा सकते हैं जब आपको पहली बार एहसास हुआ था कि परियोजना संकट में है?
वक्ता B [00:00:13]: यह 2019 की शुरुआत थी। मैं रोलआउट चला रहा था, और संख्याएं जुड़ना बंद हो गईं ऊपर।
वक्ता A [00:00:28]: और आपने इसके बारे में क्या किया?
वक्ता B [00:00:31]: ईमानदारी से कहूं तो, पहले तो कुछ भी नहीं। यही वह हिस्सा है जिसके लिए मुझे खेद है।
उस पर वास्तविक नाम डालने के लिए:
- प्रतिलेख में
वक्ता Aके किसी भी उदाहरण पर क्लिक करें। - आप जो नाम चाहते हैं उसे टाइप करें, उदाहरण के लिए “साक्षात्कारकर्ता” या अपने विषय का नाम।
- उस वक्ता की प्रत्येक पंक्ति एक बार में अपडेट होती है।
आप इसे प्रति वक्ता एक बार करते हैं। 90-मिनट, दो-व्यक्ति साक्षात्कार के लिए पूरे साक्षात्कार में एक मिनट से भी कम समय लगता है, और आप एक उद्धरण-तैयार दस्तावेज़ के साथ समाप्त होते हैं जहां प्रत्येक पंक्ति को एक नामित व्यक्ति को जिम्मेदार ठहराया जाता है। यदि आप विस्तार से जानना चाहते हैं कि यह पृथक्करण वास्तव में हुड के नीचे कैसे काम करता है, तो वक्ता डायराइजेशन कैसे काम करता है इसे सरल भाषा में समझाता है।
एक काम किया हुआ उदाहरण: एक घंटे का शोध साक्षात्कार
मान लीजिए कि आपने अपने फोन पर .m4a के रूप में 58 मिनट का शोध साक्षात्कार रिकॉर्ड किया है। फ़ाइल. कमरा शांत था, आप दोनों फोन के करीब थे, और जब आपका विषय एनिमेटेड होता है तो ओवरलैप का सामान्य सा हिस्सा होता है।
आप फ़ाइल को/audio-to-text पर छोड़ दें। 30 सेकंड का पूर्वावलोकन आपके शुरुआती प्रश्न को वक्ता A और आपके विषय के पहले उत्तर को वक्ता B के रूप में दिखाता है, जो आपको बताता है कि अलगाव साफ है। आप साइन अप करें और पूरी फ़ाइल को ट्रांसक्राइब करने दें। 58 मिनट का साक्षात्कार आपके शेष राशि से 58 मिनट का उपयोग करता है, इसलिए 30 निःशुल्क मिनट केवल आधे से अधिक को कवर करते हैं और आप बाकी को पूरा करते हैं।
प्रतिलेख आगे-पीछे साफ-सुथरा पढ़ता है। आप पहलेवक्ता A पर क्लिक करें, अपना नाम टाइप करें, पहलेवक्ता B पर क्लिक करें, अपने विषय का नाम टाइप करें, और पूरा दस्तावेज़ अपडेट हो जाएगा। आगे बढ़ते हुए, आप तीन छोटे हिस्सों को देखते हैं जहां इंजन ने आपके विषय को दूसरे लेबल में विभाजित कर दिया है क्योंकि वे फोन से दूर झुक गए थे, इसलिए आप उन्हें वापस मर्ज कर देते हैं। आप अपने नोट्स के लिए DOCX और JSON पर निर्यात करते हैं ताकि आपकी विश्लेषण स्क्रिप्ट प्रत्येक कथन को उसके प्रारंभ समय, समाप्ति समय और वक्ता के साथ खींच सके। अपलोड के बाद कुल व्यावहारिक समय: कुछ मिनट।
टाइमस्टैम्प के साथ सटीक उद्धरण
प्रतिलेख में प्रत्येक कथन में एक टाइमस्टैम्प होता है, जो आउटपुट को उद्धृत करने के लिए सुरक्षित बनाता है। जब आप किसी लेख, रिपोर्ट या पेपर के लिए उद्धरण निकालते हैं, तो उसके बगल में टाइमस्टैम्प नोट करें। यह आपको तथ्य-जाँच के दौरान सुनने के लिए एक सटीक बिंदु देता है, एक संपादक को उद्धरण को सत्यापित करने का एक तरीका देता है, और यदि कोई स्रोत बाद में उनकी कही गई बात पर विवाद करता है तो आपको इंगित करने के लिए कुछ देता है। किसी उद्धरण को एक बार प्राप्त करने के बाद उसे कितना साफ-सुथरा रखना है, चाहे हर गलत शुरुआत को बनाए रखना हो या शब्दों को साफ गद्य में सुचारू करना हो, उद्देश्यपूर्ण ढंग से चुनने लायक एक शैली विकल्प है, और संपादित शब्दशः प्रतिलेख बनाम पूर्ण शब्दशः प्रतिलेख दोनों परंपराओं को सामने रखता है।
DOCX एक्सपोर्ट टाइमस्टैम्प को इनलाइन रखता है। यदि आपको कच्ची संरचना की आवश्यकता है, तो JSON निर्यात आपको उच्चारण-स्तर का डेटा देता है, प्रत्येक प्रविष्टि एक प्रारंभ समय, समाप्ति समय, वक्ता और पाठ के साथ होती है, जिसे आप प्रोग्रामेटिक रूप से संसाधित कर सकते हैं। TXT एक्सपोर्ट साफ-सुथरी रीडिंग कॉपी है, और यदि साक्षात्कार एक वीडियो के नीचे होने वाला है तो SRT आपको समयबद्ध कैप्शन लाइनें देता है।
जानने लायक एक सीमा: टाइमस्टैम्प उच्चारण स्तर पर हैं, व्यक्तिगत शब्द नहीं। अधिकांश साक्षात्कार कार्यों के लिए बिल्कुल वही होता है जो आप चाहते हैं, क्योंकि आप एक वाक्य उद्धृत कर रहे हैं, कोई शब्दांश नहीं। यदि आपको फ़ुटेज पर उपशीर्षक जलाने के लिए विशेष रूप से शब्द-स्तरीय समय की आवश्यकता है, तो SRT लाइन समय लगभग हर उद्देश्य के लिए काफी करीब है।
सामान्य समस्याएं और उन्हें कैसे ठीक करें
अधिकांश साक्षात्कार रिकॉर्डिंग साफ-सुथरी रूप से प्रतिलेखित होती हैं। जब कोई चीज़ बंद होती है, तो यह लगभग हमेशा मुट्ठी भर समस्याओं में से एक होती है, और प्रत्येक का सीधा समाधान होता है।
एक वक्ता दो लेबल में विभाजित हो जाता है। यह सबसे आम अप्रत्याशित स्थिति है। आमतौर पर इसका मतलब है कि उस व्यक्ति की आवाज़ आंशिक रूप से बदल गई है: वे माइक के करीब या दूर चले गए, हेडसेट से स्पीकरफ़ोन पर स्विच हो गए, या कॉल पर लाइन की गुणवत्ता बदल गई। किसी आवाज की ध्वनि के आधार पर इंजन क्लस्टर करता है, इसलिए एक बड़े बदलाव को एक नई आवाज के रूप में पढ़ा जा सकता है। संपादक में दो लेबलों को मर्ज करें और इसे एक बार में ठीक कर दिया जाए, जैसा कि ऊपर दिए गए उदाहरण में है।
दो लोग एक लेबल में विलीन हो गए। इसका उल्टा। ऐसा तब होता है जब दो आवाजें सचमुच एक जैसी होती हैं, या जब रिकॉर्डिंग शांत होती है और अंतर सुनना मुश्किल होता है। तथ्य के बाद सफाई से इसे ठीक करना कठिन है, यही कारण है कि रिकॉर्डिंग के समय दो अलग-अलग इनपुट, प्रति व्यक्ति एक, इसके खिलाफ सबसे अच्छा बीमा है।
क्रॉसस्टॉक और लोग एक-दूसरे से बात कर रहे हैं। जब दोनों एक साथ बोलते हैं, तो कोई भी प्रतिलेखक, स्वचालित या मानव, संघर्ष करता है, क्योंकि ऑडियो में शब्द भौतिक रूप से ओवरलैप हो रहे हैं। अपेक्षा करें कि गर्मागर्म साक्षात्कार के सबसे व्यस्त क्षणों में मैन्युअल रूप से सुनने की आवश्यकता होगी। टाइमस्टैम्प उन क्षणों को त्वरित रूप से ढूँढने में सहायक होते हैं।
मजबूत उच्चारण या विशेषज्ञ शब्द। उच्चारण में सटीकता अच्छी होती है, लेकिन अपरिचित व्यक्तिवाचक संज्ञा, तकनीकी शब्दजाल और नाम ऐसे होते हैं जहां स्वचालित प्रतिलेखन के फिसलने की सबसे अधिक संभावना होती है। अपने साक्षात्कार के लिए विशिष्ट कुछ नामों और शब्दों के लिए एक खोज-और-प्रतिस्थापन पास करें और जो भी आप उद्धृत करना चाहते हैं उसकी पुष्टि करें। जब साक्षात्कार विशेषज्ञ शब्दावली से भरपूर एक नैदानिक या शोध वार्तालाप होता है, तो श्रुतलेख और साक्षात्कार के लिए चिकित्सा प्रतिलेखन कवर करता है कि उन शब्दों को कैसे संभालना है।
एक शांत या दूर की रिकॉर्डिंग। यदि विषय माइक से दूर था या धीरे से बोला गया था, तो सटीकता कम हो जाती है, और तथ्य के बाद कोई सॉफ़्टवेयर फिक्स नहीं होता है। इसी स्थिति को रोकने के लिए “रिकॉर्ड करने से पहले” अनुभाग मौजूद है। यदि आप कमजोर रिकॉर्डिंग में फंस गए हैं, तो इसे ड्राफ्ट के रूप में ट्रांसक्राइब करें, फिर ऑडियो के सामने सही करें।
एक बहुत लंबी या बड़ी फ़ाइल। एक रिकॉर्डिंग 10 घंटे तक चल सकती है, बिना फ़ाइल-आकार की सीमा के - यहां तक कि एक बहुत बड़ी रिकॉर्डिंग भी सीधे ब्राउज़र में तैयार की जाती है। केवल 10-घंटे की सीमा से अधिक की रिकॉर्डिंग को प्राकृतिक विराम का उपयोग करके विभाजित करें, फिर प्रत्येक भाग को ट्रांसक्राइब करें।
ऑडियो स्रोत या वीडियो स्रोत: कौन सा अपलोड करना है
यदि आपके पास एक ऑडियो फ़ाइल और एक ही साक्षात्कार का वीडियो दोनों हैं, तो दोनों में से किसी एक को अपलोड करें। प्रतिलेख समान है, क्योंकि Hushscript दोनों मामलों में ऑडियो से काम करता है। व्यावहारिक अंतर गोपनीयता है. जब आप इसे एक वीडियो देते हैं, तो ऑडियो आपके ब्राउज़र में निकाला जाता है और केवल वह ऑडियो भेजा जाता है, इसलिए वीडियो, अक्सर अधिक पहचानने योग्य और अधिक संवेदनशील कलाकृति, आपकी मशीन को कभी नहीं छोड़ती है। एक संवेदनशील साक्षात्कार के लिए यह बेहतर डिफ़ॉल्ट है। यदि आपके पास पहले से ही एक साफ़-सुथरी ऑडियो-केवल फ़ाइल है, तो उसे अपलोड करना सबसे सरल है।
संवेदनशील साक्षात्कारों को निजी रखना
कानूनी मामलों, गोपनीय स्रोतों, एचआर मामलों या व्यक्तिगत खुलासों से संबंधित साक्षात्कारों के लिए, ऑडियो को कैसे संभाला जाता है, यह ट्रांसक्रिप्ट गुणवत्ता से परे मायने रखता है। Hushscript बिल्कुल इसी के लिए बनाया गया है।
ट्रांसक्रिप्ट तैयार होते ही ऑडियो सर्वर से हटा दिया जाता है। इसमें कोई रिटेंशन विंडो नहीं है और रिकॉर्डिंग की कोई बैकअप कॉपी बाद में कहीं नहीं रखी जाएगी। यदि आपने कोई वीडियो अपलोड किया है, तो केवल निकाला गया ऑडियो ही भेजा गया था, और वह भी चला गया है। स्पीच इंजन आपकी रिकॉर्डिंग पर प्रशिक्षित नहीं होता है, इसलिए आपके द्वारा सबमिट किया गया कुछ भी एक मॉडल को फीड नहीं करता है।
प्रतिलिपियां बाकी समय में एन्क्रिप्टेड होती हैं। स्पष्ट शब्दों में, यदि भंडारण का कभी उल्लंघन हुआ, तो एक हमलावर को अपठनीय सिफरटेक्स्ट मिलेगा, न कि आपके विषय के शब्द। यह रिसाव सुरक्षा है, यह दावा नहीं है कि हम आपकी प्रतिलेख नहीं पढ़ सकते हैं: कुंजी हमारी तरफ रखी जाती है ताकि उत्पाद आपको अपना काम दिखा सके। इसका मतलब यह है कि डेटा लीक, किसी भी क्लाउड टूल के लिए यथार्थवादी खतरा, पढ़ने योग्य साक्षात्कार सामग्री को नहीं सौंपता है।
सबसे मजबूत मामलों के लिए, पत्रकारिता में स्रोत सुरक्षा, विशेषाधिकार प्राप्त कानूनी सामग्री, मानक सावधानी बरतें: ऑडियो की अपनी ऑफ़लाइन प्रतिलिपि और तैयार प्रतिलेख को अपने नियंत्रण वाले डिवाइस पर रखें, और किसी भी क्लाउड सेवा को एकमात्र प्रतिलिपि के रूप में न मानें, जिसमें यह भी शामिल है। यदि आप डेटा प्रबंधन की पूरी तस्वीर चाहते हैं, तो निजी ट्रांसक्रिप्शन पेज इसे प्रस्तुत करता है।
यदि आपकी रिकॉर्डिंग एक-पर-एक साक्षात्कार के बजाय एक मल्टी-होस्ट पॉडकास्ट है, तो वर्कफ़्लो समान है और पॉडकास्ट को कैसे ट्रांसक्राइब करें मल्टी-वॉयस को कवर करता है। विशेष.
स्वतंत्र स्रोत और मानक
Hushscript ने इन स्वतंत्र, गैर-प्रतिस्पर्धी स्रोतों का संदर्भ लिया है। ये शोध, मानकों या प्लेटफ़ॉर्म के काम करने के तरीके को समझाते हैं और Hushscript का समर्थन नहीं करते।
स्रोतों की समीक्षा: