如何轉錄 Podcast 並製作節目筆記
作者: Hushscript 發布: 最後審閱:
播客轉錄內容會獲得兩次保留。它使閱讀而不是聆聽的聽眾可以搜尋和存取該劇集,並且為您提供節目筆記、引述和字幕的原始資料,而無需重播整個錄音。平台支援是具體的,而不是理論上的:Apple 播客為創作者提供記錄和章節導航。本指南逐步介紹了轉錄劇集、標記每位主持人和嘉賓,以及將輸出轉換為可用的演出筆記文件。
最節省時間的部分是說話者分離。作為一個完整的文字區塊來閱讀的逐字稿幾乎與音訊本身一樣需要大量工作。 Hushscript 會自動標記每個聲音,並免費包含在每個記錄中,以便對話以對話形式傳回。
開始之前需要什麼
以任何常見的音訊或視訊格式錄製該劇集。如果您從編輯器匯出了純音訊檔案(MP3、WAV、M4A),則可以直接使用。如果您唯一的副本是來自 Zoom、Riverside 或 Ecamm 的視訊錄製,也可以,並且音訊是在瀏覽器中從中提取的,因此視訊永遠不會上傳。
乾淨的來源音訊比其他任何東西都更有幫助。當每個人的聲音都不同並且人們不會經常互相交談時,說話者標籤效果最好。如果您將每位參與者錄製在單獨的軌道上,則您已經擁有了最乾淨的輸入。單一混合曲目仍然有效;它只是更依賴說話者分離來區分聲音。如果可以的話,錄製乾燥的聲音,然後在編輯器中添加音樂床,因為連續語音下運行的叮噹聲會可靠地降低準確性。
您將需要一個帳號來轉錄完整的劇集。 30 秒預覽是無帳戶步驟,因此您可以在註冊任何內容之前檢查實際文件中的說話者標籤和文字品質。
轉錄劇集
流程遵循真實的漏斗順序:先預覽,然後註冊,然後轉錄其餘部分。
- **將檔案拖曳到 /podcast-transcription。**Hushscript 會在瀏覽器中剪輯前 30 秒,並傳回帶有說話者標籤的預覽。此步驟不需要帳戶。您可以準確地看到主持人和嘉賓如何分開,以及您自己的音訊中的文字讀起來有多乾淨。
- **註冊以轉錄其餘內容。**輸入電子郵件並登入後,即可上傳完整集數。新帳戶可免費試用 30 分鐘,並授予一次。最快的領取方式是一張 1 美元的卡支票,經過授權後立即發放,無需付費。如果您喜歡您所在國家/地區可用的其他付款方式,則您首次購買時將在 30 分鐘內完成;不需要卡片。
- **讓轉錄運行,然後匯出。**轉錄結果會在每個話語上帶有標籤和時間戳記。將要編輯到節目註釋中的文件匯出為 DOCX,匯出為可貼上到 CMS 中的乾淨區塊的 TXT,將視訊版本上的字幕匯出為 SRT,如果您的播客主持人接受話語級別的逐字稿上傳,則匯出為 JSON。
30 分鐘免費時間可以涵蓋一小集或較長劇集的代表性部分。 60 分鐘的劇集會佔用您 60 分鐘的餘額,因此需要在試用限額後充值。
為每位主持人和嘉賓新增標籤
說話者分離會自動運行,因此您無需開啟任何裝置。對於兩人的劇集(一名主持人,一名嘉賓),逐字稿會清晰地分開,每一行都歸屬於兩個標籤之一。對於面板,Hushscript 會分離出聽到的盡可能多的不同聲音,且沒有說話者上限。
要將通用標籤替換為真實姓名:
- 在編輯器中按任意
說話者 A實例。 - 鍵入姓名,例如「Alex」或「Host」。
- 該標籤的每個實例都會在整個記錄中立即更新。
您可以為每個語音重新標記一次,而不是逐行重新標記。兩人劇情大約需要一分鐘;四人小組需要幾個人。重新標記後,一段文字內容如下:
Alex [00:03:12]:所以當時你正在經營公司。第一個跡像是什麼?
Jamie [00:03:19]:老實說,是數字。我們在一個季度內下降了 40%。
Alex [00:03:27]:當時你無法解釋嗎?
Jamie [00:03:35]:好幾週都沒有。這是讓我堅持不懈的部分。
這是提取引用和編寫帶有時間戳的章節所需的結構。由於標籤貫穿整個文件,因此長劇集只會被標記一次。有關語音分離背後的機制,請參考說話者分離的工作原理。
何時需要修復標籤
說話者分離在乾淨的錄音上是準確的,但並非萬無一失,有幾個模式值得了解,以便您可以快速糾正它們。
如果兩位嘉賓的聲音非常相似,有時線路可能會落在錯誤的說話者上。在開啟音訊的情況下掃描逐字稿,並手動重新分配幾行錯誤的行。這比從頭開始輸入說話者姓名要快得多,因為您只是修復異常情況。
如果一個幾乎不說話的安靜的共同主持人被合併到另一個標籤中,請先給出主要說話人的真實姓名,然後掃描應該屬於安靜聲音的幾行。在分離良好的錄音中,您很少會遇到這兩種情況,這就是為什麼每個人單獨的軌道值得在錄音時進行少量額外設定的原因。
常見問題以及實際導致這些問題的原因
大多數轉錄問題都可以追溯到錄音,而不是工具。在發布節目之前,有一些值得計劃。
**串擾和人們互相交談。**這對任何說話者分離系統來說都是最困難的事情,因為同一時刻的兩個聲音無法乾淨地分開。文字通常保持可讀性,但一時的嚴重重疊可能會落在一個說話者上或在接縫處變得模糊。良好的播客衛生在這裡已經有所幫助:讓客人完成的主持人會產生更清晰的記錄,作為副作用。如果確實發生這種情況,請根據音訊手動修復這幾行內容。
**錄製在一個軌道上的遠端來賓。**記錄為單一混合檔案的通話比擷取為每個參與者的軌道的相同通話更難區分。如果您的工具支援本地每個參與者錄製,請使用它;如果您只有混合文件,逐字稿仍然可以通過,它只是更依賴說話者分離。無論哪種方式,音訊都是相同的上傳內容,因此在轉錄時沒有什麼不同。
**重音口音和代碼切換。**Hushscript 會自動偵測語言並轉錄大約 99 種語言,其中 18 種語言的準確度最高,因此可以很好地處理使用受支援語言的帶有明顯口音的客人。一位客人在句子中途在兩種語言之間切換是真正困難的情況;期望手動清理交換的短語。有關受支援語言的完整列表,請參閱語言頁面。
**介紹音樂和 Stingers。**片段之間的音樂床通常會被跳過,而不是轉錄為廢話。只有當音樂長時間在連續講話的情況下播放時,才會出現問題。乾淨的解決方法是編輯:錄製乾燥的聲音,然後放入音樂,因此轉錄只能看到語音。
**名稱、行話和品牌拼字。**專家嘉賓將使用模型可能以語音方式呈現的術語和產品名稱。這些問題很快就能修復,因為它們會重複,並且匯出文件上的搜尋和替換可以一次處理重複出現的拼字錯誤。
一些準確度提示
最大的槓桿是錄音品質,因此在麥克風和安靜的房間上花費的精力在轉錄時得到了回報。除此之外,每個說話者的軌道都可以提供最乾淨的文字和最乾淨的說話者標籤,因為系統永遠不需要從一個波形中解開兩個聲音。保持客人的麥克風靠近並保持一致而不是漂移,這樣您就可以將編輯時間花在實質內容上而不是修復上。
當您進行校對時,請在打開音訊的情況下閱讀並逐步修復:首先是說話者標籤,然後是聽錯的名稱和行話,然後是偶爾的重疊。按類別工作比從上到下閱讀要快,而且它會讓您獲得足夠清晰的文件以供發布。
從記錄到節目筆記
節目筆記並不是所有內容的摘要。它們是聽眾的導航輔助工具,也是尚未按下播放鍵的人的搜尋介面。適用於大多數訪談和對話的結構如下:
**情節摘要,兩到四個句子。**從記錄中擷取核心主題。中心論點、故事或重點是什麼?為決定是否要聽的人編寫。
**有時間戳記的章節。**掃描逐字稿以了解主題變化。每次談話轉向新主題時,記下時間戳記並寫下一行描述。時間戳直接來自逐字稿,因此您永遠不會重新聆聽來找到它們。
[00:02:15] 在沒有行銷預算的情況下創辦公司
[00:14:30] 40% 的收入下降及其原因
[00:28:44] 重建:內部發生了什麼變化
[00:51:00]給處於同一職位的創始人的建議
**關鍵引述。**提取兩到三行文字來捕捉這一集的主要主張或最受引用的時刻。逐字引用逐字稿並註明說話者的姓名。是否要完全按照所說的進行引用,還是修剪填充物和錯誤的開頭以獲得更清晰的節目筆記,這是一個值得特意做出的決定,清稿逐字稿與完整逐字稿遍歷了這兩者。由於文字是可搜尋的,因此找到您記不清的一行的確切措辭只需幾秒鐘。
**訪客連結和資源。**新增訪客提到的任何內容。要快速找到語音 URL,請在逐字稿中搜尋「dot com」或「斜線」等片段;人們大聲說出網址的頻率比您想像的要高,逐字記錄會擷取它們。
**完整記錄,可選但有價值。**將全文貼在註釋下方或連結到單獨的錄音頁面。這就是搜尋價值所在,因為口頭內容變得可索引。如果您的主機平台接受逐字稿上傳,則 JSON 匯出會攜帶話語級資料;否則純文字就足夠了。
一個可行的範例
假設您將一段 58 分鐘的創辦人訪談錄製為兩首曲目,並將它們混合成一個 MP3。您將 MP3 放到 /podcast-transcription,觀看 30 秒的預覽,正確劃分主機和訪客,註冊並上傳完整文件。筆錄回傳有說話者 A和說話者 B;點擊兩次即可將它們重命名為「Alex」和「Jamie」。從那裡開始,摘要來自開頭的兩分鐘,上面的四章來自掃描主題轉移,兩個引述來自搜尋文字中你記得的時刻。從開始到完成的演出筆記大約需要十五分鐘,其中大部分是您自己編輯的,而不是等待或轉錄。
新增字幕或副標題
如果您將劇集的影片版本發佈到視訊主機、Spotify 影片或 LinkedIn 等平台,則 SRT 匯出是一個可供上傳的定時字幕檔案。沒有額外的步驟,因為您已經產生的逐字稿帶有計時資料。有關將字幕添加到剪輯上的更廣泛的工作流程(包括內建文件與附加文件),請參閱如何為影片添加字幕。
如果您的起點是視訊錄製而不是音訊匯出,則過程是相同的;首先在您的瀏覽器中提取音訊。 影片到文字頁面完整地涵蓋了該路徑。
長集和多部分劇集
對於長集或現場錄音,Hushscript 最多可以上傳 10 小時,沒有檔案大小限制。四小時的專題小組或紀錄片格式的劇集作為一個文件進行播放,而不是分成幾塊,這很重要,原因有二。講話者標籤在整個文件中保持一致,因此您可以重新標記一次。而且時間戳記是連續的,因此三小時標記處的一章顯示為“[03:12:40]”,而不是第二部分從零重新開始。
如果您在一個會話中錄製多部分系列,請將整個會話轉錄為單個文件,然後按部分拆分節目筆記。首先剪切音訊只會增加重新標記的工作量。
為什麼這會變得更快
對於常規的發布節奏,每週一次或每週兩次,一旦完成幾次,轉錄到節目筆記例程就會壓縮到每集幾分鐘的時間:拖入檔案,重新標記說話者,掃描章節,引用,匯出。說話者標籤免費進行歸因,從而消除了繁瑣的部分。您將時間花在節目筆記實際需要的編輯判斷上,而不是弄清楚誰說了什麼。
獨立來源與標準
Hushscript 參考了這些獨立且非競爭性的資料來源。它們用於說明研究、標準或平台運作方式,並不代表其為 Hushscript 背書。
來源審閱日期: