跳至主要內容

說話者辨識:逐字稿自動標記發言人

Hushscript 自動區分錄音中的每位說話者––業界稱為 speaker diarization(說話者分離)––並標記誰說了什麼。免費提供,不設付費門檻。

拖放音訊或影片檔案以預覽轉錄內容

前30秒 · 免費 · 無需帳號 · 檔案保留在您的瀏覽器中

選擇檔案

或貼上音訊檔案的直接連結 – 也支援 Dropbox、Google Drive 和 OneDrive 的共用連結。 連結匯入的運作方式

使用方式

  1. 01

    上傳多人對話錄音

    任何音訊或影片格式––直接拖放,我們會自動轉換並轉錄,最長 10 小時,沒有檔案大小限制––大型影片與音訊會直接在瀏覽器中準備。

  2. 02

    自動區分並標記每個聲音

    Speaker diarization 自動執行,無需額外步驟,無需付費附加功能。

  3. 03

    重新命名說話者並匯出

    一鍵將「說話者 1」改為真實姓名,適用於整份逐字稿。以 21 種格式匯出,包括 TXT、SRT、VTT、DOCX、PDF,或密碼保護的 .husharchive。

什麼是 speaker diarization(說話者分離)?

Speaker diarization 會判斷誰在何時說話。您獲得的不是整段文字,而是按說話者分割的逐字稿––這正是需要自行梳理的文字,與可以直接閱讀的內容之間的差別。沒有它,一段 45 分鐘的訪談會呈現為一整段不間斷的文字;有了它,每一行都清楚歸屬,讓您可以直接略讀到某人說過的內容。

自動說話者辨識的工作原理

Hushscript 會區分錄音中的每個聲音並自動加上標記,不需要尋找任何切換選項,也不需要額外步驟。訪談會歸屬於訪問者與受訪者;會議會歸屬於每位參與者;多位來賓的 Podcast 則會保持每個聲音各自獨立。即使是長時間的錄音,同一個聲音從第一分鐘到最後一分鐘都會維持相同標記,讓您不必猜測結尾出現的「說話者 2」是否與開頭的「說話者 2」是同一個人。

重新命名、標記與修正說話者

第一個標記通常不是最終版本。將「說話者 1」改為真實姓名,這項變更會在一次編輯中套用到整份逐字稿,不需要手動逐一尋找每個位置。為日後想再次查找的段落加上標籤,若 diarization 曾錯誤地拆分或合併兩位說話者,尋找及取代可以一次抓出逐字稿中所有標記錯誤的行,而不必逐一修正。一段 40 分鐘的訪談中,若某位說話者在中段兩分鐘內被誤標,只需要一次尋找及取代加上重新命名即可解決,不必重新上傳;編輯器正是為這類快速修正而設計,而非用於整份重新轉錄。

多聲道:當說話者已預先分開

有些錄音在錄製時就已經預先分開,例如某些通話錄音裝置會將雙方各自放在獨立的音訊聲道上。開啟多聲道後,Hushscript 會直接使用這些聲道區分說話者,而非僅從音訊本身推斷是誰在說話,在聲道本就已經分離的情況下,效果會更穩定。這種情況最常出現在通話錄音、部分網路研討會平台,以及已為每位參與者提供獨立聲道的專用訪談錄音裝置上。這是一個選項,而非必要條件:一般的單軌錄音可以保持關閉,自動 diarization 會照常接手處理。

說話者名稱會延續套用到整個工作流程

當您選擇「產生 Insights」時,一次可選的免費執行會建立與目前逐字稿修訂版本綁定的完整結果,包括摘要、行動項目、決定、未決問題、引文、章節、講者主題、主題群組、匯出建議、術語與不雅用語檢查,以及清理建議。請在「編輯」分頁檢查清理內容,只套用您批准的變更。

為何不收費

許多工具會將說話者區分鎖在付費方案裡,或限制可辨識的說話者數量。我們不這麼做:每份逐字稿都免費提供,因為沒有這項功能的逐字稿只有一半的用處。您付費的是轉錄本身;說話者標籤則是隨附贈送,不另外收費。

訪談、會議與 Podcast,標記後更好讀

只要有一個以上的人說話,說話者標籤就能發揮最大作用。單人訪談會呈現為訪問者與受訪者之間乾淨俐落的一問一答,而不是需要您自行歸屬的一整片文字。五人會議會呈現為五個清楚分開的聲音,讓您能分辨誰承諾了什麼。多位來賓的 Podcast 集數,即使歷經一小時的交疊發言,也能讓每位來賓保持獨立,這在您日後為節目摘要摘錄金句時特別重要。→ Podcast · 音檔轉文字

隱私設計

音訊於逐字稿生成後刪除。逐字稿靜態加密––即使資料洩露也只會暴露密文,而非您的文字。

為何選擇 Hushscript

免費提供

每份逐字稿均含說話者標籤––不設付費門檻。

一鍵重新標記

立即將任何說話者名稱更改至整份逐字稿。

無說話者數量上限

多位說話者自動區分,無付費上限。

常見問題

什麼是 speaker diarization(說話者分離)?

這是識別誰在何時說話並將錄音分割為不同說話者的步驟––讓逐字稿呈現為有標記的對話,而非整段文字。

可以處理多少位說話者?

錄音中的多位說話者自動區分;無付費說話者數量上限。

可以重新命名、標記或修正說話者標籤嗎?

可以。在編輯器中一鍵將「說話者 1」改為真實姓名並套用至整份逐字稿,為區段加上標籤以便日後查找,若 diarization 誤判某一行,也可使用尋找及取代修正。

什麼是多聲道模式?

適用於已將每位說話者分開至獨立音訊聲道的錄音,例如某些通話錄音裝置。開啟後,diarization 會直接使用這些聲道區分說話者,而非從音訊本身推斷。

需要額外付費嗎?

不需要。每份逐字稿均免費提供說話者標籤。您付費的是轉錄本身,而非額外的標籤功能:30 分鐘免費,透過信用卡驗證解鎖(暫收 $1,立即釋放,從不收費),之後按使用量付費。

轉錄後音訊會被保留嗎?

不會––逐字稿生成後立即刪除。逐字稿靜態加密,即使資料洩露也只會暴露無法辨識的密文。

從 30 分鐘免費額度開始

開始––30 分鐘免費