如何讓轉錄工具識別自訂詞彙
作者: Hushscript 發布: 最後審閱:
通用語音引擎對於產品代號、地區姓氏或您的團隊在會議中使用十次的內部首字母縮寫詞的上下文較少。研究稱這種將識別轉向預期術語的技術語境偏差,2025 W3C 網路語音會議將其描述為 Chrome 中的一項功能。 Hushscript 將這個想法轉化為四種詞彙控件,從一個檔案的一次性添加到可重複使用的常設設定。
自訂詞彙最有幫助的地方
三個類別導致通用模型的大部分辨識失敗。人們的名字是第一位的,尤其是那些不是最常見變體的拼寫。模型無法猜測音訊是否為“Nguyen”或接近同音字,除非有資訊告訴它正在使用該名稱。其次是產品和品牌名稱:像「FlowBridge」這樣的名稱聽起來就像兩個普通單詞,而不是特定公司選擇的專有名詞。第三種是內部術語和縮寫:這些術語僅表示一個團隊或產業內部的某些內容,一般詞彙不會包含這些術語。臨床實踐的藥物和程序名稱在更大範圍內是相同的問題,醫學轉錄使用專用模式與這些詞彙工具一起處理這個問題。在會議中重複十次的縮寫詞要么抄寫錯誤十次,要么抄寫正確十次;沒有部分功勞,因此在關鍵術語列表或字典中修復一次就會自動修復該文件中的每個出現位置。
對於單一文件:關鍵術語和自訂提示
如果您要轉錄一份不尋常的錄音並且不需要永久設定,請將關鍵術語直接添加到該作業中。僅針對該文件,多達 1,000 個關鍵術語(名稱、品牌、首字母縮略詞)會使識別偏向於您實際所說的單字。除此之外,最多 2,000 個字元的自訂提示為引擎提供了單獨音訊無法提供的上下文:誰在講話、錄音涵蓋的內容、特定於情況的術語。工作結束後,兩者都消失了;除非您再次添加,否則不會保留到下一個文件。
對於重複性工作:已儲存的字典和提示預設
如果一個又一個檔案中出現相同的名稱和行話,則一次性清單不再值得重新輸入。保存的字典解決了以下問題:從 CSV 或 TSV 文件批量導入術語,將它們組織成類別,並將拼寫變體附加到每個規範術語,以便識別“McAllister”,無論源音訊聽起來像“MacAlister”還是“McAllaster”。提示預設的工作方式與上下文相同,可以儲存您每次都需要重新輸入的背景。將字典或預設標記為預設值,下次轉錄時會自動預先選擇它,因此站立式設定不需要在每個檔案上重新選擇。
它們結合在一起,不會互相替換
站立式字典和一次性添加不是兩個選項之間的選擇;而是一種選擇。他們一起申請同一份工作。保留團隊產品名稱的預設字典和描述您的錄音通常內容的預設提示,然後為僅與本週文件相關的來賓姓名添加一次性關鍵術語。站立式設定涵蓋了重複出現的詞彙;一次性添加內容涵蓋了該錄音的具體內容。任何一方都不必考慮對方已經處理的內容。
它不涉及的內容
四種形式中任何一種的自訂詞彙都會決定引擎在轉錄時聽到的內容,並且不會配置後續的 Insights 作業。Insights與所產生的逐字稿相對應。因此,儘早掌握詞彙可以改進 Insights 讀取的源文字,而無需更改 Insights 產生的內容。
一個有效範例
每周播客每集採訪不同的嘉賓,但始終按名稱涵蓋相同的三個產品線。主持人會建立一個已儲存的字典,從產品名稱和團隊自己的名稱的電子表格中匯入,按照節目實際所說的方式拼寫,並將其標記為預設值。每週的劇集都會自動受益。對於那週的客人,常設字典沒有理由知道一個名字,主持人在上傳之前添加了一個特定於該文件的關鍵術語。常設字典和一次性關鍵術語都適用於同一份逐字稿,並且不需要相互接觸。
設定位置
詞彙選項與音訊轉文字上的其他每個檔案設定並存,無論您是向單次上傳新增一次性關鍵術語,或是管理已儲存的字典以進行重複性工作。無論 Hushscript 在錄音中自動偵測大約 99 種語言中的哪一種,它們的運作方式都是相同的,並且 語言頁面 具有完整列表,以及哪些語言具有頂級準確性。有關在擔心詞彙量之前獲取轉錄內容的更多資訊,請參閱如何轉錄播客以了解此示例中的重複訪客工作流程。
獨立來源與標準
Hushscript 參考了這些獨立且非競爭性的資料來源。它們用於說明研究、標準或平台運作方式,並不代表其為 Hushscript 背書。
來源審閱日期: