「將音訊翻譯為文字」:實際意義
作者: Hushscript 發布: 最後審閱:
「將音訊翻譯為文字」是涵蓋兩個不同工作的搜尋字詞。大多數打字的人都有他們理解的語言的音訊,並且希望將演講內容寫下來。較小的群體擁有他們不會說的語言的音訊,並且想要另一種語言的含義。第一項工作是轉錄。第二個在頂部新增翻譯。知道您真正需要哪一個可以避免很多混亂,因為工具和步驟並不相同。
本指南釐清了兩者,展示瞭如何轉錄另一種語言的音訊,並解釋了當您真正需要翻譯時該怎麼做。 Hushscript 可以傳回相同語言的逐字稿,也可以轉錄來源音訊並在您上傳之前選擇這些目標時新增選定的目標語言翻譯。翻譯是上傳選項的一部分,而不是轉錄視圖中的事後切換。
轉錄與翻譯
轉錄將語音轉換為相同語言的文字。你有一個英文採訪錄音,你會得到一份英文文字文件。您有一個法語播客,並且您將獲得一份法語逐字稿。頁面上的文字就是所說的文字。語言不會改變。
翻譯將文字從一種語言轉換為另一種語言。法文文字變成英文文字。它以文字而非聲音為基礎,並且需要了解原始語言和目標語言。歐盟委員會將翻譯與口語翻譯區分開來;同樣的區別有助於解釋為什麼「將音訊翻譯為文字」可以隱藏兩個單獨的工作。
那麼為什麼很多人在表示轉錄時會說「翻譯」。這個詞的使用很寬鬆,就像有人說他們需要將 PDF「翻譯」成 Word 文件,而實際上他們只是指轉換格式。從音訊到文字的感覺就像在兩種媒體之間進行翻譯,儘管語言沒有改變。這種非正式的使用是這個搜尋短語如此常見的原因,也是為什麼大多數輸入它的人都在尋找轉錄工具的原因。
快速判斷您需要哪項工作的方法:您能聽懂錄音嗎?如果可以的話,並且您只想將其寫下來,那就是轉錄。如果你聽不懂,但你想用自己的語言表達意思,那就是轉錄,然後翻譯。
同語言音訊就是轉錄
如果你有英文錄音,你想要它作為文字,那就是轉錄。如果您有西班牙語錄音並且想要西班牙語逐字稿,這也是轉錄。你沒有改變語言。您正在更改頁面上的格式,從聲音到文字。
這是搜尋背後最常見的意圖,這正是 Hushscript 建構的目的。從開始到結束,其工作原理如下。
- 將檔案拖曳到 /audio-to-text。 30 秒、帶有說話者標籤的預覽會直接在瀏覽器中呈現,無需帳戶,因此您可以在進行任何操作之前查看品質。
- 使用您的電子郵件註冊以轉錄其餘部分。前 30 分鐘免費,授予一次。添加卡是最快的途徑:一美元的保留確認該卡,然後立即清算並且永遠不會收費。如果您想使用您所在國家/地區可用的其他付款方式,則免費分鐘數會在您首次購買時獲得。無論哪種方式都不需要卡片。
- 上傳完整檔案。如果是影片,則首先在瀏覽器中提取音訊,因此影片本身保留在您的設備上,只有音訊到達伺服器。
- 選擇轉錄選項。將來源語言保留為自動偵測或自行選擇,然後在上傳之前選擇任何目標語言翻譯(如果需要)。
- 閱讀、重新標記和匯出。將「說話者 A」重新命名為真實姓名,然後以 21 種匯出格式(TXT、SRT、VTT、DOCX、PDF 等)中的任何一種格式或以受密碼保護的 .husharchive 形式下載逐字稿。翻譯後的逐字稿顯示為語言選項卡,並且可以按語言匯出。
無論使用何種語言,說話者標籤和時間戳都會自動返回。如果您在上傳之前沒有選擇翻譯目標,則您獲得的逐字稿將採用與音訊相同的語言,因為這就是轉錄的作用。
實例
假設您錄製了與一位講葡萄牙語的同事的 40 分鐘採訪,並且你們都聽得懂葡萄牙語。您想要一份書面記錄以供稍後引用。
您將文件放在 /audio-to-text 處,預覽顯示前半分鐘,已分為說話者 A 和說話者 B。口音和葡萄牙語清晰可見,因此您註冊並上傳整個錄音。作業完成後,您將獲得一份以說話人身分區分的葡萄牙語逐字稿,內容如下:
說話者 A [00:02]: Então, conta-me como começou o projeto。 說話者 B [00:05]: Começou quase por acaso, no ano passado。
您將說話者重新命名為實際名稱,匯出為 DOCX 或其他格式,然後就完成了。任何時候都沒有改變語言。這是一項純粹的轉錄工作,「將音訊翻譯為文字」一詞描述了大多數情況。
現在更改一個細節。假設您不會說葡萄牙語,但需要用英語進行面試。在開始完整上傳之前,您選擇英文作為翻譯目標。作業完成後,葡萄牙語源逐字稿和英語翻譯逐字稿將顯示為單獨的語言選項卡,您可以匯出其中一個。
當您真正需要翻譯時
如果您有自己不會說的語言的音訊、法語採訪、德語演講或西班牙語錄音,並且您想要英語內容,同樣的區別仍然很重要:必須先轉錄音訊,然後才能翻譯文字。
在 Hushscript 中,您可以在開始完整上傳之前選擇此選項。將來源語言保留為自動偵測或自行選擇,然後新增所需的目標語言。該應用程式會在上傳前顯示估計的計費分鐘數,因為翻譯目標會增加計費分鐘數。如果您跳過目標語言,作業將只傳回相同語言的逐字稿。
作業完成後,您將獲得來源逐字稿以及翻譯後的逐字稿作為語言標籤。開啟您需要的選項卡,並以您需要的 21 種格式(包括 TXT、SRT 和 DOCX)中的任何一種匯出該語言,或匯出為受密碼保護的 .husharchive。對於任何具有法律、醫學、新聞或出版重要性的措辭,請在依賴之前讓翻譯人員檢查翻譯後的逐字稿。
關於匯出的一個實用注意事項:選擇與下一步相符的格式。 TXT 對於純文字審查來說是乾淨的,DOCX 或 PDF 更容易與人共享,SRT 或 VTT 用於字幕,CSV 和 JSON 對於結構化工作流程非常有用,Markdown 對於筆記或發布草稿來說非常方便。逐字稿中的說話者標籤告訴審閱者誰在說話,這消除了訪談中常見的猜測來源。
要明確界限:轉錄和翻譯仍然是不同的工作,即使一次上傳可以同時要求這兩種工作。 Hushscript 首先需要來源逐字稿,然後它可以提供您在上傳之前選擇的目標語言逐字稿。這種分離很有用,因為它告訴您在發生錯誤時要檢查哪些內容:來源轉錄、翻譯選項卡或兩者。
如果您的原始語言碰巧超出了 Hushscript 支援的大約 99 種語言,則第一步需要不同的轉錄工具,然後從那裡進行翻譯。
為什麼差異很重要
將轉錄和翻譯視為同樣的事情會導致一些可預見的錯誤。
上傳西班牙語音訊而不選擇目標語言,您將獲得西班牙語文字,因為這是轉錄產生的。上傳前選擇英語,Hushscript 可以在西班牙語來源逐字稿旁邊添加英語翻譯逐字稿。無論哪種方式,最終英語的品質取決於兩個因素疊加在一起:西班牙語轉錄的準確程度以及翻譯的準確程度。第一階段的錯誤仍然可能成為第二階段的錯誤。
這就是為什麼這種差異很重要。透過可見的原始程式碼和翻譯選項卡,您可以檢查問題是否來自轉錄或語言變更。隱藏這兩個階段的工作流程會讓這一切變得更加困難。
對於快速要點、簡短的非正式電子郵件或大致了解所說內容,機器翻譯可能就足夠了。對於法律訴訟、新聞、正式文件或任何需要錯誤用詞的內容,請查看來源記錄並讓人工翻譯檢查最終措辭。
準確性和品質提示
乾淨的錄音在任何語言中都能更好地轉錄,這比語言本身更重要。讓麥克風靠近說話者,在安靜的地方錄音,並要求人們不要互相交談。麥克風距離和背景噪音對結果的影響遠大於您使用的大約 99 種語言中的哪一種。
單語言錄音是最簡單的。如果說話者在句子中途在兩種語言之間切換,那麼任何引擎都很難跟上,而且逐字稿可能會在它們之間滑動。如果可以的話,將一份錄音保留為一種語言。如果對話確實自始至終都是雙語的,那麼在翻譯之前,請仔細閱讀並手動修改一些內容。
專有名詞值得再看一次。人名、地名和公司名稱是筆錄中最容易出現輕微錯誤的地方,其中的一個小錯誤可能會導致以後的翻譯失敗。在文字進入翻譯階段之前,瀏覽一下轉錄內容並在音訊仍清晰可見時進行修正。
如果您在上傳之前選擇目標語言翻譯,則來源轉錄內容的準確性將為下游所有內容設定上限。花時間獲得乾淨的錄音和檢查逐字稿會得到雙倍的回報,因為任何翻譯的逐字稿只能與其背後的源文字一樣好。
選擇你的路徑
使用它來快速做出決定。如果您理解音訊並希望將其寫下來,請將其轉錄並停止;您完成了。如果您聽不懂音訊並希望了解您語言的含義,請在上傳前選擇翻譯目標,然後在作業完成後查看原始檔案和翻譯標籤。如果您需要快速了解大致要點並且準確性並不重要,機器翻譯可能就足夠了。如果準確性至關重要,請檢查轉錄內容並讓人工審核翻譯後的措辭。
在每一條路徑中,轉錄步驟都是基礎,也是 Hushscript 的開頭部分:使用大約 99 種語言將說話者分開的來源轉錄內容,自動偵測或在上傳前選擇。
如果您的情況是常見情況,則提供您理解的音訊您只是想寫下來,那麼 /audio-to-text 就是工具。拖入檔案,預覽前 30 秒,註冊並匯出記錄。有關涵蓋每種檔案類型的逐步說明,請參閱如何轉錄任何音訊檔案。如果您想先了解將語音轉換為文字的技術,語音到文字:它是如何運作的會清楚地解釋它。
獨立來源與標準
Hushscript 參考了這些獨立且非競爭性的資料來源。它們用於說明研究、標準或平台運作方式,並不代表其為 Hushscript 背書。
來源審閱日期: