部落格
清稿逐字稿與完整逐字稿:實際差異
作者: Hushscript 發布: 最後審閱:
完整逐字稿會完整保留每個填充詞、錯誤開頭與重複,完全按照原話呈現:這是完整、逐字的記錄。清稿逐字稿則會移除這些內容以提高可讀性,同時保持意思不變。大家搜尋「清稿逐字稿與完整逐字稿」時,常會看到這種答案:選一套只提供其中一種模式的轉錄工具,然後接受它的限制。Hushscript 的做法不同:免費的 AI 清理會在未經更動的原文旁,完整寫出一份純淨版,因此清稿逐字稿與完整逐字稿不是來自兩種工具的兩種不同輸出,而是同一份逐字稿的兩個分頁,您可以隨時在兩者之間切換。
| 完整逐字稿 | 清稿逐字稿 | |
|---|---|---|
| 保留內容 | 每個填充詞、錯誤開頭與重複,完全按照原話 | 意思、用詞與說話者標籤;已移除不流暢用語 |
| 範例 | 「我認為,我認為我們應該,我們可能應該等待」 | 「我認為我們可能應該等待」 |
| 位置 | 原文分頁(永不更動) | 純淨版分頁(完整重寫) |
| 費用 | 一律包含在內 | 首次 Insights 生成免費;之後重新生成需要花費分鐘數 |
「逐字記錄」意味著無條件
不合格,“逐字記錄”意味著完整的、字面的記錄:每一個“嗯”,每一個錯誤的開始,每一個重複的單詞,都與所說的一模一樣。真正的機構使用更精確的標籤:英國議會將 Hansard 描述為「基本上逐字記錄」,而美國國家公園管理局則告訴口述歷史計畫,要自行決定該多完整地呈現說話的方式。在 Hushscript 中,原文逐字稿是未經清理的來源。選用的清理絕不會覆蓋它,依賴精確措辭的工作應始終對照錄音核實。
「乾淨」修剪的內容以及保留的內容
清稿逐字稿刪除頁面上沒有意義的詞性:填充詞、錯誤的開頭、口吃、精確的重複。 「我認為,我認為我們應該,我們可能應該等待」變成「我認為我們可能應該等待」:同樣的聲明,更容易閱讀,沒有添加任何內容,也沒有刪除任何實質內容。清理不會改寫單字選擇,軟化某人所說的話,或糾正不流暢本身之外的語法;這是一個可讀性通行證,而不是社論通行證。
為什麼您不必預先選擇一個
有些清理流程只提供清理後的匯出檔,之後很難檢查工具到底改了什麼。Hushscript 兩者都保留:選擇「產生 Insights」會在專屬分頁中產生完整重寫的純淨版,而原文則維持轉錄時的原貌。您可以切換分頁,以任一種風格閱讀同一段內容;當某一行很重要時,在依賴它之前,先對照原文與錄音核實。
純淨版實際上是如何運作的
清理會以完整的逐字稿內文形式送達,位於專屬的「純淨版」分頁中,與原文及任何翻譯並列。這是為了可讀性而做的整體重寫,而不是逐字列出的修改清單:填充詞、說到一半重來的片段和精確重複的內容全部被移除,同時意思、用詞和說話者標籤都會保留。純淨版分頁和任何逐字稿一樣可以編輯:您可以手動修正、使用尋找及取代,編輯出錯時也能靠復原、重做和還原補救。而如果您在純淨版已經存在的情況下嘗試編輯原文,編輯器會先要求確認,確保逐字記錄不會被意外更動。
原文永遠不會被更動
產生清理並不會動到原文:它仍然是完整的逐字記錄,匯出和引用依然可以取自原文。您不需要事先為整份文件選擇清稿或完整逐字,也不會覆蓋您唯一的一份副本;逐字稿的兩種狀態都會保留,您可以依任務決定要閱讀、編輯或匯出哪一個。之後改變主意,另一個版本依然還在。首次 Insights 生成(包含清理)是免費的;之後重新生成則需要花費分鐘數(從原文重新開始需要錄音長度的 40%,從您目前的純淨版更新則需要 30%),確認前都會先顯示費用。
一個有效範例
一位 Podcast 主持人正在整理一集兩小時的逐字稿,準備用於節目筆記,並希望內容容易閱讀:全篇刪除填充詞與說到一半重來的片段,從頭到尾都是清稿逐字稿。他們產生一次 Insights,免費,整集內容就會以重寫過的樣貌出現在純淨版分頁中;節目筆記和文章草稿都取自那裡。不過,其中一段對話涉及來賓對某個敏感主張的精確措辭,主持人希望那句話連同填充詞都完全按照原話保留,以防日後被引用。原文中這段內容仍完好保留:他們把原文分頁裡那句逐字的話複製到純淨版中,讓那一句維持完整逐字稿,其餘內容則維持清稿。一份逐字稿、兩種標準,各自用在真正需要的地方。
它所在的位置
清理作為可選的免費Insights結果的一部分提供。選擇“產生Insights”,純淨版會以完全重寫的樣貌送達,而非逐項核准的建議清單:您可以將它與原文比較、編輯,或隨時還原。它與說話者識別一起工作,而不是取代它。清理會改變措辭,而不是誰在說話,因此重新標記的說話者和清理後的話語位於同一個記錄中,不會發生衝突。
獨立來源與標準
Hushscript 參考了這些獨立且非競爭性的資料來源。它們用於說明研究、標準或平台運作方式,並不代表其為 Hushscript 背書。
來源審閱日期: