跳至主要內容

部落格

訪談與焦點團體的研究逐字稿指南

作者: 發布: 最後審閱:

錄音本身還不是資料。要等有人決定寫下什麼、如何標記說話者、要拿掉哪些足以辨識身分的細節,以及檔案送進您的編碼軟體時會是什麼樣子,它才會成為資料。這四項決定就是研究逐字稿轉錄,而且每一項都屬於方法學層面,而不是文書作業。

在第一場訪談之前就做出這些決定,遠比拖到第十四場訪談才做便宜得多。以下說明每項決定會改變什麼、方法一節該寫下什麼,以及自動轉錄真正能幫上研究的地方,而不只是讓資料夾看起來完工。

在第一場工作階段前選定逐字稿類型

沒有中立的逐字稿。每一種慣例都會讓某些內容顯現、讓另一些內容消失,因此請依照您實際要進行的分析來選擇。

逐字稿類型 保留內容 適用情境
完整逐字 填充詞、錯誤起頭、停頓、重疊發言 對話分析與論述分析
精簡逐字 保留字句本身,去除填充詞與修正 主題分析、紮根理論
清稿 為文法與可讀性潤飾 供出版與報告引用
規範化逐字 全語料庫統一文法 跨案例比較、大型樣本

真正代價高昂的錯誤不是選錯,而是選了兩次。半數語料用完整逐字、半數用清稿,編碼時就無法保持一致,事後重新轉錄二十場訪談來補救,等於憑空多出一個月沒人編列預算的工作。請事先把慣例寫下來,包括您要如何標記笑聲、打斷與聽不清楚的段落。

機器擅長什麼,又會漏掉什麼

自動轉錄的品質,足以當作幾乎任何研究的初稿,卻還不足以當作定稿。皮尤研究中心(Pew Research Center)針對錄製的講道內容比較人工與機器轉錄,發現機器在清晰連貫的語音上能跟上進度,但遇到專有名詞、專業術語,以及說話者轉換語氣或音量的段落就會落後——而這些正是質性研究者最常引用的段落。

因此可行的作法是:先產生一份不是您自己打字的草稿,再由您親自審閱一次。對照錄音聽一遍、修正人名與術語、修好交叉對話中歸屬錯誤的說話者,就此打住。審閱是真正耗時的部分,也是不能省略的部分。

說話者標籤本身就是化名

自動說話者分離會依聲音把錄音切開,並將結果標記為說話者 1說話者 2……以此類推。它辨識的是聲音,不是人,這一點其實很有用:標籤預設就是化名,除非有人把真實姓名輸入進去,否則會一直維持化名狀態。

請維持這個狀態。把說話者 1重新命名為P07或某個角色標籤一次,整份逐字稿與每一種匯出格式都會同步套用,讓受試者編號規則能一致套用,而不必手動改四十個地方。說話者標籤在每一份 Hushscript 逐字稿中都是免費的,聲音數量沒有上限,這正是六人焦點團體所需要的。

老實說,真正的限制是交叉對話。當受試者同時說話時,分離就需要人工再確認一次,而時間戳記能告訴您該重聽哪幾分鐘。

把轉錄方法寫進論文裡

審稿人愈來愈常追問文字是如何產生的,而不只是內容說了什麼。APA 針對質性研究的期刊文章報告標準要求作者說明資料是如何錄製與轉換的,這讓轉錄成為您必須報告的事,而不是可以逕自省略的事。

通常只需要一段方法說明,回答以下幾點就足夠:

邊轉錄邊去識別化,不要事後才做

足以辨識身分的細節,往往在句子講到一半時就冒出來:某個雇主、某個病房、某條街、某個開庭日期,或是唯一一位聽了故事就認得出來的同事。事後才要拿掉,等於要把整份語料再讀一遍,所以請直接在轉錄過程中一併處理。

直接在逐字稿裡處理,而不是在匯出的副本裡處理,也意味著唯一流通在外的版本就是化名版本。尋找及取代能一次修正整份文件中重複出現的地名,而事先儲存的詞庫則能把研究中的姓名、地點與專業詞彙帶進辨識引擎,讓一開始就少一些辨識錯誤。

您能對平台做出什麼樣的說明,和遮蔽本身一樣重要。Hushscript 會在每份逐字稿完成的當下立即刪除音訊,且從不用於訓練模型;逐字稿在靜態儲存時會加密,保留期限由您自行設定,範圍是 7 天到 365 天,也可依單一逐字稿個別覆寫;刪除流程會提供收據。來自歐盟、歐洲經濟區、瑞士與英國的音訊都在歐盟境內處理。如果某份錄音連儲存的逐字稿都不該留下,私人轉錄會改為回傳一個受密碼保護的.husharchive檔案。

依照接收端軟體選擇匯出格式

逐字稿很少會留在原地不動。它會被匯入 NVivo、ATLAS.ti、MAXQDA 或試算表,之後再進入手稿。純文字正是說話者標籤與時間戳記消失的地方,因此請依照最終去處來選格式。

Hushscript 匯出 21 種格式,不含浮水印,並將相關格式整理成 Research pack。時間戳記在匯出後依然保留,讓研究發現中的引文能精準指回原話說出的那一秒,這正是可供引用的逐字稿與一份長文件之間的差別。

多語田野調查,不必每個國家找一家廠商

比較研究不該在每個場域都需要找不同的轉錄供應商。自動偵測涵蓋約 99 種語言,其中有一組共 18 種主打語言變體的準確度最高,因此單一套工作流程就能涵蓋整個樣本。

翻譯與轉錄是兩個獨立的決定,而且順序很重要:先用受訪者說的語言轉錄,再翻譯。每新增一個翻譯目標語言,費用是錄音時長的 25%,而且原文與您的工作語言會出現在同一份文件的不同分頁中,各自都能單獨匯出,讓您能用您思考時所用的語言來引用受訪者的原話並進行編碼。請記錄由誰翻譯、意見不一致時如何解決,因為兩位譯者不會把同一句話譯成完全相同的措辭。

對照經費項目估算成本

人工轉錄是以研究者工時計價,而二十場一小時的訪談,正是那種會悄悄吃掉一整個學期的工作量。自動轉錄能把這筆支出壓進一個小到不再限制樣本規模的預算項目裡。

Hushscript 銷售的是預付分鐘數,而不是訂閱制,因此田野調查期就依實際使用量計費,寫作期則完全不花錢。以最大的套餐計算,$49.99 可購買 100 小時,二十場一小時的訪談大約落在 $10 上下,一場 90 分鐘的焦點團體則約 $0.75。分鐘數的有效期為 365 天,任何一次轉錄或購買都會重新啟動這個計時,適合中途要暫停等待倫理審查通過的研究。新帳戶可獲得 30 分鐘免費額度,解鎖方式是進行一次 $1 信用卡驗證(授權後立即釋放,從不收費),或是若您以其他方式付款,則在首次購買時解鎖。

從哪裡開始

請用您實際錄下的最後一場訪談,而不是乾淨的測試檔案。把它送進研究逐字稿,看看回傳的前 5 分鐘:這能讓您看出說話者辨識在您的受試者、房間與口音上的實際表現,而這才是唯一對您的研究真正有意義的準確度數字。

接著趁還有三十場訪談可以套用時,把這項慣例寫進您的研究方案裡。

獨立來源與標準

Hushscript 參考了這些獨立且非競爭性的資料來源。它們用於說明研究、標準或平台運作方式,並不代表其為 Hushscript 背書。

來源審閱日期:

常見問題

自動轉錄的準確度足以用於質性研究嗎?

作為初稿,足夠。作為最終逐字稿,單靠它並不夠。機器辨識能跟上清晰連貫的語音,但遇到專有名詞、專業術語,以及說話者轉換語氣的那些時刻就會落後——而這些恰好是研究者最常引用的片段。可行的作法是先產生自動草稿,再對照錄音進行一次審閱。

受試者要如何在逐字稿裡維持匿名?

說話者標籤不帶身分。自動分離辨識的是聲音,而不是人,因此標籤預設會顯示為說話者 1 和說話者 2,除非您親自輸入真實姓名,否則會維持匿名代稱。將它們依您的受試者編號規則重新命名一次,逐字稿與每一種匯出格式都會同步顯示。

我能對倫理委員會說明這個平台的哪些狀況?

簡短的事實即可。Hushscript 會在每份逐字稿完成的當下立即刪除音訊,且從不用於訓練模型。逐字稿在靜態儲存時會加密,保留期限由您自行設定,範圍是 7 天到 365 天,也可依單一逐字稿個別覆寫,刪除後會提供收據。來自歐盟、歐洲經濟區、瑞士與英國的音訊,都在歐盟境內處理。這些是您應對照研究方案檢查的能力,而不是合規認證。

哪種匯出格式能搭配 NVivo 或 ATLAS.ti 使用?

請使用結構化格式,而不是純文字,因為純文字會遺失說話者標籤與時間戳記。CSV、TSV 與 XLSX 會把兩者保留為欄位,適合試算表與軟體輔助編碼;JSON 則適合腳本化流程。Hushscript 匯出 21 種格式,不含浮水印,並將實用的格式整理成 Research pack。

轉錄一項研究的費用大概是多少?

以最大的預付套餐計算,$49.99 可購買 100 小時,二十場一小時的訪談大約落在 $10 上下,一場 90 分鐘的焦點團體則約 $0.75。沒有訂閱制,也沒有學術優惠方案:分鐘數採預付制,只有在檔案實際轉錄時才會扣除,有效期為 365 天,任何一次轉錄或購買都會重新啟動這個計時。

在投入整個語料庫之前,我能先用自己的錄音測試看看嗎?

可以。不需要帳戶,檔案的前 5 分鐘就會回傳已標記說話者的結果,足以讓您判斷在您實際的受試者、房間與口音上,說話者分離的效果如何。要轉錄完整語料庫則需要帳戶。

遇到牽涉一種以上語言的訪談,該怎麼處理?

先用受訪者說的語言轉錄,再進行翻譯。自動偵測涵蓋約 99 種語言,每新增一個翻譯目標語言,費用是錄音時長的 25%,原文與您的工作語言會出現在同一份文件的不同分頁中。同一句話裡的語碼轉換仍是最棘手的情況,這時就需要雙語審閱者來處理。

從 30 分鐘免費額度開始

$1 暫授權用於確認您的卡片,並會立即釋放——絕不收費,您的 30 分鐘免費時數也會立刻到帳。

開始––30 分鐘免費