ข้ามไปยังเนื้อหาหลัก

สอนคำศัพท์เฉพาะให้ระบบถอดเสียง

ผู้เขียน: เผยแพร่: ตรวจสอบล่าสุด:

เครื่องมือคำพูดทั่วไปมีบริบทน้อยกว่าสำหรับชื่อรหัสผลิตภัณฑ์ นามสกุลของภูมิภาค หรือตัวย่อภายในที่ทีมของคุณใช้ในการประชุมสิบครั้ง การวิจัยเรียกเทคนิคนี้ในการขับเคลื่อนการจดจำไปยังคำที่คาดไว้การให้น้ำหนักตามบริบท และเซสชัน W3C Web Speech ปี 2025 อธิบายว่าเป็นความสามารถในการจัดส่งใน Chrome Hushscript เปลี่ยนแนวคิดดังกล่าวให้เป็นการควบคุมคำศัพท์สี่แบบ ตั้งแต่การเพิ่มครั้งเดียวสำหรับไฟล์หนึ่งไฟล์ไปจนถึงการตั้งค่าแบบยืนที่คุณสามารถนำมาใช้ซ้ำได้

ที่ที่คำศัพท์แบบกำหนดเองช่วยได้มากที่สุด

สามหมวดหมู่ทำให้การจดจำส่วนใหญ่พลาดจากโมเดลที่ใช้งานทั่วไป ชื่อของบุคคลจะเป็นชื่อขึ้นต้น โดยเฉพาะการสะกดคำที่ไม่ใช่รูปแบบที่พบบ่อยที่สุด แบบจำลองไม่มีทางเดาได้ว่าเสียงนั้นเขียนว่า “เหงียน” หรือเป็นคำที่ใกล้เคียงกัน เว้นแต่จะมีบางสิ่งบอกว่าชื่อนั้นกำลังเล่นอยู่ ชื่อผลิตภัณฑ์และแบรนด์เป็นชื่อที่สอง: ชื่ออย่าง “FlowBridge” จะได้ยินเป็นคำธรรมดาสองคำที่ฟังดูเหมือน ไม่ใช่คำนามเฉพาะที่บริษัทใดบริษัทหนึ่งเลือก ศัพท์เฉพาะและคำย่อภายในคือคำที่สาม: คำที่หมายถึงบางสิ่งภายในทีมหรืออุตสาหกรรมเดียวเท่านั้น ซึ่งไม่มีคำศัพท์ทั่วไปเลย ชื่อยาและหัตถการของเวชปฏิบัติทางคลินิกเป็นปัญหาเดียวกันในระดับที่ใหญ่กว่า ซึ่งการถอดความทางการแพทย์ จัดการด้วยโหมดเฉพาะควบคู่ไปกับเครื่องมือคำศัพท์เหล่านี้ คำย่อซ้ำสิบครั้งในการประชุมถอดความผิดสิบครั้งหรือถูกต้องสิบครั้ง ไม่มีเครดิตบางส่วน ดังนั้นการแก้ไขครั้งเดียวในรายการคำหลักหรือพจนานุกรมจะแก้ไขทุกเหตุการณ์ในไฟล์นั้นโดยอัตโนมัติ

สำหรับไฟล์เดียว: keyterms และพรอมต์ที่กำหนดเอง

หากคุณกำลังถอดเสียงการบันทึกที่ผิดปกติและไม่ต้องการการตั้งค่าถาวร ให้เพิ่มคีย์เวิร์ดลงในงานนั้นโดยตรง จดจำคำสำคัญได้ถึง 1,000 คำ (ชื่อ แบรนด์ ตัวย่อ) สำหรับไฟล์นั้นเพียงอย่างเดียว นอกจากนี้ ข้อความแจ้งแบบกำหนดเองที่มีความยาวสูงสุด 2,000 ตัวอักษรยังทำให้บริบทของกลไกเสียงเพียงอย่างเดียวไม่สามารถทำได้ เช่น ใครกำลังพูด สิ่งที่บันทึกครอบคลุม ข้อกำหนดเฉพาะของสถานการณ์ ทั้งสองหายตัวไปหลังเลิกงาน ไม่มีสิ่งใดที่ส่งต่อไปยังไฟล์ถัดไปเว้นแต่คุณจะเพิ่มอีกครั้ง

สำหรับงานที่เกิดซ้ำ: พจนานุกรมที่บันทึกไว้และการตั้งค่าล่วงหน้าของพรอมต์

หากชื่อและศัพท์เฉพาะเดียวกันปรากฏขึ้นทีละไฟล์ รายการแบบครั้งเดียวจะไม่คุ้มค่ากับการพิมพ์ซ้ำ พจนานุกรมที่บันทึกไว้ช่วยแก้ปัญหาดังกล่าว: นำเข้าคำศัพท์จำนวนมากจากไฟล์ CSV หรือ TSV จัดระเบียบเป็นหมวดหมู่ และแนบรูปแบบการสะกดคำกับคำศัพท์มาตรฐานแต่ละคำเพื่อให้ “McAllister” รับรู้ได้ว่าเสียงต้นฉบับทำให้เสียงเหมือน “MacAlister” หรือ “McAllaster” การตั้งค่าล่วงหน้าของพรอมต์ทำงานในลักษณะเดียวกันกับบริบท โดยบันทึกพื้นหลังที่คุณจะพิมพ์ซ้ำทุกครั้ง ทำเครื่องหมายพจนานุกรมหรือค่าที่กำหนดล่วงหน้าเป็นค่าเริ่มต้น และระบบจะเลือกไว้ล่วงหน้าโดยอัตโนมัติในครั้งถัดไปที่คุณถอดเสียง ดังนั้นการตั้งค่าแบบยืนจึงไม่จำเป็นต้องเลือกซ้ำในทุกไฟล์

ทั้งสองแบบรวมกัน แต่จะไม่แทนที่กัน

พจนานุกรมแบบยืนและการเพิ่มแบบครั้งเดียวไม่ใช่ตัวเลือกระหว่างสองตัวเลือก พวกเขาสมัครงานเดียวกันด้วยกัน เก็บพจนานุกรมเริ่มต้นของชื่อผลิตภัณฑ์ของทีมของคุณและพรอมต์เริ่มต้นที่อธิบายว่าการบันทึกของคุณมักจะเป็นอย่างไร จากนั้นเพิ่มคีย์เวิร์ดแบบใช้ครั้งเดียวสำหรับชื่อแขกที่เกี่ยวข้องกับไฟล์ของสัปดาห์นี้เท่านั้น การตั้งค่าการยืนครอบคลุมคำศัพท์ที่เกิดซ้ำ การเพิ่มครั้งเดียวจะครอบคลุมถึงความเฉพาะเจาะจงของการบันทึกนี้ ทั้งสองคนไม่จำเป็นต้องคำนึงถึงสิ่งที่อีกฝ่ายจัดการอยู่แล้ว

สิ่งที่ไม่ได้สัมผัส

คำศัพท์ที่กำหนดเองในรูปแบบใดรูปแบบหนึ่งจากสี่รูปแบบจะกำหนดสิ่งที่กลไกได้ยินในขณะที่กำลังถอดเสียง และจะไม่กำหนดค่างาน Insights ในภายหลัง Insightsจะเทียบกับการถอดเสียงที่เป็นผล การใช้คำศัพท์ให้ถูกต้องแต่เนิ่นๆ จึงสามารถปรับปรุงข้อความต้นฉบับที่ Insights อ่านได้ โดยไม่เปลี่ยนแปลงสิ่งที่ Insights สร้างขึ้น

ตัวอย่างข้างต้น

พอดแคสต์รายสัปดาห์จะสัมภาษณ์แขกรับเชิญที่แตกต่างกันในแต่ละตอน แต่จะพูดถึงกลุ่มผลิตภัณฑ์ 3 รายการเดียวกันตามชื่อเสมอ โฮสต์สร้างพจนานุกรมที่บันทึกไว้เพียงครั้งเดียว โดยนำเข้าจากสเปรดชีตชื่อผลิตภัณฑ์และชื่อของทีม สะกดตามวิธีที่รายการพูดจริง และทำเครื่องหมายว่าเป็นค่าเริ่มต้น ตอนของทุกสัปดาห์จะได้รับประโยชน์โดยอัตโนมัติ สำหรับแขกในสัปดาห์นั้น ชื่อพจนานุกรมแบบยืนไม่มีเหตุผลที่ต้องรู้ โฮสต์จะเพิ่มคีย์เวิร์ดหนึ่งคำก่อนที่จะอัปโหลด โดยเฉพาะสำหรับไฟล์นั้น พจนานุกรมแบบสแตนด์อโลนและคีย์เวิร์ดที่ใช้ครั้งเดียวนั้นใช้ได้กับการถอดเสียงเดียวกัน และไม่จำเป็นต้องแตะต้องกันอีก

จะตั้งค่าที่ไหน

ตัวเลือกคำศัพท์จะอยู่เคียงข้างการตั้งค่าต่อไฟล์อื่นๆ ในเสียงเป็นข้อความ ไม่ว่าคุณจะเพิ่มคีย์เวิร์ดแบบใช้ครั้งเดียวในการอัปโหลดครั้งเดียวหรือจัดการพจนานุกรมที่บันทึกไว้สำหรับงานที่เกิดซ้ำ โดยจะทำงานในลักษณะเดียวกันไม่ว่า Hushscript ประมาณ 99 ภาษาจะตรวจพบอัตโนมัติในการบันทึกหรือไม่ก็ตาม และ หน้าภาษา ก็มีรายการทั้งหมด พร้อมด้วยภาษาใดบ้างที่มีความแม่นยำระดับสูงสุด หากต้องการข้อมูลเพิ่มเติมเกี่ยวกับการถอดเสียงก่อนที่คุณจะกังวลเกี่ยวกับคำศัพท์ โปรดดูวิธีถอดเสียงพอดแคสต์สำหรับเวิร์กโฟลว์สำหรับผู้เยี่ยมชมที่เกิดซ้ำตามตัวอย่างนี้

แหล่งข้อมูลและมาตรฐานอิสระ

Hushscript อ้างอิงแหล่งข้อมูลอิสระที่ไม่ใช่คู่แข่งเหล่านี้เพื่ออธิบายงานวิจัย มาตรฐาน หรือการทำงานของแพลตฟอร์ม โดยไม่ได้หมายความว่าแหล่งข้อมูลดังกล่าวรับรอง Hushscript

วันที่ตรวจสอบแหล่งข้อมูล:

คำถามที่พบบ่อย

ความแตกต่างระหว่างคำสำคัญและพจนานุกรมที่บันทึกไว้คืออะไร

คำสำคัญเป็นแบบใช้ครั้งเดียว: คุณเพิ่มคำเหล่านี้ลงในไฟล์เดียวและนำไปใช้กับงานนั้นเท่านั้น พจนานุกรมที่บันทึกไว้สามารถนำกลับมาใช้ใหม่ได้ โดยสร้างเพียงครั้งเดียว ทำเครื่องหมายเป็นค่าเริ่มต้นหากคุณต้องการให้เลือกไว้ล่วงหน้าโดยอัตโนมัติ และพจนานุกรมดังกล่าวใช้กับทุกไฟล์ที่คุณถอดเสียงในภายหลังโดยไม่ต้องป้อนอะไรเลย

ฉันสามารถเพิ่มคำสำคัญได้กี่คำในหนึ่งไฟล์

สูงสุด 1,000 คำต่อไฟล์ ซึ่งครอบคลุมชื่อ แบรนด์ และตัวย่อที่คุณต้องการให้กลไกเอนเอียงต่อการได้ยินอย่างถูกต้องสำหรับการบันทึกครั้งนั้น

พรอมต์แบบกำหนดเองสามารถมีได้นานแค่ไหน

สูงสุด 2,000 อักขระ มันเป็นบริบทของไฟล์เดียว: พื้นหลังที่เสียงเพียงอย่างเดียวไม่สามารถให้กลไกได้ เช่น ใครกำลังพูดหรือสิ่งที่บันทึกเป็นเรื่องเกี่ยวกับ

ฉันสามารถนำเข้าพจนานุกรมจำนวนมากแทนการพิมพ์คำศัพท์ทีละคำได้หรือไม่

ได้ นำเข้าไฟล์ CSV หรือ TSV จัดระเบียบรายการเป็นหมวดหมู่ และแนบรูปแบบการสะกดคำแต่ละคำตามรูปแบบบัญญัติ เพื่อให้พจนานุกรมจดจำลักษณะต่างๆ ที่ชื่อหรือคำอาจเกิดขึ้นได้

คำศัพท์ที่กำหนดเองส่งผลต่อ Insights หรือไม่

ไม่โดยตรง พจนานุกรม การตั้งค่าล่วงหน้าของพรอมต์ คำสำคัญ และพรอมต์แบบกำหนดเองจะกำหนดรูปแบบการรู้จำคำพูด Insightsจะทำงานในภายหลังโดยเทียบกับการถอดเสียงที่ได้ ดังนั้นคำศัพท์ที่ดีขึ้นจึงสามารถปรับปรุงข้อความต้นฉบับได้ แต่ไม่ได้กำหนดค่างานInsights

เริ่มต้นด้วย 30 นาทีฟรี

เริ่มต้น – 30 นาทีฟรี