Nhận dạng người nói tự động
Hushscript tự động phân tách từng người nói – điều mà trong lĩnh vực gọi là speaker diarization – và gắn nhãn ai nói gì. Tính năng này được bao gồm miễn phí, không bị chặn sau cổng trả phí.
Thả tệp âm thanh hoặc video để xem trước bản phiên âm
30 giây đầu · miễn phí · không cần tài khoản · tệp của bạn ở lại trong trình duyệt
Hoặc dán liên kết âm thanh trực tiếp – liên kết chia sẻ từ Dropbox, Google Drive và OneDrive cũng hoạt động. Cách hoạt động của việc nhập qua liên kết
Kiểm tra email của bạn để đăng nhập, sau đó tải lên tệp của bạn để phiên âm.
Cách thức hoạt động
- 01
Tải bản ghi âm nhiều người lên
Bất kỳ định dạng âm thanh hoặc video nào – chỉ cần tải lên và chúng tôi sẽ chuyển đổi và phiên âm, tối đa 10 giờ, không giới hạn dung lượng tệp. Video và âm thanh lớn được chuẩn bị ngay trong trình duyệt của bạn.
- 02
Chúng tôi phân tách và gắn nhãn từng giọng nói
Speaker diarization chạy tự động. Không cần bước thêm, không cần trả thêm phí.
- 03
Đổi tên người nói và xuất
Đổi 'Speaker 1' thành tên thật trên toàn bộ bản phiên âm chỉ bằng một cú nhấp. Xuất theo 21 định dạng, cùng lưu trữ được bảo vệ bằng mật khẩu.
Speaker diarization là gì?
Speaker diarization xác định ai nói khi nào. Thay vì một khối văn bản, bạn nhận được bản phiên âm được phân chia theo người nói – sự khác biệt giữa thứ bạn phải gỡ rối và thứ bạn có thể đọc ngay. Không có nó, một cuộc phỏng vấn 45 phút đọc như một đoạn văn liền mạch không ngắt quãng; có nó, mỗi dòng đều được gán cho đúng người, nên bạn có thể lướt thẳng đến điều một người cụ thể đã nói.
Cách nhận dạng người nói tự động hoạt động
Hushscript phân tách các giọng nói trong bản ghi âm và gắn nhãn từng người một cách tự động, không cần bật công tắc nào, không cần thêm bước nào. Các cuộc phỏng vấn được trả về với người phỏng vấn và đối tượng được gắn nhãn riêng; các cuộc họp được trả về với từng người tham gia; podcast nhiều khách mời giữ mỗi giọng nói tách biệt. Cùng một giọng nói giữ nguyên một nhãn từ phút đầu đến phút cuối, kể cả trong bản ghi dài, nên bạn không bao giờ phải đoán xem “Speaker 2” gần cuối có phải cùng một người với “Speaker 2” ở đầu hay không.
Đổi tên, gắn thẻ và sửa người nói
Nhãn đầu tiên hiếm khi là nhãn cuối cùng. Đổi “Speaker 1” thành tên thật và nó cập nhật trên toàn bộ bản phiên âm chỉ trong một lần chỉnh sửa, không cần lùng từng chỗ một bằng tay. Gắn thẻ các đoạn bạn muốn tìm lại sau, và nếu việc phân tách người nói có lúc tách hoặc gộp nhầm hai người nói, tìm & thay thế sẽ bắt các dòng bị gắn nhầm trên toàn bộ bản phiên âm thay vì bắt bạn sửa từng dòng một. Một cuộc phỏng vấn 40 phút với một người nói bị gắn nhầm nhãn trong hai phút giữa bài chỉ cần tìm & thay thế và đổi tên, không cần tải lên lại; trình chỉnh sửa được xây dựng cho kiểu sửa nhanh này, không phải phiên âm lại từ đầu.
Multichannel: khi người nói đã được tách sẵn
Một số bản ghi đến ở dạng đã tách sẵn, như một máy ghi âm cuộc gọi đặt mỗi bên đường dây vào một kênh âm thanh riêng. Bật Multichannel (đa kênh) và Hushscript sẽ dùng trực tiếp các kênh đó để tách người nói thay vì suy luận ai đang nói chỉ từ âm thanh – cách này chính xác hơn khi các kênh đã được tách biệt sẵn. Tình huống này thường gặp nhất với các bản ghi cuộc gọi, một số nền tảng hội thảo trực tuyến, và các máy ghi âm phỏng vấn chuyên dụng vốn đã cho mỗi người tham gia một đường riêng. Đây là một tùy chọn, không phải yêu cầu bắt buộc: để tắt với bản ghi một kênh thông thường, và việc phân tách người nói tự động sẽ đảm nhiệm như bình thường.
Tên người nói theo suốt phần còn lại của quy trình
Nhãn người nói, dù đã đổi tên hay chưa, vẫn theo suốt các bản ghi đã gộp, trình chỉnh sửa, phụ đề, tài liệu, và mọi định dạng xuất, nên kết quả vẫn dễ đọc lâu dài chứ không chỉ ở lần xem đầu. Đổi tên một lần, ở cấp bản phiên âm, và phần chia chương, một trích dẫn được rút ra, hay một file phụ đề đều thống nhất về việc ai là ai mà không cần thêm thao tác nào. Khi chọn Tạo Insights, một lần chạy tùy chọn và miễn phí sẽ tạo kết quả đầy đủ gắn với phiên bản hiện tại của bản phiên âm: bản tóm tắt, việc cần làm, quyết định, câu hỏi mở, trích dẫn, chương, chủ đề theo người nói, nhóm chủ đề, gợi ý xuất, phát hiện thuật ngữ và ngôn từ thô tục, cùng gợi ý làm sạch. Xem lại phần làm sạch trong thẻ Chỉnh sửa và chỉ áp dụng những thay đổi bạn phê duyệt.
Tại sao chúng tôi không tính phí cho tính năng này
Nhiều công cụ chặn việc phân tách người nói sau cổng trả phí hoặc giới hạn số người nói. Chúng tôi thì không – tính năng này miễn phí trong mỗi bản phiên âm, vì bản phiên âm không có nó chỉ có nửa giá trị.
Tuyệt vời cho phỏng vấn, cuộc họp và podcast
Bất cứ nơi nào có nhiều hơn một người nói, nhãn người nói sẽ làm phần việc nặng nhọc. Một cuộc phỏng vấn một-đối-một được trả về như một cuộc đối đáp rõ ràng giữa người phỏng vấn và đối tượng, thay vì một bức tường văn bản mà bạn phải tự gán ai nói gì. Một cuộc họp năm người tham gia đọc như năm giọng nói riêng biệt, nên bạn biết ai đã cam kết điều gì. Một tập podcast nhiều khách mời giữ mỗi khách mời tách biệt suốt cả giờ nói chồng lên nhau, điều quan trọng khi bạn cần trích một câu để làm ghi chú chương trình sau này. → Podcast · Chuyển âm thanh thành văn bản
Riêng tư theo thiết kế
Âm thanh của bạn bị xóa ngay khi bản phiên âm sẵn sàng. Bản phiên âm được mã hóa khi lưu trữ – nếu bị rò rỉ chỉ lộ ra văn bản mã hóa, không phải lời nói của bạn.
Tại sao chọn Hushscript
Bao gồm miễn phí
Nhãn người nói trong mỗi bản phiên âm – không phải cấp trả phí.
Đổi tên chỉ bằng một cú nhấp
Đổi tên bất kỳ người nói nào trên toàn bộ bản phiên âm ngay lập tức.
Không giới hạn số người nói
Nhiều người nói được phân tách mà không có giới hạn trả phí về số lượng.
Câu hỏi thường gặp
Speaker diarization là gì?
Đây là bước xác định ai nói khi nào, và chia bản ghi âm thành các người nói riêng biệt – nên bản phiên âm đọc như một cuộc trò chuyện có nhãn thay vì một khối văn bản.
Có thể xử lý bao nhiêu người nói?
Nhiều người nói trong bản ghi âm được phân tách tự động; không có giới hạn trả phí về số người nói.
Tôi có thể đổi tên, gắn thẻ, hoặc sửa nhãn người nói không?
Có. Đổi 'Speaker 1' thành tên thật trên toàn bộ bản phiên âm chỉ bằng một cú nhấp, gắn thẻ các đoạn để tìm lại sau, và dùng tìm & thay thế nếu việc phân tách gắn nhầm nhãn một dòng nào đó – tất cả ngay trong trình chỉnh sửa.
Multichannel (đa kênh) là gì?
Đây là tùy chọn dành cho các bản ghi đã tách sẵn mỗi người nói vào một kênh âm thanh riêng, như một số máy ghi âm cuộc gọi. Bật lên và việc phân tách người nói sẽ dùng trực tiếp các kênh đó thay vì suy luận người nói từ âm thanh.
Có tốn thêm phí không?
Không. Nhãn người nói miễn phí trên mọi bản phiên âm. Bạn trả tiền cho chính việc phiên âm, không phải cho nhãn đi kèm: 30 phút miễn phí được mở khóa bằng cách xác thực thẻ (khoản giữ $1 tạm thời, hoàn trả ngay, không bao giờ bị trừ), sau đó trả theo mức dùng.
Âm thanh của tôi có bị lưu lại sau khi phiên âm không?
Không – âm thanh bị xóa ngay khi bản phiên âm sẵn sàng. Bản phiên âm được mã hóa khi lưu trữ, nên nếu bị rò rỉ chỉ lộ ra văn bản mã hóa không thể đọc.
Bắt đầu với 30 phút miễn phí
Bắt đầu – 30 phút miễn phí