Chuyển đến nội dung chính

Chuyển video thành văn bản

Hushscript trích xuất âm thanh từ video ngay trên trình duyệt của bạn, nên video không bao giờ được tải lên. Phiên âm một video – hoặc gộp nhiều video thành một – rồi biến bản phiên âm thành phụ đề, dịch sang ngôn ngữ khác, và xuất theo 21 định dạng, kể cả mốc thời gian cho trình dựng phim.

Thả tệp âm thanh hoặc video để xem trước bản phiên âm

30 giây đầu · miễn phí · không cần tài khoản · tệp của bạn ở lại trong trình duyệt

Chọn tệp

Hoặc dán liên kết âm thanh trực tiếp – liên kết chia sẻ từ Dropbox, Google Drive và OneDrive cũng hoạt động. Cách hoạt động của việc nhập qua liên kết

Cách thức hoạt động

  1. 01

    Tải video lên

    MP4, MOV, WebM, MKV và nhiều hơn – tối đa 10 giờ, không giới hạn dung lượng tệp.

  2. 02

    Chúng tôi trích xuất âm thanh trên trình duyệt của bạn

    Chỉ có âm thanh gọn nhẹ được gửi đi để phiên âm. Video không rời khỏi thiết bị của bạn.

  3. 03

    Nhận bản phiên âm, phụ đề, hoặc bản dịch

    Có nhãn người nói, sẵn sàng xuất theo 21 định dạng – dịch sang ngôn ngữ khác trước nếu cần. Thêm phương thức thanh toán để nhận 30 phút miễn phí – ngay lập tức khi xác thực thẻ (giữ $1, hoàn trả ngay), hoặc khi mua lần đầu bằng phương thức khác. Sau đó trả theo mức dùng.

Video không rời khỏi thiết bị của bạn

Hầu hết các công cụ phiên âm video đều tải lên toàn bộ file. Hushscript không cần làm vậy: trình duyệt của bạn trích xuất âm thanh trước, nên chỉ có âm thanh gọn nhẹ được gửi đi – và âm thanh bị xóa ngay khi bản phiên âm sẵn sàng. Bản thân video không bao giờ chạm đến máy chủ.

Cách trích xuất trên trình duyệt hoạt động: trang web chạy bộ công cụ media ngay trên thiết bị của bạn, kéo track âm thanh ra, và chỉ gửi file gọn nhẹ đó. Video ở lại cục bộ trong suốt quá trình.

Bản phiên âm của bạn cũng được mã hóa khi lưu trữ – nếu hệ thống lưu trữ của chúng tôi bị rò rỉ, chúng sẽ là văn bản mã hóa không thể đọc thay vì lời nói của bạn.

Chuyển video thành văn bản trong ba bước

Thả video vào, hoặc gộp nhiều bản ghi liên quan (chẳng hạn một buổi ghi hình bị chia thành nhiều phần) thành một bản phiên âm có thứ tự duy nhất. Để trình duyệt trích xuất âm thanh, rồi đăng ký để phiên âm phần còn lại. Mọi bản phiên âm đều tự động phân tách từng người nói, nên một cuộc họp hay phỏng vấn đọc đúng như cuộc trò chuyện đã diễn ra chứ không phải một khối văn bản liền mạch; đổi “Speaker 1” thành tên thật chỉ với một cú nhấp. 30 giây xem trước miễn phí và không cần tài khoản. Chỉ khi hài lòng, bạn mới cần thêm phương thức thanh toán để nhận 30 phút miễn phí đầu tiên.

Biến bản phiên âm thành phụ đề

Một bản phiên âm và một bộ phụ đề thực chất là cùng một dữ liệu, chỉ khác cách đánh thời gian. Khi video đã được phiên âm, xuất phụ đề trực tiếp, không cần bước riêng, không cần công cụ riêng. Trình tạo phụ đề của Hushscript tạo ra SRT, VTT, ASS, TTML, SBV, hoặc LRC, mỗi dòng đã được đánh thời gian khớp với âm thanh và gắn nhãn theo người nói. Cần phụ đề có định dạng riêng với phông chữ và vị trí tùy chỉnh? ASS làm được việc đó. Đang dựng cho một nền tảng phát sóng? TTML là định dạng họ cần. Tất cả đều đi kèm bản phiên âm, không tính thêm phí; không có phụ đề nào phải mua riêng. Xem hướng dẫn từng bước tại cách tạo phụ đề SRT từ video.

Dịch bản phiên âm sang ngôn ngữ khác

Cần khán giả không nói ngôn ngữ gốc hiểu được video? Chọn một hoặc nhiều ngôn ngữ đích trước khi bắt đầu, và việc dịch chạy trong cùng một lượt với phiên âm, không cần tải lên lần hai, không cần công cụ riêng. Chọn trong số 13 ngôn ngữ đích – một danh sách nhỏ hơn và tách biệt với khoảng 99 ngôn ngữ mà Hushscript có thể tự động phát hiện và phiên âm: ngôn ngữ nguồn là bất cứ thứ gì thực sự được nói trong video của bạn, còn ngôn ngữ đích là những gì bạn chọn cho đầu ra. Bản phiên âm đã dịch được xuất theo cùng 21 định dạng như bản gốc, kể cả SRT và VTT đã dịch, nên một file phụ đề đã dịch gắn vừa khít vào video hệt như bản ngôn ngữ gốc. Việc dịch được tính phí như một khoản phụ thu cộng thêm vào phiên âm, khoảng một phần tư độ dài bản phiên âm cho mỗi ngôn ngữ.

Mọi định dạng xuất, kể cả mốc thời gian cho trình dựng phim

Tải bản phiên âm dưới dạng TXT, SRT, VTT, CSV, TSV, Markdown, HTML, RTF, XML, JSON, DOCX, PDF, XLSX, ODS, ODT, ASS, TTML, SBV, LRC, FCPXML, hoặc EDL: tổng cộng 21 định dạng, tất cả đều sạch và không watermark. Hai định dạng cuối được xây dựng cho trình dựng phim: FCPXML mang mốc thời gian vào Final Cut, và EDL làm điều tương tự cho Premiere, Resolve và hầu hết các NLE khác, để bạn có thể nhảy thẳng đến điều ai đó đã nói thay vì tua timeline bằng tai. Cần nhiều định dạng cho một dự án? Các gói lưu trữ dựng sẵn gộp chúng lại: Subtitle pack cho file phụ đề, Editor pack cho FCPXML và EDL cùng nhau, hoặc All formats cho mọi thứ cùng lúc, dưới dạng .husharchive được bảo vệ bằng mật khẩu kèm manifest và checksum, hoặc ZIP mã hóa AES tiêu chuẩn nếu đầu bên kia cần vậy.

Mọi định dạng video phổ biến

MP4, MOV, WebM, MKV và nhiều hơn: nếu thiết bị hay máy quay của bạn tạo ra nó, Hushscript gần như chắc chắn có thể trích xuất âm thanh và phiên âm nó. Chỉ cần file âm thanh, không cần bản phiên âm? Chuyển video sang âm thanh miễn phí trên trình duyệt của bạn, chọn MP3, WAV, hay định dạng khác. Có định dạng lạ hơn? Chuyển đổi miễn phí trước; việc chuyển đổi luôn ở lại trên thiết bị của bạn. Khi bạn chọn phiên âm, chỉ có âm thanh đã trích xuất được gửi đi, và nó bị xóa khi bản phiên âm sẵn sàng.

Miễn phí, không subscription

Hushscript không miễn phí. Phiên âm chạy trên AI hàng đầu, và đó là phần tốn chi phí. Đây là mô hình trả theo mức dùng: không phí hàng tháng, không gì để hủy, chỉ mua phút khi bạn cần. Xác thực một phương thức thanh toán và 30 phút được mở khóa miễn phí. Khoản giữ $1 tạm thời trên thẻ được hoàn trả ngay, không bao giờ bị trừ. Sau đó, trả theo mức dùng. Các gói từ $1.99 cho 45 phút đến $19.99 cho 30 giờ (1.800 phút); xem trang giá để biết bảng đầy đủ. Muốn nhiều hơn một bản phiên âm? Khi chọn Tạo Insights, một lần chạy tùy chọn và miễn phí sẽ tạo kết quả đầy đủ gắn với phiên bản hiện tại của bản phiên âm: bản tóm tắt, việc cần làm, quyết định, câu hỏi mở, trích dẫn, chương, chủ đề theo người nói, nhóm chủ đề, gợi ý xuất, phát hiện thuật ngữ và ngôn từ thô tục, cùng gợi ý làm sạch. Xem lại phần làm sạch trong thẻ Chỉnh sửa và chỉ áp dụng những thay đổi bạn phê duyệt. Với những công cụ thực sự miễn phí không cần mua gì cả, công cụ miễn phí trên trình duyệt chuyển đổi định dạng và tách âm thanh khỏi video mà không cần tài khoản, không có gì được tải lên; chúng chỉ không phiên âm.

Tại sao chọn Hushscript

Video không bao giờ được tải lên

Âm thanh được trích xuất trên thiết bị của bạn; video ở lại với bạn.

Nhãn người nói, miễn phí

Mỗi bản phiên âm đều tự động phân tách người nói.

Không subscription

Chỉ trả cho số phút đã dùng. 30 phút miễn phí để bắt đầu.

Câu hỏi thường gặp

Video của tôi có được tải lên không?

Không. Âm thanh được trích xuất trên trình duyệt của bạn, và chỉ có âm thanh gọn nhẹ đó được gửi đi để phiên âm – rồi bị xóa. Video không rời khỏi thiết bị của bạn.

Những định dạng video nào hoạt động được?

MP4, MOV, WebM, MKV và nhiều hơn. Bạn cũng có thể chuyển đổi định dạng trước bằng công cụ miễn phí trên trình duyệt của chúng tôi.

Tôi có thể xuất phụ đề ở những định dạng nào?

SRT, VTT, ASS, TTML, SBV, hoặc LRC, cùng FCPXML và EDL cho các trình dựng phim như Final Cut, Premiere và Resolve. Chúng nằm trong cùng bộ 21 định dạng xuất mà mọi bản phiên âm đều có, không phải tính năng trả thêm.

Tôi có thể dịch bản phiên âm sang ngôn ngữ khác không?

Có. Chọn trong số 13 ngôn ngữ đích trước khi bắt đầu, và việc dịch chạy trong cùng một lượt với phiên âm. Đây là việc tách biệt với ngôn ngữ nguồn: phiên âm tự động phát hiện khoảng 99 ngôn ngữ mà Hushscript có thể phiên âm, còn ngôn ngữ đích khi dịch là 13 ngôn ngữ bạn chọn cho đầu ra.

Giới hạn kích thước và độ dài là bao nhiêu?

Một bản ghi có thể dài tối đa 10 giờ, không giới hạn dung lượng tệp – video lớn được chuẩn bị ngay trong trình duyệt của bạn.

Âm thanh của tôi có bị lưu lại không?

Không – âm thanh bị xóa ngay khi bản phiên âm sẵn sàng, và engine không lưu lại gì.

Hỗ trợ những ngôn ngữ nào?

Hệ thống tự động phát hiện ngôn ngữ và phiên âm khoảng 99 ngôn ngữ. Danh sách đầy đủ trên trang Ngôn ngữ.

Tôi có thể xuất dưới dạng gì?

TXT, SRT, VTT, CSV, TSV, Markdown, HTML, RTF, XML, JSON, DOCX, PDF, XLSX, ODS, ODT, ASS, TTML, SBV, LRC, FCPXML, hoặc EDL: 21 định dạng, cùng các gói lưu trữ dựng sẵn và .husharchive được bảo vệ bằng mật khẩu. Không watermark trên bất kỳ định dạng nào.

Bắt đầu với 30 phút miễn phí

Bắt đầu – 30 phút miễn phí