Chuyển đến nội dung chính

Chuyển âm thanh thành văn bản

Tải file âm thanh lên và nhận bản phiên âm sạch, được phân tách theo người nói – có thể đổi tên và xuất sang 21 định dạng, cùng lưu trữ được bảo vệ bằng mật khẩu. Riêng tư và có nhãn người nói, trả theo mức dùng, không subscription – và 30 phút miễn phí để thử.

Thả tệp âm thanh hoặc video để xem trước bản phiên âm

30 giây đầu · miễn phí · không cần tài khoản · tệp của bạn ở lại trong trình duyệt

Chọn tệp

Hoặc dán liên kết âm thanh trực tiếp – liên kết chia sẻ từ Dropbox, Google Drive và OneDrive cũng hoạt động. Cách hoạt động của việc nhập qua liên kết

Cách thức hoạt động

  1. 01

    Tải file lên

    Bất kỳ file âm thanh hoặc video nào – thả một bản ghi hoặc gộp nhiều file liên quan thành một bản phiên âm có thứ tự duy nhất. Bản ghi có thể dài tối đa 10 giờ, không giới hạn dung lượng tệp – video và âm thanh lớn được chuẩn bị ngay trong trình duyệt của bạn.

  2. 02

    Xem trước 30 giây đầu tiên

    Xem kết quả có nhãn người nói trước khi đăng ký. Không cần tài khoản để xem trước.

  3. 03

    Đăng ký để phiên âm toàn bộ

    Thêm phương thức thanh toán để nhận 30 phút miễn phí – ngay lập tức khi xác thực thẻ (giữ $1, hoàn trả ngay), hoặc khi mua lần đầu bằng phương thức khác. Sau đó trả theo mức dùng.

Hầu hết các công cụ phiên âm chỉ trả về một khối văn bản liền mạch. Hushscript chuyển âm thanh thành văn bản và phân tách từng người nói ngay khi xử lý, nên một cuộc phỏng vấn hay cuộc họp đọc đúng như cuộc trò chuyện đã thực sự diễn ra, không phải một bức tường văn bản mà bạn phải tự gỡ rối. Đổi “Speaker 1” thành tên thật chỉ với một cú nhấp, sửa một từ nghe nhầm ngay trong trình chỉnh sửa, và xuất theo bất kỳ định dạng nào trong 21 định dạng mà bước tiếp theo của bạn cần. Đây là một công cụ chuyển âm thanh thành văn bản trọn vẹn, không chỉ là công cụ tạo bản phiên âm: chuyển đổi, dọn dẹp, và hoàn thiện.

Cách chuyển âm thanh thành văn bản

Thả file vào, xem trước 30 giây đầu tiên miễn phí, rồi đăng ký để phiên âm phần còn lại. Âm thanh tương thích được tải lên nguyên trạng. Với video, Hushscript sao chép một track âm thanh tương thích trong trình duyệt mà không mã hóa lại và chỉ chuyển đổi cục bộ khi cần, nên bản thân video không bao giờ được tải lên. Bản ghi có thể dài tối đa 10 giờ, không giới hạn dung lượng tệp – video và âm thanh lớn được chuẩn bị ngay trong trình duyệt của bạn. Dữ liệu được xử lý tại EU cho các bản ghi đến từ EU, EEA, Thụy Sĩ, hoặc Vương quốc Anh. Một vài tùy chọn giúp kết quả chính xác hơn trước khi bạn bắt đầu. Cố định ngôn ngữ nguồn thay vì tin vào tự động phát hiện, hoặc để nguyên cho âm thanh pha trộn hay khó đoán. Tắt nhận dạng người nói cho bản ghi một giọng như đọc chính tả hay ghi chú giọng nói, hoặc bật Multichannel (đa kênh) nếu file của bạn đã tách sẵn các giọng nói vào các kênh âm thanh riêng, thường gặp ở các bản ghi cuộc gọi, để mỗi kênh được phiên âm như một người nói riêng. Thêm tối đa 1.000 thuật ngữ chính (tên, thương hiệu, từ viết tắt) để định hướng nhận dạng theo đúng những từ bạn thực sự nói, hoặc viết một prompt tùy chỉnh tối đa 2.000 ký tự để cung cấp ngữ cảnh mà chỉ riêng âm thanh không thể cho engine biết. Đang ghi một cuộc phỏng vấn lâm sàng? Chế độ Y tế chuyển sang một mô hình được xây dựng cho ngôn ngữ lâm sàng; nó nhân đôi số phút tính phí cho file đó, và chỉ khi bạn bật nó lên.

Dạy nó vốn từ vựng của bạn

Thuật ngữ chính và prompt tùy chỉnh chỉ hoạt động một lần, cho một file. Từ điển đã lưu và mẫu prompt hoạt động mỗi lần bạn phiên âm. Xây dựng một từ điển gồm tên, sản phẩm, và thuật ngữ chuyên ngành riêng của công việc bạn, nhập hàng loạt từ file CSV hay TSV, và sắp xếp các mục vào danh mục với các biến thể chính tả đi kèm mỗi thuật ngữ chuẩn. Lưu một mẫu prompt theo cách tương tự, để ngữ cảnh mà bạn phải gõ lại cho từng file giờ có sẵn theo mặc định. Đánh dấu một từ điển hay mẫu làm mặc định và nó sẽ được chọn sẵn tự động vào lần phiên âm tiếp theo, nên một thiết lập cố định không cần chọn lại mỗi lần. Cả hai đều gắn vào một công việc cùng với bất kỳ thuật ngữ hay prompt riêng lẻ nào bạn thêm chỉ cho file đó, nên một bảng thuật ngữ cố định và một bổ sung trong ngày vẫn hoạt động cùng nhau. Chúng định hình những gì engine nhận ra từ âm thanh. Insights chạy sau trên bản phiên âm đã tạo; vốn từ tốt hơn cải thiện văn bản nguồn nhưng không cấu hình công việc Insights.

Sửa nhanh

Bản phiên âm hiếm khi hoàn hảo ngay từ đầu, nên trình chỉnh sửa được xây dựng để sửa nhanh, không phải phiên âm lại toàn bộ. Hoàn tác bất kỳ thay đổi nào, tìm và thay thế một từ nghe nhầm trên toàn bộ bản phiên âm cùng lúc, đổi tên người nói để “Speaker 1” trở thành một cái tên, gắn thẻ các đoạn để tìm lại sau, hoặc khôi phục về bản gốc nếu một chỉnh sửa đi sai hướng. Khi chọn Tạo Insights, một lần chạy tùy chọn và miễn phí sẽ tạo kết quả đầy đủ gắn với phiên bản hiện tại của bản phiên âm: bản tóm tắt, việc cần làm, quyết định, câu hỏi mở, trích dẫn, chương, chủ đề theo người nói, nhóm chủ đề, gợi ý xuất, phát hiện thuật ngữ và ngôn từ thô tục, cùng gợi ý làm sạch. Xem lại phần làm sạch trong thẻ Chỉnh sửa, khôi phục gợi ý bạn không muốn và chỉ áp dụng những thay đổi bạn phê duyệt.

Xuất ở đâu cũng được

Tải bản phiên âm của bạn dưới dạng TXT, SRT, VTT, CSV, TSV, Markdown, HTML, RTF, XML, JSON, DOCX, PDF, XLSX, ODS, ODT, ASS, TTML, SBV, LRC, FCPXML, hoặc EDL. Tổng cộng 21 định dạng, tất cả đều sạch và không watermark. Chưa chắc bước tiếp theo cần định dạng nào? Hướng dẫn này giúp bạn chọn định dạng bản phiên âm phù hợp. Cần nhiều định dạng cùng lúc? Các gói lưu trữ dựng sẵn gộp các định dạng mà một công việc thực sự cần: Subtitle pack cho file phụ đề, Research pack cho định dạng văn bản và dữ liệu, Office pack cho tài liệu, Editor pack cho các trình dựng phim như Final Cut, Premiere, và Resolve, hoặc All formats cho mọi thứ cùng lúc. Mỗi lưu trữ được xuất dưới dạng .husharchive được bảo vệ bằng mật khẩu kèm manifest và checksum, hoặc dưới dạng ZIP mã hóa AES tiêu chuẩn nếu công cụ ở đầu bên kia không mở được file .husharchive. Nhận được một .husharchive từ người khác? Mở, xác minh, và giải nén ngay trên trình duyệt của bạn, không cần cài thêm phần mềm nào.

Phiên âm theo lô

Không phải lúc nào cũng chỉ có một file mỗi lần. Xếp nhiều file cùng lúc và chúng sẽ nằm trong hàng đợi cho đến khi bạn nhấn bắt đầu. Không có gì được phiên âm ngay khi bạn thả vào, nên bạn có thể xem lại và điều chỉnh tùy chọn riêng cho từng file trước, hoặc bắt đầu tất cả cùng lúc. Các bản ghi liên quan (một cuộc phỏng vấn bị chia đôi, một cuộc gọi nhiều phần, các file sao lưu từ máy ghi âm) có thể được gộp thành một bản phiên âm có thứ tự duy nhất thay vì để rời rạc và bạn phải tự ghép lại. Số dư quyết định chi phí; các biện pháp bảo vệ công việc đang chạy và an toàn dịch vụ kiểm soát lượng công việc được xử lý đồng thời. Nếu bạn đang xử lý cả một thư mục bản ghi, đây là cách phiên âm cả một thư mục bản ghi chỉ trong một lượt.

Chi phí là bao nhiêu

Hushscript trả theo mức dùng, không phải subscription: mua phút theo gói và dùng chúng cho các dự án của bạn. Các gói có giá $1.99 cho 45 phút, $5.99 cho 5 giờ (300 phút), $11.99 cho 15 giờ (900 phút), và $19.99 cho 30 giờ (1.800 phút). Gói lớn nhất tương đương khoảng $0.67 một giờ, mức giá tốt nhất trong bảng. Phút chưa dùng được chuyển tiếp thay vì đặt lại hàng tháng; một bản phiên âm hoàn tất hoặc một giao dịch mua phút sẽ đặt lại thời hạn 180 ngày. Trang thanh toán tự động hiển thị giá theo đơn vị tiền tệ địa phương của bạn, không cần quy đổi thủ công và không có bất ngờ nào trên sao kê thẻ của bạn. Tài khoản mới nhận 30 phút miễn phí khi có phương thức thanh toán trong hồ sơ: khoản giữ $1 tạm thời trên thẻ được hoàn trả ngay, không bao giờ bị trừ. Từ đó, trả theo mức dùng.

Đang tìm một công cụ chuyển âm thanh thành văn bản miễn phí, không cần mua gì cả? Các công cụ miễn phí trên trình duyệt chuyển đổi định dạng và tách âm thanh khỏi video: chúng chạy phía client, không tải lên gì cả, và không cần tài khoản. Chúng chỉ không phiên âm. Biến giọng nói thành văn bản là phần chạy trên AI trả phí, hàng đầu, và đó là lý do vì sao đó là phần tốn chi phí.

Tại sao chọn Hushscript

Riêng tư theo thiết kế

Video của bạn không bao giờ được tải lên – âm thanh được trích xuất ngay trên trình duyệt – và âm thanh bị xóa ngay khi bản phiên âm sẵn sàng.

Không subscription

Trả theo mức dùng: mua phút chỉ khi cần. Không có gì định kỳ, không cần hủy.

Nhãn người nói miễn phí

Mỗi bản phiên âm đều tự động phân tách người nói – không phải tính năng trả phí.

Câu hỏi thường gặp

Tôi có thể chuyển đổi định dạng nào?

Bất kỳ file âm thanh hoặc video phổ biến nào – chỉ cần tải lên và chúng tôi sẽ chuyển đổi và phiên âm. Nếu có định dạng không được hỗ trợ, email support@hushscript.com và chúng tôi sẽ thêm vào.

Có miễn phí không?

Hushscript không miễn phí – chúng tôi dùng AI hàng đầu cho phiên âm, nên sử dụng mô hình trả theo mức dùng. Bạn có được 30 phút miễn phí để thử: ngay lập tức khi thêm và xác thực thẻ (giữ $1, hoàn trả ngay, không bao giờ bị trừ), hoặc khi mua lần đầu nếu dùng phương thức thanh toán khác.

Tôi có cần thẻ không?

Không. Thẻ là cách nhanh nhất để nhận 30 phút miễn phí – giữ $1 xác thực rồi hoàn trả ngay – nhưng không bắt buộc. Dùng phương thức thanh toán thay thế có sẵn ở quốc gia bạn và 30 phút miễn phí sẽ đến cùng lần mua đầu tiên.

Âm thanh của tôi có bị lưu lại không?

Không – âm thanh bị xóa ngay khi bản phiên âm sẵn sàng, và engine phiên âm không lưu lại gì. Bạn có thể xóa bản phiên âm chỉ bằng một cú nhấp.

Bản phiên âm của tôi có được mã hóa không?

Có – bản phiên âm được mã hóa khi lưu trữ, nên nếu hệ thống lưu trữ của chúng tôi bị rò rỉ, dữ liệu của bạn sẽ là văn bản mã hóa không thể đọc được thay vì văn bản thông thường.

File có thể dài bao lâu và dung lượng bao nhiêu?

Bản ghi có thể dài tối đa 10 giờ, không giới hạn dung lượng tệp – video và âm thanh lớn được chuẩn bị ngay trong trình duyệt của bạn. Không có hạn mức ngày hoặc tháng theo gói; các biện pháp bảo vệ an toàn dịch vụ và công việc đang chạy vẫn áp dụng.

Tôi có thể xuất gì?

TXT, SRT, VTT, CSV, TSV, Markdown, HTML, RTF, XML, JSON, DOCX, PDF, XLSX, ODS, ODT, ASS, TTML, SBV, LRC, FCPXML, hoặc EDL: 21 định dạng, cùng các gói lưu trữ dựng sẵn và .husharchive được bảo vệ bằng mật khẩu hoặc ZIP mã hóa AES. Không watermark trên bất kỳ định dạng nào.

Có thể phiên âm những ngôn ngữ nào?

Hệ thống tự động phát hiện ngôn ngữ và phiên âm khoảng 99 ngôn ngữ. Trang Ngôn ngữ liệt kê tất cả.

Có công cụ chuyển âm thanh thành văn bản miễn phí không?

Các công cụ miễn phí trên trình duyệt chuyển đổi định dạng và tách âm thanh khỏi video, không có gì được tải lên và không cần tài khoản, nhưng chúng không biến giọng nói thành văn bản. Phần đó chạy trên AI trả phí: 30 phút miễn phí được mở khóa bằng cách xác thực thẻ (khoản giữ $1 tạm thời, hoàn trả ngay, không bao giờ bị trừ), sau đó trả theo mức dùng.

Tôi có thể chuyển những định dạng file nào thành văn bản?

Các định dạng âm thanh phổ biến (MP3, M4A, WAV, FLAC, OGG, Opus) và video phổ biến (MP4, MOV, WebM, MKV). Nếu là video, âm thanh được trích xuất ngay trên trình duyệt trước khi có bất cứ thứ gì được tải lên; bản thân video không bao giờ rời khỏi thiết bị của bạn. Thiếu định dạng bạn cần? Email support@hushscript.com và chúng tôi sẽ thêm vào.

Bắt đầu với 30 phút miễn phí

Bắt đầu – 30 phút miễn phí