メインコンテンツへスキップ

音声をアップロードして文字起こししても安全?

著者: 公開日: 最終確認日:

ツール、録音、および適用されるルールが揃っている場合、文字起こしのために音声をアップロードすることは合理的です。転写自体はリスクの一部にすぎません。重要なのは、ファイルがデバイスから出た後に何が起こるか、つまりファイルがどこに保存されるか、そこにどのくらいの期間存在するか、他の誰が処理するか、そしてモデルのトレーニングに使用できるかどうかです。ポリシーは多岐にわたります。そのため、安全性に関する質問は、実際に信頼しようとしている特定のサービスに関する質問です。

この投稿では、アップロードしたファイルに実際に何が起こるか、文字起こしツールに尋ねる価値のある 4 つの質問、Hushscript が露出を小さく保つ方法、およびタブを閉じる必要がある危険信号について説明します。それは説明であって、セールストークではありません。この質問は、当社以外のツールも含め、すべてのツールに当てはまります。

オーディオに実際に何が起こるか

ファイルをアップロードすると、ファイルは 1 か所に送られてすぐに戻ってくるわけではありません。それは複数のシステムを経由しており、プライバシーの問題は、それぞれがそれをどのように扱うかということです。

**ストレージ。**アップロードサービスは、音声エンジンがファイルを認識する前にファイルをクラウドオブジェクトストレージに書き込む場合があります。マーケティングページに明確に記載されているかどうかに関係なく、そのストレージには保存ポリシーがあります。 欧州委員会の GDPR 原則では、個人データは可能な限り最短の期間保存し、定義された消去制限に照らして確認する必要があると規定しています。機能リストから推測するのではなく、実際の保持ウィンドウを要求します。

処理音声は、音声認識、話者分離、およびクリーンアップを実行している 1 つ以上のシステムを通過できます。サービスは独自のエンジンまたはプロセッサを使用している場合があるため、アップロードページの企業が唯一の関係者であると想定するのではなく、指定されたサブプロセッサとその保持期間を確認してください。

トレーニングデータ音声モデルは実際の音声でトレーニングすることで改善され、実際の顧客の録音は貴重なトレーニングの燃料となります。一部のサービスは、規約にある「製品の改善」のためにアップロードを使用する権利を留保します。アップロード時にこれが明確なオプトインボックスになることはほとんどありません。通常、これは利用規約に埋め込まれているか、オプトアウトでデフォルトでオンになっているので、見つけに行く必要があります。

**ログ。**音声を削除するツールでさえ、アップロードした日時、ファイルの長さ、検出された言語、話者の数などのメタデータを保持していることがよくあります。このメタデータはオーディオ自体よりもリスクがはるかに低いですが、通常は録音よりも存続することを知っておく価値があります。

ここで重要なのは、これらすべてが邪悪であるというわけではありません。それは、「音声をアップロードしてテキストを戻す」には 4 つまたは 5 つの個別の決定が隠されており、そのすべてに注意を払っているツールとそうでないツールでは見た目が大きく異なります。

文字起こしツールに尋ねるべき 4 つの質問

ツールを判断するために、企業のエンジニアリングブログ全体を読む必要はありません。リスクのほとんどは 4 つの質問でカバーされており、データの運用を考慮したサービスは 4 つすべてに明確に答えることができます。

音声はいつ削除されますか?

必要な答えは、「30、60、または 90 日以内」や「アカウントを削除したとき」ではなく、「トランスクリプトの準備ができた直後」です。アクションを実行する必要がある削除は、オーディオがデフォルトで存続することを意味し、デフォルトが実際に起こることです。数週間または数か月の固定保存期間とは、録音のコピーがその期間ずっとサーバー上に存在し、バケットにアクセスできる誰でも利用できることを意味します。

音声エンジンはコピーを保持しますか?

サービスがサードパーティの音声 API を使用している場合、音声もそのベンダーを通過します。あなたがサインアップした会社からの「オーディオは保存しません」というメッセージは、基盤となるエンジンがオーディオを保存しないことと同じではありません。音声プロバイダーもすぐに削除するのか、それとも独自の別のポリシーに基づいて音声を保持するのかを尋ねます。これは、外部からは見えないため、ほとんどの人が見逃しているステップです。

音声はトレーニングに使用されていますか?

プライバシー ポリシーは拘束力のある文書であり、ランディングページではありません。記録がモデルのトレーニング、微調整、または評価に使用されるかどうかについての具体的な文言を探してください。ポリシーに「サービスを改善し、開発する」などの曖昧な内容が記載されている場合は、別の記載があるまでトレーニングが含まれているものと想定してください。プライバシー ポリシーのあいまいさは、あなたではなく会社に有利に解決される傾向があります。

何が保存され、暗号化されていますか?

音声が削除されても、トランスクリプトは通常残ります。それがあなたが来た目的です。機密の会話の記録は、それ自体が機密性の高いものです。保存されているトランスクリプトが保管時に暗号化されているかどうかを確認します。そうすることで、ストレージ侵害が発生すると、誰かがこれまでにトランスクリプトを作成したすべての検索可能なアーカイブではなく、読み取り不可能な暗号文が公開されます。

これらはよくわからない質問ではありません。 4 つすべてに明確に答えられるツールが注目を集めています。

Hushscript が露出を小さく保つ方法

Hushscript の設計原則は、接触を最小限に抑えることです。オーディオが自分のデバイスの外のサーバーに費やす時間をできる限り短くする必要があり、保存された内容は、万が一漏洩した場合でも読み取れないようにする必要があります。これはプライバシー ウェッジであり、その仕組みを具体的に説明する価値があります。

**ビデオは決してアップロードされません。**ビデオファイルをドロップすると、Hushscript は何かが送信される前にブラウザでそのオーディオトラックを準備します。互換性のあるトラックは再エンコードせずにコピーされます。変換はトラックが必要な場合にのみローカルで実行されます。文字起こしサービスに届くのは、動画データを残した音声のみのアップロードです。ビデオ自体は最初から最後までデバイス上に残ります。

**音声はトランスクリプトの準備ができた瞬間に削除されます。**30 日間の猶予期間、バックアップバケット、コールドストレージ層はありません。削除は完了時に自動的に行われます。それはあなたが要求するものではありませんし、あなたがそれを覚えているかどうかに依存しません。音声は、アップロードからトランスクリプトまでの一時的な処理状態にあり、その後失われます。

**音声エンジンは何も保持しません。**トランスクリプションを行うエンジンは、トレーニング、評価、またはデバッグのために音声を保持しません。ファイルを処理して破棄します。これにより、アプリケーションレベルの削除要求に暗黙的に残すのではなく、Hushscript に対する副処理者の質問に直接答えることができます。

**トランスクリプトは保存時に暗号化されます。**ダッシュボードに表示されるトランスクリプトは、保存される場所で暗号化されます。私たちのストレージが漏洩した場合、攻撃者が取得するのは、あなたの言葉の読み取り可能なアーカイブではなく、読み取り不可能な暗号文です。その主張の限界について正確に言うと、これは漏洩防止であり、ゼロ知識ではありません。キーはアプリが復号して自分のトランスクリプトを表示できるようにサーバー上に保持されているため、それを読み取ることができないとは主張しません。私たちは、キーがなければ盗まれたデータベースは役に立たない、つまり保存時の暗号化が実際に対処しようとしている脅威であると主張しています。

認証についてHushscript は SOC 2 やその他の正式なコンプライアンス認証を取得していません。このアプローチは、録音の大規模なストアを構築してからその周囲のコントロールを認証するのではなく、最初から公開される面を小さく保つことです (ブラウザーで音声を抽出し、完了したら削除し、保存されているものを暗号化します)。コンプライアンス証明書が業務にとって厳しい要件である場合、代わりに認定ベンダーを選択する正当な理由になります。それを想定するよりも、事前に知っておく方がよいでしょう。

最終的な効果は、データフットプリントが短くなることです。あなたの音声は、文字起こし期間中のみ当社のインフラストラクチャ上に存在します。その前に、それはあなたのデバイス上にあります。その後はどこにも残らず、残っているトランスクリプトは保存された暗号文です。完全なフローは仕組みページで確認でき、非公開文字起こしページではデータ処理の詳細が説明されています。

実際の例: 機密インタビュー

あなたがジャーナリストであるとします。MP4 で 50 分間のインタビューを録音しました。電話で撮影しました。情報筋は匿名を希望した。ここでは、何が起こるのか、そしてプライバシーの保証が実際にどこに影響するのかを段階的に説明します。

  1. **MP4 をプレビューにドロップします。**まだアカウントがありません。このページはブラウザでファイルを読み取り、ローカルで音声を準備します。 1.8 GB のビデオがラップトップから離れることはありません。次のステップでは、音声のみのアップロードのみが準備されています。
  2. **話者ラベル付きの 30 秒間のプレビューが表示されます。**冒頭のやりとりがすでに「話者 1」と「話者 2」に分割されていることがわかり、コミットする前にダイアライゼーションが適切であることを確認できます。このプレビューは、完全にアカウントを必要としない唯一のステップです。
  3. **残りを文字に起こすにはサインアップします。**文字起こしはゲートされているため、アカウントが必要です。新しいアカウントには 30 分間の無料お試し期間が与えられます。1 ドルの保留でカードを認証するとすぐに承認され、その後すぐに解放されます。請求されることはありません。または、お住まいの国で利用可能な支払い方法を使用している場合は最初の購入時に行われます。 50 分の面接は無料の 30 分を超えるため、追加料金を支払う必要があります。 料金ページには 1 分あたりの料金が記載されています。
  4. 完全な音声が文字起こしされてから削除されます。音声ファイルは文字起こしの準備ができた瞬間に処理され、削除されます。ソースの音声のコピーはサーバー上に残りません。
  5. ラベルを変更してエクスポートします。「話者 1」をインタビュアーに、「話者 2」をソースのペンネームに名前を変更してから、編集者用に DOCX にエクスポートし、メモ用に TXT を保存します。トランスクリプトは、削除するまで暗号化された状態でダッシュボードに保存されます。

この例のポイントは、どの段階においても、生のビデオがサーバー上に存在すること、音声がトランスクリプトよりも存続すること、または保存されたトランスクリプトが、キーを持たずにストレージに侵入した人によって読み取られることはないということです。それが、「ファイルを文字に起こした」ということと、「ソースの録音された音声を無期限に保存した」ことの違いです。

よくある悩みとその答え

いくつかの状況は、直接対処するのに十分なほど頻繁に起こります。

**「私のファイルは巨大です。それは長くて危険なアップロードを意味しますか?」**大きなビデオはビデオはデバイス上に残り、音声のみが送信されるため、最初にローカルで準備されます。互換性のあるトラックは再エンコードせずにコピーされますが、変換は必要なファイルのために予約されます。ファイルサイズの制限はありません。録画が 10 時間以内であれば、非常に大きなビデオでもブラウザで直接準備されます。

**「トランスクリプトにまったく保存したくない内容が含まれている場合はどうなりますか?」**音声認識のみにプライベートモードを使用し、アカウントにトランスクリプトを保存せずにパスワードで保護されたアーカイブ結果を使用します。通常のトランスクリプトの場合は、必要なものをエクスポートし、不要になったらトランスクリプトを削除します。

**「オーディオファイルしかなく、ビデオはありません。ブラウザでの抽出はまだ問題ありますか?」**プレーンオーディオファイルの場合、保留すべきビデオがないため、特定の保護は適用されません。まだ機能しているのは、機密性の高い作業用の大きなものです。音声は文字起こし後に削除され、エンジンは何も保持せず、文字起こしは保存時に暗号化されます。

**「無料ツールは自動的に安全性が低くなりますか?」**自動的ではありません。しかし、ツールが完全に無料で、それがお金を稼ぐ明らかな方法がない場合は、何が収益化されているかを尋ねる価値があります。場合によっては、あなたが提供したデータが答えとなることもあります。有料ツールまたは従量課金制ツールには、アップロードのマイニングに依存しない資金調達モデルが少なくともあります。

保存されたアーカイブと文字起こしと削除

文字起こしツールには 2 つの正直なモデルがあり、どちらが適しているかは文字起こしの対象によって異なります。

A保存アーカイブツールは、音声とトランスクリプトを検索可能なライブラリに保存し、数か月後に戻ることができます。これは、自分の録音に関する個人的なナレッジベースを構築していて、ポッドキャスターが自分のエピソードをアーカイブしている場合のように、コンテンツが機密ではない場合に非常に役立ちます。その代償として、あなたの録音の山が他人のサーバー上に存在することになります。

Hushscript などの文字起こしと削除ツールは、文字起こしを成果物として扱い、音声をそれを取得する手段として扱います。音声は完了すると削除され、トランスクリプトはエクスポートして削除できます。これは、録音が機密であり、ソースファイルの独自のコピーをすでに持っている場合に、ツールがコピーを保持する理由がないため、正しいモデルです。

どちらも間違いではありません。しかし、法的記録、インタビュー、セラピーノート、または匿名の情報源を持つものについては、2 番目のモデルは、最初のモデルが時間の経過とともに蓄積する責任を取り除きます。

注意すべき危険信号

ツールを評価するとき、いくつかの信号は警告として扱う価値があります。

曖昧な保持言語「ファイルを合理的な期間保存する」または「サービスを向上させるためにファイルを保持する場合がある」ということは約束ではありません。 「合理的」にはあらゆる意味があり、「サービスの向上」にはトレーニングが含まれることがよくあります。

規約に隠されたトレーニング条項。プライバシー ポリシーだけでなく、利用規約の「利用規約」、「コンテンツ」、または「ライセンス」セクションを確認してください。一部のツールは、送信されたコンテンツを好きなように使用するための広範なライセンスを自身に付与しており、その中にはモデルのトレーニングを密かに含めることもできます。

**直接的な質問に対する明確な答えはありません。**サポートが音声がいつ削除されるか、または録音がトレーニングに使用されるかどうかを明確に言えない場合は、沈黙自体が答えになります。

**無料で、目に見える資金調達モデルもありません。**ツールが完全に無料で、経済性は明確ではありません。販売されている製品が、あなたが引き渡すデータであるかどうかを検討してください。

**ペイウォールエクスポートと組み合わせた無期限のストレージ。**音声を永久に保存するツールですが、トランスクリプトのエクスポートに料金がかかるのは、ユーザーが自分のコンテンツを制御できるようにするためではなく、ストレージに依存し続けるように設計されています。


インタビュー、法的録音、または内容が機密性の高い音声の場合、重要なのは文字起こしが正確かどうかではなく、それを生成した音声が自分のものであり続けるかどうかです。 非公開の文字起こしページでは、Hushscript のアプローチがデフォルトとどのように比較されるかを説明します。

削除の仕組み(削除が発生した場合、何が「削除」とみなされるのか、およびそれをデフォルトにした理由)について詳しく知りたい場合は、文字起こし後に音声を削除する理由で詳しく説明します。

独立した情報源と規格

Hushscript は、競合関係にない独立した情報源を参照しています。これらは研究、規格、プラットフォームの仕組みを説明するもので、Hushscript を推奨するものではありません。

情報源の確認日:

よくある質問

文字起こしのために音声をアップロードするのは安全ですか?

それは、録音、サービス、および適用されるルールによって異なります。ブラウザ側のビデオ処理、短い音声保持、暗号化されたストレージ、トレーニングなしポリシーにより、暴露が軽減されます。すべてのアップロードが規制された作業や機密性の高い作業に適しているわけではありません。まずサービスのポリシーと独自の要件を確認してください。

Hushscript は文字起こし後に音声を保持しますか?

いいえ。音声は、トランスクリプトの準備ができた瞬間にサーバーから削除されます。猶予期間、バックアップバケット、コールドストレージ、トレーニングコピーはありません。ダッシュボード内のトランスクリプトテキストだけが保持されます。これも削除するまでです。

ビデオをアップロードすると、ビデオファイルはデバイスから削除されますか?

いいえ。 Hushscript はブラウザでビデオの音声トラックを準備し、その音声のみを文字起こし用に送信します。互換性のあるトラックは再エンコードせずにコピーされます。変換は必要な場合にのみローカルで実行されます。ビデオはデバイスに残ります。

トランスクリプトは暗号化されていますか?

はい。トランスクリプトは保存時に暗号化されるため、ストレージが漏洩した場合、あなたの言葉は平文ではなく判読不能な暗号文になるでしょう。暗号化によりストレージ侵害が防止されます。キーはサーバー上に保持されているため、アプリがトランスクリプトを表示できるため、ゼロ知識ではありません。

トランスクリプトサービスが私の録音をトレーニングしていないことはどのようにしてわかりますか?

直接質問し、マーケティングページではなくプライバシー ポリシーをお読みください。 「サービスを向上させるためにコンテンツを使用する可能性があります」のような表現は危険信号です。この表現は通常、モデルのトレーニングを対象としているためです。音声はモデルのトレーニングや微調整には使用されないという明示的な記述を探してください。

どのような種類の録音が最もリスクを伴いますか?

法律相談、治療セッション、医療訪問、商談、人事面接、ジャーナリズムソースの録音などが明らかなケースです。ただし、個人を特定できる音声、名前、個人情報が含まれる録音は、管理していないサードパーティのサーバーに保存されている場合、ある程度のリスクが伴います。

機密コンテンツの文字起こしは安全ですか?

ツールを慎重に選べば、はい、安全です。他人のサーバーに無期限に残しておきたくないものについては、ブラウザで音声を抽出し、文字起こし後に削除し、保存するものを暗号化し、あなたのデータでトレーニングしないことを明確に示すサービスを使用してください。アップロードする前に、プライバシー ポリシーでこれらの主張をそれぞれ確認してください。

無料30分からはじめる

はじめる – 無料30分