メインコンテンツへスキップ

Zoom ミーティングまたは録画を文字に起こす方法

著者: 公開日: 最終確認日:

Zoom ミーティングをテキストに変換するには 2 つの方法があります。 1 つは、AI メモ取りボットを可視の出席者として通話に参加させ、リアルタイムで話を聞くことです。もう 1 つは、会議を自分で録画し、保存したファイルを後でアップロードすることです。Hushscriptは 2 番目の種類です。これは、Zoom の統合、会議ボット、または通話に参加するメモ係ではありません。

その違いが、このガイドの重要な点です。アップロードのアプローチでは、会話中にサードパーティのサービスは存在せず、Zoom アカウントへのアクセスは何も許可されず、参加者リストに追加の名前が表示されて全員が見ることもありません。保存した瞬間から録音を制御できます。

以下に完全なプロセスを示します。Zoom から録音を取得し、音声を抽出し、話者ラベル付きトランスクリプトを作成し、全体を非公開にします。これは、2 人による 1 対 1 の会議でも、8 人が通話する取締役会でも機能します。

必要なもの

必要なものは 3 つあり、ほぼ確実にすべてが揃っています。

最初は会議の記録です。 Zoom は、コンピューターまたは Zoom クラウドアカウントに保存するものを作成できます。 ボストン大学の最新の Zoom 録画ガイドでは、ホストのコントロールと作成されたファイルについて説明しています。 2 つ目は、それを転記する権利です。これは通常、あなたが参加者であり、必要な同意を得て記録したことを意味します。 3つ目はブラウザです。 Hushscript は Chrome、Firefox、Safari、または Edge で実行でき、インストールするものは何もありません。

ローカル録画には Zoom 有料プランは必要ありません。また、アプリに接続したり、カレンダーへのアクセスを許可したりする必要もありません。ファイルが機能します。

ローカルまたはクラウドで会議を録画します。

Zoom は主催者に 2 つの録画モードを提供し、どちらを選択するかによってファイルの保存場所が決まります。

コンピュータの録画は、録画をクリックした人のコンピュータに保存されます。ダウンロードしたファイルを管理するのはあなたであり、Zoom はその録画をクラウド録画ライブラリに配置しません。正確なフォルダーとファイルは Zoom クライアントと設定によって異なるため、固定パスに依存するのではなく、Zoom の現在の録画コントロールを使用してください。あなたが主催者で、後でファイルをアップロードしたい場合、これが通常最も簡単なパスです。

代わりに、クラウド録画が Zoom アカウントにアップロードされます。ファイルを取得するには、Zoom ウェブポータルを開き、[録画] を選択し、ミーティングを見つけて MP4 をダウンロードします。クラウド録画の可用性はアカウントによって異なり、ホストによって制御されます。他の参加者は、ホストがアクセスを共有している場合にのみアクセスできます。これは、誰がコピーを持っているかを考えるときに覚えておく価値があります。

どちらのルートでも、コンピュータ上にファイルが残ります。そのファイルはアップロードするものであり、Hushscript はローカル録音かクラウド録音かを気にしません。

3 つのステップで録音を文字起こしします。

ファイルが完全な MP4 であっても、別のオーディオトラックであっても、フローは同じです。

  1. ファイルを追加してプレビューを確認します。 音声をテキストに変換するページを開き、MP4 または M4A をアップロード欄に追加します。ブラウザ内で動画から音声が抽出され、会議冒頭 30 秒の話者ラベル付きプレビューが表示されます。この段階ではアカウントが不要なので、処理を始める前に冒頭部分の品質を確認できます。
  2. **サインアップして残りを文字に起こしてください。**プレビューが正しく表示される場合は、メールでアカウントを作成してください。これがゲートステップです。 30 秒のテイストは誰でも参加できますが、会議全体を文字に起こすにはアカウントが必要です。本物を試すための 30 分間の無料体験が与えられます。これは、1 ドルの保留が付いているカードを認証した瞬間に付与され、すぐに解除され請求されません。または、別の方法で支払った場合は最初の購入時に付与されます。カードは必要ありません。
  3. **ファイル全体をアップロードしてトランスクリプトを取得します。**アプリに戻り、録音全体をアップロードします。トランスクリプトには、1 行に 1 つの発話が含まれ、それぞれが話者 A や話者 B などの話者ラベルに関連付けられ、タイムスタンプが付いています。そこから、話者のラベルを変更し、エクスポートします。

オーディオのみがデバイスから出力されます。 MP4 はそのまま残り、抽出された音声はトランスクリプトの準備ができた瞬間に削除され、残るのはあなたが所有するテキストです。

実際に行われた例

4 人で 45 分間の四半期レビューを主催し、それをローカルで記録したとします。 Zoom は MP4 をDocuments/Zoom/2026-06-18 Q2 Review/にドロップしました。その MP4 をアップロード領域にドロップすると、最初の 30 秒間は 2 人の別個の話者がすでに分離されている状態できれいにプレビューされ、残りの作業を行うためにサインアップします。

完全なアップロードの処理が完了すると、次のようなトランスクリプトが作成されます。

話者 A [00:05:22]: 第 2 四半期の数字が入りました。マージンは保たれていますが、音量は 12 下がっています。パーセント。
話者 B [00:05:31]: それは先週調達でフラグが立てられた内容と一致します。
話者 A [00:05:38]: そうですね。そこで問題は、今予報を調整するか、それとも 7 月まで待つかということです。
話者 C [00:06:02]: 私は待ちます。 1 つのソフト月はまだトレンドではありません。

[話者 A] をクリックして「サラ」と入力すると、彼女が話したすべてのセリフのラベルが一度に変更されます。あなたは他の人にも同じことをします。 5 分間クリックすると、4 つの匿名の声が、誰が何を言ったかの名前付き記録に変わります。それを DOCX としてエクスポートし、4 人の出席者に回覧すると、通話中に誰もメモを書く必要がなく、会議が文書化されます。

誰が何を発言したかを示す話者ラベル

構造のない長いテキストでは、行動するのが困難です。各行の話者を示す会議の記録は実際に使用できるもので、Hushscript はデフォルトですべての記録にこれらのラベルを追加します。話者キャップや有料枠はありません。

ラベルに実名を入力するには 3 回のクリックが必要です。エディターで話者 Aの任意のインスタンスをクリックし、その人の名前を入力すると、その話者が表示されるすべての場所でラベルが更新されます。 5 人による 60 分の会議の場合、ラベル変更パスには 1 ~ 2 分かかります。 30 分間の 1 対 1 の場合、所要時間は 1 分もかかりません。

名前が入力されると、会話の内容のようにトランスクリプトが読み上げられます。 1 人の人の貢献をスキャンしたり、1 人の参加者が行ったすべてのコミットメントを取得したり、正しい名前を付けて決定を引用したりすることができます。話者の分離が内部でどのように機能するかについて詳しくは、話者の識別をご覧ください。

会議を非公開に保つ

社内会議では、予算、人数、戦略、法的暴露、その場にいない人々についての率直な意見など、最も漏洩したくない内容が取り上げられます。テキスト自体と同じくらい、会議がどのようにテキストになるかが重要です。

メモ作成ボットが通話に参加すると、それはライブ参加者になります。これは誰にでも表示され、会議セッション内から記録され、話している間、会話はそのサービスのインフラストラクチャを通じてストリーミングされます。一部の参加者は、見慣れない参加者がレコーダーとしてラベル付けされているのを見た瞬間にざわつきます。また、リアルタイムストリームの送信先を常に制御できるわけではありません。

アップロードベースの文字起こしでは、ボットを方程式から排除します。 Hushscript が関与する前に、録音はデバイス上にすでに存在します。音声はブラウザでローカルに抽出されるため、ビデオファイルがアップロードされることはありません。サーバーに到達した音声はトランスクリプトの準備ができた瞬間に削除され、Zoom アカウント、カレンダー、参加者には何も影響しません。自分で会議を録画し、後でアップロードすることは、室内のボットに代わる完全な手段であり、ボットを使用しない会議の文字起こしがより適切なケースになります。

知っておく価値のある層がもう 1 つあります。トランスクリプトは保存時に暗号化されます。私たちのストレージが漏洩した場合、その内容は平文での会議ではなく、判読できない暗号文になるでしょう。これは漏洩防止であり、私たちの側の誰もそれを読み取ることができないという主張ではありません。キーは私たちのサーバーに保持されており、あなただけが保持しているわけではありません。データの処理方法の全体像は、非公開文字起こし ページにあります。

一般的な Zoom 録画のトラブルシューティング

実際の会議の音声は、きれいなスタジオ録画よりも汚いため、最もよく発生する問題とその対処方法をここに示します。

**人々は互いに話し合っています。**四半期ごとのレビューやブレインストーミングは白熱します。2 人の声が重なると、システムは 1 人の話者がどこで終わり、次の話者が始まるかを推測する必要があります。クロストークは、ラインに誤ったラベルが付けられる唯一の最大の原因です。音声を後から修正することはできませんが、トランスクリプトを修正することはできます。混雑している部分をざっと調べて、ラベルが間違っていると思われる箇所を修正します。今後は、話していないときはミュートするようにユーザーに依頼することが、どの設定よりもトランスクリプトの品質に大きく影響します。

1 人が他の人よりもはるかに静かです。他の参加者がヘッドセットを使用しているときに、ある参加者が部屋の反対側のラップトップのマイクからダイヤルインした場合、回線が弱くなるか、場合によっては切断される可能性があります。ここでZoom独自のオーディオ設定が役に立ちます。録音前に [元の音声に合わせて最適化] をオンにし、遠隔地の参加者にヘッドセットの使用を依頼すると、静かな音声が他の参加者に近づくようになります。

ファイルが大きい長時間のビデオ会議の場合、かなりの MP4 になる可能性がありますが、アップロード用に準備されるのは音声のみです。 Hushscript は、互換性のあるオーディオトラックを再エンコードせずにブラウザにコピーし、必要な場合にのみローカルで変換するため、ビデオはデバイス上に残ります。録音は最大 10 時間実行でき、ファイルサイズの制限はありません。非常に大きな録音であっても、ブラウザーで直接準備されます。

**強いアクセントや専門用語。**さまざまな国の人々が集まる部屋や、製品コード名でいっぱいの通話では、文字起こし者は奇妙な単語につまずく可能性があります。このモデルは幅広いアクセントを適切に処理し、言語 ページにリストされている約 99 の言語にわたって言語を自動的に検出します。まれな聞き間違いの用語については、エクスポートされたファイル内で簡単に検索して置換すると、すべてのインスタンスが一度に修正されます。

**話者 A が誰であるかわかりません。**会議が世間話で始まるとき、最初にラベル付けされた音声が必ずしも主催者であるとは限りません。タイムスタンプを使用して、誰かが覚えているトピックを紹介した瞬間にジャンプし、コンテキストからそのトピックを特定します。 1 つまたは 2 つの音声を一致させたら、通常、残りはすぐに適切な位置に収まります。

**録音されるのは音声のみです。**Zoom が MP4 ではなく M4A を作成した場合は、何も変わりません。 M4Aを直接差し込みます。抽出するビデオがないため、直接文字起こしに進みます。

ローカル録画とクラウド録画: どちらを文字起こしするか

ローカルとクラウドの両方のコピーが存在する場合は、どちらの方法でも文字起こしは同一であるため、都合の良い方を文字起こしします。選択は品質よりも制御に重要です。

ローカル録画は、別の決定をするまでマシン上にのみ保存されます。これは、コピーの数を最小限に抑えたい機密性の高い会議に適しています。クラウド録画は、Zoom のクラウドに追加のコピーが保存される代わりに、別のデバイスから取得するのが簡単で、ラップトップが故障した場合でも失いにくくなります。日常的なチーム同期にはクラウドが便利です。機密事項については、ローカルで録音すると、最初からファイルが手元に残ります。

どちらをアップロードしても、文字起こしステップのプライバシーは同じです。音声の入力、文字起こしの出力、音声の削除です。

会議の文字起こしをきれいに作成するためのヒント

録音の前後にちょっとした注意を払うと、非常に役立ちます。

会議の前に、ラップトップのマイクではなくヘッドセットを使用することを推奨し、発言していないときはミュートするよう参加者に依頼します。最低の帯域幅設定ではなく、適切なオーディオ品質で録音すると、モデルの操作性が向上します。これにはスタジオは必要ありません。平均的な通話よりも少し良い習慣を身につけるだけです。

文字起こし後、会議の内容が記憶に新しいうちに、まず話者のラベルを付け直し、次に、忙しい瞬間の記憶と照らし合わせて文字起こしを 1 回読みます。 1 回のパスでいくつかのクロストークの漏れをキャッチでき、その結果、自信を持って回覧できる記録が得られます。

Hushscript は、会議でもスタジオインタビューでも同じ最上位 AI で実行されるため、無料ではありません。サブスクリプションなしの従量課金制で、文字起こしした分だけ料金がかかります。最大のパックでは 1 分あたりわずか 1 ペニーです。現在のパックの価格は価格ページにあります。

よくある質問

上記の質問は実践的なポイントをカバーしています。 2 人の会話に適用される同じ話者ラベル付けワークフローについては、インタビューを文字に起こす方法をご覧ください。複数話者のショーノートの角度については、ポッドキャストを文字に起こす方法をご覧ください。 Microsoft Teams と Google Meet のアプローチは Zoom の場合と同じです。通話を録音し、ファイルを保存して、音声をテキストに変換してアップロードします。

独立した情報源と規格

Hushscript は、競合関係にない独立した情報源を参照しています。これらは研究、規格、プラットフォームの仕組みを説明するもので、Hushscript を推奨するものではありません。

情報源の確認日:

よくある質問

Hushscript はボットとして Zoom ミーティングに参加しますか?

いいえ。 Hushscript はアップロードベースであり、会議の統合ではありません。ミーティングを自分でローカルまたは Zoom のクラウドに記録し、保存したファイルをアップロードします。 Zoom アカウントに何も接続されず、通話に追加の参加者も表示されません。

録画を Zoom から取得するにはどうすればよいですか?

ローカル録画の場合、Zoom は自動的にコンピュータに保存します (通常はドキュメント/Zoom の下にあります)。クラウド録画の場合は、Zoom アカウントにログインし、録画を開いて MP4 をダウンロードします。どちらの方法でも、アップロードできるファイルが完成します。

ビデオファイル全体がアップロードされますか?

いいえ。音声は、何かが送信される前にブラウザでビデオから抽出されます。 MP4 はデバイス上に残り、音声のみがサーバーに到達し、トランスクリプトの準備ができた時点で削除されます。

誰が何を言ったかを示すトランスクリプトを取得できますか?

はい。話者ラベルはすべてのトランスクリプトに自動的に含まれます。文字起こし後、任意のラベルをクリックして話者 A を参加者の本名に置き換えると、文字起こし内のすべての場所でその名前が更新されます。

会議に 3 人以上の参加者がいる場合はどうなりますか?

Hushscriptは、話者キャップを使用せずに複数の話者を自動的に分離します。精度は、会議が盛り上がるとよくあることですが、お互いに話し合うよりも順番に話す方が最適です。

会議が文字に起こされていることを人々に伝える必要がありますか?

録音の同意規則は国や州によって異なるため、参加者のいる地域の法律を確認してください。実際には、すでに Zoom で会議を録画しているため、同意の質問は録画自体に関するものになります。保存したファイルを後で文字起こししても、通話に新しい参加者は追加されません。

トランスクリプトは非公開に保たれていますか?

音声はトランスクリプトの準備ができるとすぐに削除され、トランスクリプト自体は保存時に暗号化されます。ストレージが漏洩した場合、その内容は平文の会議ではなく、判読できない暗号文になります。ワンクリックでトランスクリプトを削除することもできます。

無料30分からはじめる

はじめる – 無料30分