AI文字起こし

AI文字起こしは安全?録音データの保存・削除・学習を比較

AI文字起こしをデータ保存場所、暗号化、保持期間、削除、AI学習、外部委託先の6点から確認。機密会議で見るべき項目を整理します。

AI文字起こしのプライバシーは、「暗号化しています」という一文だけでは判断できません。会議録音には氏名、顧客情報、製品計画、医療情報、法務相談、未公開の経営判断が含まれることがあります。文字になった後も機密性は消えません。

見るべきなのは録音のライフサイクルです。収録、アップロード、音声認識、保存、共有、AI要約、保持、削除の順に追うと、どこで誰がデータを扱うのかが見えてきます。本記事は法的助言ではなく、AI文字起こしサービスを選定するための実務チェックです。

AI文字起こしの録音データはどこを通る?

クラウド型では、端末で音声を取得し、ネットワーク経由でサーバーへ送り、音声認識を実行し、録音と文字起こしを保存する流れが一般的です。さらにAI要約や質問機能を使うと、文字起こしが別の生成AI処理経路へ渡る場合があります。

HTTPSは通信中の保護には重要ですが、それだけで十分ではありません。サーバー到着後の暗号化、保存地域、バックアップ、アクセス権、subprocessor、削除まで確認して初めてデータ経路を評価できます。

プライバシー比較で最初に確認する6項目は?

保存地域。 Nottaの現行公式セキュリティ資料はAWSを利用し、データを東京のデータセンターに保存すると説明しています。通信はTLS 1.2、保管中はAES-256で暗号化すると明記されています。日本企業にとって保存地域を具体的に確認できる点は重要です。

保持期間。 Nottaの日本語ヘルプでは、ユーザーが文字起こしデータを手動削除する、ワークスペースを削除する、またはアカウントを削除しない限り、自動削除されないと説明されています。長期検索には便利ですが、社内規程で短期保持を求める場合は運用設計が必要です。

削除方法。 Otterの2026年7月更新ヘルプでは、通常削除されたconversationは共有解除後Trashに30日残り、その後サーバーから完全削除されます。法人向けにはカスタム保持期間も案内され、期限到達後の削除ジョブは日次で実行され、最大48時間以内の削除と説明されています。

AI学習。 Otterは自社モデルと外部AIサービスを分けて説明しています。公式Privacy & Securityでは、ユーザーデータを自動的にde-identifyして自社モデル学習に使う一方、外部AIサービス提供者は顧客データをモデル学習に利用しないとしています。「外部AIが学習しない」を「どこでも学習しない」と読み替えないことが重要です。

アクセス権。 チーム共有、リンク共有、管理者、サポート対応によって閲覧者は変わります。Otterはconversationの共有をユーザーが制御し、トラブル対応で従業員やサポートが音声・文字起こしへアクセスする前に明示的同意を求めると説明しています。

外部委託先。 ストレージ、分析、認証、生成AI、サポートは別会社が担当することがあります。プライバシーポリシーだけでなくsubprocessor一覧も確認すると、実際の処理チェーンが分かります。

TLS・AES-256・SOC 2 Type IIは何を意味する?

TLSは通信中、AES-256は主に保管中のデータを守る技術です。NottaはTLS 1.2とAES-256、OtterはAWS S3のAES-256 server-side encryptionを公開しています。重要な基礎対策ですが、削除時期や共有権限までは説明しません。

SOC 2 Type IIは一定期間の内部統制を第三者が評価する仕組みです。NottaとOtterはいずれも取得を公表しています。ただし認証マークだけで「絶対安全」と結論づけず、保持、削除、権限、契約と組み合わせて判断します。

確認価値が高い情報

  • 保存地域と越境移転の説明が具体的。
  • 通信中・保管中の暗号化方式が明示されている。
  • 保持期間と完全削除の手順が文書化されている。
  • 自社AIと外部AIの学習方針が分けて説明されている。
  • 法人向けにSSO、権限、保持設定などがある。

単独では不十分な情報

  • 「エンタープライズ級セキュリティ」という宣伝文句。
  • 適用範囲が分からない認証ロゴ。
  • データ経路を示さない法令準拠の表記。
  • App Storeのプライバシー表示だけでの判断。
  • 削除ボタンを即時物理削除と決めつけること。

NottaとOtterはプライバシー面でどう違う?

Nottaは日本市場で確認しやすい情報として、東京リージョンのAWS、TLS 1.2、AES-256、SOC 2 Type IIを公開しています。一方、文字起こしデータはユーザーが削除操作をしない限り自動削除されないと案内しています。長期保存を望む個人には便利ですが、企業は社内のretention policyと合うかを確認すべきです。

Otterは保存、削除、モデル学習、政府からのデータ要求、従業員アクセス、法人保持設定まで詳細な資料を公開しています。ヘルプではAWSの米国リージョン利用を説明し、プライバシーポリシーでは越境移転にも触れています。クラウド共同作業の利便性と、データが外部インフラで管理される事実をセットで評価する必要があります。

どちらが「絶対に安全」という比較ではありません。公開予定のインタビューと、M&Aや患者情報を含む会議では必要な管理レベルが違います。製品名ではなく、録音の機密度と契約プランを基準に選ぶべきです。

Atter AIや国内サービスも同じ基準で見るべき?

同じです。Atter AIも本サイトのブランドだからといって確認基準を下げるべきではありません。機密録音では、その時点の公開ポリシー、アプリ内設定、組織向け契約で確認できる内容だけを根拠にします。未確認の保存地域や認証を推測してはいけません。

日本企業のサービスでも「国内企業だからデータも必ず国内」とは限りません。音声認識、ストレージ、分析、生成AIで海外インフラを使うことがあります。会社所在地ではなくデータフローを確認します。

ローカル文字起こしならプライバシー問題は解決する?

「原音を端末外へ出さない」が必須条件なら、ローカル処理は強い選択肢です。クラウドへのアップロードを一つ丸ごと除外でき、外部処理者も減らせます。法務、研究、内部調査などではこの設計差が機能数より重要になる場合があります。

ただしMacやPCのフォルダが自動的にクラウド同期されていれば、実質的には外部保存が発生します。書き出したTXTやSRTの誤送信、端末紛失、マルウェアも残ります。ローカルはリスクを減らす設計であって、無条件の安全保証ではありません。

端末内処理の製品そのものを探している場合はプライバシー重視の文字起こしアプリも参照してください。本記事はクラウド型を含むサービスのデータライフサイクル監査に焦点を置いています。

録音同意があればデータ利用も問題ない?

録音への同意と、その録音を第三者クラウドへ送ることへの説明は同じではありません。参加者が録音を知っていても、長期保存や生成AI要約まで想定していない場合があります。

さらに医療、教育、雇用、法務では追加の規程や契約義務があり得ます。高機密の利用では一般記事だけで法的判断をせず、社内の法務・情報セキュリティ・個人情報保護担当へ確認してください。

企業は録音をどう分類すればよい?

公開前提の音声、通常の社内会議、高機密録音の三段階でも十分役立ちます。顧客の本人情報、未公開財務、法務相談、医療情報、認証情報などは高機密側に置くべきです。

分類によって必要条件を変えます。通常会議なら標準的なクラウド管理で足りる場合があります。高機密なら保存地域、短期自動削除、SSO、DPA、学習制限、共有制御、あるいは完全ローカル処理を条件にできます。

15分でAI文字起こしを監査する方法

  1. データ経路を書く録音、アップロード、認識、AI要約、保存、共有、書き出し、削除を順番に並べます。
  2. 一次情報を読む保存地域、暗号化、認証をベンダー公式のsecurity/privacy文書で確認します。
  3. 保持と削除を確認する削除が即時か、Trashを経由するか、バックアップや法人設定が影響するかを調べます。
  4. AI学習を分解する自社モデル、外部AI、人手ラベリング、サポートアクセスを別々に質問します。
  5. 機密度に合わせる公開インタビューと機密会議を同じ承認基準で扱わないようにします。

一般クラウドへ入れない方がよい録音は?

漏えい時の影響が大きい音声は、便利さだけでアップロードを決めるべきではありません。未公開M&A、弁護士との秘匿性が必要な会話、患者情報、認証情報、決済情報、子どもの高機密情報などは、組織の承認と契約条件を先に確認します。

データ最小化は実践しやすい原則です。不要な録音はアップロードしない。不要になった音声は残さない。閲覧する必要がない人には共有しない。この三つだけでも事故面積をかなり小さくできます。

プライバシーと便利さはどう両立する?

完全ローカルは外部データ移動を減らせますが、クラウド型は端末横断検索、チーム共有、会議Bot、自動要約、ナレッジ化に強みがあります。どちらが正しいかではなく、録音の分類に合うかで判断します。

比較前に最低条件を書いてください。「日本または指定地域に保存」「30日で自動削除」「顧客データを学習に使わない」「SSO必須」「DPA必須」などです。条件が先に決まれば、機能や価格の比較がぶれません。

AI文字起こしのプライバシーチェックリスト

  • 音声と文字はどこで処理・保存されるか。
  • 国境を越えるデータ移転はあるか。
  • 通信中と保管中の暗号化方式は何か。
  • Delete後にTrashやバックアップへ何日残るか。
  • 自社モデルの学習に顧客データを使うか。
  • 外部AIサービスは学習に利用するか。
  • 従業員、サポート、管理者はいつアクセスできるか。
  • どのsubprocessorがデータを受け取るか。
  • 2FA、SSO、権限、retention設定はあるか。
  • 参加者は録音目的と保存方法を理解しているか。
  • 高機密データは社内承認を得ているか。

よくある質問

AI文字起こしは録音をクラウドに送りますか?

多くのクラウド型は送りますが、ローカル型もあります。製品名ではなく実際の処理経路を確認してください。

文字起こしを削除すると録音もすぐ消えますか?

必ずしもそうではありません。Otterは通常削除で30日間Trashに残ると案内しており、サービスごとに確認が必要です。

録音データはAI学習に使われますか?

方針は各社で異なり、自社モデルと外部AIでも違う場合があります。二つを分けて確認することが重要です。

AES-256なら録音は安全ですか?

AES-256は重要ですが、保持、権限、学習、外部委託先、アカウント管理まで含めて評価する必要があります。

企業が文字起こし導入前に確認すべき点は?

まず録音の機密度を分類し、保存地域、保持、削除、アクセス、AI学習、subprocessor、契約を確認します。

ローカル文字起こしはクラウドより安全ですか?

クラウド送信を減らせる点は有利ですが、端末、バックアップ、共有のリスクは残ります。