macOS音声入力はAppleの組み込み音声テキスト変換ツールです。あなたが話す音声はトランスクリプション処理のためにAppleのサーバーに送信されます。機械上に留まるわけではありません。Appleは転送中の音声を暗号化し、モデル学習には使用されないと述べていますが、暗号化されたサーバーへのアップロードは、基本的に音声をローカルで処理することと異なります。
あなたの音声はどこに行く
macOS音声入力で音声を入力すると、Appleのサーバーに送信され、トランスクリプションエンジンが処理し、テキストが返されます。Appleのプライバシードキュメントは、転送中の音声は暗号化されていると説明し、モデル学習やサードパーティへの販売には使用されないと述べています。
暗号化は転送中の音声を保護しますが、コンテンツ自体はデバイスを離れます。医療、法律、財務会話などで音声は絶対にマシンを離れてはならないという場合、このツールは不適切です。サーバーベースのアプローチは、強力な暗号化でも、オンデバイス処理と根本的に異なります。
オフライン要件について
macOS音声入力はすべてのトランスクリプションにインターネット接続が必要です。これはマイナーな制限ではなく、アーキテクチャです。毎回音声を入力するたびに、音声はAppleのインフラストラクチャに移動してテキストとして戻る必要があります。飛行機内、SCIF、ネットワーク制限されたコーポレートラップトップ、またはデバイスがAppleのサーバーに到達できない環境では動作しません。
オフライン機能が必須の場合、オンデバイス音声認識が該当するカテゴリです。オンデバイスツールはローカルにトランスクリプションエンジンを実行するため、何もデバイスを離れません。
保持ポリシーを理解する
Appleのプライバシードキュメントは、音声はモデル学習のために保持されないと述べています。しかし、トランスクリプション後に音声に何が起こるかは詳しく説明されていません。一部のサービスはトランスクリプト作成直後に音声を削除します。他のサービスは品質のために一時的に保持します。それでも他のサービスは無期限に保持します。トランスクリプション完了後の音声保持があなたの使用に重要な場合、Appleがそれを文書化するかどうか確認してください。
サーバーベースが受け入れられない場合
暗号化とサーバー処理のトレードオフは正当です。Appleの実装は何をしているかについて透明です。オンデバイス処理が代替手段として利用可能です。
Wispr Flowなど多くの商用音声入力アプリも音声をサーバーに送信して処理しますが、保持とモデル学習のポリシーは異なります。Apple音声入力と有料ツールの比較はApple音声入力と有料ツールの違いをカバーしています。