オンラインOCRは安全?画像の扱いと確認ポイント
オンラインOCRツールを使うと画像はどこへ行くのか。プライバシーポリシーで確認したい質問と、端末内で処理されているかを自分で確かめる簡単な方法を紹介します。
更新日
OCRにかける画像には、身分証明書、銀行の明細、医療関係の手紙、契約書、個人的なチャットのスクリーンショットなど、プライベートなものが多く含まれます。オンラインツールが「安全」かどうかは、2つの問いに集約されます。画像はどこで読み取られるのか。そして、そのあと画像とテキストはどうなるのか、です。
このガイドは、特定のサービスを評価するものではありません。ファイルを慎重に扱っているサービスもたくさんあります。ご自身で確かめる方法を紹介し、文書ごとに適したツールを選べるようにするためのものです。
画像をアップロードすると通常どうなるか
オンラインOCRツールの動き方は2通りあり、両方を組み合わせているものもあります。
サーバー側での処理
ほとんどのオンラインツールは、画像をサーバーに送って読み取ります。ブラウザがファイルをアップロードし(通常は暗号化されたHTTPS接続で)、サーバーがOCRを実行して、テキストがページに返ってきます。その過程では、次のようなことが起こります。
- ファイルは少なくとも1台のサーバー上に存在し、処理の順番を待つ間にストレージに書き込まれることもあります。
- サーバーのログには通常、日時、IPアドレス、ファイルサイズなど、リクエストごとの詳細が記録され、それ以上の情報が残ることもあります。
- メインのコピーが削除されたあとも、バックアップにしばらくコピーが残ることがあります。
- サービスが利用している他社(クラウドホスティング事業者や外部のOCR・AIサービスなど)に画像が渡されることがあり、それぞれに独自の規約があります。
- サポートやデバッグのために、スタッフがファイルにアクセスできる場合があります。
- ポリシーによっては、ファイルや抽出されたテキストがサービスの改善に使われ、そこにモデルの学習が含まれることもあります。
これらがすべて問題というわけではありません。ファイルをすぐに削除し、アクセスを制限し、学習には一切使わないサービスもあります。大事なのは、あなたがそのサービスのポリシーと、実際の運用がポリシーどおりであることを信頼するしかない、という点です。
端末上での処理
OCRエンジンをブラウザにダウンロードし、お使いの端末上で画像を読み取るツールもあります。画像がサービスに送られることはないので、保存期間、ログ、学習といった問題がそもそも当てはまりません。
OSの標準機能もさまざま
OSに組み込まれたOCR機能も、それぞれ異なります。Appleはテキスト認識表示が端末上で動作すると説明しており、MicrosoftもSnipping Toolの文字認識はローカルで実行されるとしています。一方、Chromebook Plusのテキストキャプチャについて、Googleのヘルプページには選択した範囲がGoogleのサーバーに送信されると書かれています。確認すべきなのは、それぞれの機能のドキュメントです。使い方はスクリーンショットのガイドで紹介しています。
プライバシーポリシーで確認すべきこと
次の質問を念頭に置いてポリシーを読みましょう。
- 画像はどこで処理されるか。 「サーバーにアップロード」「ブラウザ内で処理」「端末上で」といった表現を探します。ここがあいまいなら、それ自体が答えです。
- どのくらいの期間保存されるか。 「1時間後に削除」のような具体的な期間のほうが、「必要な期間」よりも意味があります。その期間がバックアップやログにも適用されるかを確認しましょう。
- 学習や「サービスの改善」に使われるか。 使われる場合は、オプトアウトできるか、またそれがすでにアップロードしたファイルにも及ぶかを調べます。
- ほかに誰が扱うか。 ホスティング、OCR、AIの事業者やアクセス解析など、委託先や第三者の一覧を探しましょう。
- 抽出されたテキストはどうなるか。 アップロードされたファイルについては書いてあっても、そこから作られたテキストについて何も触れていないポリシーもあります。
- サーバーはどこにあるか。 データが処理される国によって、どの法律が適用されるかが決まります。
- 履歴がアカウントに保存されるか。 アカウントにひも付いて保存された結果は、削除するまでサーバー上に残ります。
- ページ上にほかに誰がいるか。 ページに組み込まれた広告ネットワークやアクセス解析のスクリプトは、あなたの訪問に関する情報を受け取ります。通常は画像を受け取ることはありませんが、知っておく価値はあります。
- ポリシーは具体的で最新か。 日付入りの詳しいポリシーのほうが、ありきたりなテンプレートよりも信頼できる兆候です。
プライバシーポリシーはあくまで意思の表明であり、証明ではないことを覚えておきましょう。端末上で処理するツールなら、その主張をご自身で確かめられます。
端末上での処理はどう違うか
OCRがブラウザ内で動く場合、画像の機密性は、他者のサーバーやスタッフ、保存期間に左右されません。ただし、トレードオフもあります。初回の訪問時にはエンジンと言語データをダウンロードする必要があり、読み取り速度はお使いの端末に左右されるため、古いスマートフォンでは時間がかかります。
端末そのものの管理も大切です。結果は、自分で管理していても忘れがちな場所に残ることがあります。履歴機能をオンにした場合のブラウザのストレージ、ダウンロードフォルダ、クリップボードなどです。Windowsのクリップボード履歴(Windows+V)や、端末間のクリップボード同期によって、コピーした内容が残ることもあります。
ご自身で確認する方法
「ネットワーク」タブを見る
ブラウザには、ページが行うすべての通信を表示する開発者ツールが備わっています。開発者でなくても使えます。
- パソコンのブラウザでツールを開きます。Safariの場合は、先にSafariの設定の「詳細」で開発者向けの機能をオンにしてください。
- 開発者ツールを開きます。WindowsとLinuxではF12またはCtrl+Shift+I、Macでは⌘+Option+Iです。
- 「ネットワーク」タブを選んで一覧をクリアし、ログを保持するオプションがあればオンにします。
- 画像を追加して、ツールに読み取らせます。
- 表示されたリクエストを確認します。アップロードは通常、画像のファイルサイズに近いサイズのPOSTまたはPUTリクエストとして表示されます。サイズで並べ替えると、大きな送信リクエストを見つけやすくなります。
端末上で処理するツールなら、初回利用時にエンジンや言語ファイルがダウンロードされる様子や、小さなアクセス解析のリクエストが見えることはあっても、画像ほどの大きさのデータが送信されることはありません。読み取ったあとも1分ほどパネルを開いたままにし、すべての種類のリクエストを確認しましょう。データは分割して送られたり、WebSocket接続で送られたりすることもあるからです。
オフラインで試す
ページを読み込んで画像を1枚読み取り、エンジンと言語データをキャッシュさせます。次にWi-Fiをオフにするか機内モードにして、別の画像を読み取ってみましょう。それでも動けば、読み取りは端末上で行われています。
オフラインテストは手軽ですが、それだけでは決定的ではありません。ページが画像を保存しておき、あとで送信する可能性もあるからです。「ネットワーク」タブのほうが確実な確認方法です。
Image to Text Appは、まさにこの方法で端末上でOCRを実行しています。両方のテストでぜひ確かめてみてください。詳しくはプライバシーのページをご覧ください。
機密性の高い文書を扱うときのアドバイス
- 身分証明書、医療記録、金融関係の明細、法的書類には、端末上で処理するツールを選びましょう。
- 必要ない部分は取り除く。 手紙から住所だけが必要なら、口座番号はトリミングで外しましょう。サーバー型のツールでは、アップロードする前にトリミングしてください。ツール内でのトリミングはアップロードのあとに行われるからです。
- 共用のパソコンや公共のパソコンは避ける。 どうしても使う場合は、履歴機能をオフのままにし、終わったらタブを閉じて、ダウンロードしたファイルを削除しましょう。
- クリップボードの履歴を消去する。 機密性の高いテキストをコピーしたあとは、特に端末間で同期している場合に消去しましょう。
- 結果を共有する前によく考える。 テキストをアドレスの#以降に埋め込んだリンクは、誰かが開いてもWebサイトのサーバーには送信されません。ただし、リンクを持っている人は誰でもテキストを読めますし、チャットアプリは送ったリンクを残します。リンクは文書そのものと同じように扱いましょう。
- ブラウザの拡張機能を確認する。 すべてのWebサイトへのアクセス権を持つ拡張機能は、閲覧中のページの内容を読み取れます。特に機密性の高い文書には、拡張機能のないブラウザのプロファイルか、プライベートウィンドウを使いましょう。多くのブラウザでは、許可しないかぎりプライベートウィンドウで拡張機能がオフになります。
こうした疑問が最も多く出てくるのは、スキャンした書類です。スキャンやPDFの扱い方は、PDFの文字起こしのページをご覧ください。