画像の中の文字を、もっと手軽にコピーできるように
Image to Text Appは、ブラウザで動く無料の画像文字起こしツールです。スクリーンショットを貼り付けるか、写真・スキャン・PDFをドロップするだけで、編集・確認・書き出しができるテキストになります。登録も、画像のアップロードも必要ありません。
ひと目でわかる概要
- 対応言語(1ページで複数言語も可)
- 47
- 一度に読み取れる画像の枚数
- 50
- ダウンロード形式
- 9
- 必要なアカウント
- 0
このツールを作った理由
必要な文字の多くは、すでに目の前にあります。エラーメッセージ、レシート、スライド、メモを書いたページ。そこから文字を取り出すのは、数秒で済むはずです。ところが実際には、素性のわからないサーバーにプライベートな画像をアップロードしたり、広告を我慢したり、1日の回数制限に引っかかったりすることが少なくありません。
そこで私たちは、その逆を作りました。Image to Text Appは、画像がすでにある場所、つまりお使いの端末上で、オープンソースのTesseractエンジンを使って画像を読み取ります。アカウントの作成もインストールも不要で、エンジンを一度読み込めばオフラインでも動作します。
大切にしていること
-
プライバシーを前提に設計
画像は私たちのサーバーではなく、お使いのブラウザで読み取られます。履歴はオンにしない限りオフで、トラッキングも広告もありません。
-
本当に無料
端末での読み取りなら、登録、広告、CAPTCHA、1日の回数制限は一切ありません。一度に最大50枚、1枚あたり25MBまで読み取れます。
-
限界にも正直に
OCRは間違えることがあります。だからこのツールは、その場所をお見せします。自信を持てなかった単語には下線が付き、信頼度も表示されます。完璧を約束することはありません。
-
実際の書類のために
表は編集できるグリッドに、レシートは項目ごとに分かれ、コードはインデントを保ち、文書は見出しやリストをそのまま残します。
仕組み
- 画像を追加します。貼り付け、ドロップ、ファイル選択、写真撮影、リンクの貼り付けのいずれでも追加できます。JPG、PNG、WebP、HEIC、TIFF、GIF、BMP、PDFに対応しています。
- 端末上で読み取ります。自動補正で画像を整え、ページの種類を判別したうえで、Tesseractがブラウザ内で直接テキストを読み取ります。
- 確認・編集して書き出します。下線の付いた単語を修正したら、テキストをコピーするか、Word、Excel、PDF、Markdown、JSONなどの形式でダウンロードします。
詳しく知りたい方は、OCRの仕組みや、画像がどのように扱われるかをご覧ください。
オープンソースに支えられています
このツールは、以下のオープンソースプロジェクトの成果の上に成り立っています。開発と保守に携わるすべての方に感謝します。
ご質問やアイデア、読み取れないファイルはありませんか?
ぜひお聞かせください。