画像からテキストへのコンバーター (OCR)
ブラウザで直接 OCR を使用して画像からテキストを抽出します: JPG、PNG、WebP、BMP (12 の認識言語)。
結果
Image to Text は、スクリーンショット、書類の写真、スキャンした本のページ、レシート、サイン、ラベルなどの画像から編集可能なテキストを抽出する無料のオンライン OCR (光学文字認識) ツールです。 PNG、JPG、WebP、または BMP ファイルをドロップし、画像内のテキストの言語を選択してボタンを押すと、信頼スコア付きの選択可能でコピー可能なテキストが得られます。
このツールは、WebAssembly にコンパイルされた Tesseract OCR エンジン上に構築されています。つまり、認識はサーバー上ではなく、ブラウザー タブ内で実行されます。画像がどこにもアップロードされることはありません。ネットワークから取得されるのは、選択した言語のコンパクトな言語モデル (数メガバイト、一度ダウンロードされキャッシュされる) だけです。これにより、このツールは個人的な文書に対して安全になります。契約書、身分証明書、個人的なメモがデバイスから離れることはありません。
12 の認識言語が利用可能です: 英語、ウクライナ語、ドイツ語、フランス語、スペイン語、イタリア語、ポーランド語、ポルトガル語、オランダ語、トルコ語、チェコ語、ルーマニア語。適切な言語を選択することが重要です。各モデルはそのアルファベットの特殊文字 (ウクライナ語の ї と è、ドイツ語の ß、スペイン語の ñ、フランス語のアクセント) を認識しており、間違ったモデルでテキストを実行すると、静かにそれらの文字が正確に破損します。ライブ進行状況バーにモデルの読み込みと認識が表示され、結果がテキスト ボックスに表示され、すぐに .txt ファイルとしてコピーまたはダウンロードできます。
OCR の品質はソース画像に依存します。無地の背景上の鮮明でコントラストの高いテキストはほぼ完全に認識されますが、ぼやけた写真、装飾的なフォント、混雑した背景は精度が低くなります。結果の下に表示される信頼度パーセンテージは、エンジンがどの程度確実であるかを示します。信頼度が約 80% を下回った場合は、より鮮明な写真を試すか、ページをまっすぐにするか、画像解像度を上げて再実行してください。