0

英語 OCR — 画像から英語テキストを抽出

ブラウザで直接 OCR を使用して画像からテキストを抽出します: JPG、PNG、WebP、BMP (12 の認識言語)。

🔍

ここに画像をドラッグ&ドロップ

またはクリックしてファイルを参照します

処理中... 0%
画像ファイルの読み込み
OCRエンジンの起動
言語モデルをロードしています
テキストの認識

結果

Preview Output

このページでは、認識言語として英語がすでに選択された状態で画像テキスト変換ツールが開きます。スクリーンショットをドロップし、スキャンまたは写真を入力してボタンを押します。 Tesseract OCR が最もよく処理できる言語は英語です。このエンジンは英語の活字の膨大なコーパスを基にトレーニングされているため、クリーン スキャンの信頼性は常に 95% 以上に達します。

英語 OCR は、端末のスクリーンショット、斜めに撮影された本のページ、レシートや製品ラベルなど、扱いにくいソースでもうまく機能します。最良の結果を得るには、エンジンの鮮明なテキストを少なくとも 20 ~ 30 ピクセルの高さにしてください。写真がぼやけている場合、またはテキストが小さい場合は、認識前に画像を拡大すると、通常、精度が著しく向上します。

すべてがブラウザ内でローカルに実行されます。画像はアップロードされず、コンパクトな英語モデル (数メガバイト) のみが一度フェッチされてキャッシュされます。認識が完了したら、ワンクリックでテキストをコピーするか、.txt ファイルとしてダウンロードします。