Angielski OCR — wyodrębnij tekst w języku angielskim z obrazów
Wyodrębnij tekst z obrazów za pomocą OCR bezpośrednio w przeglądarce: JPG, PNG, WebP i BMP w 12 językach rozpoznawania.
Wynik
Na tej stronie otwiera się narzędzie do konwersji obrazu na tekst z wybranym już językiem rozpoznawania w języku angielskim — upuść zrzut ekranu, skan lub zdjęcie i naciśnij przycisk. Angielski jest językiem, z którym Tesseract OCR radzi sobie najlepiej: silnik został przeszkolony na ogromnym zbiorze angielskich druków, więc czyste skany rutynowo osiągają poziom pewności wynoszący ponad 95%.
Angielski OCR działa dobrze nawet w przypadku trudnych źródeł — zrzutów ekranu terminali, stron książek sfotografowanych pod kątem, paragonów i etykiet produktów. Aby uzyskać najlepsze rezultaty, nadaj silnikowi ostry tekst o wysokości co najmniej 20–30 pikseli; jeśli zdjęcie jest rozmazane lub tekst jest mały, należy przeskalować obraz przed rozpoznaniem, a dokładność zwykle zauważalnie wzrasta.
Wszystko działa lokalnie w przeglądarce: obraz nigdy nie jest przesyłany, jedynie kompaktowy model w języku angielskim (kilka megabajtów) jest pobierany raz i zapisywany w pamięci podręcznej. Po zakończeniu rozpoznawania skopiuj tekst jednym kliknięciem lub pobierz go jako plik .txt.