Angļu valodas OCR — izņemiet tekstu angļu valodā no attēliem
Izņemiet tekstu no attēliem, izmantojot OCR tieši savā pārlūkprogrammā: JPG, PNG, WebP un BMP 12 atpazīšanas valodās.
Rezultāts
Šajā lapā tiek atvērts attēla pārveides rīks ar angļu valodu, kas jau ir atlasīta kā atpazīšanas valoda — nometiet ekrānuzņēmumu, skenējiet vai fotoattēlu un nospiediet pogu. Angļu valoda ir valoda, ko Tesseract OCR pārvalda vislabāk: dzinējs tika apmācīts, izmantojot milzīgu angļu valodas izdruku korpusu, tāpēc tīri skenējumi parasti sasniedz 95%+ ticamību.
Angļu valodas OCR labi darbojas pat sarežģītos avotos — termināļa ekrānuzņēmumos, leņķī fotografētās grāmatu lapās, čekos un produktu etiķetēs. Lai iegūtu labākos rezultātus, piešķiriet dzinējam asu tekstu vismaz 20–30 pikseļus garu; ja fotoattēls ir izplūdis vai teksts ir niecīgs, palieliniet attēla mērogu pirms atpazīšanas, un precizitāte parasti ievērojami palielinās.
Jūsu pārlūkprogrammā viss darbojas lokāli: attēls nekad netiek augšupielādēts, tikai kompaktais angļu valodas modelis (daži megabaiti) tiek vienreiz ielādēts un saglabāts kešatmiņā. Kad atpazīšana ir pabeigta, kopējiet tekstu ar vienu klikšķi vai lejupielādējiet to kā .txt failu.