Anglų kalbos OCR – ištraukite anglišką tekstą iš vaizdų
Ištraukite tekstą iš vaizdų naudodami OCR tiesiai naršyklėje: JPG, PNG, WebP ir BMP 12 atpažinimo kalbų.
Rezultatas
Šiame puslapyje atidaromas vaizdo į tekstą įrankis, kurio atpažinimo kalba jau pasirinkta anglų kalba – numeskite ekrano kopiją, nuskaitykite ar nuotrauką ir paspauskite mygtuką. Anglų kalba yra ta, kurią „Tesseract OCR“ valdo geriausiai: variklis buvo parengtas naudojant didžiulį spausdinimo anglų k. korpusą, todėl švarus nuskaitymas reguliariai pasiekia 95 %+ pasitikėjimą.
Anglų kalbos OCR puikiai veikia net naudojant sudėtingus šaltinius – terminalo ekrano kopijas, kampu nufotografuotus knygų puslapius, kvitus ir produktų etiketes. Norėdami gauti geriausius rezultatus, varikliui nurodykite ryškų bent 20–30 pikselių aukščio tekstą; jei nuotrauka neryški arba tekstas mažas, prieš atpažindami padidinkite vaizdo mastelį, o tikslumas paprastai pastebimai šokteli.
Viskas veikia lokaliai jūsų naršyklėje: vaizdas niekada neįkeliamas, tik kompaktiškas anglų kalbos modelis (keli megabaitai) paimamas vieną kartą ir saugomas talpykloje. Kai atpažinimas baigsis, nukopijuokite tekstą vienu paspaudimu arba atsisiųskite jį kaip .txt failą.