Ingliskeelne OCR — ingliskeelse teksti eraldamine piltidest
Ekstraheerige piltidest teksti OCR-iga otse brauseris: JPG, PNG, WebP ja BMP 12 tuvastuskeeles.
Tulemus
See leht avab pildi tekstiks tööriista, mille tuvastuskeeleks on juba valitud inglise keel – kukutage ekraanipilt, skannige või foto ja vajutage nuppu. Inglise keel on keel, mida Tesseract OCR kõige paremini oskab: mootorit õpetati tohutul hulgal ingliskeelseid trükiseid, nii et puhaste skannimiste usaldusväärsus on tavaliselt 95%+.
Ingliskeelne OCR töötab hästi isegi keeruliste allikate puhul – terminali ekraanipildid, nurga all pildistatud raamatulehed, kviitungid ja tootesildid. Parimate tulemuste saavutamiseks andke mootorile vähemalt 20–30 piksli pikkune terav tekst; kui foto on udune või tekst on väike, suurendage pilti enne tuvastamist ja täpsus hüppab tavaliselt märgatavalt.
Kõik töötab teie brauseris lokaalselt: pilti ei laadita kunagi üles, ainult kompaktne ingliskeelne mudel (mõned megabaidid) tõmmatakse üks kord ja salvestatakse vahemällu. Kui tuvastamine on lõppenud, kopeerige tekst ühe klõpsuga või laadige see alla .txt-failina.