Pildi tekstiks teisendaja (OCR)
Ekstraheerige piltidest teksti OCR-iga otse brauseris: JPG, PNG, WebP ja BMP 12 tuvastuskeeles.
Tulemus
Pilt tekstiks on tasuta veebipõhine OCR (optiline märgituvastus) tööriist, mis tõmbab piltidelt välja redigeeritava teksti: ekraanipildid, fotod dokumentidest, skannitud raamatulehed, kviitungid, märgid ja sildid. Pukseerige PNG-, JPG-, WebP- või BMP-fail, valige pildil oleva teksti keel, vajutage nuppu – ja hankige valitav, kopeeritav tekst usaldusskooriga.
Tööriist põhineb Tesseracti OCR-mootoril, mis on kompileeritud WebAssemblysse, mis tähendab, et tuvastamine toimub teie brauseri vahekaardil, mitte serveris. Teie pilti ei laadita kunagi kuhugi üles – võrgust tuuakse ainult kompaktne keelemudel teie valitud keele jaoks (paar megabaiti, laaditakse üks kord alla ja salvestatakse vahemällu). See muudab tööriista eradokumentide jaoks turvaliseks: lepingud, isikutunnistused ja isiklikud märkmed ei lahku kunagi teie seadmest.
Saadaval on kaksteist tunnustamiskeelt: inglise, ukraina, saksa, prantsuse, hispaania, itaalia, poola, portugali, hollandi, türgi, tšehhi ja rumeenia. Õige keele valimine on oluline – iga mudel teab oma tähestiku erimärke (ukraina ї ja ґ, saksa ß, hispaania ñ, prantsuse aktsendid) ning vale mudeli teksti läbiviimine rikub vaikselt täpselt need tähed. Reaalajas edenemisriba näitab mudeli laadimist ja tuvastamist ning tulemus saabub tekstikasti, mis on valmis kopeerimiseks või allalaadimiseks .txt-failina.
OCR-kvaliteet sõltub lähtepildist: terav, suure kontrastsusega tekst tavalisel taustal tunneb ära peaaegu täiuslikult, samas kui udused fotod, dekoratiivsed fondid ja hõivatud taustad vähendavad täpsust. Tulemuse all kuvatav usaldusprotsent näitab, kui kindel mootor on — kui see langeb alla ~80%, proovi teha teravamat fotot, aja leht sirgeks või tõsta pildi eraldusvõimet ja käivita uuesti.