Pretvornik slike v besedilo (OCR)
Izvlecite besedilo iz slik z OCR neposredno v brskalniku: JPG, PNG, WebP in BMP v 12 jezikih za prepoznavanje.
Rezultat
Slika v besedilo je brezplačno spletno orodje OCR (optično prepoznavanje znakov), ki črpa besedilo, ki ga je mogoče urejati iz slik: posnetkov zaslona, fotografij dokumentov, skeniranih strani knjig, računov, znakov in nalepk. Spustite datoteko PNG, JPG, WebP ali BMP, izberite jezik besedila na sliki, pritisnite gumb — in pridobite besedilo, ki ga je mogoče izbrati in kopirati, z oceno zaupanja.
Orodje je zgrajeno na motorju Tesseract OCR, prevedenem v WebAssembly, kar pomeni, da se prepoznavanje izvaja znotraj zavihka vašega brskalnika, ne na strežniku. Vaša slika ni nikoli nikamor naložena - edina stvar, ki se pridobi iz omrežja, je kompaktni jezikovni model za jezik, ki ga izberete (nekaj megabajtov, enkrat prenesenih in predpomnjenih). Zaradi tega je orodje varno za zasebne dokumente: pogodbe, osebne izkaznice in osebne opombe nikoli ne zapustijo vaše naprave.
Na voljo je dvanajst jezikov za prepoznavanje: angleščina, ukrajinščina, nemščina, francoščina, španščina, italijanščina, poljščina, portugalščina, nizozemščina, turščina, češčina in romunščina. Izbira pravega jezika je pomembna — vsak model pozna posebne znake svoje abecede (ukrajinska ї in ґ, nemški ß, španski ñ, francoski naglasi) in vodenje besedila skozi napačen model tiho pokvari točno te črke. Vrstica napredka v živo prikazuje nalaganje in prepoznavanje modela, rezultat pa prispe v besedilno polje, pripravljeno za kopiranje ali prenos kot datoteko .txt.
Kakovost OCR je odvisna od izvorne slike: ostro besedilo z visokim kontrastom na navadnem ozadju prepozna skoraj popolnoma, zamegljene fotografije, okrasne pisave in zasedena ozadja pa zmanjšajo natančnost. Odstotek zaupanja, prikazan pod rezultatom, vam pove, kako prepričan je motor - če pade pod ~80%, poskusite z ostrejšo fotografijo, poravnajte stran ali povečajte ločljivost slike in jo znova zaženite.