Prevodník obrázkov na text (OCR)
Extrahujte text z obrázkov pomocou OCR priamo vo vašom prehliadači: JPG, PNG, WebP a BMP v 12 jazykoch rozpoznávania.
Výsledok
Image to Text je bezplatný online nástroj OCR (optické rozpoznávanie znakov), ktorý z obrázkov vytiahne upraviteľný text: snímky obrazovky, fotografie dokumentov, naskenované strany kníh, účtenky, nápisy a štítky. Pustite súbor PNG, JPG, WebP alebo BMP, vyberte jazyk textu na obrázku, stlačte tlačidlo – a získajte voliteľný a kopírovateľný text so skóre spoľahlivosti.
Nástroj je postavený na jadre Tesseract OCR skompilovanom do WebAssembly, čo znamená, že rozpoznávanie beží na karte vášho prehliadača, nie na serveri. Váš obrázok sa nikdy nikam neodovzdá – jediná vec, ktorá sa získa zo siete, je kompaktný jazykový model pre jazyk, ktorý si vyberiete (niekoľko megabajtov, stiahnuté raz a uložené vo vyrovnávacej pamäti). Vďaka tomu je nástroj bezpečný pre súkromné dokumenty: zmluvy, preukazy totožnosti a osobné poznámky nikdy neopustia vaše zariadenie.
K dispozícii je dvanásť jazykov rozpoznávania: angličtina, ukrajinčina, nemčina, francúzština, španielčina, taliančina, poľština, portugalčina, holandčina, turečtina, čeština a rumunčina. Na výbere správneho jazyka záleží – každý model pozná špeciálne znaky svojej abecedy (ukrajinské ї a ґ, nemčinu ß, španielčinu ñ, francúzske diakritické znamienka) a spustenie textu cez nesprávny model ticho poškodí presne tieto písmená. Živý indikátor priebehu zobrazuje načítanie a rozpoznávanie modelu a výsledok sa zobrazí v textovom poli, ktoré je pripravené na skopírovanie alebo stiahnutie ako súbor .txt.
Kvalita OCR závisí od zdrojového obrazu: ostrý, vysoko kontrastný text na obyčajnom pozadí rozpozná takmer dokonale, zatiaľ čo rozmazané fotografie, ozdobné písma a rušné pozadie zníži presnosť. Percento spoľahlivosti zobrazené pod výsledkom vám povie, akú istotu má motor – ak klesne pod ~80 %, skúste ostrejšiu fotografiu, vyrovnajte stránku alebo zvýšte rozlíšenie obrázka a spustite to znova.