Képből szöveggé konvertáló (OCR)
Kivonat szöveget a képekből OCR segítségével közvetlenül a böngészőben: JPG, PNG, WebP és BMP 12 felismerési nyelven.
Eredmény
Az Image to Text egy ingyenes online OCR (optikai karakterfelismerő) eszköz, amely kihúzza a szerkeszthető szöveget a képekből: képernyőképek, dokumentumok fényképei, szkennelt könyvoldalak, nyugták, jelek és címkék. Dobjon el egy PNG, JPG, WebP vagy BMP fájlt, válassza ki a képen a szöveg nyelvét, nyomja meg a gombot – és kiválasztható, másolható szöveget kap megbízhatósági pontszámmal.
Az eszköz a WebAssembly-re fordított Tesseract OCR motorra épül, ami azt jelenti, hogy a felismerés a böngésző lapján fut, nem a szerveren. A képet soha nem töltik fel sehova – az egyetlen dolog, amit a hálózatról lekérnek, az a választott nyelvhez tartozó kompakt nyelvi modell (néhány megabájt, egyszer letöltve és gyorsítótárban). Ez biztonságossá teszi az eszközt a magándokumentumok számára: szerződések, igazolványok és személyes jegyzetek soha nem hagyják el a készüléket.
Tizenkét elismerési nyelv áll rendelkezésre: angol, ukrán, német, francia, spanyol, olasz, lengyel, portugál, holland, török, cseh és román. A megfelelő nyelv kiválasztása számít – minden modell ismeri az ábécé speciális karaktereit (ukrán ї és ґ, német ß, spanyol ñ, francia ékezet), és a szöveg rossz modellen való futtatása csendben pontosan ezeket a betűket rontja el. Az élő folyamatjelző sáv mutatja a modell betöltését és felismerését, az eredmény pedig egy szövegdobozban érkezik, amely készen áll a másolásra vagy letöltésre .txt fájlként.
Az OCR minősége a forrásképtől függ: az éles, nagy kontrasztú szöveget sima háttéren szinte tökéletesen felismeri, míg az elmosódott fényképek, a dekoratív betűtípusok és az elfoglalt hátterek rontják a pontosságot. Az eredmény alatt látható megbízhatósági százalék megmutatja, mennyire biztos a motor – ha ~80% alá esik, próbáljon élesebb képet készíteni, egyenesítse ki az oldalt, vagy növelje a képfelbontást, és futtassa újra.