Attēla teksta pārveidotājs (OCR)
Izņemiet tekstu no attēliem, izmantojot OCR tieši savā pārlūkprogrammā: JPG, PNG, WebP un BMP 12 atpazīšanas valodās.
Rezultāts
Attēls uz tekstu ir bezmaksas tiešsaistes OCR (optiskā rakstzīmju atpazīšanas) rīks, kas no attēliem izņem rediģējamu tekstu: ekrānuzņēmumus, dokumentu fotoattēlus, skenētas grāmatu lapas, kvītis, zīmes un etiķetes. Nometiet PNG, JPG, WebP vai BMP failu, izvēlieties attēla teksta valodu, nospiediet pogu un iegūstiet atlasāmu, kopējamu tekstu ar ticamības rādītāju.
Rīks ir veidots, izmantojot Tesseract OCR dzinēju, kas apkopots WebAssembly, kas nozīmē, ka atpazīšana tiek veikta jūsu pārlūkprogrammas cilnē, nevis serverī. Jūsu attēls nekad nekur netiek augšupielādēts — vienīgais, kas tiek iegūts no tīkla, ir kompaktais valodas modelis jūsu izvēlētajai valodai (daži megabaiti, vienreiz lejupielādēts un saglabāts kešatmiņā). Tas padara rīku drošu privātiem dokumentiem: līgumi, ID un personiskās piezīmes nekad neatstāj jūsu ierīci.
Ir pieejamas divpadsmit atpazīšanas valodas: angļu, ukraiņu, vācu, franču, spāņu, itāļu, poļu, portugāļu, holandiešu, turku, čehu un rumāņu. Ir svarīgi izvēlēties pareizo valodu — katrs modelis zina sava alfabēta īpašās rakstzīmes (ukraiņu ї un ґ, vācu ß, spāņu ñ, franču akcentus), un teksta palaišana nepareizajā modelī klusi sabojā tieši šos burtus. Tiešsaistes norises joslā tiek rādīta modeļa ielāde un atpazīšana, un rezultāts tiek parādīts tekstlodziņā, kas ir gatavs kopēšanai vai lejupielādei .txt faila formātā.
OCR kvalitāte ir atkarīga no avota attēla: ass, augsta kontrasta teksts uz vienkārša fona atpazīst gandrīz perfekti, savukārt izplūdušie fotoattēli, dekoratīvie fonti un aizņemts fons samazina precizitāti. Zem rezultāta parādītais ticamības procents parāda, cik pārliecināts ir dzinējs — ja tas nokrīt zem ~80%, izmēģiniet asāku fotoattēlu, iztaisnojiet lapu vai palieliniet attēla izšķirtspēju un palaidiet to vēlreiz.