Vaizdo į tekstą keitiklis (OCR)
Ištraukite tekstą iš vaizdų naudodami OCR tiesiai naršyklėje: JPG, PNG, WebP ir BMP 12 atpažinimo kalbų.
Rezultatas
Vaizdas į tekstą yra nemokamas internetinis OCR (optinio simbolių atpažinimo) įrankis, kuris iš paveikslėlių ištraukia redaguojamą tekstą: ekrano kopijas, dokumentų nuotraukas, nuskaitytus knygos puslapius, kvitus, ženklus ir etiketes. Numeskite PNG, JPG, WebP arba BMP failą, pasirinkite paveikslėlio teksto kalbą, paspauskite mygtuką ir gaukite pasirenkamą, kopijuojamą tekstą su patikimumo balu.
Įrankis sukurtas naudojant Tesseract OCR variklį, sudarytą į WebAssembly, o tai reiškia, kad atpažinimas vykdomas jūsų naršyklės skirtuke, o ne serveryje. Jūsų vaizdas niekada niekur neįkeliamas – vienintelis dalykas, gaunamas iš tinklo, yra kompaktiškas pasirinktos kalbos kalbos modelis (keli megabaitai, atsisiunčiami vieną kartą ir saugomi talpykloje). Dėl to įrankis yra saugus privatiems dokumentams: sutartys, ID ir asmeniniai užrašai niekada nepalieka jūsų įrenginio.
Galimos dvylika atpažinimo kalbų: anglų, ukrainiečių, vokiečių, prancūzų, ispanų, italų, lenkų, portugalų, olandų, turkų, čekų ir rumunų. Svarbu pasirinkti tinkamą kalbą – kiekvienas modelis žino savo abėcėlės specialiuosius simbolius (ukrainiečių ї ir ґ, vokiečių ß, ispanų ñ, prancūziškus kirčius), o teksto paleidimas per netinkamą modelį tyliai sugadina būtent tas raides. Tiesioginėje eigos juostoje rodomas modelio įkėlimas ir atpažinimas, o rezultatas pateikiamas teksto laukelyje, paruoštame kopijuoti arba atsisiųsti kaip .txt failą.
OCR kokybė priklauso nuo šaltinio vaizdo: ryškus, didelio kontrasto tekstas paprastame fone atpažįstamas beveik puikiai, o neryškios nuotraukos, dekoratyvūs šriftai ir užimtas fonas sumažina tikslumą. Po rezultatu rodomas pasitikėjimo procentas parodo, ar variklis yra tikras – jei jis nukrenta žemiau ~80%, pabandykite padaryti ryškesnę nuotrauką, ištiesinkite puslapį arba padidinkite vaizdo skyrą ir paleiskite jį dar kartą.