Kuva tekstiksi muuntaja (OCR)
Poimi tekstiä kuvista OCR:llä suoraan selaimessasi: JPG, PNG, WebP ja BMP 12 tunnistuskielellä.
Tulos
Image to Text on ilmainen online-OCR (optinen merkintunnistus) -työkalu, joka vetää muokattavan tekstin pois kuvista: kuvakaappauksia, valokuvia asiakirjoista, skannatut kirjan sivut, kuitit, kyltit ja tarrat. Pudota PNG-, JPG-, WebP- tai BMP-tiedosto, valitse kuvan tekstin kieli, paina painiketta – ja saat valittavissa olevaa, kopioitavaa tekstiä luotettavuudella.
Työkalu perustuu Tesseract OCR -moottoriin, joka on käännetty WebAssemblyyn, mikä tarkoittaa, että tunnistus suoritetaan selaimen välilehdessä, ei palvelimella. Kuvaasi ei koskaan ladata minnekään – ainoa verkosta haettu asia on valitsemasi kielen kompakti kielimalli (muutama megatavu, ladataan kerran ja tallennetaan välimuistiin). Tämä tekee työkalusta turvallisen yksityisille asiakirjoille: sopimukset, henkilötodistukset ja henkilökohtaiset muistiinpanot eivät koskaan poistu laitteeltasi.
Käytettävissä on kaksitoista tunnustamiskieltä: englanti, ukraina, saksa, ranska, espanja, italia, puola, portugali, hollanti, turkki, tšekki ja romania. Oikean kielen valitseminen on tärkeää – jokainen malli tuntee aakkostonsa erikoismerkit (ukrainalaiset ї ja ґ, saksa ß, espanja ñ, ranskalaiset aksentit), ja tekstin ajaminen väärän mallin läpi turmelee äänettömästi juuri kyseiset kirjaimet. Reaaliaikainen edistymispalkki näyttää mallin lataamisen ja tunnistamisen, ja tulos saapuu tekstiruutuun, joka on valmis kopioitavaksi tai ladattavaksi .txt-tiedostona.
OCR-laatu riippuu lähdekuvasta: terävä, suurikontrastinen teksti tavallisella taustalla tunnistaa lähes täydellisesti, kun taas epäselvät valokuvat, koristeelliset fontit ja kiireiset taustat heikentävät tarkkuutta. Tuloksen alla näkyvä luottamusprosentti kertoo, kuinka varma moottori on – jos se laskee alle ~80 %, kokeile terävämpää kuvaa, suorista sivua tai lisää kuvan resoluutiota ja suorita se uudelleen.