Englanninkielinen OCR — Poimi englanninkielistä tekstiä kuvista
Poimi tekstiä kuvista OCR:llä suoraan selaimessasi: JPG, PNG, WebP ja BMP 12 tunnistuskielellä.
Tulos
Tämä sivu avaa kuvasta tekstiksi -työkalun, jonka tunnistuskieleksi on jo valittu englanti – pudota kuvakaappaus, skannaa tai valokuva ja paina -painiketta. Englanti on kieli, jota Tesseract OCR käsittelee parhaiten: moottori on koulutettu valtavaan englanninkieliseen painokseen, joten puhtaat skannaukset saavuttavat rutiininomaisesti yli 95 %:n luotettavuuden.
Englantilainen OCR toimii hyvin myös hankalia lähteitä käytettäessä – päätekuvakaappauksissa, vinossa kuvattujen kirjojen sivuilla, kuiteilla ja tuotetarroilla. Parhaan tuloksen saamiseksi anna moottorille terävä teksti vähintään 20–30 pikseliä korkea; Jos kuva on epäselvä tai teksti on pientä, skaalaa kuvaa ennen tunnistusta ja tarkkuus yleensä hyppää huomattavasti.
Kaikki toimii paikallisesti selaimessasi: kuvaa ei koskaan ladata, vain kompakti englanninkielinen malli (muutama megatavu) haetaan kerran ja tallennetaan välimuistiin. Kun tunnistus on valmis, kopioi teksti yhdellä napsautuksella tai lataa se .txt-tiedostona.