0

Englanninkielinen OCR — Poimi englanninkielistä tekstiä kuvista

Poimi tekstiä kuvista OCR:llä suoraan selaimessasi: JPG, PNG, WebP ja BMP 12 tunnistuskielellä.

🔍

Vedä ja pudota kuva tähän

tai Selaa tiedostoja napsauttamalla

Käsitellään... 0%
Kuvatiedoston lukeminen
OCR-moottorin käynnistys
Ladataan kielimallia
Tekstin tunnistaminen

Tulos

Preview Output

Tämä sivu avaa kuvasta tekstiksi -työkalun, jonka tunnistuskieleksi on jo valittu englanti – pudota kuvakaappaus, skannaa tai valokuva ja paina -painiketta. Englanti on kieli, jota Tesseract OCR käsittelee parhaiten: moottori on koulutettu valtavaan englanninkieliseen painokseen, joten puhtaat skannaukset saavuttavat rutiininomaisesti yli 95 %:n luotettavuuden.

Englantilainen OCR toimii hyvin myös hankalia lähteitä käytettäessä – päätekuvakaappauksissa, vinossa kuvattujen kirjojen sivuilla, kuiteilla ja tuotetarroilla. Parhaan tuloksen saamiseksi anna moottorille terävä teksti vähintään 20–30 pikseliä korkea; Jos kuva on epäselvä tai teksti on pientä, skaalaa kuvaa ennen tunnistusta ja tarkkuus yleensä hyppää huomattavasti.

Kaikki toimii paikallisesti selaimessasi: kuvaa ei koskaan ladata, vain kompakti englanninkielinen malli (muutama megatavu) haetaan kerran ja tallennetaan välimuistiin. Kun tunnistus on valmis, kopioi teksti yhdellä napsautuksella tai lataa se .txt-tiedostona.