Английски OCR — Извличане на английски текст от изображения
Извличайте текст от изображения с OCR директно във вашия браузър: JPG, PNG, WebP и BMP на 12 езика за разпознаване.
Резултат
Тази страница отваря инструмента за преобразуване на изображение в текст с вече избран английски като език за разпознаване — пуснете екранна снимка, сканиране или снимка и натиснете бутона. Английският е езикът, с който Tesseract OCR се справя най-добре: машината е обучена на огромен корпус от английски печат, така че чистите сканирания рутинно достигат 95%+ увереност.
Английското OCR работи добре дори при трудни източници — екранни снимки на терминали, страници от книги, снимани под ъгъл, разписки и етикети на продукти. За най-добри резултати дайте на двигателя остър текст с височина поне 20–30 пиксела; ако снимката е замъглена или текстът е мъничък, подобрете изображението преди разпознаване и точността обикновено скача забележимо.
Всичко работи локално във вашия браузър: изображението никога не се качва, само компактният модел на английски език (няколко мегабайта) се извлича веднъж и се кешира. Когато разпознаването приключи, копирайте текста с едно кликване или го изтеглете като .txt файл.