Извличане на текст от PDF
Извлечете обикновения текст от текстовия слой на PDF в браузъра, страница по страница, готов за копиране или изтегляне.
Резултат
Тази страница отваря инструмента за преобразуване на PDF в текст, готов да изтегли обикновен текст от документ. Пуснете PDF и инструментът чете неговия текстов слой страница по страница, етикетира всеки блок с маркер „Страница N“ и показва целия резултат в кутия, която можете да копирате или изтеглите като .txt файл.
Извличането на текст е най-бързият начин за повторно използване на думите в PDF: цитиране на клауза от договор, преместване на тялото на отчет в редактор, подаване на съдържание в преводач или търсене на фраза в дълъг документ. Тъй като текстът идва от собствения текстов слой на PDF файла, той е точен — без предположения за OCR, без неправилно разчетени знаци.
Всичко работи локално във вашия браузър чрез pdf.js двигателя, така че поверителни документи никога не напускат вашето устройство. Ако PDF е сканиран без текстов слой, инструментът ви казва ясно и ви насочва към OCR, вместо да връща празен файл.