Extrahujte text z PDF
Extrahujte obyčajný text z textovej vrstvy PDF v prehliadači, stránku po stránke, pripravený na kopírovanie alebo stiahnutie.
Výsledok
Táto stránka otvorí nástroj PDF-to-text pripravený na vytiahnutie čistého textu z dokumentu. Pustite súbor PDF a nástroj prečíta jeho textovú vrstvu stránku po stránke, označí každý blok značkou „Stránka N“ a zobrazí celý výsledok v poli, ktoré môžete skopírovať alebo stiahnuť ako súbor .txt.
Extrahovanie textu je najrýchlejší spôsob opätovného použitia slov v PDF: citovanie klauzuly zo zmluvy, presunutie tela správy do editora, vloženie obsahu do prekladača alebo hľadanie frázy v dlhom dokumente. Keďže text pochádza z vlastnej textovej vrstvy PDF, je presný – žiadne dohady OCR, žiadne nesprávne prečítané znaky.
Všetko beží lokálne vo vašom prehliadači prostredníctvom nástroja pdf.js, takže dôverné dokumenty nikdy neopustia vaše zariadenie. Ak je súbor PDF naskenovaný bez textovej vrstvy, nástroj vám to jasne povie a nasmeruje vás na OCR namiesto toho, aby vrátil prázdny súbor.