Extrahujte text z PDF
Extrahujte prostý text z textové vrstvy PDF v prohlížeči stránku po stránce, připraven ke kopírování nebo stažení.
Výsledek
Tato stránka otevře nástroj PDF-to-text připravený k vytažení prostého textu z dokumentu. Pusťte soubor PDF a nástroj přečte jeho textovou vrstvu stránku po stránce, označí každý blok značkou „Stránka N“ a zobrazí celý výsledek v poli, které můžete zkopírovat nebo stáhnout jako soubor .txt.
Extrahování textu je nejrychlejší způsob, jak znovu použít slova v PDF: citovat klauzuli ze smlouvy, přesunout tělo zprávy do editoru, vložit obsah do překladače nebo vyhledat frázi v dlouhém dokumentu. Protože text pochází z vlastní textové vrstvy PDF, je přesný – žádné dohady OCR, žádné špatně přečtené znaky.
Vše běží lokálně ve vašem prohlížeči prostřednictvím jádra pdf.js, takže důvěrné dokumenty nikdy neopustí vaše zařízení. Pokud je soubor PDF naskenovaný bez textové vrstvy, nástroj vám to řekne jasně a nasměruje vás na OCR, místo aby vrátil prázdný soubor.