0

Převaděč PDF na text

Extrahujte prostý text z textové vrstvy PDF v prohlížeči stránku po stránce, připraven ke kopírování nebo stažení.

📄

Sem přetáhněte dokument PDF

nebo kliknutím procházejte soubory PDF

Zpracování... 0%
Načítání dokumentu PDF
Čtení textové vrstvy
Skládání stránek
Stavební výstup

Výsledek

PDF je snadno čitelné, ale nepohodlné pro opětovné použití: nemůžete vždy vybrat jeho text čistě a ruční kopírování stránky po stránce je únavné. Tento nástroj extrahuje prostý text z textové vrstvy PDF jedním průchodem, zcela uvnitř vašeho prohlížeče, a předá jej zpět připravený ke kopírování nebo stahování – žádné nahrávání, žádný účet, žádný vodoznak.

Extrakce funguje stránku po stránce. Text každé stránky je vytažen z vlastní textové vrstvy dokumentu a oddělen zřetelnou značkou „Stránka N“, takže padesátistránková zpráva zůstane uspořádaná, místo aby se sbalila do jedné nerozlišené stěny slov. Výsledek se zobrazí v textovém poli, které si můžete přečíst, vybrat, zkopírovat do schránky nebo uložit jako soubor .txt, který se otevře kdekoli.

Zde záleží na upřímnosti: mnoho PDF jsou skeny – fotografie papíru bez textové vrstvy. Když se to stane, žádná extrakce nenajde slova, takže místo vracení tiše prázdného souboru nástroj detekuje prázdný výsledek a řekne vám, že dokument je sken, a nasměruje vás na nástroj Image to Text (OCR), který skutečně umí číst pixely. Toto je extraktor textu, nikoli OCR engine, a nepředstírá převod PDF na upravitelný dokument Word.

Vzhledem k tomu, že celý proces běží na vašem vlastním počítači prostřednictvím enginu pdf.js, důvěrné smlouvy, výpisy a záznamy nikdy neopustí zařízení – neexistují žádné limity stránek a žádný server. Pokud potřebujete stránky jako obrázky a ne jako text, nástroj PDF-to-JPG vykreslí každou stránku jako obrázek.