Pretvornik PDF v besedilo
Izluščite navadno besedilo iz besedilne plasti PDF-ja v brskalniku, stran za stranjo, pripravljeno za kopiranje ali prenos.
🔒 V celoti obdelano v vašem brskalniku – nič, kar tukaj vnesete, ni nikoli naloženo.
Rezultat
PDF je enostavno brati, a težko ponovno uporabiti: besedila ni vedno mogoče čisto označiti, ročno kopiranje stran za stranjo pa je zamudno. To orodje izvleče navadno besedilo iz besedilne plasti PDF-ja v enem zamahu, v celoti znotraj vašega brskalnika, in ga vrne pripravljenega za kopiranje ali prenos – brez nalaganja, brez računa, brez vodnega žiga.
Izvlečenje poteka stran za stranjo. Besedilo vsake strani se potegne iz lastne besedilne plasti dokumenta in loči z jasno oznako »Stran N«, tako da petdesetstransko poročilo ostane urejeno, namesto da bi se sesulo v eno nerazločljivo steno besed. Rezultat pristane v besedilnem polju, ki ga lahko berete, označite, kopirate v odložišče ali shranite kot datoteko .txt, ki se odpre povsod.
Poštenost je tukaj pomembna: veliko PDF-jev je skeniranih – fotografij papirja, ki sploh nimajo besedilne plasti. Ko se to zgodi, nobeno izločanje ne bo našlo besed, zato orodje, namesto da bi tiho vrnilo prazno datoteko, zazna prazen rezultat in vam sporoči, da je dokument skeniran, ter vas usmeri na orodje Slika v besedilo (OCR), ki dejansko zna brati slikovne pike. To je izločevalnik besedila, ne pogon OCR, in se ne pretvarja, da pretvori PDF v Wordov dokument, ki bi ga bilo mogoče urejati.
Ker celoten postopek poteka na vašem lastnem računalniku prek pogona pdf.js, zaupne pogodbe, izpiski in evidence nikoli ne zapustijo naprave – ni omejitev števila strani in nobenega krožnega prometa s strežnikom. Če potrebujete strani kot slike namesto kot besedilo, orodje PDF v JPG upodobi vsako stran v sliko.