0

PDF į tekstą keitiklis

Ištraukite grynąjį tekstą iš PDF teksto sluoksnio naršyklėje, puslapis po puslapio – paruoštą kopijavimui ar atsisiuntimui.

🔒 Visiškai apdorojama jūsų naršyklėje – niekas, kurį čia įvedėte, niekada neįkeliama.

📄

Vilkite ir paleiskite PDF dokumentą čia

arba spustelėkite, kad naršytumėte PDF bylas

Apdorojama... 0%
Įkeliamas PDF dokumentas
Skaitomas teksto sluoksnis
Komponuojami puslapiai
Ruošiamas išvedinys

Rezultatas

PDF failą lengva skaityti, bet nepatogu pakartotinai naudoti: ne visada galima švariai pažymėti tekstą, o kopijuoti puslapį po puslapio rankomis yra varginantis darbas. Šis įrankis ištraukia grynąjį tekstą iš PDF teksto sluoksnio vienu ypu, visiškai jūsų naršyklėje, ir pateikia jį paruoštą kopijavimui ar atsisiuntimui – be įkėlimo, be paskyros, be vandens ženklų.

Ištraukimas vyksta puslapis po puslapio. Kiekvieno puslapio tekstas paimamas iš dokumento teksto sluoksnio ir atskiriamas aiškia žyma „Puslapis N“, todėl penkiasdešimties puslapių ataskaita išlieka tvarkinga, o ne subyra į vieną nediferencijuotą žodžių sieną. Rezultatas patenka į teksto laukelį, kurį galite skaityti, žymėti, kopijuoti į iškarpinę arba išsaugoti kaip .txt failą, atidaromą bet kur.

Sąžiningumas čia svarbus: daug PDF yra nuskaityti dokumentai – popieriaus nuotraukos, apskritai neturinčios teksto sluoksnio. Kai taip nutinka, joks ištraukimas žodžių neras, todėl užuot tyliai grąžinęs tuščią failą, įrankis aptinka tuščią rezultatą ir praneša, kad dokumentas yra nuskaitytas, nukreipdamas jus į įrankį „Vaizdas į tekstą“ (OCR), kuris iš tikro geba skaityti pikselius. Tai yra teksto ištraukimo, o ne OCR variklis, ir jis neapsimetinėja konvertuojantis PDF į redaguojamą Word dokumentą.

Kadangi visas procesas vyksta jūsų kompiuteryje naudojant pdf.js variklį, konfidencialios sutartys, išrašai ir įrašai niekada nepalieka įrenginio – jokių puslapių limitų ir jokių kreipimųsi į serverį. Jei jums reikia puslapių kaip paveikslėlių, o ne teksto, PDF į JPG įrankis kiekvieną puslapį pateiks kaip vaizdą.