0

PDF-teksti muundur

Ekstraheerige brauseris PDF-i tekstikihist lihttekst lehekülgede kaupa, kopeerimiseks või allalaadimiseks valmis.

📄

Pukseerige PDF-dokument siia

või Klõpsake PDF-failide sirvimiseks

Töötlemine... 0%
PDF-dokumendi laadimine
Tekstikihi lugemine
Lehtede kokkupanek
Hoone väljund

Tulemus

PDF-faili on lihtne lugeda, kuid taaskasutada ebamugav: selle teksti ei saa alati puhtalt valida ja käsitsi lehekülg lehekülje järel kopeerimine on tüütu. See tööriist eraldab PDF-i tekstikihist lihtteksti ühe käiguga, täielikult teie brauseris, ja annab selle uuesti kopeerimiseks või allalaadimiseks valmis – pole üleslaadimist, kontot ega vesimärki.

Ekstraheerimine töötab lehekülgede kaupa. Iga lehe tekst tõmmatakse dokumendi enda tekstikihist ja eraldatakse selge "Lehekülje N" markeriga, nii et viiekümneleheküljeline aruanne jääb organiseerituks, selle asemel, et kokku kukkuda üheks eristamatuks sõnaseinaks. Tulemus satub tekstikasti, mida saate lugeda, valida, lõikelauale kopeerida või salvestada .txt-failina, mis avaneb kõikjal.

Ausus on siinkohal oluline: paljud PDF-failid on skaneeringud – paberifotod, millel puudub tekstikiht. Kui see juhtub, ei leia ükski ekstraheerimine sõnu, nii et vaikselt tühja faili tagastamise asemel tuvastab tööriist tühja tulemuse ja ütleb teile, et dokument on skannitud, suunates teid pildi tekstiks (OCR) tööriistale, mis suudab tegelikult piksleid lugeda. See on teksti ekstraktor, mitte OCR-mootor ja see ei pretendeeri PDF-i teisendamist redigeeritavaks Wordi dokumendiks.

Kuna kogu protsess töötab teie enda masinas pdf.js-mootori kaudu, ei lahku konfidentsiaalsed lepingud, avaldused ja kirjed kunagi seadmest – puuduvad leheküljepiirangud ega serveri edasi-tagasi reis. Kui vajate lehti pigem piltidena kui tekstina, renderdab PDF-vormingus JPG-vormingus tööriist iga lehe selle asemel pildiks.