0

PDF Tekstiks Teisendaja

Eralda PDF-i tekstikihist tavatekst brauseris lehekülg haaval, et seda saaks kohe kopeerida või alla laadida.

🔒 Töödeldud täielikult teie brauseris – midagi, mida siia sisestate, ei laadita kunagi üles.

📄

Lohista PDF-dokument siia

või klõpsa PDF-failide sirvimiseks

Töötlen... 0%
PDF-dokumendi laadimine
Tekstikihi lugemine
Lehekülgede koondamine
Väljundi koostamine

Tulemus

PDF-i on lihtne lugeda, kuid ebamugav taaskasutada: teksti ei saa alati puhtalt valida ja lehekülgede käsitsi kopeerimine on tüütu. See tööriist eraldab PDF-i tekstikihist tavateksti ühe korraga, täielikult sinu brauseris, ja annab selle kopeerimiseks või allalaadimiseks – faili ei laadita üles, pole vaja kontot ega vesimärki.

Eraldamine toimub lehekülg haaval. Iga lehekülje tekst võetakse dokumendi enda tekstikihist ja eraldatakse selge tähisega „Lk N“, nii et viiekümneleheküljeline aruanne jääb korrastatuks, selle asemel et vajuda üheks eristamatuks sõnumüüriks. Tulemus kuvatakse tekstikastis, mida saad lugeda, valida, lõikepuhvrisse kopeerida või salvestada .txt-failina, mis avaneb igal pool.

Ausus loeb: paljud PDF-id on skaneeringud – paberist fotod, millel pole üldse tekstikihti. Sellisel juhul ei leia ükski eraldamine sõnu, nii et tööriist ei tagasta vaikivalt tühja faili, vaid tuvastab tühja tulemuse ja ütleb sulle, et dokument on skaneering, suunates sind pildilt tekstiks (OCR) tööriista juurde, mis oskab piksleid lugeda. See on teksti eraldaja, mitte OCR-mootor, ja see ei teeskle, et suudab PDF-i redigeeritavaks Wordi dokumendiks teisendada.

Kuna kogu protsess toimub sinu enda masinas pdf.js-i mootori kaudu, ei lahku konfidentsiaalsed lepingud, väljavõtted ja dokumendid kunagi seadmest – puuduvad leheküljepiirangud ja serveripöördumised. Kui vajad lehekülgi pigem piltidena kui tekstina, renderdab PDF-JPG-ks tööriist iga lehekülje hoopis pildiks.