PDF naar tekstconverter
Extraheer de platte tekst uit de tekstlaag van een PDF in de browser, pagina voor pagina, klaar om te kopiëren of te downloaden.
Resultaat
Een PDF is gemakkelijk te lezen, maar lastig om opnieuw te gebruiken: je kunt de tekst niet altijd netjes selecteren en pagina na pagina met de hand kopiëren is vervelend. Deze tool extraheert de platte tekst in één keer uit de tekstlaag van een PDF, volledig in uw browser, en geeft deze terug, klaar om te kopiëren of te downloaden - geen upload, geen account, geen watermerk.
De extractie werkt pagina voor pagina. De tekst van elke pagina wordt uit de eigen tekstlaag van het document gehaald en gescheiden door een duidelijke 'Pagina N'-markering, zodat een rapport van vijftig pagina's georganiseerd blijft in plaats van samen te vallen in één ongedifferentieerde woordenmuur. Het resultaat komt terecht in een tekstvak dat u kunt lezen, selecteren, naar het klembord kopiëren of opslaan als een .txt-bestand dat overal kan worden geopend.
Eerlijkheid is hier van belang: veel pdf's zijn scans: foto's van papier zonder enige tekstlaag. Wanneer dat gebeurt, zal geen enkele hoeveelheid extractie woorden vinden, dus in plaats van een stilletjes leeg bestand terug te geven, detecteert de tool het lege resultaat en vertelt u dat het document een scan is, waarbij u wordt verwezen naar de Image to Text (OCR)-tool die daadwerkelijk pixels kan lezen. Dit is een tekstextractor, geen OCR-engine, en het pretendeert niet een PDF naar een bewerkbaar Word-document te converteren.
Omdat het hele proces via de pdf.js-engine op uw eigen machine wordt uitgevoerd, verlaten vertrouwelijke contracten, verklaringen en documenten het apparaat nooit. Er zijn geen paginalimieten en er is geen heen- en terugreis naar de server. Als u de pagina's als afbeeldingen in plaats van als tekst nodig heeft, wordt met de tool PDF-naar-JPG elke pagina in plaats daarvan omgezet in een afbeelding.