0

PDF szövegkonverter

Nyerd ki a PDF szövegrétegéből a nyers szöveget a böngésződben, oldalanként, másolásra vagy letöltésre készen.

🔒 Teljesen a böngészőjében dolgozzák fel – soha semmi, amit itt beírt, nem kerül feltöltésre.

📄

Húzd ide a PDF dokumentumot

vagy kattints a PDF fájlok tallózásához

Feldolgozás... 0%
PDF dokumentum betöltése
Szövegréteg olvasása
Oldalak összeállítása
Kimenet létrehozása

Eredmény

Egy PDF-et könnyű olvasni, de nehézkes újrahasznosítani: nem mindig lehet tisztán kijelölni a szövegét, és az oldalak kézi másolgatása fárasztó. Ez az eszköz egy menetben kinyeri a nyers szöveget a PDF szövegrétegéből, teljes egészében a böngésződön belül, és másolásra vagy letöltésre készen adja vissza — nincs feltöltés, nincs fiók, nincs vízjel.

A kinyerés oldalanként működik. Minden oldal szövege a dokumentum saját szövegrétegéből származik, és egyértelmű „N. oldal” jelölés választja el őket, így egy ötvenoldalas riport rendezett marad, ahelyett, hogy egyetlen tagolatlan szótömeggé omlana össze. Az eredmény egy szövegdobozban jelenik meg, amit elolvashatsz, kijelölhetsz, a vágólapra másolhatsz, vagy .txt fájlként menthetsz, ami bárhol megnyílik.

Itt fontos az őszinteség: sok PDF szkennelt kép — papír alapú fénykép, szövegréteg nélkül. Ilyenkor a kinyerés semmilyen szöveget nem talál, így ahelyett, hogy csendben üres fájlt adnánk vissza, az eszköz felismeri az üres eredményt, és közli, hogy a dokumentum szkennelt, és a Képből szöveg (OCR) eszköz felé irányít, ami ténylegesen képes a képpontok olvasására. Ez egy szövegkinyerő, nem egy OCR motor, és nem tetteti, hogy egy PDF-et szerkeszthető Word dokumentummá alakít.

Mivel a teljes folyamat a saját gépeden fut a pdf.js motor segítségével, a bizalmas szerződések, kimutatások és nyilvántartások sosem hagyják el az eszközt — nincsenek oldalkorlátozások és nincs szerveroldali oda-vissza küldés. Ha az oldalakra képként van szükséged szöveg helyett, a PDF-ből JPG eszköz minden oldalt külön képként jelenít meg.