PDF uz tekstu pārveidotājs
Izņemiet vienkāršu tekstu no PDF teksta slāņa pārlūkprogrammā, lappusi pa lappusei, kas ir gatava kopēšanai vai lejupielādei.
Rezultāts
PDF failu ir viegli lasīt, taču to ir neērti atkārtoti izmantot: jūs ne vienmēr varat tīri atlasīt tā tekstu, un ar roku kopēt lapu pēc lapas ir nogurdinoši. Šis rīks izvelk vienkāršu tekstu no PDF teksta slāņa vienā piegājienā, pilnībā jūsu pārlūkprogrammā, un nodod to atpakaļ gatavu kopēšanai vai lejupielādei — bez augšupielādes, bez konta, bez ūdenszīmes.
Izvilkšana darbojas pa lappusei. Katras lappuses teksts tiek izvilkts no paša dokumenta teksta slāņa un atdalīts ar skaidru "N lappuses" marķieri, tāpēc piecdesmit lappušu pārskats paliek sakārtots, nevis sakļaujas vienā nediferencētā vārdu sienā. Rezultāts nonāk tekstlodziņā, kuru varat lasīt, atlasīt, kopēt starpliktuvē vai saglabāt kā .txt failu, kas tiek atvērts jebkurā vietā.
Godīgums šeit ir svarīgs: daudzi PDF faili ir skenēti — papīra fotoattēli bez teksta slāņa. Ja tas notiek, neviena ekstrakcijas daļa neatradīs vārdus, tāpēc rīks tā vietā, lai atgrieztu klusi tukšu failu, nosaka tukšo rezultātu un paziņo, ka dokuments ir skenēts, norādot uz rīku Attēls uz tekstu (OCR), kas faktiski var nolasīt pikseļus. Šis ir teksta izvilkšanas līdzeklis, nevis OCR dzinējs, un tas nepretendē uz PDF konvertēšanu rediģējamā Word dokumentā.
Tā kā viss process tiek veikts jūsu datorā, izmantojot pdf.js programmu, konfidenciāli līgumi, paziņojumi un ieraksti nekad neiziet no ierīces — nav lapu ierobežojumu un servera turp un atpakaļ. Ja jums ir vajadzīgas lapas kā attēli, nevis kā teksts, rīks no PDF uz JPG katru lapu atveido kā attēlu.