0

PDF-tekstimuunnin

Pura pelkkä teksti PDF-tiedoston tekstikerroksesta selaimessa sivu sivulta, valmis kopioitavaksi tai ladattavaksi.

📄

Vedä ja pudota PDF-dokumentti tähän

tai Napsauta selataksesi PDF-tiedostoja

Käsitellään... 0%
Ladataan PDF-dokumenttia
Tekstikerroksen lukeminen
Sivujen kokoaminen
Rakennuksen tuotto

Tulos

PDF on helppolukuinen, mutta hankala käyttää uudelleen: sen tekstiä ei aina voi valita puhtaasti, ja sivun toiselle kopioiminen käsin on työlästä. Tämä työkalu poimii tavallisen tekstin PDF-tiedoston tekstikerroksesta yhdellä kertaa, kokonaan selaimen sisällä, ja palauttaa sen kopioitavaksi tai ladattavaksi – ei latausta, tiliä, ei vesileimaa.

Poiminta toimii sivu sivulta. Jokaisen sivun teksti vedetään asiakirjan omasta tekstikerroksesta ja erotetaan selkeällä "Sivu N" -merkillä, joten 50-sivuinen raportti pysyy järjestyksessä sen sijaan, että se romahtaa yhdeksi erottamattomaksi sanaseinäksi. Tulos laskeutuu tekstiruutuun, jonka voit lukea, valita, kopioida leikepöydälle tai tallentaa .txt-tiedostona, joka avautuu missä tahansa.

Rehellisyydellä on tässä väliä: monet PDF-tiedostot ovat skannauksia – paperivalokuvia, joissa ei ole lainkaan tekstikerrosta. Kun näin tapahtuu, mikään poiminta ei löydä sanoja, joten sen sijaan, että työkalu palauttaisi äänettömästi tyhjän tiedoston, se havaitsee tyhjän tuloksen ja kertoo, että asiakirja on skannattu, ja ohjaa sinut Image to Text (OCR) -työkaluun, joka voi todella lukea pikseleitä. Tämä on tekstinpoiminta, ei OCR-moottori, eikä se pyri muuttamaan PDF-tiedostoa muokattavaksi Word-asiakirjaksi.

Koska koko prosessi suoritetaan omalla koneellasi pdf.js-moottorin kautta, luottamukselliset sopimukset, lausunnot ja tietueet eivät koskaan poistu laitteelta – ei ole sivurajoituksia eikä palvelimen edestakaista kuljetusta. Jos tarvitset sivuja kuvina tekstin sijaan, PDF-to-JPG-työkalu hahmontaa jokaisen sivun kuvaksi.