PDF'den Metine Dönüştürücü
Düz metni tarayıcıdaki PDF'nin metin katmanından sayfa sayfa, kopyalamaya veya indirmeye hazır şekilde çıkarın.
Sonuç
PDF'nin okunması kolaydır ancak yeniden kullanılması zordur: metnini her zaman temiz bir şekilde seçemezsiniz ve sayfa sayfa kopyalamak sıkıcıdır. Bu araç, düz metni PDF'nin metin katmanından tek geçişte, tamamen tarayıcınızın içinden çıkarır ve kopyalamaya veya indirmeye hazır olarak geri verir; yükleme yok, hesap yok, filigran yok.
Çıkarma işlemi sayfa sayfa çalışır. Her sayfanın metni, belgenin kendi metin katmanından alınır ve anlaşılır bir "Sayfa N" işaretçisiyle ayrılır, böylece elli sayfalık bir rapor, farklılaştırılmamış tek bir kelime duvarına çökmek yerine düzenli kalır. Sonuç, okuyabileceğiniz, seçebileceğiniz, panoya kopyalayabileceğiniz veya herhangi bir yerde açılan bir .txt dosyası olarak kaydedebileceğiniz bir metin kutusuna gelir.
Burada dürüstlük önemlidir: PDF'lerin çoğu taramadır; yani hiçbir metin katmanı olmayan kağıt fotoğraflarıdır. Bu olduğunda, hiçbir çıkarma işlemi sözcükleri bulamaz; bu nedenle, sessizce boş bir dosya döndürmek yerine, araç boş sonucu algılar ve size belgenin bir tarama olduğunu söyleyerek sizi gerçekten piksel okuyabilen Görüntüden Metne (OCR) aracına yönlendirir. Bu bir OCR motoru değil, bir metin çıkarıcıdır ve PDF'yi düzenlenebilir bir Word belgesine dönüştürme iddiasında değildir.
Tüm süreç pdf.js motoru aracılığıyla kendi makinenizde çalıştığından, gizli sözleşmeler, beyanlar ve kayıtlar asla cihazdan ayrılmaz; sayfa sınırı yoktur ve sunucu gidiş-dönüş durumu yoktur. Sayfalara metin yerine resim olarak ihtiyacınız varsa, PDF'den JPG'ye dönüştürme aracı her sayfayı bir görüntüye dönüştürür.