Ekstrak Teks dari PDF
Ekstrak teks biasa dari lapisan teks PDF di browser, halaman demi halaman, siap untuk disalin atau diunduh.
Hasil
Halaman ini membuka alat PDF-ke-teks yang siap mengeluarkan teks biasa dari dokumen. Jatuhkan PDF dan alat tersebut membaca lapisan teksnya halaman demi halaman, memberi label setiap blok dengan penanda "Halaman N", dan menampilkan keseluruhan hasil dalam kotak yang dapat Anda salin atau unduh sebagai file .txt.
Mengekstrak teks adalah cara tercepat untuk menggunakan kembali kata-kata dalam PDF: mengutip klausul kontrak, memindahkan isi laporan ke editor, memasukkan konten ke penerjemah, atau mencari frasa di dokumen panjang. Karena teksnya berasal dari lapisan teks PDF itu sendiri, maka teksnya persis — tidak ada tebakan OCR, tidak ada karakter yang salah membaca.
Semuanya berjalan secara lokal di browser Anda melalui mesin pdf.js, sehingga dokumen rahasia tidak pernah meninggalkan perangkat Anda. Jika PDF adalah pindaian tanpa lapisan teks, alat ini memberi tahu Anda dengan jelas dan mengarahkan Anda ke OCR daripada mengembalikan file kosong.