Extraer texto de PDF
Extraiga el texto sin formato de la capa de texto de un PDF en el navegador, página por página, listo para copiar o descargar.
Resultado
Esta página abre la herramienta de conversión de PDF a texto lista para extraer el texto sin formato de un documento. Suelte un PDF y la herramienta lee su capa de texto página por página, etiqueta cada bloque con un marcador de "Página N" y muestra el resultado completo en un cuadro que puede copiar o descargar como un archivo .txt.
Extraer texto es la forma más rápida de reutilizar las palabras en un PDF: citar una cláusula de un contrato, mover el cuerpo de un informe a un editor, introducir contenido en un traductor o buscar una frase en un documento extenso. Debido a que el texto proviene de la propia capa de texto del PDF, es exacto: sin conjeturas de OCR ni caracteres mal leídos.
Todo se ejecuta localmente en su navegador a través del motor pdf.js, por lo que los documentos confidenciales nunca salen de su dispositivo. Si el PDF es un escaneo sin capa de texto, la herramienta se lo informará claramente y le indicará OCR en lugar de devolver un archivo vacío.