从 PDF 中提取文本
从浏览器中的 PDF 文本层中逐页提取纯文本,准备复制或下载。
处理中...
0%
加载 PDF 文档
读取文本层
组装页面
建筑输出
结果
此页面打开 PDF 转文本工具,准备从文档中提取纯文本。拖放 PDF,该工具会逐页读取其文本层,用“Page N”标记标记每个块,并在一个框中显示整个结果,您可以复制或下载为 .txt 文件。
提取文本是重复使用 PDF 中的单词的最快方法:引用合同中的条款、将报告正文移至编辑器、将内容输入翻译器或在长文档中搜索短语。因为文本来自 PDF 自己的文本层,所以它是准确的 — 没有 OCR 猜测,没有误读字符。
一切都通过 pdf.js 引擎在您的浏览器本地运行,因此机密文档永远不会离开您的设备。如果 PDF 是没有文本层的扫描件,该工具会清楚地告诉您并引导您进行 OCR,而不是返回空文件。