0

PDF からテキストを抽出

ブラウザで PDF のテキスト レイヤーからプレーン テキストをページごとに抽出し、コピーまたはダウンロードできるようにします。

📄

ここに PDF ドキュメントをドラッグ アンド ドロップします

または クリックして PDF ファイルを参照します

処理中... 0%
PDFドキュメントをロードしています
テキストレイヤーの読み取り
ページを組み立てる
建築出力

結果

このページでは、ドキュメントからプレーン テキストを抽出できる PDF テキスト変換ツールが開きます。 PDF をドロップすると、ツールはそのテキスト レイヤーをページごとに読み取り、各ブロックに「ページ N」マーカーでラベルを付け、結果全体をボックスに表示します。ボックスに結果全体が表示され、.txt ファイルとしてコピーまたはダウンロードできます。

テキストの抽出は、PDF 内の単語を再利用する最も簡単な方法です。契約書の条項を引用したり、レポートの本文をエディターに移動したり、コンテンツを翻訳者に入力したり、長い文書からフレーズを検索したりすることができます。テキストは PDF 独自のテキスト レイヤーから取得されるため、OCR による推測や文字の誤読がなく、正確です。

すべては pdf.js エンジンを通じてブラウザー内でローカルに実行されるため、機密文書がデバイスから流出することはありません。 PDF がテキスト レイヤーのないスキャンである場合、ツールは空のファイルを返すのではなく、明確に通知し、OCR を指示します。