PDFからTXTへの変換
ブラウザで PDF のテキスト レイヤーからプレーン テキストをページごとに抽出し、コピーまたはダウンロードできるようにします。
処理中...
0%
PDFドキュメントをロードしています
テキストレイヤーの読み取り
ページを組み立てる
建築出力
結果
このページでは、PDF からプレーンテキストの .txt ファイルを生成することに重点を置いたコンバータが開きます。ドキュメントをドロップすると、そのテキストが「ページ N」マーカーでページごとに抽出され、ダウンロード可能な .txt として提供されます。これは、あらゆるエディター、スクリプト、またはコマンド ライン ツールで開くことができる汎用形式です。
.txt エクスポートは、書式設定を行わずに単語が必要な場合、つまりコンテンツをプログラムにパイプする場合、2 つのバージョンの差分を比較する場合、検索用にドキュメントにインデックスを作成する場合、PDF の読み取り可能なテキストを可能な限り小さいファイルにアーカイブする場合などに最適です。ダウンロード ボタンをクリックすると、テキスト ボックスに表示されている内容がそのまま保存されます。
すべての抽出は pdf.js エンジンを介してブラウザーでローカルに行われます。何もアップロードされませんが、これは個人的な書類作成には重要です。 PDF がテキストが埋め込まれていないスキャンであることが判明した場合、ツールはその旨を通知し、空のファイルを返す代わりに OCR を提案します。