PDF to Text 変換
PDFのテキストレイヤーから、ブラウザ上でページごとにプレーンテキストを抽出します。コピーやダウンロードにそのまま使えます。
🔒 ブラウザ内で完全に処理されます。ここに入力した内容はアップロードされません。
結果
PDFは読むには便利ですが、再利用しようとすると厄介です。テキストを常にきれいに選択できるとは限らず、手作業でページごとにコピーするのは面倒です。このツールはPDFのテキストレイヤーからプレーンテキストを一度に抽出し、完全にブラウザ内で処理した上で、コピーまたはダウンロードできる状態でお渡しします。アップロード不要、アカウント不要、透かしも入りません。
抽出はページ単位で行われます。各ページのテキストは文書本来のテキストレイヤーから取り出され、明確な「Page N」マーカーによって区切られます。そのため、50ページのレポートも、区切りのない長大な文章の壁に崩れることなく、整理された状態を保てます。結果はテキストボックスに表示され、読んだり、選択したり、クリップボードにコピーしたり、どこでも開ける .txt ファイルとして保存したりできます。
ここで大切なのは正直さです。PDFの多くはスキャン画像、つまり紙を撮影したもので、テキストレイヤーを一切持ちません。そのような場合、どれだけ抽出を試みても文字を見つけることはできません。そのため、本ツールは空の結果を黙って返す代わりに、文書がスキャンであることを検出してその旨を伝え、ピクセルを実際に読み取れる画像テキスト化(OCR)ツールの利用を提案します。これはテキスト抽出ツールであり、OCRエンジンではありませんし、PDFを編集可能なWord文書に変換できるとうたうこともありません。
処理全体がpdf.jsエンジンを通じてお手持ちのマシン上で実行されるため、機密の契約書や明細書、記録類がデバイスの外に出ることはありません。ページ数制限もサーバーとの通信も不要です。テキストではなく画像としてページが必要な場合は、PDF to JPG ツールが各ページを画像としてレンダリングします。