カテゴリー: PDFツール
PDFからテキストへ
PDFから選択可能なテキストをページごとにローカルで抽出
PDFのテキストレイヤーを1ページずつ、または選択したページ範囲にわたって、すべてブラウザ内で抽出します。結果をコピーするか、プレーンテキストファイルとしてダウンロードできます。
ファイルが選択されていません。
テキストを抽出するPDFファイルを選んでください。
抽出は、すでに実際のテキストを含んでいるPDFでのみ機能します。画像として保存されたスキャンページにはテキストレイヤーがなく、OCRが必要ですが、このツールはOCRを行いません。パスワードで保護されたPDFもここでは開けません。
このページの処理はすべてブラウザ内で行われます。アップロードは一切ありません。
このページの処理はすべてブラウザ内で行われます。アップロードは一切ありません。
このツールでできること
このツールはブラウザベースのPDFエンジンでPDFを開き、選択した各ページにすでに埋め込まれているテキストレイヤーを読み取り、ページ間の任意の区切りとともに1つのプレーンテキストの結果に結合します。何もアップロードされません。ファイルはすべてお使いのデバイス上で開かれ、読み取られます。すでにPDF内にテキストとして保存されているテキストのみを取り出すため、OCRは行いません。したがって、画像として保存されたスキャンページは空になります。
使い方
- デバイスからPDFファイルを選びます。
- 必要に応じて抽出するページを指定し、ページ間に区切りを挿入するかどうかを選びます。
- 「テキストを抽出」を押してから、結果をコピーするか、.txtファイルとしてダウンロードします。
プライバシー
このツールはすべてブラウザ内で動作します。入力した内容がアップロード・保存・共有されることはなく、タブを閉じれば消えます。
よくある質問
- テキストを抽出するためにPDFはアップロードされますか?
- いいえ。ファイルはブラウザ内で開かれ、そのテキストレイヤーもすべてブラウザ内で読み取られます。どこにも何も送信されません。
- 一部のページで結果が空になるのはなぜですか?
- そのページにはテキストレイヤーがない可能性が高く、通常は入力または生成されたテキストではなくスキャン画像だからです。このツールは既存のテキストを読み取るものであり、画像内のテキストを認識する(OCR)機能はありません。
- パスワードで保護されたPDFからテキストを抽出できますか?
- いいえ。パスワードで保護されたPDFはこのツールでは開けません。