PDFからテキストを抽出

PDFからすべてのテキストを抜き出し、プレビュー、コピー、または.txtファイルとして ダウンロードできます。何もアップロードされません、すべてお使いの端末内で処理されます。

クリックしてPDFファイルを選択するか、ここにドラッグ&ドロップしてください

端末内に留まり、何もアップロードされません。

PDFファイルはどこかにアップロードされますか?

いいえ。テキストの抽出はすべてブラウザ内でJavaScriptを使って行われます。ファイルが端末の外に出たり、サーバーに触れたりすることはありません。

スキャンしたPDFでも使えますか?

それだけでは使えません。このツールはPDFにすでに埋め込まれているテキストを読み取るもので、スキャンしたページは単なる画像なので、あらかじめOCR処理がされていない限り抽出できるテキストはありません。

段組みや表のようなレイアウトはきれいに抽出されますか?

多くの場合はうまくいきますが、複雑なレイアウト(複数段組みのページや表)は予期しない読み順で出力されることがあります。PDFはテキストを厳密な上から下への構造で保存しているわけではないためです。

パスワード保護されたPDFからテキストを抽出できますか?

現在は非対応です。パスワード保護や暗号化されたPDFはツールで読み込めず、エラーが表示されます。先にPDFリーダーでパスワードを解除してください。