PDF テキストの抽出

PDFの文字をTXTとして抽出

必要なページを選択し、PDF をアップロードせずに、既存のテキスト レイヤーを UTF-8 テキスト ファイルに抽出します。

PDFからテキストへ
ファイルはこのブラウザ内に残ります。サーバーには何もアップロードされません。
PDFをテキストに無料変換|TXTとして抽出

PDF ページからテキストを抽出する

読むページを選択し、プレビューし、検索可能なテキストを 1 つの TXT ファイルとしてダウンロードします。

ここにPDFをドロップ

ファイルはこのブラウザ内に残ります。サーバーには何もアップロードされません。

検索可能な PDF を編集可能なプレーン テキストに変換する

PDF テキスト抽出は、メモ、検索、引用、アクセシビリティ ワークフロー、または別のテキスト エディターのコンテンツが必要な場合に便利です。

すべてのページを選択するか、必要なページのみを選択します。出力では各ページが明確な見出しで区切られ、UTF-8 エンコーディングが使用されます。

このツールは、PDF テキスト レイヤーをローカルで読み取ります。 OCR は実行されないため、スキャンされた画像のみのページには抽出可能なテキストが含まれない場合があります。

テキスト抽出には何が含まれますか

選択可能なページ

ドキュメント全体を抽出するか、プレビュー グリッドから個々のページを選択します。

読み取り可能なページセクション

選択した各ページには見出しが付けられるため、ソースの場所が明確になります。

UTF-8出力

TXT ファイルは、PDF 内の英語、中国語、その他の Unicode テキストをサポートしています。

仕組み

1

PDFを選択してください

ファイルをローカルで開き、ページのプレビューを準備します。

2

ページを選択してください

すべてのページを選択したままにするか、必要なテキストが含まれるページのみを選択します。

3

TXTをダウンロード

テキストレイヤーを抽出し、UTF-8 テキストファイルを 1 つ保存します。

質問

私の PDF はサーバーにアップロードされていますか?+

いいえ。PDF テキスト レイヤーはブラウザでローカルに読み取られます。

このツールは OCR を実行しますか?+

いいえ。既存の検索可能なテキストを抽出しますが、スキャンされた画像内のテキストは認識しません。

特定のページだけを抽出することはできますか?+

はい。テキストを抽出する前に、ページを選択または選択解除します。

一部のテキストが順序が乱れているのはなぜですか?+

PDF は、段落ではなく位置ごとにテキストを保存します。複雑な列や装飾的なレイアウトでは、読み取り順序が異なる場合があります。

どの言語がサポートされていますか?+

UTF-8 出力には、PDF テキスト レイヤーで使用可能な任意の Unicode 文字を含めることができます。