PDFora
Pricing すべてのツール
🔤

PDFからテキスト

PDFの中の選択可能なテキストをすべて取り出し、.txtファイルにします。

🔒 ファイルはブラウザ内でローカルに処理され、アップロードされることはありません。
1

アップロード

ファイルを選択するか、ドラッグ&ドロップします。

2

設定

オプションを選びます — すべてブラウザ内で処理されます。

3

ダウンロード

完成したファイルをすぐに保存。ウォーターマークはありません。

PDFからテキストを抽出し、どこでも開ける.txt形式のプレーンテキストとして保存できます。PDFビューアーから手作業でコピーすると、改行が崩れたり文字が抜け落ちたりしがちで、長い書類ではとにかく時間がかかります。このPDFからテキストへの変換ツールは、全ページの選択可能なテキストを一度にすべて取り出し、きれいなファイルとして返します。無料、登録不要、ページ数の制限もありません。

抽出はブラウザ内でローカルに実行されます。PDFはお使いの端末で解析されるため、契約書、論文、財務資料の中身を取り出すためだけにサーバーへアップロードされることはありません。この完全ローカル方式のおかげで動作も速く、数百ページのファイルでもアップロード待ちが発生しません。タブを閉じれば、書類に関する情報はどこにも残りません。

1つだけ正直にお伝えしておきます。このツールが読むのはPDF内部のテキストレイヤーです。スキャンした書類や撮影したページは単なる画像であり、取り出せるテキストレイヤーを持たないため、結果は空になります。そうした書類にはOCRツールをお使いください。画像内の文字を認識して本物のテキストに変換します。

オンラインでPDFからテキストを抽出する手順

  1. PDFからテキストへの変換ツールを開き、PDFをページ上にドロップするか、端末内から選択します。
  2. ファイルはブラウザ内でそのまま解析されます。この間、どこにもアップロードはされません。
  3. 簡単な確認方法があります。通常のPDFビューアーで文字を選択してコピーできれば抽出できます。ページがスキャンならOCRツールに切り替えてください。
  4. 「抽出」をクリックし、全ページのテキストを順番に取り出します。
  5. 生成された.txtファイルをダウンロードします。
  6. 任意のテキストエディターで開き、次の作業に合わせて空白や改行を整えます。

When to use this tool

  • 研究論文の全文を.txtで取り出し、自分のノートアプリで検索・引用・注釈できるようにする。
  • 契約書の文面を抽出し、PDFを並べて目視で比べる代わりに、差分ツールで2つの版を1行ずつ比較する。
  • 電子書籍やレポートをプレーンテキストにして、通勤中にスクリーンリーダーや読み上げアプリで聞く。
  • PDFのアップロードに対応していない翻訳ツールやAI要約ツールに、長い書類の本文を渡す。
  • 元のWordファイルが見当たらない古いPDFから文章を取り戻し、もう一度編集できるようにする。
  • 仕入先のPDFカタログから商品説明や仕様を取り出し、ネットショップの商品ページに貼り付ける。

Tips for the best results

  • まずPDFを開いて一文を選択してみてください。何も選択できなければスキャンなので、テキスト抽出ではなくOCRを使いましょう。
  • 学術論文のような多段組みのレイアウトでは、段の間を行き来する順序で抽出されることがあります。使う前に出力にざっと目を通してください。
  • ヘッダー、フッター、ページ番号も本文と一緒に取り出されます。エディターの置換機能を使えば、繰り返し現れる要素をすぐ消せます。
  • プレーンな.txtは仕様上すべての書式が失われます。太字や表、レイアウトが後で必要になりそうなら、元のPDFを残しておきましょう。
  • とても長い書類では、終わりのほうにあると分かっている語句を.txtの出力から検索してみてください。全ページが取り込まれたかを素早く確認できます。

よくある質問

PDFから空のテキストファイルしかできませんでした。なぜですか。

その書類はほぼ確実にスキャンか写真で、実際のテキストではなく文字の画像が入っています。OCRツールにかけてください。画像内の文字を認識し、編集できるテキストを生成します。

抽出中に書類はアップロードされますか。

いいえ。PDFはお使いの端末のブラウザ内だけで読み込まれます。サーバーへの送信も、保存も、記録もありません。法務や財務の書類にはまさに求められる仕組みです。

太字やフォント、表などの書式は残りますか。

残りません。出力はプレーンテキストなので、装飾やレイアウトは失われ、表は行の連なりになります。この割り切りこそが、.txtがどこでも使えて処理しやすい理由です。

とても大きなPDFからも抽出できますか。

はい。ページ数の上限はなく、アップロードの工程がないため500ページの書類でも短時間で処理できます。実質的な制約はお使いの端末のメモリだけです。

テキストは正しい順序で出力されますか。

一般的な1段組みの書類なら、ページ順に正しく出力されます。段組み、サイドバー、テキストボックスを含む複雑なレイアウトでは、目で追う順序と異なることがあるので、軽く確認してください。

本当に無料でアカウントも不要ですか。

はい。登録は不要、透かしも一切入らず、テキストに変換できるPDFの数にも制限はありません。パソコンでもスマートフォンでも、最近のブラウザであれば動作します。