PDFからテキストを抽出する方法
更新 2026年7月13日
一節を引用したい、文書の中身を検索したい、あるいはPDFのテキストを別のツールに読み込ませたい — そんなときは、PDFビューアからページごとにコピー&ペーストするより、テキストをプレーンな .txt ファイルとして抽出したほうが速く済みます。
手順
- PDFからテキストへを開き、ファイルをドロップします。
- テキストを抽出をクリックします。
- すべての内容が入った
.txtファイルをダウンロードします。
得られるもの
このツールはPDFのテキストレイヤーを読み取り、改行を保持したまま読み順どおりに再構成します。結果はきれいなプレーンテキストで、ページ同士は空行で区切られます。引用・検索・別の場所への貼り付け用にテキストを取り出すためのツールであり、見た目のレイアウトを保持するものではありません — 段組み、表、正確な余白は再現されません。.txt ファイルにはそもそもレイアウトという概念がないためです。
スキャンしたPDFはまずOCRが必要
スキャンした文書 — 実質的には写真や画像をPDFにまとめただけのページ — にはテキストレイヤーが一切存在しないため、このツールで抽出できるものがありません。結果が空だったり「テキストが見つかりません」と表示されたりした場合は、まずPDFをOCRでテキストレイヤーを認識・追加してから、あらためて抽出してください。
補足
処理はすべてローカルで行われるため、機密文書の内容が抽出中に外部へ出ることはありません。テキストではなくPDF内の画像が必要な場合は、代わりに画像を抽出をお使いください。