HivePDF
日本語
← ガイド

PDFからテキストを抽出する方法

更新 2026年7月13日

一節を引用したい、文書の中身を検索したい、あるいはPDFのテキストを別のツールに読み込ませたい — そんなときは、PDFビューアからページごとにコピー&ペーストするより、テキストをプレーンな .txt ファイルとして抽出したほうが速く済みます。

手順

  1. PDFからテキストへを開き、ファイルをドロップします。
  2. テキストを抽出をクリックします。
  3. すべての内容が入った .txt ファイルをダウンロードします。

得られるもの

このツールはPDFのテキストレイヤーを読み取り、改行を保持したまま読み順どおりに再構成します。結果はきれいなプレーンテキストで、ページ同士は空行で区切られます。引用・検索・別の場所への貼り付け用にテキストを取り出すためのツールであり、見た目のレイアウトを保持するものではありません — 段組み、表、正確な余白は再現されません。.txt ファイルにはそもそもレイアウトという概念がないためです。

スキャンしたPDFはまずOCRが必要

スキャンした文書 — 実質的には写真や画像をPDFにまとめただけのページ — にはテキストレイヤーが一切存在しないため、このツールで抽出できるものがありません。結果が空だったり「テキストが見つかりません」と表示されたりした場合は、まずPDFをOCRでテキストレイヤーを認識・追加してから、あらためて抽出してください。

補足

処理はすべてローカルで行われるため、機密文書の内容が抽出中に外部へ出ることはありません。テキストではなくPDF内の画像が必要な場合は、代わりに画像を抽出をお使いください。

このガイドのツール

よくある質問

「テキストが見つかりません」と表示されるのはなぜですか?
そのPDFはおそらくスキャンデータ — テキスト情報を持たないページ画像の集まりです。まず「PDFをOCR」でテキストレイヤーを認識・追加してから、あらためて抽出してください。
抽出したテキストは、段組みや表など元のレイアウトを保持しますか?
いいえ。このツールは読み順と改行を保持してきれいなプレーンテキストを生成しますが、段組み・表・厳密な余白の再現までは行いません。それが必要な場合はプレーンテキストではなく、レイアウトを保持できる別の形式が必要です。
テキスト抽出時にファイルはアップロードされますか?
いいえ。テキストの読み取りはすべてブラウザ内で行われます — 大きなファイルや機密性の高い文書であっても、PDFがお使いの端末から出ることはありません。