PDF テキスト抽出

PDF の文字を、プレーンテキストで取り出す。

無料 · 送信なし · 端末内で処理

書類は端末から出ません

  • 0 KBの追加負荷
  • Pages指定も全部も
  • Copyか .txt 保存
  • Saysスキャンも明示
仕様

PDF テキスト抽出の仕様

入力形式
PDF を1つ
出力形式
テキスト、コピーか .txt
最大ファイルサイズ
端末のメモリ次第
まとめて処理
一度に1つの PDF
整形の精度
行と段落を組み直します
スキャンしたファイル
黙って空にせず、明示します
料金
無料
登録の要否
不要
使い方

PDF テキスト抽出の使い方

  1. 1

    PDF を追加する

    PDF を追加

  2. 2

    ページを選ぶ

    ページを指定するか全部

  3. 3

    文字を取り出す

    コピーか .txt で保存

よくある質問

よくある質問

メッセージだけ出て文字が返ってこないのは?

スキャンだからです。文字ではなくページの画像です。ファイルの中に取り出せるものがありません。画像から文字を読むには文字認識が必要で、このツールは行いません。

段落は保たれる?

初期状態では保たれます。文字の位置から行を組み直し、行の1.5倍ほど空いた箇所を段落の終わりとみなします。この動きはオフにできます。

一部のページだけ取り出せる?

できます。印刷ダイアログと同じ書き方(1-3, 7, 12-)で指定すると、そのページだけを読み取ります。

ファイルはアップロードされる?

されません。PDF はこのタブの中で開いて読まれます。取り出した文字も含め、どこにも送られません。

表や段組みはどうなる?

段組みの文字は、ファイルが保持している順に段ごとに出るため、読む順とは違うことがあります。表は罫線を失い、行の連なりとして返ります。

解説

PDF に文字がないとき

PDF を入れると、指定したページの文字が段落の区切りを保ったまま返ります。ページの画像だけの PDF には、取り出せる文字がありません。

  • スキャナーで作った PDF は、各ページの画像を持っています。画面では文字に見えても、ファイルの中に文字はありません。
  • このツールは、文字を探し始める前にそれをお伝えします。両方が混ざったファイルでは、画像のページを個別に示します。

仕様をすべて見る

PDF テキスト抽出ツールの仕様
入力形式PDF を1つ。暗号化されたファイルは先に解除が必要です。
出力形式画面上のプレーンテキスト。コピーするか、.txt で保存できます。
最大ファイルサイズ端末のメモリ次第
まとめて処理できません。一度に1つの PDF です。その中のページ指定は可能です。
整形の精度文字の位置から行を組み直し、行間が広く空いた箇所は段落の区切りとして扱います。
スキャンしたファイル画像のページには文字がありません。そのページ名を示し、全部が画像なら何も返さずその旨をお伝えします。
料金無料
登録の要否不要
次にできること

同じファイルのまま続ける

PDFツール一覧: SPOTTOOLSのPDFツール