PDF テキスト抽出
PDF の文字を、プレーンテキストで取り出す。
無料 · 送信なし · 端末内で処理
書類は端末から出ません
- 0 KBの追加負荷
- Pages指定も全部も
- Copyか .txt 保存
- Saysスキャンも明示
PDF テキスト抽出の仕様
- 入力形式
- PDF を1つ
- 出力形式
- テキスト、コピーか .txt
- 最大ファイルサイズ
- 端末のメモリ次第
- まとめて処理
- 一度に1つの PDF
- 整形の精度
- 行と段落を組み直します
- スキャンしたファイル
- 黙って空にせず、明示します
- 料金
- 無料
- 登録の要否
- 不要
PDF テキスト抽出の使い方
- 1
PDF を追加する
PDF を追加
- 2
ページを選ぶ
ページを指定するか全部
- 3
文字を取り出す
コピーか .txt で保存
よくある質問
メッセージだけ出て文字が返ってこないのは?
スキャンだからです。文字ではなくページの画像です。ファイルの中に取り出せるものがありません。画像から文字を読むには文字認識が必要で、このツールは行いません。
段落は保たれる?
初期状態では保たれます。文字の位置から行を組み直し、行の1.5倍ほど空いた箇所を段落の終わりとみなします。この動きはオフにできます。
一部のページだけ取り出せる?
できます。印刷ダイアログと同じ書き方(1-3, 7, 12-)で指定すると、そのページだけを読み取ります。
ファイルはアップロードされる?
されません。PDF はこのタブの中で開いて読まれます。取り出した文字も含め、どこにも送られません。
表や段組みはどうなる?
段組みの文字は、ファイルが保持している順に段ごとに出るため、読む順とは違うことがあります。表は罫線を失い、行の連なりとして返ります。
PDF に文字がないとき
PDF を入れると、指定したページの文字が段落の区切りを保ったまま返ります。ページの画像だけの PDF には、取り出せる文字がありません。
- スキャナーで作った PDF は、各ページの画像を持っています。画面では文字に見えても、ファイルの中に文字はありません。
- このツールは、文字を探し始める前にそれをお伝えします。両方が混ざったファイルでは、画像のページを個別に示します。
仕様をすべて見る
| 入力形式 | PDF を1つ。暗号化されたファイルは先に解除が必要です。 |
|---|---|
| 出力形式 | 画面上のプレーンテキスト。コピーするか、.txt で保存できます。 |
| 最大ファイルサイズ | 端末のメモリ次第 |
| まとめて処理 | できません。一度に1つの PDF です。その中のページ指定は可能です。 |
| 整形の精度 | 文字の位置から行を組み直し、行間が広く空いた箇所は段落の区切りとして扱います。 |
| スキャンしたファイル | 画像のページには文字がありません。そのページ名を示し、全部が画像なら何も返さずその旨をお伝えします。 |
| 料金 | 無料 |
| 登録の要否 | 不要 |
同じファイルのまま続ける
PDFツール一覧: SPOTTOOLSのPDFツール