PDFをテキスト(TXT)に変換
PDFの文字をワンクリックでテキストファイルに抽出します。日本語などの文字もそのまま保たれます。
- PDF→ → TXT
- 最大 25 MB
- 登録不要
04 PDF → テキスト(TXT)
- 01 選ぶ
- 02 処理
- 03 保存
HTTPS · 約 10 分後に削除
アプリ内ブラウザで開いています。確実にダウンロードするには ••• メニューから ブラウザで開く を選んでください。
準備完了。あとはワンクリック。
処理状況
ファイルをアップロード中
結果
完了。
0ページをテキストに
.txt
うまくいきませんでした。
ゲスト上限
今日のゲスト変換回数を使い切りました。
無料アカウントを作れば、そのまま続けられます。30 秒で完了します。
- 1 日の上限がアップ
- 変換履歴をひとまとめに
- すべてのツールを 1 つのアカウントで
処理の流れ
- ファイルをアップロード中
- ファイルを確認中
- テキストを抽出中
- 仕上げ中
待つのをやめても、サーバー上のコピーは自動で削除されます。
- HTTPS で暗号化して転送
- 約 10 分で削除
- 無料・登録不要
01
PDFからテキストを抽出するメリット
PDFによっては、文章をコピーすると行が乱れたり、ページ番号やヘッダーが混ざったり、単語がハイフンで途切れたりして手間がかかります。AIツールや翻訳ツール、自作のプログラムに文章を渡したいなら、書式のないプレーンテキスト(TXT)として取り出すのが最もきれいな方法です。
PDFテキスト変換ツールは、文書をページごとに読み取り、各ページの先頭に「=== ページ 1 ===」のような区切りを入れて、UTF-8形式のTXTファイルに書き出します。UTF-8なので、日本語やアクセント付きの文字も文字化けせずに保たれます。
02
PDFをテキストに変換する3つのステップ
PDFをアップロード:上のエリアにファイルをドラッグするか、クリックして選択します(25MBまで)。
テキストを抽出:「テキストに変換」をクリックすると、全ページの文字が順番に読み取られます。
TXTファイルをダウンロード:メモ帳、テキストエディット、VS Codeなど、お好みのテキストエディターで開けます。
03
こんなときに便利です
AI・翻訳ツール:長い報告書を要約・翻訳するために、整ったテキストを貼り付ける。
引用・調査:改行やハイフネーションに悩まされずに、論文や書籍から引用する。
データ処理:Python、Excelなどのソフトでテキストを検索・集計・分析する。
アクセシビリティ:スクリーンリーダーや読み上げアプリでテキストを利用する。
04
抽出の仕組みと制限
テキストベースのPDFなら正確:Wordなどで作成したPDFでは、ファイルから文字を直接読み取るため、認識ミスは起こりません。
書式は含まれません:TXTはプレーンテキストのため、太字・斜体、フォント、画像、表の罫線は含まれません。表の値は行として出力されます。
段組みのページ:新聞や雑誌のようなレイアウトでは、段の読み取り順が想定と異なる場合があります。
スキャンした文書:選択できるテキストがまったく見つからない場合は、トルコ語・英語のOCRでページの読み取りを試みます。日本語のスキャン文書は読み取れない点にご注意ください。スキャン文書にはPDF OCRツールをおすすめします。
サイズ上限:1ファイルあたり25MBまで。
05
プライバシーと自動削除
ファイルは暗号化されたHTTPS通信でサーバーに送信されます。アップロードされた元のファイルは、処理が終わるとすぐに削除されます。作成されたファイルはダウンロードのために短時間だけ保存され、毎分実行される自動クリーンアップ処理によって、10分以上経過したファイルが完全に削除されます。結果ファイルは準備ができたらすぐにダウンロードすることをおすすめします。
ダウンロードリンクは、処理を開始したユーザーまたはブラウザセッションでのみ有効で、ファイルが他のユーザーと共有されることはありません。処理ログに記録されるのはファイル名、サイズ、処理の種類などの情報のみで、ファイルそのものは保存されません。
06
よくある質問
日本語などの文字は文字化けしませんか?
しません。テキストはUTF-8で保存されるため、日本語やアクセント付きの文字もそのまま保たれます。古いエディターで正しく表示されない場合は、文字コードにUTF-8を指定して開いてください。
スキャンしたPDFからテキストを取り出せますか?
選択できるテキストがまったくない場合は、OCRによる認識を試みます(トルコ語・英語のみ対応で、日本語は認識できません)。スキャン文書で最良の結果を得るには、PDF OCRツールをご利用ください。
ページの区切りは残りますか?
はい。各ページのテキストは「=== ページ 1 ===」のような見出しで区切られるため、どのページの文章かがすぐにわかります。
表や画像はどうなりますか?
画像はTXTファイルに含まれません。表の文字は行ごとに書き出されます。表の構造を保ちたい場合は、PDF Excel変換ツールをご利用ください。
TXTファイルはどのソフトで開けますか?
Windowsならメモ帳、macOSならテキストエディット、そのほか任意のコードエディターで開けます。スマホのファイル管理アプリでも表示できます。
ファイルは保存されますか?
いいえ。元のPDFは処理完了後に削除され、TXTファイルも数分以内にサーバーから自動で削除されます。