PDFをテキスト(TXT)に変換

PDFの文字をワンクリックでテキストファイルに抽出します。日本語などの文字もそのまま保たれます。

  • PDF → TXT
  • 最大 ⁦25 MB⁩
  • 登録不要

04 PDF → テキスト(TXT)

  1. 01 選ぶ
  2. 02 処理
  3. 03 保存

HTTPS · 約 10 分後に削除

PDF

選択したファイル

サイズ: 準備完了

準備完了。あとはワンクリック。

処理状況

ファイルをアップロード中

結果

完了。

0ページをテキストに

うまくいきませんでした。

  • アカウント不要、無料です。
  • スキャンしたページは先に OCR にかけてください。
  • ファイルは処理後およそ 10 分で削除されます。

まず PDF を選んでください

処理の流れ

  1. ファイルをアップロード中
  2. ファイルを確認中
  3. テキストを抽出中
  4. 仕上げ中

待つのをやめても、サーバー上のコピーは自動で削除されます。

ファイルをダウンロード

自動削除まで 10:00

その後サーバーから完全に削除されます。今すぐダウンロードしてください。

01

PDFからテキストを抽出するメリット

PDFによっては、文章をコピーすると行が乱れたり、ページ番号やヘッダーが混ざったり、単語がハイフンで途切れたりして手間がかかります。AIツールや翻訳ツール、自作のプログラムに文章を渡したいなら、書式のないプレーンテキスト(TXT)として取り出すのが最もきれいな方法です。

PDFテキスト変換ツールは、文書をページごとに読み取り、各ページの先頭に「=== ページ 1 ===」のような区切りを入れて、UTF-8形式のTXTファイルに書き出します。UTF-8なので、日本語やアクセント付きの文字も文字化けせずに保たれます。

02

PDFをテキストに変換する3つのステップ

  1. PDFをアップロード:上のエリアにファイルをドラッグするか、クリックして選択します(25MBまで)。

  2. テキストを抽出:「テキストに変換」をクリックすると、全ページの文字が順番に読み取られます。

  3. TXTファイルをダウンロード:メモ帳、テキストエディット、VS Codeなど、お好みのテキストエディターで開けます。

03

こんなときに便利です

  • AI・翻訳ツール:長い報告書を要約・翻訳するために、整ったテキストを貼り付ける。

  • 引用・調査:改行やハイフネーションに悩まされずに、論文や書籍から引用する。

  • データ処理:Python、Excelなどのソフトでテキストを検索・集計・分析する。

  • アクセシビリティ:スクリーンリーダーや読み上げアプリでテキストを利用する。

04

抽出の仕組みと制限

  • テキストベースのPDFなら正確:Wordなどで作成したPDFでは、ファイルから文字を直接読み取るため、認識ミスは起こりません。

  • 書式は含まれません:TXTはプレーンテキストのため、太字・斜体、フォント、画像、表の罫線は含まれません。表の値は行として出力されます。

  • 段組みのページ:新聞や雑誌のようなレイアウトでは、段の読み取り順が想定と異なる場合があります。

  • スキャンした文書:選択できるテキストがまったく見つからない場合は、トルコ語・英語のOCRでページの読み取りを試みます。日本語のスキャン文書は読み取れない点にご注意ください。スキャン文書にはPDF OCRツールをおすすめします。

  • サイズ上限:1ファイルあたり25MBまで。

05

プライバシーと自動削除

ファイルは暗号化されたHTTPS通信でサーバーに送信されます。アップロードされた元のファイルは、処理が終わるとすぐに削除されます。作成されたファイルはダウンロードのために短時間だけ保存され、毎分実行される自動クリーンアップ処理によって、10分以上経過したファイルが完全に削除されます。結果ファイルは準備ができたらすぐにダウンロードすることをおすすめします。

ダウンロードリンクは、処理を開始したユーザーまたはブラウザセッションでのみ有効で、ファイルが他のユーザーと共有されることはありません。処理ログに記録されるのはファイル名、サイズ、処理の種類などの情報のみで、ファイルそのものは保存されません。

詳しくはプライバシーポリシーをご覧ください

06

よくある質問

日本語などの文字は文字化けしませんか?

しません。テキストはUTF-8で保存されるため、日本語やアクセント付きの文字もそのまま保たれます。古いエディターで正しく表示されない場合は、文字コードにUTF-8を指定して開いてください。

スキャンしたPDFからテキストを取り出せますか?

選択できるテキストがまったくない場合は、OCRによる認識を試みます(トルコ語・英語のみ対応で、日本語は認識できません)。スキャン文書で最良の結果を得るには、PDF OCRツールをご利用ください。

ページの区切りは残りますか?

はい。各ページのテキストは「=== ページ 1 ===」のような見出しで区切られるため、どのページの文章かがすぐにわかります。

表や画像はどうなりますか?

画像はTXTファイルに含まれません。表の文字は行ごとに書き出されます。表の構造を保ちたい場合は、PDF Excel変換ツールをご利用ください。

TXTファイルはどのソフトで開けますか?

Windowsならメモ帳、macOSならテキストエディット、そのほか任意のコードエディターで開けます。スマホのファイル管理アプリでも表示できます。

ファイルは保存されますか?

いいえ。元のPDFは処理完了後に削除され、TXTファイルも数分以内にサーバーから自動で削除されます。