実際の利用を再現した元の文書と、「PDF からテキストへ」による処理後の文書の状態または出力ファイルを比較しています。
ビフォー・アフターの「アフター」
ビフォー
PDF からテキストへ (OCR)

PDF からテキストへのコンバーター - PDF からテキストをオンラインで無料で抽出

PDF はスキャンであるため、何も選択されず、何もコピーされず、検索しても何も見つかりません。とにかくそこからテキストを抽出します — 画像のみの PDF が含まれており、30 以上の言語が含まれています。

  • 選択してもコピーしても何も起こらない、スキャンされた PDF からテキストを取得する
  • 30 以上の言語で画像のみの PDF および文書の写真付き PDF を読み取ります
  • TXT、Markdown、Word、Excel、または CSV としてダウンロード

PDF

PDFをアップロード

PDF をドロップします。テキストをコピーするか、.txt としてダウンロードします。

PDF · free up to 11MB, Premium up to 50MB

PDF からテキストへ でできること

始める前に、主な機能を確認してください。

  • コピーアンドペーストでは何も起こらない PDF からテキストを取得する
  • スキャンした PDF または画像のみの PDF からテキストを抽出する
  • 選択をブロックする PDF からコンテンツをコピーする
  • 文書独自の言語でテキストを読む
  • よりきれいな結果を得るために抽出を再実行します
  • メモまたは検索用に編集可能なテキストを取得する

設定リファレンス

PDF からテキストへ で使用可能なコントロール。

処理モードプリセット
1件ずつ処理するか、Premium の一括処理モードに切り替えて複数の入力に同じ設定を適用できます。対応する入力形式はツールによって異なります。オプション: 単一ファイル一括処理

エンジン

エンジンドロップダウン
ファイルを読み取る文字認識エンジンを選びます。「デフォルト」が装飾的なフォントや手書き文字を誤認識する場合は、「エンジン1」または「エンジン2」に切り替えてください — 結果は自動的に更新されます。オプション: デフォルトエンジン1エンジン2
言語ドロップダウン
元の文書の主な言語を選びます。選べる言語は認識エンジンによって異なり、非対応の言語は表示されません。初期設定は英語です。抽出したテキストに認識ミスがないか確認してください。オプション: 日本語 Englishフランス語ドイツ人スペイン語イタリアポルトガル語オランダ語ロシア人日本語 English韓国人中国語(簡体)中国語(繁体)ログインヒンディー語ベンガル語プンジャビウルドゥーベトナムタイポーランドスウェーデン語デンマーク語ノルウェー語フィンランド語トルコ語ウクライナ語インドネシア語タミル語テルグ語マラーティー語ネパール語ペルシア語ギリシャ語ヘブライ語
抽出をやり直すワンクリック
現在の「エンジン」と「言語」の設定で、同じファイルの抽出をもう一度実行します — うまく読み取れなかったときの再試行に便利です。

ダウンロード

ダウンロード形式ドロップダウン
テキスト抽出後の出力形式を選びます。Wordと表計算形式の書き出しは元の文書からファイルを作成します。PDFの表をCSVで書き出す場合は、表ごとのファイルをまとめたZIPになります。オプション: テキスト (.txt)Markdown文書(.md)Word文書(.docx)Excelブック(.xlsx)CSV(表 · .zip)
無料で利用可能 · 登録不要 · 透かしなしアップロードは転送中に暗号化されます保持ポリシーに基づいて削除されました

よくある質問

PDFをアップロードすると、ツールが本物のテキストレイヤーを含むのか、それともスキャンされた画像だけなのかを検出します。テキストレイヤーを持つPDFはその場で書き出されます。画像のみのPDF(スキャンした書籍、撮影したレシート、古いレポート)は自動的にOCRを通ります。どちらの場合も、段落、改行、セクションの間隔が保たれたきれいな.txtファイルが得られます。

usage

はい。PDFが画像のみの場合(スキャン、撮影したページ、ファックスの書き出しによく見られます)、OCRエンジンが自動的に作動するので、別のツールは必要ありません。多言語対応が組み込まれているため、二言語混在の文書やラテン文字以外の文字(中国語、アラビア語、ヒンディー語)でも、同じ処理の中で一度に抽出されます。

features

段落の区切り、セクション間の空行、箇条書きの記号、番号付きリストの接頭番号は、プレーンテキストとして保持されます。見出しは、元のフォントに応じて大文字、または元の大文字・小文字のまま出力されます。視覚的な強調(太字、斜体)はプレーンテキストには記録されません。それが必要な場合は、代わりに PDF から Word への変換ツールをご利用ください。

technical

はい。アップロード後に表示される入力欄でパスワードを入力すると、ツールはテキストを抽出するのに必要な間だけメモリ上でファイルのロックを解除します。パスワードがディスクに保存されたり、第三者のサービスに送信されたりすることは一切ありません。パスワードのないロック済みPDFは処理できません。セキュリティ上の理由から、パスワードの解読は一切行いません。

features

変換の信頼性を保つため、ページ数とファイルサイズの両方に上限があります。無料プランは30ページと11 MB、Premium は200ページと50 MB、Pro は500ページと120 MB、Enterprise は1000ページまで対応します。大きな文書は PDF 分割ツールで分け、各部分を個別に処理してください。

technical

処理は安全なサーバーで行われ、ファイルは当社のセキュリティ ポリシーに基づいて削除されます。結果を明示的に共有しない限り、その結果はパブリック リンクに保持され、その結果を持っている人は最大 30 日間開くことができます。 .txt 出力はあなたのものです。透かし、帰属、追跡はありません。研究者、ジャーナリスト、弁護士、学生は、ソース PDF がその期間を超えて保持されないことを認識しながら、このツールを使用して機密レポートからテキストを抽出します。

privacy

はい。エンジンパネルを開いて文書の言語とOCRエンジンを選ぶと、その文字体系でページが読み取られます — 非ラテン文字や右から左に書く言語を含め、100以上の言語に対応しています。最初の読み取りでアクセント付き文字や英語以外の文字が誤読された場合は、言語を切り替えて「抽出を再実行」をタップしてください。

usage

整形ビューはページ本来のレイアウト(段組み・間隔・行位置)をそのまま保つので、表やレシートに最適です。プレーンビューは整理して流し込んだクリーンなテキストになり、ドキュメントやチャットボットへの貼り付けが簡単です。両者を切り替えて、テキストをコピーするか .txt ファイルとしてダウンロードできます。

features

このツールは、コピーや.txt保存ができる生テキストを返します。元のPDFはそのまま残しつつCtrl+Fで検索できるようにしたい場合は、Image to Searchable PDFツールに通してください。スキャンの上に見えないOCRテキスト層を追加するので、ページの見た目はそのままで、文字が選択可能になります。

tips

一般的なラテン文字系の言語なら、まずはデフォルトと文書の言語で始めてください。日常的なテキストなら高速で正確です。出力が文字化けしたり、非ラテン文字(アラビア語・ヒンディー語・中国語・キリル文字)だったりする場合は、Engine 1またはEngine 2に切り替え、選択画面で該当言語を選んで「抽出を再実行」をタップします。エンジンによって得意な文字体系が異なるため、両方試しても数秒で済みます。

tips

出力ボックスは完全に編集可能なので、OCRの誤りを画面上ですばやく修正したり、一部を削ったりできます。「クリップボードにコピー」は、編集した内容も含めて、現在ボックスに入っているものをそのままコピーします。ただし「.txtをダウンロード」は、画面上の編集ではなく、最後のエンジン/言語での実行によって生成された元のファイルを保存します。修正を残すには、「コピー」を使ってご自分の.txtファイルに貼り付けるか、誤りが体系的なものであれば、手作業で編集する代わりに言語やエンジンを切り替えて「抽出を再実行」をタップしてください。

features

PDFをアップロードすると、抽出ツールがテキストを取り出します — スキャンされたページや画像のみのページには自動的にOCRが実行されます — 結果はプレーンな.txtファイルとしてダウンロードできます。このファイルはメモ帳やテキストエディット、任意のコードエディタで特別なソフトなしに開けます。書式や画像なしで、コピーしてすぐ使える生のテキストだけが欲しいときは、シンプルなpdfからメモ帳への変換ツールとして使えます。

usage

はい — アカウントを作成せずに PDF テキストを変換、プレビュー、ダウンロードします。無料枠には、スキャンされた PDF の OCR、フォーマットされたビューとプレーン ビュー、および .txt のダウンロードが含まれます。プレミアムでは、対象となる 1 日あたりの制限が削除されます。

pricing

はい — Pixoate はバッチ処理と一括処理をサポートしています。バッチ モードに切り替え、プレミアムでは最大 60 個、プロでは最大 200 個の PDF を追加し、オプションを一度設定すると、単一の ZIP をダウンロードする前にすべての PDF が同じ設定で処理されます。一括処理はプレミアム機能です。出力にはシングル モードと同じ品質と設定が使用されます。

features

はい。一括処理では設定を 1 回行うだけで、バッチ内のすべてのアイテムに適用されます (Premium では最大 60 PDF、Pro では 200 PDF)。項目ごとに設定を繰り返す必要はなく、アップロードおよび生成された一時ファイルは安全に処理され、自動的に削除されます。

usage

ほとんどの場合、原因は次の3つのいずれかです。ファイルが無料プランのアップロード上限11 MB を超えています。Premium では50 MB、Pro では120 MB まで対応しています。または、このツールが対応していない形式です。アップロード欄に表示される対応形式をご確認ください。あるいは、実際のファイル形式がファイル名に示された形式と異なります。名前を変更してもファイルの中身は変わらないため、見た目は有効な PDF でも拒否されることがあります。

troubleshooting

PDF には、ワード プロセッサが動作する段落やスタイルではなく、すべての文字がページ上のどこに配置されているかが保存されるため、変換とはその構造を推論によって再構築することを意味します。複雑な列、表、画像の周囲に巻き付けられたテキストは、画像が漂っている場所です。編集可能性よりも外観が重要な場合は、ビジュアル モードを選択します。入力する必要がある場合は、編集可能モードを選択して、奇妙な見出しを修正してください。

troubleshooting

いいえ。アカウントなしで PDF to Text を実行し、無料の結果をダウンロードできます。また、ウォーターマークもありません。プレミアムは、制限が厳しくなり始めたときに購入するものです。1 回のバッチで最大 60 ファイル、より大きなアップロード、1 日の上限なし、元の解像度の結果が得られます。ダウンロードのステップでは、開始する前には表示されなかったものは何も表示されません。

pricing

いいえ。PDF へ テキスト はデスクトップとスマートフォンのブラウザで使えます。インストール、トライアル開始、ライセンス購入は不要です。必要な機能かどうかは、サンプルではなく実際に困っているファイルでお試しください。

troubleshooting

PDF からテキストへでできること

ビジネス、クリエイター、日常業務など、実際の問題を毎日解決します。自分に合ったユースケースを見つけて始めましょう。

学歴

講義・授業ノートの抽出

学生は、教授から提供された PDF の講義ノートや実習マニュアルからプレーンテキストを抽出し、抜粋を Notion や Obsidian、学習用の暗記カードに貼り付けることができます。

個人利用

一括提出用の履歴書テキスト

求職者はPDF履歴書からプレーンテキストを抽出し、ファイルのアップロードに対応していないATS応募フォーム、LinkedInのEasy Apply、採用ポータルのテキスト欄に貼り付けられます。

ビジネス向け

PDFレポートからメール下書きを作成

アナリストは、長いPDFレポートからエグゼクティブサマリーの部分を抽出し、メールやSlackメッセージ、Teamsのチャットに貼り付けます。これにより関係者が要点をすばやく把握できます。

ビジネス向け

既存のPDFリソースのSEO監査

マーケターは、古いPDFのホワイトペーパーや電子書籍からテキストを抽出し、キーワードの網羅状況を監査したり、コンテンツの不足を特定したり、オーガニック検索向けに新しいブログ記事として再公開したりできます。

ビジネス向け

翻訳ワークフローの準備

翻訳者は、より速く正確なローカライズのために、PDFの原稿からテキストを抽出してから、Trados、MemoQ、DeepL Proといった翻訳メモリツールに貼り付けます。

生産性

長いPDFレポートからのAIプロンプト

パワーユーザーは PDF の研究論文からテキストを抽出し、要約・Q&A・要点抽出のためのコンテキストとして ChatGPT、Claude、Gemini に渡しています。

ビジネス向け

プレーンテキストのバックアップアーカイブ

IT部門や記録管理チームは、PDFのドキュメントアーカイブからプレーンテキストを抽出し、20年後にPDFビューアーに依存しない軽量で将来も使えるバックアップを作成します。

学歴

引用と参考文献リスト

研究者はPDFから参考文献欄をプレーンテキストとして抽出し、各項目を手作業で入力し直すことなくZotero、Mendeley、EndNoteに貼り付けられます。

個人利用

スクリーンリーダー・音声読み上げのアクセス

PDF からきれいなテキストを抽出すれば、スクリーンリーダーで読み上げたり、テキスト読み上げアプリに貼り付けたりできます。視覚に障害のある読者や、長いレポートをハンズフリーで聴きたい場合に便利です。

法律上の

法的電子証拠開示のキーワード検索

パラリーガルはスキャンした証言録取書や証拠開示資料からテキストを抽出し、名前や条項を探して画像のみのPDFをスクロールする代わりに、数千ページにわたって内容を検索できるようにします。

開発者向け

スキャン請求書のデータパイプライン

開発者や運用チームは、スキャンした請求書やレシートからテキストを抽出し、正規表現やLLMベースのパーサーに渡すことで、手作業の再入力の代わりに大量のデータ入力を自動化します。

リサーチ

情報公開請求・リーク文書の調査

調査報道記者は、スキャンした政府発表資料や情報公開請求(FOIA)文書からテキストを抽出し、大量の文書の山を横断して主張を検索・引用・相互参照できます。

変換結果を一つずつ確認

すべての写真はスラッシュをそのまま通過し、反対側が完成して出てきます。