実際の利用を再現した元の文書と、「PDF からテキストへ」による処理後の文書の状態または出力ファイルを比較しています。
ビフォー・アフターの「アフター」
ビフォー
PDF からテキストへ (OCR)

PDF からテキストへのコンバーター - PDF からテキストをオンラインで無料で抽出

PDF はスキャンであるため、何も選択されず、何もコピーされず、検索しても何も見つかりません。とにかくそこからテキストを抽出します — 画像のみの PDF が含まれており、30 以上の言語が含まれています。

  • 選択してもコピーしても何も起こらない、スキャンされた PDF からテキストを取得する
  • 30 以上の言語で画像のみの PDF および文書の写真付き PDF を読み取ります
  • TXT、Markdown、Word、Excel、または CSV としてダウンロード

PDFをアップロード

PDF をドロップします。テキストをコピーするか、.txt としてダウンロードします。

PDF · free up to 20MB, Premium up to 50MB

PDF からテキストへ でできること

始める前に、主な機能を確認してください。

  • コピーアンドペーストでは何も起こらない PDF からテキストを取得する
  • スキャンした PDF または画像のみの PDF からテキストを抽出する
  • 選択をブロックする PDF からコンテンツをコピーする
  • 文書独自の言語でテキストを読む
  • よりきれいな結果を得るために抽出を再実行します
  • メモまたは検索用に編集可能なテキストを取得する

設定リファレンス

PDF からテキストへ で使用可能なコントロール。

処理モードプリセット
1件ずつ処理するか、Premium の一括処理モードに切り替えて複数の入力に同じ設定を適用できます。対応する入力形式はツールによって異なります。オプション: 単一ファイル一括処理

エンジン

エンジンドロップダウン
ファイルを読み取る文字認識エンジンを選びます。「デフォルト」が装飾的なフォントや手書き文字を誤認識する場合は、「エンジン1」または「エンジン2」に切り替えてください — 結果は自動的に更新されます。オプション: デフォルトエンジン1エンジン2
言語ドロップダウン
元の文書の主な言語を選びます。選べる言語は認識エンジンによって異なり、非対応の言語は表示されません。初期設定は英語です。抽出したテキストに認識ミスがないか確認してください。オプション: 日本語 Englishフランス語ドイツ人スペイン語イタリアポルトガル語オランダ語ロシア人日本語 English韓国人中国語(簡体)中国語(繁体)ログインヒンディー語ベンガル語プンジャビウルドゥーベトナムタイポーランドスウェーデン語デンマーク語ノルウェー語フィンランド語トルコ語ウクライナ語インドネシア語タミル語テルグ語マラーティー語ネパール語ペルシア語ギリシャ語ヘブライ語
抽出をやり直すワンクリック
現在の「エンジン」と「言語」の設定で、同じファイルの抽出をもう一度実行します — うまく読み取れなかったときの再試行に便利です。

ダウンロード

ダウンロード形式ドロップダウン
テキスト抽出後の出力形式を選びます。Wordと表計算形式の書き出しは元の文書からファイルを作成します。PDFの表をCSVで書き出す場合は、表ごとのファイルをまとめたZIPになります。オプション: テキスト (.txt)Markdown文書(.md)Word文書(.docx)Excelブック(.xlsx)CSV(表 · .zip)
無料で利用可能 · 登録不要 · 透かしなしアップロードは転送中に暗号化されます保持ポリシーに基づいて削除されました

よくある質問

PDF からテキストへでできること

ビジネス、クリエイター、日常業務など、実際の問題を毎日解決します。自分に合ったユースケースを見つけて始めましょう。

学歴

講義・授業ノートの抽出

学生は、教授から提供された PDF の講義ノートや実習マニュアルからプレーンテキストを抽出し、抜粋を Notion や Obsidian、学習用の暗記カードに貼り付けることができます。

個人利用

一括提出用の履歴書テキスト

求職者はPDF履歴書からプレーンテキストを抽出し、ファイルのアップロードに対応していないATS応募フォーム、LinkedInのEasy Apply、採用ポータルのテキスト欄に貼り付けられます。

ビジネス向け

PDFレポートからメール下書きを作成

アナリストは、長いPDFレポートからエグゼクティブサマリーの部分を抽出し、メールやSlackメッセージ、Teamsのチャットに貼り付けます。これにより関係者が要点をすばやく把握できます。

ビジネス向け

既存のPDFリソースのSEO監査

マーケターは、古いPDFのホワイトペーパーや電子書籍からテキストを抽出し、キーワードの網羅状況を監査したり、コンテンツの不足を特定したり、オーガニック検索向けに新しいブログ記事として再公開したりできます。

ビジネス向け

翻訳ワークフローの準備

翻訳者は、より速く正確なローカライズのために、PDFの原稿からテキストを抽出してから、Trados、MemoQ、DeepL Proといった翻訳メモリツールに貼り付けます。

生産性

長いPDFレポートからのAIプロンプト

パワーユーザーは PDF の研究論文からテキストを抽出し、要約・Q&A・要点抽出のためのコンテキストとして ChatGPT、Claude、Gemini に渡しています。

ビジネス向け

プレーンテキストのバックアップアーカイブ

IT部門や記録管理チームは、PDFのドキュメントアーカイブからプレーンテキストを抽出し、20年後にPDFビューアーに依存しない軽量で将来も使えるバックアップを作成します。

学歴

引用と参考文献リスト

研究者はPDFから参考文献欄をプレーンテキストとして抽出し、各項目を手作業で入力し直すことなくZotero、Mendeley、EndNoteに貼り付けられます。

個人利用

スクリーンリーダー・音声読み上げのアクセス

PDF からきれいなテキストを抽出すれば、スクリーンリーダーで読み上げたり、テキスト読み上げアプリに貼り付けたりできます。視覚に障害のある読者や、長いレポートをハンズフリーで聴きたい場合に便利です。

法律上の

法的電子証拠開示のキーワード検索

パラリーガルはスキャンした証言録取書や証拠開示資料からテキストを抽出し、名前や条項を探して画像のみのPDFをスクロールする代わりに、数千ページにわたって内容を検索できるようにします。

開発者向け

スキャン請求書のデータパイプライン

開発者や運用チームは、スキャンした請求書やレシートからテキストを抽出し、正規表現やLLMベースのパーサーに渡すことで、手作業の再入力の代わりに大量のデータ入力を自動化します。

リサーチ

情報公開請求・リーク文書の調査

調査報道記者は、スキャンした政府発表資料や情報公開請求(FOIA)文書からテキストを抽出し、大量の文書の山を横断して主張を検索・引用・相互参照できます。

変換結果を一つずつ確認

すべての写真はスラッシュをそのまま通過し、反対側が完成して出てきます。