実際の利用を再現した元の文書と、「検索可能なPDF」による処理後の文書の状態または出力ファイルを比較しています。
ビフォー・アフターの「アフター」
ビフォー
画像から検索可能なPDFへ

検索可能な PDF メーカー — スキャンと写真に OCR テキスト レイヤーを追加

Ctrl-F を押してもスキャンした文書には何も見つからないため、40 ページすべてを読んで 1 行を探します。 OCR テキスト レイヤーを追加すると、スキャンが検索可能になります。

  • ページごとに読み取るのではなく、スキャン内の任意の行を検索します
  • すべてのページはスキャンしたとおりに表示されたままになります
  • 画像ページ最大20枚 · 各8 MBまで

受け付けるのは画像ファイルで、既存のPDF文書は対象外です

PDFに何をさせますか?

画像をアップロード

スキャンや写真を順番にドロップすると、各ページに検索可能なテキストレイヤーを追加します

複数選択可。各画像がPDFの1ページになります

検索可能なPDF でできること

始める前に、主な機能を確認してください。

  • スキャンした PDF を検索および選択可能にする
  • 画像 PDF に非表示の OCR テキスト レイヤーを追加する
  • スキャンしたページからテキストをコピーしてハイライト表示する
  • スキャンした文書内の単語を検索する
  • 写真撮影したドキュメントを検索可能なファイルに変換する
  • 選択した言語でテキストを認識します

設定リファレンス

検索可能なPDF で使用可能なコントロール。

モード

PDFに何をさせますか?プリセット
画像を文字認識せずに通常のPDFページへ配置するか、画像を見えるまま保ちつつ、検索・選択・コピーができるようにOCRのテキストレイヤーを追加します。オプション: 通常のPDFを作成テキストを検索可能にする
文書言語ドロップダウン
検索可能なテキストレイヤーを追加する際に、文書の認識エンジンで使う言語を選びます。初期設定では英語が選択されています。オプション: 日本語 Englishフランス語ドイツ人スペイン語イタリアポルトガル語オランダ語ロシア人日本語 English韓国人中国語(簡体)中国語(繁体)ログインヒンディー語ベンガル語プンジャビウルドゥーベトナムタイポーランドスウェーデン語デンマーク語ノルウェー語フィンランド語トルコ語ウクライナ語インドネシア語タミル語テルグ語マラーティー語ネパール語ペルシア語ギリシャ語ヘブライ語

ページ

PDF ページ(ドラッグまたは矢印で並べ替え)ワンクリック
ページの行をドラッグするか、上下の矢印ボタンを使って、完成するPDFに画像が並ぶ順序を設定します。

出力

用紙サイズプリセット
ページの形式を選びます。印刷用の標準的な A4 または Letter サイズの用紙か、PDF の各ページを画像とぴったり同じ大きさにする「画像のフィット」から選べます。オプション: A4手紙画像のフィット
向きプリセット
A4またはLetterのページを、写真の撮影方向に合わせて縦向き・横向きに設定します。「用紙サイズ」が「画像に合わせる」のときは使用できません。オプション: 縦向き横向き
余白スライダーレンジ: 0–40mm · デフォルト: 10mm
ページ上の各画像の周囲に余白を追加します。0 mm(余白なし)から 40 mm まで指定でき、用紙サイズが「画像のフィット」のときは無効になります。
出力ファイル名テキスト入力
ブラウザがダウンロードするPDFのファイル名です。初期値はcombined.pdfで、複数の書類を作るときに、書き出しごとに名前を付けられます。
無料で利用可能 · 登録不要 · 透かしなしアップロードは転送中に暗号化されます保持ポリシーに基づいて削除されました

よくある質問

通常の画像PDFは、.pdfコンテナで包まれた平坦な画像にすぎず、その中のテキストを選択・コピー・検索することはできません。検索可能なPDFには、目に見えるすべての文字の背後に位置を合わせた透明なOCRテキストレイヤーがあるため、Ctrl+Fで単語を見つけられ、コピーも機能し、スクリーンリーダーがページを読み上げられる一方で、見た目はまったく同じに保たれます。

usage

OCRエンジンはすべての単語を読み取り、そのテキストとバウンディングボックスを元画像の背後に正確なピクセル座標で保存します。見た目は元のスキャンとまったく同じですが、Adobe Acrobat、Preview、Chromeをはじめとするあらゆる最新のPDFビューアで、まるでネイティブのデジタルテキストのようにテキストの選択、検索、コピーができるようになります。

technical

はい。テキスト レイヤーは標準 PDF (独自の拡張子なし) であるため、Adobe Acrobat (Reader および Pro)、macOS プレビュー、Chrome の組み込み PDF ビューアー、Firefox、Edge、およびファイル アプリ、ドライブ、Dropbox などのモバイル リーダーはすべて、インデックスを付けて検索します。 Ctrl+F または Cmd+F は、スキャンされた長いレポートでも単語を検索します。

features

はい。複数の言語コード(例えばeng+chi_sim+hin)を指定すると、OCRは文字を読み取る際にそのすべてを考慮します。二言語併記のメニュー、国際契約書、行政の書類のような複数文字種が混在する文書もきれいに処理できます。最良の結果を得るには、最も可能性の高い言語をリストの先頭に置いてください。

features

テキストレイヤーは通常、PDFサイズを5〜15%増やします。多くの場合、100ページあたり数百キロバイト程度です。得られるメリット(文書アーカイブ全体での全文検索)に比べれば、わずかな代償です。メールでサイズが気になる場合は、結果をPDF圧縮ツールに通して、埋め込まれた大きな画像をさらに削減してください。

technical

アップロードは一時作業フォルダーで処理され、セキュリティ ポリシーに従って削除されます。共有リンクを明示的に作成した場合、そのリンクを持つ誰もが最大 30 日間結果にアクセスできます。機密文書を処理する前に、セキュリティ ポリシーと組織の要件を確認してください。

privacy

このツールは画像ファイル(JPG、PNG、TIFF、スキャン、写真)を読み取り、検索可能なPDFを返します。すでに複数ページのスキャンPDFをお持ちの場合は、まずPDF to Imagesツールでページごとの画像に分割し、それらの画像をここにドロップすれば、検索可能でOCR済みの1つのPDFが得られます。

usage

JPG、PNG、WEBP、GIF、TIFF、BMPをアップロード — スマホ写真、フラットベッドスキャン、スクリーンショットのいずれも使えます。OCRエンジンがテキストを読み取り、画像の背後に見えない層として埋め込むので、できあがるのはどのビューアーでも開ける通常の検索可能なPDFです。

features

検索可能な PDF には、スキャン上に単語ごとに配置された非表示のテキスト レイヤーが必要です。そのレイヤーを作成できるのはエンジン 1 とエンジン 2 だけです。アプリ内の他の場所で使用されている「デフォルト」エンジンは作成できません。エンジン 1 は最も幅広い言語をサポートしています。エンジン 2 は、様式化されたスキャンや低品質のスキャンでより良い結果を得ることができます。

technical

設定内の言語ピッカーを開き、文書の言語(デフォルトは英語)を選択してください。これはOCR精度にとって最も重要な設定です。エンジンの文字認識は言語ごとに異なるためです。変更後に「変換を再実行」をクリックすると、新しいテキストレイヤーでPDFが再構築されます。

usage

対応言語の幅広さから「エンジン1」を選び、言語ピッカーを契約書の主要言語に設定してください。検索したときに第2言語の重要なセクションがまだ一致しない場合は、2回目の処理で「エンジン2」または第2言語を選んで変換をやり直してください。

tips

自動的に更新されます。「エンジン」や「言語」のドロップダウンを切り替えると、アップロードした画像がただちに再処理され、クリック不要で新しい設定の検索可能なPDFが再構築されます。「変換を再実行」ボタンは主に、まったく同じ設定でもう一度やり直す際に役立ちます。たとえば変換の失敗や一時的なネットワーク切断の後などです。

technical

Ctrl+Fで何もヒットしない場合、そのPDFはほぼ間違いなくスキャンデータです — ページの中身は画像であり、下にテキストが存在しません。このPDF検索可能化ツールにファイルを通せば、OCRが全ページを読み取って目に見えないテキスト層を追加するため、どのビューアーでも検索・ハイライト・コピー&ペーストが使えるようになります。見た目のページはピクセル単位でそのまま変わりません。

technical

Acrobat やソフトウェアのインストールは必要ありません。無料枠内で、アカウントを作成せずにスキャンをアップロードし、検索可能な結果を​​プレビューし、標準 PDF をダウンロードします。出力は任意の PDF ビューアで開きます。

pricing

ほとんどの場合、原因は次の3つのいずれかです。ファイルが無料プランのアップロード上限11 MB を超えています。Premium では50 MB、Pro では120 MB まで対応しています。または、このツールが対応していない形式です。アップロード欄に表示される対応形式をご確認ください。あるいは、実際のファイル形式がファイル名に示された形式と異なります。名前を変更してもファイルの中身は変わらないため、見た目は有効な PDF でも拒否されることがあります。

troubleshooting

PDF には、ワード プロセッサが動作する段落やスタイルではなく、すべての文字がページ上のどこに配置されているかが保存されるため、変換とはその構造を推論によって再構築することを意味します。複雑な列、表、画像の周囲に巻き付けられたテキストは、画像が漂っている場所です。編集可能性よりも外観が重要な場合は、ビジュアル モードを選択します。入力する必要がある場合は、編集可能モードを選択して、奇妙な見出しを修正してください。

troubleshooting

いいえ。アカウントがなくても Searchable PDF を実行して無料の結果をダウンロードでき、ウォーターマークもありません。プレミアムは、制限が厳しくなり始めたときに購入するものです。大容量のアップロード、1 日の上限なし、元の解像度の結果が得られます。ダウンロードのステップでは、開始する前には表示されなかったものは何も表示されません。

pricing

いいえ。Searchable PDF はデスクトップとスマートフォンのブラウザで使えます。インストール、トライアル開始、ライセンス購入は不要です。必要な機能かどうかは、サンプルではなく実際に困っているファイルでお試しください。

troubleshooting

検索可能なPDFでできること

ビジネス、クリエイター、日常業務など、実際の問題を毎日解決します。自分に合ったユースケースを見つけて始めましょう。

ビジネス向け

検索可能な法的文書アーカイブ

法律事務所は、スキャンした契約書、証言録取書、証拠開示文書に OCR テキスト レイヤーを追加して、パラリーガルが訴訟中に数千ページにわたって Ctrl+F を使用できるようにします。

ビジネス向け

人事・人事ファイルの保管庫

人事チームが、スキャンした社員ファイル、内定通知書、署名済み契約書を検索可能なPDFに変換できます。権限を持つ人なら誰でも、全文検索ですばやく見つけられます。

学歴

研究者の参考文献ライブラリ

研究者や大学院生は、スキャンした学術論文や図書館のコピーを検索可能なPDFに変換することで、文献レビューの際に引用や出典を瞬時に見つけられます。

個人利用

検索可能なレシピ・料理本アーカイブ

家庭料理人は、家族の料理本や古いレシピ雑誌を検索可能な PDF にデジタル化し、材料ごとに検索して、あらゆるチョコレート ケーキのレシピを見つけることができます。

ビジネス向け

特許・商標の調査

知的財産の専門家は、スキャンした特許登録証や商標出願書類を検索可能なPDFに変換し、図版に埋もれた文言も見逃さずに先行技術のキーワードや競合の出願内容を検索します。

ビジネス向け

銀行取引明細の監査証跡

監査人やフォレンジック会計士は、スキャンした銀行取引明細を検索可能な PDF に変換し、何年分もの記録を通じて特定の支払先、金額、日付を検索できるようにしています。

ビジネス向け

税務書類のアーカイブ

個人や小規模事業者は、スキャンした確定申告書、領収書、1099フォームを検索可能なPDFに変換できます。IRS、CRA、HMRCに受理され、自分でも監査できる形式です。

個人利用

検索可能なスキャン書籍

愛好家や図書館員、製本職人は、スキャンした絶版本を電子書籍のように使える検索可能なPDFに変換できます。テキストは選択・コピーが可能で、電子書籍リーダーでインデックス化されます。

公式文書

行政・公文書のデジタル化

市の書記官や自治体アーカイブは、スキャンした許可証や土地登記、戸籍記録にOCRテキストレイヤーを追加します。これにより職員や市民は、箱を1つずつめくる代わりにCtrl+Fで特定の区画や氏名、整理番号を見つけられます。

不動産

不動産権利証&クロージング書類のアーカイブ

権原保険会社や仲介業者は、スキャンした権利証書、測量図、クロージング書類一式を検索可能なPDFに変換します。これにより、何年分もの取引にわたる区画番号や購入者名の検索が、書類室へ行く手間の代わりに数秒で済みます。

リサーチ

調査報道のための文書検索

記者は、リークされた、または情報公開法(FOIA)で入手したスキャン文書を検索可能なPDFに変換して、記事を組み立てながら数千ページの中から名前、日付、金額をgrep検索できます。

開発者向け

施設・エンジニアリングの竣工図アーカイブ

施設管理者やエンジニアリングチームは、スキャンした竣工図、設計図、設備マニュアルに OCR テキストレイヤーを追加します。これにより、何十年分もの建物記録から部品番号、部屋名、型番を検索する作業が、物理的な図面を広げる代わりに数秒で済みます。

変換結果を一つずつ確認

すべての写真はスラッシュをそのまま通過し、反対側が完成して出てきます。