Реалистичный исходный документ, а затем фактическое состояние документа или выходной файл после использования инструмента «PDF с поиском».
После
До
Изображения в PDF с поиском

PDF Maker с возможностью поиска — добавьте текстовый слой OCR к сканам и фотографиям

Ctrl-F ничего не находит в отсканированном документе, поэтому вы читаете все 40 страниц в поисках одной строки. Добавьте текстовый слой OCR, и отсканированное изображение станет доступным для поиска.

  • Найдите любую строку на скане вместо того, чтобы читать ее страницу за страницей.
  • Каждая страница остается видимой точно так же, как отсканированная.
  • До 20 страниц-изображений · 8 МБ каждая

Принимает файлы изображений, а не готовые документы PDF

Что должен делать PDF?

Загрузить изображения

Загрузите сканы или фото по порядку — добавьте на каждую страницу текстовый слой с возможностью поиска

Выберите несколько — каждое изображение станет страницей PDF

Что можно сделать с помощью PDF с поиском

Прежде чем начать, ознакомьтесь с основными возможностями.

  • Делайте отсканированные PDF доступными для поиска и выделения текста
  • Добавьте скрытый текстовый слой OCR в PDF с изображениями
  • Копируйте и выделяйте текст на отсканированных страницах
  • Найдите любое слово внутри отсканированного документа
  • Превращайте сфотографированные документы в файлы с возможностью поиска
  • Распознавайте текст на выбранном языке

Справочник по настройкам

Доступные элементы управления для PDF с поиском.

Режим

Что должен делать PDF?Пресеты
Помещает изображения на обычные страницы PDF без распознавания или оставляет их видимыми и добавляет текстовый слой OCR для поиска, выделения и копирования.Параметры: Создать обычный PDFСделать текст доступным для поиска
Язык документаВыпадающий список
Выберите язык, который модуль распознавания использует при добавлении текстового слоя с поиском. Изначально выбран английский.Параметры: АнглийскийФранцузскийНемецкийИспанскийИтальянскийПортугальскийНидерландскийРусскийЯпонскийКорейскийКитайский (упрощённый)Китайский (традиционный)АрабскийХиндиБенгальскийПанджабиУрдуВьетнамскийТайскийПольскийШведскийДатскийНорвежскийФинскийТурецкийУкраинскийИндонезийскийТамильскийТелугуМаратхиНепальскийПерсидскийГреческийИврит

Страницы

Страницы PDF (перетащите или используйте стрелки для изменения порядка)В один клик
Перетаскивайте строки страниц или используйте кнопки со стрелками вверх и вниз, чтобы задать порядок изображений в готовом PDF.

Результат

Размер бумагиПресеты
Задаёт формат страницы: стандартные листы A4 или Letter для печати либо «Вписывание изображения», чтобы каждая страница PDF точно совпадала со своим изображением.Параметры: A4Опция — LetterВписывание изображения
ОриентацияПресеты
Ставит страницы A4 или Letter вертикально или горизонтально — так, как снято большинство ваших фотографий; недоступно, когда для размера бумаги выбрано «Вписывание изображения».Параметры: ПортретнаяАльбомная
ПоляСлайдерДиапазон: 0–40mm · По умолчанию: 10mm
Добавляет вокруг каждого изображения на странице пустое поле — от 0 мм (край в край) до 40 мм; недоступно, если для размера бумаги выбрано «Вписывание изображения».
Имя выходного файлаТекстовое поле
Задаёт имя PDF-файла, который скачает браузер; по умолчанию combined.pdf — удобно подписывать каждый экспорт, когда вы собираете несколько документов.
Бесплатно · Без регистрации · Без водяного знакаПередача загружаемых файлов зашифрованаУдалено согласно политике хранения данных

Часто задаваемые вопросы

Обычный PDF-изображение — это плоская картинка, обёрнутая в контейнер .pdf: текст в ней нельзя выделить, скопировать или найти. PDF с возможностью поиска имеет невидимый текстовый слой OCR, выровненный за каждым видимым символом, поэтому Ctrl+F находит слова, копирование работает, а программы чтения с экрана могут озвучивать страницу — при этом внешний вид остаётся неизменным.

usage

Движок OCR считывает каждое слово и сохраняет его текст и ограничивающую рамку поверх исходного изображения с точными пиксельными координатами. Визуально страница выглядит так же, как оригинальный скан, но Adobe Acrobat, Preview, Chrome и любая современная программа просмотра PDF теперь могут выделять, искать и копировать текст так, словно это исходный цифровой текст.

technical

Да. Текстовый слой представляет собой стандартный PDF-файл (без собственного расширения), поэтому Adobe Acrobat (Reader и Pro), macOS Preview, встроенная программа просмотра PDF-файлов Chrome, Firefox, Edge и мобильные программы чтения, такие как приложение «Файлы», Drive и Dropbox, индексируют и выполняют поиск по нему. Ctrl+F или Cmd+F находит слова даже в длинных просматриваемых отчетах.

features

Да. Передайте несколько кодов языков (например, eng+chi_sim+hin), и OCR учтёт все их при распознавании символов. Документы со смешанными письменностями — двуязычные меню, международные договоры и государственные формы — обрабатываются корректно. Для лучшего результата укажите наиболее вероятный язык первым в списке.

features

Текстовый слой обычно добавляет 5–15% к размеру PDF — как правило, несколько сотен килобайт на 100 страниц. По сравнению с преимуществом (полнотекстовый поиск по всему архиву документов) это небольшая цена. Если размер важен для отправки по почте, пропустите результат через инструмент сжатия PDF, чтобы дополнительно уменьшить крупные встроенные изображения.

technical

Загруженные файлы обрабатываются во временной рабочей папке и удаляются в соответствии с нашей политикой безопасности. Если вы явно создадите ссылку для общего доступа, любой, у кого есть эта ссылка, сможет получить доступ к результату на срок до 30 дней. Прежде чем обрабатывать конфиденциальные документы, ознакомьтесь с политикой безопасности и требованиями вашей организации.

privacy

Этот инструмент читает файлы изображений (JPG, PNG, TIFF, сканы и фото) и возвращает PDF с возможностью поиска. Если у вас уже есть многостраничный отсканированный PDF, сначала разбейте его на изображения страниц с помощью инструмента «PDF в изображения», затем загрузите эти изображения сюда, чтобы получить один PDF с распознанным текстом и возможностью поиска.

usage

Загрузите JPG, PNG, WEBP, GIF, TIFF или BMP — подойдут фото с телефона, планшетные сканы и скриншоты. Движок OCR считывает текст и помещает его в невидимый слой за изображением, так что получается обычный PDF с возможностью поиска, который открывается в любом просмотрщике.

features

Для PDF с возможностью поиска нужен невидимый текстовый слой, размещённый слово в слово поверх скана, и только Engine 1 и Engine 2 умеют создавать такой слой — движок «По умолчанию», используемый в остальных частях приложения, этого не может. Engine 1 поддерживает больше всего языков; Engine 2 может показывать лучший результат на стилизованных или низкокачественных сканах.

technical

Откройте выбор языка в «Настройках» и выберите язык документа (по умолчанию английский) — это единственная самая важная настройка для точности OCR, поскольку распознавание символов движком зависит от языка. Нажмите «Повторить конвертацию» после её изменения, чтобы пересобрать PDF с новым текстовым слоем.

usage

Выберите Engine 1 за его более широкий охват языков и задайте в списке языков основной язык договора. Если ключевые разделы на втором языке всё равно не находятся при поиске, повторно запустите преобразование с Engine 2 или с выбранным дополнительным языком во втором проходе.

tips

Он обновляется автоматически — переключение списка «Движок» или «Язык» сразу же заново обрабатывает загруженное изображение и пересобирает PDF с поиском по тексту с новой настройкой, без необходимости нажатия. Кнопка «Повторить преобразование» полезна в основном для повторной попытки с теми же настройками, например после неудачного преобразования или кратковременного сбоя сети.

technical

Если Ctrl+F ничего не находит, PDF почти наверняка представляет собой скан — страницы являются изображениями без текста под ними. Пропустите файл через этот конвертер в PDF с возможностью поиска: OCR считывает каждую страницу и добавляет невидимый текстовый слой, благодаря чему поиск, выделение и копирование текста начинают работать в любой программе для просмотра. Видимые страницы остаются пиксель в пиксель такими же.

technical

Вам не нужен Acrobat или установленное программное обеспечение. Загрузите отсканированное изображение, просмотрите результат поиска и загрузите стандартный PDF-файл без создания учетной записи в рамках бесплатного лимита. Вывод открывается в любой программе просмотра PDF.

pricing

Почти всегда причина одна из трёх. Файл превышает бесплатный лимит загрузки 11 МБ: Premium принимает до 50 МБ, а Pro — до 120 МБ. Либо инструмент не поддерживает этот формат — проверьте список на панели загрузки. Либо фактический формат не соответствует расширению: переименование не меняет содержимое файла, поэтому даже внешне корректный PDF может быть отклонён.

troubleshooting

В PDF-файле хранится расположение каждого символа на странице, а не абзацы и стили, в которых работает текстовый процессор, поэтому преобразование означает перестройку этой структуры путем вывода. Сложные столбцы, таблицы и текст, обернутый вокруг изображений, — вот куда он смещается. Если внешний вид важнее возможности редактирования, выберите визуальный режим; если вам нужно ввести его, выберите редактируемый режим и ожидайте исправления нечетного заголовка.

troubleshooting

Нет. Вы можете запустить PDF с возможностью поиска и загрузить бесплатный результат без учетной записи, и он не имеет водяных знаков. Премиум — это то, что вы покупаете, когда ограничения начинают кусаться: большие загрузки, отсутствие дневного ограничения и результат с исходным разрешением. На этапе загрузки не отображается ничего, что не было бы видно до начала.

pricing

Нет — Поисковая система PDF работает в браузере на компьютере и телефоне. Ничего не нужно устанавливать, нет пробного периода и лицензии, которую нужно покупать, прежде чем вы сможете увидеть, выполняет ли она то, что вам нужно. Попробуйте её на файле, с которым вы действительно застряли, а не на образце.

troubleshooting

Как PDF с поиском помогает вам справиться с задачей

Реальные проблемы, которые он решает каждый день — для бизнеса, авторов и повседневных задач. Найдите вариант использования, который подходит вам, и начните.

Для бизнеса

Архивы юридических документов с поиском

Юридические фирмы добавляют текстовые слои OCR к отсканированным контрактам, показаниям и документам, чтобы помощники юристов могли просматривать тысячи страниц во время судебного процесса, нажимая Ctrl+F.

Для бизнеса

Хранилища HR- и кадровых документов

HR-команды конвертируют отсканированные личные дела сотрудников, офферы и подписанные договоры в PDF с поиском, которые любой сотрудник с доступом может быстро найти по полнотекстовому поиску.

Образование

Справочная библиотека исследователя

Учёные и аспиранты превращают отсканированные журнальные статьи и библиотечные ксерокопии в PDF с возможностью поиска, чтобы цитаты и ссылки мгновенно находились при обзоре литературы.

Для личного использования

Архивы рецептов и кулинарных книг с поиском

Домашние повара оцифровывают семейные кулинарные книги и старые журналы рецептов в PDF-файлы с возможностью поиска, которые они могут запрашивать по ингредиентам — найдите каждый рецепт шоколадного торта.

Для бизнеса

Поиск патентов и товарных знаков

Специалисты по интеллектуальной собственности конвертируют отсканированные патенты и заявки на товарные знаки в PDF с возможностью поиска, чтобы искать ключевые слова предшествующего уровня техники и заявки конкурентов, не упуская формулировки, скрытые в иллюстрациях.

Для бизнеса

Аудиторский след по банковским выпискам

Аудиторы и судебные бухгалтеры преобразуют отсканированные банковские выписки в PDF с возможностью поиска, чтобы находить конкретных получателей, суммы и даты в записях за многие годы.

Для бизнеса

Архивы налоговых документов

Частные лица и малый бизнес превращают сканы налоговых деклараций, чеков и форм 1099 в PDF с поиском по тексту, которые примут IRS, CRA или HMRC и которые вы сможете проверить самостоятельно.

Для личного использования

Отсканированные книги с поиском

Любители, библиотекари и переплётчики превращают отсканированные книги, снятые с печати, в PDF с возможностью поиска, которые работают как электронные книги: текст можно выделять, копировать, а электронные читалки его индексируют.

Официальные документы

Оцифровка государственных и публичных документов

Городские секретари и муниципальные архивы добавляют текстовые слои OCR к отсканированным разрешениям, земельным и актовым записям, чтобы сотрудники и граждане могли найти конкретный участок, имя или номер дела с помощью Ctrl+F, а не перебирая коробки.

Недвижимость

Архивы актов и документов по завершению сделок с недвижимостью

Титульные компании и брокеры превращают отсканированные акты, межевые планы и пакеты документов по сделкам в PDF с возможностью поиска, так что поиск по кадастровому номеру или имени покупателя за годы сделок занимает секунды вместо похода в архив.

Исследования

Поиск по документам для журналистских расследований

Репортёры конвертируют утёкшие или полученные по FOIA отсканированные документы в PDF с возможностью поиска, чтобы прогонять grep по тысячам страниц в поисках имени, даты или суммы при подготовке материала.

Для разработчиков

Архивы исполнительных чертежей эксплуатации и инженерных служб

Менеджеры по эксплуатации и инженерные команды добавляют OCR-слои с текстом к отсканированным исполнительным чертежам, схемам и руководствам по оборудованию, чтобы поиск по номеру детали, названию помещения или модели по десятилетиям строительных записей занимал секунды вместо разворачивания физических чертежей.

Наблюдайте за каждой трансформацией

Каждая фотография проходит через разделитель без изменений и выходит готовой.