

PDF Maker с возможностью поиска — добавьте текстовый слой OCR к сканам и фотографиям
Ctrl-F ничего не находит в отсканированном документе, поэтому вы читаете все 40 страниц в поисках одной строки. Добавьте текстовый слой OCR, и отсканированное изображение станет доступным для поиска.
- Найдите любую строку на скане вместо того, чтобы читать ее страницу за страницей.
- Каждая страница остается видимой точно так же, как отсканированная.
- До 20 страниц-изображений · 8 МБ каждая
Принимает файлы изображений, а не готовые документы PDF
Загрузить изображения
Загрузите сканы или фото по порядку — добавьте на каждую страницу текстовый слой с возможностью поиска
Выберите несколько — каждое изображение станет страницей PDF
Что можно сделать с помощью PDF с поиском
Прежде чем начать, ознакомьтесь с основными возможностями.
- Делайте отсканированные PDF доступными для поиска и выделения текста
- Добавьте скрытый текстовый слой OCR в PDF с изображениями
- Копируйте и выделяйте текст на отсканированных страницах
- Найдите любое слово внутри отсканированного документа
- Превращайте сфотографированные документы в файлы с возможностью поиска
- Распознавайте текст на выбранном языке
Справочник по настройкам
7 настроек
Доступные элементы управления для PDF с поиском.
Режим
- Что должен делать PDF?Пресеты
- Помещает изображения на обычные страницы PDF без распознавания или оставляет их видимыми и добавляет текстовый слой OCR для поиска, выделения и копирования.Параметры: Создать обычный PDFСделать текст доступным для поиска
- Язык документаВыпадающий список
- Выберите язык, который модуль распознавания использует при добавлении текстового слоя с поиском. Изначально выбран английский.Параметры: АнглийскийФранцузскийНемецкийИспанскийИтальянскийПортугальскийНидерландскийРусскийЯпонскийКорейскийКитайский (упрощённый)Китайский (традиционный)АрабскийХиндиБенгальскийПанджабиУрдуВьетнамскийТайскийПольскийШведскийДатскийНорвежскийФинскийТурецкийУкраинскийИндонезийскийТамильскийТелугуМаратхиНепальскийПерсидскийГреческийИврит
Страницы
- Страницы PDF (перетащите или используйте стрелки для изменения порядка)В один клик
- Перетаскивайте строки страниц или используйте кнопки со стрелками вверх и вниз, чтобы задать порядок изображений в готовом PDF.
Результат
- Размер бумагиПресеты
- Задаёт формат страницы: стандартные листы A4 или Letter для печати либо «Вписывание изображения», чтобы каждая страница PDF точно совпадала со своим изображением.Параметры: A4Опция — LetterВписывание изображения
- ОриентацияПресеты
- Ставит страницы A4 или Letter вертикально или горизонтально — так, как снято большинство ваших фотографий; недоступно, когда для размера бумаги выбрано «Вписывание изображения».Параметры: ПортретнаяАльбомная
- ПоляСлайдерДиапазон: 0–40mm · По умолчанию: 10mm
- Добавляет вокруг каждого изображения на странице пустое поле — от 0 мм (край в край) до 40 мм; недоступно, если для размера бумаги выбрано «Вписывание изображения».
- Имя выходного файлаТекстовое поле
- Задаёт имя PDF-файла, который скачает браузер; по умолчанию combined.pdf — удобно подписывать каждый экспорт, когда вы собираете несколько документов.
Сопутствующие инструменты для PDF с поиском
Инструменты для общих следующих шагов после PDF с поиском.
PDF и документы
Изображение в PDF
Объедините изображения JPG, PNG, WEBP или HEIC в обычный многостраничный PDF или добавьте текстовый слой OCR для поиска.
Попробовать сейчасPDF и документы
PDF в текст
Извлекайте простой копируемый текст из цифровых или отсканированных PDF-файлов и загружайте его в формате .txt.
Попробовать сейчасOCR и извлечение данных
Изображение в текст (OCR)
Извлекайте редактируемый текст из снимка экрана, фотографии или отсканированного изображения на более чем 30 поддерживаемых языках.
Попробовать сейчасЧасто задаваемые вопросы
Обычный PDF-изображение — это плоская картинка, обёрнутая в контейнер .pdf: текст в ней нельзя выделить, скопировать или найти. PDF с возможностью поиска имеет невидимый текстовый слой OCR, выровненный за каждым видимым символом, поэтому Ctrl+F находит слова, копирование работает, а программы чтения с экрана могут озвучивать страницу — при этом внешний вид остаётся неизменным.
usageДвижок OCR считывает каждое слово и сохраняет его текст и ограничивающую рамку поверх исходного изображения с точными пиксельными координатами. Визуально страница выглядит так же, как оригинальный скан, но Adobe Acrobat, Preview, Chrome и любая современная программа просмотра PDF теперь могут выделять, искать и копировать текст так, словно это исходный цифровой текст.
technicalДа. Текстовый слой представляет собой стандартный PDF-файл (без собственного расширения), поэтому Adobe Acrobat (Reader и Pro), macOS Preview, встроенная программа просмотра PDF-файлов Chrome, Firefox, Edge и мобильные программы чтения, такие как приложение «Файлы», Drive и Dropbox, индексируют и выполняют поиск по нему. Ctrl+F или Cmd+F находит слова даже в длинных просматриваемых отчетах.
featuresДа. Передайте несколько кодов языков (например, eng+chi_sim+hin), и OCR учтёт все их при распознавании символов. Документы со смешанными письменностями — двуязычные меню, международные договоры и государственные формы — обрабатываются корректно. Для лучшего результата укажите наиболее вероятный язык первым в списке.
featuresТекстовый слой обычно добавляет 5–15% к размеру PDF — как правило, несколько сотен килобайт на 100 страниц. По сравнению с преимуществом (полнотекстовый поиск по всему архиву документов) это небольшая цена. Если размер важен для отправки по почте, пропустите результат через инструмент сжатия PDF, чтобы дополнительно уменьшить крупные встроенные изображения.
technicalЗагруженные файлы обрабатываются во временной рабочей папке и удаляются в соответствии с нашей политикой безопасности. Если вы явно создадите ссылку для общего доступа, любой, у кого есть эта ссылка, сможет получить доступ к результату на срок до 30 дней. Прежде чем обрабатывать конфиденциальные документы, ознакомьтесь с политикой безопасности и требованиями вашей организации.
privacyЭтот инструмент читает файлы изображений (JPG, PNG, TIFF, сканы и фото) и возвращает PDF с возможностью поиска. Если у вас уже есть многостраничный отсканированный PDF, сначала разбейте его на изображения страниц с помощью инструмента «PDF в изображения», затем загрузите эти изображения сюда, чтобы получить один PDF с распознанным текстом и возможностью поиска.
usageЗагрузите JPG, PNG, WEBP, GIF, TIFF или BMP — подойдут фото с телефона, планшетные сканы и скриншоты. Движок OCR считывает текст и помещает его в невидимый слой за изображением, так что получается обычный PDF с возможностью поиска, который открывается в любом просмотрщике.
featuresДля PDF с возможностью поиска нужен невидимый текстовый слой, размещённый слово в слово поверх скана, и только Engine 1 и Engine 2 умеют создавать такой слой — движок «По умолчанию», используемый в остальных частях приложения, этого не может. Engine 1 поддерживает больше всего языков; Engine 2 может показывать лучший результат на стилизованных или низкокачественных сканах.
technicalОткройте выбор языка в «Настройках» и выберите язык документа (по умолчанию английский) — это единственная самая важная настройка для точности OCR, поскольку распознавание символов движком зависит от языка. Нажмите «Повторить конвертацию» после её изменения, чтобы пересобрать PDF с новым текстовым слоем.
usageВыберите Engine 1 за его более широкий охват языков и задайте в списке языков основной язык договора. Если ключевые разделы на втором языке всё равно не находятся при поиске, повторно запустите преобразование с Engine 2 или с выбранным дополнительным языком во втором проходе.
tipsОн обновляется автоматически — переключение списка «Движок» или «Язык» сразу же заново обрабатывает загруженное изображение и пересобирает PDF с поиском по тексту с новой настройкой, без необходимости нажатия. Кнопка «Повторить преобразование» полезна в основном для повторной попытки с теми же настройками, например после неудачного преобразования или кратковременного сбоя сети.
technicalЕсли Ctrl+F ничего не находит, PDF почти наверняка представляет собой скан — страницы являются изображениями без текста под ними. Пропустите файл через этот конвертер в PDF с возможностью поиска: OCR считывает каждую страницу и добавляет невидимый текстовый слой, благодаря чему поиск, выделение и копирование текста начинают работать в любой программе для просмотра. Видимые страницы остаются пиксель в пиксель такими же.
technicalВам не нужен Acrobat или установленное программное обеспечение. Загрузите отсканированное изображение, просмотрите результат поиска и загрузите стандартный PDF-файл без создания учетной записи в рамках бесплатного лимита. Вывод открывается в любой программе просмотра PDF.
pricingПочти всегда причина одна из трёх. Файл превышает бесплатный лимит загрузки 11 МБ: Premium принимает до 50 МБ, а Pro — до 120 МБ. Либо инструмент не поддерживает этот формат — проверьте список на панели загрузки. Либо фактический формат не соответствует расширению: переименование не меняет содержимое файла, поэтому даже внешне корректный PDF может быть отклонён.
troubleshootingВ PDF-файле хранится расположение каждого символа на странице, а не абзацы и стили, в которых работает текстовый процессор, поэтому преобразование означает перестройку этой структуры путем вывода. Сложные столбцы, таблицы и текст, обернутый вокруг изображений, — вот куда он смещается. Если внешний вид важнее возможности редактирования, выберите визуальный режим; если вам нужно ввести его, выберите редактируемый режим и ожидайте исправления нечетного заголовка.
troubleshootingНет. Вы можете запустить PDF с возможностью поиска и загрузить бесплатный результат без учетной записи, и он не имеет водяных знаков. Премиум — это то, что вы покупаете, когда ограничения начинают кусаться: большие загрузки, отсутствие дневного ограничения и результат с исходным разрешением. На этапе загрузки не отображается ничего, что не было бы видно до начала.
pricingНет — Поисковая система PDF работает в браузере на компьютере и телефоне. Ничего не нужно устанавливать, нет пробного периода и лицензии, которую нужно покупать, прежде чем вы сможете увидеть, выполняет ли она то, что вам нужно. Попробуйте её на файле, с которым вы действительно застряли, а не на образце.
troubleshootingКак PDF с поиском помогает вам справиться с задачей
Реальные проблемы, которые он решает каждый день — для бизнеса, авторов и повседневных задач. Найдите вариант использования, который подходит вам, и начните.
Архивы юридических документов с поиском
Юридические фирмы добавляют текстовые слои OCR к отсканированным контрактам, показаниям и документам, чтобы помощники юристов могли просматривать тысячи страниц во время судебного процесса, нажимая Ctrl+F.
Хранилища HR- и кадровых документов
HR-команды конвертируют отсканированные личные дела сотрудников, офферы и подписанные договоры в PDF с поиском, которые любой сотрудник с доступом может быстро найти по полнотекстовому поиску.
Справочная библиотека исследователя
Учёные и аспиранты превращают отсканированные журнальные статьи и библиотечные ксерокопии в PDF с возможностью поиска, чтобы цитаты и ссылки мгновенно находились при обзоре литературы.
Архивы рецептов и кулинарных книг с поиском
Домашние повара оцифровывают семейные кулинарные книги и старые журналы рецептов в PDF-файлы с возможностью поиска, которые они могут запрашивать по ингредиентам — найдите каждый рецепт шоколадного торта.
Поиск патентов и товарных знаков
Специалисты по интеллектуальной собственности конвертируют отсканированные патенты и заявки на товарные знаки в PDF с возможностью поиска, чтобы искать ключевые слова предшествующего уровня техники и заявки конкурентов, не упуская формулировки, скрытые в иллюстрациях.
Аудиторский след по банковским выпискам
Аудиторы и судебные бухгалтеры преобразуют отсканированные банковские выписки в PDF с возможностью поиска, чтобы находить конкретных получателей, суммы и даты в записях за многие годы.
Архивы налоговых документов
Частные лица и малый бизнес превращают сканы налоговых деклараций, чеков и форм 1099 в PDF с поиском по тексту, которые примут IRS, CRA или HMRC и которые вы сможете проверить самостоятельно.
Отсканированные книги с поиском
Любители, библиотекари и переплётчики превращают отсканированные книги, снятые с печати, в PDF с возможностью поиска, которые работают как электронные книги: текст можно выделять, копировать, а электронные читалки его индексируют.
Оцифровка государственных и публичных документов
Городские секретари и муниципальные архивы добавляют текстовые слои OCR к отсканированным разрешениям, земельным и актовым записям, чтобы сотрудники и граждане могли найти конкретный участок, имя или номер дела с помощью Ctrl+F, а не перебирая коробки.
Архивы актов и документов по завершению сделок с недвижимостью
Титульные компании и брокеры превращают отсканированные акты, межевые планы и пакеты документов по сделкам в PDF с возможностью поиска, так что поиск по кадастровому номеру или имени покупателя за годы сделок занимает секунды вместо похода в архив.
Поиск по документам для журналистских расследований
Репортёры конвертируют утёкшие или полученные по FOIA отсканированные документы в PDF с возможностью поиска, чтобы прогонять grep по тысячам страниц в поисках имени, даты или суммы при подготовке материала.
Архивы исполнительных чертежей эксплуатации и инженерных служб
Менеджеры по эксплуатации и инженерные команды добавляют OCR-слои с текстом к отсканированным исполнительным чертежам, схемам и руководствам по оборудованию, чтобы поиск по номеру детали, названию помещения или модели по десятилетиям строительных записей занимал секунды вместо разворачивания физических чертежей.
Руководства по этому инструменту
- How to Convert Image Text to PDF: Searchable Pages or Editable TextTurn image text into a searchable PDF or an editable document. Compare both Pixoate workflows and choose the right output for your paperwork.
- How to Make Scanned Business Records Searchable by Name or Invoice NumberMake photographed business records searchable with Pixoate. Find names and invoice numbers while preserving a readable copy of the original page.
Наблюдайте за каждой трансформацией
Каждая фотография проходит через разделитель без изменений и выходит готовой.


























