Extract text from PDFs — free
Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.
- Reads scanned & image-only PDFs in 30+ languages
- Formatted or plain text — copy or download instantly
- Private processing · Files deleted automatically
PDF · Secure processing
Загрузить PDF
Drop any PDF — copy its text or download it as .txt
PDF · free up to 20MB, Premium up to 50MB
What you can do with PDF в текст
Everything this tool helps you accomplish — no learning curve, no setup.
- Extract plain text from any PDF
- Pull text out of scanned or image-only PDFs
- Copy content from PDFs that block selection
- Read text in your document's own language
- Re-run extraction for a cleaner result
- Get editable text for notes or search
Settings information
3 settings
Every control in PDF в текст, explained — what it does and when to use it.
Движок
- ДвижокDropdown
- Выбирает, какой движок распознавания текста читает ваш файл; переключитесь на «Движок 1» или «Движок 2», если вариант «По умолчанию» неверно распознаёт стилизованные шрифты или почерк — результат обновится автоматически.Параметры: По умолчаниюДвижок 1Движок 2
- ЯзыкDropdown
- Задаёт язык, на котором написан исходный текст, чтобы символы распознавались точно; в списке с поиском показаны только языки, поддерживаемые выбранным движком, по умолчанию — английский.Параметры: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
- Запустить извлечение зановоOne-click
- Заново извлекает текст из того же файла с текущими значениями «Движок» и «Язык» — удобно для повторной попытки после слабого или неудачного распознавания.
Закончили с PDF в текст? Попробуйте эти
Тщательно подобранные инструменты, которые хорошо сочетаются с PDF в текст. Продолжайте, не теряя файл.
PDF в Word
Stop retyping locked PDFs. Get a clean .docx with fonts, tables and layout preserved that opens in Word, Pages or Google Docs — ready in seconds. Free to start, no credit card.
Попробовать сейчасPDF в HTML
Get semantic HTML with real table markup you can paste straight into your site or CMS — works on scanned PDFs too, done in seconds. Free to start, no credit card.
Попробовать сейчасИзображение в текст (OCR)
Stop retyping screenshots and scans. Upload any image and get clean, editable text in 30+ languages — ready to copy in seconds. Free to start.
Попробовать сейчасОбъединить PDF
Stop emailing five attachments. Drop your PDFs, drag them into order, and download a single merged file in seconds. Free to start, no watermark, files auto-deleted.
Попробовать сейчасСжать PDF
Rejected by an upload limit or bounced by email? Pick a quality preset and get a much smaller PDF in seconds — same document, lighter file. Free to start, no watermark.
Попробовать сейчасСчётчик слов
Essay limits and character caps sneak up on you. Paste or type to see words, characters, sentences, paragraphs and reading time update live. Free to use and copy — no account needed.
Попробовать сейчасЧасто задаваемые вопросы
Загрузите ваш PDF, и инструмент определит, содержит ли он настоящий текстовый слой или только отсканированные изображения. PDF с текстовым слоем экспортируются мгновенно. PDF, содержащие только изображения (отсканированные книги, сфотографированные чеки, старые отчёты), автоматически проходят через OCR. В любом случае вы получаете чистый файл .txt с сохранением абзацев, разрывов строк и отступов между разделами.
usageДа. Если PDF состоит только из изображений (что обычно для сканов, сфотографированных страниц или экспортированных факсов), движок OCR включается автоматически — отдельный инструмент не нужен. Поддержка нескольких языков встроена, поэтому даже двуязычные или нелатинские письменности (китайская, арабская, хинди) извлекаются за один проход.
featuresРазрывы абзацев, пустые строки между разделами, маркеры списков и префиксы нумерованных списков сохраняются как обычный текст. Заголовки передаются в верхнем регистре или с исходным регистром в зависимости от исходного шрифта. Визуальное выделение (полужирный, курсив) не кодируется в обычном тексте — для этого используйте конвертер PDF в Word.
technicalДа. Введите пароль в запросе после загрузки, и инструмент разблокирует файл в памяти ровно настолько, чтобы извлечь текст. Пароль никогда не сохраняется на диске и не передаётся сторонним сервисам. Защищённые PDF без пароля обработать нельзя — из соображений безопасности подбор пароля не выполняется.
featuresРазмер файлов может достигать 20 МБ в бесплатной версии, 50 МБ в премиум-версии или 120 МБ в версии Pro, а 500 страниц обрабатываются без проблем. Документы большего размера тоже работают, но занимают больше времени: распознавание юридического архива объемом 2000 страниц может занять несколько минут. Для объемных заданий сначала разделите PDF-файл с помощью инструмента «Разделить PDF» и обработайте каждый фрагмент отдельно.
technicalProcessing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.
privacyДа. Откройте панель «Движок», выберите язык документа и движок OCR — и страница будет распознана в этом письме; поддерживается более 100 языков, включая нелатинские и письма справа налево. Если при первом проходе символы с диакритикой или неанглийские буквы распознаны неверно, смените язык и нажмите «Повторить распознавание».
usageРежим с форматированием сохраняет исходную раскладку страницы — колонки, отступы и расположение строк, — что удобно для таблиц и чеков. Простой режим даёт чистый перекомпонованный текст, который проще вставить в документ или чат-бота. Переключайтесь между ними, затем скопируйте текст или скачайте его как файл .txt.
featuresЭтот инструмент выдаёт необработанный текст для копирования или сохранения в .txt. Если вы предпочитаете сохранить исходный PDF, но сделать его доступным для поиска по Ctrl+F, пропустите его через инструмент «Изображение в PDF с поиском» — он добавляет невидимый текстовый слой OCR поверх скана, так что страница выглядит так же, а слова становятся выделяемыми.
tipsНачните с движка Default и языка вашего документа для распространённых языков на латинице — он быстрый и точный для повседневного текста. Если результат выглядит искажённым или письменность не латинская (арабская, хинди, китайская, кириллица), переключитесь на Engine 1 или Engine 2, выберите нужный язык из списка и нажмите «Повторить распознавание» — разные движки настроены под разные письменности, так что проверить оба займёт секунды.
tipsПоле вывода полностью редактируемое, так что вы можете быстро исправить ошибку OCR или обрезать фрагмент прямо на экране. «Копировать в буфер обмена» всегда копирует именно то, что сейчас в поле, включая правки — но «Скачать .txt» сохраняет исходный файл, полученный при последнем запуске движка/языка, а не ваши экранные правки. Чтобы сохранить исправление, воспользуйтесь «Копировать» и вставьте его в собственный файл .txt, или, если ошибка систематическая, смените язык или движок и нажмите «Повторить распознавание» вместо ручного редактирования.
featuresЗагрузите PDF и дайте инструменту извлечь текст — на сканированных или состоящих только из изображений страницах автоматически запускается OCR — а затем скачайте результат в виде обычного файла .txt. Файл открывается в «Блокноте», TextEdit или любом текстовом редакторе без специального ПО. По сути, это простой конвертер PDF в блокнот для тех случаев, когда нужен просто «сырой» текст, готовый к копированию, без форматирования и изображений.
usageYes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.
pricingДа — Pixoate поддерживает пакетную и массовую обработку. Переключитесь в пакетный режим, добавьте до 60 PDF-файлов в Premium или до 200 в Pro, задайте параметры один раз, и каждый PDF-файл будет обрабатываться с одинаковыми настройками перед загрузкой одного ZIP-файла. Массовая обработка — это функция Premium; на выходе используется то же качество и настройки, что и в одиночном режиме.
featuresДа — при массовой обработке вы настраиваете параметры один раз, и они применяются к каждому элементу в пакете — до 60 PDF-файлов в версии Premium или 200 в версии Pro. Нет необходимости повторять настройку для каждого элемента, а временные загруженные и созданные файлы безопасно обрабатываются и автоматически удаляются.
usageКак PDF в текст помогает вам справиться с задачей
Реальные задачи, которые он решает каждый день, — для бизнеса, авторов и повседневных дел. Найдите подходящий вам сценарий и начните за секунды.
Извлечение конспектов лекций и курсов
Учащиеся извлекают простой текст из выданных преподавателем PDF-конспектов лекций и лабораторных методичек, чтобы вставлять фрагменты в Notion, Obsidian и учебные карточки.
Текст резюме для массовой отправки
Соискатели извлекают простой текст из резюме в формате PDF, чтобы вставить его в формы ATS, LinkedIn Easy Apply и текстовые поля порталов рекрутеров, которые не принимают загрузку файлов.
Черновики писем на основе PDF-отчётов
Аналитики извлекают разделы с краткой сводкой из длинных PDF-отчётов, чтобы вставить их в письма, сообщения Slack и чаты Teams, чтобы заинтересованные стороны быстро ознакомились с ключевыми выводами.
SEO-аудит существующих PDF-ресурсов
Маркетологи извлекают текст из старых PDF-материалов и электронных книг, чтобы проверить охват ключевых слов, выявить пробелы в контенте и переиздать его в виде свежих постов в блоге для органического поиска.
Подготовка рабочего процесса перевода
Переводчики извлекают текст из исходного PDF, прежде чем вставить его в инструменты памяти переводов, такие как Trados, MemoQ или DeepL Pro, для более быстрой и точной локализации.
Промпты для AI из длинных PDF-отчётов
Опытные пользователи извлекают текст из научных статей в PDF и передают его в ChatGPT, Claude или Gemini как контекст для кратких изложений, вопросов и ответов и выделения ключевых тезисов.
Резервные архивы в виде обычного текста
ИТ-отделы и архивные службы извлекают обычный текст из архивов PDF-документов, чтобы создавать лёгкие, не зависящие от времени резервные копии, которые не потребуют программ для просмотра PDF через 20 лет.
Списки цитат и литературы
Исследователи извлекают разделы библиографии из PDF в обычный текст, чтобы вставить их в Zotero, Mendeley или EndNote без ручного перепечатывания каждой записи.
Доступ через программу чтения с экрана и синтез речи
Извлекайте чистый текст из PDF, чтобы его могли озвучивать программы чтения с экрана или можно было вставить в приложения синтеза речи — полезно для людей с нарушениями зрения или для прослушивания длинного отчёта без рук.
Поиск по ключевым словам для юридического e-discovery
Помощники юристов извлекают текст из отсканированных показаний и материалов дела, чтобы по содержимому можно было искать среди тысяч страниц, а не пролистывать PDF-файлы из одних изображений в поисках имени или пункта.
Конвейеры данных отсканированных счетов
Разработчики и команды эксплуатации извлекают текст из отсканированных счетов и чеков, чтобы подать его в парсеры на основе регулярных выражений или LLM, автоматизируя массовый ввод данных вместо ручного перепечатывания.
Расследования по FOIA и утечкам документов
Журналисты-расследователи извлекают текст из отсканированных государственных публикаций и документов по FOIA, чтобы искать, цитировать и перекрёстно проверять факты в больших массивах документов.
