PDF to Text (OCR)

Extract text from PDFs — free

Pull editable text out of any PDF with accurate OCR — even scanned, image-only or photo-of-document PDFs. Copy it or download as TXT, Markdown, Word, Excel or CSV.

  • Reads scanned & image-only PDFs in 30+ languages
  • Formatted or plain text — copy or download instantly
  • Private processing · Files deleted automatically

PDF · Secure processing

TXT
PDFTXT

PDF 업로드

Drop any PDF — copy its text or download it as .txt

PDF · free up to 20MB, Premium up to 50MB

What you can do with PDF를 텍스트로

Everything this tool helps you accomplish — no learning curve, no setup.

  • Extract plain text from any PDF
  • Pull text out of scanned or image-only PDFs
  • Copy content from PDFs that block selection
  • Read text in your document's own language
  • Re-run extraction for a cleaner result
  • Get editable text for notes or search

Settings information

Every control in PDF를 텍스트로, explained — what it does and when to use it.

엔진

엔진Dropdown
파일을 읽어 들일 텍스트 인식 엔진을 선택합니다. 기본값이 장식적인 글꼴이나 손글씨를 잘못 읽는다면 엔진 1 또는 엔진 2로 바꿔 보세요 — 결과는 자동으로 새로 고쳐집니다.옵션: 기본값엔진 1엔진 2
언어Dropdown
원본 텍스트가 어떤 언어로 쓰였는지 지정해 문자를 정확하게 인식하도록 합니다. 검색 가능한 선택기에는 선택한 엔진이 지원하는 언어만 표시되며, 기본값은 영어입니다.옵션: EnglishFrenchGermanSpanishItalianPortugueseDutchRussianJapaneseKoreanChinese (Simplified)Chinese (Traditional)ArabicHindiBengaliPunjabiUrduVietnameseThaiPolishSwedishDanishNorwegianFinnishTurkishUkrainianIndonesianTamilTeluguMarathiNepaliPersianGreekHebrew
추출 다시 실행One-click
현재 선택한 엔진과 언어 설정으로 같은 파일에서 추출을 다시 실행합니다 — 결과가 부실하거나 실패했을 때 재시도하기 좋습니다.
Uploads are encrypted in transitRemoved under our retention policy

자주 묻는 질문

PDF를 업로드하면 도구가 실제 텍스트 레이어가 있는지, 아니면 스캔된 이미지만 있는지 감지합니다. 텍스트 레이어가 있는 PDF는 즉시 내보내집니다. 이미지만 있는 PDF(스캔된 책, 촬영한 영수증, 오래된 보고서)는 자동으로 OCR을 거칩니다. 어느 쪽이든 단락, 줄바꿈, 섹션 간격이 보존된 깔끔한 .txt 파일을 얻을 수 있습니다.

usage

네. PDF가 이미지로만 되어 있는 경우(스캔본, 촬영한 페이지, 팩스 내보내기에서 흔함) OCR 엔진이 자동으로 작동하므로 별도의 도구가 필요 없습니다. 다국어 지원이 내장되어 있어 이중 언어나 비라틴 문자(중국어, 아랍어, 힌디어)도 한 번에 추출됩니다.

features

단락 구분, 섹션 사이의 빈 줄, 글머리 기호, 번호 매기기 목록 접두사가 일반 텍스트로 보존됩니다. 제목은 원본 글꼴에 따라 대문자 또는 원래 대소문자 형태로 표시됩니다. 시각적 강조(굵게, 기울임꼴)는 일반 텍스트에 인코딩되지 않습니다. 그것이 필요하면 대신 PDF를 Word로 변환 도구를 사용하세요.

technical

네. 업로드 후 프롬프트에 비밀번호를 입력하면, 도구가 텍스트를 추출하는 데 필요한 시간 동안만 메모리에서 파일의 잠금을 해제합니다. 비밀번호는 디스크에 저장되거나 제3자 서비스로 전송되는 일이 절대 없습니다. 비밀번호 없이 잠긴 PDF는 처리할 수 없으며, 보안상의 이유로 비밀번호 크래킹은 수행하지 않습니다.

features

파일은 무료의 경우 최대 20MB, Premium의 경우 50MB, Pro의 경우 120MB까지 가능하며 500페이지를 문제 없이 처리할 수 있습니다. 더 큰 문서도 작동하지만 시간이 더 오래 걸립니다. 2000페이지 분량의 법률 아카이브는 OCR에 몇 분 정도 걸릴 수 있습니다. 대규모 작업의 경우 먼저 PDF 분할 도구를 사용하여 PDF를 분할하고 각 청크를 개별적으로 처리합니다.

technical

Processing happens on secure servers and files are deleted within 24 hours — unless you explicitly share a result, which keeps it at a public link anyone who has it can open for up to 30 days. The .txt output is yours — no watermark, no attribution, no tracking. Researchers, journalists, lawyers and students use the tool to extract text from confidential reports knowing the source PDF is not retained beyond that window.

privacy

네. 엔진 패널을 열어 문서의 언어와 OCR 엔진을 선택하면 해당 문자로 페이지를 읽습니다 — 비라틴 및 오른쪽에서 왼쪽으로 쓰는 언어를 포함해 100개가 넘는 언어가 지원됩니다. 첫 번째 처리에서 강세 부호나 비영어 문자를 잘못 읽으면 언어를 바꾸고 추출 다시 실행을 탭하세요.

usage

서식 보기는 페이지의 원래 레이아웃(단, 간격, 줄 위치)을 그대로 유지해 표와 영수증에 유용합니다. 일반 보기는 문서나 챗봇에 붙여넣기 쉽도록 깔끔하게 재배열된 텍스트를 제공합니다. 두 보기를 전환한 뒤 텍스트를 복사하거나 .txt 파일로 내려받으세요.

features

이 도구는 복사하거나 .txt로 저장할 수 있는 원시 텍스트를 제공합니다. 원본 PDF를 유지하면서 Ctrl+F로 검색 가능하게 만들고 싶다면 이미지를 검색 가능한 PDF로 변환 도구에 넣으세요 — 스캔본 위에 보이지 않는 OCR 텍스트 레이어를 추가하므로 페이지는 똑같아 보이면서도 단어를 선택할 수 있게 됩니다.

tips

일반적인 라틴 문자 언어라면 Default와 문서 언어로 시작하세요. 일상적인 텍스트에는 빠르고 정확합니다. 결과가 깨져 보이거나 문자가 라틴 계열이 아니라면(아랍어, 힌디어, 중국어, 키릴어) Engine 1이나 Engine 2로 전환하고 선택기에서 해당 언어를 고른 뒤 Re-run extraction을 누르세요. 엔진마다 문자 체계에 맞게 조정되어 있으니 둘 다 시도해 봐도 몇 초면 됩니다.

tips

출력 상자는 완전히 편집 가능하므로 OCR 오류를 화면에서 바로 빠르게 정리하거나 일부를 잘라낼 수 있습니다. Copy to clipboard는 편집 내용을 포함해 현재 상자에 있는 것을 항상 그대로 복사합니다. 하지만 Download .txt는 화면상의 편집이 아니라 마지막 Engine/Language 실행으로 생성된 원본 파일을 저장합니다. 수정을 유지하려면 Copy를 사용해 직접 만든 .txt 파일에 붙여넣거나, 오류가 체계적이라면 손으로 편집하는 대신 Language나 Engine을 전환하고 Re-run extraction을 누르세요.

features

PDF를 업로드하면 추출기가 텍스트를 뽑아냅니다 — 스캔본이나 이미지로만 이루어진 페이지는 OCR이 자동으로 실행됩니다 — 결과물은 일반 .txt 파일로 다운로드할 수 있습니다. 이 파일은 Notepad, TextEdit는 물론 어떤 코드 편집기에서도 별도 프로그램 없이 열립니다. 이런 방식으로 사용하면 서식이나 이미지 없이 복사해서 바로 쓸 수 있는 텍스트만 필요할 때 간단한 pdf to notepad 변환기로 활용할 수 있습니다.

usage

Yes — you can convert PDF to text free to preview; create a free account to download required. The free tier includes a generous daily allowance and covers OCR on scanned PDFs, the Formatted and Plain views, and the .txt download. If you extract text from large batches of documents every day, upgrading removes the daily limits.

pricing

예 — Pixoate는 일괄 처리 및 대량 처리를 지원합니다. 배치 모드로 전환하고 Premium에서 최대 60개, Pro에서 최대 200개의 PDF를 추가하고 옵션을 한 번 설정하면 단일 ZIP을 다운로드하기 전에 모든 PDF가 동일한 설정으로 처리됩니다. 대량 처리는 프리미엄 기능입니다. 출력은 단일 모드와 동일한 품질과 설정을 사용합니다.

features

예. 대량 처리를 사용하면 설정을 한 번만 구성하면 일괄 처리의 모든 항목에 적용됩니다(Premium의 경우 최대 60개 PDF, Pro의 경우 최대 200개). 항목별로 반복 설정이 필요 없으며, 임시 업로드 및 생성된 파일은 안전하게 처리되어 자동으로 삭제됩니다.

usage

PDF를 텍스트로가 작업을 완수하도록 돕는 방법

비즈니스, 크리에이터, 일상 작업에서 매일 해결하는 실제 문제들. 나에게 맞는 활용 사례를 찾아 몇 초 만에 시작하세요.

학력

강의 및 수업 노트 추출

학생이 교수가 제공한 PDF 강의 노트와 실습 매뉴얼에서 일반 텍스트를 추출해, 발췌한 내용을 Notion, Obsidian, 학습 플래시카드에 붙여 넣습니다.

개인용

대량 제출용 이력서 텍스트

구직자는 PDF 이력서에서 일반 텍스트만 추출해, 파일 업로드를 지원하지 않는 ATS 지원서, LinkedIn 간편 지원, 채용 포털의 텍스트 입력란에 붙여넣을 수 있습니다.

비즈니스용

PDF 보고서로 만드는 이메일 초안

분석가는 긴 PDF 보고서에서 요약 섹션을 추출해 이메일, Slack 메시지, Teams 채팅에 붙여 넣어 이해관계자가 핵심 인사이트를 빠르게 파악할 수 있게 합니다.

비즈니스용

기존 PDF 리소스의 SEO 감사

마케터는 오래된 PDF 백서와 전자책에서 텍스트를 추출해 키워드 적용 범위를 점검하고, 콘텐츠 공백을 찾아내며, 자연 검색 유입을 위해 새로운 블로그 글로 다시 게시할 수 있습니다.

비즈니스용

번역 워크플로우 준비

번역가는 PDF 원본에서 텍스트를 추출한 뒤 Trados, MemoQ, DeepL Pro 같은 번역 메모리 도구에 붙여 넣어 더 빠르고 정확한 현지화를 진행합니다.

생산성

긴 PDF 보고서에서 AI 프롬프트 만들기

고급 사용자는 PDF 연구 논문에서 텍스트를 추출해 ChatGPT, Claude, Gemini에 컨텍스트로 입력하여 요약, 질의응답, 핵심 정리에 활용합니다.

비즈니스용

일반 텍스트 백업 아카이브

IT 및 기록 관리 팀은 PDF 문서 아카이브에서 일반 텍스트를 추출해, 20년 뒤에도 PDF 뷰어에 의존하지 않는 가볍고 미래에도 호환되는 백업을 만듭니다.

학력

인용 및 참고문헌 목록

연구자는 PDF에서 참고문헌 섹션을 일반 텍스트로 추출하여 각 항목을 일일이 다시 입력하지 않고 Zotero, Mendeley, EndNote에 붙여넣습니다.

개인용

스크린 리더 및 텍스트 음성 변환 접근

PDF에서 깔끔한 텍스트를 추출하면 화면 낭독기로 읽어 주거나 텍스트 음성 변환 앱에 붙여넣을 수 있습니다. 시각 장애가 있는 독자나 긴 보고서를 손을 쓰지 않고 듣고 싶은 경우에 유용합니다.

법적 고지

법률 전자증거개시 키워드 검색

패러리걸은 스캔한 증언 녹취록과 증거개시 자료 묶음에서 텍스트를 추출해, 이미지로만 된 PDF를 수천 페이지씩 넘기며 이름이나 조항을 찾는 대신 콘텐츠 전체를 검색할 수 있게 합니다.

개발자용

스캔된 청구서 데이터 파이프라인

개발자와 운영 팀은 스캔한 청구서와 영수증에서 텍스트를 추출해 정규식 또는 LLM 기반 파서에 입력함으로써, 수작업으로 다시 입력하는 대신 대량 데이터 입력을 자동화합니다.

연구

정보공개(FOIA) 및 유출 문서 조사

탐사 기자는 스캔한 정부 발표문과 정보공개(FOIA) 문서에서 텍스트를 추출하여 방대한 문서 더미에서 주장을 검색하고 인용하며 교차 확인할 수 있습니다.