

Trình tạo PDF có thể tìm kiếm - Thêm lớp văn bản OCR vào bản quét và ảnh
Ctrl-F không tìm thấy gì trong tài liệu được quét, vì vậy bạn đọc tất cả 40 trang và tìm kiếm một dòng. Thêm lớp văn bản OCR và quá trình quét sẽ có thể tìm kiếm được.
- Tìm bất kỳ dòng nào trong bản quét thay vì đọc từng trang
- Mỗi trang vẫn hiển thị chính xác như được quét
- Tối đa 20 trang hình ảnh · 8 MB mỗi trang
Chấp nhận tệp hình ảnh, không phải tài liệu PDF có sẵn
Tải ảnh lên
Thả các bản quét hoặc ảnh theo thứ tự — thêm lớp văn bản có thể tìm kiếm vào mỗi trang
Chọn nhiều tệp — mỗi hình ảnh trở thành một trang PDF
Bạn có thể làm gì với PDF có thể tìm kiếm
Xem lại các khả năng chính trước khi bạn bắt đầu.
- Biến PDF quét thành tệp có thể tìm kiếm và bôi chọn văn bản
- Thêm lớp văn bản OCR ẩn vào PDF dạng ảnh
- Sao chép và bôi đen văn bản trên các trang quét
- Tìm bất kỳ từ nào bên trong tài liệu đã quét
- Biến tài liệu đã chụp ảnh thành các tập tin có thể tìm kiếm được
- Nhận diện văn bản theo ngôn ngữ bạn chọn
Tham khảo cài đặt
cài đặt 7
Các điều khiển có sẵn cho PDF có thể tìm kiếm.
Chế độ
- PDF nên làm gì?Cài đặt sẵn
- Đặt các hình ảnh lên các trang PDF thông thường mà không nhận dạng, hoặc giữ chúng hiển thị và thêm một lớp văn bản OCR để tìm kiếm, chọn và sao chép.Tùy chọn: Tạo một tệp PDF thườngBiến văn bản thành tìm kiếm được
- Ngôn ngữ tài liệuDanh sách thả xuống
- Choose the language used by the document reader when adding a searchable text layer. English is selected initially.Tùy chọn: Tiếng AnhTiếng PhápTiếng ĐứcTiếng Tây Ban NhaTiếng ÝTiếng Bồ Đào NhaTiếng Hà LanTiếng NgaTiếng NhậtTiếng HànTiếng Trung (Giản thể)Tiếng Trung (Phồn thể)Tiếng Ả RậpTiếng HindiTiếng BengalTiếng Punjabtiếng UrduTiếng ViệtTiếng TháiTrau chuốtTiếng Thụy ĐiểnTiếng Đan MạchTiếng Na UyTiếng Phần Lantiếng Thổ Nhĩ Kỳtiếng UkrainaTiếng IndonesiaTiếng TamilTiếng TeluguTiếng MarathiTiếng NepalTiếng Ba TưTiếng Hy LạpTiếng Do Thái
Trang
- Trang PDF (kéo hoặc dùng mũi tên để sắp xếp lại)Một cú nhấp
- Kéo các hàng trang hoặc dùng nút mũi tên lên và xuống để sắp xếp thứ tự ảnh xuất hiện trong tệp PDF hoàn chỉnh.
Kết quả
- Khổ giấyCài đặt sẵn
- Chọn khổ trang: giấy A4 hoặc Letter tiêu chuẩn để in, hoặc Vừa khít ảnh để mỗi trang PDF có kích thước đúng bằng ảnh của nó.Tùy chọn: A4ThưCách vừa khung hình ảnh
- HướngCài đặt sẵn
- Đặt trang A4 hoặc Letter theo chiều dọc hay chiều ngang cho khớp với cách chụp phần lớn ảnh của bạn; không khả dụng khi Khổ giấy đang đặt ở Vừa với ảnh.Tùy chọn: DọcNgang
- LềThanh trượtPhạm vi: 0–40mm · Mặc định: 10mm
- Thêm khoảng trắng quanh mỗi ảnh trên trang, từ 0 mm (sát mép) đến 40 mm; bị vô hiệu hóa khi Khổ giấy đặt là Vừa khít ảnh.
- Tên tệp đầu raNhập văn bản
- Đặt tên cho tệp PDF mà trình duyệt tải về; mặc định là combined.pdf, hữu ích để gắn nhãn cho từng bản xuất khi bạn tạo nhiều tài liệu.
Các công cụ liên quan dành cho PDF có thể tìm kiếm
Công cụ dành cho các bước tiếp theo phổ biến sau PDF có thể tìm kiếm.
PDF & Tài liệu
Ảnh sang PDF
Kết hợp các hình ảnh JPG, PNG, WEBP hay HEIC thành một tệp PDF thường nhiều trang, hoặc thêm một lớp văn bản OCR để tìm kiếm.
Dùng thử ngayPDF & Tài liệu
PDF sang văn bản
Trích xuất văn bản đơn giản, có thể sao chép từ các tệp PDF kỹ thuật số hoặc được quét và tải xuống dưới dạng .txt.
Dùng thử ngayOCR & trích xuất dữ liệu
Ảnh sang văn bản (OCR)
Trích xuất văn bản có thể chỉnh sửa từ ảnh chụp màn hình, ảnh hoặc bản quét bằng hơn 30 ngôn ngữ được hỗ trợ.
Dùng thử ngayCâu hỏi thường gặp
Một tệp PDF ảnh thông thường là một bức tranh phẳng được bọc trong vật chứa .pdf — bạn không thể chọn, sao chép hay tìm kiếm văn bản trong đó. Một tệp PDF có thể tìm kiếm có một lớp văn bản OCR vô hình căn chỉnh phía sau từng ký tự hiển thị, nên Ctrl+F tìm được từ, chức năng Sao chép hoạt động, và trình đọc màn hình có thể đọc to trang giấy trong khi giao diện hiển thị vẫn giữ y nguyên.
usageCông cụ OCR đọc từng chữ và lưu văn bản cùng khung bao của nó phía sau ảnh gốc tại đúng tọa độ pixel. Về mặt hình ảnh, trang trông giống hệt bản scan gốc, nhưng Adobe Acrobat, Preview, Chrome và mọi trình xem PDF hiện đại giờ đây có thể chọn, tìm kiếm và sao chép văn bản như thể đó là văn bản số gốc.
technicalVâng. Lớp văn bản là PDF tiêu chuẩn (không có tiện ích mở rộng độc quyền), vì vậy Adobe Acrobat (Reader và Pro), macOS Preview, trình xem PDF tích hợp của Chrome, Firefox, Edge và các trình đọc di động như ứng dụng Tệp, Drive và Dropbox đều lập chỉ mục và tìm kiếm nó. Ctrl+F hoặc Cmd+F tìm thấy các từ, ngay cả trong các báo cáo được quét dài.
featuresCó. Truyền vào nhiều mã ngôn ngữ (ví dụ eng+chi_sim+hin) và OCR sẽ cân nhắc tất cả khi đọc ký tự. Các tài liệu pha trộn nhiều chữ viết như thực đơn song ngữ, hợp đồng quốc tế và biểu mẫu chính phủ đều hoạt động trơn tru. Để có kết quả tốt nhất, hãy đặt ngôn ngữ có khả năng cao nhất lên đầu danh sách.
featuresLớp văn bản thường làm tăng 5–15% dung lượng PDF — thường là vài trăm kilobyte cho mỗi 100 trang. So với lợi ích thu được (tìm kiếm toàn văn trên toàn bộ kho tài liệu của bạn), đây là cái giá nhỏ. Nếu dung lượng quan trọng để gửi email, hãy chạy kết quả qua công cụ Nén PDF để cắt giảm thêm các hình ảnh nhúng lớn.
technicalCác nội dung tải lên được xử lý trong một thư mục làm việc tạm thời và bị xóa theo chính sách Bảo mật của chúng tôi. Nếu bạn tạo liên kết chia sẻ một cách rõ ràng thì bất kỳ ai có liên kết đó đều có thể truy cập vào kết quả trong tối đa 30 ngày. Xem lại Chính sách bảo mật và các yêu cầu của tổ chức bạn trước khi xử lý các tài liệu nhạy cảm.
privacyCông cụ này đọc các tệp ảnh (JPG, PNG, TIFF, bản quét và ảnh chụp) và trả về một PDF có thể tìm kiếm. Nếu bạn đã có một PDF quét nhiều trang, trước tiên hãy tách nó thành các ảnh trang bằng công cụ PDF sang ảnh, rồi thả các ảnh đó vào đây để nhận lại một PDF có thể tìm kiếm đã qua OCR.
usageTải lên JPG, PNG, WEBP, GIF, TIFF hoặc BMP — ảnh chụp điện thoại, bản quét máy scan phẳng và ảnh chụp màn hình đều dùng được. Công cụ OCR đọc văn bản và bọc nó trong một lớp vô hình phía sau ảnh, nên kết quả là một PDF có thể tìm kiếm bình thường, mở được trong mọi trình xem.
featuresMột PDF có thể tìm kiếm được cần một lớp văn bản vô hình đặt khớp từng từ lên trên bản quét, và chỉ Engine 1 và Engine 2 mới tạo được lớp này — engine 'Mặc định' dùng ở những nơi khác trong ứng dụng thì không thể. Engine 1 hỗ trợ nhiều ngôn ngữ nhất; Engine 2 xử lý tốt hơn với các bản quét cách điệu hoặc chất lượng thấp.
technicalMở bộ chọn Ngôn ngữ trong Cài đặt và chọn ngôn ngữ của tài liệu (mặc định là tiếng Anh) — đây là cài đặt quan trọng nhất đối với độ chính xác OCR, vì việc nhận diện ký tự của engine phụ thuộc vào ngôn ngữ. Nhấn Chạy lại chuyển đổi sau khi thay đổi để dựng lại PDF với một lớp văn bản mới.
usageChọn Engine 1 vì độ bao phủ ngôn ngữ rộng hơn của nó, và đặt bộ chọn Ngôn ngữ theo ngôn ngữ chính của hợp đồng. Nếu các phần quan trọng ở ngôn ngữ thứ hai vẫn không khớp khi bạn tìm kiếm, hãy chạy lại việc chuyển đổi với Engine 2 hoặc ngôn ngữ phụ được chọn ở lượt thứ hai.
tipsNó tự động cập nhật — chuyển menu Công cụ hoặc Ngôn ngữ sẽ lập tức xử lý lại ảnh đã tải lên và dựng lại PDF có thể tìm kiếm với cài đặt mới, không cần nhấp. Nút Chạy lại chuyển đổi chủ yếu hữu ích để thử lại đúng cùng cài đặt đó, ví dụ sau một lần chuyển đổi thất bại hoặc mất mạng thoáng qua.
technicalNếu Ctrl+F không tìm thấy gì, gần như chắc chắn file PDF này là bản quét — các trang chỉ là hình ảnh, không có văn bản bên dưới. Hãy đưa file qua công cụ chuyển đổi PDF có thể tìm kiếm này: OCR sẽ đọc từng trang và thêm một lớp văn bản vô hình, giúp tính năng tìm kiếm, tô sáng và sao chép - dán hoạt động được trên mọi trình xem. Các trang hiển thị vẫn giữ nguyên từng pixel như bản gốc.
technicalBạn không cần Acrobat hoặc cài đặt phần mềm. Tải lên bản quét, xem trước kết quả có thể tìm kiếm và tải xuống bản PDF tiêu chuẩn mà không cần tạo tài khoản, trong phạm vi cho phép miễn phí. Đầu ra sẽ mở trong bất kỳ trình xem PDF nào.
pricingGần như luôn do một trong ba nguyên nhân. Tệp vượt quá giới hạn tải lên miễn phí 11 MB — Premium hỗ trợ 50 MB và Pro 120 MB. Hoặc định dạng không được công cụ này hỗ trợ, vì vậy hãy kiểm tra danh sách trên bảng tải lên. Hoặc tệp không thực sự có định dạng như tên gọi: đổi tên tệp không làm thay đổi nội dung bên trong, và đó là lý do một tệp PDF có vẻ hợp lệ vẫn bị từ chối.
troubleshootingTệp PDF lưu trữ mọi ký tự nằm trên trang chứ không phải các đoạn văn và kiểu mà trình xử lý văn bản hoạt động, vì vậy việc chuyển đổi có nghĩa là xây dựng lại cấu trúc đó bằng cách suy luận. Các cột, bảng và văn bản phức tạp bao quanh hình ảnh là nơi nó trôi dạt. Nếu hình thức quan trọng hơn khả năng chỉnh sửa, hãy chọn chế độ trực quan; nếu bạn cần nhập vào nó, hãy chọn chế độ có thể chỉnh sửa và mong muốn sửa tiêu đề lẻ.
troubleshootingKhông. Bạn có thể chạy bản PDF có thể tìm kiếm và tải xuống kết quả miễn phí mà không cần có tài khoản và kết quả đó không có hình mờ. Premium là thứ bạn mua khi giới hạn bắt đầu bị giới hạn: tải lên lớn hơn, không có giới hạn hàng ngày và kết quả ở độ phân giải gốc. Không có gì được tiết lộ ở bước tải xuống mà bạn không thể nhìn thấy trước khi bắt đầu.
pricingKhông — PDF có thể tìm kiếm chạy trong trình duyệt trên máy tính để bàn và điện thoại. Không cần cài đặt gì, không cần dùng thử để bắt đầu và không cần mua giấy phép trước khi bạn có thể xem liệu nó có đáp ứng được những gì bạn cần hay không. Hãy thử nó trên tập tin mà bạn thực sự đang gặp khó khăn thay vì một tập tin mẫu.
troubleshootingPDF có thể tìm kiếm giúp bạn hoàn thành công việc như thế nào
Những vấn đề thực tế mà nó giải quyết hàng ngày — cho doanh nghiệp, người sáng tạo và các công việc hàng ngày. Tìm trường hợp sử dụng phù hợp với bạn và bắt đầu.
Kho lưu trữ tài liệu pháp lý có thể tìm kiếm
Các công ty luật thêm các lớp văn bản OCR vào các hợp đồng, lời khai và tài liệu khám phá được quét để trợ lý pháp lý có thể Ctrl+F trên hàng nghìn trang trong quá trình kiện tụng.
Kho lưu trữ hồ sơ nhân sự
Các nhóm nhân sự chuyển đổi hồ sơ nhân viên được quét, thư mời làm việc và hợp đồng đã ký thành file PDF có thể tìm kiếm, để bất kỳ ai có quyền truy cập đều có thể nhanh chóng tìm thấy bằng tìm kiếm toàn văn.
Thư viện tham khảo của nhà nghiên cứu
Các học giả và nghiên cứu sinh biến các bài báo tạp chí đã quét và bản photocopy từ thư viện thành PDF có thể tìm kiếm, để các trích dẫn xuất hiện ngay lập tức khi tổng quan tài liệu.
Kho lưu trữ công thức và sách nấu ăn có thể tìm kiếm
Những người nấu ăn tại nhà số hóa sách dạy nấu ăn gia đình và tạp chí công thức nấu ăn cũ thành các tệp PDF có thể tìm kiếm được mà họ có thể truy vấn theo thành phần — tìm mọi công thức làm bánh sô cô la.
Tra cứu bằng sáng chế và nhãn hiệu
Chuyên gia sở hữu trí tuệ chuyển các văn bằng sáng chế và hồ sơ đăng ký nhãn hiệu được quét thành PDF có thể tìm kiếm để tra cứu từ khóa tình trạng kỹ thuật đã biết và hồ sơ của đối thủ mà không bỏ sót nội dung ẩn trong hình vẽ.
Dấu vết kiểm toán sao kê ngân hàng
Kiểm toán viên và kế toán pháp y chuyển sao kê ngân hàng đã quét thành PDF có thể tìm kiếm, để họ tra cứu được người nhận, số tiền và ngày tháng cụ thể trong hồ sơ của nhiều năm.
Kho lưu trữ tài liệu thuế
Cá nhân và doanh nghiệp nhỏ chuyển các tờ khai thuế, biên lai và mẫu 1099 đã quét thành PDF có thể tìm kiếm được mà cơ quan thuế IRS, CRA hay HMRC chấp nhận và bạn có thể tự kiểm tra.
Sách đã quét có thể tìm kiếm
Người chơi sách, thủ thư và thợ đóng sách chuyển những cuốn sách đã ngừng in được quét thành các tệp PDF tìm kiếm được hoạt động như ebook — văn bản có thể chọn, sao chép và được lập chỉ mục bởi máy đọc sách điện tử.
Số hóa hồ sơ chính phủ và hồ sơ công
Thư ký thành phố và lưu trữ đô thị thêm lớp văn bản OCR vào giấy phép, hồ sơ đất đai và hồ sơ hộ tịch đã quét để nhân viên và người dân có thể tìm một thửa đất, tên hoặc số hồ sơ cụ thể bằng Ctrl+F thay vì lật từng thùng tài liệu.
Lưu trữ chứng thư và tài liệu chốt giao dịch bất động sản
Các công ty quản lý giấy tờ sở hữu và môi giới biến các văn tự, bản khảo sát và hồ sơ hoàn tất giao dịch được quét thành PDF tìm kiếm được, nên việc tra một số thửa đất hay tên người mua qua nhiều năm giao dịch chỉ mất vài giây thay vì phải xuống phòng lưu trữ.
Tìm kiếm tài liệu cho báo chí điều tra
Phóng viên chuyển các tài liệu quét bị rò rỉ hoặc lấy được qua FOIA thành PDF có thể tìm kiếm để họ có thể lùng hàng nghìn trang tìm một cái tên, ngày tháng hay số tiền khi xây dựng một câu chuyện.
Lưu trữ bản vẽ hoàn công cơ sở vật chất & kỹ thuật
Quản lý cơ sở vật chất và đội kỹ thuật thêm lớp văn bản OCR vào bản vẽ hoàn công, bản thiết kế và sổ tay thiết bị đã quét để việc tìm kiếm mã linh kiện, nhãn phòng hoặc số model qua hàng chục năm hồ sơ tòa nhà chỉ mất vài giây thay vì phải trải các bản vẽ giấy ra.
Hướng dẫn cho công cụ này
- How to Convert Image Text to PDF: Searchable Pages or Editable TextTurn image text into a searchable PDF or an editable document. Compare both Pixoate workflows and choose the right output for your paperwork.
- How to Make Scanned Business Records Searchable by Name or Invoice NumberMake photographed business records searchable with Pixoate. Find names and invoice numbers while preserving a readable copy of the original page.
Ngắm nhìn từng vùng đất chuyển hóa
Mỗi bức ảnh đều vượt qua dấu gạch chéo và đi ra phía bên kia.


























