

可搜索 PDF 制作工具 — 为扫描件和照片添加 OCR 文本图层
Ctrl-F 在扫描文档中找不到任何内容,因此您阅读了所有 40 页,寻找一行。添加 OCR 文本图层,扫描件将变得可搜索。
- 查找扫描中的任何行,而不是一页一页地阅读
- 每一页都保持与扫描时完全相同的可见性
- 最多 20 个图片页面 · 每个 8 MB
接受图片文件,而非现有的 PDF 文档
上传图片
按顺序拖入扫描件或照片 —— 为每一页添加可搜索的文字层
可选多张——每张图片成为一个 PDF 页面
使用 可搜索的 PDF 可以做什么
在开始之前查看主要功能。
- 让扫描版 PDF 可搜索、可选中文字
- 为图片型 PDF 添加隐藏的 OCR 文本层
- 复制并高亮扫描页面中的文字
- 在扫描文档中查找任意文字
- 将拍摄的文档转换为可搜索的文件
- 按你选择的语言识别文字
设置参考
7 个设置
可搜索的 PDF 的可用控件。
模式
- PDF 应该做什么?预设
- 将图片放到普通 PDF 页面上而不做识别,或保留其可见并添加 OCR 文字层,以便搜索、选取和复制。选项: 创建普通 PDF让文字可搜索
- 文档语言下拉框
- 选择文档识别引擎在添加可搜索文字层时使用的语言,初始选择为英语。选项: 英语法语德语西班牙语意大利语葡萄牙语荷兰语俄语日语韩语中文(简体)中文(繁体)阿拉伯语印地语孟加拉语旁遮普语乌尔都语越南语泰语波兰语瑞典语丹麦语挪威语芬兰语土耳其语乌克兰语印尼语泰米尔语泰卢固语马拉地语尼泊尔语波斯语希腊语希伯来语
页面
- PDF 页面(拖动或使用箭头重新排序)一键
- 拖动页面行或使用上下箭头按钮,设置图片在最终 PDF 中的排列顺序。
输出
- 纸张尺寸预设
- 选择页面格式:标准 A4 或 Letter 纸张适合打印,“图片适配”则让每一页 PDF 的尺寸与其图片完全一致。选项: A4信图片适配
- 方向预设
- 将 A4 或 Letter 页面设为竖版或横版,以匹配你多数照片的拍摄方向;当「纸张尺寸」为「贴合图片」时不可用。选项: 纵向横向
- 页边距滑块范围: 0–40mm · 默认: 10mm
- 为页面上每张图片添加留白,从 0 mm 无边距到 40 mm;纸张尺寸设为“图片适配”时不可用。
- 输出文件名文字输入
- 为浏览器下载的 PDF 文件命名;默认为 combined.pdf,在制作多份文档时便于区分每次导出的文件。
常见问题
普通的图像 PDF 只是一张包在 .pdf 容器里的平面图片——你无法选中、复制或搜索其中的文字。可搜索 PDF 则在每个可见字符背后对齐放置了一层隐形的 OCR 文本层,因此 Ctrl+F 能找到词语、复制功能可用、屏幕阅读器也能朗读页面,而视觉外观保持完全一致。
usageOCR 引擎会读取每个单词,并将其文本和边界框以精确的像素坐标存储在原始图像之后。页面在视觉上与原始扫描件完全一致,但 Adobe Acrobat、预览、Chrome 以及所有现代 PDF 阅读器现在都能像处理原生数字文本一样选择、搜索和复制其中的文字。
technical是的。文本层是标准 PDF(无专有扩展),因此 Adobe Acrobat(Reader 和 Pro)、macOS Preview、Chrome 的内置 PDF 查看器、Firefox、Edge 以及文件应用程序、Drive 和 Dropbox 等移动阅读器都会对其进行索引和搜索。即使在长扫描报告中,Ctrl+F 或 Cmd+F 也可以查找单词。
features可以。传入多个语言代码(例如 eng+chi_sim+hin),OCR 在识别字符时会同时考虑它们。双语菜单、国际合同和政府表单等混合文字的文档都能顺利处理。为获得最佳效果,请将最可能的语言排在列表首位。
features文本层通常会使 PDF 大小增加 5–15%——每 100 页一般增加几百 KB。相比由此获得的好处(可在整个文档库中进行全文搜索),这点代价微不足道。如果文件大小对邮件发送很重要,可将结果再用 PDF 压缩工具处理一遍,进一步精简体积较大的内嵌图片。
technical上传内容将在临时工作文件夹中进行处理,并根据我们的安全政策进行删除。如果您明确创建共享链接,则拥有该链接的任何人都可以在最多 30 天内访问结果。在处理敏感文档之前,请查看安全策略和您组织的要求。
privacy此工具读取图片文件(JPG、PNG、TIFF、扫描件和照片),返回一份可搜索的 PDF。如果你已经有一份多页扫描 PDF,请先用「PDF 转图片」工具把它拆分成多张页面图片,再把这些图片拖到这里,即可得到一份经 OCR 处理、可搜索的 PDF。
usage上传 JPG、PNG、WEBP、GIF、TIFF 或 BMP — 手机照片、平板扫描件和截图都可以。OCR 引擎会识别文字,并将其包裹在图片背后的隐形图层中,因此最终得到的是一份普通的可搜索 PDF,任何阅读器都能打开。
features可搜索的 PDF 需要在扫描件上逐字精确叠加一层不可见文本,只有引擎 1 和引擎 2 能生成这层文本——应用中其他位置使用的“默认”引擎无法做到。引擎 1 支持的语言最广;引擎 2 在处理风格化或质量较低的扫描件时表现更好。
technical打开「设置」中的语言选择器并选择文档语言(默认英文)——这是影响 OCR 准确度最重要的一项设置,因为引擎的字符识别是针对特定语言的。更改后点击「重新运行转换」,以用全新的文本层重建 PDF。
usage选择 Engine 1,因为它的语言覆盖更广,并把语言选择器设为合同的主要语言。如果搜索时第二语言的关键章节仍然无法匹配,再进行一次转换,选用 Engine 2 或选中第二语言重新处理一遍。
tips它会自动更新——切换引擎或语言下拉框会立即用新设置重新处理已上传的图片并重建可搜索的 PDF,无需点击。“重新运行转换”按钮主要用于以完全相同的设置再试一次,例如在某次转换失败或短暂网络中断之后。
technical如果按 Ctrl+F 搜索不到任何内容,这份 PDF 几乎可以肯定是扫描件——页面本质上是图片,底下没有文字。把文件放进这个可搜索 PDF 转换工具:OCR 会逐页识别并添加一层隐形文字,让搜索、高亮和复制粘贴在任何阅读器里都能正常使用,而页面画面本身则保持像素级不变。
technical您不需要 Acrobat 或安装的软件。在免费限额内上传扫描件、预览可搜索结果并下载标准 PDF,无需创建帐户。输出可在任何 PDF 查看器中打开。
pricing几乎总是以下三种原因之一:文件超过 11 MB 的免费上传上限——Premium 支持 50 MB,Pro 支持 120 MB;文件格式不受此工具支持,请查看上传面板显示的格式列表;或者文件的真实格式与文件名不符。重命名不会改变文件内部格式,这正是看似有效的 PDF 仍会被拒绝的原因。
troubleshootingPDF 存储每个字符在页面上的位置,而不是文字处理器工作的段落和样式,因此转换意味着通过推理重建该结构。复杂的列、表格和围绕图像的文本是它漂移的地方。如果外观比可编辑性更重要,请选择视觉模式;如果您需要输入内容,请选择可编辑模式并期望修复奇怪的标题。
troubleshooting不需要。您无需帐户即可运行可搜索 PDF 并下载免费结果,并且它没有水印。高级版是当限制开始出现时您购买的:更大的上传量、无每日上限以及原始分辨率结果。下载步骤中不会显示任何在开始之前不可见的内容。
pricing否 — 可搜索 PDF 在桌面和手机上的浏览器中运行。在您看到它是否满足您的需要之前,无需安装任何东西,无需试用,也无需购买许可证。在您实际遇到的文件而不是样本上尝试一下。
troubleshooting可搜索的 PDF 如何助您完成任务
它每天为企业、创作者和日常任务解决实际问题。找到适合您的用例并开始。
可搜索的法律文档档案
律师事务所将 OCR 文本图层添加到扫描的合同、证词和证据开示文件中,以便律师助理可以在诉讼期间使用 Ctrl+F 浏览数千页内容。
人力资源与人事档案库
人力资源团队将扫描的员工档案、录用通知书和已签署合同转换为可搜索的 PDF,任何有权限的人都能通过全文搜索快速找到。
研究者参考资料库
学者和研究生将扫描的期刊论文和图书馆复印件转换为可搜索 PDF,从而在文献综述时即时检索引文和参考文献。
可搜索的食谱与菜谱档案
家庭厨师将家庭食谱和旧食谱杂志数字化为可搜索的 PDF,他们可以按成分查询 - 找到每个巧克力蛋糕食谱。
专利和商标检索
知识产权专业人士将扫描的专利授权书和商标申请文件转换为可搜索的 PDF,从而检索现有技术关键词和竞争对手的申请,不会遗漏藏在图表中的文字。
银行对账单审计追踪
审计师与法务会计师将扫描的银行对账单转换为可搜索的 PDF,以便在数年的记录中检索特定收款方、金额和日期。
税务文档存档
个人和小企业可将扫描的纳税申报表、收据和 1099 表单转换为可搜索的 PDF,既能被 IRS、CRA 或 HMRC 受理,也方便你自行核查。
可搜索的扫描书籍
爱好者、图书馆员和装帧师将扫描的绝版书转换为可搜索的 PDF,使其像电子书一样——文字可选中、可复制,并能被电子阅读器索引。
政府与公共档案数字化
市政书记员和市政档案馆为扫描的许可证、土地记录和户籍记录添加 OCR 文本层,使工作人员和市民能够用 Ctrl+F 查找特定的地块、姓名或立案编号,而无需逐箱翻找。
房产契据和成交文件归档
产权公司和经纪人将扫描的地契、测绘图和过户资料包转成可搜索的 PDF,这样在多年交易中搜索地块编号或买方姓名只需几秒,而不必跑一趟档案室。
调查性新闻文档检索
记者将泄露的或通过《信息自由法》获取的扫描文件转换为可搜索的 PDF,以便在撰写报道时能在数千页中检索某个人名、日期或金额。
设施与工程竣工图档案
设施管理者和工程团队为扫描的竣工图、蓝图和设备手册添加 OCR 文本层,这样在数十年的建筑记录中搜索零件号、房间标签或型号只需几秒,而无需展开实体图纸。
本工具指南
- How to Convert Image Text to PDF: Searchable Pages or Editable TextTurn image text into a searchable PDF or an editable document. Compare both Pixoate workflows and choose the right output for your paperwork.
- How to Make Scanned Business Records Searchable by Name or Invoice NumberMake photographed business records searchable with Pixoate. Find names and invoice numbers while preserving a readable copy of the original page.
观看每一个转变土地
每张照片都原封不动地穿过斜线,并在另一边完成。


























