跳到主要内容
File Acture

如何在 Mac 上让扫描的 PDF 可以搜索

“预览”和“实况文本”能读出扫描页面上的文字,但不会把它存进 PDF,所以查找和聚焦看到的仍然只是一张图片。File Acture 的“OCR PDF”会在你的 Mac 上识别文字,并把它作为不可见的图层嵌入,生成一份和扫描件看起来一模一样、却可以搜索的副本。

更新于 2026年9月23日阅读约 5 分钟在 macOS 26 上使用 File Acture 1.0.9 测试

File Acture 团队

你扫描了一沓收据或一份已签署的合同,结果按 Command-F 什么也找不到。这是因为扫描仪把每一页都存成了图像。OCR,也就是光学字符识别,会读出图像中的字母并把它们存为真正的文本,这样文件在外观不变的前提下变得可以搜索。

为什么扫描的 PDF 不能搜索或拷贝文字?

扫描的 PDF 搜不了,是因为它装的是每一页的照片,而不是字母本身。平板扫描仪、手机扫描 App 和办公室的复印机通常都这样保存页面,除非它们在扫描时顺便做了文字识别。

结果就是:文件看着像文稿,用起来却像相册。在“预览”里按 Command-F 什么都找不到,聚焦无法凭内容找到这个文件,账号也没法拷贝到邮件里,屏幕阅读器更是无字可读。

“预览”能在 Mac 上对 PDF 做 OCR 吗?

“预览”无法给 PDF 添加文本层,所以它没办法让扫描件变得可搜索。macOS 的“实况文本”可以让你选中图像里的文字,需要抓一个电话号码或地址时很方便。

问题在于,什么都没有写进文件里。聚焦、其他 App 以及收到这份 PDF 的人,拿到的仍然是一张图片。如果这份文稿以后要搜索,或者要交给别人,文字就必须嵌入 PDF 本身。

如何用 File Acture 在 Mac 上对 PDF 做 OCR

File Acture 的“OCR PDF”会对每个扫描页面运行 Apple 的 Vision 文本识别,并把结果作为不可见的文本层嵌到原始图像之上。页面看起来和之前完全一样,但你可以搜索它、选中整行并拷贝。

你可以选择文档语言:“自动检测”,或者英语、土耳其语、德语、法语、西班牙语、意大利语、葡萄牙语、俄语、中文、日语和韩语中的一种。准确度提供默认的“高精度”,识别更仔细;以及“快速”,适合一长串干净的印刷页面。已经含有文本的页面会原样拷贝,所以混有录入页和扫描页的 PDF 不会出现重复文字。

遇到受密码保护的 PDF 会出现密码字段,生成的可搜索副本会用同一个密码重新保护。文稿的标题、作者、主题和关键词都会保留,每份副本的文件名都会加上“-searchable”。一次运行可以处理多个 PDF,你的原始文件保持不变。

怎么确认 OCR 成功了?

打开可搜索的副本并按 Command-F:页面上能看到的词应该会在原位高亮。你也可以拖过某一行把它选中,或者把拷贝的段落粘贴到备忘录里,看看究竟识别出了什么。聚焦会索引 PDF 中的文字,等它建好索引后,输入文稿里的一句话就能找到这个文件。

在 Mac 上获得更好 OCR 效果的技巧

OCR 的效果取决于扫描件本身,页面越正、越清晰,识别出的文字就越准。

  • 选好语言。“自动检测”对很多文稿都够用,但指定语言等于告诉识别引擎该期待什么,这对中文、日语、韩语和俄语尤其重要。
  • 用 300 DPI 扫描。如果扫描仪在你手上,300 DPI 是适合文字的设置。再低很多,小号字就会糊成难以辨认的色块。
  • 先把页面摆正。旋转页面把横置的页面转正,再运行 OCR。
  • 拍的是文稿照片?先用图像转 PDF把它们合成一个 PDF,再对结果运行 OCR。
  • 保留原始文件。OCR 副本是逐页重绘的,所以链接、书签和表单域不会带过去。
  • 留意文件大小。OCR 只是添加文字,并不会缩小图像。如果副本大到发不出去,就对它运行压缩 PDF,文本层会原样保留。

在线做 OCR 安全吗?

在线 OCR 服务需要把你的文稿放到它们的服务器上,而这对银行对账单、就医记录和身份证件扫描件来说很要紧。File Acture 在你的 Mac 上运行文字识别,页面不会离开这台机器;Pro 无需联网即可使用,只会偶尔联网续期授权。

免费版在每台 Mac 上包含 3 次运行,每次最多 5 个 PDF。要处理大量扫描存档,请查看价格

如何用 File Acture 让扫描的 PDF 可以搜索

  1. 1

    打开“OCR PDF”

    在边栏中选择 OCR PDF,然后拖入扫描的 PDF,或点按选取文件…

  2. 2

    设置语言

    识别下选择文档语言,并把准确度保持在高精度

  3. 3

    按需输入密码

    如果 PDF 受密码保护,在出现的密码字段中输入它的密码。

  4. 4

    识别文本

    点按识别文本。每份副本的文件名都会加上“-searchable”。

  5. 5

    检查结果

    打开副本,按 Command-F,搜索页面上能看到的一个词。

在你的 Mac 上,把扫描的 PDF 变成可以搜索的文件。

免费试用 · macOS 14 或更高版本

在 Mac 上从扫描件中取出文字
方法生成可搜索的 PDF一次处理多个文件留在你的 Mac 上
“实况文本”否,一次只能选一处
“预览”否,它没有 OCR
在线 OCR 网站视情况而定否,文件会被上传
File Acture“OCR PDF”

常见问题

“预览”能让 PDF 变得可搜索吗?

不能。“预览”可以显示和标记 PDF,“实况文本”可以从图像中拷贝文字,但两者都不会把文本层存进文件。

OCR 会改变 PDF 的外观吗?

不会。识别出的文字是不可见的,位于原始页面图像之上,所以页面看起来一样,而查找和拷贝都能用。

File Acture 能识别哪些语言?

英语、土耳其语、德语、法语、西班牙语、意大利语、葡萄牙语、俄语、中文、日语和韩语。也可以保持在“自动检测”。

OCR 之后为什么有些文字没了?

模糊、过小或横置的文字可能识别不出来。把页面转正,条件允许时用更高分辨率重新扫描,并把“准确度”保持在“高精度”。

能对受密码保护的 PDF 做 OCR 吗?

可以,前提是你知道密码。在“密码”字段中输入它,生成的可搜索副本会用同一个密码保护。

OCR 会保留链接和书签吗?

不会。页面会连同文本层一起重绘,所以链接、书签和表单域不会带过去。需要它们的话,请保留原始文件。

相关指南