跳到主要内容
File Acture

如何在 Windows 上让扫描的 PDF 可以搜索

截图工具的“文本操作”和 PowerToys 的 Text Extractor 能从屏幕上的扫描页面复制文字,但不会把它存进 PDF,所以在 Edge 里搜索仍然一无所获。File Acture 的“OCR PDF”会在你的电脑上识别文字,并把它作为不可见的图层嵌入,生成一份和扫描件看起来一模一样、却可以搜索的副本。

更新于 2026年9月24日阅读约 5 分钟

File Acture 团队

你扫描了一沓收据或一份已签署的合同,结果在 Edge 里按 Ctrl+F 什么也找不到。这是因为扫描仪把每一页都存成了图像。OCR,也就是光学字符识别,会读出图像中的字母并把它们存为真正的文本,这样文件在外观不变的前提下变得可以搜索。

为什么扫描的 PDF 不能搜索或复制文字?

扫描的 PDF 搜不了,是因为它装的是每一页的照片,而不是字母本身。平板扫描仪、手机扫描应用和办公室的复印机通常都这样保存页面,除非它们在扫描时顺便做了 OCR。

结果就是:文件看着像文档,用起来却像相册。在 Edge 里查找什么都找不到,没法选中一行文字,也没法把账号复制到邮件里,最后只能重新手打一遍。

Windows 自带工具能对 PDF 做 OCR 吗?

Windows 能读出屏幕上的文字,但无法给 PDF 添加文本层,所以没办法让扫描件变得可搜索。Microsoft Edge 能显示扫描件,也能在上面绘制或添加文本,但没有把识别出的文字存进文件的选项。

在 Windows 11 中,截图工具可以读出文字:按 Windows 徽标键 + Shift + S,截取页面的一部分,在截图工具中打开截图,单击文本操作,然后复制文字。PowerToys 是一款需要单独安装的免费 Microsoft 应用,它提供的 Text Extractor 可以从屏幕上的任何内容中复制文字。需要抓一个电话号码或地址时,两者都很方便。

问题在于,什么都没有写进文件里。Edge 的搜索、其他应用以及收到这份 PDF 的人,拿到的仍然是一张图片。如果这份文档以后要搜索,或者要交给别人,文字就必须嵌入 PDF 本身。

如何用 File Acture 在 Windows 上对 PDF 做 OCR

File Acture 的“OCR PDF”会在你的电脑上对每个扫描页面运行文字识别,并把结果作为不可见的文本层嵌到原始图像之上。页面看起来和之前完全一样,但你可以搜索它、选中整行并复制。

开始之前先选择文档的语言:让识别引擎知道该期待什么,效果会更好,对带重音符号的文字和非拉丁字母的文字尤其如此。

一次运行可以处理多个 PDF。每个 PDF 都会得到一份可搜索的副本,作为新文件保存在你选择的文件夹中,原始扫描件保持不变。

怎么确认 OCR 成功了?

在 Edge 中打开可搜索的副本并按 Ctrl+F:页面上能看到的词应该会在原位高亮。你也可以拖过某一行把它选中,或者把复制的段落粘贴到记事本里,看看究竟识别出了什么。

在 Windows 上获得更好 OCR 效果的技巧

OCR 的效果取决于扫描件本身,页面越正、越清晰,识别出的文字就越准。

  • 选好语言。选择文档的语言,等于告诉识别引擎该期待什么,这对带重音符号的文字和非拉丁文字尤其重要。
  • 用 300 DPI 扫描。如果扫描仪在你手上,300 DPI 是适合文字的设置。再低很多,小号字就会糊成难以辨认的色块。
  • 先把页面摆正。旋转页面把横置的页面转正,再运行 OCR。
  • 拍的是文档照片?先用图像转 PDF 把它们合成一个 PDF,再对结果运行 OCR。
  • 扫描件受密码保护?先用解锁 PDF 移除密码,对副本运行 OCR,再用保护 PDF 重新保护可搜索的副本。
  • 留意文件大小。OCR 只是添加文字,并不会缩小图像。如果副本大到发不出去,就对它运行压缩 PDF,文本层会原样保留。

在线做 OCR 安全吗?

在线 OCR 服务需要把你的文档放到它们的服务器上,而这对银行对账单、就医记录和身份证件扫描件来说很要紧。File Acture 在你的电脑上运行文字识别,页面不会离开这台电脑;免费版联网只是为了统计运行次数。

免费版在每台电脑上包含 3 次运行,每次最多 5 个 PDF。要处理大量扫描存档,请查看价格

要把结果上传到申请门户?请看如何在不毁掉扫描件的前提下满足大小限制

如何用 File Acture 让扫描的 PDF 可以搜索

  1. 1

    打开“OCR PDF”

    选择 OCR PDF,然后拖入扫描的 PDF,或单击选取文件…

  2. 2

    设置语言

    选择文档的语言,让识别引擎知道该期待哪些字符。

  3. 3

    识别文本

    单击识别文本。每个 PDF 都会得到一份可搜索的副本,原始文件保持原样。

  4. 4

    检查结果

    在 Edge 中打开副本,按 Ctrl+F,搜索页面上能看到的一个词。

在你的电脑上,把扫描的 PDF 变成可以搜索的文件。

免费试用 · 在你的电脑上运行

在 Windows 上从扫描件中取出文字
方法生成可搜索的 PDF一次处理多个文件留在你的电脑上
截图工具,“文本操作”否,一次截一张
PowerToys Text Extractor否,一次选一处
在线 OCR 网站视情况而定否,文件会被上传
File Acture“OCR PDF”

常见问题

不装额外软件,Windows 能让 PDF 变得可搜索吗?

不能。Edge 可以显示和标记 PDF,截图工具的“文本操作”可以从截图中复制文字,但 Windows 自带的任何工具都不会把文本层存进文件。

OCR 会改变 PDF 的外观吗?

不会。识别出的文字是不可见的,位于原始页面图像之上,所以页面看起来一样,而查找和复制都能用。

能一次对多个扫描的 PDF 做 OCR 吗?

可以。把它们全部添加到“OCR PDF”,单击“识别文本”,每个文件都会得到各自的可搜索副本。免费版每次运行最多处理 5 个 PDF。

OCR 之后为什么有些文字没了?

模糊、过小或横置的文字可能识别不出来。把页面转正,条件允许时用更高分辨率重新扫描,并确认已选择文档的语言。

能对受密码保护的 PDF 做 OCR 吗?

可以,前提是你知道密码。先用“解锁 PDF”移除密码,对解锁后的副本运行 OCR,再用“保护 PDF”把密码加回去。

做 OCR 时我的扫描件会被上传吗?

不会。File Acture 在你的电脑上识别文字,文件从不离开这台电脑。免费版联网只是为了统计运行次数。

相关指南