如何在 Windows 上让扫描的 PDF 可以搜索
截图工具的“文本操作”和 PowerToys 的 Text Extractor 能从屏幕上的扫描页面复制文字,但不会把它存进 PDF,所以在 Edge 里搜索仍然一无所获。File Acture 的“OCR PDF”会在你的电脑上识别文字,并把它作为不可见的图层嵌入,生成一份和扫描件看起来一模一样、却可以搜索的副本。
更新于 2026年9月24日阅读约 5 分钟
File Acture 团队
你扫描了一沓收据或一份已签署的合同,结果在 Edge 里按 Ctrl+F 什么也找不到。这是因为扫描仪把每一页都存成了图像。OCR,也就是光学字符识别,会读出图像中的字母并把它们存为真正的文本,这样文件在外观不变的前提下变得可以搜索。
为什么扫描的 PDF 不能搜索或复制文字?
扫描的 PDF 搜不了,是因为它装的是每一页的照片,而不是字母本身。平板扫描仪、手机扫描应用和办公室的复印机通常都这样保存页面,除非它们在扫描时顺便做了 OCR。
结果就是:文件看着像文档,用起来却像相册。在 Edge 里查找什么都找不到,没法选中一行文字,也没法把账号复制到邮件里,最后只能重新手打一遍。
Windows 自带工具能对 PDF 做 OCR 吗?
Windows 能读出屏幕上的文字,但无法给 PDF 添加文本层,所以没办法让扫描件变得可搜索。Microsoft Edge 能显示扫描件,也能在上面绘制或添加文本,但没有把识别出的文字存进文件的选项。
在 Windows 11 中,截图工具可以读出文字:按 Windows 徽标键 + Shift + S,截取页面的一部分,在截图工具中打开截图,单击文本操作,然后复制文字。PowerToys 是一款需要单独安装的免费 Microsoft 应用,它提供的 Text Extractor 可以从屏幕上的任何内容中复制文字。需要抓一个电话号码或地址时,两者都很方便。
问题在于,什么都没有写进文件里。Edge 的搜索、其他应用以及收到这份 PDF 的人,拿到的仍然是一张图片。如果这份文档以后要搜索,或者要交给别人,文字就必须嵌入 PDF 本身。
如何用 File Acture 在 Windows 上对 PDF 做 OCR
File Acture 的“OCR PDF”会在你的电脑上对每个扫描页面运行文字识别,并把结果作为不可见的文本层嵌到原始图像之上。页面看起来和之前完全一样,但你可以搜索它、选中整行并复制。
开始之前先选择文档的语言:让识别引擎知道该期待什么,效果会更好,对带重音符号的文字和非拉丁字母的文字尤其如此。
一次运行可以处理多个 PDF。每个 PDF 都会得到一份可搜索的副本,作为新文件保存在你选择的文件夹中,原始扫描件保持不变。
怎么确认 OCR 成功了?
在 Edge 中打开可搜索的副本并按 Ctrl+F:页面上能看到的词应该会在原位高亮。你也可以拖过某一行把它选中,或者把复制的段落粘贴到记事本里,看看究竟识别出了什么。
在 Windows 上获得更好 OCR 效果的技巧
OCR 的效果取决于扫描件本身,页面越正、越清晰,识别出的文字就越准。
在线做 OCR 安全吗?
在线 OCR 服务需要把你的文档放到它们的服务器上,而这对银行对账单、就医记录和身份证件扫描件来说很要紧。File Acture 在你的电脑上运行文字识别,页面不会离开这台电脑;免费版联网只是为了统计运行次数。
免费版在每台电脑上包含 3 次运行,每次最多 5 个 PDF。要处理大量扫描存档,请查看价格。
要把结果上传到申请门户?请看如何在不毁掉扫描件的前提下满足大小限制。
如何用 File Acture 让扫描的 PDF 可以搜索
- 1
打开“OCR PDF”
选择 OCR PDF,然后拖入扫描的 PDF,或单击选取文件…。
- 2
设置语言
选择文档的语言,让识别引擎知道该期待哪些字符。
- 3
识别文本
单击识别文本。每个 PDF 都会得到一份可搜索的副本,原始文件保持原样。
- 4
检查结果
在 Edge 中打开副本,按 Ctrl+F,搜索页面上能看到的一个词。
在你的电脑上,把扫描的 PDF 变成可以搜索的文件。
免费试用 · 在你的电脑上运行
| 方法 | 生成可搜索的 PDF | 一次处理多个文件 | 留在你的电脑上 |
|---|---|---|---|
| 截图工具,“文本操作” | 否 | 否,一次截一张 | 是 |
| PowerToys Text Extractor | 否 | 否,一次选一处 | 是 |
| 在线 OCR 网站 | 是 | 视情况而定 | 否,文件会被上传 |
| File Acture“OCR PDF” | 是 | 是 | 是 |
常见问题
不装额外软件,Windows 能让 PDF 变得可搜索吗?
不能。Edge 可以显示和标记 PDF,截图工具的“文本操作”可以从截图中复制文字,但 Windows 自带的任何工具都不会把文本层存进文件。
OCR 会改变 PDF 的外观吗?
不会。识别出的文字是不可见的,位于原始页面图像之上,所以页面看起来一样,而查找和复制都能用。
能一次对多个扫描的 PDF 做 OCR 吗?
可以。把它们全部添加到“OCR PDF”,单击“识别文本”,每个文件都会得到各自的可搜索副本。免费版每次运行最多处理 5 个 PDF。
OCR 之后为什么有些文字没了?
模糊、过小或横置的文字可能识别不出来。把页面转正,条件允许时用更高分辨率重新扫描,并确认已选择文档的语言。
能对受密码保护的 PDF 做 OCR 吗?
可以,前提是你知道密码。先用“解锁 PDF”移除密码,对解锁后的副本运行 OCR,再用“保护 PDF”把密码加回去。
做 OCR 时我的扫描件会被上传吗?
不会。File Acture 在你的电脑上识别文字,文件从不离开这台电脑。免费版联网只是为了统计运行次数。