·5分钟阅读

Mac 预览的 OCR 局限——它遗漏了什么

预览能打开图片和 PDF,但无法从大多数图片和 PDF 中提取文字。如果你曾试图在预览中从扫描 PDF 或照片里复制文字却一无所获,原因就在这里。

预览是 macOS 默认的图片和 PDF 查看器,很多用户以为它能处理 OCR——从图片和扫描文档中识别并提取文字。在有限的场景下它确实可以,这要归功于实况文本的整合。但在许多常见场景下,预览要么悄无声息地无法识别文字,要么根本不提供任何提取能力。如果你曾在预览里试图从一份扫描 PDF 或一张文档照片中选中文字,而你的光标只是画出一个没有任何文字高亮的选框,那你就撞上了预览 OCR 能力的边界。

预览的文字识别在哪些地方会失效

布局复杂的扫描 PDF。预览有时能识别干净、排版规整的单栏文档中的文字。但多栏布局、表格、页眉页脚,以及图形与文字混排的文档,往往完全无法产生可选中的文字。预览中的实况文本引擎并不能可靠地处理复杂的文档结构。

低对比度或小号文字。收据扫描件、褪色文档,以及文字与背景对比度低的图片,经常会让预览的识别失败。这些文字对人眼来说完全可读,对预览的检测机制来说却视而不见。

手写文字。预览的文字识别是针对印刷字体调校的。手写笔记、白板照片和带批注的文档,即便字迹工整清晰,也很少能被识别出来。

非拉丁文字系统。对非拉丁语言的支持并不稳定。图片中的中日韩文字、阿拉伯文和西里尔字母文字能否被检测出来,取决于字体样式、图片质量和文档复杂度。

无法从屏幕捕获。预览只能处理你已经打开的文件。如果你需要的文字在视频画面、网页应用界面、错误对话框,或另一个应用的窗口里,预览根本无法触及。

覆盖屏幕上一切内容的 OCR

Optic 通过在屏幕层面工作,完全绕开了预览的局限。它不是让一个文件查看器去识别文件内部的文字,而是直接从显示器上可见的内容中读取字符。在预览——或任何其他应用——中打开那份有问题的文档,用 Optic 的选框拖过你需要的文字。

Optic overcoming Preview OCR limitations on Mac

复杂的文档布局

让预览束手无策的表格、多栏文字和混合内容,对 Optic 来说都可以读取,因为你可以自己控制要扫描的确切区域。只选中你需要的那一列或那一个表格单元格——不需要解析整页内容。

超越文件本身

Optic 不局限于已打开的文件。视频画面、对话框、网页应用、远程桌面会话——任何渲染在屏幕上的内容都可以处理。预览永远无法触及这些来源;Optic 却能像处理普通图片一样自然地读取它们。

持久的历史记录

预览对过去的文字识别尝试没有任何记忆。Optic 会把每一次提取都保存在菜单栏里,建立起一份可以随时滚动查看和重新复制的捕获文字日志。

在 Mac App Store 获取 Optic

下一篇文章

Optic

Select any text on screen and copy it — images, PDFs, dialogs, anything.

Get Optic on the Mac App Store