·4分钟阅读

在 Mac 上把任何屏幕内容转换为语音

你想听屏幕上的文字——来自一张图片、一份扫描的 PDF、一个视频画面——但 Mac 的语音工具只对能高亮的文字有效。

macOS 内置了一个朗读所选内容的功能,可以把选中的文字朗读出来。在 Safari 里高亮一段文字,右键点击,你的 Mac 就会把它读出来。这个功能效果不错——直到你需要朗读的文字根本无法被高亮。一张带有关键数据的信息图。一份没有文本图层的扫描文档。烧录进视频画面里的字幕。在网页应用中以图形形式渲染的文字。在所有这些情况下,macOS 的朗读所选内容功能都无从下手,因为没有可选中的文字可以喂给它。

大多数屏幕文字都无法被选中

现代 Mac 屏幕上无法选中的文字数量,比大多数人意识到的要多得多。带文字叠加的图片、canvas 渲染的网页应用、PDF 扫描件、视频画面、远程桌面会话、对话框、使用自定义渲染标签的应用界面——所有这些都会显示可读的文字,而 macOS 却把它们都当作图片的一部分处理。你能看见它,能用眼睛读懂它,但你没法选中它,也就没法把它送进语音引擎。

对于依赖音频输出来实现无障碍访问、校对、多任务处理,或语言学习的用户来说,这个鸿沟是一个真实存在的障碍。文字就在屏幕上,语音引擎也在同一台设备上,但对于不可选中的内容,两者之间却没有任何桥梁。

选中屏幕上的任何内容,让它被朗读出来

Optic 把屏幕级 OCR 和文字转语音结合起来,弥合了这个鸿沟。从菜单栏启用它,在任何可见文字上拖出选框——无论来源是什么——Optic 都会识别这些字符。之后你就可以让捕获的文字被朗读出来,把任何可见的屏幕内容变成音频。

Optic text-to-speech from screen content on Mac

无障碍使用

像旁白这样的屏幕阅读器在原生界面元素和标准文字上表现良好,但在图片内的文字和非标准渲染方式面前会遇到困难。Optic 通过把任何可见文字同时变成剪贴板文字和朗读音频来填补这个空白。原本无法访问的内容变得可以被听到。

校对

朗读文字能捕捉到视觉扫描容易漏掉的错误。从扫描文档或图片中提取文字之后,用文字转语音来核实 OCR 的输出结果。一个乱码的词或误识别的字符,在被朗读出来时会立刻显现,但在屏幕上可能悄悄溜过去而不被察觉。

多任务处理与理解

从文档、文章或扫描页面中提取一大段文字,在做其他事情的同时听它。音频处理调用的认知通道与阅读不同,这有助于理解和记忆——尤其是对于内容密集或不熟悉的材料。每一次捕获都留在你的菜单栏历史记录中,让你可以回顾并重新播放之前的任何一次提取。

在 Mac App Store 获取 Optic

下一篇文章

Optic

Select any text on screen and copy it — images, PDFs, dialogs, anything.

Get Optic on the Mac App Store