В macOS есть функция озвучивания содержимого, которая читает выделенный текст вслух. Выделите абзац в Safari, щёлкните правой кнопкой — и Mac его озвучит. Функция отлично работает — пока не понадобится услышать текст, который нельзя выделить. Инфографика с ключевой статистикой. Отсканированный документ без текстового слоя. Субтитры, вшитые в кадр видео. Текст, отрисованный как графика в веб-приложении. Во всех этих случаях озвучиванию контента macOS нечего обрабатывать, потому что нет выделяемого текста, который можно было бы передать в движок речи.
Большая часть текста на экране не выделяема
Объём невыделяемого текста на современном экране Mac больше, чем думает большинство людей. Изображения с наложенным текстом, веб-приложения, отрисованные через canvas, сканы PDF, кадры видео, сеансы удалённого рабочего стола, диалоговые окна, интерфейсы приложений с кастомно отрисованными подписями — всё это отображает читаемый текст, который macOS воспринимает как часть изображения. Вы его видите, можете прочитать глазами, но не можете выделить, а значит, не можете отправить в движок речи.
Для пользователей, полагающихся на аудиовывод ради доступности, вычитки, многозадачности или изучения языка, этот разрыв — реальный барьер. Текст на экране, движок речи на той же машине, но моста между ними для невыделяемого контента нет.
Выделяйте что угодно на экране, слушайте вслух
Optic закрывает этот разрыв, сочетая OCR уровня экрана с синтезом речи. Активируйте его из строки меню, выделите любой видимый текст — независимо от источника, — и Optic распознает символы. Затем вы можете озвучить захваченный текст, превращая любое содержимое экрана в аудио.
Доступность
Программы чтения с экрана вроде VoiceOver хорошо работают с нативными элементами интерфейса и стандартным текстом, но спотыкаются на тексте внутри изображений и нестандартной отрисовки. Optic заполняет этот пробел, делая любой видимый текст доступным одновременно как текст в буфере обмена и как озвученное аудио. Контент, который раньше был недоступен, становится слышимым.
Вычитка
Прослушивание текста вслух помогает заметить ошибки, которые пропускает визуальное сканирование. После извлечения текста из отсканированного документа или изображения используйте синтез речи, чтобы проверить результат OCR. Искажённое слово или неверно распознанный символ сразу становятся заметны на слух, но могут остаться незамеченными на экране.
Многозадачность и понимание
Извлеките длинный отрывок из документа, статьи или отсканированной страницы и слушайте его, занимаясь другими делами. Аудиовосприятие задействует иные когнитивные каналы, чем чтение, что может улучшить понимание и запоминание — особенно для плотного или незнакомого материала. Каждый захват остаётся в истории строки меню, так что вы можете вернуться и заново прослушать любое прошлое извлечение.