macOS enthält eine Funktion für gesprochene Inhalte, die markierten Text vorliest. Markiere einen Absatz in Safari, rechtsklicke, und dein Mac spricht ihn. Die Funktion funktioniert gut — bis du Text hören musst, der nicht markiert werden kann. Eine Infografik mit wichtigen Statistiken. Ein gescanntes Dokument ohne Textebene. Untertitel, die in einen Video-Frame eingebrannt sind. Text, der als Grafik in einer Web-App gerendert wird. In all diesen Fällen hat die macOS-Sprachausgabe nichts, womit sie arbeiten kann, weil es keinen auswählbaren Text gibt, den man ihr zuführen kann.
Der meiste Bildschirmtext ist nicht auswählbar
Die Menge an nicht-auswählbarem Text auf einem modernen Mac-Bildschirm ist größer, als die meisten denken. Bilder mit Textüberlagerungen, Canvas-gerenderte Web-Apps, PDF-Scans, Video-Frames, Remote-Desktop-Sitzungen, Dialogfenster, App-Oberflächen mit benutzerdefiniert gerenderten Labels — all das zeigt lesbaren Text an, den macOS als Teil eines Bildes behandelt. Du kannst ihn sehen, mit deinen Augen lesen, aber nicht auswählen — also kannst du ihn nicht an die Sprach-Engine senden.
Für Nutzer, die auf Audio-Ausgabe für Barrierefreiheit, Korrekturlesen, Multitasking oder Sprachenlernen angewiesen sind, ist diese Lücke eine echte Barriere. Der Text ist auf dem Bildschirm, die Sprach-Engine ist auf derselben Maschine, aber es gibt keine Brücke zwischen ihnen für nicht-auswählbare Inhalte.
Beliebiges auf dem Bildschirm auswählen, vorgelesen bekommen
Optic schließt diese Lücke, indem es Bildschirm-OCR mit Sprachausgabe kombiniert. Aktiviere es über die Menüleiste, ziehe eine Auswahl über beliebigen sichtbaren Text — unabhängig von der Quelle — und Optic erkennt die Zeichen. Du kannst den erfassten Text dann vorlesen lassen und so jeden sichtbaren Bildschirminhalt in Audio verwandeln.
Barrierefreiheit
Screenreader wie VoiceOver funktionieren gut mit nativen UI-Elementen und Standard-Text, stolpern aber über Text in Bildern und nicht-standardmäßigem Rendering. Optic füllt diese Lücke, indem es jeden sichtbaren Text sowohl als Zwischenablage-Text als auch als gesprochenes Audio verfügbar macht. Zuvor unzugängliche Inhalte werden hörbar.
Korrekturlesen
Text vorgelesen zu bekommen, fängt Fehler auf, die visuelles Überfliegen übersieht. Nach der Textextraktion aus einem gescannten Dokument oder Bild nutze die Sprachausgabe, um die OCR-Ausgabe zu überprüfen. Ein verstümmeltes Wort oder falsch erkanntes Zeichen ist beim Sprechen sofort offensichtlich, könnte aber auf dem Bildschirm unbemerkt durchgehen.
Multitasking und Textverständnis
Extrahiere eine lange Passage aus einem Dokument, Artikel oder einer gescannten Seite und höre sie dir an, während du andere Arbeit erledigst. Audioverarbeitung spricht andere kognitive Kanäle an als Lesen, was das Verständnis und die Erinnerung fördern kann — besonders bei dichten oder unbekannten Materialien. Jede Erfassung bleibt in deinem Menüleisten-Verlauf, sodass du jede frühere Extraktion erneut aufrufen und abspielen kannst.