macOS hat eine integrierte Funktion „Auswahl sprechen": Text markieren, rechtsklicken und „Sprachausgabe" wählen. Das funktioniert gut — solange der Text auswählbar ist. Aber sobald du Text aus einem Bild, einem gescannten PDF, einem Video-Frame oder einem nicht-interaktiven UI-Element vorlesen lassen musst, hat die Sprachfunktion nichts, womit sie arbeiten kann. Du kannst nicht sprechen lassen, was du nicht auswählen kannst.
Die Lücke zwischen Bildschirminhalt und Sprache
Viele Situationen erfordern, dass Bildschirmtext vorgelesen wird. Korrekturlesen fängt Fehler auf, die deine Augen übersehen. Multitasking profitiert von Audio — du kannst extrahierten Inhalten zuhören, während du an etwas anderem arbeitest. Barrierefreiheits-Bedürfnisse erstrecken sich auf Inhalte, die nicht nativ auswählbar sind. Sprachlernende profitieren davon, unbekannten Text ausgesprochen zu hören.
Aber die integrierten Sprachwerkzeuge funktionieren nur mit Standard-Textauswahlen. Wenn der Text in einem Bild steckt, als Grafik in einer Web-App gerendert wird, in einem Video angezeigt wird oder in einem gescannten Dokument eingesperrt ist, bietet macOS keinen Weg von „auf dem Bildschirm sichtbar" zu „vorgelesen". Du müsstest den Text erst manuell abtippen, was den Zweck verfehlt.
Beliebigen Text auswählen, vorgelesen bekommen
Optic kombiniert Bildschirm-OCR mit Sprachausgabe. Aktiviere es über die Menüleiste, ziehe über beliebigen sichtbaren Text — unabhängig von der Quelle — und du kannst den erfassten Text vorlesen lassen. Kein manuelles Abtippen, keine Abhängigkeit davon, dass der Text nativ auswählbar ist.
OCR-Ergebnisse korrekturlesen
Nachdem du Text aus einem Scan oder Bild extrahiert hast, hilft das Vorlesen, OCR-Fehler zu erkennen, die auf dem Bildschirm korrekt aussehen. Ein falsch gelesener Buchstabe oder ein verstümmeltes Wort wird beim Sprechen offensichtlich, könnte aber bei der visuellen Prüfung durchrutschen.
Barrierefreiheit
Für Nutzer, die auf Screenreader angewiesen sind, schaffen in Bildern und nicht-auswählbaren Formaten gefangene Inhalte Barrieren. Optic überbrückt diese Lücke, indem es jeden sichtbaren Text sowohl in Zwischenablage-Text als auch in gesprochenes Audio umwandelt und zuvor unzugängliche Inhalte verfügbar macht.
Multitasking und Sprachenlernen
Extrahiere eine Passage aus einem Dokument oder einer Webseite und höre sie dir beim Kochen, Pendeln oder Sport an. Sprachlernende können unbekannte Wörter korrekt ausgesprochen hören, indem sie Text in einer Fremdsprache auswählen und die Sprachausgabe nutzen.
Erfassungsverlauf mit Sprachausgabe
Da jede Erfassung im Menüleisten-Verlauf gespeichert wird, kannst du zu einer früheren Extraktion zurückkehren und sie erneut vorlesen lassen — nützlich zum Überprüfen von Notizen oder zum Wiederaufgreifen von Inhalten aus früheren Sitzungen.