Du folgst einem YouTube-Tutorial und der Kursleiter tippt einen langen Terminal-Befehl. Oder ein Video-Review zeigt kurz eine Produktvergleichstabelle. Oder ein Tech-Walkthrough zeigt Einstellungen, die du nachstellen musst. Der Text ist perfekt auf dem Bildschirm sichtbar, aber YouTubes Videoplayer rendert nur Frames — es gibt nichts zum Klicken, Markieren oder Kopieren. Du pausierst das Video und fängst an abzutippen, was du siehst, in der Hoffnung, kein Flag zu übersehen oder einen Pfad falsch zu schreiben.
YouTube-Text ist in das Video eingebrannt
Alles, was du in einem YouTube-Video-Frame siehst, ist ein dekodiertes Bild. Ob es eine Folie ist, eine Terminal-Sitzung, ein Code-Editor oder Bildschirmgrafiken — der Text ist Teil der Pixeldaten. YouTube bietet keinen Mechanismus, um Text aus dem Videoinhalt selbst zu extrahieren. Untertitel und Beschreibungen sind separat — sie decken ab, was gesagt wird, nicht was auf dem Bildschirm gezeigt wird.
Manche Creator stellen Befehle und Links in die Videobeschreibung oder angeheftete Kommentare, aber viele tun das nicht. Und bei Inhalten wie Vergleichstabellen, Einstellungsseiten oder im Video angezeigten Daten gibt es typischerweise gar kein Text-Äquivalent.
Text direkt aus dem Video-Frame holen
Pausiere das Video im richtigen Moment (oder auch nicht — es funktioniert auch bei laufenden Inhalten), aktiviere Optic über die Menüleiste und ziehe eine Auswahl über den sichtbaren Text im YouTube-Player. Optic liest die Zeichen aus dem gerenderten Frame und kopiert sie in deine Zwischenablage. Funktioniert in jedem Browser — Safari, Chrome, Firefox, Arc.
Tutorial-Befehle und Code
Programmier-Tutorials zeigen ständig Terminal-Befehle, Code-Snippets und Konfigurationsbeispiele. Ein einziges Ziehen extrahiert den exakten Text — unter Bewahrung von Sonderzeichen, Flags und Syntax, die manuell leicht falsch getippt werden.
Bildschirmdaten und Tabellen
Produktreviews, Benchmark-Vergleiche und Bildungsinhalte zeigen oft Tabellen oder Listen auf dem Bildschirm. Wähle den Datenbereich aus und füge den extrahierten Text in deine Notizen oder eine Tabelle ein. Kein Pausieren und zeilenweises Abtippen mehr.
URLs und Referenzen
Wenn ein Video eine URL, einen Buchtitel oder einen Ressourcennamen einblendet, erfasse ihn, bevor er verschwindet. Optics Erfassungsverlauf speichert jede Extraktion, sodass du auch Text, den du während der Wiedergabe erfasst hast, später aus dem Menüleisten-Dropdown abrufen kannst.