Aperçu est la visionneuse d'images et de PDF par défaut sur macOS, et de nombreux utilisateurs supposent qu'elle peut gérer l'OCR — reconnaître et extraire du texte depuis des images et des documents scannés. Dans des situations limitées, c'est le cas, grâce à l'intégration de Texte en direct. Mais dans de nombreux scénarios courants, Aperçu échoue silencieusement à reconnaître le texte ou ne fournit aucune capacité d'extraction. Si vous avez essayé de sélectionner du texte dans un PDF scanné ou une photo d'un document dans Aperçu et que votre curseur ne fait que tracer un rectangle de sélection sans surligner de texte, vous avez heurté le mur de l'OCR d'Aperçu.
Où la reconnaissance de texte d'Aperçu s'effondre
PDF scannés avec mise en page complexe. Aperçu peut parfois reconnaître du texte dans des documents propres, bien scannés, à colonne unique. Mais les mises en page multi-colonnes, les tableaux, les en-têtes et pieds de page, et les documents mélangeant graphismes et texte ne produisent souvent aucun texte sélectionnable du tout. Le moteur Texte en direct d'Aperçu ne gère pas de manière fiable les structures de documents complexes.
Texte à faible contraste ou petit. Les scans de reçus, les documents fanés, et les images à faible contraste entre le texte et l'arrière-plan déjouent fréquemment la reconnaissance d'Aperçu. Le texte peut être parfaitement lisible pour l'œil humain mais invisible pour la détection d'Aperçu.
Texte manuscrit. La reconnaissance de texte d'Aperçu est calibrée pour les polices imprimées. Les notes manuscrites, les photos de tableaux blancs et les documents annotés sont rarement reconnus, même quand l'écriture est propre et lisible.
Écritures non latines. La prise en charge des langues non latines est inégale. Le texte CJC, arabe et cyrillique dans les images peut être détecté ou non selon le style de police, la qualité de l'image et la complexité du document.
Aucune capture depuis l'écran. Aperçu ne traite que les fichiers que vous avez ouverts. Si le texte dont vous avez besoin se trouve dans une image vidéo, une interface d'application web, une boîte de dialogue d'erreur, ou la fenêtre d'une autre application, Aperçu n'a aucun moyen de l'atteindre.
Un OCR qui fonctionne sur tout ce qui est à l'écran
Optic contourne entièrement les limites d'Aperçu en fonctionnant au niveau de l'écran. Au lieu de demander à une visionneuse de fichiers de reconnaître le texte à l'intérieur d'un fichier, Optic lit les caractères de tout ce qui est visible sur votre écran. Ouvrez le document problématique dans Aperçu — ou toute autre application — et faites glisser la sélection d'Optic sur le texte dont vous avez besoin.
Mises en page de documents complexes
Les tableaux, le texte multi-colonnes et le contenu mixte qui déjouent Aperçu sont lisibles par Optic car vous contrôlez exactement quelle région scanner. Sélectionnez juste la colonne ou la cellule du tableau dont vous avez besoin — aucune analyse complète de la page requise.
Au-delà des fichiers
Optic ne se limite pas aux fichiers ouverts. Images vidéo, boîtes de dialogue, applications web, sessions de bureau à distance — tout ce qui est affiché à l'écran est éligible. Aperçu ne peut jamais atteindre ces sources ; Optic les lit aussi naturellement que n'importe quelle image.
Historique persistant
Aperçu n'a aucune mémoire des tentatives de reconnaissance de texte passées. Optic enregistre chaque extraction dans la barre de menus, constituant un journal de texte capturé que vous pouvez faire défiler et recopier à tout moment.