Vous ouvrez un PDF en pensant copier un paragraphe, mais lorsque vous cliquez et faites glisser, rien ne se surligne. Le curseur glisse sur la page comme si le texte n'existait pas. Vous essayez Cmd+A pour tout sélectionner — rien. Le document semble parfaitement lisible, mais il s'agit en réalité d'une image de texte, pas de texte véritable.
Pourquoi certains PDF ne vous laissent pas sélectionner le texte
Cela arrive avec les documents scannés, les formulaires administratifs, les anciens articles universitaires et les PDF exportés depuis certains outils de design. Les pages ont été créées à partir d'images — soit scannées depuis du papier, soit aplaties lors de l'export — de sorte que le PDF contient des couches raster plutôt que des couches de texte. Aperçu, Adobe Reader et tous les autres lecteurs de PDF voient la même chose : des pixels agencés pour ressembler à des lettres, sans données de caractères sous-jacentes à sélectionner.
Certains PDF ont également une protection contre la copie activée. Le créateur a défini un indicateur de permission qui empêche la sélection de texte, même si la couche de texte existe. Les lecteurs de PDF standards respectent cet indicateur, vous laissant incapable de copier quoi que ce soit.
Lisez le texte directement depuis l'écran
Optic contourne les deux problèmes. Comme il lit les caractères depuis votre écran plutôt que depuis la structure interne du fichier, peu importe que le PDF ait une couche de texte, soit une image scannée, ou comporte des restrictions de copie. Si vous pouvez voir le texte sur votre écran, Optic peut le lire.
Documents scannés
Ouvrez le PDF scanné dans Aperçu, zoomez à une taille de lecture confortable, activez Optic, et faites glisser sur le texte dont vous avez besoin. Il reconnaît les caractères imprimés du scan et les copie sous forme de texte modifiable. Fonctionne avec d'anciens documents dactylographiés, des reçus scannés et des pages photographiées.
PDF protégés
Pour les PDF où la couche de texte existe mais où la sélection est verrouillée, Optic lit le rendu affiché à l'écran. Vous obtenez le même texte sans lutter contre des indicateurs de permission ni chercher des outils de déverrouillage de PDF.
Extraction multi-pages
Faites défiler le document et effectuez des sélections sur chaque page. Chaque capture est enregistrée dans l'historique de la barre de menus d'Optic, ce qui vous permet de parcourir un long document scanné page par page et de rassembler tout le texte dont vous avez besoin.