·4 min de lecture

Synthèse vocale depuis n'importe quel contenu d'écran sur Mac

Vous voulez écouter du texte à l'écran — dans une image, un PDF scanné, une image vidéo — mais les outils de synthèse vocale de votre Mac ne fonctionnent que sur du texte que vous pouvez surligner.

macOS inclut une fonction de contenu énoncé qui lit à voix haute le texte sélectionné. Surlignez un paragraphe dans Safari, faites un clic droit, et votre Mac le prononce. La fonction fonctionne bien — jusqu'à ce que vous ayez besoin d'entendre un texte qui ne peut pas être surligné. Une infographie avec des statistiques clés. Un document scanné sans couche de texte. Des sous-titres incrustés dans une image vidéo. Du texte affiché comme un graphisme dans une application web. Dans tous ces cas, le contenu énoncé de macOS n'a rien sur quoi travailler car il n'y a pas de texte sélectionnable à fournir au moteur.

La plupart du texte à l'écran n'est pas sélectionnable

La quantité de texte non sélectionnable sur un écran Mac moderne est plus grande que ce que la plupart des gens réalisent. Images avec superpositions de texte, applications web rendues en canvas, scans PDF, images vidéo, sessions de bureau à distance, boîtes de dialogue, interfaces d'applications avec des étiquettes rendues sur mesure — tout cela affiche du texte lisible que macOS traite comme faisant partie d'une image. Vous pouvez le voir, vous pouvez le lire des yeux, mais vous ne pouvez pas le sélectionner, donc vous ne pouvez pas l'envoyer au moteur de synthèse vocale.

Pour les utilisateurs qui dépendent de la sortie audio pour l'accessibilité, la relecture, le multitâche, ou l'apprentissage des langues, cet écart est un véritable obstacle. Le texte est à l'écran, le moteur de synthèse vocale est sur la même machine, mais il n'y a aucun pont entre les deux pour le contenu non sélectionnable.

Sélectionnez n'importe quoi à l'écran, entendez-le prononcé

Optic comble cet écart en combinant l'OCR au niveau de l'écran avec la synthèse vocale. Activez-le depuis la barre de menus, faites glisser une sélection sur n'importe quel texte visible — quelle que soit sa source — et Optic reconnaît les caractères. Vous pouvez ensuite faire lire le texte capturé à voix haute, transformant n'importe quel contenu d'écran visible en audio.

Optic text-to-speech from screen content on Mac

Accessibilité

Les lecteurs d'écran comme VoiceOver fonctionnent bien avec les éléments d'interface natifs et le texte standard, mais peinent avec le texte dans des images et un rendu non standard. Optic comble cet écart en rendant tout texte visible disponible à la fois comme texte dans le presse-papiers et comme audio prononcé. Un contenu auparavant inaccessible devient audible.

Relecture

Entendre un texte lu à voix haute permet de repérer des erreurs que la lecture visuelle manque. Après avoir extrait du texte d'un document scanné ou d'une image, utilisez la synthèse vocale pour vérifier le résultat de l'OCR. Un mot déformé ou un caractère mal reconnu devient immédiatement évident lorsqu'il est prononcé mais pourrait passer inaperçu à l'écran.

Multitâche et compréhension

Extrayez un long passage d'un document, d'un article, ou d'une page scannée et écoutez-le pendant que vous faites autre chose. Le traitement audio sollicite des canaux cognitifs différents de la lecture, ce qui peut favoriser la compréhension et la rétention — particulièrement pour du contenu dense ou peu familier. Chaque capture reste dans votre historique de la barre de menus, ce qui vous permet de revisiter et de réécouter n'importe quelle extraction précédente.

Obtenez Optic sur le Mac App Store

Article suivant

Optic

Select any text on screen and copy it — images, PDFs, dialogs, anything.

Get Optic on the Mac App Store