·5 min leestijd

Beperkingen van Mac Preview OCR — wat het mist

Preview verwerkt afbeeldingen en PDF's maar kan uit de meeste geen tekst extraheren. Als je hebt geprobeerd tekst te kopiëren uit een gescande PDF of foto in Preview en niets kreeg, is dit waarom.

Preview is de standaard afbeeldings- en PDF-viewer op macOS, en veel gebruikers gaan ervan uit dat het OCR aankan — het herkennen en extraheren van tekst uit afbeeldingen en gescande documenten. In beperkte situaties kan het dat, dankzij Live Text-integratie. Maar bij veel gangbare scenario's herkent Preview de tekst stilzwijgend niet of biedt het helemaal geen extractiemogelijkheid. Als je hebt geprobeerd tekst te selecteren uit een gescande PDF of een foto van een document in Preview en je cursor tekent gewoon een selectierechthoek zonder tekstmarkering, ben je tegen de OCR-muur van Preview aangelopen.

Waar de tekstherkenning van Preview faalt

Gescande PDF's met complexe lay-outs. Preview kan soms tekst herkennen in schone, goed gescande documenten met één kolom. Maar meerkoloms-lay-outs, tabellen, kop- en voetteksten, en documenten met gemengde afbeeldingen en tekst leveren vaak helemaal geen selecteerbare tekst op. De Live Text-engine in Preview verwerkt complexe documentstructuren niet betrouwbaar.

Tekst met weinig contrast of kleine tekst. Bonnetjesscans, vervaagde documenten en afbeeldingen met weinig contrast tussen tekst en achtergrond ondermijnen vaak de herkenning van Preview. De tekst is voor het menselijk oog misschien perfect leesbaar, maar onzichtbaar voor de detectie van Preview.

Handgeschreven tekst. De tekstherkenning van Preview is afgestemd op gedrukte lettertypes. Handgeschreven notities, whiteboardfoto's en geannoteerde documenten worden zelden herkend, zelfs als het handschrift netjes en leesbaar is.

Niet-Latijnse schriften. Ondersteuning voor niet-Latijnse talen is inconsistent. CJK-, Arabische en Cyrillische tekst in afbeeldingen wordt al dan niet gedetecteerd, afhankelijk van lettertypestijl, afbeeldingskwaliteit en documentcomplexiteit.

Geen vastlegging vanaf het scherm. Preview verwerkt alleen bestanden die je hebt geopend. Als de tekst die je nodig hebt in een videoframe, een webapp-interface, een foutdialoog of het venster van een andere app zit, heeft Preview geen manier om erbij te komen.

OCR dat werkt over alles op het scherm

Optic omzeilt de beperkingen van Preview volledig door op schermniveau te werken. In plaats van een bestandsviewer te vragen tekst in een bestand te herkennen, leest Optic tekens uit alles wat zichtbaar is op je scherm. Open het problematische document in Preview — of een andere app — en sleep de selectie van Optic over de tekst die je nodig hebt.

Optic overcoming Preview OCR limitations on Mac

Complexe documentlay-outs

Tabellen, meerkoloms tekst en gemengde content die Preview struikelen laten, zijn leesbaar voor Optic omdat jij precies bepaalt welk gebied wordt gescand. Selecteer alleen de kolom of tabelcel die je nodig hebt — geen volledige pagina-analyse vereist.

Meer dan bestanden

Optic is niet beperkt tot geopende bestanden. Videoframes, dialoogvensters, webapps, remote-desktopsessies — alles wat op het scherm wordt weergegeven, is toegestaan. Preview kan deze bronnen nooit bereiken; Optic leest ze net zo natuurlijk als elke afbeelding.

Permanente geschiedenis

Preview heeft geen geheugen van eerdere tekstherkenningspogingen. Optic bewaart elke extractie in de menubalk, waardoor een logboek van vastgelegde tekst ontstaat dat je kunt doorbladeren en op elk moment opnieuw kunt kopiëren.

Haal Optic in de Mac App Store

Volgend artikel

Optic

Select any text on screen and copy it — images, PDFs, dialogs, anything.

Get Optic on the Mac App Store