·5분 읽기

Mac 미리보기 OCR의 한계 — 놓치는 것들

미리보기는 이미지와 PDF를 다루지만 대부분에서 텍스트를 추출하지는 못합니다. 미리보기에서 스캔된 PDF나 사진의 텍스트를 복사하려다 실패했다면, 그 이유를 알려드립니다.

미리보기는 macOS의 기본 이미지 및 PDF 뷰어이며, 많은 사용자가 이미지와 스캔 문서에서 텍스트를 인식하고 추출하는 OCR도 처리할 수 있다고 생각합니다. 라이브 텍스트 통합 덕분에 제한된 상황에서는 실제로 가능합니다. 하지만 흔한 여러 상황에서 미리보기는 조용히 텍스트 인식에 실패하거나 추출 기능을 아예 제공하지 않습니다. 미리보기에서 스캔된 PDF나 문서 사진의 텍스트를 선택하려 했는데 커서가 텍스트 강조 없이 선택 사각형만 그린다면, 미리보기의 OCR 한계에 부딪힌 것입니다.

미리보기의 텍스트 인식이 무너지는 지점

복잡한 레이아웃의 스캔 PDF. 미리보기는 깔끔하게 스캔된 단일 열 문서에서는 텍스트를 인식하기도 합니다. 하지만 다중 열 레이아웃, 표, 머리글과 바닥글, 그래픽과 텍스트가 섞인 문서에서는 선택 가능한 텍스트가 전혀 나오지 않는 경우가 많습니다. 미리보기의 라이브 텍스트 엔진은 복잡한 문서 구조를 안정적으로 처리하지 못합니다.

대비가 낮거나 작은 텍스트. 영수증 스캔, 색이 바랜 문서, 텍스트와 배경의 대비가 낮은 이미지는 미리보기의 인식을 자주 무력화시킵니다. 사람의 눈에는 완벽하게 읽히는 텍스트라도 미리보기의 감지 능력에는 보이지 않을 수 있습니다.

손글씨 텍스트. 미리보기의 텍스트 인식은 인쇄된 글꼴에 맞춰져 있습니다. 손글씨 메모, 화이트보드 사진, 필기가 있는 문서는 글씨가 깔끔하고 읽기 쉬워도 좀처럼 인식되지 않습니다.

비라틴 문자 체계. 비라틴 언어 지원은 일관성이 없습니다. 이미지 속 한자·가나·한글, 아랍 문자, 키릴 문자는 글꼴 스타일, 이미지 품질, 문서 복잡도에 따라 감지될 수도, 안 될 수도 있습니다.

화면 캡처 불가. 미리보기는 열어놓은 파일만 처리합니다. 필요한 텍스트가 동영상 프레임, 웹 앱 인터페이스, 오류 대화상자, 다른 앱의 창 안에 있다면 미리보기는 그곳에 닿을 방법이 전혀 없습니다.

화면의 모든 것에서 작동하는 OCR

Optic은 화면 수준에서 작동함으로써 미리보기의 한계를 완전히 우회합니다. 파일 뷰어에게 파일 안의 텍스트를 인식해달라고 요청하는 대신, Optic은 화면에 보이는 것에서 직접 문자를 읽어냅니다. 문제의 문서를 미리보기든 다른 어떤 앱이든 열고 필요한 텍스트 위로 Optic의 선택 영역을 드래그하세요.

Mac에서 미리보기 OCR의 한계를 뛰어넘는 Optic

복잡한 문서 레이아웃

미리보기를 곤란하게 만드는 표, 다중 열 텍스트, 혼합 콘텐츠도 Optic으로는 읽을 수 있습니다. 스캔할 영역을 정확히 직접 지정할 수 있기 때문입니다. 필요한 열이나 표 셀만 선택하면 되며, 전체 페이지를 파싱할 필요가 없습니다.

파일을 넘어서

Optic은 열려 있는 파일에만 국한되지 않습니다. 동영상 프레임, 대화상자, 웹 앱, 원격 데스크톱 세션 — 화면에 렌더링되는 것이라면 무엇이든 대상이 됩니다. 미리보기는 이런 소스에 결코 닿을 수 없지만, Optic은 여느 이미지처럼 자연스럽게 읽어냅니다.

지속되는 기록

미리보기는 과거의 텍스트 인식 시도를 기억하지 못합니다. Optic은 모든 추출 내용을 메뉴 막대에 저장하여, 언제든 스크롤하며 다시 복사할 수 있는 캡처 텍스트 로그를 쌓아갑니다.

Mac App Store에서 Optic 받기

다음 기사

Optic

Select any text on screen and copy it — images, PDFs, dialogs, anything.

Get Optic on the Mac App Store