이미지 텍스트 추출 (OCR) 사용 가이드
사진·스캔본·스크린샷에서 한국어와 영어를 추출하는 방법, 지원 형식·용량, 인식 오류 해결 및 로컬 처리 방식을 안내합니다.
사진, 스캔본, 스크린샷에서 한국어·영어·숫자 텍스트를 서버로 보내지 않고 추출합니다.
사용 방법
실행 방식
PaddleOCR.js와 ONNX Runtime Web으로 한국어 PP-OCRv5 검출·인식 모델을 실행합니다. 브라우저가 지원하면 WebGPU를 자동 선택하고, 지원하지 않으면 버전이 고정된 WASM으로 폴백합니다.
첫 실행 시 모델 자산 약 18MB를 다운로드하고 캐시합니다. 이미지의 초점·조명·문서 레이아웃에 따라 정확도가 달라질 수 있습니다.
개인정보 보호
OCR은 브라우저 전용 Worker에서 실행됩니다. 이미지 픽셀은 기기에 남으며 OCR API로 전송되지 않습니다.
지원 파일과 결과의 한계
- PNG, JPG, WebP, GIF 이미지 한 장을 최대 10MB까지 처리합니다.
- 픽셀 수가 안전 한도를 넘으면 처리 전에 이미지를 축소합니다. 지나치게 큰 해상도나 내부 처리 한도를 넘는 이미지는 거부될 수 있습니다.
- 인식 모델은 한국어·영어·숫자를 중심으로 동작합니다. 손글씨, 장식 글꼴, 세로쓰기, 표, 수식이나 다른 문자 체계는 누락되거나 읽는 순서가 달라질 수 있습니다.
- 결과는 편집 가능한 텍스트 초안입니다. 이름·날짜·금액 등 중요한 값은 원본과 대조하세요. 원본 문서의 표나 서식을 그대로 복원하는 기능은 아닙니다.
자주 묻는 질문
PDF나 아이폰 HEIC 사진에서 텍스트를 추출할 수 있나요?
OCR 도구는 PDF와 HEIC를 직접 입력받지 않습니다. 먼저 파일 변환기에서 PNG나 JPG로 변환한 다음 이미지를 OCR에 넣으세요. PDF를 PNG로 변환하거나 HEIC를 JPG로 변환하는 안내를 참고할 수 있습니다.
글자가 누락되거나 순서가 섞이면 어떻게 하나요?
글자가 똑바로 보이도록 회전하고, 주변 배경을 잘라낸 뒤 원본 해상도의 선명한 이미지를 사용하세요. 여러 단으로 나뉜 문서는 영역별로 잘라 한 장씩 처리하면 결과를 확인하기 쉽습니다. 흐릿한 글씨나 작은 글씨를 확대해도 원본에 없는 세부 정보가 복원되지는 않습니다.
WebGPU가 없거나 첫 실행이 오래 걸리면 어떻게 하나요?
WebGPU를 사용할 수 없으면 WASM으로 실행되므로 더 느릴 수 있습니다. 첫 실행에는 약 18MB의 모델과 별도 런타임 자산을 내려받습니다. 로딩 중에는 페이지를 열어 두고, 다운로드 오류가 나면 네트워크나 콘텐츠 차단 설정을 확인하세요.
사진을 서버로 업로드하지 않아도 인터넷이 필요한가요?
이미지 인식은 기기에서 처리하지만 페이지 코드·모델·런타임을 처음 받으려면 네트워크 연결이 필요합니다. 캐시 상태에 따라 재다운로드가 발생할 수 있으므로 완전한 오프라인 실행을 보장하지 않습니다. 사이트의 다른 네트워크 요청은 개인정보 처리방침을 확인하세요.
한국어 OCR 활용 안내와 스크린샷 텍스트 추출 안내에서 입력 이미지에 맞는 작업 순서를 확인할 수 있습니다.
지원 범위와 문제 해결
화면은 5개 언어로 제공되지만 현재 OCR 모델의 인식 대상은 한국어·영어·숫자입니다. 일본어·중국어·스페인어 전용 인식 모델은 제공하지 않습니다. PDF·HEIC는 파일 변환기에서 PNG나 JPG로 바꾼 뒤 처리하세요. 원본을 보관하고 결과를 대조하세요.
관련 도구
빠른 답변과 사양
핵심 작업은 이 브라우저에서 실행됩니다. 시작 전에 지원 형식, 공개된 한도와 필요한 모델 다운로드를 확인하세요.
- 입력
- JPG, PNG, WebP 및 GIF
- 출력
- 텍스트 및 Markdown
- 처리 위치
- 이 기기의 브라우저
- 모델 지원 언어
- 한국어 및 영어
- 파일당 한도
- 10 MB
- 한 번에 처리
- 1
- 필요 시 모델 다운로드
- 18 MB
- 마지막 검증
화면 언어와 모델의 처리 언어는 다릅니다. 언어별 인식·발음 품질은 다르므로 결과를 확인하세요.