총 54개 서포트 유틸리티
100% 브라우저 자체 연산 (서버 전송 없음)
Zero Latency 실시간 결과
완전 프라이빗 개인정보 보호
이미지 및 그래픽 Client Local

이미지 텍스트 추출 (OCR)

이미지를 여기에 드래그하거나 클릭하여 선택하세요

JPG, PNG, WebP, BMP, GIF 이미지 지원 (최대 20MB)

텍스트 추출 결과

클라이언트 로컬 보안 연산

이미지나 추출된 텍스트는 외부 웹 서버로 전송되지 않습니다. 브라우저의 WebAssembly 및 Web Worker 스레드 안에서만 안전하게 연산되므로 개인정보가 포함된 신분증, 계약서, 영수증도 안심하고 변환할 수 있습니다.

인식 언어 설정 (Language)

이미지에 적힌 주요 언어를 선택하면 인식 정확도가 크게 향상됩니다.

텍스트 후처리 옵션

OCR 인식률을 높이는 팁

01. 정면 수평 촬영 & 90° 회전

글자가 기울어지면 인식률이 떨어집니다. [90° 회전] 버튼을 눌러 글자가 똑바로 서 있도록 방향을 맞춰주세요.

02. 충분한 조명 & 높은 대비

그림자가 지지 않고 글자와 배경의 명암 차이가 뚜렷할수록 작은 글씨도 오타 없이 정확하게 읽어냅니다.

03. 대비 보정 필터 활용

흐릿한 영수증이나 노이즈가 있는 스캔 문서는 [인식률 향상 대비 보정] 토글을 켜면 글자가 더욱 또렷해집니다.

광학 문자 인식(OCR) & 텍스트 추출 핵심

스마트폰 사진이나 캡처 이미지에서 글자를 빠르고 정확하게 추출하는 방법

스마트폰으로 찍은 영수증, 책의 한 페이지, 명함, 강의 자료나 화면 캡처 이미지에 적힌 긴 글자를 일일이 손으로 타이핑하는 것은 매우 번거롭고 시간이 오래 걸립니다.

본 도구는 최신 웹 표준 기술(WebAssembly)로 포팅된 구글의 고성능 Tesseract OCR 엔진을 브라우저에 직접 탑재하여, 별도의 프로그램 설치나 회원가입 없이 즉시 사진 속 글자를 깨끗한 텍스트로 변환해 줍니다.

특히 모든 연산이 사용자의 컴퓨터/스마트폰 메모리 안에서만 비공개로 동작하므로, 주민번호나 금융 정보가 적힌 영수증·계약서 등 민감한 문서도 외부 서버 유출 걱정 없이 안전하게 이용할 수 있습니다.

다국어 고정밀 OCR 엔진 탑재

한국어와 영어를 동시에 판독하는 혼합 모드부터 일본어, 중국어, 유럽어 등 9개 언어를 정밀하게 인식합니다.

실시간 전처리 및 90도 회전 보정

기울어진 사진을 바로잡는 90도 회전과 흐릿한 문서를 또렷하게 만들어주는 흑백 대비 강화 필터를 지원합니다.

클라이언트 사이드 개인정보 보호

이미지 파일과 추출된 텍스트가 서버로 절대 업로드되지 않아 기밀 문서나 금융 영수증도 안심하고 처리합니다.

1. OCR 텍스트 추출은 어떤 상황에서 유용할까요? (주요 활용 사례)

영수증 및 지출 증빙 서류 정리:

- 결제 금액, 상호명, 사업자 번호, 구매 품목 내역을 즉시 텍스트로 추출하여 엑셀이나 가계부에 간편하게 붙여넣을 수 있습니다.

스캔 도서 및 전공 서적 텍스트 복사:

- 두꺼운 책이나 논문의 필요한 문단을 스마트폰 카메라로 촬영한 뒤 타이핑 없이 원하는 문장만 복사하여 과제나 연구 노트에 인용합니다.

화면 캡처 이미지 및 복사 금지 웹페이지 텍스트 추출:

- 드래그나 우클릭이 막힌 웹페이지, 유튜브 영상 캡처 자막, 프레젠테이션 슬라이드 이미지에서 필요한 텍스트를 즉각 추출합니다.

명함 및 연락처 데이터 전산화:

- 주고받은 종이 명함의 이름, 이메일, 전화번호, 회사 주소를 텍스트로 변환하여 주소록이나 CRM 시스템에 빠르게 등록합니다.

2. OCR 문자 인식 정확도(신뢰도)를 극대화하는 실무 촬영 요령

글자 방향을 수평으로 바로잡기 (Orientation):

- OCR 엔진은 수평으로 나열된 글자를 기준으로 학습되어 있습니다. 사진이 세로나 거꾸로 되어 있다면 도구 내의 90° 회전 버튼을 이용해 올바른 방향으로 맞춰주세요.

적정 해상도와 선명한 초점 확보:

- 글자의 세로 높이가 최소 20~30픽셀 이상 확보되어야 오타가 줄어듭니다. 카메라가 흔들리지 않도록 초점을 맞추고 가까이에서 선명하게 촬영하세요.

균일한 조명과 그림자 방지:

- 형광등 불빛에 의한 강한 반사광이나 스마트폰 그림자가 글자를 가리면 획이 끊겨 잘못 인식될 수 있습니다. 조명이 고르게 비치는 환경에서 촬영하는 것이 좋습니다.

인식률 향상 대비 보정 기능 활용:

- 배경에 무늬가 있거나 글씨가 흐릿할 때는 화면 우측의 인식률 향상 대비 보정 옵션을 켜면 이미지의 명암비가 극대화되어 글자 윤곽이 또렷해집니다.

3. 주요 언어별 추천 설정 및 문자 인식 특성 비교표

다양한 문서 유형과 언어 조합에 따른 최적의 설정 가이드입니다.

언어 모드추천 문서 유형문자 인식 특성최적화 팁
한국어 + 영어 (kor+eng)국내 일반 영수증, 안내문, 간판, 이중 언어 문서한글 음절과 영문 알파벳을 동시에 자연스럽게 판독국내 사용자 권장 기본값, 일상 문서 95% 이상 커버
한국어 전용 (kor)순수 한글 소설, 고문서, 한글 전용 계약서초성·중성·종성 조합형 한글 자모에 집중하여 정확도 향상영문 알파벳이 섞이지 않은 순수 국문 문서에 추천
영어 전용 (eng)해외 영수증, 영문 논문, 프로그래밍 코드, 여권알파벳 대소문자와 숫자 기호에 최적화되어 가장 빠른 속도특수기호나 소스코드 스크린샷 판독 시 최고 정확도
일본어 (jpn)일본 여행 영수증, 만화책, 제품 설명서히라가나, 가타카나 및 상용한자를 정밀하게 식별세로쓰기 문서보다 가로쓰기 문서에서 훨씬 높은 인식률
중국어 간체/번체 (chi_sim/tra)중화권 영수증, 티켓, 한자 서류복잡한 한자 획수를 정밀하게 분해하여 표준 유니코드로 변환해상도가 높을수록 획수가 많은 한자의 오인식 대폭 감소

4. 추출된 텍스트 활용 및 편집 팁

클립보드 즉시 복사:

- 추출 완료 후 상단의 [텍스트 복사] 버튼을 누르면 전체 결과가 클립보드에 복사되어 노션, 메모장, 슬랙, 카카오톡 등에 즉시 붙여넣을 수 있습니다.

.TXT 텍스트 파일 저장:

- 수천 자가 넘는 장문의 문서나 회의록은 [.TXT 저장] 버튼을 눌러 컴퓨터에 텍스트 파일로 안전하게 보관할 수 있습니다.

결과창 직접 편집 및 오타 수정:

- 결과 영역은 자유롭게 텍스트를 수정할 수 있는 에디터이므로, 필요한 부분만 남기거나 잘못 인식된 글자를 즉시 직접 고칠 수 있습니다.

개발자를 위한 언어별 OCR 텍스트 추출 구현 스니펫

웹 프론트엔드, Node.js 서버, 파이썬 데이터 파이프라인에서 즉시 활용할 수 있는 표준 OCR 스니펫입니다.

JavaScript (Browser Tesseract.js Worker)
1import { createWorker } from 'tesseract.js';
2 
3// 브라우저 클라이언트 사이드 OCR 비동기 함수
4async function extractTextFromImage(imageFile, lang = 'kor+eng') {
5 const worker = await createWorker(lang, 1, {
6 logger: (m) => console.log(`[${m.status}] ${Math.round(m.progress * 100)}%`),
7 });
8 
9 const { data: { text, confidence } } = await worker.recognize(imageFile);
10 console.log(`신뢰도: ${confidence}%`);
11
12 await worker.terminate();
13 return text;
14}
Python 3 (pytesseract & Pillow)
1import pytesseract
2from PIL import Image
3 
4# 1. 이미지 로드 및 전처리
5image_path = "receipt.jpg"
6image = Image.open(image_path)
7 
8# 2. 한국어 + 영어 다중 언어 OCR 실행
9extracted_text = pytesseract.image_to_string(image, lang='kor+eng')
10 
11print("--- 추출된 텍스트 ---")
12print(extracted_text)
13 
14# 3. 텍스트 파일로 저장
15with open("output.txt", "w", encoding="utf-8") as f:
16 f.write(extracted_text)
Node.js (Tesseract.js Backend)
1const { createWorker } = require('tesseract.js');
2const fs = require('fs');
3 
4async function runNodeOcr(imagePath) {
5 const worker = await createWorker(['kor', 'eng']);
6 const { data: { text } } = await worker.recognize(imagePath);
7
8 console.log('OCR 텍스트 추출 완료:');
9 console.log(text);
10
11 await worker.terminate();
12}
13 
14runNodeOcr('./document.png');
Terminal / CLI (Tesseract CLI)
1# 한국어 + 영어 OCR 실행 후 result.txt 파일로 출력
2tesseract scan_image.png result -l kor+eng
3 
4# 페이지 레이아웃 분석 모드(PSM) 6 적용 (단일 텍스트 블록)
5tesseract receipt.jpg receipt_output -l kor+eng --psm 6

자주 묻는 질문 (FAQ)

Q.업로드한 사진이나 개인정보가 서버로 전송되거나 저장되나요?

전송되지 않습니다. 본 도구는 WebAssembly 기술을 통해 모든 OCR 연산을 사용자의 웹 브라우저 내부 메모리에서만 로컬로 처리합니다. 따라서 개인 신분증, 금융 영수증, 기밀 비즈니스 서류도 안전하게 다룰 수 있습니다.

Q.한글과 영어가 섞여 있는 문서는 어떻게 설정해야 하나요?

인식 언어 설정에서 한국어 + 영어 (권장 기본값)를 선택하시면 됩니다. 국내 대부분의 영수증, 간판, 명함, 서적은 한글과 알파벳, 숫자가 혼용되어 있으므로 혼합 모드가 가장 뛰어난 인식률을 제공합니다.

Q.인식률이 떨어지거나 오타가 많이 나는 경우 어떻게 해야 하나요?

① 사진이 기울어져 있다면 [90° 회전] 버튼을 눌러 정방향으로 맞춰주세요. ② 글씨가 흐릿하다면 [인식률 향상 대비 보정] 토글을 켜보세요. ③ 그림자나 빛 반사가 없는 밝은 조명에서 고해상도로 다시 촬영하시는 것을 추천합니다.

Q.손글씨(필기체)도 인식할 수 있나요?

OCR 엔진은 인쇄체(타이핑된 폰트)에 최적화되어 있습니다. 또박또박 바르게 쓴 손글씨는 어느 정도 인식하지만, 흘려 쓴 필기체나 캘리그라피는 인식률이 다소 떨어질 수 있습니다.

Q.인터넷 연결이 끊겨도 OCR 기능을 사용할 수 있나요?

최초 1회 언어 데이터(traineddata)가 브라우저 캐시에 로드된 이후에는 오프라인 상태나 비행기 탑승 모드에서도 정상 작동합니다.

Q.추출된 텍스트를 파일로 저장하거나 복사할 수 있나요?

네, 상단의 [텍스트 복사] 버튼을 눌러 클립보드에 복사하거나 [.TXT 저장] 버튼을 눌러 순수 텍스트 파일(.txt)로 즉시 다운로드할 수 있습니다.

Q.대용량 고해상도 사진도 지원하나요?

최대 20MB 및 4K 해상도의 대용량 이미지(JPG, PNG, WebP, BMP, GIF 등)를 모두 지원합니다. 해상도가 높을수록 작은 글자까지 더욱 정밀하게 인식됩니다.

Q.추출된 결과에서 직접 오타를 수정할 수 있나요?

네, 결과 텍스트 영역은 자유롭게 입력과 수정이 가능한 편집기 형태로 제공되므로, 필요한 부분만 편집하거나 서식을 다듬어 복사할 수 있습니다.