이미지 텍스트 추출 (OCR)
중간 크기 OCR 모델로 이미지 속 글자를 추출합니다. 속도와 정확도의 균형.
글자가 있는 이미지를 끌어 놓거나 클릭해서 고르세요
사진, 스캔, 스크린숏: JPG, PNG, WebP, GIF, BMP, TIFF, AVIF. 영어 등 라틴 문자, 중국어, 일본어를 읽습니다. 한국어(한글)는 읽지 못합니다. 파일은 브라우저에서만 처리되고 업로드되지 않습니다. 이 브라우저에 보관되며, 빼기 전까지 남습니다.
Ctrl+O고르기Ctrl+V붙여넣기
글자 인식 모델
균형 모델 · …
영어와 라틴 문자 언어(프랑스어, 독일어, 스페인어, 폴란드어 등), 중국어(간체·번체), 일본어를 읽습니다. 한국어(한글), 러시아어 등 키릴 문자, 아랍어, 태국어, 힌디어, 베트남어는 읽지 못합니다.
라이선스: 모델(Apache-2.0) · 엔진(MIT)
문서를 찍은 사진, 스캔한 페이지, 스크린숏에서 글자를 뽑아 고치고 복사합니다. 이미지 텍스트 추출 도구 세 가지 중 평소에 쓰기 좋은 도구로, 30MB 인식 모델이 작은 글씨, 비스듬히 찍은 사진, 복잡한 배경을 가장 빠른 모델보다 눈에 띄게 정확하게 읽으면서도 스크린숏은 몇 초면 됩니다. 영어·중국어·일본어를 읽고, 한국어(한글)는 읽지 못합니다. 모든 처리는 브라우저 안에서 이루어져 이미지가 기기 밖으로 나가지 않으며, 무료이고 가입도 필요 없습니다.
이미지 텍스트 추출 모델 세 가지 비교
| 이미지 텍스트 추출 (가장 빠름) | 이미지 텍스트 추출 (균형)이 페이지 | 이미지 텍스트 추출 (정확도) | |
|---|---|---|---|
| 모델 크기 | 6 MB | 29.7 MB | 132.3 MB |
| 처음 사용: 엔진과 함께 받는 시간(50Mbit/s 기준) | 19.6 MB · ≈ 3초 | 43.4 MB · ≈ 7초 | 145.9 MB · ≈ 24초 |
| 그다음부터 | 브라우저에 저장 — 다시 받지 않음 | ||
| 속도 | 가장 빠름 | 빠름 | 가장 느림 |
| 정확도 | 또렷한 글자에 알맞음 | 사진과 작은 글씨에 더 정확 | 어려운 이미지에 가장 정확 |
| 읽는 글자 | 라틴 문자(영어, 프랑스어, 독일어 등) 및 중국어 | 라틴 문자(영어, 프랑스어, 독일어 등), 중국어 및 일본어 | 라틴 문자(영어, 프랑스어, 독일어 등), 중국어 및 일본어 |
인식 엔진(13.7 MB, WebGPU 브라우저는 27.4 MB)은 한 번만 받고 세 모델이 함께 씁니다. 도구에서 글자 읽기를 시작하기 전에는 아무것도 받지 않습니다.
이미지에서 텍스트 추출하는 방법
- 이미지를 페이지 어디에나 끌어 놓거나, Ctrl+V로 붙여넣거나, 클릭해서 파일을 고릅니다. 여러 장을 한 번에 넣어도 됩니다. 가장 빠름·정확도 페이지를 비롯해 다른 이미지 도구에서 넣은 이미지는 이미 목록에서 기다리고 있습니다.
- 처음에는 모델 받고 글자 읽기를 누릅니다. 모델(30MB)과 이를 실행하는 엔진, 합쳐서 약 43MB를 한 번 내려받아 브라우저에 저장하므로 다음부터는 넣은 이미지를 바로 읽고, 목록에 있던 이미지는 선택한 것을 페이지를 열자마자, 나머지는 읽기나 모두 읽기로 읽습니다.
- 이미지와 글을 비교합니다. 영역을 클릭하면 그 줄을, 줄을 클릭하면 그 영역을 찾아 줍니다. 밑줄 친 줄은 모델이 확신하지 못한 줄입니다. 고친 뒤 글 복사(Ctrl+Shift+C)나 .txt 저장을 누릅니다.
- 글자를 가린 이미지가 필요하면 이미지에서 글자 가리기에서 색을 고르고, 남겨 둘 영역은 보이게 한 뒤 가린 이미지를 저장합니다.
주요 기능
- 인쇄된 영어와 라틴 문자 언어, 중국어(간체·번체), 일본어 인식
- 읽는 순서대로 정리: 여러 단은 한 단씩, 영수증은 품목과 가격을 한 줄로
- 이미지 위에 글자 영역과 읽는 순서 번호 표시, 영역을 클릭하면 그 줄로 이동
- 글을 고친 뒤 복사하거나 .txt로 저장, 확신이 낮은 줄에는 밑줄
- 글자 가리기: 글자를 상자로 덮은 이미지 저장
- 여러 장을 한 번에, 거꾸로 된 페이지도 알아서 돌려 읽기
- 처음 한 번 약 43MB(30MB 모델과 엔진)를 받아 브라우저에 저장
개인정보는 안전한가요?
네. 이미지는 브라우저 안에서 도는 모델이 읽으며 사진도 글도 어디로도 보내지 않고, 이미지는 목록에서 뺄 때까지 이 브라우저에만 남습니다. 모델과 엔진만 이 사이트에서 한 번 내려받아 브라우저에 저장합니다.
자주 묻는 질문
어떤 언어를 읽나요? 한국어도 되나요?
한국어(한글)는 읽지 못합니다. 인쇄된 영어와 라틴 문자 언어(프랑스어, 독일어, 스페인어, 포르투갈어, 이탈리아어, 폴란드어, 체코어, 튀르키예어 등), 숫자와 기호, 중국어(간체·번체), 일본어(한자·히라가나·가타카나)를 읽습니다. 러시아어 등 키릴 문자, 아랍어, 태국어, 힌디어, 베트남어도 읽지 못합니다.
처음에는 왜 더 걸리나요?
처음 한 번만 브라우저가 모델과 이를 실행하는 엔진(14MB, 그래픽 카드를 쓰는 WebGPU 브라우저는 27MB)을 내려받아 준비하기 때문입니다. 그 뒤에는 저장된 파일을 써서 다시 받지 않고 바로 읽기 시작하며, 이미 열어 둔 페이지는 연결이 끊겨도 계속 읽습니다. 다른 이미지 텍스트 추출 도구를 이미 썼다면 엔진은 있으므로 모델만 받습니다.
가장 빠름, 균형, 정확도 중 무엇을 쓸까요?
대부분의 이미지에는 균형이 알맞습니다. 가장 빠름(모델 6MB, 처음 받는 양 약 20MB)은 영어·중국어의 또렷한 스크린숏과 문서에 충분합니다. 균형(30MB, 약 43MB)은 사진과 작은 글씨에 더 정확하고 일본어도 읽습니다. 정확도(132MB, 약 146MB)는 가장 어려운 이미지를 가장 잘 읽지만, 그래픽 가속(WebGPU)이 없으면 짧은 페이지에도 30초쯤 걸립니다. 어느 것이든 한 번 받으면 브라우저에 저장됩니다.
문서의 배치도 유지되나요?
정확한 배치가 아니라 읽는 순서를 유지합니다. 같은 줄에 있는 글은 이어 붙이고, 줄마다 줄을 바꾸고, 문단 사이에는 빈 줄을 넣습니다. 나란히 놓인 여러 단은 한 단씩 차례로 읽고, 표는 스프레드시트가 아니라 읽는 순서의 글로 나옵니다.
여러 이미지를 한 번에 읽을 수 있나요?
네. 원하는 만큼 넣으면 차례로 읽습니다. 모든 이미지 복사는 각 글을 파일 이름 아래에 모아 복사하고, 모두 저장 (ZIP)은 가린 이미지를 한꺼번에 저장합니다.