Toolonit
  1. 홈
  2. 이미지
  3. 이미지 텍스트 추출 (정확도)

고정확도 이미지 텍스트 추출 (OCR)

가장 큰 OCR 모델로 이미지 속 글자를 추출합니다. 가장 정확하며 처음 한 번 받는 용량이 큽니다.

글자가 있는 이미지를 끌어 놓거나 클릭해서 고르세요

사진, 스캔, 스크린숏: JPG, PNG, WebP, GIF, BMP, TIFF, AVIF. 영어 등 라틴 문자, 중국어, 일본어를 읽습니다. 한국어(한글)는 읽지 못합니다. 파일은 브라우저에서만 처리되고 업로드되지 않습니다. 이 브라우저에 보관되며, 빼기 전까지 남습니다.

Ctrl+O고르기Ctrl+V붙여넣기

글자 인식 모델

정확도 모델 · …

영어와 라틴 문자 언어(프랑스어, 독일어, 스페인어, 폴란드어 등), 중국어(간체·번체), 일본어를 읽습니다. 한국어(한글), 러시아어 등 키릴 문자, 아랍어, 태국어, 힌디어, 베트남어는 읽지 못합니다.

 

라이선스: 모델(Apache-2.0) · 엔진(MIT)

작은 글씨, 찍은 문서, 영수증, 대비가 낮거나 복잡한 이미지처럼 정확도가 가장 중요할 때 쓰는 도구로, 인식 모델 세 가지 중 가장 큰 모델을 씁니다. 132MB 모델은 한 번만 내려받아 브라우저에 저장합니다. 그래픽 가속(WebGPU, 대부분의 최신 데스크톱 브라우저)이 있으면 글이 빽빽한 페이지도 몇 초에 읽고, 프로세서만으로는 짧은 페이지에 30초쯤 걸립니다. 영어·중국어·일본어를 읽고, 한국어(한글)는 읽지 못합니다. 이미지는 기기 밖으로 나가지 않으며, 무료이고 가입도 필요 없습니다.

이미지 텍스트 추출 모델 세 가지 비교

이미지 텍스트 추출 (가장 빠름)이미지 텍스트 추출 (균형)이미지 텍스트 추출 (정확도)이 페이지
모델 크기6 MB29.7 MB132.3 MB
처음 사용: 엔진과 함께 받는 시간(50Mbit/s 기준)19.6 MB · ≈ 3초43.4 MB · ≈ 7초145.9 MB · ≈ 24초
그다음부터브라우저에 저장 — 다시 받지 않음
속도가장 빠름빠름가장 느림
정확도또렷한 글자에 알맞음사진과 작은 글씨에 더 정확어려운 이미지에 가장 정확
읽는 글자라틴 문자(영어, 프랑스어, 독일어 등) 및 중국어라틴 문자(영어, 프랑스어, 독일어 등), 중국어 및 일본어라틴 문자(영어, 프랑스어, 독일어 등), 중국어 및 일본어

인식 엔진(13.7 MB, WebGPU 브라우저는 27.4 MB)은 한 번만 받고 세 모델이 함께 씁니다. 도구에서 글자 읽기를 시작하기 전에는 아무것도 받지 않습니다.

이미지에서 텍스트를 정확하게 추출하는 방법

  1. 이미지를 페이지 어디에나 끌어 놓거나, Ctrl+V로 붙여넣거나, 클릭해서 파일을 고릅니다. 비교해 보려고 균형 페이지에서 넣은 이미지처럼, 다른 이미지 도구에서 넣은 이미지는 이미 목록에 있습니다.
  2. 처음에는 모델 받고 글자 읽기를 누릅니다. 내려받기(엔진 포함 약 146MB)는 한 번뿐이며, 진행 표시에 용량·진행률·남은 시간이 나옵니다. 받은 파일은 브라우저에 저장되므로 다음부터는 페이지를 열자마자 선택한 이미지를 읽고, 목록의 나머지는 읽기나 모두 읽기로 읽습니다.
  3. 이미지 옆의 글을 확인합니다. 영역을 클릭하면 그 줄을 찾고, 두 번 클릭하면 그 줄을 바로 고칩니다. 밑줄 친 줄은 한 번 더 확인하세요. 그다음 글 복사(Ctrl+Shift+C)나 .txt 저장을 누릅니다.
  4. 글자 없이 이미지를 공유하려면 이미지에서 글자 가리기에서 색과 가릴 영역을 고르고 가린 이미지를 저장합니다.

주요 기능

  • 가장 큰 모델: 132MB, 엔진까지 약 146MB를 한 번 받아 브라우저에 저장
  • 작거나 흐리거나 기울었거나 대비가 낮은 글자를 가장 정확하게
  • WebGPU가 있으면 빽빽한 페이지도 몇 초, 프로세서만으로는 짧은 페이지에 30초쯤
  • 영어와 라틴 문자 언어, 중국어(간체·번체), 일본어 인식
  • 읽는 순서대로 정리하고 이미지 위에 글자 영역과 번호 표시
  • 글을 고치고 복사하거나 .txt로 저장, 글자를 가린 이미지 저장
  • 내려받은 파일은 쓰기 전에 모두 검사하고, 받다가 끊겨도 다 받은 파일은 남김

개인정보는 안전한가요?

네. 모델은 브라우저 안에서 돌며 이미지와 인식된 글은 업로드되지 않고, 이미지는 목록에서 뺄 때까지 이 브라우저에만 남습니다. 그래서 영수증, 신분증, 계약서처럼 온라인 서비스에 보내고 싶지 않은 문서에도 쓸 수 있습니다.

자주 묻는 질문

다른 두 도구와 무엇이 다른가요?

가장 큰 인식 모델을 써서 작거나, 흐리거나, 기울었거나, 대비가 낮은 글자를 더 정확하게 읽습니다. 대신 처음 받는 용량이 크고(모델 132MB, 다른 도구는 6MB와 30MB), 그래픽 가속이 없는 브라우저에서는 짧은 페이지에 30초쯤, 빽빽한 페이지는 몇 분, 휴대폰에서는 더 걸립니다. 또렷한 스크린숏이라면 가장 빠름이나 균형으로 충분합니다.

매번 내려받아야 하나요?

아니요. 모델과 엔진(14MB, WebGPU 브라우저는 27MB — 다른 두 도구와 함께 씀)은 한 번 내려받아 브라우저에 저장하며, 쓰기 전에 파일마다 온전한지 확인합니다. 다음부터는 다시 받지 않고 바로 시작합니다. 내려받은 모델 지우기로 언제든 공간을 비울 수 있습니다.

한국어도 읽나요?

아니요. 이 모델은 한국어(한글)를 읽지 못합니다. 영어와 라틴 문자 언어(프랑스어, 독일어, 스페인어, 포르투갈어, 이탈리아어, 폴란드어, 체코어, 튀르키예어 등), 숫자와 기호, 중국어(간체·번체), 일본어(한자·히라가나·가타카나)를 읽습니다. 러시아어 등 키릴 문자, 아랍어, 태국어, 힌디어, 베트남어도 읽지 못합니다.

거꾸로 된 페이지나 비스듬히 찍은 사진도 읽나요?

네. 거꾸로 된 페이지는 알아서 알아보고 바로 돌려 읽고, 조금 기울어진 사진은 줄의 기울기를 바로잡은 뒤 읽는 순서를 정하므로 줄이 뒤섞이지 않습니다. 세로쓰기 중국어·일본어는 오른쪽 열부터 차례로 읽습니다.

내려받다가 끊기면 어떻게 되나요?

다시 시도하면 됩니다. 진행 표시에 무엇이 잘못됐는지 나오고 다시 시도 버튼이 생깁니다. 끝까지 받아 확인을 마친 파일은 남겨 두므로 다시 시도하면 나머지만 받고, 반쯤 받은 파일은 쓰지 않습니다.

관련 도구