이미지나 PDF를 여기에 놓으세요
또는 클릭해서 파일 선택 — 여러 개를 한 번에 골라도 됩니다또는 Ctrl+V로 붙여넣기
인식 언어
이미지나 PDF를 추가하면 읽기가 시작됩니다

이미지 텍스트 추출

사진, 스크린샷과 스캔한 PDF의 글자를 읽습니다. 인식 언어를 선택하고 결과를 확인한 뒤 텍스트를 복사하거나 TXT로 저장하세요.

이 도구가 하는 일

인쇄된 글자를 잘 읽습니다

인식 정확도는 선명도, 언어, 배치와 조명에 따라 달라집니다. 이름, 날짜, 숫자는 원본과 꼭 대조하세요.

아홉 가지 언어

영어, 중국어(간체·번체), 일본어, 한국어, 독일어, 프랑스어, 스페인어, 이탈리아어. 영어가 아닌 언어를 고르면 영어도 함께 불러옵니다. 실제 문서에는 주문번호, 이메일, 금액처럼 로마자로 적힌 것이 가득하기 때문입니다.

스캔 PDF를 쪽 단위로

PDF를 열어 한 쪽씩 읽으므로, 여러 쪽짜리 스캔본을 미리 이미지로 내보낼 필요가 없습니다.

여러 파일을 한 번에

폴더 하나 분량의 스크린샷을 놓으면 차례로 처리됩니다. 하나가 실패해도 나머지는 계속되므로, 잘못된 파일 하나가 전체를 멈추지 않습니다.

복사하거나 내려받기

결과를 바로 클립보드에 복사하거나.txt 파일로 저장할 수 있습니다. 파일이 여러 개면 각각 이름이 붙어 결과가 섞이지 않습니다.

이미지에서 텍스트를 추출하는 방법

1

파일 추가

이미지나 PDF를 끌어다 놓거나 클릭해서 고르세요. JPG, PNG, WebP, GIF, BMP, PDF를 지원하며 파일당 50MB까지입니다.

2

언어 선택

이 페이지의 언어가 아니라 이미지 속 글자의 언어를 고르세요. 정확도에 가장 크게 영향을 주는 것이 이 설정입니다.

3

텍스트 복사 또는 내려받기

파일마다 끝나는 대로 결과가 나타납니다. 전체를 클립보드에 복사하거나.txt로 저장하세요.

실제 처리 예시

이미지 텍스트 추출 · 예시 1

이 도구 또는 도구와 동일한 처리 코드로 만든 결과입니다. 입력 파일, 설정, 결과를 비교하고 파일을 내려받아 확인하세요.

더 잘 읽히게 하려면

언어부터 제대로 고르기

영향이 가장 큰 항목입니다. 영어 모델로 한국어를 읽히면 이미지가 아무리 선명해도 알아볼 수 없는 결과만 나옵니다.

글자 부분만 잘라내기

책장을 찍으면 책상이나 손, 방의 일부까지 함께 담기기 마련입니다. 종이 면만 남기면 엔진이 헷갈릴 요소가 줄어듭니다.

밝기보다 고른 조명

종이 절반에 그림자가 드리운 편이 전체적으로 조금 어두운 것보다 훨씬 나쁩니다. 더 밝게 비추기보다 빛이 고르게 드는 자리로 옮기세요.

글줄을 수평으로

비스듬히 흐르는 글자는 눈에 띄게 잘 읽히지 않습니다. 올리기 전에 사진을 반듯하게 돌리는 몇 초는 충분히 값어치를 합니다.

원본 파일 쓰기

스크린샷의 스크린샷이나 여러 앱을 거쳐 전달된 사진은 그때마다 압축됩니다. 원본이 언제나 더 선명합니다.

인쇄체는 되고 손글씨는 안 됩니다

인쇄되거나 컴퓨터로 조판된 글자를 대상으로 합니다. 손글씨 인식은 전혀 다른 문제이며, 여기서 시도하면 실망하게 됩니다.

실제 처리 예시

이미지 텍스트 추출 · 더 많은 예시

이 도구 또는 도구와 동일한 처리 코드로 만든 결과입니다. 입력 파일, 설정, 결과를 비교하고 파일을 내려받아 확인하세요.

텍스트 추출에 관한 질문

네. OCR(광학 문자 인식)은 그림 속 인쇄된 글자를 읽어내는 일을 통틀어 부르는 이름이고, 이 도구가 하는 일이 바로 그것입니다. 대부분의 OCR 사이트와 다른 점은 실행 위치입니다. 파일을 남의 서버로 올리는 대신, 엔진을 당신의 브라우저로 내려받아 돌립니다.
인식 정확도는 선명도, 언어, 배치와 조명에 따라 달라집니다. 이름, 날짜, 숫자는 원본과 꼭 대조하세요.
읽지 못합니다. 이 점은 분명히 말씀드립니다. 이 엔진은 인쇄되거나 조판된 글자를 위한 것입니다. 손글씨 인식은 다른 모델이 필요한 별개의 문제이며, 여기서 시도하면 시간만 낭비하게 됩니다.
안 됩니다. 표 안의 글자는 읽히지만 행과 열 구조는 유지되지 않습니다. 얻는 것은 글자이지 표가 아닙니다. 엔진이 표 구조를 애초에 인식하지 않으므로 쓸 만한 엑셀로 내보낼 방법이 없습니다.
선택한 파일의 내용은 브라우저에서 처리하며 앱의 업로드 서버로 보내지 않습니다. 다만 사이트, 글꼴, 처리 라이브러리를 불러오는 데는 네트워크 요청이 필요할 수 있습니다.
먼저 인터넷에 연결한 상태에서 페이지를 여세요. 열린 탭에서 처리가 이어질 수 있지만 새로고침, 외부 자료와 미리 저장되지 않은 엔진·모델 로딩에는 연결이 필요합니다.
이 페이지의 언어가 아니라 이미지 속 글자의 언어입니다. 잘못 고르면 아무리 선명한 이미지라도 알아볼 수 없는 결과가 나옵니다. 영어가 아닌 언어를 고르면 영어도 함께 불러오므로, 주문번호나 이메일이 섞인 문서도 제대로 읽힙니다.
읽습니다. 각 쪽을 차례로 그려서 읽고 결과도 쪽 단위로 나타납니다. 아주 긴 문서는 앞의 100쪽까지만 처리하며, 그럴 때는 조용히 잘라내지 않고 알려 드립니다.
오류가 아니라 「글자를 찾지 못했습니다」라고 표시됩니다. 읽을 글자가 없는 이미지는 비정상이 아니라 정상적인 결과이기 때문입니다. 대개는 이미지가 흐리거나 글자가 너무 작거나 언어를 잘못 고른 경우입니다.
원래 없어야 하기 때문입니다. 인식 엔진은 한자 하나하나를 별개의 단어로 취급해 그 사이마다 공백을 넣고, 그 결과 그대로는 쓰기 불편해집니다. 여기서는 그 공백을 없앱니다. 다만 한자와 로마자 사이의 공백은 실제로 존재하는 것이므로 남깁니다.
있습니다. 몇 장이든 놓으면 차례를 기다리며, 끝나는 것부터 결과가 나타납니다. 하나가 실패해도 나머지는 계속되고, 도중에 멈춰도 이미 읽어낸 내용은 사라지지 않습니다.