PDF 텍스트 OCR 변환기

브라우저에서 PDF를 텍스트로 변환하고 일반 TXT 파일로 다운로드하세요. 필요한 경우에만 텍스트 인식 기능을 켜고, 그렇지 않을 때는 꺼 둘 수 있습니다.

파일 업로드

또는 파일을 끌어다 놓거나, 붙여넣거나, 클라우드에서 선택하세요

URL 붙여넣기 샘플 사용
Google Drive Dropbox OneDrive
100% 무료 설치 필요 없음 안전하고 개인 정보 보호
광고
신뢰받는 서비스
eBay Booking.com University of Michigan Cornell University Columbia University
이 도구 평가하기
0/5 · 0 투표

OCR 사용 여부를 선택해 PDF를 텍스트로 변환

PDF를 텍스트로 변환하는 작업에는 두 가지가 있고, 이 변환기는 필요한 방식을 선택할 수 있게 합니다. 대부분의 PDF에는 이미 실제 문자 데이터가 있어 텍스트를 읽어오기만 하면 됩니다. 스캔된 PDF에는 대신 페이지 이미지가 들어 있어, 내용을 추출하기 전에 문자 인식이 필요합니다.

텍스트 인식은 기본적으로 꺼져 있으며, 이는 의도된 설정입니다. 실제 텍스트 레이어가 있는 PDF는 이미지를 해석하지 않고 단어를 그대로 복사하기 때문에 인식 없이 더 빠르고 정확하게 변환됩니다. 필요 없는 파일에 인식을 켜면 정확도만 떨어질 수 있습니다.

어떤 종류의 파일인지 확인하는 데는 몇 초면 충분합니다. PDF를 리더에서 열고 한 줄을 드래그해 보세요. 단어가 선택되면 OCR 토글은 끈 채로 두세요. 아무 것도 선택되지 않으면 스위치를 켜고, 인식이 지원하는 124개 문서 언어 중에서 파일에 맞는 언어를 고르세요.

단 한 줄도 다시 치지 않고 PDF에서 텍스트 추출

PDF에서 텍스트를 추출하면 보기만 가능하던 페이지가 실제로 활용할 수 있는 단어가 됩니다. 변환기는 찾아낸 모든 내용을 일반 텍스트 파일로 작성하므로, 인용문을 복사하고, 문단을 이메일에 붙여넣고, 어떤 편집기에서든 찾기 기능으로 전체 문서를 검색할 수 있습니다.

이로써 보통 떠올리는 작업을 대부분 처리할 수 있습니다. 논문에서 참고 내용을 가져오거나, 보고서에서 수치를 뽑아 오거나, 긴 문서의 본문을 작성 도구로 옮기는 일 등입니다. 아무 것도 다시 입력하거나 손으로 옮겨 적을 필요가 없습니다.

여러 개의 PDF를 한 번에 올릴 수 있습니다. 각 파일은 개별적으로 변환되어 각각의 텍스트 파일로 돌아오며, 모두 같은 OCR 설정과 같은 언어가 적용됩니다. 계정은 필요 없고 이메일 주소도 요청하지 않습니다.

TXT 파일이란?

.txt 파일 확장자는 일반 텍스트 파일에 사용됩니다. 이 파일에는 여러 줄의 텍스트가 들어 있으며, 다양한 플랫폼과 기기에서 여러 텍스트 편집기로 열 수 있습니다. 텍스트에는 서식 정보가 포함되지 않습니다.

이는 문서 형식이 아닌 PDF에서 TXT로 변환하는 핵심 이유이기도 합니다. 이 파일은 어떤 컴퓨터와 어떤 휴대폰에서도 열 수 있고, 읽는 데 라이선스가 필요 없으며, 원본을 만든 프로그램이 바뀐 뒤에도 계속 읽을 수 있습니다.

파일 확장자: .txt, MIME 타입: text/plain

위키백과의 TXT

PDF에서 TXT로 변환할 때 텍스트 파일이 유지하는 것

일반 텍스트 파일은 페이지가 아니라 단어를 담습니다. 변환 후 남는 것과 남지 않는 것은 다음과 같습니다.

PDF에서 TXT 파일에서
단어와 줄바꿈 유지됨
읽기 순서 위에서 아래로 유지됨
굵게, 기울임 및 글꼴 삭제됨
이미지, 로고 및 차트 삭제됨
격자 없이 텍스트만 유지됨
다단 페이지 한 개의 단으로 이어 붙임
머리글, 바닥글 및 쪽 번호 본문과 함께 텍스트로 작성됨

일반 텍스트 파일은 레이아웃이 아닌 단어를 담습니다. 서식이 단어만큼 중요한 경우에는 PDF를 Word로 변환하는 앱이 더 적합합니다.

PDF를 텍스트로 변환하는 것이 알맞은 경우

PDF의 단어는 페이지 레이아웃 안에 고정되어 있습니다. 이 중에서 단순 텍스트로 꺼냈을 때 수고를 가장 크게 줄일 수 있는 경우는 다음과 같습니다.

인용과 조사

논문, 보고서, 책은 PDF로 공유되는 경우가 많습니다. 텍스트를 한 번 추출해 두면 필요한 구절을 다시 치지 않고 그대로 노트에 붙여넣을 수 있습니다.

긴 문서 검색

텍스트 파일은 어떤 편집기에서나 열리므로, 페이지를 한 장씩 읽는 대신 이름, 날짜, 금액 등으로 바로 이동할 수 있습니다.

다른 도구에 텍스트 넣기

번역기, 작성 도구, 화면 판독기, 스프레드시트 등은 모두 일반 텍스트를 받습니다. TXT는 거의 모든 도구가 별도 변환기 없이 받아들이는 형식입니다.

데이터 보호

사용자가 변환하는 PDF에는 종종 계약서, 청구서, 개인적인 서신이 포함됩니다. 여러분의 파일이 어떻게 처리되는지 정확히 알려드립니다.

TLS 암호화

모든 업로드와 다운로드는 암호화된 연결을 통해 전송되어, 전송 중 파일을 읽을 수 없습니다.

ISO 27001 데이터 센터

처리는 유럽 연합 내의 인증된 데이터 센터에서 이루어집니다.

사람이 열람하지 않음

텍스트 인식은 완전히 자동으로 수행됩니다. 누구도 사용자의 스캔본이나 문서를 열람하지 않으며, 어떤 내용도 제3자와 공유되지 않습니다.

PDF를 텍스트로 변환하는 방법

1

업로드

PDF를 업로드하세요.

2

선택

PDF가 스캔본이면 OCR을 켜세요. 파일에서 텍스트를 이미 선택할 수 있다면 끈 상태로 두세요.

3

조정

메뉴에서 문서 언어를 선택하세요(선택 사항).

4

변환

"Start"를 클릭하고 변환이 끝날 때까지 기다리세요.

PDF를 텍스트로 변환하기 자주 묻는 질문

이 PDF 텍스트 변환기는 무료인가요?

예. PDF를 텍스트로 변환하는 기능은 무료이며 계정이 필요 없고, 이메일 주소도 요구하지 않습니다. 파일을 업로드하고 변환을 시작한 뒤 텍스트를 다운로드하면 됩니다. 요금제는 아주 큰 파일이나 긴 일괄 작업에만 관련이 있습니다.

PDF를 텍스트로 변환하려면 어떻게 하나요?

위에 PDF를 업로드하고, 파일에서 텍스트를 이미 선택할 수 있으면 OCR 토글을 끈 채로 두고 변환을 시작하세요. 결과는 어떤 편집기에서도 열 수 있는 일반 텍스트 파일입니다. 설치해야 할 프로그램은 없습니다.

PDF에서 텍스트를 복사하려면 어떻게 하나요?

단어 위를 드래그했을 때 강조 표시가 되면, PDF 리더에서 바로 복사할 수 있습니다. 그렇지 않다면 페이지는 이미지이고 선택할 수 있는 내용이 없습니다. PDF를 텍스트로 변환하면 출력물이 자유롭게 복사 가능한 텍스트 파일이기 때문에 이 문제가 해결됩니다.

PDF를 TXT로도 변환할 수 있나요?

바로 이 변환기가 작성하는 형식이 TXT입니다. TXT는 일반 텍스트 형식이므로, 다운로드한 파일의 확장자는 .txt이고 미디어 타입은 text/plain입니다. 메모장, TextEdit, 모든 코드 편집기, 모든 휴대폰에서 별도 소프트웨어 없이 열립니다.

왜 OCR이 기본적으로 꺼져 있나요?

대부분의 PDF에는 OCR이 필요 없기 때문입니다. 실제 텍스트 레이어가 있는 PDF는 이미지를 인식하는 대신 단어를 복사해 내기만 하면 되므로 더 빠르고 정확하게 변환됩니다. 페이지가 스캔본이나 사진일 때만 OCR을 켜고, 이때 언어 선택기가 함께 나타납니다.

이 PDF 텍스트 변환기는 스캔된 PDF에도 작동하나요?

예, OCR을 켠 상태라면 가능합니다. 인식 기능이 페이지 이미지에서 문자를 읽어 텍스트 파일에 작성합니다. 변환하는 파일이 대부분 스캔본이라면, 스캔된 PDF를 텍스트로 변환하는 앱이 같은 결과에 더 곧바로 도달하는 방법입니다.

텍스트 인식은 어떤 언어를 읽을 수 있나요?

이 도구는 124개 원본 언어를 인식합니다. 유럽 언어와 함께, 힌디어, 벵골어, 타밀어, 우르두어, 아랍어, 태국어, 일본어, 한국어, 중국어(간체와 번체 모두)를 지원합니다. 최상의 결과를 위해 문서가 작성된 언어를 선택하세요.

여러 개의 PDF를 한 번에 텍스트로 변환할 수 있나요?

네. 필요한 만큼 PDF를 추가하면 한 번에 변환되며, 각각 동일한 OCR 설정과 언어가 적용된 개별 텍스트 파일로 제공됩니다.

텍스트 인식 더 알아보기

노란 책상 위 스캐너 브래킷에 올려진 펼친 책과, 페이지 위에 Save Valuable Text With OCR라는 글 제목이 인쇄된 모습
사용 방법

OCR로 소중한 텍스트 저장

스캔한 문서와 이미지에서 OCR(광학 문자 인식)로 중요한 텍스트를 디지털화하세요. 이미지를 온라인에서 손쉽게 텍스트로 추출할 수 있습니다.

기사 읽기