PDF 글자 추출
문서에서 문장을 다시 타이핑하지 말고, 어느 쪽이 제대로 나왔는지 눈으로 보면서 가져오세요.
도구를 준비하고 있어요.
이용자 평가
아직 등록된 리뷰가 없어요. 이 도구를 써 보셨다면 첫 리뷰를 남겨 주세요.
PDF 글자 추출 상세 가이드
사용법과 예제를 살펴보고, 궁금한 내용은 주제별로 찾아보세요.
시작 전에 한눈에 보기
- 지원 파일
- PDF 한 개를 60MB·1,000쪽까지 읽습니다.
- 쪽 범위
- 1-3, 7처럼 적고 비우면 전체가 대상입니다.
- 빈 쪽 표시
- 글자를 찾지 못한 쪽을 목록과 안내로 알려 줍니다.
- 원문 대조
- 고른 쪽을 그려 추출문과 나란히 보여 줍니다.
- 줄바꿈
- 그대로 두거나 문단으로 이어 붙일 수 있습니다.
- 읽는 차례
- 글자 위치로 짐작합니다. 두 단·표는 어긋날 수 있습니다.
- 스캔 문서
- 글자가 그림이라 꺼낼 수 없고 이미지 글자 추출로 안내합니다.
- 처리 위치
- 파일을 서버로 보내지 않고 이 브라우저에서만 읽습니다.
PDF 글자 추출 사용 순서
PDF를 넣고 꺼낼 쪽을 정하세요
전체가 필요하면 비워 두고, 일부만 필요하면 1-3, 7처럼 적습니다. 범위를 잘못 적으면 몇 쪽까지 있는지와 함께 이유를 알려 줍니다. 긴 문서는 진행률이 보이고 도중에 취소할 수 있습니다.
줄바꿈 방식을 고르세요
줄바꿈 유지는 문서에 보이는 줄을 그대로 남깁니다. 표나 목록을 옮길 때 좋습니다. 문단으로 잇기는 줄을 이어 붙이고 빈 줄만 문단 경계로 삼습니다. 글을 다시 편집할 때 편합니다.
쪽을 넘겨 가며 원문과 견주세요
쪽 단추를 누르면 왼쪽에 실제 쪽이 그려지고 오른쪽에 그 쪽에서 꺼낸 글자가 나옵니다. 글자를 찾지 못한 쪽은 단추가 점선으로 표시되고 그 쪽을 고르면 이유를 함께 안내합니다.
쪽별 또는 전체를 가져가세요
한 쪽만 복사하거나 전체를 복사·저장할 수 있습니다. 쪽 번호 머리말을 넣으면 어디서 온 글인지 남아 나중에 찾기 쉽습니다.
이런 작업에 활용하세요
빈 쪽을 완료로 넘기지 않습니다
사진으로 스캔한 문서는 글자가 그림으로 들어 있어 아무리 눌러도 텍스트가 나오지 않습니다. 이 도구는 쪽마다 결과를 따로 남겨 글자를 찾지 못한 쪽을 목록에 표시하고, 고른 쪽이 모두 비어 있으면 스캔 문서일 가능성을 알리며 이미지 글자 추출로 이어지는 길을 안내합니다.
원문을 옆에 두고 확인합니다
PDF는 글자의 위치만 저장하고 읽는 차례는 저장하지 않습니다. 그래서 두 단으로 짠 문서나 표는 좌우가 한 줄로 합쳐질 수 있습니다. 왼쪽에 실제 쪽을 그려 주므로 결과가 이상하면 바로 원문과 견줘 볼 수 있습니다. 줄바꿈을 그대로 둘지 문단으로 이어 붙일지도 고를 수 있습니다.
예제로 결과 이해하기
한국어와 영문이 섞인 문서
2쪽 PDF · 전체 · 줄바꿈 유지계약 조건 안내
첫째 항목은 배송 기간입니다.
Second item is the refund policy.두 단으로 짠 문서
왼쪽과 오른쪽에 글이 나뉜 쪽왼쪽 1행 오른쪽 1행
왼쪽 2행 오른쪽 2행줄바꿈 방식 고르기
표를 좌우로 밀어 나머지 내용을 확인하세요.
| 방식 | 결과 | 어울리는 경우 |
|---|---|---|
| 줄바꿈 유지 | 문서에 보이는 줄을 그대로 둡니다. | 표, 목록, 주소처럼 줄이 뜻을 가지는 글 |
| 문단으로 잇기 | 줄을 이어 붙이고 빈 줄만 문단으로 나눕니다. | 본문을 다시 편집하거나 옮겨 쓸 때 |
결과가 예상과 다를 때
아무 글자도 나오지 않습니다
사진으로 스캔한 문서일 가능성이 큽니다. 글자가 그림으로 들어 있어 이 방법으로는 꺼낼 수 없습니다. 안내에 있는 이미지 글자 추출로 옮겨 인식해 보세요.
일부 쪽만 비어 있습니다
문서 안에 스캔한 쪽이 섞여 있는 경우입니다. 어떤 쪽이 비었는지 목록으로 알려 드리니 그 쪽만 따로 인식하시면 됩니다.
글이 뒤섞여 나옵니다
두 단이나 표처럼 복잡한 배치에서는 같은 높이의 글이 한 줄로 합쳐집니다. 왼쪽 원문과 견줘 확인하고 필요하면 쪽을 나눠 꺼내 보세요.
암호가 걸린 PDF를 열지 못합니다
암호가 걸린 문서는 열 수 없습니다. 원래 프로그램에서 암호를 해제한 사본으로 저장한 뒤 넣어 주세요.
알아두면 쉬운 용어
- 텍스트 레이어
- PDF 안에 글자로 저장된 부분입니다. 이것이 있어야 글자를 꺼낼 수 있습니다.
- 스캔 문서
- 종이를 찍거나 스캔해 그림으로 만든 문서입니다. 글자로 저장돼 있지 않습니다.
- 읽는 차례
- 사람이 읽는 순서입니다. PDF는 이 순서를 따로 저장하지 않는 경우가 많습니다.
PDF 글자 추출 자주 묻는 질문
스캔한 문서도 되나요?
되지 않습니다. 글자가 그림으로 들어 있기 때문입니다. 그럴 때는 글자를 찾지 못했다고 알려 드리며 이미지 글자 추출로 옮겨 인식하시면 됩니다.
읽는 차례가 원문과 같나요?
보장하지 않습니다. 글자의 위치를 보고 차례를 짐작합니다. 두 단이나 표처럼 복잡한 배치는 어긋날 수 있어 원문을 나란히 보여 드립니다.
파일이 서버로 올라가나요?
올라가지 않습니다. PDF를 읽고 글자를 꺼내는 과정이 모두 이 브라우저 안에서 이뤄집니다. 암호가 걸린 PDF는 먼저 암호를 해제해 주세요.
표를 표 모양 그대로 가져올 수 있나요?
가져올 수 없습니다. 글자만 꺼내며 칸 구조는 남지 않습니다. 줄바꿈 유지로 꺼낸 뒤 직접 정리해 주세요.
긴 문서를 넣으면 화면이 멈추나요?
한 쪽씩 처리하며 진행률을 보여 주고 중간에 취소할 수 있습니다. 처리 중에도 화면이 응답합니다.
글꼴이 없어도 글자가 나오나요?
대부분 나옵니다. 다만 글꼴을 특수하게 넣은 문서는 글자가 깨져 나올 수 있어 원문과 견줘 확인해 주세요.