PDF OCR 변환 무료: 스캔 PDF를 검색·복사 가능한 문서로 만들기
PDF Toucan editorial team · 최종 업데이트: 2026년 9월 20일 · 8분 읽기

스캔한 문서에 PDF OCR 변환 무료 기능을 적용하면 이미지로만 보이던 글자에 텍스트 정보가 추가되어 검색하고 복사할 수 있는 PDF가 됩니다. PDF Toucan에서 PDF를 선택하고 문서 언어를 지정한 뒤 텍스트 인식을 실행하면, 가입이나 워터마크 없이 검색 가능한 PDF를 내려받을 수 있습니다.
스캔 PDF를 검색 가능한 문서로 바꾸려면 OCR이 왜 필요한가요?
스캐너나 휴대폰으로 만든 PDF는 겉보기에는 일반 문서와 같아도, 실제로는 종이 페이지를 촬영한 이미지가 들어 있는 경우가 많습니다. 사람은 화면의 글자를 읽지만 PDF 뷰어는 글자가 아닌 픽셀로 인식합니다. 따라서 다음 문제가 생깁니다.
Ctrl+F로 단어, 이름, 문서 번호를 찾아도 결과가 없습니다.- 문장을 선택하려 해도 글자 대신 페이지 이미지의 영역이 선택됩니다.
- 복사한 내용을 메모장에 붙여 넣으면 비어 있거나 쓸 수 없는 결과가 나옵니다.
OCR은 광학 문자 인식 기능입니다. 이미지 속 글자 모양을 분석해 한글, 영어, 숫자 등의 문자로 읽고, 페이지 이미지 위에 보이지 않는 텍스트 레이어를 넣습니다. 원래 스캔 이미지의 모양은 유지하면서 검색, 선택, 복사 기능을 쓸 수 있게 됩니다.
다만 OCR은 완벽한 전사가 아닙니다. 선명하게 인쇄되고 바르게 스캔된 문서는 결과가 좋은 편이지만, 흐린 복사본, 그림자가 있는 사진, 손글씨, 도장과 겹친 글자, 매우 작은 글씨, 복잡한 표는 오인식될 수 있습니다. 계약 금액, 날짜, 주소, 계좌번호처럼 오류 영향이 큰 정보는 반드시 원본 이미지와 대조해야 합니다.
PDF를 Word로 바꾸는 작업도 OCR과는 다릅니다. OCR되지 않은 스캔 PDF를 Word로 변환하면 텍스트 문단이 아니라 페이지 그림으로 들어갈 수 있습니다. 검색과 복사가 목적이면 OCR PDF를 사용하고, 편집이 필요하면 OCR 후 Word 변환을 진행하는 순서가 적합합니다.
| 작업 목적 | 권장 순서 | 얻는 결과 |
|---|---|---|
| 단어·문서 번호 검색 | OCR 실행 | 검색 가능한 PDF |
| 문장 복사 | OCR 실행 | 선택·복사 가능한 텍스트 |
| Word에서 수정 | OCR 후 PDF → Word | 편집 검토용 DOCX |
| 전자서명 검증 보관 | 원본은 변경하지 않음 | 서명 검증용 원본 |
PDF Toucan에서 무료 PDF OCR 변환은 어떻게 하나요?
PDF OCR 도구를 열면 PC, 태블릿, 휴대폰의 브라우저에서 스캔 PDF를 처리할 수 있습니다. 입력과 결과 형식은 모두 PDF입니다.
- 페이지에서
PDF 파일 선택을 누르고 스캔 PDF를 고릅니다. 파일을 페이지 아무 곳에나 끌어 놓거나 클립보드에서 파일을 붙여 넣을 수도 있습니다. - 문서 언어에서 문서에 실제로 쓰인 언어를 하나 이상 선택합니다. 언어를 선택해야 인식을 시작할 수 있습니다.
- 필요하면 More options를 열어 인식할 페이지와 페이지 보정 옵션을 정합니다. 일반적인 스캔본은 텍스트가 없는 페이지만 처리하는 권장 방식을 그대로 사용하면 됩니다.
텍스트 인식을 누릅니다. 페이지 수가 많으면 텍스트 인식에 몇 분이 걸릴 수 있으므로 완료될 때까지 기다립니다.- 완료 메시지가 표시되면
Download the searchable PDF를 눌러 결과 파일을 저장합니다. - 저장한 PDF를 열어 검색과 복사가 정상 작동하는지 확인합니다.
여러 PDF를 추가할 수 있지만 각 파일은 개별적으로 처리됩니다. 파일별로 언어가 다르거나 품질 차이가 크다면 결과를 각각 검수하세요.
PDF Toucan의 브라우저 도구는 계정, 워터마크, 일일 사용 횟수 제한 없이 이용할 수 있으며 광고로 운영됩니다. OCR은 서버 처리가 필요한 기능이므로 파일은 HTTPS로 유럽연합 내 서버에 전송됩니다. 파일은 디스크에 저장되지 않고 메모리에서 처리되며, 결과를 다운로드한 즉시 또는 늦어도 10분 안에 삭제됩니다. 조직 정책상 문서가 기기 밖으로 나가면 안 된다면 오프라인 OCR 프로그램을 사용해야 합니다.
OCR 문서 언어는 한국어만 선택하면 되나요?
문서 언어 선택은 단순한 표시 설정이 아니라 인식 품질과 처리 속도에 영향을 줍니다. OCR 엔진은 선택한 언어의 문자 체계와 단어 패턴을 바탕으로 흐린 글자를 판단합니다. 한글만 있는 문서라면 한국어만 선택하고, 실제로 섞여 있는 언어만 추가하세요.
예를 들면 다음과 같습니다.
- 한글 공문서, 국내 영수증, 강의 자료: 한국어
- 한글·영문 이력서와 제품 설명서: 한국어와 영어
- 한글 본문에 중국어 인명이나 주소가 많은 자료: 한국어와 중국어
- 영문 계약서에 한국어 메모가 포함된 파일: 영어와 한국어
한 번에 최대 5개 언어를 조합할 수 있습니다. 한국어, 중국어, 일본어를 비롯해 라틴 문자, 키릴 문자, 그리스 문자, 아랍 문자 등 30개 언어를 지원합니다. 다만 문서에 없는 언어까지 많이 선택하면 처리 시간이 길어질 수 있고, 모양이 비슷한 문자를 잘못 판단할 가능성도 있습니다.
기울거나 옆으로 스캔된 PDF는 어떻게 보정하나요?
스캔 품질은 OCR 정확도에 직접 영향을 줍니다. 종이가 비스듬하거나 거꾸로 들어간 파일은 텍스트 인식 전에 More options의 페이지 보정 항목을 확인하세요.
Straighten tilted pages: 스캐너에 비스듬히 들어가 기울어진 페이지를 바로잡습니다. 문장 줄이 수평에 가까워져 읽기와 인식에 도움이 됩니다.Fix page orientation automatically: 거꾸로 또는 옆으로 스캔된 페이지를 올바른 방향으로 자동 회전합니다.
인식할 페이지를 정하는 옵션도 문서 상태에 따라 선택해야 합니다.
| 옵션 | 작동 방식 | 알맞은 경우 | 주의할 점 |
|---|---|---|---|
Scan pages without text | 텍스트가 없는 페이지만 인식하고 기존 텍스트 페이지는 유지 | 일반 스캔본, 디지털 PDF와 스캔이 섞인 문서 | 기존의 잘못된 텍스트는 개선되지 않음 |
Recognize existing text again | 기존의 잘못 인식된 텍스트를 지우고 다시 인식 | 검색은 되지만 복사 결과가 깨진 PDF | 이 모드에서는 기울기 보정을 사용할 수 없음 |
Treat every page as an image | 모든 페이지를 이미지로 바꾼 후 처음부터 인식 | 텍스트 레이어가 손상되었거나 일관성이 없는 PDF | 기존 선택 텍스트와 링크가 사라짐 |
대부분의 경우 Scan pages without text가 권장됩니다. 이미 정상인 디지털 텍스트는 건드리지 않고 이미지형 페이지만 처리하기 때문입니다. 읽을 수 있는 단어를 검색해도 나오지 않거나, 복사 결과가 의미 없는 문자로 나올 때 재인식을 고려하세요.
Recognize existing text again을 사용하면 Straighten tilted pages는 사용할 수 없습니다. 기울기 보정과 완전 재인식이 모두 필요하다면 Treat every page as an image를 검토할 수 있지만, 기존 링크와 선택 가능한 텍스트가 사라진다는 점을 먼저 확인해야 합니다.
OCR 결과가 제대로 인식됐는지 어떻게 확인하나요?
완료 메시지만 보고 중요한 문서에 바로 사용하지 마세요. 검색, 복사, 원본 대조를 함께 하면 실용적인 오류를 빠르게 찾을 수 있습니다.
- 내려받은 searchable PDF를 PDF 뷰어에서 엽니다.
- Windows나 ChromeOS에서는
Ctrl+F, macOS에서는Command+F를 누릅니다. 모바일에서는 뷰어의 검색 메뉴를 엽니다. - 제목, 성명, 회사명, 날짜, 청구 번호처럼 원본에서 확실히 보이는 단어를 검색합니다. 검색 결과가 올바른 페이지로 이동하는지 확인합니다.
- 문서의 앞, 중간, 뒤쪽에서 각각 검색해 봅니다. 한 파일 안에서도 스캔 상태가 다른 구간은 인식 품질이 달라질 수 있습니다.
- 짧은 문장을 드래그해 복사한 뒤 메모장 같은 일반 텍스트 편집기에 붙여 넣습니다. 원본과 비교해 글자가 정상 추출되는지 확인합니다.
- 금액, 날짜, 표의 숫자, 작은 각주, 주민등록번호처럼 오류 영향이 큰 정보는 원본과 한 글자씩 대조합니다.
특히 0과 O, 1과 l, 5와 S처럼 모양이 비슷한 숫자와 영문자는 흐린 스캔에서 바뀔 수 있습니다. 표는 셀 순서나 줄바꿈이 달라질 수 있으므로 복사한 텍스트만 믿지 않는 것이 좋습니다.
결과가 좋지 않다면 더 선명하고 바르게 스캔한 원본을 준비하고, 문서 언어와 페이지 방향을 다시 설정해 OCR을 실행하세요. 기존 OCR 레이어가 문제라면 재인식 옵션이 도움이 될 수 있습니다. 손글씨나 번진 도장 부분은 자동 인식이 어려울 수 있습니다.
전자서명이 있는 PDF에 OCR을 적용하면 문서 내용이 변경되므로 디지털 서명은 더 이상 유효하지 않습니다. 서명 검증이나 원본 보관이 필요한 파일은 OCR 전 원본을 별도로 보관하고, OCR 결과물은 검색·검토용 사본으로 사용하세요.
OCR한 PDF를 Word로 편집하거나 검색하려면 어떻게 하나요?
검색과 복사가 목적이라면 OCR 후 받은 searchable PDF를 그대로 사용하면 됩니다. Word에서 내용을 수정하거나 재활용해야 한다면 OCR을 끝낸 뒤 Word 변환을 진행하세요.
- PDF OCR 도구에서 스캔 PDF를 인식하고 searchable PDF를 내려받습니다.
- 결과 PDF에서 검색과 복사가 되는지 먼저 검수합니다.
- PDF → Word 도구에서
PDF 파일 선택을 누르고, 원본 스캔본이 아닌 OCR 완료 PDF를 선택합니다. Word로 변환을 누릅니다.- Word 문서를 내려받아 열고 제목, 문단, 표, 숫자, 줄바꿈을 원본 PDF와 비교합니다.
이 순서가 중요한 이유는 PDF → Word 도구가 스캔 이미지 자체를 문자로 읽어 내는 OCR 기능은 제공하지 않기 때문입니다. OCR되지 않은 스캔 페이지는 Word 문서에서 그림으로 추가될 수 있어 문장을 바로 수정할 수 없습니다. 반면 OCR을 거친 PDF에는 검색 가능한 텍스트가 있으므로 후속 변환의 출발점으로 적합합니다.
복잡한 표, 다단 편집, 세로쓰기, 작은 각주가 포함된 문서는 Word로 옮긴 뒤 줄바꿈이나 표 모양을 조정해야 할 수 있습니다. 편집용 DOCX를 만들더라도 OCR PDF를 기준으로 열어 두고 대조하세요.
FAQ
PDF OCR 변환 무료로 하면 파일에 워터마크가 생기나요?
PDF Toucan의 OCR 도구는 계정 없이 사용할 수 있고 결과 PDF에 워터마크를 추가하지 않습니다. 일일 사용 횟수 제한도 없습니다. 다만 OCR 정확도는 원본 스캔 품질과 언어 설정에 따라 달라지므로, 중요한 정보는 결과 파일에서 반드시 검수해야 합니다.
한글과 영어가 섞인 스캔 PDF는 언어를 어떻게 선택하나요?
문서에 실제로 포함된 한국어와 영어를 함께 선택하세요. 한글 본문에 영문 이름, 제품명, 주소, 표 제목이 섞인 문서도 두 언어를 선택하는 편이 적합할 수 있습니다. 최대 5개까지 조합할 수 있지만 불필요한 언어는 처리 속도를 늦출 수 있습니다.
OCR 후에도 PDF에서 검색이 안 되면 무엇을 확인해야 하나요?
먼저 원본 스캔본이 아니라 Download the searchable PDF로 받은 결과 파일을 열었는지 확인하세요. 다음으로 문서 언어, 페이지 방향, 검색어 철자를 점검합니다. 기존 텍스트 레이어가 잘못된 파일은 Recognize existing text again 또는 모든 페이지 재인식이 도움이 될 수 있습니다.
스캔 PDF를 바로 Word로 변환하면 글자를 수정할 수 있나요?
항상 가능한 것은 아닙니다. OCR되지 않은 스캔 PDF의 페이지는 Word 문서에서 그림으로 추가될 수 있어 문장을 직접 수정할 수 없습니다. 먼저 OCR로 텍스트 레이어를 만든 searchable PDF를 확인한 뒤 Word 변환을 실행하고, 변환된 문단과 표를 원본과 비교해 수정하세요.
