PDF 워드 변환 깨짐: 원인별 해결과 OCR 변환 방법
PDF Toucan editorial team · 최종 업데이트: 2026년 9월 20일 · 9분 읽기

PDF 워드 변환 깨짐은 PDF의 고정된 페이지 배치와 Word의 편집 가능한 문단·표 재구성 방식이 달라서 주로 생깁니다. 선택되지 않는 스캔 PDF라면 먼저 OCR로 한국어 텍스트를 인식한 뒤 Word로 변환하고, 변환 후에는 표·숫자·줄바꿈을 원본 PDF와 반드시 대조하세요.
PDF를 Word로 변환하면 왜 레이아웃이 깨질까요?
PDF는 결과물을 동일한 모양으로 보여 주기 위한 형식입니다. 페이지 안의 글자, 선, 이미지, 도형이 어느 위치에 놓일지를 고정 좌표로 기록합니다. 반면 Word 문서는 문단, 글꼴, 표, 여백, 스타일을 바탕으로 화면과 종이 크기에 맞춰 내용을 다시 배치하는 편집 형식입니다.
따라서 PDF를 DOCX로 바꾸는 과정은 단순히 형식을 교체하는 작업이 아니라, 고정된 페이지에서 문단과 표의 구조를 추정해 다시 만드는 작업에 가깝습니다. 이 때문에 편집 가능한 Word 문서를 얻는 대신 원본과 완전히 같은 모양을 보장하기는 어렵습니다.
특히 다음 요소가 있으면 변환 결과가 달라질 가능성이 큽니다.
- 글꼴 대체: PDF에 포함된 글꼴을 Word 또는 현재 PC에서 사용할 수 없으면 다른 글꼴로 바뀝니다. 글자 폭이 달라져 줄바꿈, 행 높이, 페이지 나눔이 연쇄적으로 바뀔 수 있습니다.
- 다단 편집과 텍스트 상자: 신문형 보고서, 브로슈어, 여러 단으로 나뉜 문서, 도형 위의 글자는 일반 문단으로 복원되지 않고 텍스트 상자나 별도 요소가 될 수 있습니다.
- 표와 병합 셀: 선이 없는 표, 불규칙한 셀 병합, 셀 안의 여러 줄 텍스트는 표 구조를 정확히 판단하기 어렵습니다.
- 머리말·꼬리말과 각주: 페이지마다 반복되는 요소가 본문에 섞이거나 위치가 달라질 수 있습니다.
- 이미지 배치: PDF에서는 이미지가 정확한 좌표에 있지만, Word에서는 글자처럼 취급되거나 떠 있는 개체가 되어 캡션과 본문 위치가 움직일 수 있습니다.
원본이 단일 열의 일반 보고서, 계약서, 편지처럼 디지털로 만든 텍스트 PDF라면 비교적 안정적으로 변환됩니다. 반대로 디자인이 복잡한 홍보물, 도면, 수식이 많은 문서라면 변환본을 초안으로 보고 수동 정리를 계획하는 편이 현실적입니다.
변환 전에 내 PDF가 스캔본인지 확인하는 방법은 무엇인가요?
먼저 PDF 뷰어에서 문장 일부를 마우스로 드래그하거나 모바일에서 길게 눌러 보세요. 글자 단위로 선택되고 복사하거나 검색할 수 있다면 대체로 텍스트 PDF입니다. 이 경우 OCR 없이 바로 Word 변환을 시도해도 됩니다.
반대로 페이지 전체가 한 장의 사진처럼 선택되거나, 문구 검색이 되지 않거나, 복사한 내용을 붙여 넣어도 글자가 나오지 않는다면 스캔 PDF일 가능성이 높습니다. 종이 문서를 스캐너나 휴대폰 카메라로 촬영한 파일이 대표적입니다.
두 유형의 차이는 변환 결과에 직접 영향을 줍니다.
| PDF 상태 | 바로 Word 변환 시 결과 | 권장 순서 |
|---|---|---|
| 글자 선택·검색 가능 | 문단과 표를 편집 가능한 구조로 변환 시도 | PDF → Word |
| 페이지가 이미지처럼 선택됨 | 스캔 페이지가 Word에 그림으로 들어감 | OCR 후 PDF → Word |
| 선택은 되지만 복사 텍스트가 틀림 | 기존 텍스트 품질에 따라 오류가 이어질 수 있음 | OCR 재인식 검토 후 변환 |
PDF Toucan의 PDF → Word 도구는 스캔 페이지를 글자로 바꾸지 않습니다. 스캔본을 바로 변환하면 페이지는 Word 문서에 그림으로 추가되므로, 문단을 클릭해 수정할 수 없습니다. 스캔 문서를 편집 가능한 텍스트로 쓰려면 OCR을 먼저 실행해야 합니다.
이미 선택 가능한 글자가 있더라도 이전 OCR 결과가 심하게 틀렸다면 OCR에서 기존 텍스트를 다시 인식하는 방법을 검토할 수 있습니다. 다만 이 옵션은 기존의 선택 가능한 텍스트를 제거하고 다시 읽기 때문에, 링크도 사라질 수 있다는 점을 알아두세요.
텍스트 PDF를 PDF Toucan에서 Word로 변환하는 방법은 무엇인가요?
글자 선택이 가능한 PDF라면 다음 순서로 DOCX를 만드세요. 여러 PDF를 한 번에 추가할 수도 있습니다.
- PDF → Word 변환기를 엽니다.
- PDF 파일 선택을 눌러 변환할 PDF를 고릅니다. 파일을 페이지 안 아무 곳에나 끌어다 놓거나 붙여 넣어도 됩니다.
- 필요한 PDF를 모두 추가한 뒤 Word로 변환을 누릅니다.
- 변환이 끝나면 Word 문서 다운로드를 눌러 DOCX를 저장합니다.
- 다운로드한 파일을 Microsoft Word에서 열고, 원본 PDF를 함께 띄워 첫 페이지부터 비교합니다.
- 제목, 본문 줄바꿈, 목록, 표, 머리말·꼬리말, 페이지 나눔 순으로 점검한 뒤 본격적으로 편집합니다.
점검은 눈에 잘 띄는 디자인보다 문서의 의미를 바꿀 수 있는 항목부터 하는 것이 좋습니다. 예를 들어 계약서라면 조항 번호와 날짜, 견적서라면 수량·단가·합계, 보고서라면 표 제목과 각주를 먼저 확인하세요.
PDF Toucan의 브라우저 도구는 가입이 필요 없고, 워터마크와 일일 사용 제한도 없습니다. 광고로 운영됩니다. 파일은 HTTPS를 통해 유럽연합 서버로 전송되어 디스크에 저장하지 않고 메모리에서 처리되며, 결과를 다운로드한 즉시 또는 늦어도 10분 안에 삭제됩니다.
스캔 PDF는 OCR 후 어떻게 Word로 변환하나요?
OCR은 이미지 속 글자를 인식해 검색과 복사가 가능한 텍스트 PDF를 만드는 과정입니다. OCR 결과 PDF를 만든 다음 Word 변환을 실행해야 스캔 페이지가 단순 그림으로만 들어가는 문제를 피할 수 있습니다.
- PDF OCR 도구를 엽니다.
- PDF 파일 선택을 눌러 스캔 PDF를 추가합니다. 파일을 끌어다 놓거나 붙여 넣는 방법도 사용할 수 있습니다.
- 문서 언어에서 한국어를 선택합니다. 한국어와 영어가 함께 있는 문서는 두 언어를 선택할 수 있습니다. 다만 사용하지 않는 언어를 많이 추가하면 인식 처리 시간이 길어집니다.
- 추가 옵션에서 스캔할 페이지를 정합니다. 처음에는 텍스트 없는 페이지 스캔을 사용하세요. 이미 텍스트가 있는 페이지는 그대로 두므로 일반적인 혼합 문서에 권장됩니다.
- 이전 인식 텍스트가 명확히 잘못되었을 때만 기존 텍스트 다시 인식을 사용합니다. 이 경우 잘못 인식된 기존 텍스트가 제거되고 페이지를 다시 읽습니다.
- 모든 페이지를 처음부터 이미지로 처리해야 하는 특수한 경우에만 모든 페이지를 이미지로 처리를 사용합니다. 이 선택을 하면 기존의 선택 가능한 텍스트와 링크가 사라집니다.
- 종이가 비뚤게 스캔되었다면 기울어진 페이지 바로잡기를 선택합니다. 페이지가 옆으로 누웠거나 거꾸로 들어갔다면 페이지 방향 자동 수정도 선택합니다. 기울기 보정은 기존 텍스트 다시 인식 시에는 사용할 수 없습니다.
- 텍스트 인식을 누릅니다. 페이지 수가 많은 문서는 몇 분 걸릴 수 있습니다.
- 완료 후 검색 가능한 PDF 다운로드를 눌러 저장합니다.
- 저장한 OCR 결과 PDF를 다시 PDF → Word 도구에 올리고 PDF 파일 선택, Word로 변환 순서로 DOCX를 만듭니다.
OCR이 끝났다고 해서 모든 글자가 정확하다는 뜻은 아닙니다. 특히 0과 O, 1과 l, 작은 글씨의 한글 받침, 표 안 숫자와 고유명사는 오인식될 수 있습니다. Word로 바꾸기 전에 OCR PDF에서 검색과 복사가 되는지 확인하고, 중요한 내용은 원본 스캔과 대조하세요.
표, 글꼴, 이미지가 깨졌을 때 Word에서 무엇을 수정해야 하나요?
변환본을 빠르게 다듬으려면 구조를 먼저 고치고, 글꼴과 장식은 나중에 조정하세요. 앞부분에서 페이지 설정을 바로잡으면 뒤쪽 문단의 밀림이 함께 해결되는 경우가 많습니다.
- 페이지 설정 확인: 용지 크기, 방향, 여백을 원본과 비교합니다. A4와 Letter처럼 용지 크기가 다르면 거의 모든 페이지 나눔이 달라질 수 있습니다.
- 글꼴 통일: 대체된 글꼴 때문에 줄이 밀렸다면 문제가 되는 제목 또는 본문 구간을 선택해 사용 가능한 한글 글꼴로 통일합니다. 글자 크기, 줄 간격, 문단 앞뒤 간격도 함께 봅니다.
- 표 구조 수정: 표를 선택해 열 너비, 행 높이, 셀 경계, 병합 상태를 확인합니다. 몇 개 셀만 어긋났다면 너비와 정렬을 조정하고, 오류가 많은 복잡한 표라면 새 표를 만드는 편이 더 빠를 수 있습니다.
- 페이지 나눔 점검: 문단이 어색하게 갈라지면 단락 설정의 줄 및 페이지 나누기 옵션을 확인합니다. 제목이 페이지 끝에 홀로 남는지도 살펴보세요.
- 머리말·꼬리말 재작성: 반복 문구가 본문 텍스트 상자로 변환되었다면 Word의 머리말·꼬리말 기능으로 다시 만드는 편이 관리하기 쉽습니다.
- 목록과 번호 재적용: 글머리 기호와 번호가 단순 문자·탭으로 들어왔다면 Word 목록 기능을 다시 적용합니다. 이후 항목을 추가해도 번호가 자동으로 이어집니다.
- 이미지와 서명 처리: 도장, 서명, 복잡한 도표처럼 내용을 편집할 필요가 없는 요소는 이미지로 유지하는 편이 원본 모양을 보존하는 데 유리할 수 있습니다.
수정한 Word 파일을 다시 고정된 형식의 PDF로 제출해야 한다면 PDF Toucan의 word-to-PDF 도구를 사용할 수 있습니다. 제출 전에는 변환한 최종 PDF도 다시 열어 페이지 수와 표의 잘림 여부를 확인하세요.
어떤 경우에 완벽한 변환을 기대하기 어려운가요?
다음 문서는 변환 후 수동 검토가 특히 중요합니다.
- 해상도가 낮거나 흐릿한 스캔, 그림자·접힌 자국·배경 무늬가 있는 문서
- 손글씨, 작은 주석, 스탬프와 도장이 본문 위에 겹친 문서
- 복잡한 재무 표, 다단 편집물, 수식, 특수 글꼴, CAD 도면
- 입력 필드와 계산 기능이 포함된 양식 PDF
- 법적 문구, 금액, 성적, 주민번호 일부처럼 한 글자 오류도 문제가 되는 문서
깨끗한 300dpi 수준의 스캔은 텍스트 인식 결과가 좋아질 수 있지만, 표 레이아웃까지 원본 그대로 복원된다는 뜻은 아닙니다. 반대로 짧고 디자인이 복잡한 홍보물은 변환 결과를 계속 고치는 것보다 Word에서 필요한 부분을 새로 구성하는 편이 더 효율적일 수 있습니다.
계약서, 성적서, 견적서, 세금 관련 문서처럼 숫자와 법적 표현이 중요한 파일은 원본 PDF와 변환본을 나란히 놓고 이름, 날짜, 금액, 표 합계, 조항 번호, 각주를 대조해야 합니다. 원본 PDF는 항상 별도로 보관하세요.
또한 디지털 서명이 들어 있는 PDF를 OCR 처리하면 파일 내용이 바뀌므로 디지털 서명은 더 이상 유효하지 않습니다. 서명 검증이 필요한 원본은 OCR하거나 변환하지 말고 보관하며, OCR 결과물은 검색·편집을 위한 작업용 사본으로 사용하세요.
FAQ
PDF 워드 변환 시 글자가 깨지면 OCR을 해야 하나요?
항상 그렇지는 않습니다. 글자가 선택되고 복사되는 텍스트 PDF라면 먼저 Word 변환 후 글꼴과 문단 설정을 점검하세요. 글자가 전혀 선택되지 않는 스캔 PDF라면 OCR이 필요합니다. OCR 후에도 표와 숫자는 원본과 대조해야 합니다.
스캔한 PDF를 Word에서 수정 가능한 텍스트로 바꾸려면 어떻게 하나요?
먼저 PDF OCR에서 한국어를 선택하고 텍스트 인식을 실행해 검색 가능한 PDF를 만드세요. 그 결과 PDF를 PDF → Word에 올려 DOCX로 변환합니다. OCR 없이 스캔본을 바로 변환하면 페이지가 그림으로 추가되어 본문 편집이 어렵습니다.
PDF 워드 변환 후 표가 틀어졌을 때 어떻게 고치나요?
먼저 용지 크기와 여백을 맞춘 뒤 표의 열 너비, 행 높이, 병합 셀, 숫자 정렬을 확인하세요. 일부만 틀어졌다면 셀 크기를 조정하면 됩니다. 복잡한 표에서 오류가 많다면 새 표를 만들고 원본 값을 옮기는 방식이 더 빠를 수 있습니다.
PDF Toucan에서 변환한 파일은 얼마나 오래 보관되나요?
파일은 HTTPS로 전송되어 유럽연합 서버의 메모리에서 처리되며 디스크에 저장되지 않습니다. 결과 파일을 다운로드한 뒤 즉시 삭제되고, 다운로드하지 않은 경우에도 늦어도 10분 안에 삭제됩니다. 중요한 원본과 결과 파일은 사용자가 별도로 보관해야 합니다.
