Belin Doc IconBelin Doc

PDF 워드 변환: 레이아웃이 유지되는 조건과 스캔본이 안 되는 이유

BelinDoc Team2026/08/22

PDF를 Word로 변환하면 파일에 텍스트 레이어가 있는지에 따라 완전히 다른 두 경로를 탑니다. 전자 문서에서 레이아웃이 재현되는 원리, 스캔본이 재배치 텍스트로만 나오는 이유, 표와 텍스트 상자 확인법, 그리고 .docx를 편집하기 전에 봐야 할 다섯 가지.

PDF를 Word로 변환하는 방법: 결론부터

PDF를 Word로 변환할 때는 "이 파일에 텍스트 레이어가 있는가"를 먼저 판정하는 도구를 써야 합니다. PDF를 올리고 .docx를 내려받는 절차는 같지만 내부 처리는 두 갈래입니다. 실제 텍스트가 있는 PDF라면 본문 블록·표·이미지를 원래 위치에 재구성하므로 결과물이 원본과 비슷해 보입니다. 스캔본이라면 OCR로 글자를 먼저 읽은 뒤 재배치하므로, 얻는 것은 "편집 가능한 문단"이지 같은 모양의 페이지가 아닙니다.

같은 버튼에서 전혀 다른 두 결과가 나옵니다. 자신이 어느 쪽을 받게 될지 아는 것만으로 PDF → Word 변환에 대한 불만 대부분이 설명됩니다.

하나의 PDF가 가는 두 갈래 경로: 전자 문서는 표와 이미지 위치를 유지한 채 Word로 재구성되고, 스캔본은 OCR을 거쳐 재배치된 텍스트가 된다


결과를 가르는 단 하나의 질문

PDF는 두 종류뿐이고, 이 둘은 변환 결과가 완전히 다릅니다.

전자 문서 PDF는 Word·InDesign·LaTeX·브라우저에서 내보낸 것으로, 글꼴과 좌표를 가진 실제 텍스트 객체가 들어 있습니다. 변환기는 각 글자가 무엇인지 정확히 알고 있으므로, 할 일은 어떤 글자들이 한 문단을 이루는지, 어느 것이 표 셀인지, 이미지가 어디에 있는지 판단하는 것입니다.

스캔 PDF는 종이를 찍은 사진입니다. 파일 안에 글자는 하나도 없고, 사람 눈에 글자처럼 보이는 픽셀만 있습니다. 변환에 앞서 글자를 인식해야 하는데, 인식은 확률적 과정이라 돌아오는 것은 서식 정보가 전혀 없는 단어입니다.

Belin Doc의 PDF 워드 변환 도구는 앞의 세 페이지를 표본으로 어느 경로를 탈지 판정한 뒤 각각 다르게 처리합니다.

전자 문서 PDF (텍스트 레이어 있음)스캔 PDF (텍스트 레이어 없음)
방식레이아웃 유지 재구성OCR 후 재배치
본문원래 위치에 블록 재구성흐르는 문단으로 복원
실제 Word 표로 재구성대개 일반 문단으로 퇴화
이미지유지하고 배치유지되지만 위치는 근사치
시각적 결과원본 페이지에 가까움읽고 편집할 수 있으나 시각적 복제는 아님
주요 위험텍스트 상자로 들어가 편집이 불편한 부분눈에 보이지 않는 인식 오류

이 글에서 한 문장만 기억한다면 이것입니다. 스캔본은 어떤 도구를 써도 픽셀 단위로 같은 Word 문서가 되지 않습니다. 얻을 수 있는 것은 편집 가능한 텍스트입니다. 이것이 정직한 한계이고, 그 이상을 약속하는 제품은 전자 문서 쪽 이야기를 하고 있을 뿐입니다.

"레이아웃 유지"가 .docx에서 실제로 뜻하는 것

잘 풀리는 쪽에서도 재구성에는 판단이 개입합니다. 파일을 열고 "왜 편집이 어색하지?" 하고 당황하지 않으려면 미리 알아 둘 가치가 있습니다.

문단은 복사가 아니라 재구성됩니다. 줄 간격과 들여쓰기를 보고 끊어진 줄을 다시 문단으로 합치며, 줄을 넘긴 하이픈은 보통 이어 붙입니다. 문단 경계가 모호했던 곳에서는 한 문단이 둘로 갈라지기도 합니다.

표는 가능하면 실제 Word 표가 됩니다. 괘선이 있는 표는 안정적으로 변환됩니다. 괘선 없이 정렬만으로 유지되던 표는 훨씬 어렵고, 병합 셀이 있는 복잡한 머리글에서 재현도가 가장 많이 떨어집니다.

일부 요소는 텍스트 상자로 들어옵니다. 인용 블록, 사이드바, 그림 옆에 떠 있는 캡션처럼 위치가 특수한 내용은 자리를 지키기 위해 Word 텍스트 상자에 담기는 경우가 많습니다. 보기에는 맞지만 편집이 불편하고, 주변 본문과 함께 흐르지 않습니다.

글꼴은 대체됩니다. 원본 PDF가 내 컴퓨터에 없는 글꼴을 썼다면 Word가 비슷한 것으로 바꾸고 줄 길이가 조금씩 달라집니다. 정상 동작이고 대개 무해하지만, "거의 맞는데 뭔가 다르다"의 가장 흔한 원인입니다.

머리글·바닥글·쪽 번호는 Word의 실제 머리글/바닥글 영역이 아니라 본문에 들어갈 수 있습니다.

결과물이 doc이 아니라 docx인 이유

결과물은 .docx, 즉 Word가 2007년부터 쓰는 Office Open XML 형식이며 옛 이진 형식 .doc가 아닙니다.

둘이 자주 혼동되기에 짚어 둡니다. 반대 방향도 마찬가지여서, 사이트에서 옛 .doc 파일을 번역하려 하면 먼저 .docx로 저장하라고 안내됩니다. .docx는 Microsoft Word, 한글과컴퓨터 제품, Google 문서, WPS Office, LibreOffice에서 별도 변환기 없이 열립니다.

편집을 시작하기 전에 확인할 다섯 가지

5분의 확인이 한 시간의 혼란을 막습니다. 문제가 생기는 빈도 순입니다.

  1. 표. 안쪽을 클릭해 봅니다. 커서가 셀 사이를 이동하면 진짜 표입니다. 전체가 그림 하나로 선택되면 변환되지 않은 것입니다.
  2. 숫자 (원본이 스캔본일 때). OCR은 0/O, 1/l, 5/S와 소수점 구분자를 혼동합니다. 재무 문서라면 무엇보다 숫자를 먼저 확인하세요.
  3. 텍스트 상자. 위치가 어색해 보이는 문단을 클릭합니다. 테두리와 조절점이 나타나면 텍스트 상자이고, 본문과 함께 흐르지 않습니다.
  4. 쪽수. 변환 후 한두 쪽 늘어나는 일은 흔하며 글꼴 대체 때문입니다. 오류가 아닙니다.
  5. 읽는 순서. 원본에 단 구성이나 사이드바가 있었다면, 문단 순서가 예상과 맞는지 훑어 확인합니다.

스캔본이라면 스캔 PDF 번역과 OCR 오류 교정 가이드에 한꺼번에 검색해 볼 만한 오류 패턴을 정리해 두었습니다.

Word로 변환하지 말아야 할 경우

내용을 편집해야 할 때는 Word 변환이 맞습니다. 하지만 다음 목적이라면 잘못된 선택입니다.

  • 휴대폰에서 읽고 싶을 뿐이다. Word는 작은 화면에서 재배치가 나쁩니다. EPUB으로 변환하세요.
  • 노트 앱이나 RAG에 넣고 싶다. Markdown.docx보다 훨씬 적합합니다.
  • 몇 단어만 고치고 싶다. PDF를 직접 편집하는 편이 빠르고 레이아웃도 그대로입니다.
  • 번역본이 필요하다. 변환한 뒤 번역하지 마세요. 손실이 있는 공정을 둘 겹치는 셈입니다. 레이아웃을 유지하는 PDF 번역으로 바로 처리하세요.
  • 양식·도면·악보. 고정된 배치 자체가 정보라서 변환하면 망가집니다.

PDF 워드 변환 절차

1단계: 손에 든 PDF가 어느 쪽인지 구분한다

PDF를 열고 커서로 문장 하나를 선택해 봅니다. 글자가 선택되면 전자 문서이므로 원본에 가까운 레이아웃을 기대할 수 있습니다. 아무것도 선택되지 않거나 페이지 전체가 한 덩어리로 잡히면 스캔본이므로, 기대해야 할 것은 "같은 레이아웃"이 아니라 "편집 가능한 텍스트"입니다.

2단계: 업로드하고 변환한다

파일을 PDF 워드 변환 도구에 올립니다. 상한은 100 MB, 100페이지이고 100페이지 초과는 제출 시점에 막히므로 중간에 실패해 시간을 버리지 않습니다. 로그인이 필요합니다. 변환 비용은 1페이지당 번역 크레딧 1이며 매월 무료 한도에서 먼저 차감됩니다(가입 계정은 매월 500페이지, 문서 번역과 같은 잔액). 스캔 페이지는 OCR을 거치지만 별도의 OCR 한도는 쓰지 않고, 실패한 변환은 자동으로 반환됩니다.

3단계: .docx를 열고 다섯 가지 점검을 돌린다

분량이 많거나 스캔본이면 페이지마다 따로 분석하므로 오래 걸립니다. 변환 기록은 24시간 남으니 탭을 닫았다가 다시 와도 됩니다. 파일이 준비되면 내려받아 위의 다섯 가지를 확인한 뒤 본격적인 편집을 시작하세요.

자주 묻는 질문 (FAQ)

변환된 Word가 원본 PDF와 똑같아 보이나요?

실제 텍스트 레이어가 있는 전자 문서라면 상당히 가깝습니다. 본문 블록·표·이미지가 원래 위치에 재구성되기 때문입니다. 스캔본은 그렇지 않습니다. OCR이 돌려주는 것은 서식 없는 글자이고 문서는 재구성이 아니라 재배치되기 때문입니다. 두 경우 모두 원본 글꼴이 설치되어 있지 않으면 줄바꿈이 조금 달라지는 것은 정상입니다.

스캔 PDF를 편집 가능한 Word로 만들 수 있나요?

가능합니다. 스캔본은 OCR을 거쳐 편집 가능한 텍스트가 됩니다. 얻을 수 없는 것은 스캔 페이지의 시각적 복제이며, 인식 오류는 반드시 포함되므로 파일에 의존하기 전에 숫자와 고유명사를 교정하세요.

표는 변환되나요?

괘선이 보이는 표는 대개 실제로 편집 가능한 Word 표가 됩니다. 괘선 없는 표와 병합 셀이 있는 복잡한 머리글이 약점입니다. 변환 후 표 안을 클릭해 커서가 셀 사이를 움직이면 제대로 변환된 것입니다.

결과물은 doc인가요 docx인가요?

.docx입니다. 현행 Office Open XML 형식이며 Microsoft Word, 한글과컴퓨터 제품, Google 문서, WPS Office, LibreOffice에서 별도 변환기 없이 열립니다.

PDF 워드 변환 비용은 얼마인가요?

1페이지당 번역 크레딧 1이며 매월 무료 한도에서 먼저 차감됩니다(가입하면 매월 500페이지, 문서 번역과 공유하는 잔액). 스캔 페이지는 별도의 OCR 한도를 쓰지 않고, 변환이 실패하면 크레딧은 자동 반환됩니다. 업로드 전에 로그인이 필요합니다.

PDF가 100페이지를 넘으면 어떻게 하나요?

100페이지 초과 파일은 제출 시점에 거부되므로 과금도 되지 않고 시간도 낭비되지 않습니다. 먼저 PDF 분할로 나눈 뒤 조각별로 변환하세요.

관련 게시물