IMAGE TOOLBOX / GUIDE
PDF를 워드·엑셀로 변환하면 표는 어떻게 될까
직접 테스트 PDF를 만들어 변환해본 실제 결과를 정리했습니다.
직접 테스트해봤습니다
문단 텍스트 하나와 3×3 표 하나가 들어간 1페이지짜리 PDF를 만들어, 이 사이트의 PDF→문서 변환 기능으로 실제 Word(.docx)와 Excel(.xlsx) 결과물을 열어봤습니다. 결과는 텍스트 종류에 따라 크게 갈렸습니다.
일반 문단은 정확하게 옮겨집니다
여러 줄로 나눠 쓴 문단 텍스트는 Word 변환에서 하나의 문단으로 정확하게 합쳐졌습니다. 실제 변환 결과에 담긴 문장입니다.
"This is a sample paragraph for testing PDF to Word conversion. It spans multiple lines that should be grouped into one paragraph because the vertical gap between them is small."
원본 PDF에서는 이 문장이 3줄에 걸쳐 나뉘어 있었지만, 줄 사이 간격이 좁아서 하나의 문단으로 잘 합쳐졌습니다.
표는 구조가 완전히 무너집니다
같은 PDF에 있던 3×3 표(이름·점수·등급, 3명분)를 변환한 결과는 이렇습니다. Word에서는 표 전체가 줄바꿈도 없이 하나의 문단으로 뭉쳐졌습니다.
"Name Score Grade Alice 92 A Bob 81 B Carol 76 C"
Excel에서는 그나마 원래 줄 단위로는 나뉘었지만, 열 구분 없이 한 줄 전체가 A열 한 칸에 그대로 들어갔습니다 — 즉 "Alice", "92", "A"가 각각 다른 셀이 아니라 A5 셀 하나에 "Alice 92 A"로 합쳐진 텍스트로 저장됐습니다. 헤더 행("Name Score Grade")도 데이터 행과 구분 없이 똑같은 방식으로 처리됐습니다.
왜 이런 일이 일어나나요
PDF 파일에는 애초에 "표"라는 개념이 없습니다. 화면에 보이는 표는 사실 특정 좌표에 텍스트를 하나하나 배치해서 만든 것일 뿐입니다. 이 도구는 텍스트의 Y좌표(세로 위치)가 비슷하면 같은 줄로, 줄 사이 간격이 좁으면 같은 문단으로 묶는 방식으로 동작합니다. 문단처럼 세로로 줄바꿈되는 텍스트는 이 방식이 잘 맞지만, 표처럼 가로로 여러 칸이 나열된 구조는 애초에 "칸"이라는 개념을 인식하지 못하고 같은 줄 안의 텍스트를 왼쪽부터 순서대로 이어붙이기만 합니다. 결과적으로 칸 사이의 구분이 사라지고 텍스트만 한 줄로 합쳐집니다.
자주 묻는 질문
표가 있는 PDF는 변환하면 안 되나요?
변환은 되지만 표 구조(행과 열의 구분)는 사라집니다. 표 안의 텍스트 자체는 남아있으니 내용을 검색하거나 복사하는 용도로는 쓸 수 있지만, 표 형태 그대로 편집하려는 목적이라면 이 방법으로는 원하는 결과를 얻기 어렵습니다.
표를 제대로 옮기려면 어떻게 해야 하나요?
이 도구는 표 구조를 인식하지 못하므로, 표가 중요한 문서라면 변환된 결과를 열어서 수동으로 표를 다시 만들거나, 원본 PDF를 그대로 유지하면서 필요한 부분만 옮겨 적는 것을 권장합니다.
표가 없는 일반 문서는 안전하게 변환되나요?
네. 줄 간격이 일반적인 문단 형태의 텍스트는 실제 테스트에서 문단 구분과 내용 모두 정확하게 옮겨졌습니다. 문제가 되는 쪽은 여러 줄이 표처럼 촘촘하게 배치된 경우입니다.
몇 페이지짜리로 테스트한 결과인가요?
직접 만든 1페이지짜리 테스트 PDF(문단 하나 + 3x3 표 하나)로 변환 결과를 확인했습니다. 표가 여러 개이거나 더 복잡한 문서에서도 같은 원리(좌표 기반 줄 인식)로 처리되므로 결과 양상은 비슷할 것으로 예상됩니다.
PowerPoint(.pptx) 변환도 표가 깨지나요?
아니요. PowerPoint 변환은 텍스트를 추출하는 방식이 아니라 PDF 페이지 전체를 이미지로 캡처해 슬라이드에 넣는 방식이라, 표를 포함한 페이지 전체의 시각적 모양이 그대로 보존됩니다. 대신 텍스트를 편집하거나 복사할 수는 없습니다.