한글·워드 변환에 '본문 텍스트가 없습니다'가 뜰 때: 이미지 문서와 OCR 구분
파일에는 글자가 보이는데 변환할 텍스트가 없는 이유를 확인합니다. 사진·스캔 문서는 OCR로 옮기고 숫자와 누락을 검수하세요.
파일 확장자보다 글자가 저장된 방식을 확인하세요
DOCX나 HWPX 안에 종이 문서 사진만 넣어 저장하면, 화면에 문장은 보이지만 사진 속 글자가 본문 텍스트가 되는 것은 아닙니다. 이 사이트의 문서 변환은 본문을 추출해 새 문서로 만드는 기능이며 이미지 속 글자를 인식하는 OCR 기능은 아닙니다. '읽을 수 있는 본문 텍스트가 없습니다. 이미지 문서는 OCR이 필요합니다.'라는 오류는 이 경로에서 비어 있지 않은 본문을 얻지 못했다는 의미입니다.
원본 프로그램에서 문장 일부를 선택해 일반 텍스트 편집기에 붙여 보세요. 문장이 복사되지 않고 그림 개체만 선택된다면 이미지로 저장된 자료일 가능성이 있습니다. 다만 선택 실패만으로 확정하지는 마세요. 보호 설정, 문서 손상, 지원하지 않는 구조도 확인해야 하며, 원본 프로그램에서도 열리지 않는 파일을 반복 변환하지 않습니다.
- 원본 프로그램에서 정상 열림 확인
- 문장 일부를 텍스트로 복사해 보기
- 그림 개체로만 선택되는지 확인
- 보호·손상·지원 범위와 구분
읽기 권한이 있는 페이지를 이미지로 준비하세요
처리 권한이 있는 문서에서 필요한 페이지의 원본 이미지나 선명한 화면 이미지를 준비합니다. 스캔 글자가 너무 작거나 흐리고 기울어져 있으면 인식 오류가 늘 수 있습니다. Tesseract 공식 품질 문서는 기울기와 노이즈, 배경 상태가 인식에 영향을 준다고 설명합니다. 글자 주변 여백을 남기고, 원본보다 더 낮은 해상도로 반복 저장하는 일은 피하세요.
사진 글자 추출 도구 https://ocr-toolbox.pages.dev/photo-to-text/ 는 이미지 입력을 대상으로 합니다. DOCX·HWP나 PDF를 이 입력 칸에 그대로 넣지 마세요. Tesseract.js 자체도 PDF 파일 입력을 지원하지 않는다고 명시합니다. 이미지 준비 경로와 OCR 경로를 분리하고, 여러 페이지라면 페이지 번호를 파일명에 남겨 순서가 섞이지 않게 합니다.
- 처리·복사 권한 확인
- 필요한 페이지를 선명한 이미지로 준비
- 이미지 입력 도구에 문서 파일을 넣지 않기
- 페이지 번호와 순서 기록
OCR 결과를 편집 문서로 옮기기 전에 대조하세요
먼저 한 페이지에서 시험합니다. 가상 예시 '접수번호 A-108 / 납기 10월 5일 / 수량 12개'를 입력 자료와 대조한다면 A와 다른 문자, 숫자 0과 영문 O, 1과 I처럼 혼동될 부분을 따로 확인할 수 있습니다. 이는 검수 설명용 문구이며 특정 자료에서 정확도를 측정했다는 뜻은 아닙니다.
OCR 결과는 줄 순서가 바뀌거나 표의 열이 섞일 수 있습니다. Tesseract 공식 문서는 표 인식에 한계가 있음을 안내합니다. 이름, 날짜, 금액, 단위, 부정 표현을 원본과 한 항목씩 확인한 뒤 수정한 텍스트를 Word나 한글의 새 사본에 옮깁니다. 표를 일반 문장으로 붙였다고 표의 데이터 관계까지 복구됐다고 판단하지 마세요.
- 한 페이지부터 시험
- 숫자·영문 혼동 대조
- 날짜·이름·단위·부정 표현 검수
- 표 행·열 관계를 별도로 재구성
중요한 오류가 남으면 자동 복구를 멈추세요
첫 페이지가 잘 읽혀도 마지막 페이지와 작은 각주는 다를 수 있습니다. 페이지별 첫·끝 문장과 빠진 구간을 기록하고, 원본에만 있는 문장이나 숫자가 없는지 확인합니다. 판독이 어려운 글자를 주변 문맥만으로 추측해 채우지 말고 원본 제공자에게 재스캔이나 텍스트 원본을 요청하세요.
계약서, 공문, 증빙처럼 오독이 결과를 바꾸는 자료는 인식 텍스트를 검수 없이 제출하지 않습니다. 필요한 서명·도장이나 배치를 보존해야 하면 OCR 텍스트가 아니라 원본 파일을 보관하고 제출처와 형식을 협의하세요. 이 경로는 검색하거나 다시 입력할 문장을 얻는 데 도움을 주지만 원본 문서의 진위나 동일성을 인증하지 않습니다.
- 페이지별 누락 검사
- 판독 불가 문자는 추측하지 않기
- 중요한 오독이 남으면 제출 중단
- 원본 파일과 검수 기록 함께 보관
이 방법으로 해결되지 않는 경우
- 문서 변환기는 이미지 OCR을 수행하지 않으며 OCR 결과의 서식·표·서명·도장을 복원하지 않습니다.
- OCR 정확도는 입력 이미지에 따라 달라지며 고정 정확도나 손글씨 인식을 보장하지 않습니다.
- PDF 직접 입력이나 검색 가능한 PDF 출력 기능을 제공한다는 안내가 아닙니다.
- 타인의 문서 보호를 우회하거나 처리 권한이 없는 정보를 복사하는 용도로 사용하지 마세요.
바로 실행하기
HWP를 DOCX로 변환 열기 →HWPX를 DOCX로 변환 열기 →DOCX를 HWPX로 변환 열기 →근거 자료
형식과 기능 설명은 아래 공식 문서와 표준을 우선 확인했습니다.