공시보고서 변환기 기능설명
2026.08.27.3 버전 기준
공시 파일을 끌어다 놓으면 됩니다
여러 개를 한 번에 담을 수 있고, 형식을 섞어도 됩니다. 하나가 실패해도 나머지는 계속 변환되며, 실패한 까닭이 기록에 남습니다.
끌어다 놓기 또는 파일 선택. 목록에서 개별 삭제와 비우기가 됩니다.
감사보고서 · 사업보고서 · 그 밖의 공시를 스스로 판정해 시트를 나눕니다.
ZIP 하나로 묶거나, 원본과 같은 이름의 .xlsx 를 각각 다운로드합니다.
| 확장자 | 무엇 | 비고 |
|---|---|---|
| 공시뷰어에서 ‘PDF로 저장’한 파일 | 표 괘선(도형)을 보고 표를 추출 | |
| .html .htm | 공시 원본 HTML | 표 구조가 문서에 적혀 있어 PDF 보다 정확 |
| .zip | 「공시서류원본파일」 압축 | 안의 문서를 모두 꺼내 각각 변환 |
| .dsd .xml | DART편집기 파일 | 제출 전 작업본도 변환됩니다 |
압축 안의 한글 파일명(CP949)도 제대로 읽습니다. .dsd 는 안에 든 contents.xml 만 꺼내 넣어도 결과가 같습니다.
같은 공시라도 어느 파일을 넣느냐에 따라 다릅니다
| DART 에서 받는 것 | 변환 |
|---|---|
| 공시서류원본파일 | 원본 HTML 이 들어 있어 가장 정확합니다. 표 구조가 문서에 적혀 있기 때문입니다 |
| 공시뷰어 PDF | 표 괘선을 보고 표를 짜 맞춥니다. 원본 HTML 을 받을 수 없을 때 씁니다 |
| DART편집기 (.dsd) | 제목 칸이 TH 로 명시돼 있어 제목행 인식이 PDF 보다 정확합니다. 제출 전 작업본도 됩니다 |
| 재무제표 원문파일 | 변환되지 않습니다. _IFRS(원문XBRL).zip 은 기계가 읽는 재무자료라 변환할 표가 없습니다. 넣으면 그 까닭을 알려 주고 다음 파일로 넘어갑니다 |
문서 종류에 맞춰 시트를 나눕니다
표지 · 목차 · 감사의견 본문 같은 군더더기는 담지 않고, 찾아 쓸 단위로 갈라 놓습니다.
감사 · 검토보고서
재무상태표 · 손익계산서 · 현금흐름표 · 자본변동표 · 주석 표지 · 주석 번호별 시트 · 내부회계관리제도 · 외부감사 실시내용
사업 · 반기 · 분기보고서
장(章)별 본문에 더해 연결재무제표와
별도재무제표를 각각의 주석까지 갈라 담습니다.
재무제표는 III장 본문에서 빼내므로 중복 기록되지 않고,
정정보고서면 맨 앞에 정정신고 시트가 붙습니다.
그 밖의 공시 — 주요사항보고서 · 증권신고서 등
앞머리 목차의 대제목마다 한 시트를 만듭니다.
받는 방식
| 저장 방식 | 이럴 때 |
|---|---|
| ZIP 하나로 묶기 | 여러 개를 한꺼번에 변환할 때. 다운로드 창이 여러 번 뜨지 않습니다 |
| 파일 각각 받기 | 한두 개만 변환할 때. 압축을 푸는 수고가 없습니다 |
결과는 브라우저의 다운로드 폴더로 갑니다. 웹페이지가 컴퓨터의 폴더를 함부로 건드리지 못하게 브라우저가 막아 두어, 저장 폴더는 고를 수 없습니다. 만들어진 .xlsx 는 엑셀 · 한셀 · LibreOffice 중 아무거나 있으면 열립니다.
글자만 옮기는 것이 아닙니다
원문에 적힌 서식을 읽어 그대로 재현합니다. 화면에서 보던 표가 엑셀에서도 같은 모습입니다.
PDF 는 글자마다 붙은 fontname · size, HTML 은 CSS, .dsd 는 USERMARK 에서 읽습니다. LUOPQK+Gulim 같은 PostScript 이름은 굴림 으로 되돌립니다.
PDF 제목행 밑에 깔린 회색 사각형이 덮는 칸을 찾아 같은 색으로 칠합니다. 다단 제목행과 (단위: 천원) 줄까지 원문과 같습니다.
colspan · rowspan 을 엑셀 병합으로 그대로 옮깁니다. 표에는 테두리를 넣고 눈금선은 끕니다.
내용은 B열 1행부터, 표는 B열에서 좌 → 우로 펼칩니다. A열은 너비 2.83 의 여백으로 비워 둡니다.
제목행은 음영만 입히고 굵게 하지 않습니다 — 원문도 굵게 쓰지 않기 때문입니다. 이 페이지의 표도 같은 규칙으로 그렸습니다.
계산에 바로 쓸 수 있는 값으로
콤마와 괄호를 걷어 진짜 숫자로 넣되, 숫자가 아닌 것을 숫자로 만들지 않습니다.
| 원문 | 엑셀 | 설명 | |
|---|---|---|---|
| 1,234,567 | → | 1234567 | 콤마를 없앤 숫자 |
| (1,234,567) | → | -1234567 | 괄호는 음수로 |
| △1,234 | → | -1234 | 삼각형도 음수로 |
| 55.47% | → | 0.5547 | 백분율 서식으로 |
| 4,5,6 | → | 4,5,6 | 주석번호는 글자 그대로 — 456 이 되지 않습니다 |
붙임표 - 는 문맥을 봅니다
한 칸(열) 단위로 판단합니다. 그 열이 숫자 열이면 - 를 0 으로 바꾸지만, 같은 열의 자료 구간에 숫자와 무관한 글자값이 섞여 있으면 그대로 둡니다. ‘해당 없음’이 ‘0원’으로 뭉개지지 않습니다.
| 문서 | 칸 | 같은 열의 다른 값 | 결과 |
|---|---|---|---|
| 영업(잠정)실적 | 흑자적자전환여부 | 적자전환 | - 유지 |
| 단일판매 · 공급계약 | 회사와의 관계 | 아시아 선주 | - 유지 |
| 회계감사인의 감사의견 | 의견변형사유 | 적정의견 | - 유지 |
| 재무상태표 · 자본변동표 | 비지배지분 등 | 1,234,567 | 0 으로 |
자료가 밖으로 나가지 않습니다
변환은 전부 내 브라우저 안에서 일어납니다. 넣은 파일을 서버로 올리지 않으므로 제출 전 작업본도 다룰 수 있습니다.
PDF 해석기가 바깥에서 자원을 받아오지 않도록 막아 두었습니다. 인터넷을 끊고 써도 변환은 그대로 다 됩니다.
크롬 · 엣지 · 파이어폭스에서 바로 씁니다. 따로 깔 것도, 관리자 권한도 필요 없습니다.
넣은 파일은 읽기만 하고 손대지 않습니다. 결과는 브라우저 다운로드 폴더로 갑니다.
한 가지만 밖으로 나갑니다. 화면을 열 때 한 번, 더 새로운 버전이 있는지 물어보려고 hhautotools.com 의 작은 파일 하나를 읽습니다. 파일 이름도 변환 내용도 담기지 않고, 회사 방화벽이 막으면 조용히 건너뜁니다. 바깥 통신이 일절 없어야 하는 환경이라면 인터넷을 끊고 쓰시면 됩니다.
이런 것을 많이 묻습니다
스캔한 PDF 도 엑셀로 변환되나요?
되지 않습니다. 글자를 복사할 수 있는 텍스트 기반 PDF 에서만 동작하며, 이미지를 글자로 읽는 OCR 은 하지 않습니다. 같은 공시의 HTML 을 넣으면 이 제약이 없습니다.
공시뷰어 PDF 와 「공시서류원본파일」 중 어느 것을 넣어야 하나요?
공시서류원본파일이 정확합니다. 안에 든 원본 HTML 에 표 구조가 적혀 있어 표를 짜 맞출 필요가 없기 때문입니다. PDF 는 그려진 괘선을 보고 표를 추출하므로, 원본 HTML 을 받을 수 없을 때 씁니다.
재무제표 원문파일(원문XBRL)을 넣었더니 변환되지 않습니다
_IFRS(원문XBRL).zip 은 기계가 읽는 재무자료라 변환할 표가 들어 있지 않습니다. 넣으면 그 까닭을 알려 주고 다음 파일로 넘어갑니다. 같은 공시의 「공시서류원본파일」 을 받으십시오.
제출 전 작업본도 변환할 수 있나요?
DART편집기 파일(.dsd)을 그대로 넣으면 됩니다. 제목 칸이 TH 로 명시돼 있어 제목행 인식이 PDF 보다 정확합니다. 안에 든 contents.xml 만 꺼내 넣어도 결과가 같습니다. 변환은 브라우저 안에서 끝나므로 파일이 밖으로 나가지 않습니다.
여러 개를 한꺼번에 변환할 수 있나요?
PDF · DSD · HTML · XML · ZIP 을 섞어 한 번에 담을 수 있습니다. 하나가 실패해도 나머지는 계속 변환되고, 실패한 까닭이 기록에 남습니다.
연결재무제표와 별도재무제표가 한 시트에 섞이지 않나요?
사업 · 반기 · 분기보고서는 연결을 BS · IS · CF · CE 와 주석 1~n 로, 별도를 BS_S · IS_S · CF_S · CE_S 와 주석 S1~Sn 로 갈라 담습니다. 재무상태표 · 손익계산서 · 현금흐름표 · 자본변동표가 각각 다른 시트로 갑니다.
결과 파일은 어디에 저장되나요?
브라우저의 다운로드 폴더로 갑니다. 웹페이지가 컴퓨터의 폴더를 함부로 건드리지 못하게 브라우저가 막아 두어 저장 폴더는 고를 수 없습니다. 여러 개를 변환할 때는 ZIP 하나로 묶기 를 고르면 다운로드 창이 여러 번 뜨지 않습니다.
결과를 열려면 엑셀이 있어야 하나요?
엑셀 · 한셀 · LibreOffice 중 아무거나 있으면 열립니다. 만들어지는 것은 보통의 .xlsx 파일입니다.
표가 표로 들어가지 않고 글자로만 들어갔습니다
원본에 표 괘선이 없으면 문장으로 처리됩니다. 괘선 없이 공백으로만 정렬된 표가 그렇습니다. 같은 공시의 HTML 이나 .dsd 로 넣으면 표로 잡힙니다.
- 텍스트 기반 PDF 에서만 동작합니다. 글자 복사가 안 되는 스캔 이미지 PDF 는 변환되지 않습니다. OCR 은 하지 않습니다. HTML 입력은 이 제약이 없습니다.
- 표 인식은 PDF 에 그려진 괘선을 기준으로 합니다. 괘선 없이 공백으로만 정렬된 표는 일반 문장으로 처리됩니다.
- PDF 입력은 문단의 줄바꿈이 인쇄된 위치를 따르므로, 원본 HTML 에서 뽑은 것과 몇 행에 걸치는지가 다를 수 있습니다. 내용은 같습니다.
- ZIP 안에 문서가 여러 개면 각각 별도의 엑셀 파일이 됩니다. 합치지 않습니다.
- 변환 결과의 정확성은 보증되지 않습니다. 중요한 용도로 쓰기 전에는 반드시 원문과 대조해 확인하십시오.