# 표에 대한 글자 텍스트 데이터 추출에 관해 문의드립니다.

**URL:** <https://forum.developer.hancom.com/t/topic/1570>\
**Category:** 한글 오토메이션\
**Created:** [6월 13, 2024, 6:05오전 UTC](https://forum.developer.hancom.com/t/topic/1570 "2024-06-13T06:05:10Z")\
**Posts on this page:** 2\
**Page:** 1

<div class="post-metadata">

**Author:** ![user254](https://avatars.discourse-cdn.com/v4/letter/u/7ab992/32.png) [@user254](https://forum.developer.hancom.com/u/user254)\
**Post date:** [6월 13, 2024, 6:05오전 UTC](https://forum.developer.hancom.com/t/topic/1570/1 "2024-06-13T06:05:10Z")

</div>

일반 텍스트와 표가 함께 작성된 한글문서가 있습니다.  
이때 일반텍스트와 표 안의 텍스트 데이터를 구분해서 가져오고 싶습니다.  
특히 표 안의 텍스트는 데이터로 활용할 수도 있겠지요.  
표는 서식이 정해져 있지는 않습니다. 셀에 필드명 등도 지정되어 있지 않습니다.  
제공되는 API로 가능한지, 또 다른 방법이 있는지 궁금합니다.

 ![image](https://us1.discourse-cdn.com/flex016/uploads/hancom_dev_forum/original/2X/8/8e0dc48f8fa7d83ef8763432970541b10e1dc770.png)

---

<div class="post-metadata">

**Author:** ![jhbang](https://avatars.discourse-cdn.com/v4/letter/j/ee59a6/32.png) [@jhbang](https://forum.developer.hancom.com/u/jhbang)\
**Post date:** [6월 13, 2024, 6:39오전 UTC](https://forum.developer.hancom.com/t/topic/1570/2 "2024-06-13T06:39:03Z")

</div>

안녕하세요.

오토메이션 API를 통해 데이터를 추출하고자 한다면  
가장 간단한 방법은 문서를 HTML 형식으로 저장해서 HTML을 파싱하는 방법이 될 것 같습니다.

```auto
지정된 파일을 불러와서 HTML로 저장하는 예제(C++)

hwpObject.Open("원본.hwp", "", "");
hwpObject.SaveAs("대상.html", "HTML", "");

// TODO : 대상.html 파싱

```

감사합니다.
