HTML을 일반 텍스트로 변환
HTML 문서를 브라우저에서 파싱해 body에 포함된 텍스트 노드 내용을 일반 텍스트로 추출합니다.
사용 방법
- 변환할 HTML을 입력하고 실행합니다.
핵심 기능과 처리 범위
현재 구현은 remove-html-tags와 같은 DOMParser+body.textContent 경로를 사용하지만 HTML 콘텐츠를 텍스트 자료로 가져오는 용도에 맞춘 도구입니다.
처리 원리
text/html로 파싱한 Document의 body.textContent를 결과 문자열로 사용합니다.
예시
<h1>Title</h1><p>Body</p>는 DOM의 텍스트 내용이 이어진 결과를 만듭니다.
이럴 때 유용합니다
- 웹에서 복사한 HTML 소스의 표시 텍스트를 추출할 때
사용 전 참고
- CSS 레이아웃·링크 URL·이미지 alt 구조를 별도 포맷으로 보존하지 않습니다.
자주 묻는 질문
링크 주소도 자동으로 붙나요?
아닙니다. a 요소의 표시 텍스트는 남지만 href 값은 별도로 추출하지 않습니다.