HTML 태그 제거
HTML 문자열을 브라우저 DOMParser로 파싱하고 body의 textContent만 반환해 마크업을 제거합니다.
사용 방법
- HTML을 입력하고 실행한 뒤 일반 텍스트 결과를 확인합니다.
핵심 기능과 처리 범위
정규식으로 꺾쇠괄호를 지우는 방식이 아니라 브라우저 HTML parser가 만든 DOM의 텍스트를 읽습니다.
처리 원리
new DOMParser().parseFromString(input,'text/html').body.textContent를 반환합니다.
예시
<p>Hello <b>world</b></p>는 Hello world 텍스트가 됩니다.
이럴 때 유용합니다
- HTML 조각에서 태그 없이 텍스트 내용만 가져올 때
사용 전 참고
- 레이아웃상의 줄바꿈을 재현하지 않으며 script/style 텍스트 등 DOM textContent 의미를 그대로 따릅니다.
자주 묻는 질문
HTML 엔티티는 어떻게 되나요?
DOMParser가 파싱하므로 & 같은 엔티티는 textContent에서 대응 문자로 해석됩니다.