HTML Entity (HTML 엔티티)

agnusdei·6일 전

HTML Entity (HTML 엔티티)는 HTML(HyperText Markup Language) 문문서에서 예약어(시스템 키워드)이거나 키보드로 직접 입력하기 어려운 문자를 문자로 안전하게 표현하기 위한 대체 문자 코드입니다.

핵심 개념

  1. HTML 예약어 충돌 방지
    HTML 해석기(Parser)는 <나 >를 태그의 시작과 끝으로 인식합니다. 본문에 실제 "미만"이나 "초과"를 뜻하는 기호를 쓰고 싶을 때, 태그로 오인되지 않도록 특수 코드로 치환합니다.
  • < (Less Than) →\rightarrow &lt;
  • > (Greater Than) →\rightarrow &gt;
  1. 표준 구문 구조
    모든 HTML 엔티티는 앰퍼샌드(&)로 시작하고 세미콜론(;)으로 끝납니다.
  • & (Ampersand) →\rightarrow &amp;
  • " (Double Quote) →\rightarrow &quot;
  • (Non-Breaking Space, 공백) →\rightarrow &nbsp;

본문 문장의 의미

"There are multiple transformations happening in this code including most significantly, HTML entity decoding and character stripping."

이 문장에서 HTML entity decoding (HTML 엔티티 디코딩)은 인코딩되어 변환된 코드(&lt;, &gt; 등)를 원래의 실제 문자(<, > 등)로 복원하는 작업을 뜻합니다.

  • 예시: &lt;script&gt; 형태의 문자열을 디코딩하면 실제 실행 가능한 형태인 <script>로 되돌아갑니다.

보안 및 웹 데이터 처리(Parsing) 과정에서 입력값 검증을 우회하거나 특수문자를 정제할 때 자주 등장하는 개념입니다.

0개의 댓글