구글봇의 JSON-LD 추출, 이제 HTML 언이스케이프 한 번만 적용
seroundtable.com조회수 03일 전
핵심
구글이 JSON-LD 추출 방식을 변경해 이중 이스케이프(double-escaped) 문자를 더 이상 풀어내지 않기로 결정했다. 구글은 파서를 JSON 및 기타 표준에 맞추기 위해 HTML 언이스케이프를 한 번만 적용하도록 수정했다.
변경 내용
- 구글의 크롤러가 사이트의 구조화된 데이터와 스키마 마크업을 읽을 때 이제 표준 JSON 형식을 엄격히 준수
- 이전처럼 이중으로 이스케이프된 HTML 텍스트를 자동 수정하지 않음
- 구글의 게리 일리에스(Gary Illyes)는 RFC 8259의 섹션 7에서 JSON의 올바른 이스케이프 규칙이 명확히 정의되어 있다고 설명
실질적 영향
- 이중 이스케이프 문자(
&,✔등)는 더 이상 언이스케이프되지 않음 - JSON-LD로 구조화된 데이터를 사용하는 경우, 코드를 다음 중 하나로 업데이트해야 함:
- 표준 JSON 이스케이프 형식
- 유니코드 16진 이스케이프 형식(예:
\u0026)
구글의 JSON-LD 활용
- 제품 가격, 리뷰 별점, 레시피 재료, FAQ 등 엔티티 상세 정보를 파악하는 데
application/ld+json스크립트 타입 사용 - 이러한 정보를 구글 검색 결과 페이지의 리치 리절트(Rich Results)로 변환