robots.txt
Robots Exclusion Standard
검색 크롤러의 사이트 디렉터리 접근 권한을 규정하는 루트 디렉터리의 텍스트 파일
페이지 HTML 헤더 내에서 검색 로봇의 페이지 수집 및 링크 추적을 세부 제어하는 태그입니다. 정의와 상세 설명을 통해 기술적 원리를 이해하고, 비즈니스에 미치는 영향과 실무 적용 방법, 구현 시 고려할 주의사항을 관련 용어와 함께 확인하세요.
Robots Meta Tag
robots meta tag는 <meta name=“robots” content=“noindex, nofollow”>처럼 페이지 HTML head 안에 직접 삽입해, 그 페이지 하나만 세밀하게 색인·링크 추적 여부를 제어할 수 있는 태그다. noimageindex, max-snippet:-1, notranslate 같은 세부 지시자를 조합하면 이미지 색인 제외나 스니펫 길이 제한도 가능하다. 다만 robots.txt에서 해당 경로 전체를 차단해버리면 크롤러가 애초에 그 페이지에 접근하지 못해 meta 태그 자체를 읽을 수 없으므로, noindex를 적용하려면 반드시 크롤링은 허용한 채로 두어야 한다.
개별 페이지 단위로 색인 방지(noindex) 및 스니펫 제한 등을 유연하게 제어
robots.txt에서 차단된 페이지는 로봇 메타 태그를 읽을 수 없음에 주의
Robots Exclusion Standard
검색 크롤러의 사이트 디렉터리 접근 권한을 규정하는 루트 디렉터리의 텍스트 파일
Indexing
검색엔진이 수집한 웹페이지를 분석하여 검색 후보 데이터베이스에 체계적으로 저장하는 과정
Crawling
검색엔진 로봇이 링크를 따라 웹을 탐색하며 새 페이지와 갱신된 정보를 수집하는 과정
Snippet
검색결과 목록에서 제목과 URL 아래에 표시되는 2~3줄의 본문 미리보기 설명문
301 Redirect
페이지가 새 URL로 영구 이동했음을 알리고 링크 가치를 새 주소로 온전히 전달하는 HTTP 코드
302 Redirect
요청한 자원이 일시적으로 다른 URL에 있음을 알리는 HTTP 응답 코드