SEO

robots.txt Validator

robots.txt를 검증합니다 — User-agent 그룹 구조, 지시문, 특정 경로의 허용/차단 테스트.

도메인만 입력하면 /robots.txt가 자동으로 추가됩니다. 모든 사이트에서 작동하지는 않습니다 — 일부 사이트는 크로스 오리진 요청(CORS)을 차단합니다. 가져오기에 실패하면 새 탭에서 robots.txt를 열고 내용을 직접 붙여넣으세요.

robots.txt controls which paths of a site search bots are allowed to crawl. A mistake in this file can accidentally block an entire site from indexing, or expose internal sections that shouldn't be crawled. This tool checks the file's structure and tests a specific path against allow/disallow rules.

How to use it

Common uses

Things to keep in mind

robots.txt only blocks crawling — it doesn't guarantee a page won't appear in the index: if something else links to it, Google can still show the URL with no description. To reliably exclude a page, use a meta noindex tag, and the page must not be blocked in robots.txt for that tag to be seen.

Paths in robots.txt are case-sensitive — /Page and /page are treated as different paths.

이 도구에 대한 아티클: robots.txt: 검색 봇은 무엇을 크롤링할 수 있는지 어떻게 결정하는가

자주 묻는 질문

제 Disallow 규칙이 예상한 페이지를 차단하지 않는 이유는 무엇인가요?

robots.txt 규칙은 정확한 페이지가 아니라 접두사로 일치하며, 더 구체적인 규칙이 일반 규칙을 재정의합니다 — 접두사 매칭이 실제로 어떻게 작동하는지 고려하지 않으면 Disallow: /blog는 /blog-archive를 차단하지 않으며, 다른 곳의 Allow 규칙이 더 넓은 Disallow를 재정의할 수 있습니다.

robots.txt가 실제로 페이지가 색인되는 것을 막나요?

그 자체로는 신뢰할 수 없습니다. 이는 예의 바른 크롤러에게 페이지를 가져오지 말라고 요청할 뿐입니다 — 다른 페이지가 링크한다면 금지된 페이지도 (내용 없이) 여전히 색인될 수 있으므로, 실제 보장을 위해서는 noindex 메타 태그나 헤더를 사용하세요.

제 robots.txt 내용이 검증을 위해 어딘가로 전송되나요?

아니요. 검증은 브라우저 내에서 완전히 이루어집니다 — 서버로 전송되는 것은 없습니다.

Googlebot은 와일드카드 * 와 $를 지원하나요?

네 — Googlebot과 대부분의 다른 현대 크롤러는 *(임의의 문자열과 일치)와 $(URL 끝 표시)를 지원하지만, 이는 1994년 원래 사양을 넘어서는 확장이므로 모든 봇이 지원하는 것은 아닙니다.

robots.txt의 경로는 대소문자를 구분하나요?

네. /Admin/과 /admin/은 서로 다른 경로로 취급되므로, 대소문자가 잘못된 Disallow 규칙은 실제 경로에 전혀 영향을 미치지 않습니다.

아티클: SEO