2026. 9. 16.에 점검함 · https://www.i-puzzle.ro/
확실한 차단은 없지만 1건의 항목이 AI 발견 가능성을 약화시킵니다.
AI 크롤러 매트릭스
각 봇에 대해: 귀하의 robots.txt가 무엇을 허용하는지 — 그리고 서버가 봇의 사용자 에이전트에 실제로 무엇을 반환하는지. 빨간색으로 강조된 행: robots는 허용하지만 서버가 차단합니다(대개 WAF 또는 봇 보호 규칙).
| 봇 | 운영자 | robots.txt | 서버 응답 |
|---|---|---|---|
| GPTBot | OpenAI | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| OAI-SearchBot | OpenAI | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| ChatGPT-User | OpenAI | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| ClaudeBot | Anthropic | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| Claude-SearchBot | Anthropic | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| Claude-User | Anthropic | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| PerplexityBot | Perplexity | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| Perplexity-User | Perplexity | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| Google-Extended | Google (Gemini-Training) | 허용 (User-agent: * 를 통해) | — |
| Googlebot | Google (KI-Übersichten) | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| Bytespider | ByteDance (Doubao) | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| Amazonbot | Amazon (Alexa/Rufus) | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
| Applebot-Extended | Apple (Intelligence-Training) | 허용 (User-agent: * 를 통해) | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | 허용 (User-agent: * 를 통해) | 200 + 콘텐츠 |
점수는 어떻게 산출되나요?
| 페이지 제목이 너무 짧거나 너무 깁니다 | -6 |
| llms.txt가 없습니다 | -5 |
| 작성자 또는 저작 신호가 없습니다 | -4 |
| sitemap.xml을 찾을 수 없습니다 | -4 |
| 제목 레벨이 건너뛰어집니다 | -3 |
| 법적 고지 / 회사 소개 / 연락처 링크가 없습니다 | -3 |
| 눈에 보이거나 마크업된 날짜가 없습니다 | -3 |
| FAQ 또는 HowTo 마크업이 없습니다 | -2 |
| 결과 | 70 / 100 |
구조와 기계 이해 가능성
페이지 제목이 너무 짧거나 너무 깁니다
<title>은 87자입니다. 대략 30~60자가 적절합니다: 주제를 명명하기에 충분히 설명적이고, 잘리지 않을 만큼 충분히 짧게.
해야 할 일: 주제와 필요 시 브랜드를 포함한 간결한 제목을 작성하세요.
llms.txt가 없습니다
/llms.txt에 파일이 없습니다. llms.txt는 핵심 콘텐츠의 짧은 Markdown 개요로, 일부 AI 시스템이 방향 설정에 사용합니다.
해야 할 일: /llms.txt를 생성하세요: 이름을 포함한 H1, 제공 내용에 대한 짧은 단락, 핵심 페이지로의 링크 목록.
# 귀하의 회사 > 한 문장 설명. ## 중요한 페이지 - [제품](https://your-domain.kr/product): … - [가격](https://your-domain.kr/pricing): … - [회사 소개](https://your-domain.kr/about): …
제목 레벨이 건너뛰어집니다
제목 순서가 적어도 한 레벨을 건너뜁니다(예: H2에서 바로 H4). 이는 콘텐츠 구조를 자동으로 재구성하기 어렵게 만듭니다.
해야 할 일: 제목 레벨을 빠뜨리지 말고 순서대로 사용하세요(H1 → H2 → H3 …).
FAQ 또는 HowTo 마크업이 없습니다
질문-답변 및 단계별 콘텐츠는 FAQPage 또는 HowTo 마크업이 없으면 AI 시스템이 직접 인용 가능한 답변으로 인식하기 더 어렵습니다.
해야 할 일: 페이지가 실제 질문에 답하거나 지침을 제공하는 경우 FAQPage 또는 HowTo로 마크업하세요(눈에 보이는 해당 콘텐츠 없이 마크업 금지).
신뢰 및 엔터티 신호(E-E-A-T)
작성자 또는 저작 신호가 없습니다
작성자를 인식할 수 없습니다(메타 태그, rel=author, JSON-LD Person 모두 없음). E-E-A-T 의미의 「경험」과 「전문성」에는 명명되고 추적 가능한 저작이 중요합니다.
해야 할 일: 편집 콘텐츠에서는 작성자를 이름으로 명시하고 작성자 페이지를 링크하세요. JSON-LD 「Person」으로도 마크업합니다.
법적 고지 / 회사 소개 / 연락처 링크가 없습니다
점검한 페이지에서 법적 고지, 「회사 소개」 페이지, 연락처로의 링크를 인식할 수 없습니다. 이러한 페이지는 강한 신뢰 신호이며 엔터티 매핑에도 도움이 됩니다.
해야 할 일: 법적 고지 또는 「회사 소개」와 연락처를 눈에 띄게, 보통 각 페이지의 푸터에 링크하세요.
눈에 보이거나 마크업된 날짜가 없습니다
게시 날짜나 수정 날짜를 인식할 수 없습니다(<time>, article:published_time, JSON-LD의 datePublished 모두 없음). 많은 질문에서 AI 시스템은 최신 출처를 선호합니다.
해야 할 일: 시간과 관련된 콘텐츠에서는 날짜를 눈에 띄게 표시하고 JSON-LD에서 datePublished / dateModified를 마크업하세요.
기술적 기반
sitemap.xml을 찾을 수 없습니다
/sitemap.xml에서 유효한 XML 사이트맵에 접근할 수 없었고 robots.txt도 어느 것도 지정하지 않습니다. 사이트맵은 크롤러가 관련된 모든 URL을 찾는 데 도움이 됩니다.
해야 할 일: 색인 가능한 모든 URL이 포함된 sitemap.xml을 생성하고 robots.txt에서 참조하세요.
정상(6)
- 주요 콘텐츠가 JavaScript 없이 HTML에 있습니다.
- 구조화 데이터(JSON-LD)가 존재합니다. — Organization, WebSite, Store
- 조직이 JSON-LD로 표시되어 있습니다.
- H1 제목이 정확히 하나입니다.
- canonical URL이 설정되어 있습니다.
- noindex 없음 — 페이지를 색인할 수 있습니다.
다음 단계
- 페이지 제목이 너무 짧거나 너무 깁니다. 주제와 필요 시 브랜드를 포함한 간결한 제목을 작성하세요.
- llms.txt가 없습니다. /llms.txt를 생성하세요: 이름을 포함한 H1, 제공 내용에 대한 짧은 단락, 핵심 페이지로의 링크 목록.
- 작성자 또는 저작 신호가 없습니다. 편집 콘텐츠에서는 작성자를 이름으로 명시하고 작성자 페이지를 링크하세요. JSON-LD 「Person」으로도 마크업합니다.
변경이 있을 때마다 이메일 알림이 있는 주간 재스캔. 준비 중 — 주소를 입력하세요.
방법과 한계
2026. 9. 16.에 점검함. citeglass는 i-puzzle.ro와 관련 파일(robots.txt, llms.txt, sitemap.xml)을 HTTP로 가져옵니다 — 한 번은 일반 브라우저로, 한 번은 각 AI 크롤러 사용자 에이전트로. JavaScript는 실행되지 않습니다. 첫 바이트까지의 시간: 1456 ms.
이것이 아닌 것: 순위나 인용 추적이 없고, 모델이 실제로 귀하를 언급하는지에 대한 진술도 없으며, JavaScript로 로드되는 콘텐츠에 대한 점검도 없습니다. 하나의 서버 IP 관점에서의 스냅숏입니다.