24.09.2026 tarihinde kontrol edildi · https://www.nytimes.com/
YZ bulunabilirliği için 2 kritik engel var — önce bunları düzeltin.
Bu site için 3 tarama, ilk taramadan bu yana puan -37. İzleme ile citeglass siteyi her hafta otomatik kontrol eder ve bir şey bozulursa haber verir — yayına girdiğinde haberdar olmak için kaydol.
YZ tarayıcı matrisi
Her bot için: robots.txt'niz neye izin veriyor — ve sunucunuz botun kullanıcı aracısına gerçekte ne döndürüyor. Kırmızıyla işaretli satırlar: robots izin veriyor ama sunucu engelliyor (genellikle bir WAF veya bot koruma kuralı).
| Bot | İşletmeci | robots.txt | Sunucu yanıtı |
|---|---|---|---|
| GPTBot | OpenAI | engelli | engelli (403 / WAF) |
| OAI-SearchBot | OpenAI | engelli | engelli (403 / WAF) |
| ChatGPT-User | OpenAI | engelli | engelli (403 / WAF) |
| ClaudeBot | Anthropic | engelli | engelli (403 / WAF) |
| Claude-SearchBot | Anthropic | engelli | engelli (403 / WAF) |
| Claude-User | Anthropic | engelli | engelli (403 / WAF) |
| PerplexityBot | Perplexity | engelli | engelli (403 / WAF) |
| Perplexity-User | Perplexity | engelli | engelli (403 / WAF) |
| Google-Extended | Google (Gemini-Training) | engelli | — |
| Googlebot | Google (KI-Übersichten) | izinli | engelli (403 / WAF) |
| CCBot | Common Crawl (Trainingsdaten vieler LLMs) | engelli | engelli (403 / WAF) |
| Bytespider | ByteDance (Doubao) | engelli | engelli (403 / WAF) |
| Amazonbot | Amazon (Alexa/Rufus) | izinli | engelli (403 / WAF) |
| Applebot-Extended | Apple (Intelligence-Training) | engelli | — |
| Meta-ExternalAgent | Meta (Llama/Meta AI) | engelli | engelli (403 / WAF) |
Puan nasıl oluşuyor?
| Yapay zekâ arama botları robots.txt’de engellenmiş | -32 |
| robots.txt izin verse de sunucu botları engelliyor | -12 |
| HTML'de çok az metin var | -10 |
| Yapılandırılmış veri (JSON-LD) yok | -8 |
| Sayfa başlığı çok kısa veya çok uzun | -6 |
| Tam olarak bir H1 başlığı değil | -5 |
| Meta açıklama eksik veya uygun değil | -5 |
| llms.txt yok | -5 |
| Yazar veya yazarlık sinyali yok | -4 |
| sameAs bağlantıları yok | -3 |
| Yasal bilgi / hakkımızda / iletişim bağlantısı yok | -3 |
| Görünür veya işaretlenmiş tarih yok | -3 |
| canonical URL yok | -3 |
| Sonuç | 1 / 100 |
YZ tarayıcıları için erişim
Yapay zekâ arama botları robots.txt’de engellenmiş
robots.txt dosyan, yapay zekâ asistanları ve arama motorlarının yanıtları için içerik çeken 6 botu engelliyor: OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User. Engelli kaldıkları sürece siten orada kaynak olarak görünemez.
Yapmanız gereken: Her bot için engellemenin bilinçli olup olmadığını kontrol et. Yalnızca yapay zekâ eğitimini dışlamak istiyorsan eğitim botlarını (GPTBot, ClaudeBot, Google-Extended) engelle, arama botlarına izin ver.
User-agent: OAI-SearchBot Allow: / User-agent: ChatGPT-User Allow: / User-agent: Claude-SearchBot Allow: / User-agent: Claude-User Allow: / User-agent: PerplexityBot Allow: / User-agent: Perplexity-User Allow: /
robots.txt izin verse de sunucu botları engelliyor
Google (KI-Übersichten), Amazon (Alexa/Rufus) kaynağından 2 bot için robots.txt «izinli» diyor ama sunucu 403 veya bir bot koruma sayfasıyla yanıt veriyor. Genellikle robots.txt'yi atlayarak tarayıcıyı dışarıda bırakan bir WAF, güvenlik duvarı veya CDN kuralı.
Yapmanız gereken: İstenen YZ tarayıcılarının kullanıcı aracılarını ve/veya IP aralıklarını WAF / Cloudflare / güvenlik duvarınızdaki bir izin listesine ekleyin. Yalnızca kullanıcı aracısı dizesine göre değil, ters DNS ile doğrulayın.
JavaScript olmadan içerik
HTML'de çok az metin var
İlk HTML yalnızca yaklaşık 55 karakter görünür metin içeriyor. YZ sistemlerinin sayfanın konusunu güvenle kavraması için bu neredeyse yetersiz.
Yapmanız gereken: Asıl içeriğin görüntülerde, iframe'lerde veya JavaScript ile yüklenen bloklarda değil, tamamen HTML'de olduğundan emin olun.
Yapı ve makine anlaşılırlığı
Yapılandırılmış veri (JSON-LD) yok
Sayfa JSON-LD içermiyor. Yapılandırılmış veriler, YZ sistemlerinin varlıkları, yazarı, kuruluşu, tarihi ve sayfa türünü kesin olarak tanımasına yardımcı olur — bunlar olmadan her şey metinden tahmin edilmelidir.
Yapmanız gereken: En azından bir «Organization» şeması ve sayfa türüne uygun bir şema (Article, Product, FAQPage …) JSON-LD olarak <head>'e ekleyin.
<script type="application/ld+json">
{"@context":"https://schema.org","@type":"Organization",
"name":"Şirketiniz","url":"https://alan-adiniz.com.tr",
"sameAs":["https://www.linkedin.com/company/…"]}
</script>Sayfa başlığı çok kısa veya çok uzun
<title> 11 karakter uzunluğunda. Yaklaşık 30–60 karakter makuldür: konuyu adlandıracak kadar açıklayıcı, kesilmeyecek kadar kısa.
Yapmanız gereken: Konuyu ve gerekirse markayı içeren özlü bir başlık yazın.
Tam olarak bir H1 başlığı değil
Sayfada 0 H1 başlığı var. Kesin bir H1, sayfanın öncelikle ne hakkında olduğunu insanlara ve makinelere söyler.
Yapmanız gereken: Sayfanın ana konusunu adlandıran tam olarak bir H1 ayarlayın. Altındaki her şey H2'den başlar.
Meta açıklama eksik veya uygun değil
Meta açıklama 0 karakter uzunluğunda. YZ sistemlerinin ve arama motorlarının sayfanın özeti olarak ilk okuduğu şey genellikle budur.
Yapmanız gereken: Anahtar kelime dizisi değil, sayfanın bağımsız bir özetini bir veya iki cümlede yazın (yaklaşık 120–200 karakter).
llms.txt yok
/llms.txt'de dosya yok. llms.txt, bazı YZ sistemlerinin yönlendirme için kullandığı, temel içeriğinizin kısa bir Markdown genel bakışıdır.
Yapmanız gereken: Bir /llms.txt oluşturun: adı içeren bir H1, teklif hakkında kısa bir paragraf ve merkezi sayfalara bir bağlantı listesi.
# Şirketiniz > Tek cümlelik açıklama. ## Önemli sayfalar - [Ürün](https://alan-adiniz.com.tr/urun): … - [Fiyatlar](https://alan-adiniz.com.tr/fiyatlar): … - [Hakkımızda](https://alan-adiniz.com.tr/hakkimizda): …
Güven ve varlık sinyalleri (E-E-A-T)
Yazar veya yazarlık sinyali yok
Bir yazar tanınamıyor (ne meta etiketi, ne rel=author, ne de JSON-LD Person). E-E-A-T anlamında «deneyim» ve «uzmanlık» için adı belirtilmiş, izlenebilir bir yazarlık önemlidir.
Yapmanız gereken: Editöryel içerikte yazarı adıyla belirtin ve bir yazar sayfasına bağlantı verin; onu JSON-LD «Person» olarak da işaretleyin.
sameAs bağlantıları yok
JSON-LD'de «sameAs» eksik. Bununla YZ sistemleri markanızı veya kişinizi bilinen varlıklara (Wikidata, LinkedIn, sektör dizinleri) açıkça eşler.
Yapmanız gereken: Organization veya Person'a resmi profillerinizin ve dizin kayıtlarınızın URL'leriyle bir «sameAs» ekleyin.
Yasal bilgi / hakkımızda / iletişim bağlantısı yok
Kontrol edilen sayfada yasal bilgiye, bir «Hakkımızda» sayfasına veya iletişime giden bir bağlantı tanınamıyor. Bu tür sayfalar güçlü bir güven sinyalidir ve varlık eşlemesine yardımcı olur.
Yapmanız gereken: Yasal bilgiyi veya «Hakkımızda» ile iletişimi görünür şekilde, genellikle her sayfanın alt bilgisinde bağlayın.
Görünür veya işaretlenmiş tarih yok
Bir yayın veya değişiklik tarihi tanınamıyor (ne <time>, ne article:published_time, ne de JSON-LD'de datePublished). Birçok soruda YZ sistemleri güncel kaynakları tercih eder.
Yapmanız gereken: Zaman bağlantılı içerikte bir tarihi görünür şekilde gösterin ve JSON-LD'de datePublished / dateModified'ı işaretleyin.
Teknik temel
canonical URL yok
Sayfa bir <link rel="canonical"> ayarlamıyor. canonical olmadan, birden fazla URL varyantı olduğunda hangi sürümün yetkili olduğu belirsiz kalabilir.
Yapmanız gereken: Her sayfada tercih edilen URL'ye işaret eden, kendine referans veren bir <link rel="canonical"> ayarlayın.
Uygun (3)
- Site haritasına erişilebiliyor.
- Hızlı sunucu yanıt süresi.
- noindex yok — sayfa dizine eklenebilir.
Sonraki adımlar
- Yapay zekâ arama botları robots.txt’de engellenmiş. Her bot için engellemenin bilinçli olup olmadığını kontrol et. Yalnızca yapay zekâ eğitimini dışlamak istiyorsan eğitim botlarını (GPTBot, ClaudeBot, Google-Extended) engelle, arama botlarına izin ver.
- robots.txt izin verse de sunucu botları engelliyor. İstenen YZ tarayıcılarının kullanıcı aracılarını ve/veya IP aralıklarını WAF / Cloudflare / güvenlik duvarınızdaki bir izin listesine ekleyin. Yalnızca kullanıcı aracısı dizesine göre değil, ters DNS ile doğrulayın.
- HTML'de çok az metin var. Asıl içeriğin görüntülerde, iframe'lerde veya JavaScript ile yüklenen bloklarda değil, tamamen HTML'de olduğundan emin olun.
Yöntem ve sınırlar
24.09.2026 tarihinde kontrol edildi. citeglass, nytimes.com ve ilgili dosyaları (robots.txt, llms.txt, sitemap.xml) HTTP üzerinden getirir — bir kez normal tarayıcı olarak, bir kez her YZ tarayıcı kullanıcı aracısı için. JavaScript çalıştırılmaz. İlk bayta kadar süre: 123 ms.
Bunun ne olmadığı: Sıralama veya alıntı takibi yok, bir modelin sizi gerçekten anıp anmadığına dair bir ifade yok ve JavaScript ile yüklenen içeriğin kontrolü yok. Tek bir sunucu IP'sinin bakış açısından bir anlık görüntü.