Start › Baza wiedzy › Tematy
Zakazać treningu, dopuścić wyszukiwanie
Większość dostawców oddziela robota treningowego od wyszukiwawczego. Dzięki temu możesz wyjść z treningu modelu i mimo to pojawiać się jako cytowane źródło.
Zablokować boty treningowe
Disallow dla: GPTBot (OpenAI), ClaudeBot (Anthropic), CCBot (Common Crawl), plus tokeny Google-Extended i Applebot-Extended. Opcjonalnie Meta-ExternalAgent, jeśli chcesz też wyjść z treningu Llama.
Dopuścić boty wyszukiwawcze
Allow dla: OAI-SearchBot i ChatGPT-User (wyszukiwanie ChatGPT), Claude-SearchBot i Claude-User (Claude), PerplexityBot i Perplexity-User (Perplexity), Googlebot (wyszukiwarka Google i przeglądy AI).
Strefy szare
Nie każdy dostawca oddziela to czysto: Common Crawl nie ma wyszukiwania, Bytespider miesza jedno z drugim. A fragment może trafić do przeglądu AI, nawet jeśli zakazałeś treningu — to wynika z indeksowania wyszukiwania.
Sprawdzenie konfiguracji
citeglass pokazuje osobno dla każdego bota obowiązującą regułę robots.txt i rzeczywistą odpowiedź serwera — od razu widać, czy podział „trening nie, wyszukiwanie tak” faktycznie działa.
Sprawdź własną stronę
citeglass pokazuje w około 30 sekund, gdzie Twoja strona jest nieczytelna dla systemów AI — za darmo i bez logowania.
Czytaj dalej
Informacja ogólna, nie porada prawna. GEO to młoda dziedzina — zalecenia mogą się zmieniać.