Generator robots.txt
Zaznaczasz, czego roboty mają nie ruszać, i dostajesz gotowy plik do wgrania na serwer. Osobno decydujesz o robotach AI, bo jedne uczą na Twoich tekstach modele, a inne szukają odpowiedzi dla kogoś, kto właśnie pyta ChatGPT.
Twój plik robots.txt
Działa w Twojej przeglądarce. Tego, co tu wpisujesz, nigdzie nie wysyłamy ani nie zapisujemy.
Jak z tego korzystać
- Wybierz, na czym stoi strona. Dla WordPressa i sklepu generator sam dopisze katalogi, których roboty nie powinny przeglądać: panel, koszyk, konto klienta, wyniki wyszukiwarki na stronie.
- Zdecyduj o robotach AI.
- Wklej adres mapy strony, czyli pliku z listą wszystkich podstron (zwykle
twojastrona.pl/sitemap.xmlalbositemap_index.xml). Dzięki temu roboty szybciej trafiają na nowe wpisy. - Skopiuj wynik albo pobierz plik i wgraj go do głównego katalogu strony.
Co tak naprawdę robi ten plik
robots.txt to pierwsza rzecz, o którą robot pyta, zanim zacznie chodzić po stronie. Każda grupa zaczyna się od User-agent, czyli nazwy robota (gwiazdka oznacza wszystkie), a pod spodem są ścieżki, do których ma nie wchodzić (Disallow) albo wyjątki (Allow).
Na małej stronie firmowej plik ma zwykle trzy, cztery linijki i to wystarczy. Blokuje się rzeczy, które nie mają sensu w wyszukiwarce: panel, koszyk, wewnętrzną wyszukiwarkę. Nie blokuje się plików CSS i JavaScript, bo Google musi zobaczyć stronę tak jak człowiek.
Najczęstszy błąd
Disallow: / przy User-agent: *. Jedna kreska blokuje całą stronę. Zostaje często po budowie strony, kiedy wykonawca zablokował wersję roboczą i zapomniał zdjąć blokadę po starcie. Jeśli strona od miesięcy nie pojawia się w Google, zacznij od sprawdzenia tego pliku.
Roboty AI: dwa rodzaje
| Robot | Czyj | Co robi |
|---|---|---|
| GPTBot | OpenAI | zbiera teksty do uczenia modeli |
| OAI-SearchBot, ChatGPT-User | OpenAI | szuka i otwiera strony, gdy ktoś pyta ChatGPT |
| ClaudeBot | Anthropic | zbiera teksty do uczenia modeli |
| Claude-SearchBot, Claude-User | Anthropic | szuka i otwiera strony, gdy ktoś pyta Claude'a |
| Google-Extended | zgoda na użycie tekstów w Gemini (nie wpływa na zwykłe Google) | |
| PerplexityBot, Perplexity-User | Perplexity | buduje wyszukiwarkę Perplexity i otwiera strony dla pytających |
| CCBot | Common Crawl | publiczne archiwum internetu, z którego uczy się wiele modeli |
| Bytespider, meta-externalagent, Applebot-Extended | ByteDance, Meta, Apple | zbierają teksty do uczenia modeli |
Pytania
Gdzie wgrać plik robots.txt?
twojastrona.pl/robots.txt. W innym miejscu roboty go nie znajdą. W WordPressie najprościej zrobić to wtyczką Yoast albo Rank Math (mają edytor pliku), w Webflow w ustawieniach strony w zakładce SEO.Czy robots.txt usunie stronę z Google?
noindex i właśnie nie blokować jej w robots.txt, bo inaczej robot tego znacznika nie zobaczy.Czy zablokować roboty AI?
Czy roboty muszą słuchać robots.txt?
Czy potrzebuję Crawl-delay?
Inne darmowe narzędzia
Generator FAQ schema
Pytania i odpowiedzi zamienione w kod FAQPage (JSON-LD), gotowy do wklejenia na stronę.
OtwórzGenerator llms.txt
Ściąga o Twojej firmie dla modeli AI. Wypełniasz pola, pobierasz gotowy plik llms.txt.
OtwórzGenerator schema dla firmy lokalnej
Nazwa, adres, telefon i godziny otwarcia zamienione w kod LocalBusiness (JSON-LD) do wklejenia na stronę.
Otwórz