Przejdź do treści

Robots.txt tester

Sprawdź, czy określone ścieżki lub adresy URL są dozwolone lub zablokowane przez plik robots.txt.

Wejście
Ścieżki lub adresy URL do przetestowania (jedna na wiersz)
Wynik

Robots.txt tester

Wklej zawartość pliku robots.txt, wypisz ścieżki lub pełne adresy URL, które chcesz sprawdzić, a to narzędzie powie ci dokładnie, które z nich crawlery mogą pobrać, a które są zablokowane. Zostało stworzone dla momentów, gdy strona niespodziewanie przestaje być indeksowana i potrzebujesz w kilka sekund potwierdzić, czy przyczyną jest reguła Disallow — bez wdrażania, bez czekania na żywy crawl.

Wybierz crawler z listy user-agentów — Googlebot, Googlebot-Image, Bingbot, GPTBot, ClaudeBot — lub wpisz własny token, aby przetestować własny bot. Narzędzie używa tej samej logiki, co prawdziwe crawlery: zwycięża najdłużej pasująca reguła, Allow pokonuje Disallow o równej długości, a zarówno "*" (dowolna sekwencja znaków), jak i końcowy "$" (koniec ścieżki) działają dokładnie jak w żywym robots.txt. Włącz "Pokaż decydującą regułę", aby zobaczyć dokładnie, który wiersz Allow lub Disallow określił wynik.

Raport zawiera wszystkie zadeklarowane linie Sitemap i Crawl-delay dla wybranego user-agenta. Ostrzega również o błędach składni — wiersz bez dwukropka, reguły przed pierwszą linią User-agent lub dyrektywy, których crawlery nie znają. Wybierz zwykłą tabelę do szybkiego przeglądu lub JSON do przetwarzania wyniku skryptem lub sprawdzeniem CI.

Wszystko działa w twojej przeglądarce. Zawartość robots.txt i testowane ścieżki nigdy nie opuszczą twój komputer, więc bezpiecznie jest sprawdzać reguły dla stron, które nie zostały jeszcze uruchomione lub są chronione logowaniem.

Częste pytania

Jak narzędzie decyduje, czy ścieżka jest dozwolona?
Wybiera regułę Allow lub Disallow z najdłużej pasującym wzorem dla wybranego user-agenta. Jeśli Allow i Disallow pasują z dokładnie taką samą długością, Allow wygrywa. Ścieżka bez żadnej pasującej reguły jest domyślnie dozwolona.
Które user-agenty mogę testować?
Predefiniowane opcje dla Googlebot, Googlebot-Image, Bingbot, GPTBot i ClaudeBot, lub wybierz "Własny" i wpisz token dowolnego user-agenta, aby przetestować crawlera, którego nie ma na liście.
Czy obsługiwane są znaki wieloznaczne?
Tak. "*" pasuje do dowolnej sekwencji znaków we wzorze, a końcowy "$" kotwicy dopasowanie do dokładnego końca ścieżki — taką samą składnię implementują Google, Bing i inne crawlery.
Co oznaczają ostrzeżenia?
Ostrzegają o błędach składni: wiersz bez dwukropka, Allow, Disallow lub Crawl-delay przed jakąkolwiek linią User-agent albo dyrektywy, które crawlery nie rozpoznają.
Czy mój robots.txt lub lista ścieżek jest przesyłana gdziekolwiek?
Nie. Parsowanie i porównywanie odbywają się całkowicie w twojej przeglądarce — nic, co tutaj wkleisz, nie jest wysyłane na serwer.