Zezwól na publiczne przeszukiwanie domyślnie, dodaj niestandardowe zasady lub wyraźnie zablokuj przeszukiwanie dla tymczasowego środowiska.
Free Robots.txt Generator for SEO & AI Crawlers
Create and test a plain RFC 9309-aligned robots.txt with CMS publishing guidance and optional AI crawler controls. Copy or download it free - no signup.
Wybierz podstawową politykę, a następnie dodaj tylko te ścieżki, które wymagają wyjątku.
Użyj * dla wszystkich robotów lub jednego dokładnego tokena produktu, takiego jak Googlebot.
Użyj * lub tokena produktu zawierającego tylko litery, myślniki i podkreślenia.
Wprowadź ścieżki na tym hoście. Brakujący wiodący ukośnik jest dodawany automatycznie.
Użyj bardziej specyficznej ścieżki Allow wewnątrz szerszego obszaru zablokowanego.
Usuń komentarze, znaki nowej linii lub znaki kontrolne z wartości zasad.
Użyj pełnych URL-i http:// lub https://. Dozwolone są URL-e mapy witryny z różnych hostów.
Każda mapa witryny musi być kompletnym adresem URL HTTP lub HTTPS.
Nie zostaną dodane żadne nazwane grupy AI. Wszystkie roboty wracają do twojej głównej grupy.
Brak ograniczeń - indeksowanie jest dozwolone.
Przekształć wynik w monitorowany workflow
Workspace Novaverb przeszukuje Twoją aktywną stronę, weryfikuje, czy te tagi i pliki są rzeczywiście serwowane, śledzi zmiany w czasie i przekształca ustalenia w przypisane zadania.
Robots.txt Generator
Co to jest generator robots.txt?
Generator robots.txt tworzy politykę przeszukiwania w formacie tekstowym dla zautomatyzowanych agentów użytkowników na jednym hoście witryny. To narzędzie tworzy rekordy User-agent, Allow, Disallow i Sitemap w Twojej przeglądarce i pozwala testować ścieżkę przed publikacją.
Utwórz i zweryfikuj robots.txt w pięciu krokach
Plik i tester aktualizują się natychmiast bez przesyłania reguł.
Użyj * dla wszystkich zgodnych robotów lub wprowadź dokładny token produktu dla jednego robota.
Zabraniaj szerokich ścieżek i używaj bardziej szczegółowych wyjątków Allow tylko tam, gdzie to konieczne.
Wypróbuj publiczne, zablokowane i wyjątkowe ścieżki. Podgląd identyfikuje zwycięską regułę.
Prześlij robots.txt do głównego katalogu hosta, a następnie pobierz żywy URL i potwierdź, że odpowiedź jest aktualna.
Jak działa dopasowywanie zasad
Tester podąża za kluczowym zachowaniem dopasowania zdefiniowanym przez Protokół Wykluczenia Robotów.
Dłuższa pasująca ścieżka ma pierwszeństwo przed krótszą, szerszą regułą.
Gdy równoważne reguły Allow i Disallow obie pasują, należy użyć reguły Allow.
/Folder/ i /folder/ to różne ścieżki. Przetestuj tę samą wielkość liter, której używa twój serwer.
Lista kontrolna zgodności z RFC 9309
To są wymagania protokołu i zasady obsługi robotów, a nie opcjonalne mity SEO.
§2.3Poprawny plik i lokalizacjaSerwuj małe litery /robots.txt na najwyższym poziomie każdego schematu, hosta i portu jako UTF-8 text/plain.
§2.2.1–2.2.3Grupy i dopasowanieTokeny user-agent używają liter, myślników lub podkreślników. Dopasowanie jest wrażliwe na wielkość liter; najdłuższa zasada wygrywa, a Allow wygrywa w równym przypadku.
§2.3.1Wyniki HTTP mają znaczenieRoboty powinny podążać za co najmniej pięcioma przekierowaniami. Plik 4xx może oznaczać, że crawl jest dozwolony; błąd 5xx lub awaria sieci oznacza całkowity zakaz, gdy jest niedostępny.
§2.4–2.5Limity pamięci podręcznej i parseraZbuforowany plik normalnie nie powinien być używany dłużej niż 24 godziny, a parsery muszą obsługiwać co najmniej 500 KiB.
Zacznij od przejrzystej podstawy CMS
Wybór platformy ładuje widoczny, edytowalny szablon do wygenerowanego robots.txt. Novaverb nigdy nie dodaje ukrytych dyrektyw; zweryfikuj zainstalowaną wersję CMS przed zastąpieniem pliku zarządzanego przez platformę.
/robots.txt · /wp-sitemap.xmlWordPress może serwować oba punkty końcowe wirtualnie. Najpierw sprawdź bieżącą odpowiedź, ponieważ wtyczki mogą zastąpić podstawowe wyjście; dodawaj tylko zasady, które zweryfikowałeś dla tej strony.
Referencje rdzenia WordPressweb/robots.txtDrupal Composer Scaffold zarządza plikiem głównym. Dodaj lub popraw reguły specyficzne dla projektu przez konfigurację scaffold, aby aktualizacje rdzenia nie usunęły ich cicho.
Przewodnik po szablonach Drupalrobots.txt.dist → robots.txtUżyj zwykłego pliku dostarczonego z twoją dokładną wersją Joomli jako aktualnego źródła platformy. Nie importuj listy ścieżek z starszej wersji lub innej strony.
Plik rdzenia Joomlatemplates/robots.txt.liquidShopify już serwuje domyślną wersję zorientowaną na SEO. Dostosuj szablon Liquid tylko w razie potrzeby; zastąpienie całego wygenerowanego pliku może usunąć przyszłe aktualizacje platformy.
Wskazówki Shopifyapp/robots.tsUżyj konwencji MetadataRoute.Robots dla typowego statycznego lub dynamicznego wyjścia, lub dodaj app/robots.txt dla zwykłego pliku statycznego.
Referencje robotów Next.jspublic root or explicit /robots.txt routeTe frameworki nie implikują jednego uniwersalnego zestawu zasad SEO. Serwuj wygenerowany tekst z publicznego katalogu głównego lub z trasy text/plain i przetestuj hosta produkcyjnego.
Wybierz dostęp AI według celu
Widoczność w wyszukiwarkach, rozwój modeli i pobieranie na żądanie użytkownika to różne decyzje. Nazwy dostawców i polityki mogą się zmieniać, więc sprawdź powiązane źródło przed publikacją.
OAI-SearchBot, Claude-SearchBot, PerplexityBotZablokowanie tych może zmniejszyć odkrywanie, fragmenty, cytacje lub jakość wyników wyszukiwania w odpowiadających produktach AI.
GPTBot, ClaudeBot, Google-ExtendedTe nazwane kontrole odnoszą się do potencjalnego treningu modeli, poprawy modeli lub ugruntowania Gemini. Google-Extended nie wpływa na włączenie ani ranking Google Search.
Reguła user-agent nie jest weryfikacją tożsamości, kontrolą dostępu ani uniwersalnym opt-out. Przejrzyj dokumentację dostawcy i zweryfikuj rzeczywisty ruch osobno.
Użyj odpowiedniego kontrolera do zadania
robots.txt to preferencja crawl, a nie kontrola dostępu ani gwarantowane polecenie indeksowania.
Dobre zastosowania
- Zredukuj indeksowanie duplikatów filtrów, koszyków i ścieżek o niskiej wartości użytkowej.
- Udostępnij jeden lub więcej absolutnych adresów URL mapy witryny.
- Utwórz konkretne zasady dla robotów, które się identyfikują i przestrzegają protokołu.
Nie gwarantowane przez robots.txt
- Zachowaj prywatność wrażliwych treści - użyj uwierzytelniania i autoryzacji.
- Usuwanie URL z wyszukiwania - użyj indeksowalnej odpowiedzi noindex, workflow usunięcia lub kontroli dostępu, jeśli to konieczne.
- Zmuszanie każdego skanera lub systemu AI do przestrzegania - protokół jest doradczy.
Wygenerowane nie jest tym samym co żywe
Poprawny szkic może być nadal przesyłany do niewłaściwego hosta, buforowany, przekierowywany lub serwowany z błędem. Po publikacji pobierz rzeczywisty plik, zweryfikuj jego status HTTP i potwierdź, że dyrektywy mapy witryny są rozwiązywane.
Robots.txt Generator FAQ
Co robi robots.txt?
robots.txt informuje zgodne roboty, które ścieżki URL mogą żądać w określonym schemacie, hoście i porcie. Zarządza crawlowaniem; nie jest to uwierzytelnianie i nie gwarantuje, że odkryty URL pozostanie poza indeksem.
Gdzie powinien być umieszczony robots.txt?
Umieść go w katalogu głównym dokładnego hosta, na przykład https://example.com/robots.txt. Plik w podfolderze nie kontroluje całego hosta, a zasady nie przenoszą się automatycznie między subdomenami.
Czy robots.txt zapobiega indeksowaniu przez Google?
Nie. Zablokowany URL może być nadal odkryty z linków i może pojawić się bez fragmentu. Użyj odpowiedniego dyrektywy noindex, gdy potrzebujesz kontroli indeksowania, i nie blokuj robota przed odczytaniem tej dyrektywy.
Czy Google wspiera Crawl-delay?
Nie. Google dokumentuje User-agent, Allow, Disallow i Sitemap jako wspierane pola robots.txt i nie wspiera Crawl-delay, więc ten generator celowo go nie dodaje.
Która reguła wygrywa, gdy obie reguły Allow i Disallow pasują?
Najbardziej specyficzna ścieżka dopasowania wygrywa. Jeśli reguły Allow i Disallow są równoważne, reguła Allow powinna wygrać. Dopasowanie jest wrażliwe na wielkość liter.
Czy mogę dodać mapę witryny do robots.txt?
Tak. Dodaj jeden lub więcej kompletnych URL-i mapy witryny HTTP lub HTTPS. Wartość mapy witryny musi być absolutna i może wskazywać na inny host.
Czy robots.txt może blokować roboty AI?
Możesz celować w robota, który identyfikuje się za pomocą tokena produktu, ale tylko roboty, które rozpoznają i szanują Protokół Wykluczenia Robotów, będą przestrzegać. Nie traktuj pliku jako gwarancji przeciwko dostępowi, szkoleniu lub ponownemu użyciu.
Które roboty AI powinienem zezwolić lub zablokować?
Decyduj według celu. OAI-SearchBot, Claude-SearchBot i PerplexityBot wspierają odkrywanie wyszukiwania lub cytacje; GPTBot, ClaudeBot i Google-Extended zapewniają oddzielne kontrole związane z rozwojem modelu lub podstawą Gemini. Polityki się zmieniają, więc zweryfikuj aktualną dokumentację każdego dostawcy przed publikacją.
Czy powinienem zastąpić domyślny robots.txt w WordPressie, Drupalu, Joomli lub Shopify?
Zazwyczaj nie. Zacznij od pliku lub wirtualnego wyjścia utrzymywanego przez zainstalowaną wersję platformy, a następnie dodawaj tylko zweryfikowane zmiany specyficzne dla projektu. Shopify zaleca zachowanie wygenerowanych domyślnych ustawień Liquid, podczas gdy Drupal Composer Scaffold może zarządzać i aktualizować główny plik.
Czy moje dane są gdzieś przesyłane?
Nie. Ten generator działa całkowicie po stronie klienta w Twojej przeglądarce. Nic, co wpisujesz, nie jest wysyłane na serwer, więc jest bezpieczne w użyciu na prywatnych treściach.
Czy to naprawdę jest darmowe?
Tak, bez konta. Przestrzeń robocza Novaverb jest potrzebna tylko wtedy, gdy chcesz weryfikować, monitorować i śledzić te pliki na swojej aktywnej stronie w czasie.