Sta standaard openbare crawling toe, voeg aangepaste regels toe, of blokkeer expliciet crawling voor een tijdelijke omgeving.
Free Robots.txt Generator for SEO & AI Crawlers
Create and test a plain RFC 9309-aligned robots.txt with CMS publishing guidance and optional AI crawler controls. Copy or download it free - no signup.
Kies een basisbeleid en voeg alleen de paden toe die een uitzondering nodig hebben.
Gebruik * voor alle crawlers of één exacte producttoken zoals Googlebot.
Gebruik * of een producttoken die alleen letters, koppeltekens en onderstrepingen bevat.
Voer paden in op deze host. Een ontbrekende voorwaartse schuine streep wordt automatisch toegevoegd.
Gebruik een specifiekere Toestaan pad binnen een breder geblokkeerd gebied.
Verwijder opmerkingen, regeleinden of controlekarakters uit regelwaarden.
Gebruik volledige http:// of https:// URL's. Cross-host sitemap URL's zijn toegestaan.
Elke sitemap moet een volledige HTTP- of HTTPS-URL zijn.
Er zullen geen benoemde AI groepen worden toegevoegd. Alle crawlers vallen terug op je hoofdgroep.
Geen overeenkomende beperking - crawlen is toegestaan.
Zet output om in een gemonitorde workflow
Een Novaverb-werkruimte crawlt je live site, verifieert of deze tags en bestanden daadwerkelijk worden aangeboden, volgt veranderingen in de tijd en zet bevindingen om in toegewezen werk.
Robots.txt Generator
Wat is een robots.txt generator?
Een robots.txt generator creëert een platte tekst crawlbeleid voor geautomatiseerde gebruikersagenten op één website-host. Deze tool bouwt User-agent, Toestaan, Verbieden en Sitemap records in je browser en laat je een pad testen voordat je publiceert.
Maak en verifieer robots.txt in vijf stappen
Het bestand en de tester worden onmiddellijk bijgewerkt zonder je regels te uploaden.
Gebruik * voor alle conforme crawlers of voer de exacte producttoken in voor één crawler.
Blokkeer brede paden en gebruik meer specifieke toestaan uitzonderingen alleen waar nodig.
Probeer openbare, geblokkeerde en uitzonderingspaden. De preview identificeert de winnende regel.
Upload robots.txt naar de host root, haal dan de live URL op en bevestig dat de reactie actueel is.
Hoe werkt regelovereenstemming
De tester volgt het belangrijkste overeenkomend gedrag zoals gedefinieerd door het Robots Exclusion Protocol.
Een langer overeenkomend pad heeft voorrang boven een kortere, bredere regel.
Wanneer equivalente Toestaan en Verbieden regels beide overeenkomen, moet de Toestaan regel worden gebruikt.
/Folder/ en /folder/ zijn verschillende paden. Test dezelfde hoofdletters die je server gebruikt.
RFC 9309 compliance checklist
Dit zijn protocolvereisten en crawler-behandelingsregels, geen optionele SEO folklore.
§2.3Correct bestand en locatieDien kleine letters /robots.txt in op het hoogste niveau van elk schema, host en poort als UTF-8 text/plain.
§2.2.1–2.2.3Groepen en overeenkomstenUser-agent tokens gebruiken letters, koppeltekens of underscores. Overeenkomsten zijn hoofdlettergevoelig; de langste regel wint en Allow wint bij een gelijke stand.
§2.3.1HTTP-resultaten zijn belangrijkCrawlers moeten ten minste vijf omleidingen volgen. Een 4xx bestand kan betekenen dat crawlen is toegestaan; een 5xx of netwerkfout betekent volledige weigering terwijl onbereikbaar.
§2.4–2.5Cache en parser limietenEen gecached bestand mag normaal gesproken niet langer dan 24 uur worden gebruikt, en parsers moeten ten minste 500 KiB ondersteunen.
Begin vanaf een transparante CMS-basislijn
Het selecteren van een platform laadt een zichtbare, bewerkbare starter in Generated robots.txt. Novaverb voegt nooit verborgen richtlijnen toe; verifieer de geïnstalleerde CMS-versie voordat je een platform-beheerd bestand vervangt.
/robots.txt · /wp-sitemap.xmlWordPress kan beide eindpunten virtueel bedienen. Inspecteer eerst de huidige respons omdat plugins de kernoutput kunnen vervangen; voeg alleen regels toe die je voor deze site hebt geverifieerd.
WordPress kernreferentieweb/robots.txtDrupal Composer Scaffold beheert het rootbestand. Voeg project-specifieke regels toe of patch ze via scaffold-configuratie zodat kernupdates ze niet stilletjes wissen.
Drupal scaffold gidsrobots.txt.dist → robots.txtGebruik het platte bestand dat met je exacte Joomla release is geleverd als de huidige platformbron. Importeer geen padlijst van een oudere release of een andere website.
Joomla kernbestandtemplates/robots.txt.liquidShopify biedt al een SEO-georiënteerde standaard. Pas de Liquid-sjabloon alleen aan wanneer nodig; het vervangen van het volledige gegenereerde bestand kan toekomstige platformupdates verwijderen.
Shopify richtlijnenapp/robots.tsGebruik de MetadataRoute.Robots conventie voor getypte statische of dynamische output, of voeg app/robots.txt toe voor een platte statische file.
Next.js robots referentiepublic root or explicit /robots.txt routeDeze frameworks impliceren geen universele SEO regelset. Dien de gegenereerde tekst in vanuit de publieke root of een text/plain route en test de productiehost.
Kies AI-toegang op basis van doel
Zoekzichtbaarheid, modelontwikkeling en door gebruikers aangevraagde retrieval zijn verschillende beslissingen. Leverancier namen en beleid kunnen veranderen, dus controleer de gelinkte bron voordat je publiceert.
OAI-SearchBot, Claude-SearchBot, PerplexityBotHet blokkeren hiervan kan de ontdekking, snippets, citaten of de kwaliteit van zoekresultaten in de bijbehorende AI-producten verminderen.
GPTBot, ClaudeBot, Google-ExtendedDeze benoemde controles hebben betrekking op potentiële modeltraining, modelverbetering of Gemini grounding. Google-Extended heeft geen invloed op Google Search opname of ranking.
Een user-agent regel is geen identiteitsverificatie, toegangscontrole of een universele opt-out. Bekijk de documentatie van de provider en valideer echt verkeer afzonderlijk.
Gebruik de juiste controle voor de taak
robots.txt is een crawlvoorkeur, geen toegangscontrole of een gegarandeerde indexeringsopdracht.
Goede toepassingen
- Verminder het crawlen van dubbele filters, winkelwagentjes en paden met lage waarde.
- Exposeer een of meer absolute sitemap-URL's.
- Creëer specifieke regels voor crawlers die zichzelf identificeren en het protocol respecteren.
Niet gegarandeerd door robots.txt
- Houd gevoelige inhoud privé - gebruik authenticatie en autorisatie.
- Een URL uit de zoekresultaten verwijderen - gebruik een indexeerbare noindex-respons, verwijderingsworkflow of toegangscontrole indien nodig.
- Iedere crawler of AI-systeem dwingen om te voldoen - het protocol is adviserend.
Gegenereerd is niet hetzelfde als live
Een correct concept kan nog steeds naar de verkeerde host worden geüpload, gecached, omgeleid of met een fout worden weergegeven. Controleer na publicatie het echte bestand, verifieer de HTTP-status en bevestig dat de Sitemap-instructies oplossen.
Robots.txt Generator FAQ
Wat doet robots.txt?
robots.txt vertelt conforme crawlers welke URL-paden ze mogen aanvragen op een specifieke schema, host en poort. Het beheert crawlen; het is geen authenticatie en garandeert niet dat een ontdekte URL buiten een index blijft.
Waar moet robots.txt geplaatst worden?
Plaats het in de root van de exacte host, bijvoorbeeld https://example.com/robots.txt. Een bestand in een submap controleert de hele host niet, en regels worden niet automatisch overgedragen tussen subdomeinen.
Voorkomt robots.txt dat Google indexeert?
Nee. Een geblokkeerde URL kan nog steeds worden ontdekt via links en kan verschijnen zonder een snippet. Gebruik een geschikte noindex-directive wanneer je indexeringscontrole nodig hebt, en blokkeer de crawler niet om die directive te lezen.
Ondersteunt Google Crawl-delay?
Nee. Google documenteert User-agent, Allow, Disallow en Sitemap als ondersteunde robots.txt-velden en ondersteunt geen Crawl-delay, dus deze generator voegt het opzettelijk niet toe.
Welke regel wint wanneer Toestaan en Verbieden beide overeenkomen?
De meest specifieke overeenkomstige pad wint. Als een Toestaan en Verbieden regel gelijkwaardig zijn, moet Toestaan winnen. Overeenkomsten zijn hoofdlettergevoelig.
Kan ik een sitemap aan robots.txt toevoegen?
Ja. Voeg een of meer complete HTTP of HTTPS sitemap URL's toe. De Sitemap waarde moet absoluut zijn, en het kan naar een andere host wijzen.
Kan robots.txt AI-crawlers blokkeren?
Je kunt een crawler targeten die zichzelf identificeert met een producttoken, maar alleen crawlers die het Robots Exclusion Protocol herkennen en respecteren zullen zich houden aan de regels. Behandel het bestand niet als een garantie tegen toegang, training of hergebruik.
Welke AI crawlers moet ik toestaan of blokkeren?
Beslis op basis van doel. OAI-SearchBot, Claude-SearchBot en PerplexityBot ondersteunen zoekontdekking of citaten; GPTBot, ClaudeBot en Google-Extended bieden aparte controles met betrekking tot modelontwikkeling of Gemini-grondslagen. Beleid verandert, dus verifieer de huidige documentatie van elke provider voordat je publiceert.
Moet ik de standaard robots.txt in WordPress, Drupal, Joomla of Shopify vervangen?
Meestal niet. Begin met het bestand of virtuele output die wordt onderhouden door de geïnstalleerde platformversie, voeg dan alleen geverifieerde project-specifieke wijzigingen toe. Shopify raadt aan zijn gegenereerde Liquid-standaarden te behouden, terwijl Drupal Composer Scaffold het rootbestand kan beheren en bijwerken.
Is mijn data ergens geüpload?
Nee. Deze generator draait volledig client-side in uw browser. Niets wat u typt wordt naar een server gestuurd, dus het is veilig om te gebruiken op privé-inhoud.
Is het echt gratis?
Ja, zonder account. Een Novaverb-werkruimte is alleen nodig wanneer je deze bestanden op je live site wilt verifiëren, monitoren en volgen in de loop van de tijd.