Générateur gratuit · fonctionne dans votre navigateur

Free Robots.txt Generator for SEO & AI Crawlers

Create and test a plain RFC 9309-aligned robots.txt with CMS publishing guidance and optional AI crawler controls. Copy or download it free - no signup.

Instantané, sans compte Rien n'est téléchargé Copiez ou téléchargez le résultat
Votre entréeRobots.txt Generator

Choisissez une politique de base, puis ajoutez uniquement les chemins nécessitant une exception.

robots.txt simpleCommence avec un groupe valide autorisant tout. Votre chemin et vos choix AI sont ajoutés au fichier généré en temps réel.

Utilisez * pour tous les robots ou un jeton de produit exact tel que Googlebot.

Utilisez * ou un jeton de produit contenant uniquement des lettres, des tirets et des underscores.

Entrez des chemins sur cet hôte. Un slash initial manquant est ajouté automatiquement.

Utilisez un chemin Autoriser plus spécifique à l'intérieur d'une zone bloquée plus large.

Supprimer les commentaires, les sauts de ligne ou les caractères de contrôle des valeurs de règle.

Utilisez des URL http:// ou https:// complètes. Les URL de sitemap inter-hôtes sont autorisées.

Chaque sitemap doit être une URL HTTP ou HTTPS complète.

Préférences de robots AIAjoutez des groupes nommés séparés sans changer le crawl de Google Search.

Aucun groupe AI nommé ne sera ajouté. Tous les robots reviennent à votre groupe principal.

Test et résultatSortie conforme à la RFC avec tests de wildcard de style Google
Ce chemin serait-il crawlable ?Simule le groupe actuel ; testez à nouveau le fichier en direct après publication.
Autorisé

Aucune restriction correspondante - le crawl est autorisé.

1Règles actives
0Sitemaps valides
0Avertissements d'entrée
robots.txt générérobots.txt
Publier à /robots.txt
Corrigez le champ surligné pour générer le fichier.
Privé par conception : ce générateur s'exécute entièrement dans votre navigateur - votre texte n'est jamais envoyé à Novaverb ou à un serveur.

Transformez la sortie en un flux de travail surveillé

Un espace de travail Novaverb explore votre site en direct, vérifie que ces balises et fichiers sont effectivement servis, suit les changements dans le temps et transforme les résultats en tâches assignées.

Commencer gratuitement
Comment l'utiliser

Robots.txt Generator

Qu'est-ce qu'un générateur de robots.txt ?

Un générateur de robots.txt crée une politique de crawl en texte brut pour les agents utilisateurs automatisés sur un hôte de site web. Cet outil crée des enregistrements User-agent, Autoriser, Interdire et Sitemap dans votre navigateur et vous permet de tester un chemin avant de le publier.

User-agentAllowDisallowSitemap

Créer et vérifier robots.txt en cinq étapes

Le fichier et le testeur se mettent à jour instantanément sans télécharger vos règles.

Choisissez une politique de départ

Autoriser le crawl public par défaut, ajouter des règles personnalisées ou bloquer explicitement le crawl pour un environnement temporaire.

Ciblez un groupe de robots

Utilisez * pour tous les robots conformes ou entrez le jeton de produit exact pour un robot.

Ajouter des règles de chemin

Interdire des chemins larges et utiliser des exceptions d'autorisation plus spécifiques uniquement si nécessaire.

Tester des URL représentatives

Essayez des chemins publics, bloqués et d'exception. L'aperçu identifie la règle gagnante.

Publier et récupérer

Téléchargez robots.txt à la racine de l'hôte, puis récupérez l'URL en direct et confirmez que la réponse est actuelle.

Comment fonctionne la correspondance des règles

Le testeur suit le comportement de correspondance clé défini par le Protocole d'Exclusion des Robots.

La correspondance la plus spécifique l'emporte

Un chemin correspondant plus long prend le pas sur une règle plus courte et plus large.

Autoriser gagne un égalité

Lorsque des règles Autoriser et Interdire équivalentes correspondent toutes deux, la règle Autoriser doit être utilisée.

La correspondance des chemins est sensible à la casse

/Folder/ et /folder/ sont des chemins différents. Testez la même casse que celle utilisée par votre serveur.

Liste de contrôle de conformité RFC 9309

Ce sont des exigences de protocole et des règles de gestion des robots, pas du folklore SEO optionnel.

§2.3Fichier et emplacement corrects

Servez /robots.txt en minuscules au niveau supérieur de chaque schéma, hôte et port en tant que texte/plain UTF-8.

§2.2.1–2.2.3Groupes et correspondance

Les jetons User-agent utilisent des lettres, des tirets ou des underscores. La correspondance est sensible à la casse ; la règle la plus longue l'emporte et Allow l'emporte en cas d'égalité.

§2.3.1Les résultats HTTP comptent

Les robots doivent suivre au moins cinq redirections. Un fichier 4xx peut signifier que le crawl est autorisé ; un échec 5xx ou réseau signifie un refus complet tant qu'il est injoignable.

§2.4–2.5Limites de cache et d'analyseur

Un fichier mis en cache ne doit normalement pas être utilisé au-delà de 24 heures, et les analyseurs doivent prendre en charge au moins 500 Ko.

Commencez à partir d'une base CMS transparente

Sélectionner une plateforme charge un starter visible et modifiable dans le robots.txt généré. Novaverb n'ajoute jamais de directives cachées ; vérifiez la version CMS installée avant de remplacer un fichier géré par la plateforme.

WordPress/robots.txt · /wp-sitemap.xml

WordPress peut servir les deux points de terminaison virtuellement. Inspectez d'abord la réponse actuelle car les plugins peuvent remplacer la sortie principale ; ajoutez uniquement des règles que vous avez vérifiées pour ce site.

Référence du cœur de WordPress
Drupalweb/robots.txt

Drupal Composer Scaffold gère le fichier racine. Ajoutez ou modifiez des règles spécifiques au projet via la configuration de l'échafaudage afin que les mises à jour du cœur ne les effacent pas silencieusement.

Guide de l'échafaudage Drupal
Joomlarobots.txt.dist → robots.txt

Utilisez le fichier simple expédié avec votre version Joomla exacte comme source de plateforme actuelle. N'importez pas une liste de chemins d'une version antérieure ou d'un autre site web.

Fichier de base Joomla
Shopifytemplates/robots.txt.liquid

Shopify sert déjà un défaut orienté SEO. Personnalisez le modèle Liquid uniquement si nécessaire ; remplacer le fichier généré complet peut supprimer les mises à jour futures de la plateforme.

Conseils Shopify
Next.jsapp/robots.ts

Utilisez la convention MetadataRoute.Robots pour une sortie statique ou dynamique typée, ou ajoutez app/robots.txt pour un fichier statique simple.

Référence des robots Next.js
Laravel / Djangopublic root or explicit /robots.txt route

Ces frameworks n'impliquent pas un ensemble de règles SEO universel. Servez le texte généré depuis la racine publique ou un itinéraire texte/plain et testez l'hôte de production.

Choisissez l'accès AI par objectif

La visibilité de recherche, le développement de modèle et la récupération demandée par l'utilisateur sont des décisions différentes. Les noms et politiques des fournisseurs peuvent changer, donc vérifiez la source liée avant de publier.

Recherche et citationOAI-SearchBot, Claude-SearchBot, PerplexityBot

Bloquer ceux-ci peut réduire la découverte, les extraits, les citations ou la qualité des résultats de recherche dans les produits AI correspondants.

Développement de modèleGPTBot, ClaudeBot, Google-Extended

Ces contrôles nommés concernent la formation potentielle de modèle, l'amélioration de modèle ou le grounding Gemini. Google-Extended n'affecte pas l'inclusion ou le classement dans Google Search.

Contrôle de frontièrerobots.txt reste consultatif

Une règle d'agent utilisateur n'est pas une vérification d'identité, un contrôle d'accès ou un opt-out universel. Consultez la documentation du fournisseur et validez le trafic réel séparément.

Utilisez le bon contrôle pour le travail

robots.txt est une préférence de crawl, pas un contrôle d'accès ou un ordre d'indexation garanti.

Bonnes utilisations

  • Réduire le crawling des filtres en double, des paniers et des chemins utilitaires de faible valeur.
  • Exposez une ou plusieurs URL de sitemap absolues.
  • Créer des règles spécifiques pour les crawlers qui s'identifient et respectent le protocole.

Pas garanti par robots.txt

  • Gardez le contenu sensible privé - utilisez l'authentification et l'autorisation.
  • Suppression d'une URL de la recherche - utilisez une réponse noindex indexable, un flux de suppression ou un contrôle d'accès selon le cas.
  • Forcer chaque crawler ou système AI à se conformer - le protocole est consultatif.

Généré n'est pas la même chose que en direct

Un brouillon correct peut toujours être téléchargé sur le mauvais hôte, mis en cache, redirigé ou servi avec une erreur. Après publication, récupérez le vrai fichier, vérifiez son statut HTTP et confirmez que les directives Sitemap se résolvent.

Vérifier robots.txt en direct
Questions courantes

Robots.txt Generator FAQ

Que fait robots.txt ?

robots.txt indique aux robots conformes quels chemins d'URL ils peuvent demander sur un schéma, un hôte et un port spécifiques. Il gère le crawl ; ce n'est pas une authentification et ne garantit pas qu'une URL découverte restera hors d'un index.

Où robots.txt doit-il être placé ?

Placez-le à la racine de l'hôte exact, par exemple https://example.com/robots.txt. Un fichier dans un sous-dossier ne contrôle pas l'ensemble de l'hôte, et les règles ne se transfèrent pas automatiquement entre les sous-domaines.

Le robots.txt empêche-t-il l'indexation par Google ?

Non. Une URL bloquée peut toujours être découverte à partir de liens et peut apparaître sans extrait. Utilisez une directive noindex appropriée lorsque vous avez besoin de contrôle d'indexation, et ne bloquez pas le crawler de lire cette directive.

Google supporte-t-il Crawl-delay ?

Non. Google documente User-agent, Allow, Disallow et Sitemap comme des champs robots.txt pris en charge et ne supporte pas Crawl-delay, donc ce générateur ne l'ajoute pas intentionnellement.

Quelle règle l'emporte lorsque Autoriser et Interdire correspondent tous deux ?

Le chemin de correspondance le plus spécifique l'emporte. Si une règle Autoriser et une règle Interdire sont équivalentes, Autoriser doit l'emporter. La correspondance est sensible à la casse.

Puis-je ajouter un sitemap à robots.txt ?

Oui. Ajoutez une ou plusieurs URL de sitemap HTTP ou HTTPS complètes. La valeur Sitemap doit être absolue et peut pointer vers un hôte différent.

Le robots.txt peut-il bloquer les crawlers AI ?

Vous pouvez cibler un robot qui s'identifie avec un jeton de produit, mais seuls les robots qui reconnaissent et respectent le Protocole d'Exclusion des Robots se conformeront. Ne considérez pas le fichier comme une garantie contre l'accès, la formation ou la réutilisation.

Quels robots AI devrais-je autoriser ou bloquer ?

Décidez par objectif. OAI-SearchBot, Claude-SearchBot et PerplexityBot soutiennent la découverte de recherche ou les citations ; GPTBot, ClaudeBot et Google-Extended fournissent des contrôles séparés liés au développement de modèles ou à la base de Gemini. Les politiques changent, donc vérifiez la documentation actuelle de chaque fournisseur avant de publier.

Dois-je remplacer le robots.txt par défaut dans WordPress, Drupal, Joomla ou Shopify ?

En général, non. Commencez par le fichier ou la sortie virtuelle maintenue par la version de plateforme installée, puis ajoutez uniquement des modifications spécifiques au projet vérifiées. Shopify recommande de préserver ses défauts Liquid générés, tandis que Drupal Composer Scaffold peut gérer et mettre à jour le fichier racine.

Mes données sont-elles téléchargées quelque part ?

Non. Ce générateur fonctionne entièrement côté client dans votre navigateur. Rien de ce que vous tapez n'est envoyé à un serveur, donc il est sûr à utiliser sur du contenu privé.

Est-ce vraiment gratuit ?

Oui, sans compte. Un espace de travail Novaverb n'est nécessaire que lorsque vous souhaitez vérifier, surveiller et suivre ces fichiers sur votre site en direct au fil du temps.

Plus d'outils gratuits

Explorer tous les outils gratuits de Novaverb

Meta Tag GeneratorCreate valid SEO meta tags for titles, descriptions, canonicals, …
XML Sitemap GeneratorCreate a valid XML sitemap or sitemap index from …
Word CounterCount words, characters, sentences, paragraphs and reading time instantly. …
Convert CaseConvert text to sentence case, lowercase, UPPER CASE, capitalized …
Image ConverterConvert up to 20 browser-supported images to JPG, PNG, …
Image CompressorCompress JPG, PNG, WebP and AVIF images in your …
Image ResizerResize up to 20 JPG, PNG, WebP or AVIF …
AI Content CheckerCheck writing signals associated with AI-generated text in a …
Plagiarism CheckerFind potential matching sources for selected sentences via a …
Online HTML EditorWrite and edit HTML with an instant live preview, …
SEO ROI CalculatorEstimate organic conversions, gross profit, monthly ROI and break-even …
UTM Campaign BuilderBuild consistent UTM campaign URLs for ads, email, social …
Campaign Brief BuilderTurn an objective, audience, offer and measurement plan into …
SEO Traffic ForecastModel organic clicks, conversions and revenue over a planning …
Content Calendar PlannerCreate a practical multi-week content calendar from one topic, …
Marketing KPI CalculatorCalculate CTR, CPC, conversion rate, CPA, revenue and ROAS …
Vérificateur SEO de site webCouverture de crawl, pages indexables, liens internes
Keyword Research ToolFree AI keyword research tool for search volume, keyword …
SERP CheckerCheck live organic search results and AI Overview rankings …
Website Security CheckerAudit website security posture, TLS/SSL certificates, HTTP security headers, …
Server Response Time CheckerMeasure server Time to First Byte (TTFB), DNS lookup, …
Backlink CheckerExplore backlinks, referring domains, dofollow links, and domain authority …
Robots.txt CheckerTest and validate robots.txt rules, User-Agent directives, blocked paths …
Sitemap CheckerValidate XML sitemap structure, URL counts, reachability, and index …
Meta Tag CheckerCheck page title length, meta description, H1 heading structure, …
HTTP Status & Redirect CheckerTrace HTTP status codes (200, 301, 302, 404, 500) …
Website MonitorMonitor website availability, HTTP status code, and server response …
HTTP/2 TestCheck whether your web server supports HTTP/2 via TLS …
HTTP/3 TestTest whether your web server supports HTTP/3 over QUIC …
Website Performance TestTest global website loading speed and TTFB waterfall timing …
GEO CheckerAudit whether ChatGPT, Perplexity, Gemini, and Google AI Overviews …
Core Web Vitals CheckerCheck real-user Core Web Vitals (LCP, INP, CLS) from …
PageSpeed CheckerRun a live Lighthouse performance audit to test PageSpeed, …
Website Safety CheckerCheck whether a domain or URL is flagged for …
Knowledge Graph CheckerCheck whether a brand, person, product or organization is …
Keyword Gap CheckerCompare your site against competitors to find missing high-traffic …
Competitor Top PagesFind top organic traffic-driving pages for any competitor domain. …
Copié dans le presse-papiers
Vérifiez → comprenez → corrigez

Transformez cette vérification en une correction vérifiée

Chaque outil gratuit de Novaverb est un entonnoir : effectuez la vérification, comprenez les preuves, puis corrigez-le et prouvez qu'il est résolu avec une nouvelle vérification - aucun état de passage inventé.