Generador gratuito · se ejecuta en su navegador

Free Robots.txt Generator for SEO & AI Crawlers

Create and test a plain RFC 9309-aligned robots.txt with CMS publishing guidance and optional AI crawler controls. Copy or download it free - no signup.

Instantáneo, sin cuenta Nada se ha subido Copia o descarga el resultado
Tu entradaRobots.txt Generator

Elige una política base y luego agrega solo los caminos que necesitan una excepción.

robots.txt planoComienza con un grupo válido que permite todo. Tu ruta y elecciones de IA se añaden al archivo generado en tiempo real.

Usa * para todos los rastreadores o un token de producto exacto como Googlebot.

Usa * o un token de producto que contenga solo letras, guiones y guiones bajos.

Ingresa caminos en este host. Se agrega automáticamente una barra diagonal inicial faltante.

Usa una ruta de Permitir más específica dentro de un área bloqueada más amplia.

Elimina comentarios, saltos de línea o caracteres de control de los valores de las reglas.

Usa URLs completas http:// o https://. Se permiten URLs de sitemap de diferentes hosts.

Cada sitemap debe ser una URL completa HTTP o HTTPS.

Preferencias de rastreadores de IAAgrega grupos separados y nombrados sin cambiar el rastreo de Google Search.

No se añadirán grupos de IA nombrados. Todos los rastreadores regresan a tu grupo principal.

Prueba y resultadoSalida alineada con RFC y pruebas de comodín al estilo de Google
¿Sería esta ruta rastreable?Simula el grupo actual; prueba el archivo en vivo nuevamente después de publicar.
Permitido

Sin restricciones coincidentes - el rastreo está permitido.

1Reglas activas
0Sitemaps válidos
0Advertencias de entrada
robots.txt generadorobots.txt
Publicar en /robots.txt
Corrige el campo resaltado para generar el archivo.
Privado por diseño: este generador se ejecuta completamente en tu navegador - tu texto nunca se envía a Novaverb ni a ningún servidor.

Convierte la salida en un flujo de trabajo monitoreado

Un espacio de trabajo de Novaverb rastrea tu sitio en vivo, verifica que estas etiquetas y archivos se sirvan realmente, rastrea cambios a lo largo del tiempo y convierte hallazgos en trabajo asignado.

Comenzar gratis
Cómo usarlo

Robots.txt Generator

¿Qué es un generador de robots.txt?

Un generador de robots.txt crea una política de rastreo en texto plano para agentes de usuario automatizados en un host de sitio web. Esta herramienta crea registros de User-agent, Permitir, No permitir y Sitemap en tu navegador y te permite probar una ruta antes de publicarla.

User-agentAllowDisallowSitemap

Crea y verifica robots.txt en cinco pasos

El archivo y el probador se actualizan instantáneamente sin necesidad de subir tus reglas.

Elige una política inicial

Permitir rastreo público por defecto, añadir reglas personalizadas o bloquear explícitamente el rastreo para un entorno temporal.

Dirige a un grupo de rastreadores

Usa * para todos los rastreadores compatibles o ingresa el token de producto exacto para un rastreador.

Añadir reglas de ruta

Deniega caminos amplios y usa excepciones de permitir más específicas solo donde sea necesario.

URLs representativas de prueba

Prueba rutas públicas, bloqueadas y excepcionales. La vista previa identifica la regla ganadora.

Publicar y obtener

Sube robots.txt a la raíz del host, luego recupera la URL en vivo y confirma que la respuesta es actual.

Cómo funciona la coincidencia de reglas

El probador sigue el comportamiento clave de coincidencia definido por el Protocolo de Exclusión de Robots.

La coincidencia más específica gana

Una ruta coincidente más larga tiene prioridad sobre una regla más corta y amplia.

Permitir gana un empate igual

Cuando las reglas de Permitir y No permitir son equivalentes y ambas coinciden, se debe usar la regla de Permitir.

La coincidencia de caminos es sensible a mayúsculas y minúsculas

/Folder/ y /folder/ son rutas diferentes. Prueba la misma capitalización que usa tu servidor.

Lista de verificación de cumplimiento de RFC 9309

Estos son requisitos de protocolo y reglas de manejo de rastreadores, no folklore SEO opcional.

§2.3Archivo y ubicación correctos

Sirve /robots.txt en minúsculas en el nivel superior de cada esquema, host y puerto como texto plano UTF-8.

§2.2.1–2.2.3Grupos y coincidencias

Los tokens de agente de usuario usan letras, guiones o guiones bajos. La coincidencia es sensible a mayúsculas; la regla más larga gana y Allow gana en un empate igual.

§2.3.1Los resultados HTTP importan

Los rastreadores deben seguir al menos cinco redirecciones. Un archivo 4xx puede significar que el rastreo está permitido; un 5xx o fallo de red significa una prohibición completa mientras no sea accesible.

§2.4–2.5Límites de caché y analizador

Un archivo en caché normalmente no debe usarse más allá de 24 horas, y los analizadores deben soportar al menos 500 KiB.

Comienza desde una base de CMS transparente

Seleccionar una plataforma carga un iniciador visible y editable en robots.txt generado. Novaverb nunca añade directivas ocultas; verifica la versión de CMS instalada antes de reemplazar un archivo gestionado por la plataforma.

WordPress/robots.txt · /wp-sitemap.xml

WordPress puede servir ambos puntos finales virtualmente. Inspecciona primero la respuesta actual porque los plugins pueden reemplazar la salida principal; solo añade reglas que hayas verificado para este sitio.

Referencia del núcleo de WordPress
Drupalweb/robots.txt

Drupal Composer Scaffold gestiona el archivo raíz. Agrega o parchea reglas específicas del proyecto a través de la configuración del scaffold para que las actualizaciones del núcleo no las borren silenciosamente.

Guía de andamiaje de Drupal
Joomlarobots.txt.dist → robots.txt

Usa el archivo plano enviado con tu versión exacta de Joomla como la fuente actual de la plataforma. No importes una lista de rutas de una versión anterior o de otro sitio web.

Archivo principal de Joomla
Shopifytemplates/robots.txt.liquid

Shopify ya ofrece un predeterminado orientado a SEO. Personaliza la plantilla Liquid solo cuando sea necesario; reemplazar el archivo generado completo puede eliminar futuras actualizaciones de la plataforma.

Guía de Shopify
Next.jsapp/robots.ts

Usa la convención MetadataRoute.Robots para salida estática o dinámica tipada, o añade app/robots.txt para un archivo estático plano.

Referencia de robots de Next.js
Laravel / Djangopublic root or explicit /robots.txt route

Estos marcos no implican un conjunto universal de reglas SEO. Sirve el texto generado desde la raíz pública o una ruta de texto/plano y prueba el host de producción.

Elige acceso de IA por propósito

La visibilidad de búsqueda, el desarrollo de modelos y la recuperación solicitada por el usuario son decisiones diferentes. Los nombres de proveedores y políticas pueden cambiar, así que revisa la fuente vinculada antes de publicar.

Búsqueda y citaciónOAI-SearchBot, Claude-SearchBot, PerplexityBot

Bloquear estos puede reducir el descubrimiento, fragmentos, citas o calidad de resultados de búsqueda en los productos de IA correspondientes.

Desarrollo de modelosGPTBot, ClaudeBot, Google-Extended

Estos controles nombrados se relacionan con el posible entrenamiento de modelos, mejora de modelos o fundamentación de Gemini. Google-Extended no afecta la inclusión o clasificación en Google Search.

Control de límiterobots.txt sigue siendo asesor

Una regla de user-agent no es verificación de identidad, control de acceso o una opción universal de exclusión. Revisa la documentación del proveedor y valida el tráfico real por separado.

Usa el control adecuado para el trabajo

robots.txt es una preferencia de rastreo, no control de acceso o un comando de indexación garantizado.

Buenos usos

  • Reduce el rastreo de filtros duplicados, carritos y caminos de utilidad de bajo valor.
  • Expón una o más URLs absolutas de sitemap.
  • Crea reglas específicas para rastreadores que se identifican y respetan el protocolo.

No garantizado por robots.txt

  • Manteniendo contenido sensible privado - usa autenticación y autorización.
  • Eliminar una URL de la búsqueda - usa una respuesta no indexable noindex, flujo de trabajo de eliminación o control de acceso según corresponda.
  • Forzar a cada rastreador o sistema de IA a cumplir - el protocolo es asesor.

Generado no es lo mismo que en vivo

Un borrador correcto aún puede ser subido al host equivocado, almacenado en caché, redirigido o servido con un error. Después de publicar, obtén el archivo real, verifica su estado HTTP y confirma que las directivas del Sitemap se resuelven.

Verificar robots.txt en vivo
Preguntas comunes

Robots.txt Generator FAQ

¿Qué hace robots.txt?

robots.txt indica a los rastreadores compatibles qué rutas de URL pueden solicitar en un esquema, host y puerto específicos. Gestiona el rastreo; no es autenticación y no garantiza que una URL descubierta se mantenga fuera de un índice.

¿Dónde debe colocarse robots.txt?

Colócalo en la raíz del host exacto, por ejemplo https://example.com/robots.txt. Un archivo en una subcarpeta no controla todo el host, y las reglas no se transfieren automáticamente entre subdominios.

¿robots.txt previene la indexación de Google?

No. Una URL bloqueada aún puede ser descubierta a partir de enlaces y puede aparecer sin un fragmento. Usa una directiva noindex apropiada cuando necesites control de indexación, y no bloquees al rastreador de leer esa directiva.

¿Google soporta Crawl-delay?

No. Google documenta Agente de usuario, Permitir, Denegar y Sitemap como campos soportados de robots.txt y no soporta Crawl-delay, por lo que este generador intencionalmente no lo agrega.

¿Qué regla gana cuando ambas, Permitir y No permitir, coinciden?

La ruta de coincidencia más específica gana. Si una regla de Permitir y una de No permitir son equivalentes, la de Permitir debe ganar. La coincidencia es sensible a mayúsculas y minúsculas.

¿Puedo agregar un sitemap a robots.txt?

Sí. Agrega una o más URLs de sitemap HTTP o HTTPS completas. El valor del Sitemap debe ser absoluto y puede apuntar a un host diferente.

¿Puede robots.txt bloquear rastreadores de IA?

Puedes dirigirte a un rastreador que se identifica con un token de producto, pero solo los rastreadores que reconocen y respetan el Protocolo de Exclusión de Robots cumplirán. No trates el archivo como una garantía contra el acceso, entrenamiento o reutilización.

¿Qué rastreadores de IA debería permitir o bloquear?

Decide por propósito. OAI-SearchBot, Claude-SearchBot y PerplexityBot apoyan el descubrimiento de búsqueda o citas; GPTBot, ClaudeBot y Google-Extended proporcionan controles separados relacionados con el desarrollo de modelos o la fundamentación de Gemini. Las políticas cambian, así que verifica la documentación actual de cada proveedor antes de publicar.

¿Debería reemplazar el robots.txt predeterminado en WordPress, Drupal, Joomla o Shopify?

Generalmente no. Comienza desde el archivo o salida virtual mantenida por la versión de plataforma instalada, luego añade solo cambios específicos del proyecto verificados. Shopify recomienda preservar sus predeterminados de Liquid generados, mientras que Drupal Composer Scaffold puede gestionar y actualizar el archivo raíz.

¿Mis datos están subidos en alguna parte?

No. Este generador se ejecuta completamente del lado del cliente en tu navegador. Nada de lo que escribas se envía a un servidor, por lo que es seguro usarlo en contenido privado.

¿Es realmente gratis?

Sí, sin cuenta. Un espacio de trabajo de Novaverb solo es necesario cuando deseas verificar, monitorear y rastrear estos archivos en tu sitio en vivo a lo largo del tiempo.

Más herramientas gratuitas

Explorar todas las herramientas gratuitas de Novaverb

Meta Tag GeneratorCreate valid SEO meta tags for titles, descriptions, canonicals, …
XML Sitemap GeneratorCreate a valid XML sitemap or sitemap index from …
Word CounterCount words, characters, sentences, paragraphs and reading time instantly. …
Convert CaseConvert text to sentence case, lowercase, UPPER CASE, capitalized …
Image ConverterConvert up to 20 browser-supported images to JPG, PNG, …
Image CompressorCompress JPG, PNG, WebP and AVIF images in your …
Image ResizerResize up to 20 JPG, PNG, WebP or AVIF …
AI Content CheckerCheck writing signals associated with AI-generated text in a …
Plagiarism CheckerFind potential matching sources for selected sentences via a …
Online HTML EditorWrite and edit HTML with an instant live preview, …
SEO ROI CalculatorEstimate organic conversions, gross profit, monthly ROI and break-even …
UTM Campaign BuilderBuild consistent UTM campaign URLs for ads, email, social …
Campaign Brief BuilderTurn an objective, audience, offer and measurement plan into …
SEO Traffic ForecastModel organic clicks, conversions and revenue over a planning …
Content Calendar PlannerCreate a practical multi-week content calendar from one topic, …
Marketing KPI CalculatorCalculate CTR, CPC, conversion rate, CPA, revenue and ROAS …
Verificador SEO del Sitio WebCobertura de rastreo, páginas indexables, enlaces internos
Keyword Research ToolFree AI keyword research tool for search volume, keyword …
SERP CheckerCheck live organic search results and AI Overview rankings …
Website Security CheckerAudit website security posture, TLS/SSL certificates, HTTP security headers, …
Server Response Time CheckerMeasure server Time to First Byte (TTFB), DNS lookup, …
Backlink CheckerExplore backlinks, referring domains, dofollow links, and domain authority …
Robots.txt CheckerTest and validate robots.txt rules, User-Agent directives, blocked paths …
Sitemap CheckerValidate XML sitemap structure, URL counts, reachability, and index …
Meta Tag CheckerCheck page title length, meta description, H1 heading structure, …
HTTP Status & Redirect CheckerTrace HTTP status codes (200, 301, 302, 404, 500) …
Website MonitorMonitor website availability, HTTP status code, and server response …
HTTP/2 TestCheck whether your web server supports HTTP/2 via TLS …
HTTP/3 TestTest whether your web server supports HTTP/3 over QUIC …
Website Performance TestTest global website loading speed and TTFB waterfall timing …
GEO CheckerAudit whether ChatGPT, Perplexity, Gemini, and Google AI Overviews …
Core Web Vitals CheckerCheck real-user Core Web Vitals (LCP, INP, CLS) from …
PageSpeed CheckerRun a live Lighthouse performance audit to test PageSpeed, …
Website Safety CheckerCheck whether a domain or URL is flagged for …
Knowledge Graph CheckerCheck whether a brand, person, product or organization is …
Keyword Gap CheckerCompare your site against competitors to find missing high-traffic …
Competitor Top PagesFind top organic traffic-driving pages for any competitor domain. …
Copiado al portapapeles
Verifica → entiende → corrige

Convierte esta verificación en una solución verificada

Cada herramienta gratuita de Novaverb es un embudo: realiza la verificación, comprende la evidencia, luego corrígela y prueba que se ha resuelto con una nueva verificación - sin estados de paso inventados.