Permitir rastreo público por defecto, añadir reglas personalizadas o bloquear explícitamente el rastreo para un entorno temporal.
Free Robots.txt Generator for SEO & AI Crawlers
Create and test a plain RFC 9309-aligned robots.txt with CMS publishing guidance and optional AI crawler controls. Copy or download it free - no signup.
Elige una política base y luego agrega solo los caminos que necesitan una excepción.
Usa * para todos los rastreadores o un token de producto exacto como Googlebot.
Usa * o un token de producto que contenga solo letras, guiones y guiones bajos.
Ingresa caminos en este host. Se agrega automáticamente una barra diagonal inicial faltante.
Usa una ruta de Permitir más específica dentro de un área bloqueada más amplia.
Elimina comentarios, saltos de línea o caracteres de control de los valores de las reglas.
Usa URLs completas http:// o https://. Se permiten URLs de sitemap de diferentes hosts.
Cada sitemap debe ser una URL completa HTTP o HTTPS.
No se añadirán grupos de IA nombrados. Todos los rastreadores regresan a tu grupo principal.
Sin restricciones coincidentes - el rastreo está permitido.
Convierte la salida en un flujo de trabajo monitoreado
Un espacio de trabajo de Novaverb rastrea tu sitio en vivo, verifica que estas etiquetas y archivos se sirvan realmente, rastrea cambios a lo largo del tiempo y convierte hallazgos en trabajo asignado.
Robots.txt Generator
¿Qué es un generador de robots.txt?
Un generador de robots.txt crea una política de rastreo en texto plano para agentes de usuario automatizados en un host de sitio web. Esta herramienta crea registros de User-agent, Permitir, No permitir y Sitemap en tu navegador y te permite probar una ruta antes de publicarla.
Crea y verifica robots.txt en cinco pasos
El archivo y el probador se actualizan instantáneamente sin necesidad de subir tus reglas.
Usa * para todos los rastreadores compatibles o ingresa el token de producto exacto para un rastreador.
Deniega caminos amplios y usa excepciones de permitir más específicas solo donde sea necesario.
Prueba rutas públicas, bloqueadas y excepcionales. La vista previa identifica la regla ganadora.
Sube robots.txt a la raíz del host, luego recupera la URL en vivo y confirma que la respuesta es actual.
Cómo funciona la coincidencia de reglas
El probador sigue el comportamiento clave de coincidencia definido por el Protocolo de Exclusión de Robots.
Una ruta coincidente más larga tiene prioridad sobre una regla más corta y amplia.
Cuando las reglas de Permitir y No permitir son equivalentes y ambas coinciden, se debe usar la regla de Permitir.
/Folder/ y /folder/ son rutas diferentes. Prueba la misma capitalización que usa tu servidor.
Lista de verificación de cumplimiento de RFC 9309
Estos son requisitos de protocolo y reglas de manejo de rastreadores, no folklore SEO opcional.
§2.3Archivo y ubicación correctosSirve /robots.txt en minúsculas en el nivel superior de cada esquema, host y puerto como texto plano UTF-8.
§2.2.1–2.2.3Grupos y coincidenciasLos tokens de agente de usuario usan letras, guiones o guiones bajos. La coincidencia es sensible a mayúsculas; la regla más larga gana y Allow gana en un empate igual.
§2.3.1Los resultados HTTP importanLos rastreadores deben seguir al menos cinco redirecciones. Un archivo 4xx puede significar que el rastreo está permitido; un 5xx o fallo de red significa una prohibición completa mientras no sea accesible.
§2.4–2.5Límites de caché y analizadorUn archivo en caché normalmente no debe usarse más allá de 24 horas, y los analizadores deben soportar al menos 500 KiB.
Comienza desde una base de CMS transparente
Seleccionar una plataforma carga un iniciador visible y editable en robots.txt generado. Novaverb nunca añade directivas ocultas; verifica la versión de CMS instalada antes de reemplazar un archivo gestionado por la plataforma.
/robots.txt · /wp-sitemap.xmlWordPress puede servir ambos puntos finales virtualmente. Inspecciona primero la respuesta actual porque los plugins pueden reemplazar la salida principal; solo añade reglas que hayas verificado para este sitio.
Referencia del núcleo de WordPressweb/robots.txtDrupal Composer Scaffold gestiona el archivo raíz. Agrega o parchea reglas específicas del proyecto a través de la configuración del scaffold para que las actualizaciones del núcleo no las borren silenciosamente.
Guía de andamiaje de Drupalrobots.txt.dist → robots.txtUsa el archivo plano enviado con tu versión exacta de Joomla como la fuente actual de la plataforma. No importes una lista de rutas de una versión anterior o de otro sitio web.
Archivo principal de Joomlatemplates/robots.txt.liquidShopify ya ofrece un predeterminado orientado a SEO. Personaliza la plantilla Liquid solo cuando sea necesario; reemplazar el archivo generado completo puede eliminar futuras actualizaciones de la plataforma.
Guía de Shopifyapp/robots.tsUsa la convención MetadataRoute.Robots para salida estática o dinámica tipada, o añade app/robots.txt para un archivo estático plano.
Referencia de robots de Next.jspublic root or explicit /robots.txt routeEstos marcos no implican un conjunto universal de reglas SEO. Sirve el texto generado desde la raíz pública o una ruta de texto/plano y prueba el host de producción.
Elige acceso de IA por propósito
La visibilidad de búsqueda, el desarrollo de modelos y la recuperación solicitada por el usuario son decisiones diferentes. Los nombres de proveedores y políticas pueden cambiar, así que revisa la fuente vinculada antes de publicar.
OAI-SearchBot, Claude-SearchBot, PerplexityBotBloquear estos puede reducir el descubrimiento, fragmentos, citas o calidad de resultados de búsqueda en los productos de IA correspondientes.
GPTBot, ClaudeBot, Google-ExtendedEstos controles nombrados se relacionan con el posible entrenamiento de modelos, mejora de modelos o fundamentación de Gemini. Google-Extended no afecta la inclusión o clasificación en Google Search.
Una regla de user-agent no es verificación de identidad, control de acceso o una opción universal de exclusión. Revisa la documentación del proveedor y valida el tráfico real por separado.
Usa el control adecuado para el trabajo
robots.txt es una preferencia de rastreo, no control de acceso o un comando de indexación garantizado.
Buenos usos
- Reduce el rastreo de filtros duplicados, carritos y caminos de utilidad de bajo valor.
- Expón una o más URLs absolutas de sitemap.
- Crea reglas específicas para rastreadores que se identifican y respetan el protocolo.
No garantizado por robots.txt
- Manteniendo contenido sensible privado - usa autenticación y autorización.
- Eliminar una URL de la búsqueda - usa una respuesta no indexable noindex, flujo de trabajo de eliminación o control de acceso según corresponda.
- Forzar a cada rastreador o sistema de IA a cumplir - el protocolo es asesor.
Generado no es lo mismo que en vivo
Un borrador correcto aún puede ser subido al host equivocado, almacenado en caché, redirigido o servido con un error. Después de publicar, obtén el archivo real, verifica su estado HTTP y confirma que las directivas del Sitemap se resuelven.
Robots.txt Generator FAQ
¿Qué hace robots.txt?
robots.txt indica a los rastreadores compatibles qué rutas de URL pueden solicitar en un esquema, host y puerto específicos. Gestiona el rastreo; no es autenticación y no garantiza que una URL descubierta se mantenga fuera de un índice.
¿Dónde debe colocarse robots.txt?
Colócalo en la raíz del host exacto, por ejemplo https://example.com/robots.txt. Un archivo en una subcarpeta no controla todo el host, y las reglas no se transfieren automáticamente entre subdominios.
¿robots.txt previene la indexación de Google?
No. Una URL bloqueada aún puede ser descubierta a partir de enlaces y puede aparecer sin un fragmento. Usa una directiva noindex apropiada cuando necesites control de indexación, y no bloquees al rastreador de leer esa directiva.
¿Google soporta Crawl-delay?
No. Google documenta Agente de usuario, Permitir, Denegar y Sitemap como campos soportados de robots.txt y no soporta Crawl-delay, por lo que este generador intencionalmente no lo agrega.
¿Qué regla gana cuando ambas, Permitir y No permitir, coinciden?
La ruta de coincidencia más específica gana. Si una regla de Permitir y una de No permitir son equivalentes, la de Permitir debe ganar. La coincidencia es sensible a mayúsculas y minúsculas.
¿Puedo agregar un sitemap a robots.txt?
Sí. Agrega una o más URLs de sitemap HTTP o HTTPS completas. El valor del Sitemap debe ser absoluto y puede apuntar a un host diferente.
¿Puede robots.txt bloquear rastreadores de IA?
Puedes dirigirte a un rastreador que se identifica con un token de producto, pero solo los rastreadores que reconocen y respetan el Protocolo de Exclusión de Robots cumplirán. No trates el archivo como una garantía contra el acceso, entrenamiento o reutilización.
¿Qué rastreadores de IA debería permitir o bloquear?
Decide por propósito. OAI-SearchBot, Claude-SearchBot y PerplexityBot apoyan el descubrimiento de búsqueda o citas; GPTBot, ClaudeBot y Google-Extended proporcionan controles separados relacionados con el desarrollo de modelos o la fundamentación de Gemini. Las políticas cambian, así que verifica la documentación actual de cada proveedor antes de publicar.
¿Debería reemplazar el robots.txt predeterminado en WordPress, Drupal, Joomla o Shopify?
Generalmente no. Comienza desde el archivo o salida virtual mantenida por la versión de plataforma instalada, luego añade solo cambios específicos del proyecto verificados. Shopify recomienda preservar sus predeterminados de Liquid generados, mientras que Drupal Composer Scaffold puede gestionar y actualizar el archivo raíz.
¿Mis datos están subidos en alguna parte?
No. Este generador se ejecuta completamente del lado del cliente en tu navegador. Nada de lo que escribas se envía a un servidor, por lo que es seguro usarlo en contenido privado.
¿Es realmente gratis?
Sí, sin cuenta. Un espacio de trabajo de Novaverb solo es necesario cuando deseas verificar, monitorear y rastrear estos archivos en tu sitio en vivo a lo largo del tiempo.