EN
navegar Enter abrir Esc cerrar
SEO & Control de Rastreo

Generador de robots.txt

Crea y descarga un archivo robots.txt compatible con RFC 9309 con directivas Allow/Disallow personalizadas, referencias a sitemaps y presets de CMS.

El archivo robots.txt se genera localmente en su navegador. Las reglas e inputs no se suben ni almacenan en nuestros servidores.
Revisión Técnica de Estándar · Última revisión: 27 de agosto de 2026
Configuración General de Rastreo
Cuidado al bloquear CSS y JavaScript

Google utiliza recursos CSS y JavaScript para renderizar y comprender correctamente muchas páginas. Evita bloquear con robots.txt los recursos que sean necesarios para mostrar el contenido indexable. Reglas amplias como Disallow: /assets/, /css/ o /js/ pueden impedir que Googlebot acceda a recursos necesarios y afectar a cómo Google interpreta o posiciona la página.

Bloquea únicamente los recursos cuyo rastreo realmente quieras impedir y comprueba el resultado con las herramientas de inspección de Google Search Console.

Nota: Ignorado por Google y por Yandex (buscador principal). Soportado por Bingbot, AhrefsBot y SemrushBot.
Vista previa de robots.txt
0 bytes UTF-8 text/plain

Guía Técnica de robots.txt y Estándar RFC 9309

El archivo robots.txt es un documento de texto plano ubicado en la raíz de un dominio (ejemplo: https://tusitio.com/robots.txt) que indica a los rastreadores web qué áreas del sitio web deben o no deben explorar. En 2022, la IETF formalizó esta especificación mediante el estándar RFC 9309 (Robots Exclusion Protocol), unificando las reglas de directivas, precedencia y coincidencia de rutas.

1. Rastreo frente a Indexación: Una distinción crítica

Uno de los errores más frecuentes en SEO técnico es confundir el rastreo con la indexación. Una regla Disallow impide que los motores de búsqueda descarguen o rastreen una URL. Sin embargo, si esa URL recibe enlaces externos o internos, Google puede llegar a indexar la URL sin leer su contenido. Para evitar que una página aparezca en los resultados de búsqueda, debe permitir que Googlebot la rastree y responder con la etiqueta <meta name="robots" content="noindex"> o la cabecera HTTP X-Robots-Tag: noindex. Google no admite directivas Noindex: dentro de robots.txt (retiradas oficialmente en 2019).

2. Precedencia de directivas y coincidencia de rutas (RFC 9309 §2.2.2)

Bajo el estándar RFC 9309, los rastreadores evalúan la longitud de los patrones que coinciden con la URL solicitada. La regla con el patrón coincidente más largo es la que se aplica. En caso de empate exacto de longitud entre una regla Allow y una regla Disallow, la directiva Allow tiene prioridad.

3. Realidad de Crawl-delay: Google e Yandex frente a otros buscadores

La directiva Crawl-delay no forma parte del núcleo de RFC 9309. Google ignora completamente Crawl-delay en robots.txt (la velocidad de Googlebot se gestiona algorítmicamente o en Search Console). Asimismo, Yandex ignora Crawl-delay para su buscador principal desde febrero de 2018 (se configura en Yandex Webmaster). No obstante, motores como Bingbot y herramientas como AhrefsBot o SemrushBot sí reconocen y aplican Crawl-delay para limitar la frecuencia de rastreo.

4. robots.txt NO es un mecanismo de seguridad ni control de acceso

robots.txt es un protocolo voluntario para rastreadores legítimos y es de acceso público universal. Nunca liste carpetas confidenciales o rutas secretas en robots.txt, ya que los atacantes revisan este archivo específicamente para descubrir endpoints privados. Para proteger áreas sensibles, utilice autenticación de servidor (HTTP Auth, sesiones, tokens o cortafuegos), no directivas de rastreo.

Preguntas Frecuentes sobre robots.txt

robots.txt es un archivo de texto plano regulado por el estándar RFC 9309. Debe servirse obligatoriamente en la raíz del dominio (ejemplo: https://tusitio.com/robots.txt). Los archivos colocados en subcarpetas no tienen validez para el host.

Compartir esta herramienta

Ayuda a otras personas compartiendo esta herramienta gratuita.