Generador de Robots.txt Gratis

Genera un archivo robots.txt para controlar el rastreo de los motores de búsqueda. Gratis, rápido y funciona totalmente en tu navegador sin registro.

Actualizado

Share:
Leer la guía: How to Create a robots.txt File
Home/SEO Tools/Robots.txt Generator

Robots.txt Generator

Generate a robots.txt file for your website. Control how search engines and AI bots crawl and index your pages with visual rule building, validation, presets, and URL testing.

Valid robots.txt
1 rule(s)
0 AI bot(s) blocked

Quick Presets

Global Settings

Rule 1: *

Not supported by Google. Supported by Bing, Yandex, and others.

/

Generated Output

# robots.txt generated by The Toolbox
# https://seotools.example.com/robots-txt-generator

User-agent: *
Allow: /

Important Notes

  • robots.txt should be placed at the root of your domain (e.g., example.com/robots.txt)
  • robots.txt is a suggestion, not a security measure -- it will not prevent access
  • Use "Disallow: /" to block all crawling, "Disallow:" (empty) to allow all
  • The * wildcard matches any sequence of characters in a path
  • The $ anchor matches the end of URL (e.g. /*.pdf$ blocks only .pdf URLs)
  • Always include your sitemap URL(s) for better indexing
  • Crawl-delay is not supported by Google but is respected by Bing and Yandex
  • Test your robots.txt using Google Search Console's robots.txt Tester
  • Blocking AI bots (GPTBot, CCBot, etc.) does not affect search engine indexing

Privacy First: All generation, validation, and testing happens locally in your browser. No data is sent to any server.

Preguntas Frecuentes

¿Qué es el Generador de Robots.txt?

El Generador de Robots.txt es una herramienta online gratuita que crea archivos robots.txt para controlar cómo los rastreadores de los motores de búsqueda acceden a tu sitio web y lo indexan.

¿Es gratis el Generador de Robots.txt?

Sí, es completamente gratis y no requiere registro. Toda la generación de archivos ocurre del lado del cliente, en tu navegador.

¿Por qué necesito un archivo robots.txt?

Un archivo robots.txt indica a los bots de los motores de búsqueda qué páginas rastrear u omitir, lo que te ayuda a gestionar el presupuesto de rastreo y a evitar la indexación de páginas privadas.

¿Están seguros mis datos con esta herramienta?

Por supuesto. El Generador de Robots.txt procesa todo del lado del cliente, en tu navegador. No se sube ni se almacena ningún dato en ningún servidor. Tu contenido permanece siempre privado en tu dispositivo.

¿Funciona el Generador de Robots.txt en dispositivos móviles?

Sí, el Generador de Robots.txt es totalmente adaptable y funciona en smartphones y tablets. Puedes usarlo en cualquier dispositivo con un navegador web moderno, sin necesidad de descargar ninguna app.

¿Necesito crear una cuenta para usar esta herramienta?

No se necesita cuenta ni registro. Simplemente abre el Generador de Robots.txt en tu navegador y empieza a usarlo de inmediato. No hay muros de registro ni restricciones de uso.

¿Esta herramienta sigue las últimas directrices de Google?

Sí, el Generador de Robots.txt está creado siguiendo las directrices y buenas prácticas actuales de Google Search. Actualizamos la herramienta con regularidad para reflejar los cambios en los requisitos de los motores de búsqueda.

¿Cómo uso el Generador de Robots.txt?

Simplemente introduce tu texto en el campo correspondiente, ajusta las opciones a tu gusto y la herramienta lo procesará al instante. Después puedes copiar el resultado al portapapeles o descargarlo.

¿Qué navegadores son compatibles?

El Generador de Robots.txt funciona en todos los navegadores modernos, incluidos Chrome, Firefox, Safari, Edge y Opera. Para una mejor experiencia, usa la última versión de tu navegador preferido.

¿Cuál es la diferencia entre Allow y Disallow en robots.txt?

Disallow le indica a un rastreador que no solicite las rutas que siguen, mientras que Allow las permite explícitamente, lo cual sirve para abrir un solo archivo o subcarpeta dentro de un directorio que has bloqueado. Por ejemplo, Disallow: /admin/ bloquea la carpeta, y Allow: /admin/public.html deja pasar esa página concreta. Cuando una URL coincide con una regla Allow y con una Disallow, los buscadores no la leen de arriba abajo: gana el patrón coincidente más específico (el más largo), y si dos patrones tienen la misma longitud, gana Allow. Equivocarse con esta prioridad es una forma habitual de bloquear o exponer páginas por accidente. El Probador de URLs de este generador reproduce exactamente esa lógica de coincidencia: introduces una ruta y un user-agent, y te muestra si la URL queda permitida o bloqueada y qué regla lo decide, para que puedas verificarlo antes de publicar.

¿Cómo bloqueo rastreadores de IA como GPTBot y ClaudeBot en robots.txt?

Los rastreadores de IA obedecen robots.txt según su propio nombre de user-agent, de forma independiente a los bots de buscadores, así que bloquear a Googlebot no detiene a GPTBot, y viceversa. Para mantener fuera a un bot, añade un bloque dirigido a su nombre exacto con una línea Disallow: /, por ejemplo User-agent: GPTBot seguido de Disallow: /. El generador tiene una pestaña dedicada de Control de Bots de IA que hace esto por ti: puedes permitir o bloquear cada rastreador individualmente —GPTBot y ChatGPT-User (OpenAI), Google-Extended, ClaudeBot y anthropic-ai (Anthropic), PerplexityBot, CCBot, Bytespider y otros— o bloquearlos todos a la vez sin dejar de permitir que los buscadores normales indexen tus páginas. Recuerda que se trata de un estándar voluntario, así que los rastreadores de IA respetuosos lo cumplen, pero no puede obligar a nadie a acatarlo. Cambia a la pestaña de Control de Bots de IA para activar o desactivar cada uno y ver cómo aparecen las reglas en tu archivo.

¿El robots.txt impide que una página aparezca en los resultados de Google?

No de forma fiable. Disallow le dice a los rastreadores que no obtengan una página, pero no garantiza que la URL quede fuera de los resultados de búsqueda: Google puede seguir indexando una URL bloqueada si otras páginas enlazan a ella, mostrando a veces el enlace sin descripción porque no pudo leer el contenido. Para mantener realmente una página fuera del índice, usa una etiqueta meta noindex o una cabecera X-Robots-Tag en la propia página, y algo crucial: déjala rastreable para que el rastreador pueda ver esa directiva; bloquearla en robots.txt oculta la etiqueta noindex. El robots.txt sirve sobre todo para gestionar el presupuesto de rastreo y alejar a los bots de URLs de bajo valor, no para ocultar datos sensibles, algo que tampoco logra porque los bots maliciosos pueden ignorarlo por completo. Usa este generador para controlar el rastreo y combínalo con etiquetas noindex a nivel de página cuando necesites una eliminación real de los resultados.

¿Dónde debo colocar el archivo robots.txt en mi sitio web?

Un archivo robots.txt debe alojarse en la raíz de un dominio —por ejemplo, https://ejemplo.com/robots.txt— y no en una subcarpeta como /blog/robots.txt, porque los rastreadores solo lo buscan en esa única ubicación raíz. Además, se aplica por host, así que un archivo en la raíz de tu dominio principal no cubre un subdominio: shop.ejemplo.com necesita su propio robots.txt, y las versiones http y https, junto con www y sin www, se tratan cada una como hosts distintos que deben servir el archivo correcto. El archivo es texto plano y debe estar codificado en UTF-8, con el nombre exacto robots.txt en minúsculas. Este generador te permite copiar el archivo terminado al portapapeles o descargarlo como un .txt listo para subir, así que solo tienes que colocarlo en la raíz de tu dominio y confirmar que carga en tusitio.com/robots.txt.

¿Por qué no debería bloquear los archivos CSS y JavaScript en robots.txt?

Los buscadores renderizan tus páginas de forma muy parecida a un navegador, cargando el CSS y el JavaScript que una página necesita para mostrar su diseño y contenido. Si tu robots.txt bloquea las carpetas que contienen esos recursos, el rastreador no puede obtenerlos, así que ve una versión rota o incompleta de la página. Eso puede perjudicar cómo se entiende y se posiciona la página, especialmente en cuanto a la compatibilidad móvil y al contenido que se inyecta mediante scripts. Un error habitual es bloquear un directorio como /assets/ o /wp-includes/ que también contiene archivos imprescindibles para el renderizado. La solución es permitir esos recursos incluso cuando bloqueas los directorios que los rodean: por ejemplo, mantén la carpeta bloqueada pero añade una regla Allow para las rutas .css y .js dentro de ella. Mientras construyes reglas aquí, la validación en vivo señala conflictos y patrones arriesgados, y el Probador de URLs te permite confirmar que los archivos de scripts y estilos clave siguen siendo rastreables antes de publicar.

Sobre el Generador de Robots.txt

El Generador de Robots.txt crea un archivo robots.txt válido para tu sitio web sin que tengas que memorizar la sintaxis. Un archivo robots.txt es un archivo de texto plano que se aloja en la raíz de un dominio —por ejemplo, https://ejemplo.com/robots.txt— e indica a los rastreadores de buscadores y de IA qué partes del sitio pueden solicitar. Esta herramienta convierte eso en un ejercicio visual: añades reglas, eliges los bots a los que se aplican y ves cómo un archivo correctamente formateado se construye solo, en tiempo real. Está pensada para propietarios de sitios, profesionales de SEO y desarrolladores que quieren controlar el rastreo sin editar directivas a mano ni arriesgarse a una errata que bloquee todo el sitio.

Todo se ejecuta en tu navegador. Nada de lo que escribas —rutas, URLs de sitemap o un archivo existente que importes— se sube ni se almacena en ningún servidor, y no hace falta registrarse. Puedes copiar el resultado al portapapeles o descargarlo como archivo .txt, listo para colocar en la raíz de tu dominio.

Cómo construir reglas con el generador visual

El generador funciona por bloques de user-agent. Cada bloque apunta a un rastreador concreto (o a * para todos) y contiene sus propias rutas Allow y Disallow, un Crawl-delay opcional, y puedes añadir tantos bloques como necesite tu sitio. Las rutas más habituales están a un clic de distancia —/admin/, /wp-admin/, /api/, /cart/, /checkout/, /*.pdf$ y más— o puedes escribir rutas personalizadas. También puedes añadir una o varias líneas Sitemap: y una directiva Host:.

Si prefieres partir de una base ya probada, hay preajustes que cubren las configuraciones más habituales: Allow All, Block All, Standard Website, WordPress, Shopify, Next.js, Laravel y E-commerce. Cada preajuste bloquea las rutas privadas y de contenido duplicado típicas de esa plataforma y, cuando corresponde, sugiere la ruta de sitemap adecuada.

Control de los rastreadores de IA

Una pestaña dedicada de control de bots de IA gestiona los rastreadores que recopilan contenido para entrenar modelos de lenguaje y para la búsqueda con IA. Puedes permitir o bloquear cada uno individualmente —GPTBot y ChatGPT-User (OpenAI), Google-Extended, ClaudeBot y anthropic-ai (Anthropic), PerplexityBot, CCBot (Common Crawl), Bytespider y otros— o bloquearlos todos a la vez sin dejar de permitir que los buscadores normales indexen tus páginas. Esto importa porque los rastreadores de IA respetan robots.txt de forma independiente a Googlebot: bloquear a Google no bloquea a GPTBot, y viceversa.

Pruebas y validación antes de publicar

Como un solo carácter fuera de lugar puede desindexar un sitio, el generador revisa tu trabajo mientras lo construyes. La validación en vivo señala errores y advertencias: una ruta a la que le falta la barra inicial /, un sitemap que no es una URL completa, la misma ruta en Allow y Disallow entrando en conflicto, bloques duplicados para un mismo bot, o un crawl-delay tan alto que ralentiza la indexación.

El probador de URLs te deja introducir una ruta y un user-agent para ver si sería permitida o bloqueada, y qué regla lo decide. Sigue la misma lógica de coincidencia real que usan los buscadores: cuando una URL coincide con una regla Allow y otra Disallow, gana el patrón más específico (el más largo), y en caso de empate gana Allow. También puedes probar URLs en lote para revisar una lista de páginas de una sola vez. Además, hay una opción de importación: pega o sube un robots.txt existente y la herramienta lo convierte de nuevo en reglas editables, para que puedas auditar y corregir un archivo real en lugar de reescribirlo desde cero.

Por qué importa el robots.txt

Un robots.txt bien construido mantiene a los rastreadores centrados en las páginas que vale la pena indexar y los aleja de páginas de resultados de búsqueda interna, URLs de navegación por facetas y duplicados por parámetros que desperdician presupuesto de rastreo. Conviene tener presentes algunos datos: el archivo es un estándar voluntario, así que los rastreadores respetuosos lo obedecen, pero los bots maliciosos pueden ignorarlo —nunca lo uses para ocultar datos sensibles—. Debe ubicarse en la raíz del dominio, y un archivo alojado en un subdominio solo se aplica a ese subdominio. Y bloquear el CSS o el JavaScript que una página necesita para renderizarse puede perjudicar cómo la ven los buscadores, así que permite esos recursos incluso cuando bloquees los directorios que los rodean.