Controla qué páginas rastrean los buscadores. Configura reglas para Google, Bing, AI crawlers y más. Presets para WordPress, Shopify y tiendas online.
Presets rápidos
Permitir todos los bots
Indexación completa (recomendado por defecto)
Bloquear todos los bots
Útil para sitios en staging o desarrollo
Bloquear bots AI (GPTBot, CCBot, etc.)
Protege tu contenido de crawlers de IA
# Selecciona opciones para generar robots.txt
tudominio.com/robots.txtTodo lo que necesitas saber para controlar cómo los buscadores rastrean tu sitio.
El archivo robots.txt implementa el Robots Exclusion Protocol, un estándar de 1994 adoptado por todos los buscadores respetables. Es un archivo de texto plano que le indica a los bots rastreadores (Googlebot, Bingbot, etc.) qué páginas pueden visitar y cuáles deben ignorar.
A diferencia de la etiqueta noindex, robots.txt actúa antes de que el bot llegue a la página, si está bloqueada, el bot ni siquiera intenta visitarla. Esto es útil para proteger áreas de administración, páginas de staging o secciones que consumen mucho crawl budget.
En 2024-2025, robots.txt se ha vuelto más relevante que nunca gracias a los AI crawlers de OpenAI (GPTBot), Anthropic (Claude-Web), Google (Google-Extended) y otros, que también respetan este protocolo.
Configura las reglas usando los controles de arriba y haz clic en Descargar para obtener el archivo robots.txt listo para usar.
public_htmlrobots.txtAbre tu navegador y visita https://tudominio.com/robots.txt. Debe mostrarse el contenido del archivo como texto plano. Si ves un error 404, el archivo no está en la carpeta correcta.
Ve a Google Search Console → Configuración → Robots.txt. Ahí puedes ver el archivo que Google tiene almacenado en caché y probar URLs específicas para verificar si están bloqueadas o permitidas.
Añade esta línea al final de tu robots.txt: Sitemap: https://tudominio.com/sitemap.xml. Todos los buscadores la leerán automáticamente para encontrar tu mapa del sitio.
Proteger áreas privadas
Bloquea /admin/, /dashboard/, /login/ para evitar que aparezcan en Google y ahorrar crawl budget.
Optimizar crawl budget
En sitios grandes, bloquea páginas de paginación y filtros de búsqueda para que Google indexe lo que importa.
Bloquear AI crawlers
Impide que GPTBot, Claude-Web y otros bots de IA usen tu contenido para entrenar sus modelos.
Entornos de staging
Bloquea todo tu sitio de prueba con Disallow: / para evitar que Google indexe versiones en desarrollo.
¿Dónde va el robots.txt?
📁 public_html/
📄 robots.txt ← aquí
📄 index.php
📄 sitemap.xml
📄 .htaccess
📁 wp-content/
El robots.txt siempre debe estar en la raíz del dominio. Los buscadores lo buscan exclusivamente en tudominio.com/robots.txt, no en subdirectorios.
Error crítico a evitar
Nunca pongas esto en tu robots.txt de producción:
User-agent: *
Disallow: /
Esto bloquea todo el sitio y Google dejará de indexar todas tus páginas.
Tip: AI crawlers 2025
Para bloquear los bots de IA más importantes, agrega al inicio de tu robots.txt:
User-agent: GPTBot
Disallow: /
User-agent: Claude-Web
Disallow: /
User-agent: Google-Extended
Disallow: /
Las dudas más comunes sobre indexación y rastreo