User-Agent: * Allow: /wp-content/uploads/ Disallow: /wp-content/plugins/ Disallow: /wp-content/themes/ Disallow: /wp-includes/ Disallow: /wp-admin/ # También podemos desindexar todo lo que empiece # por wp-. Es lo mismo que los Disallow de arriba pero # incluye cosas como wp-rss.php Disallow: /wp- # # Sitemap permitido, búsquedas no. # Sitemap: http://www.argentinaconcierge.com/sitemap.xml Disallow: /?s= Disallow: /search # # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que sólo # sirven como Trackback URI (y son contenido duplicado). # Allow: /feed/$ Disallow: /feed Disallow: /comments/feed Disallow: /*/feed/$ Disallow: /*/feed/rss/$ Disallow: /*/trackback/$ Disallow: /*/*/feed/$ Disallow: /*/*/feed/rss/$ Disallow: /*/*/trackback/$ Disallow: /*/*/*/feed/$ Disallow: /*/*/*/feed/rss/$ Disallow: /*/*/*/trackback/$ # # A partir de aquí es opcional pero recomendado. # # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # Añadir al gusto del consumidor... user-Agent: * Allow: user-Agent: Slurp Disallow: /cgi-bin/ user-Agent: ArchitextSpider Disallow: /cgi-bin/ user-Agent: Scooter Disallow: /cgi-bin/ user-Agent: Lycos_Spider_(T-Rex) Disallow: /cgi-bin/ user-Agent: Googlebot Disallow: /cgi-bin/ user-Agent: FAST-WebCrawler/ Disallow: /cgi-bin/ user-agent: msnbot Disallow: /cgi-bin/ user-agent: Adsbot-Google Disallow: /cgi-bin/ user-agent: Googlebot-Image Disallow: /cgi-bin/ User-Agent: Mediapartners-Google Disallow: /cgi-bin/