# BEGIN XML-SITEMAP-PLUGIN Sitemap: http://www.viciao2k3.net/blog/sitemap.xml.gz # END XML-SITEMAP-PLUGIN User-agent: Mediapartners-Google Allow: /* User-agent: Googlebot-Image Disallow: /* User-agent: * Disallow: /blog/?s= Disallow: /blog/search Disallow: /blog/wp-admin/ Disallow: /blog/wp-includes/ Disallow: /blog/author/ Disallow: /blog/archives/ Disallow: /blog/trackback/ Disallow: /blog/feed/ Disallow: /blog/salta.php Disallow: /blog/wp- # sigt # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que sólo # sirven como Trackback URI (y son contenido duplicado). Allow: /blog/feed/$ Disallow: /blog/feed Disallow: /blog/comments/feed Disallow: /blog/*/feed/$ Disallow: /blog/*/feed/rss/$ Disallow: /blog/*/trackback/$ Disallow: /blog/*/*/feed/$ Disallow: /blog/*/*/feed/rss/$ Disallow: /blog/*/*/trackback/$ Disallow: /blog/*/*/*/feed/$ Disallow: /blog/*/*/*/feed/rss/$ Disallow: /blog/*/*/*/trackback/$ # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # Añadir al gusto del consumidor... User-agent: MSIECrawler Disallow: / User-agent: WebCopier Disallow: / User-agent: HTTrack Disallow: / User-agent: Microsoft.URL.Control Disallow: / User-agent: libwww Disallow: / # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y podéis dejarlo bajo e ir # subiendo hasta el punto óptimo. # User-agent: noxtrumbot Crawl-delay: 50 User-agent: msnbot Crawl-delay: 30 User-agent: Slurp Crawl-delay: 10