# Primero el contenido adjunto. User-Agent: * Allow: /wordpress/wp-content/uploads/ Disallow: /wordpress/wp-content/plugins/ Disallow: /wordpress/wp-content/themes/ Disallow: /wordpress/wp-includes/ Disallow: /wordpress/wp-admin/ Disallow: /gallery2 # También podemos desindexar todo lo que empiece # por wp-. Es lo mismo que los Disallow de arriba pero # incluye cosas como wp-rss.php Disallow: /wordpress/wp- # # Sitemap permitido, búsquedas no. # Sitemap: http://www.carballada.com/wordpress/sitemap.xml Disallow: /wordpress/?s= Disallow: /wordpress/search # # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que sólo # sirven como Trackback URI (y son contenido duplicado). # Allow: /wordpress/feed/$ Disallow: /wordpress/feed Disallow: /wordpress/comments/feed Disallow: /wordpress/*/feed/$ Disallow: /wordpress/*/feed/rss/$ Disallow: /wordpress/*/trackback/$ Disallow: /wordpress/*/*/feed/$ Disallow: /wordpress/*/*/feed/rss/$ Disallow: /wordpress/*/*/trackback/$ Disallow: /wordpress/*/*/*/feed/$ Disallow: /wordpress/*/*/*/feed/rss/$ Disallow: /wordpress/*/*/*/trackback/$ # # A partir de aquí es opcional pero recomendado. # # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # Añadir al gusto del consumidor... User-agent: MSIECrawler Disallow: / User-agent: WebCopier Disallow: / User-agent: HTTrack Disallow: / User-agent: Microsoft.URL.Control Disallow: / User-agent: libwww Disallow: / # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y podéis dejarlo bajo e ir # subiendo hasta el punto óptimo. # User-agent: noxtrumbot Disallow: / ##Crawl-delay: 50 User-agent: msnbot Disallow: / User-agent: Slurp Disallow: /