# # robots.txt para tu blog en WordPress. # # Usar bajo propia responsabilidad, que nos conocemos }:) # http://sigt.net/archivo/robotstxt-para-wordpress.xhtml y otros # # Primero el contenido adjunto. User-Agent: * Allow: / # Disallow: /cgi-bin/ # Sitemap permitido, búsquedas no. # Sitemap: http://gejocastro.mine.nu/sitemap.xml # # A partir de aquí es opcional pero recomendado. # # Activa la posibilidad de que el Bot de Google Indexe User-agent: Googlebot Disallow: /*.css$ Disallow: /*.gz$ # Disallow: /*.cgi$ Disallow: /*.wmv$ Disallow: /*.png$ Disallow: /*.gif$ Disallow: /*.jpg$ # Disallow: /*.cgi$ Disallow: /*.xhtml$ # Disallow: /*.php* Disallow: */trackback* Disallow: /*?* Disallow: /z/ Disallow: /wp-* Disallow: /drupal5 Disallow:/wiki/* Allow: / # Activa el Bot de Imágenes de Google User-agent: Googlebot-Image # Este es el Bot de publicidad de Google User-agent: Mediapartners-Google* Allow: / Allow: /*.php$ Allow: /*.js$ Allow: /*.inc$ Allow: /*.css$ Allow: /*.gz$ Allow: /*.cgi$ Allow: /*.wmv$ Allow: /*.cgi$ Allow: /*.xhtml$ Allow: /*.php* Allow: /*.gif$ Allow: /*.jpg$ Allow: /*.png$ # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # Añadir al gusto del consumidor... User-agent: MSIECrawler Disallow: / User-agent: WebCopier Disallow: / User-agent: HTTrack Disallow: / User-agent: Microsoft.URL.Control Disallow: / User-agent: libwww Disallow: / User-agent: duggmirror Disallow: / User-agent: ia_archiver Disallow: / # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y podéis dejarlo bajo e ir # subiendo hasta el punto óptimo. # User-agent: noxtrumbot Crawl-delay: 50 User-agent: msnbot Crawl-delay: 30 User-agent: Slurp Crawl-delay: 10 # Agents amb restricción total (Robot de spam) User-Agent: Morfeus Fucking Scanner User-Agent: Morfeus User-Agent: Morfeus* User-Agent: libwww-perl Disallow: /