Crawler access (robots.txt)
2/2 · pass8 of 8 AI crawlers may read the site, 0 disallowed
- GET /robots.txt -> HTTP 200, 439 B, 1 user-agent group
- Allowed: GPTBot (via *) (11 path rules), ClaudeBot (via *) (11 path rules), OAI-SearchBot (via *) (11 path rules), PerplexityBot (via *) (11 path rules), Google-Extended (via *) (11 path rules), Amazonbot (via *) (11 path rules), CCBot (via *) (11 path rules), Bytespider (via *) (11 path rules)
- Sitemap declared: https://www.clarin.com/sitemaps/index.xml, https://www.clarin.com/sitemaps/index_services.xml, https://www.clarin.com/sitemaps/sitemap_google_news.xml
Fix: Nothing to fix here.