Crawler access (robots.txt)
1/2 · warn6 of 8 AI crawlers may read the site, 2 disallowed
- GET /robots.txt -> HTTP 200, 790 B, 11 user-agent groups
- Allowed: GPTBot (via *) (2 path rules), ClaudeBot (via *) (2 path rules), OAI-SearchBot (via *) (2 path rules), PerplexityBot (via *) (2 path rules), Google-Extended (via *) (2 path rules), Amazonbot (via *) (2 path rules)
- Disallowed: CCBot, Bytespider
- Sitemap declared: https://www.iflscience.com/sitemaps/sitemap.xml, https://www.iflscience.com/sitemaps/sitemap-news-1.xml
Fix: Add a group for CCBot, Bytespider with "Allow: /" (or drop the blanket "Disallow: /") if you want answer engines to cite you.