CrawlerPulse
CrawlerPulse / Asia / Japan / zdnet.com

zdnet.com

zdnet.com · Japan · measured 8 Oct 2026

Google Search
Allowed
Google-Extended
Allowed
OpenAI
Blocked
Anthropic
Blocked
Perplexity
Blocked
Meta
Blocked
Common Crawl
Blocked
ByteDance
Blocked
Apple
Blocked
Amazon
Blocked

robots.txt

As read on 8 Oct 2026, 5,816 bytes. 2 rule groups name AI crawlers; shown first.

user-agent: AddSearchBot
user-agent: AI2Bot
user-agent: Ai2Bot-DeepResearchEval
user-agent: Ai2Bot-Dolma
user-agent: AIWebIndex
user-agent: amazon-QBusiness
user-agent: Amazonbot
user-agent: AmazonBuyForMe
user-agent: Amzn-SearchBot
user-agent: Amzn-User
user-agent: Anchor Browser
user-agent: anthropic-ai
user-agent: ApifyBot
user-agent: ApifyWebsiteContentCrawler
user-agent: Applebot
user-agent: Applebot-extended
user-agent: atlassian-bot
user-agent: AutoRAG
user-agent: AwarioSmartBot
user-agent: AzureAI-SearchBot
user-agent: Big Sur AI
user-agent: bigsur.ai
user-agent: Brandwatch
user-agent: Bravebot
user-agent: Brightbot
user-agent: Bytespider
user-agent: CCBot
user-agent: Channel3Bot
user-agent: ChatGLM-Spider
user-agent: ChatGPT-User
user-agent: Claude-Code
user-agent: Claude-SearchBot
user-agent: Claude-User
user-agent: Claude-Web
user-agent: ClaudeBot
user-agent: Code
user-agent: cohere-ai
user-agent: cohere-training-data-crawler
user-agent: Cotoyogi
user-agent: Crawl4AI
user-agent: Cursor
user-agent: Datenbank Crawler
user-agent: Datenbank-Crawler
user-agent: DeepSeekBot
user-agent: Devin
user-agent: Diffbot
user-agent: Direqt Anomura
user-agent: DuckAssistBot
user-agent: Echobot Bot
user-agent: ExaBot
user-agent: FacebookBot
user-agent: Factset_spyderbot
user-agent: FirecrawlAgent
user-agent: GeistHaus-PageFetcher
user-agent: GPTBot
user-agent: iAsk
user-agent: iAskBot
user-agent: iaskspider
user-agent: ICC Crawler
user-agent: ICC-Crawler
user-agent: ImageSiftBot
user-agent: imageSpider
user-agent: kagi-fetcher
user-agent: Kangaroo Bot
user-agent: Kangaroo-Bot
user-agent: Kimi-User
user-agent: KlaviyoAIBot
user-agent: Kunato
user-agent: laion-huggingface-processor
user-agent: LCC
user-agent: LINER Bot
user-agent: LinerBot
user-agent: LinkupBot
user-agent: Manus-User
user-agent: meta-externalagent
user-agent: meta-externalfetcher
user-agent: meta-webindexer
user-agent: mistral.ai
user-agent: MistralAI-User
user-agent: netEstate Imprint Crawler
user-agent: NovaAct
user-agent: Novellum
user-agent: Novellum AI Crawl
user-agent: OAI-SearchBot
user-agent: omgili
user-agent: opencode
user-agent: PanguBot
user-agent: PeopleInc-DCipher-Scraper/1.1.0
user-agent: Perplexity-User
user-agent: PerplexityBot
user-agent: PetalBot
user-agent: PhindBot
user-agent: Poggio-Citations
user-agent: QualifiedBot
user-agent: SBIntuitionsBot
user-agent: SeekrBot
user-agent: SemrushBot-OCOB
user-agent: SemrushBotSwa
user-agent: Shap-User
user-agent: ShapBot
user-agent: Spider
user-agent: TavilyBot
user-agent: TerraCotta
user-agent: Timpibot
user-agent: TongyiBot
user-agent: Trae
user-agent: TwinAgent
user-agent: UseAI
user-agent: Velen Crawler
user-agent: VelenPublicWebCrawler
user-agent: Webzio-Extended
user-agent: Wrtn
user-agent: YiyanBot
user-agent: YouBot
user-agent: ZanistaBot
Allow: /article/how-ai-companies-are-secretly-collecting-training-data-from-the-web-and-why-it-matters/
Allow: /article/how-proxy-servers-actually-work-and-why-theyre-so-valuable/
Allow: /article/how-to-print-checks-in-quickbooks-online/
Allow: /article/how-to-remove-your-personal-information-from-whitepages-in-5-steps-and-why-you-should/
Allow: /article/how-to-undo-a-reconciliation-in-quickbooks-online-the-easy-way/
Allow: /article/i-found-the-easiest-way-to-delete-myself-from-the-internet-and-why-you-shouldnt-wait-to-use-it-too/
Allow: /article/incogni-vs-deleteme/
Allow: /article/this-proxy-provider-i-tested-is-the-best-for-web-scraping-and-its-not-iproyal-or-marsproxies/
Allow: /article/xero-vs-quickbooks/
Disallow: /

User-agent: "008"
User-agent: AwarioRssBot
User-agent: AwarioSmartBot
User-agent: DDM-DCipher/1.0.7
User-agent: HTTrack
User-agent: Magpie-crawler
User-agent: Nutch
User-agent: Offline Explorer
User-agent: Omgilibot
User-agent: Peer39_crawler/1.0
User-agent: Scrapy
Disallow: /
Sitemap: https://www.zdnet.com/sitemap-authors.xml
Sitemap: https://www.zdnet.com/sitemap-google-news.xml
Sitemap: https://www.zdnet.com/sitemaps/articles/index.xml
Sitemap: https://www.zdnet.com/sitemaps/best/index.xml
Sitemap: https://www.zdnet.com/sitemaps/categories/index.xml
Sitemap: https://www.zdnet.com/sitemaps/deals/index.xml
Sitemap: https://www.zdnet.com/sitemaps/galleries/index.xml
Sitemap: https://www.zdnet.com/sitemaps/how-to/index.xml
Sitemap: https://www.zdnet.com/sitemaps/news/index.xml
Sitemap: https://www.zdnet.com/sitemaps/reviews/index.xml
Sitemap: https://www.zdnet.com/sitemaps/video/index.xml

User-agent: *
Disallow: /user/*
Disallow: /members/
Disallow: /members/newsletters/
Disallow: /members/alerts/add/
Disallow: /search/
Disallow: *Xhr*
Disallow: */xhr*
Disallow: */ajax/*
Disallow: */fly/*/bundles/flyjs/*
Disallow: */libs/*
Disallow: */version!libs/*
Disallow: /.well-known/*
Disallow: /index.php/*
Disallow: *?beta=*
Disallow: *?ftag=*

User-agent: msnbot
Crawl-delay: 1

History

Changes recorded since June 2026.

No change recorded.

In context

Japan
32.2% block at least one AI crawler
Behind Cloudflare
No