CrawlerPulse
CrawlerPulse / Europe / Germany / allgemeine-zeitung.de

Allgemeine Zeitung

allgemeine-zeitung.de · Germany · VRM GmbH & Co. KG · measured 8 Oct 2026

Google Search
Allowed
Google-Extended
Blocked
OpenAI
Blocked
Anthropic
Blocked
Perplexity
Blocked
Meta
Blocked
Common Crawl
Blocked
ByteDance
Blocked
Apple
Blocked
Amazon
Blocked

robots.txt

As read on 8 Oct 2026, 5,040 bytes. 8 rule groups name AI crawlers; shown first.

User-agent: SemrushBot
User-agent: AhrefsBot
User-agent: ai2bot
User-agent: Amazonbot
User-agent: anthropic-ai
User-agent: Applebot
User-agent: Applebot-Extended
User-agent: arquivo-web-crawler
User-agent: arquivo.pt
User-agent: AwarioRssBot
User-agent: AwarioSmartBot
User-agent: BacklinkCrawler
User-agent: Baiduspider
User-agent: Barkrowler
User-agent: Beloud
User-agent: BLEXBot
User-agent: Bloodhound
User-agent: browsertrix
User-agent: brozzler
User-agent: BuiltWith
User-agent: Bytespider
User-agent: captify-crawler
User-agent: ChatGPT-User
User-agent: CCBot
User-agent: Cincraw
User-agent: claudebot
User-agent: claude-web
User-agent: claude-user
User-agent: Cliqzbot
User-agent: cohere-ai
User-agent: cohere-training-data-crawler
User-agent: coccocbot
User-agent: contao/crawler
User-agent: crawlspace
User-agent: CriteoBot
User-agent: cydralspider
User-agent: DataForSeoBot
User-agent: DeepSeek
User-agent: DeepSeekBot
User-agent: Diffbot
User-agent: Dmbot
User-agent: DomainStatsBot
User-agent: downloadexpress
User-agent: dotbot
User-agent: duckassistbot
User-agent: Fasterfox
User-agent: FacebookBot
User-agent: Flamingo_SearchEngine
User-agent: fluid
User-agent: FriendlyCrawler
User-agent: gammaSpider
User-agent: gemini-deep-research
User-agent: Google-Extended
User-agent: grokbot
User-agent: GumGum-Bot
User-agent: HappyWing
User-agent: HaosouSpider
User-agent: harsilbot
User-agent: hatena-antenna
User-agent: Heritrix
User-agent: iaskspider
User-agent: ia_archiver
User-agent: ImagesiftBot
User-agent: img2dataset
User-agent: kangaroo bot
User-agent: kazbtbot
User-agent: klaviyoaibot
User-agent: KrakeN
User-agent: LCC
User-agent: LieBaoFast
User-agent: linkdebot
User-agent: LinkChecker
User-agent: linkfluence-yak-bot
User-agent: Majestic
User-agent: Majestic12
User-agent: mail.RU_Bot
User-agent: Mediatoolkitbot
User-agent: Meltwater
User-agent: MetaJobBot
User-agent: meta-externalagent
User-agent: mistralai-crawler
User-agent: MJ12bot
User-agent: Monsidobot
User-agent: mpbot
User-agent: netEstate
User-agent: newsgrab.de
User-agent: NewsNow
User-agent: OGDWCtcxCrawler
User-agent: omgili
User-agent: omgilibot
User-agent: OnPageBot
User-agent: OpenindexSpider
User-agent: panscient.com
User-agent: Paqlebot
User-agent: peer39_crawler
User-agent: peer39_crawler/1.0
User-agent: PerplexityBot
User-agent: Perplexity‑User
User-agent: PetalBot
User-agent: Pimptrain
User-agent: Raven
User-agent: relemindbot
User-agent: ResearchBot
User-agent: Riddler
User-agent: Rogerbot
User-agent: RyteBot
User-agent: scrapy
User-agent: SearchmetricsBot
User-agent: SeznamBot
User-agent: SemrushBot
User-agent: SemrushBot-SA
User-agent: Semrushbot-SI
User-agent: SEOdiver
User-agent: Seobility
User-agent: SeekportBot
User-agent: SEOkicks
User-agent: SEOkicks-Robot
User-agent: Semanticbot
User-agent: SemanticScholarBot
User-agent: SentiBot
User-agent: sidetrade indexer bot
User-agent: SiteAuditBot
User-agent: SirdataBot
User-agent: sogou-spider
User-agent: spbot
User-agent: special_archiver
User-agent: SplitSignalBot
User-agent: Tag-Crawler
User-agent: Testcrawler
User-agent: thinkers-bot
User-agent: Timpibot
User-agent: Toplistbot
User-agent: trendictionbot
User-agent: TurnitinBot
User-agent: uipbot/1.0
User-agent: UptimeRobot
User-agent: urlsuma
User-agent: velenpublicwebcrawler
User-agent: Verity
User-agent: VsuSearchSpider
User-agent: WebZinger
User-agent: webzio-extended
User-agent: weborama-fetcher
User-agent: wiseguys-robot
User-agent: wpbot
User-agent: xovi
User-agent: Yandex
User-agent: Yeti
User-agent: YouBot
Disallow: /

User-agent: ChatGPT-User
Disallow: /

User-agent: GPTBot
Disallow: /

User-agent: CCBot
Disallow: /

User-agent: Google-Extended
Disallow: /

User-agent: FacebookBot
Disallow: /

User-agent: omgilibot
Disallow: /

User-agent: omgili
Disallow: /

User-agent: *
Disallow: /*?egy_cid=*

User-agent: *
Disallow: /*?gallery=*

User-agent: *
Disallow: /*?elementId=*

User-agent: *
Disallow: /api/
Disallow: /archive/
Disallow: /archiv/
Disallow: /na/
Disallow: /service/profil/
Disallow: /aidapreview/
Sitemap: https://www.allgemeine-zeitung.de/index-sitemap.xml
Sitemap: https://www.allgemeine-zeitung.de/sitemaps/news-sitemap.xml

History

Changes recorded since June 2026.

No change recorded.

In context

Germany
71.7% block at least one AI crawler
Behind Cloudflare
No
Same group