Statistik · KI-Crawler-Monitor

Wie viele deutsche Websites blocken KI-Crawler?

Tägliche robots.txt-Messung über die deutschen Top-1000-Websites: welche KI-Bots ausgesperrt werden, wie oft — und was die 20 größten Sites tun. Alle Zahlen kannst du frei zitieren.

Stand: 30. September 2026 · Panel: Deutschland (CrUX Top-1000), 868 Sites erreichbar

30,2 %der Top-Websites sperren GPTBot per robots.txt aus (inkl. Pauschalsperre für alle Bots)
15 / 20der 20 bekanntesten Sites blocken GPTBot
868Websites im täglichen Messpanel
12KI-Crawler werden beobachtet

Blockrate je KI-Crawler

Anteil der erreichbaren Panel-Sites, die den jeweiligen Bot per robots.txt aussperren, ausdrücklich oder per Pauschalsperre (User-agent: *):

CCBot · Common Crawl · Datensatz30,8 %
GPTBot · OpenAI · Training30,2 %
Bytespider · ByteDance · Training28,5 %
ClaudeBot · Anthropic · Training26,6 %
meta-externalagent · Meta · Training23,8 %
Google-Extended · Google · Gemini-Training23,7 %
Applebot-Extended · Apple · Training23,4 %
anthropic-ai · Anthropic · Training (alt)21,4 %
PerplexityBot · Perplexity · Suche20,6 %
Amazonbot · Amazon · Assistent20,4 %
ChatGPT-User · OpenAI · On-Demand18,4 %
OAI-SearchBot · OpenAI · Suche14,4 %

Methode & Einordnung

Gemessen wird täglich die robots.txt der deutschen Top-1000-Websites (CrUX-Panel); von 868 erreichbaren Sites werden die Regeln für 12 bekannte KI-Crawler ausgewertet. Eine Teilmenge wird zusätzlich auf serverseitige Blocks geprüft (z. B. 403 für Bot-User-Agents).

„Geblockt“ heißt hier: Die robots.txt sperrt den Bot ausdrücklich oder per Pauschalsperre für alle Bots (User-agent: *). Serverseitige Blocks zeigt der interaktive Monitor getrennt, sie stecken nicht in diesen Quoten. Sites ohne Regel zählen als nicht geblockt, und robots.txt ist nur eine Bitte, kein technischer Zwang.

Beobachtet seit 3. Juli 2026. Die Zahlen auf dieser Seite stammen aus der Messung zum oben genannten Stand; die tagesaktuelle Messung zeigt der interaktive KI-Crawler-Monitor.