Crawl-Budget optimieren: Wann es relevant ist und welche Maßnahmen helfen

Crawl-Budget beschreibt vereinfacht, welche URLs ein Crawler auf einer Website abrufen kann und abrufen möchte. Für die meisten kleinen Unternehmenswebsites ist es kein akutes Optimierungsproblem. Google richtet seine aktuelle Anleitung vor allem an sehr große, sehr schnell wechselnde Sites oder Angebote mit vielen als „gefunden, derzeit nicht indexiert“ gemeldeten URLs. Dort können unendliche Filterkombinationen, Duplikate und langsame Server wichtige Seiten ausbremsen. Die Lösung beginnt mit Diagnose, nicht mit pauschalem Blockieren.

Artikel lesen Thema besprechen
Suchmaschinen-Crawler priorisiert wichtige Seiten einer sehr großen Website
8 Kapitel4 AntwortenPraxisleitfaden
01
Kapitel 1

Erst prüfen, ob wirklich ein Crawl-Problem besteht

Wenn neue oder aktualisierte Seiten zeitnah gecrawlt werden und die Website überschaubar ist, reichen meist eine aktuelle Sitemap und die Kontrolle des Indexierungsberichts. Fehlende Rankings sind nicht automatisch ein Crawl-Budget-Problem. Inhaltliche Qualität, Nachfrage oder Indexierung können andere Ursachen sein.

Relevant wird die Analyse bei Millionen URLs mit regelmäßigen Änderungen, zehntausenden täglich wechselnden Seiten oder einem hohen Anteil bekannter, aber nicht gecrawlter URLs. Auch große Shops mit facettierter Navigation können betroffen sein.

02
Kapitel 2

Crawling mit mehreren Datenquellen diagnostizieren

Search Console zeigt Crawlingstatistiken und Indexierungsgruppen, aber keine vollständige URL-genaue Historie. Serverlogs helfen zu erkennen, welche Bots welche Pfade wann und mit welchem Status abrufen. Ein technischer Crawl bildet interne Links, Canonicals und Parameter ab.

Verbinden Sie diese Daten mit Veröffentlichungszeitpunkten und Geschäftswert. Entscheidend ist nicht eine möglichst hohe Zahl von Bot-Aufrufen, sondern ob wichtige neue und geänderte Inhalte zuverlässig verarbeitet werden.

03
Kapitel 3

Das indexierbare URL-Inventar begrenzen

Filter, Sortierungen, interne Suchergebnisse, Kalender und Sitzungsparameter können sehr viele URLs erzeugen. Definieren Sie, welche Kombinationen einen eigenständigen Nutzen und Suchbedarf besitzen. Alle übrigen Varianten benötigen eine konsistente technische Behandlung.

Duplikate werden zusammengeführt, weitergeleitet oder mit Canonicals konsolidiert. Dauerhaft entfernte URLs liefern 404 oder 410. Die XML-Sitemap enthält nur kanonische, indexierbare Ziele und ein korrekt gepflegtes Änderungsdatum.

  • Parameter und Filter vollständig inventarisieren
  • Indexierbare Kombinationen fachlich freigeben
  • Soft-404 und Redirectketten beseitigen
  • Nur gewünschte Zielseiten in die Sitemap aufnehmen
04
Kapitel 4

Robots.txt und noindex nicht verwechseln

Robots.txt verhindert das Crawling eines Pfads, entfernt eine bereits bekannte URL aber nicht zuverlässig aus Suchergebnissen. noindex muss vom Crawler abgerufen werden können, damit die Anweisung gesehen wird. Beide Werkzeuge lösen unterschiedliche Aufgaben.

Google weist für große Sites darauf hin, dass noindex-Seiten weiterhin abgerufen werden müssen. Wenn unwichtige, doppelte URL-Räume dauerhaft nicht gecrawlt werden sollen, kann robots.txt Teil des Konzepts sein. Vorher ist zu prüfen, ob wichtige Ressourcen oder Canonical-Ziele betroffen wären.

05
Kapitel 5

Interne Links auf Prioritäten ausrichten

Wichtige Seiten sollten über normale HTML-Links erreichbar sein und nicht nur in Sitemap, JavaScript-Suche oder Formularen auftauchen. Flache, verständliche Themenwege helfen Nutzerinnen und Crawlern. Verwaiste Seiten erhalten kaum interne Signale.

Navigation und Teaser verlinken kanonische URLs ohne unnötige Parameter. Bei mobilen Varianten muss der wichtige Linkbestand erhalten bleiben, weil Google primär die mobile Version verarbeitet.

06
Kapitel 6

Servergesundheit und Ladeeffizienz verbessern

Langsame Antworten, 5xx-Fehler und 429-Rate-Limits können die Crawl-Kapazität senken. Caching, stabile Datenbankabfragen, skalierbare Infrastruktur und kleine Ressourcen helfen Google und Nutzern. Eine schnellere Site führt aber nicht automatisch zur Indexierung schwacher Inhalte.

Überwachen Sie Antwortzeiten nach Seitentyp, nicht nur den Durchschnitt. Große Exporte, Bots anderer Dienste oder fehlerhafte Schleifen können dieselben Ressourcen belasten. Ein Notfalllimit darf wichtige Crawler nicht unkontrolliert aussperren.

07
Kapitel 7

Änderungen kontrolliert testen und messen

Setzen Sie Maßnahmen in abgegrenzten Bereichen um und beobachten Sie Crawling, Indexierung, Serverlast und organische Einstiege. Ein Rückgang unwichtiger Parameteraufrufe ist positiv, wenn wichtige Seiten mindestens genauso zuverlässig verarbeitet werden.

Crawl-Budget-Optimierung ist technische Bestandsführung. Bei großen Shops und Portalen sollte sie gemeinsam mit Entwicklung, SEO und Infrastruktur erfolgen. Ungeprüfte Regeln können ganze Kategorien unsichtbar machen; professionelle Begleitung reduziert dieses Risiko.

08
Kapitel 8

Facettierte Navigation mit einem dauerhaften Regelwerk beherrschen

Bei großen Shops entsteht das URL-Wachstum häufig durch neue Filterwerte. Ein Governance-Dokument legt fest, welche Merkmale URLs erzeugen, welche Kombinationen intern verlinkt werden und welche als kuratierte Landingpages indexierbar sind. Produktteam, Entwicklung und SEO prüfen neue Filter gemeinsam, bevor Millionen zusätzliche Kombinationen entstehen.

Ein regelmäßiger URL-Inventarbericht vergleicht erwartete und tatsächlich entdeckte Muster. Ungewöhnliche Parameter, Kalenderpfade oder leere Kombinationen werden früh untersucht. Diese vorbeugende Kontrolle ist wirksamer als eine hektische robots.txt-Erweiterung, nachdem Crawler die neue URL-Fläche bereits über Wochen erschlossen haben.

Kurz beantwortet

Häufige Fragen

Braucht jede Website Crawl-Budget-Optimierung?

Nein. Für kleine und mittlere Websites ohne verzögerte Crawlingprobleme sind aktuelle Sitemap, gute interne Links und saubere Technik meist ausreichend.

Erhöht robots.txt automatisch das Crawl-Budget?

Nicht automatisch. Blockierungen können unnötige Abrufe reduzieren, verteilen freie Kapazität aber nicht garantiert auf andere Seiten.

Ist Crawling dasselbe wie Indexierung?

Nein. Crawling ist der Abruf einer URL. Anschließend entscheidet die Suchmaschine, ob und in welcher kanonischen Form der Inhalt indexiert wird.

Welche Daten helfen bei der Diagnose?

Crawlingstatistiken und Indexierungsberichte, Serverlogs, technische Crawls, Sitemap-Daten, Statuscodes sowie Zeitpunkte von Veröffentlichungen und Änderungen.

Alle Ratgeber ansehen