# Wie man verhindert, dass Googlebot sein Crawling auf PrestaShop-Filtern verschwendet

> In Katalogen mit unbehandelten Facetten übersteigt der auf Filter entfallende Crawl-Anteil oft die Hälfte der Anfragen. Wie man ihn in den Serverlogs misst, warum noindex und robots nicht genügen, und die einzuhaltenden Grenzen.

- Seite: <https://www.datafirefly.com/de/2026/09/25/googlebot-crawl-budget-prestashop-filter/>
- Sprache: de
- Veröffentlicht am: 2026-09-25
- Aktualisiert am: 2026-09-25
- Weitere Sprachen: [fr](https://www.datafirefly.com/2026/09/25/crawl-filtres-prestashop-budget-exploration/index.md), [en](https://www.datafirefly.com/en/2026/09/25/googlebot-crawl-waste-prestashop-filters/index.md), [es](https://www.datafirefly.com/es/2026/09/25/googlebot-rastreo-filtros-prestashop/index.md), [it](https://www.datafirefly.com/it/2026/09/25/googlebot-crawl-filtri-prestashop/index.md), [pl](https://www.datafirefly.com/pl/2026/09/25/googlebot-crawl-filtry-prestashop/index.md), [nl](https://www.datafirefly.com/nl/2026/09/25/crawl-filters-prestashop-crawlbudget/index.md)
- Index: <https://www.datafirefly.com/de/2026/llms.txt>

In einem großen Katalog richtet sich ein erheblicher Teil der Bot-Anfragen auf Filterkombinationen, die nie indexiert werden sollen. Diese Zeit geht von der Zeit ab, die der Entdeckung Ihrer neuen Produkte gedient hätte.

Dieser Artikel behandelt Messung und Umsetzung. Die Kriterien für die Wahl der zu öffnenden Facetten wurden separat erläutert.

## Die Verschwendung messen, bevor man handelt

Keine Entscheidung sollte getroffen werden, ohne die Serverlogs angesehen zu haben. Sie sind die einzige Quelle, die zeigt, was Bots wirklich anfragen, im Gegensatz zu dem, was Sie glauben, dass sie anfragen.

Die Methode passt in drei Schritte.

**Die Bot-Anfragen extrahieren**, über vier Wochen, gefiltert nach User-Agent und mit Überprüfung der Echtheit per Reverse-DNS-Auflösung der Adresse. Ein Teil der Besuche, die sich als Bot ausgeben, ist keiner.

**Die angefragten Adressen klassifizieren**, in vier Familien: Produktseiten, Kategorien ohne Filter, Kategorien mit Filtern, und der Rest. Diese Klassifizierung erfolgt nach URL-Muster und dauert wenige Minuten, sobald die Datei in eine Tabelle oder Datenbank geladen ist.

**Die Verteilung berechnen.** In Katalogen mit unbehandelten Facetten übersteigt der auf Filter entfallende Anteil häufig die Hälfte der Anfragen, und er kann bei den offensten Konfigurationen 80 % erreichen.

Zwei ergänzende Zahlen sind es wert, notiert zu werden. Die **Besuchsfrequenz Ihrer Produktseiten**: wird ein Produkt nur einmal im Monat besucht, ist Ihr Crawl-Budget anderswo gesättigt. Und die **Entdeckungsdauer** Ihrer neuesten Produkte, zwischen Veröffentlichung und erstem Besuch.

## Was die Logs offenbaren

Drei Befunde kehren in nie behandelten Katalogen systematisch wieder.

**Die tiefen Kombinationen.** Adressen mit drei, vier oder fünf gleichzeitigen Filtern, die keine Chance auf Indexierung haben und dennoch ein erhebliches Volumen darstellen.

**Die Sortierparameter.** Dieselbe Produktliste, in sechs verschiedenen Reihenfolgen angefragt. Keiner dieser Zustände bringt dem Index irgendetwas.

**Die Facetten ohne Ergebnis.** Kombinationen, die kein Produkt zurückliefern und trotzdem gecrawlt werden, weil der Link auf der Seite existiert.

Dieser letzte Punkt ist der aufschlussreichste: Ihre Oberfläche bietet Links zu leeren Auswahlen an, was bereits ein Problem für Ihre Besucher ist, bevor es eines fürs Crawling wird.

## Warum die klassischen Direktiven nicht genügen

Der Reflex besteht darin, eine noindex-Direktive auf diese Seiten zu setzen. Sie regelt die Indexierung, nicht das Crawling: die Seite muss besucht werden, damit die Direktive gelesen wird.

Die Sperrung in der robots-Datei verhindert das Crawling, hat aber zwei Nachteile. Bereits indexierte Seiten können dort bleiben, ohne dass ihr Inhalt erneut gelesen werden kann, um zu verstehen, dass sie entfernt werden sollen. Und die Sperrung lässt sich schlecht sauber handhaben: eine gesperrte, aber massiv von Ihren Seiten verlinkte Adresse bleibt bekannt.

Beide Werkzeuge bleiben nützlich. Sie greifen nur, nachdem der Bot die Adresse entdeckt hat.

## Den Link nicht geben

Der ergänzende Ansatz besteht darin, diese Links nicht als Links auszudrücken.

Das Prinzip: das Navigationsverhalten wird von einem Skript erzeugt, das an einem Element hängt, das im Sinne des Protokolls kein Link ist. Der Besucher klickt und navigiert normal, der Bot findet keine Adresse zum Folgen.

Drei Bedingungen, damit das sauber ist.

**Das Element muss zugänglich bleiben.** Ein klickbares Element, das kein Link ist, muss die Attribute tragen, die es per Tastatur nutzbar und für einen Screenreader verständlich machen. Ohne das lösen Sie ein Crawl-Problem, indem Sie ein Barrierefreiheitsproblem schaffen.

**Die Navigation muss funktional bleiben.** Die Adresse muss sich ändern, der Zurück-Button muss funktionieren, der Link muss teilbar bleiben. Die Obfuskation betrifft die Art, wie der Link im Code ausgedrückt wird, nicht das Verschwinden der Adresse.

**Der Umfang muss begrenzt sein.** Wenden Sie diese Behandlung nur auf die Links an, die nicht gecrawlt werden sollen. Ihre Hauptnavigation, Ihre Kategorien und Ihre offenen Facetten müssen normale Links bleiben.

## Was man daraus nicht machen darf

Zwei Auswüchse, die klar auszuschließen sind.

**Links zu Inhalten verstecken, die Sie indexiert haben wollen**, in der Hoffnung, die Wertverteilung zu steuern. Das ist eine alte, wirkungslose Praxis, und sie beraubt Ihre Seiten eingehender Links.

**Dem Bot eine andere Seite präsentieren als dem Besucher.** Die Link-Obfuskation ändert nicht den ausgelieferten Inhalt, sie ändert die Schreibweise eines Oberflächenelements. Der Unterschied ist scharf, und daran muss man sich halten: je nach Agent unterschiedliche Inhalte auszuliefern ist eine sanktionierte Praxis.

## Die anderen Hebel

Die Obfuskation ist nicht das einzige Werkzeug, und nicht immer das erste.

**Die Zahl der angebotenen Filter reduzieren.** Viele Kataloge zeigen zwölf Facetten, von denen vier genutzt werden. Die unnützen zu entfernen reduziert mechanisch die Kombinatorik und vereinfacht die Oberfläche.

**Filter ohne Ergebnis ausblenden.** Ein Wert, der nichts zurückliefert, sollte nicht angeboten werden. Das entfernt unnütze Links und verbessert die Erfahrung.

**Die Filter bei Bedarf laden.** Auf Mobilgeräten ist das Filterpanel oft eingeklappt: wenn sein Inhalt erst nach dem Öffnen vorhanden ist, sind die Links nicht in der ausgelieferten Seite.

**Die Sitemap pflegen.** Sie muss Ihre nützlichen Seiten enthalten und sonst nichts. Eine Sitemap, die Filterkombinationen auflistet, lädt ausdrücklich zu deren Crawling ein.

## Nach der Umsetzung kontrollieren

Vier Indikatoren, erhoben vorher, dann nach einem Monat und nach drei Monaten.

**Die Verteilung der Bot-Anfragen** nach URL-Familie, mit derselben Methode wie zu Beginn. Das ist die direkte Messung des Effekts.

**Die Gesamtzahl der pro Tag gecrawlten Seiten**, in den Crawling-Statistiken. Vorsicht bei der Interpretation: ein Rückgang ist hier erwartet und erwünscht, im Gegensatz zur üblichen Annahme.

**Die Besuchsfrequenz der Produktseiten**, die steigen sollte, da sich die freigewordene Zeit umverteilt.

**Die Entdeckungsdauer der Neuheiten**, die der finale Indikator ist: ihretwegen wird das ganze Vorhaben durchgeführt.

Ein methodischer Punkt: lassen Sie drei bis vier Wochen verstreichen, bevor Sie Schlüsse ziehen. Die Umverteilung des Crawl-Budgets zeigt sich nicht sofort.

## Was schiefgehen kann

Drei Situationen, die nach der Umsetzung zu überwachen sind.

**Nützliche Seiten werden unerreichbar.** Wenn eine Facette, die Sie öffnen wollten, im obfuskierten Umfang landet, verliert sie ihre eingehenden Links. Prüfen Sie, dass Ihre offenen Seiten von einer normalen Stelle aus verlinkt bleiben.

**Eine per Tastatur kaputte Navigation.** Der Test dauert dreißig Sekunden: gehen Sie die Filter mit der Tabulatortaste durch und prüfen Sie, dass sie erreichbar und aktivierbar sind.

**Ein Trafficrückgang auf Facettenseiten.** Wenn Sie welche hatten, die Traffic erhielten, und sie in den Umfang geraten sind, zeigt sich der Rückgang in drei bis sechs Wochen. Daher der Nutzen, die Positionen vorher festzuhalten.

Das  setzt dieses Verfahren auf PrestaShop 8 und 9 um: selektive Behandlung der Filter- und Sortierlinks mit Ausschluss der offenen Facetten, Erhalt des Navigationsverhaltens und der Barrierefreiheitsattribute, und ein pro Kategorie konfigurierbarer Umfang.
