# Jak powstrzymać Googlebota przed marnowaniem crawlu na filtrach PrestaShop

> W katalogach z nieobsłużonymi fasetami część crawlu poświęcona filtrom często przekracza połowę żądań. Jak ją zmierzyć w logach serwera, dlaczego noindex i robots nie wystarczają, i jakich granic przestrzegać.

- Strona: <https://www.datafirefly.com/pl/2026/09/25/googlebot-crawl-filtry-prestashop/>
- Język: pl
- Opublikowano: 2026-09-25
- Zaktualizowano: 2026-08-13
- Inne języki: [fr](https://www.datafirefly.com/2026/09/25/crawl-filtres-prestashop-budget-exploration/index.md), [en](https://www.datafirefly.com/en/2026/09/25/googlebot-crawl-waste-prestashop-filters/index.md), [es](https://www.datafirefly.com/es/2026/09/25/googlebot-rastreo-filtros-prestashop/index.md), [de](https://www.datafirefly.com/de/2026/09/25/googlebot-crawl-budget-prestashop-filter/index.md), [it](https://www.datafirefly.com/it/2026/09/25/googlebot-crawl-filtri-prestashop/index.md), [nl](https://www.datafirefly.com/nl/2026/09/25/crawl-filters-prestashop-crawlbudget/index.md)
- Indeks: <https://www.datafirefly.com/pl/2026/llms.txt>

Przy dużym katalogu znaczna część żądań robotów dotyczy kombinacji filtrów, które nigdy nie miały być indeksowane. Ten czas jest zabierany z czasu, który posłużyłby odkrywaniu Twoich nowych produktów.

Ten artykuł dotyczy pomiaru i wdrożenia. Kryteria wyboru faset do otwarcia zostały omówione osobno.

## Zmierzyć marnotrawstwo przed działaniem

Żadna decyzja nie powinna zapadać bez zajrzenia do logów serwera. To jedyne źródło pokazujące, czego roboty naprawdę żądają, w odróżnieniu od tego, co sądzisz, że żądają.

Metoda mieści się w trzech krokach.

**Wyodrębnij żądania robotów** z czterech tygodni, filtrując po user agencie i weryfikując autentyczność przez odwrotne rozwiązanie adresu. Część wizyt podających się za roboty nimi nie jest.

**Sklasyfikuj żądane adresy** w cztery rodziny: karty produktów, kategorie bez filtra, kategorie z filtrami i reszta. Ta klasyfikacja odbywa się po wzorcu URL i zajmuje kilka minut po załadowaniu pliku do arkusza lub bazy.

**Policz rozkład.** W katalogach z nieobsłużonymi fasetami część poświęcona filtrom często przekracza połowę żądań, a w najbardziej otwartych konfiguracjach może sięgać 80%.

Dwie uzupełniające liczby warto odnotować. **Częstotliwość odwiedzin Twoich kart produktów**: jeśli produkt jest odwiedzany tylko raz w miesiącu, Twój budżet indeksowania jest nasycony gdzie indziej. Oraz **czas odkrycia** ostatnich nowości, między publikacją a pierwszą wizytą.

## Co ujawniają logi

Trzy obserwacje wracają systematycznie w katalogach nigdy nieobsłużonych.

**Głębokie kombinacje.** Adresy niosące trzy, cztery lub pięć jednoczesnych filtrów, które nie mają żadnych szans na indeksację, a mimo to stanowią istotny wolumen.

**Parametry sortowania.** Ta sama lista produktów żądana w sześciu różnych porządkach. Żaden z tych stanów nie wnosi nic do indeksu.

**Fasety bez wyników.** Kombinacje, które nie zwracają żadnego produktu, a mimo to są odwiedzane, bo link istnieje na stronie.

Ten ostatni punkt jest najbardziej wymowny: Twój interfejs proponuje linki do pustych selekcji, co jest problemem dla Twoich odwiedzających, zanim stanie się problemem dla crawlu.

## Dlaczego klasyczne dyrektywy nie wystarczają

Odruch polega na postawieniu dyrektywy noindex na tych stronach. Rozwiązuje ona indeksację, nie indeksowanie: strona musi zostać odwiedzona, by dyrektywa została odczytana.

Blokada w pliku robots zapobiega odwiedzinom, ale ma dwie wady. Strony już zaindeksowane mogą tam pozostać, a ich treść nie może zostać ponownie odczytana, by zrozumieć, że należy je usunąć. A blokadę trudno obejść czysto: adres zablokowany, lecz masowo linkowany z Twoich stron, pozostaje znany.

Oba narzędzia pozostają użyteczne. Działają po prostu po tym, jak robot odkrył adres.

## Nie dawać linku

Podejście uzupełniające polega na tym, by nie wyrażać tych linków jako linków.

Zasada: zachowanie nawigacyjne wytwarza skrypt przypięty do elementu, który nie jest linkiem w sensie protokołu. Odwiedzający klika i nawiguje normalnie, robot nie znajduje żadnego adresu do podążania.

Trzy warunki, by było to czyste.

**Element musi pozostać dostępny.** Element klikalny, który nie jest linkiem, musi nosić atrybuty czyniące go używalnym z klawiatury i zrozumiałym dla czytnika ekranu. Bez tego rozwiązujesz problem crawlu, tworząc problem dostępności.

**Nawigacja musi pozostać funkcjonalna.** Adres musi się zmieniać, cofanie musi działać, link musi pozostać możliwy do udostępnienia. Maskowanie dotyczy sposobu wyrażenia linku w kodzie, a nie zniknięcia adresu.

**Zakres musi być ograniczony.** Stosuj to traktowanie tylko do linków, których nie chcesz widzieć odwiedzanych. Twoja główna nawigacja, kategorie i otwarte fasety muszą pozostać normalnymi linkami.

## Czego z tym nie robić

Dwa wypaczenia do jednoznacznego odrzucenia.

**Ukrywanie linków do treści, które chcesz indeksować**, w nadziei kontrolowania dystrybucji wartości. To stara, nieskuteczna praktyka, która pozbawia Twoje strony linków przychodzących.

**Prezentowanie robotowi innej strony niż odwiedzającemu.** Maskowanie linków nie zmienia serwowanej treści, zmienia sposób zapisania elementu interfejsu. Różnica jest ostra i trzeba się jej trzymać: serwowanie odmiennej treści zależnie od agenta to praktyka karana.

## Pozostałe dźwignie

Maskowanie nie jest jedynym narzędziem i nie zawsze pierwszym.

**Zmniejsz liczbę proponowanych filtrów.** Wiele katalogów pokazuje dwanaście faset, z których cztery są używane. Usunięcie zbędnych mechanicznie redukuje kombinatorykę i upraszcza interfejs.

**Ukryj filtry bez wyników.** Wartość, która nic nie zwraca, nie powinna być proponowana. To usuwa zbędne linki i poprawia doświadczenie.

**Ładuj filtry na żądanie.** Na urządzeniach mobilnych panel filtrów jest często zwinięty: jeśli jego zawartość pojawia się dopiero po otwarciu, linki nie są w serwowanej stronie.

**Zadbaj o sitemapę.** Musi zawierać Twoje użyteczne strony i nic więcej. Sitemapa wymieniająca kombinacje filtrów wprost zaprasza do ich odwiedzania.

## Kontrola po wdrożeniu

Cztery wskaźniki, mierzone przed, potem po miesiącu i po trzech miesiącach.

**Rozkład żądań robotów** według rodziny URL, tą samą metodą co na początku. To bezpośredni pomiar efektu.

**Całkowita liczba stron odwiedzanych dziennie** w statystykach indeksowania. Uwaga na interpretację: spadek jest tu oczekiwany i pożądany, wbrew temu, co się zwykle sądzi.

**Częstotliwość odwiedzin kart produktów**, która powinna rosnąć, bo uwolniony czas się przemieszcza.

**Czas odkrycia nowości**, który jest wskaźnikiem ostatecznym: to dla niego prowadzone jest całe przedsięwzięcie.

Uwaga metodyczna: odczekaj trzy do czterech tygodni przed wyciąganiem wniosków. Redystrybucja budżetu indeksowania nie jest widoczna od razu.

## Co może pójść źle

Trzy sytuacje do obserwacji po wdrożeniu.

**Użyteczne strony stały się nieosiągalne.** Jeśli faseta, którą chciałeś otworzyć, trafi do maskowanego zakresu, traci linki przychodzące. Sprawdź, że Twoje otwarte strony pozostają linkowane z normalnego miejsca.

**Nawigacja zepsuta dla klawiatury.** Test zajmuje trzydzieści sekund: przejdź filtry tabulatorem i sprawdź, że są osiągalne i możliwe do aktywacji.

**Spadek ruchu na stronach faset.** Jeśli miałeś takie, które otrzymywały ruch, a znalazły się w zakresie, spadek pojawia się w trzy do sześciu tygodni. Stąd wartość odnotowania pozycji wcześniej.

wdraża ten mechanizm w PrestaShop 8 i 9: selektywne traktowanie linków filtrów i sortowania z wykluczeniem otwartych faset, zachowanie sposobu nawigacji i atrybutów dostępności oraz zakres konfigurowalny per kategoria.
