Wszystko, co warto wiedzieć, zanim zainstalujesz.
Szczegółowe spojrzenie na to, jak działa Thin Content Detector: Wykrywanie Ubogiej Treści przez AI PrestaShop 8/9, dlaczego zbudowaliśmy go w ten sposób i jaka myśl stoi za powyższymi funkcjami.
Dlaczego thin content zabija Twoje SEO
Od Helpful Content Update Google aktywnie obniża strony ze zbyt ubogą, zbyt podobną lub zbyt zdominowaną przez powtarzalne elementy treścią. W sklepie e-commerce to typowo karty produktów przejęte od dostawcy, kategorie z dwoma generycznymi zdaniami lub warianty dzielące 95% opisu. Niewidoczne gołym okiem na katalogu 500 produktów, ale skumulowane, to właśnie to blokuje ranking Twojej strony.
Trzy komplementarne typy wykrywania
Thin Content Detector nie ogranicza się do liczenia słów. Analizator ubogiej treści sygnalizuje strony poniżej progu. Detektor duplikatów używa hasha SHA1 dla duplikatów dokładnych, potem podobieństwa Jaccarda dla quasi-duplikatów. Analizator stosunku template identyfikuje tokeny pojawiające się w ponad połowie stron siostrzanych (ta sama kategoria nadrzędna) i oblicza procent tokenów unikalnych per strona. Strona z 200 słowami, ale 90% boilerplate'u jest równie toksyczna jak strona z 30 słowami.
Kontekstowe sugestie AI
Dla każdego wykrytego problemu moduł generuje sugestię wzbogacenia przez endpoint zgodny z OpenAI. Prompt jest dopasowany do typu problemu (wzbogacić thin content, zróżnicować duplikaty, uczynić unikalną treść zbyt szablonową) ORAZ do typu obiektu (USP i specyfikacje dla produktów, USP gamy dla kategorii, rozwinięcie redakcyjne dla CMS). Zwrotka to czysty HTML, akapity, listy, podtytuły, bezpośrednio wklejalny w TinyMCE. Żadnego markdownu do czyszczenia.
Agnostyczny endpoint AI
Skonfiguruj dowolną usługę zgodną z API chat completions OpenAI: OpenAI bezpośrednio, Mistral AI, Groq dla błyskawicznych odpowiedzi, lokalny Ollama dla zerowego kosztu tokenów lub Anthropic przez zgodne proxy. Pozostajesz właścicielem dostawcy, modelu i kosztu.
Zaprojektowany dla dużych katalogów
Wszystkie zapytania SQL są dzielone na porcje (500 produktów per batch). Eksport CSV jest strumieniowany na wyjściu, aby uniknąć nasycenia pamięci. Wykrywanie duplikatów używa pre-filtrowania po liczbie słów (±50%) przed obliczeniem podobieństwa Jaccarda, a limit bezpieczeństwa na 1500 elementów zapobiega katastrofalnej złożoności O(n²). Na katalogu 5000 produktów pełny skan trwa kilka minut.
Bezpieczny cron i auto-rescan
Endpoint cron zabezpieczony tokenem pozwala planować nocne skany przez crontab. Włącz automatyczny rescan, aby każdy zapis produktu, kategorii lub strony CMS wyzwalał celowany re-test, w czasie rzeczywistym widzisz, czy Twoje przepisanie wystarcza do przekroczenia progów.
Na razie nie ma opinii o produkcie.