Alles wat u wilt weten voordat u installeert.
Een gedetailleerde blik op hoe Thin Content Detector: AI-detectie van Dunne Content PrestaShop 8/9 werkt, waarom we het zo gebouwd hebben en de gedachte achter de bovenstaande functies.
Waarom thin content uw SEO ondermijnt
Sinds de Helpful Content Update zet Google pagina's actief lager wanneer de inhoud te mager is, te sterk op elkaar lijkt of te veel uit herhaalde elementen bestaat. In een webshop gaat het dan meestal om productpagina's die letterlijk van de leverancier komen, categorieën met twee algemene zinnen, of varianten die 95% van hun beschrijving delen. Bij een catalogus van 500 producten valt dat met het blote oog niet op, maar bij elkaar opgeteld houdt het uw site uit de resultaten.
Drie soorten detectie die elkaar aanvullen
Thin Content Detector blijft niet bij het tellen van woorden. De analyse van magere inhoud meldt de pagina's onder de drempel. De duplicaatdetectie gebruikt een SHA1-hash voor exacte duplicaten en daarna een Jaccard-gelijkenis voor bijna-duplicaten. De sjabloonanalyse spoort de tokens op die in meer dan de helft van de verwante pagina's voorkomen (dezelfde bovenliggende categorie) en berekent het percentage eigen tokens per pagina. Een pagina met 200 woorden waarvan 90% standaardtekst is, is even schadelijk als een pagina van 30 woorden.
AI-suggesties met context
Bij elk gevonden probleem genereert de module een verrijkingssuggestie via een endpoint dat compatibel is met OpenAI. De prompt is afgestemd op het soort probleem (magere inhoud aanvullen, duplicaten onderscheiden, te sjabloonmatige tekst uniek maken) én op het soort object (unieke verkoopargumenten en specificaties bij producten, verkoopargumenten voor het assortiment bij categorieën, redactionele uitwerking bij CMS-pagina's). Het antwoord is schone HTML met alinea's, lijsten en tussenkoppen, die u rechtstreeks in TinyMCE plakt. Geen markdown om op te ruimen.
AI-endpoint naar keuze
Stel elke dienst in die compatibel is met de chat completions-API van OpenAI: OpenAI rechtstreeks, Mistral AI, Groq voor zeer snelle antwoorden, Ollama lokaal om geen tokens te betalen, of Anthropic via een compatibele proxy. U bepaalt zelf de aanbieder, het model en de kosten.
Gemaakt voor grote catalogi
Alle SQL-queries werken in blokken van 500 producten. De CSV-export wordt gestreamd om het geheugen niet te laten vollopen. De duplicaatdetectie filtert eerst op woordaantal (met een marge van 50%) voordat de Jaccard-gelijkenis wordt berekend, en een veiligheidsplafond bij 1.500 items voorkomt een rampzalige O(n²)-complexiteit. Bij een catalogus van 5.000 producten duurt een volledige scan enkele minuten.
Beveiligde cron en automatisch opnieuw scannen
Met een cron-endpoint dat met een token is beveiligd plant u nachtelijke scans in via crontab. Zet het automatisch opnieuw scannen aan, en elke keer dat u een product, categorie of CMS-pagina opslaat volgt er een gerichte hertest. Zo ziet u meteen of uw herschrijving genoeg is om boven de drempels uit te komen.
Er zijn nog geen beoordelingen.