PrestaShop Kunstmatige intelligentie

Thin Content Detector: AI-detectie van Dunne Content PrestaShop 8/9

De detector van magere inhoud die uw zwakke pagina's omzet in pagina's die scoren

Google straft pagina's af waarvan de inhoud te kort of te vergelijkbaar is. Bij een catalogus met honderden producten valt dat met het blote oog niet op. Thin Content Detector scant automatisch al uw producten, categorieën en CMS-pagina's in alle actieve talen, herkent drie patronen die schadelijk zijn voor SEO, en genereert verrijkingssuggesties met AI die u meteen kunt plakken.

PrestaShop 8 en 9 Meertalig AI ingebouwd Native cron
  • 30 dagen geld terug
  • 12 maanden updates
  • Support binnen 24 uur
www.datafirefly.com/nl/
Détection des fiches à contenu pauvre (thin content) sur PrestaShop
v1.0.0 · bijgewerkt 2026-05-27
Wat het doet

De korte versie.

01

Detectie van thin content

Wijst de producten, categorieën en CMS-pagina's aan die onder de instelbare woorddrempel blijven (standaard 150 woorden voor een product, 100 voor een categorie, 250 voor een CMS-pagina). De ernst is kritiek, waarschuwing of melding, afhankelijk van de afstand tot de drempel.

02

Detectie van duplicaten

Herkent identieke beschrijvingen (SHA1-hash) of sterk gelijkende (Jaccard-gelijkenis vanaf 85%, instelbaar) tussen producten. Onmisbaar bij catalogi met veel varianten.

03

Verhouding sjabloon tegenover inhoud

Wijst pagina's aan die door standaardtekst worden gedomineerd: te veel tokens die ze delen met verwante pagina's, te weinig eigen tokens. De klassieke valkuil van knippen en plakken per categorie.

04

AI-suggesties klaar om te plakken

Genereert bij elk gevonden probleem een verrijkingssuggestie die past bij het soort probleem en het soort object. De uitvoer is schone HTML, zonder markdown.

De lange versie

Alles wat u wilt weten voordat u installeert.

Een gedetailleerde blik op hoe Thin Content Detector: AI-detectie van Dunne Content PrestaShop 8/9 werkt, waarom we het zo gebouwd hebben en de gedachte achter de bovenstaande functies.

§ 01

Waarom thin content uw SEO ondermijnt

Sinds de Helpful Content Update zet Google pagina's actief lager wanneer de inhoud te mager is, te sterk op elkaar lijkt of te veel uit herhaalde elementen bestaat. In een webshop gaat het dan meestal om productpagina's die letterlijk van de leverancier komen, categorieën met twee algemene zinnen, of varianten die 95% van hun beschrijving delen. Bij een catalogus van 500 producten valt dat met het blote oog niet op, maar bij elkaar opgeteld houdt het uw site uit de resultaten.

§ 02

Drie soorten detectie die elkaar aanvullen

Thin Content Detector blijft niet bij het tellen van woorden. De analyse van magere inhoud meldt de pagina's onder de drempel. De duplicaatdetectie gebruikt een SHA1-hash voor exacte duplicaten en daarna een Jaccard-gelijkenis voor bijna-duplicaten. De sjabloonanalyse spoort de tokens op die in meer dan de helft van de verwante pagina's voorkomen (dezelfde bovenliggende categorie) en berekent het percentage eigen tokens per pagina. Een pagina met 200 woorden waarvan 90% standaardtekst is, is even schadelijk als een pagina van 30 woorden.

§ 03

AI-suggesties met context

Bij elk gevonden probleem genereert de module een verrijkingssuggestie via een endpoint dat compatibel is met OpenAI. De prompt is afgestemd op het soort probleem (magere inhoud aanvullen, duplicaten onderscheiden, te sjabloonmatige tekst uniek maken) én op het soort object (unieke verkoopargumenten en specificaties bij producten, verkoopargumenten voor het assortiment bij categorieën, redactionele uitwerking bij CMS-pagina's). Het antwoord is schone HTML met alinea's, lijsten en tussenkoppen, die u rechtstreeks in TinyMCE plakt. Geen markdown om op te ruimen.

§ 04

AI-endpoint naar keuze

Stel elke dienst in die compatibel is met de chat completions-API van OpenAI: OpenAI rechtstreeks, Mistral AI, Groq voor zeer snelle antwoorden, Ollama lokaal om geen tokens te betalen, of Anthropic via een compatibele proxy. U bepaalt zelf de aanbieder, het model en de kosten.

§ 05

Gemaakt voor grote catalogi

Alle SQL-queries werken in blokken van 500 producten. De CSV-export wordt gestreamd om het geheugen niet te laten vollopen. De duplicaatdetectie filtert eerst op woordaantal (met een marge van 50%) voordat de Jaccard-gelijkenis wordt berekend, en een veiligheidsplafond bij 1.500 items voorkomt een rampzalige O(n²)-complexiteit. Bij een catalogus van 5.000 producten duurt een volledige scan enkele minuten.

§ 06

Beveiligde cron en automatisch opnieuw scannen

Met een cron-endpoint dat met een token is beveiligd plant u nachtelijke scans in via crontab. Zet het automatisch opnieuw scannen aan, en elke keer dat u een product, categorie of CMS-pagina opslaat volgt er een gerichte hertest. Zo ziet u meteen of uw herschrijving genoeg is om boven de drempels uit te komen.