PrestaShop Katalog-Verwaltung

HTML-Bereinigung für Produkt- und Kategoriebeschreibungen: Word-Code, Inline-Styles und leere Tags entfernen (PrestaShop 8 & 9)

Entfernen Sie Word-Code, Inline-Styles und leere Tags aus Ihren Beschreibungen, ohne den Text anzurühren.

Beschreibungen, die aus Word, Google Docs oder einem alten WYSIWYG-Editor eingefügt wurden, schleppen Kilobytes unsichtbaren Code mit: MsoNormal-Klassen, Inline-Styles mit Calibri 11 Punkt, leere o:p-Tags, bedingte Office-Kommentare, Ketten geschützter Leerzeichen. Dieses Modul geht Ihre Produkt- und Kategoriebeschreibungen durch, entfernt was dort nicht hingehört und lässt den Text unberührt. Sie starten mit einer Simulation, die nichts schreibt, vergleichen zehn Vorher/Nachher-Beispiele und bereinigen dann wirklich, mit Sicherung und Weg zurück.

Auf einen Blick
  • Bereinigt Produkt- und Kategoriebeschreibungen sowie CMS-Seiten, Marken und Lieferanten
  • Entfernt Microsoft-Word-Code, Inline-Styles, Editor-Klassen und leere Tags
  • Simulation ohne Schreibzugriff, mit zehn Vorher/Nachher-Beispielen und der eingesparten Größe
  • Verarbeitung in AJAX-Stapeln: ein großer Katalog läuft ohne PHP-Timeout durch
  • Jeder überschriebene Wert wird gesichert, ein ganzer Durchlauf per Klick wiederhergestellt
PrestaShop 8 & 9 Simulation vor dem Schreiben Wiederherstellung per Klick Multishop Quellcode enthalten
  • 30 Tage Rückgaberecht
  • 12 Monate Updates
  • 24-h-Support
www.datafirefly.com/de/
HTML-Bereinigung von PrestaShop-Produktbeschreibungen: Word-Code, Inline-Styles und leere Tags entfernt
v1.0.1 · aktualisiert 2026-07-27
Was es leistet

Die Kurzfassung.

01

Der Word-Code geht, der Text bleibt

Bedingte Kommentare, XML-Inseln, o:p- und w:WordDocument-Tags, MsoNormal-Klassen, mso--Eigenschaften: was Word hinterlässt, wird erkannt und entfernt. Bei einer typischen aus Word eingefügten Beschreibung sinkt die Größe von 56 KB auf 24 KB.

02

Sie sehen es, bevor geschrieben wird

Die Schaltfläche Simulieren geht den Katalog durch, ohne etwas zu ändern, und liefert die Zahl der betroffenen Datensätze, die eingesparte Größe und zehn nebeneinander dargestellte Vorher/Nachher-Beispiele, jeweils mit direktem Link zum Datensatz.

03

Videos, Tabellen und Codeblöcke überleben

Iframes von YouTube, Vimeo, Dailymotion und Google Maps bleiben mit ihren Abmessungen und ihrem allowfullscreen-Attribut erhalten, die Liste vertrauenswürdiger Domains ist änderbar. Leere Tabellenzellen werden nicht entfernt, und der Inhalt von pre- und code-Tags wird nie neu formatiert.

04

Gefahrlos wiederholbar

Die Engine ist idempotent: eine bereits bereinigte Beschreibung erneut zu bereinigen lässt sie Byte für Byte unverändert. Ein sauberer Datensatz wird nie neu geschrieben, sein Änderungsdatum bleibt stehen.

05

Rückweg per Klick

Jeder überschriebene Wert wird in eine eigene Tabelle kopiert, nach Durchlauf gruppiert. Das Panel Sicherungen setzt einen ganzen Durchlauf zurück, ohne dass Sie an die Datenbank müssen. Die Aufbewahrungsdauer ist einstellbar, alte Einträge werden automatisch gelöscht.

Die ausführliche Fassung

Alles, was Sie vor der Installation wissen wollen.

Ein detaillierter Blick darauf, wie HTML-Bereinigung für Produkt- und Kategoriebeschreibungen: Word-Code, Inline-Styles und leere Tags entfernen (PrestaShop 8 & 9) funktioniert, warum wir es so gebaut haben und der Gedanke hinter den Funktionen oben.

§ 01

Was das Modul entfernt

Eine aus Word eingefügte Beschreibung kommt mit einem bedingten Office-Kommentar im Kopf, einer XML-Insel, Absätzen mit der Klasse MsoNormal, Inline-Styles die Schriftart und Größe vorschreiben, leeren o:p-Tags und Ketten aus drei geschützten Leerzeichen. Nichts davon ist auf der Seite sichtbar, aber alles liegt in der Datenbank, geht an jeden Besucher und wird von Google gelesen. Das Modul erkennt diese Muster und entfernt sie. Text, Links, Listen, Tabellen und Bilder bleiben erhalten.

§ 02

Ein echter Parser statt regulärer Ausdrücke

Die Bereinigung läuft über DOMDocument. Das Dokument wird neu aufgebaut, wodurch nicht geschlossene Tags und falsche Verschachtelungen nebenbei repariert statt weiter beschädigt werden. Zwei Durchgänge mit regulären Ausdrücken rahmen die DOM-Analyse ein, ausschließlich für das, was ein Parser nicht abbilden kann: bedingte Kommentare, XML-Inseln, Tags mit Namensraum. Scheitert die Analyse an ungewöhnlichem Inhalt, gibt das Modul den ursprünglichen Wert unverändert zurück.

§ 03

Simulieren, stapeln, sichern

Die Verarbeitung läuft in AJAX-Stapeln, mit Fortschrittsbalken und Stopp-Schaltfläche. Die Stapelgröße geht auf Shared Hosting bis auf 5 Datensätze herunter, was das PHP-Timeout selbst bei einem Katalog mit mehreren zehntausend Datensätzen vermeidet. Im Simulationsmodus wird nichts geschrieben: Sie erhalten die Zähler, die eingesparte Größe und zehn Vorher/Nachher-Vergleiche. Im echten Modus wird jeder ersetzte Wert mit einer Durchlaufkennung in die Sicherungstabelle kopiert, sodass sich alles aus dem Backoffice wieder zurücksetzen lässt.

§ 04

Was das Modul nicht kaputt macht

Iframes vertrauenswürdiger Anbieter behalten ihre allow- und allowfullscreen-Attribute und ihre Abmessungen; geprüft wird die tatsächliche Domain, eine Adresse wie youtube.com.beispiel.tld wird also abgelehnt. Leere Tabellenzellen bleiben erhalten, damit das Layout nicht verrutscht. Der Inhalt von pre-, code- und textarea-Tags entgeht der Leerzeichen-Normalisierung. Und die Engine ist idempotent: ein erneuter Lauf über einen bereits bereinigten Datensatz ändert nichts, es entstehen also keine unnötigen Aktualisierungsdaten.

§ 05

Bereinigung beim Speichern

Eine Option wendet dieselben Regeln bei jedem Speichern eines Produkts oder einer Kategorie im Backoffice an, über die Hooks, die vor dem Schreiben des Objekts ausgelöst werden. Sie ist standardmäßig aus: die Regeln sollten erst in der Simulation geprüft werden, bevor sie dauerhaft greifen. Dieser Modus legt keinen Sicherungseintrag an, anders als die Stapelverarbeitung.