PrestaShop Gestão de catálogo

Limpeza HTML das Descrições de Produtos e Categorias: Eliminar o Código do Word, os Estilos Inline e as Etiquetas Vazias (PrestaShop 8 e 9)

Retire o código do Word, os estilos inline e as etiquetas vazias das suas descrições, sem tocar no texto.

As descrições coladas a partir do Word, do Google Docs ou de um editor WYSIWYG antigo arrastam kilobytes de código invisível: classes MsoNormal, estilos inline que impõem Calibri de 11 pontos, etiquetas o:p vazias, comentários condicionais do Office e séries de espaços inquebráveis. Este módulo percorre as suas descrições de produtos e categorias, retira o que ali não tem nada a fazer e deixa o texto intacto. Começa por lançar uma simulação que nada escreve, compara dez exemplos antes e depois e só então limpa a sério, com cópia de segurança e possibilidade de voltar atrás.

At a glance
  • Limpa as descrições de produtos e categorias, além das páginas CMS, marcas e fornecedores
  • Retira o markup do Microsoft Word, os estilos inline, as classes de editor e as etiquetas vazias
  • Simulação sem escrita, com dez exemplos antes e depois e o peso poupado
  • Processamento por lotes AJAX: um catálogo grande passa sem timeout do PHP
  • Cada valor substituído é guardado, e uma execução inteira restaura-se num clique
PrestaShop 8 e 9 Simulação antes da escrita Restauro num clique Multiloja Código-fonte incluído
  • Reembolso em 30 dias
  • 12 meses de atualizações
  • Suporte em 24h
www.datafirefly.com/pt/
Limpeza do código HTML das descrições de produtos PrestaShop: código do Word, estilos inline e etiquetas vazias eliminados
v1.0.1 · atualizado 2026-07-27
O que faz

A versão curta.

01

O código do Word sai, o texto fica

Comentários condicionais, ilhas XML, etiquetas o:p e w:WordDocument, classes MsoNormal e propriedades mso-: aquilo que o Word deixa para trás é identificado e retirado. Numa descrição típica colada do Word, o peso passa de 56 KB para 24 KB.

02

Vê antes de escrever

O botão Simular percorre o catálogo sem alterar nada e devolve-lhe o número de fichas envolvidas, o peso poupado e dez exemplos antes e depois lado a lado, cada um com uma ligação direta para a ficha.

03

Os seus vídeos, tabelas e blocos de código sobrevivem

Os iframes do YouTube, Vimeo, Dailymotion e Google Maps são mantidos com as suas dimensões e o atributo allowfullscreen, e a lista dos domínios de confiança é editável. As células de tabela vazias não são eliminadas, e o conteúdo das etiquetas pre e code nunca é reformatado.

04

Relançável sem risco

O motor é idempotente: voltar a limpar uma descrição já tratada deixa-a igual byte a byte. Uma ficha sã nunca é reescrita e a sua data de modificação não muda.

05

Voltar atrás num clique

Cada valor substituído é copiado para uma tabela dedicada, agrupado por execução. O painel Cópias de segurança repõe uma execução inteira sem passar pela base de dados. A retenção é configurável e a limpeza automática.

A versão longa

Tudo o que quer saber antes de instalar.

Uma análise detalhada de como o Limpeza HTML das Descrições de Produtos e Categorias: Eliminar o Código do Word, os Estilos Inline e as Etiquetas Vazias (PrestaShop 8 e 9) funciona, porque o construímos assim e o raciocínio por trás das funcionalidades acima.

§ 01

O que o módulo retira

Uma descrição colada do Word chega com um comentário condicional do Office no início, uma ilha XML, parágrafos com a classe MsoNormal, estilos inline que impõem um tipo de letra e um tamanho, etiquetas o:p vazias e séries de três espaços inquebráveis. Nada disto é visível na ficha, mas tudo fica guardado em base de dados, enviado a cada visitante e lido pelo Google. O módulo identifica estes padrões e retira-os. O texto, as ligações, as listas, as tabelas e as imagens são mantidos.

§ 02

Um verdadeiro parser, não uma expressão regular

A limpeza passa pelo DOMDocument. O documento é reconstruído, o que de caminho repara as etiquetas por fechar e os aninhamentos incorretos em vez de os agravar. Duas passagens por expressões regulares enquadram a análise DOM, apenas para aquilo que um parser não sabe representar: comentários condicionais, ilhas XML e etiquetas com namespace. Se a análise falhar num conteúdo invulgar, o módulo devolve o valor original sem lhe tocar.

§ 03

Simulação, lotes e cópia de segurança

O processamento é feito por lotes em AJAX, com barra de progresso e botão de paragem. O tamanho do lote desce até 5 registos nos alojamentos mais limitados, o que evita o timeout do PHP mesmo num catálogo com várias dezenas de milhares de fichas. No modo de simulação nada é escrito: obtém os contadores, o peso poupado e dez comparações antes e depois. No modo real, cada valor substituído é copiado para a tabela de cópias de segurança com um identificador de execução, o que permite repor tudo a partir do back-office.

§ 04

O que o módulo não parte

Os iframes de fornecedores de confiança são mantidos com os seus atributos allow e allowfullscreen e as suas dimensões; a verificação incide sobre o domínio real, pelo que um endereço do tipo youtube.com.exemplo.tld é recusado. As células de tabela vazias são preservadas para não deformar o layout. O conteúdo das etiquetas pre, code e textarea escapa à normalização dos espaços. Por fim, o motor é idempotente: voltar a lançar a limpeza numa ficha já tratada não produz qualquer alteração, logo não gera datas de atualização parásitas.

§ 05

Limpeza ao gravar

Uma opção aplica as mesmas regras sempre que grava um produto ou uma categoria no back-office, através dos hooks acionados antes da escrita do objeto. Está desativada por predefinição: é preferível validar as regras em simulação antes de as aplicar em contínuo. Este modo não cria entradas de cópia de segurança, ao contrário do processamento por lotes.