Effectivement, tout le fichier est parsé à chaque fois, mais c'est obligatoire, car comme montré dans le code d'origine, les lignes sont ... douteuses :
[td][span font='arial' font-size=12px][strong]machin
sur deux lignes[/strong]
[/span]
[/td]
Devient un très beau code de la sorte, réorganisé :
[td]
machin sur deux lignes
[/td]
En fait, la correction se fait en plusieurs étapes :
* Sauvegarde de quelques balises (les tr par exemple)
* Suppression de toutes les balises
* Suppression de tous les espaces et autres, ainsi que des saut de ligne. Ainsi, tout le code se présente sur une seule ligne : «[td]machin sur deux lignes[/td]» ici
* Indentation avec des regex un peu spéciaux, mais qui marchent
Le code à la sortie est donc tout beau et tout propre :) .
[^] # Re: complexité
Posté par steckdenis . En réponse au message Nettoyer un code HTML sale. Évalué à 3.
[td][span font='arial' font-size=12px][strong]machin
sur deux lignes[/strong]
[/span]
[/td]
Devient un très beau code de la sorte, réorganisé :
[td]
machin sur deux lignes
[/td]
En fait, la correction se fait en plusieurs étapes :
* Sauvegarde de quelques balises (les tr par exemple)
* Suppression de toutes les balises
* Suppression de tous les espaces et autres, ainsi que des saut de ligne. Ainsi, tout le code se présente sur une seule ligne : «[td]machin sur deux lignes[/td]» ici
* Indentation avec des regex un peu spéciaux, mais qui marchent
Le code à la sortie est donc tout beau et tout propre :) .