ik wil uit "kappotte" html tags verwijderen die niet voldoen aan de xhtml standaard. het gaat hierbij vooral om tags die de atributen niet quoten.
helaas ontstaat bij het gebruik van regex het voldende probleem:
<a href=blabla.html>blaa</a>bladablablabla<a href=\"blaa.html\">hoi</a>
<a href=(.+)>(.+)</a>
de 1e (.+) beslaat het stuk tot aan het einde (laatste </a>) hoe kun je er voor zorgen dat de eerst volgende > wordt gevonden ipv het laatste teken?
helaas ontstaat bij het gebruik van regex het voldende probleem:
<a href=blabla.html>blaa</a>bladablablabla<a href=\"blaa.html\">hoi</a>
<a href=(.+)>(.+)</a>
de 1e (.+) beslaat het stuk tot aan het einde (laatste </a>) hoe kun je er voor zorgen dat de eerst volgende > wordt gevonden ipv het laatste teken?
Steun Elkaar, Kopieer Nederlands Waar!