Ik maak gebruik van een CMS pakket voor een website (Xoops). Dit is een pakket wat uitbreidbaar is met modules. Eén van die modules levert met Firefox rare tekens op bovenin de pagina, te weten:  . Het begin van een HTML document ziet er ook zo uit:
Het een en ander is mij nog vrij vaag, maar het enige wat tot nu toe in mij opkomt is: hoe kan ik zo'n UTF8 formaat tekst omzetten naar een 'normaal' formaat tekst. Is dit uberhaupt mogelijk of moet ik de oplossing hiervoor ergens anders zoeken? Als ik bijv. de betreffende html files open in notepad en wordpad zie ik die tekens niet (en in internet explorer dus ook niet, alleen firefox).
Nu ben ik na veel zoeken erachter gekomen dat dit ws. komt door de indeling van die html files. Die module is door een vietnamees oid gemaakt, dus daar zullen ze wel een ander soort indeling hebben qua karaktersets. Een term die oa. voorbij kwam is UTF8 en ook dat dit 3 bytes toevoegd aan het begin van een textfile. Laten die 3 tekens nou net 3 bytes zijn...
<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd">
<html xmlns="http://www.w3.org/1999/xhtml" xml:lang="nl" lang="nl">
<head>
Het een en ander is mij nog vrij vaag, maar het enige wat tot nu toe in mij opkomt is: hoe kan ik zo'n UTF8 formaat tekst omzetten naar een 'normaal' formaat tekst. Is dit uberhaupt mogelijk of moet ik de oplossing hiervoor ergens anders zoeken? Als ik bijv. de betreffende html files open in notepad en wordpad zie ik die tekens niet (en in internet explorer dus ook niet, alleen firefox).
[ Voor 40% gewijzigd door Palomar op 19-10-2004 18:02 ]