UBB parsen met XML parser

Pagina: 1
Acties:

  • justmental
  • Registratie: April 2000
  • Niet online

justmental

my heart, the beat

Topicstarter
Laatst was ik weer eens aan het klussen aan m'n stackbased UBB parser en bedacht ik me dat ik eigenlijk meer flexibiliteit in de tagnesting configuratie ed. wilde hebben.
Nu bedacht ik mij dat het geheel steeds meer op het parsen van bijvoorbeeld XML gaat lijken.

Wat ik me afvraag is of UBB ook te parsen is met een generieke XML parser.
Dus een DTD schrijven voor de UBB tagset en daarmee het geheel parsen en een XSLT gebruik om het naar HTML om te zetten.

Daarbij vraag ik me af of de volgende dingen in deze structuur kunnen:
-Het werken met blokhaken ipv. gewone XML haken
-Het parsen ondanks dat de source niet valide is volgens het DTD
-Het 'aanvullen' van de source als tags niet afgesloten zijn

Iemand hier ideeen over of zelfs ervaringen mee?

Who is John Galt?


  • Limhes
  • Registratie: Oktober 2001
  • Laatst online: 19-08 19:06
Je zou dat wel kunnen doen, maar <em>deze regel</em> is toch helemaal <i>geen <b>geldige</b></i> XML, aangezien er ook stukken tussen zitten <b>zonder</b> tags.

  • justmental
  • Registratie: April 2000
  • Niet online

justmental

my heart, the beat

Topicstarter
Limhes schreef op 05 augustus 2002 @ 15:30:
Je zou dat wel kunnen doen, maar <em>deze regel</em> is toch helemaal <i>geen <b>geldige</b></i> XML, aangezien er ook stukken tussen zitten <b>zonder</b> tags.
Dan kan ik toch '<post>' en '</post>' om om het hele stuk heen zetten, of werkt dat niet?

Who is John Galt?


  • Limhes
  • Registratie: Oktober 2001
  • Laatst online: 19-08 19:06
Nee want dan heb je een structuur met gaten. Vergelijk:
code:
1
2
3
4
5
6
7
8
<post>
  <b>
    titel ofzo
  </b>
  <verder>
    lalala
  </verder>
</post>


code:
1
2
3
4
5
6
<post>
  <b>
    titel ofzo
  </b>
  lalala
</post>


edit:

Ik bedenk me net dat een XML parser het misschien toch kan parsen (al is het geen mooie structuur...)

  • Juup
  • Registratie: Februari 2000
  • Niet online
Het zal afhangen van de XML parser maar iha zal het niet werken. En zeker niet als dat document zich niet aan de DTD houdt.

Een wappie is iemand die gevallen is voor de (jarenlange) Russische desinformatiecampagnes.
Wantrouwen en confirmation bias doen de rest.


  • Jelmer
  • Registratie: Maart 2000
  • Laatst online: 07:06
<plain> misschien voor tekst zonder opmaak?

  • MisterData
  • Registratie: September 2001
  • Laatst online: 26-08 21:52
Limhes schreef op 05 augustus 2002 @ 15:34:
Nee want dan heb je een structuur met gaten. Vergelijk:
code:
1
2
3
4
5
6
7
8
<post>
  <b>
    titel ofzo
  </b>
  <verder>
    lalala
  </verder>
</post>


code:
1
2
3
4
5
6
<post>
  <b>
    titel ofzo
  </b>
  lalala
</post>


edit:

Ik bedenk me net dat een XML parser het misschien toch kan parsen (al is het geen mooie structuur...)
kan wel gewoon worden geparsed hoor ;)

  • Sjaaky
  • Registratie: Oktober 2000
  • Laatst online: 22-08 16:45
Je kan ipv UBB ook overstappen op een ander invoerformaat. Hier heeft mbravenboer geloof ik PostingML voor bedacht.

  • justmental
  • Registratie: April 2000
  • Niet online

justmental

my heart, the beat

Topicstarter
Sjaaky schreef op 05 augustus 2002 @ 16:14:
Je kan ipv UBB ook overstappen op een ander invoerformaat. Hier heeft mbravenboer geloof ik PostingML voor bedacht.
Zat ik ook aan te denken, maar dan eigenlijk gewoon een subset van HTML, dat maakt knippen/plakken makkelijker.
Het principe blijft dan hetzelfde, dus de vragen ook ;)

Who is John Galt?

Pagina: 1