[regex] Performance posts parsen

Pagina: 1
Acties:

  • justmental
  • Registratie: April 2000
  • Niet online

justmental

my heart, the beat

Topicstarter
Zoals vele anderen ben ook ik bezig met een forum gedeelte voor m'n web-platform.
Hierin parse ik ook posts met een vergelijkbare functionaliteit als hier op GoT.

Dit doe ik nu met perl-achtige regex functies.
Nu valt de performance hiervan mij echter tegen en ik zit erover te denken om zelf een parser te schrijven met eenvoudiger replace functies.

Nu voorzie ik enkele problemen:
-hoofdletters/kleine letters -> [Link=fdhdfghdfhdf]linkje[/link] bijvoorbeeld.
-verschillen in open/sluit combinaties -> bij een link horen de open en sluit tags bij elkaar, maar bij quote bijvoorbeeld de eerste bij de laatste.
-niet afgesloten tags.
-rare combinaties -> [link]hallohallo[link]linkje[/link] test[/link].

Zijn er nog meer problemen te voorzien?
En heeft er iemand ervaring met de haalbaarheid/opzet van zoiets?

Who is John Galt?


  • tomato
  • Registratie: November 1999
  • Niet online
Zoek eens op stackbased ubb parser in dit forum (als dat kan, geen zin om te checken...)

* tomato heeft hier nog wel een aardige liggen *D

  • LuCarD
  • Registratie: Januari 2000
  • Niet online

LuCarD

Certified BUFH

Er zijn al diverse parse engine's gemaakt. Voornamelijk gebaseerd op UBB.

En ik heb een leuke gezien die was geloof ik van ACM.
(waar blijft de codebase? :( :( )

[edit]
* LuCarD is weer eens te laat

Programmer - an organism that turns coffee into software.


  • D2k
  • Registratie: Januari 2001
  • Laatst online: 31-08 10:19

D2k

[topic=178042/1/25]

deze thread dus :)

Doet iets met Cloud (MS/IBM)