[php/regex] urls grabben.

Pagina: 1
Acties:
  • 177 views sinds 30-01-2008
  • Reageer

  • chris
  • Registratie: September 2001
  • Laatst online: 11-03-2022
Ik wil graag alle urls van een pagina grabben. Ik gebruik hiervoor de volgende code:
PHP:
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
<?
//Inhoud vd pagina
$fn="Hier de inhoud van de pagina";

//Blaat
$regs=array();

//Mijn regex
$url="<a href=\"(.*)\">.*</a>";

/Regex uitvoeren
eregi($url, $fn, $regs);

//Kijken wat er in de array staat.
print_r($regs);
?>

En dan staat dus de complete pagina als string in $fn. Als ik deze code uitvoer, dan krijg ik in $fn[0] een mooie url, maar in $fn[1] krijg ik alle urls achter elkaar, want php zoekt dus door totdat 'ie de laatste </a> heeft gevonden. Weet iemand hoe het wel moet?

  • chris
  • Registratie: September 2001
  • Laatst online: 11-03-2022
Hmz dit is al gelukt. Ik heb nou nog een vraag. Hoe kan ik een serie van nummers, een spatie, en weer een serie van nummers eruithalen? Dus bijvoorbeeld:
code:
1
000 93712

Ik heb het geprobeerd met deze regex:
PHP:
1
2
3
<?
$regex="[[:digit:]*] [[:digit:]*]";
?>

Maar dit werkt niet.....
Iemand een idee?

  • brammetje
  • Registratie: Oktober 2000
  • Laatst online: 12-01-2025
PHP:
1
2
3
<?
$regex="[0-9]{3} [0-9]{5}";
?>

?

Verwijderd

ik zou iig + ipv * gebruiken.
Anders krijg je een match op elke spatie...

  • chris
  • Registratie: September 2001
  • Laatst online: 11-03-2022
Na veel geklooi ben ik er uit:
PHP:
1
2
3
<?
$regex="([[:digit:]]+ [[:digit:]]+)";
?>