Hoi,
Ondanks zoeken op Google en GoT wel heel erg veel RSS clients gevonden, maar allemaal zonder de functionaliteit die ik zoek. Heeft iemand een link voor een programma die het volgende doet?
Wat ik wil is de tekst van de originele artikelen downloaden. Als je een RSS feed bekijkt van bijvoorbeeld CNN, dan kan je normaal gesproken op de headline klikken, waarna in een browser het originele artikel op www.cnn.com getoond wordt. Ik wil graag de teksten uit het originele artikelen van www.cnn.com verzamelen op m'n harde schijf. Het volstaat om het HTML document te bewaren zonder alle images en dergelijke. Het gaat me louter om de tekst. Het maakt me niet uit of de documenten gesplitst bewaard worden of niet.
Reden hiervoor is dat ik een statistische analyse wil doen van taalgebruik en daar heb ik heel erg veel documenten voor nodig. Hoewel ik niet specifiek in de inhoud van een individueel document geinteresseerd ben moet ik ze daarvoor wel allemaal bekijken. Ik zou ook naar de Excerpts kunnen kijken, maar dan heb ik per artikel te weinig tekst.
Ik heb al gezocht op allerlei combinaties met "rss" "aggregator" "client" etc. er in, maar ik kom alleen maar standaard clients tegen en daarvan heb ik er inmiddels een stuk of tien uitgeprobeerd maar allemaal zonder deze functionaliteit.
Ondanks zoeken op Google en GoT wel heel erg veel RSS clients gevonden, maar allemaal zonder de functionaliteit die ik zoek. Heeft iemand een link voor een programma die het volgende doet?
Wat ik wil is de tekst van de originele artikelen downloaden. Als je een RSS feed bekijkt van bijvoorbeeld CNN, dan kan je normaal gesproken op de headline klikken, waarna in een browser het originele artikel op www.cnn.com getoond wordt. Ik wil graag de teksten uit het originele artikelen van www.cnn.com verzamelen op m'n harde schijf. Het volstaat om het HTML document te bewaren zonder alle images en dergelijke. Het gaat me louter om de tekst. Het maakt me niet uit of de documenten gesplitst bewaard worden of niet.
Reden hiervoor is dat ik een statistische analyse wil doen van taalgebruik en daar heb ik heel erg veel documenten voor nodig. Hoewel ik niet specifiek in de inhoud van een individueel document geinteresseerd ben moet ik ze daarvoor wel allemaal bekijken. Ik zou ook naar de Excerpts kunnen kijken, maar dan heb ik per artikel te weinig tekst.
Ik heb al gezocht op allerlei combinaties met "rss" "aggregator" "client" etc. er in, maar ik kom alleen maar standaard clients tegen en daarvan heb ik er inmiddels een stuk of tien uitgeprobeerd maar allemaal zonder deze functionaliteit.