(bien sûr, pas de (...) dans les adresses, avatar de la reconnaissante automagique par les templates de linuxfr)
Avec ça, tu examines les 500 "premières" pages d'accueil de la rubrique journal, et récupères chaque journal dans chacune de ces pages. Reste à faire les regexp qui vont bien pour extraire les auteurs, commentateurs, notes, ... Tu pourras nous produire les stats des contributions, nombre de réponses, trolleurs fous, etc. : de quoi occuper ta soirée !
Ils vont être contents, du côté du serveur de linuxfr...
# Re: DLFP mieux à vent ?
Posté par mouling . En réponse au journal DLFP mieux à vent ?. Évalué à 4.
#!/usr/bin/perl
use LWP::Simple;
for ($i=1;$i<500;$i++) {
$journaux= get("http://www.linuxfr.org/journal/index,$i.html(...)") ;
while ($journaux =~ /<a href="..(\/[^\/]+\/\d+.html)">Lire le journal/g) {
$journal = get("http://www.linuxfr.org(...)".1ドル) ;
print STDOUT $journal ; # ou autre...
}
}
(bien sûr, pas de (...) dans les adresses, avatar de la reconnaissante automagique par les templates de linuxfr)
Avec ça, tu examines les 500 "premières" pages d'accueil de la rubrique journal, et récupères chaque journal dans chacune de ces pages. Reste à faire les regexp qui vont bien pour extraire les auteurs, commentateurs, notes, ... Tu pourras nous produire les stats des contributions, nombre de réponses, trolleurs fous, etc. : de quoi occuper ta soirée !
Ils vont être contents, du côté du serveur de linuxfr...