URL: https://linuxfr.org/forums/programmation-perl/posts/r%C3%A9cup%C3%A9rer-les-tableaux-dune-page-html Title: Récupérer les tableaux d'une page HTML Authors: Ontologia Date: 2008年06月25日T18:46:53+02:00 Tags: Score: 0 Bonjour, je me perd un peu avec la caractère dynamiquement typé de perl, car j'ai du mal à récupérer le contenu HTML des cases des tableaux contenus dans une page HTML. J'ai le script suivant : #!/usr/bin/perl use LWP::Simple; use LWP::UserAgent; use HTML::TableExtract; # recup de STDIN dans une string my $holdTerminator = $/; undef $/; my $buf = ; $/ = $holdTerminator; my @lines = split /$holdTerminator/, $buf; $buf = "init"; $buf = join $holdTerminator, @lines; my $te; my $ts; my $row; my $capture = $buf; $depth = 0; $count = 0; while ($depth <= 10) { £spaces£ £/spaces£DoLoop(); £spaces£ £/spaces£$depth++; } sub DoLoop { £spaces£ £/spaces£for ($i = 0; $i <= 10; $i++) £spaces£ £/spaces£{ £spaces£ £/spaces£$te = HTML::TableExtract->new( depth => "$depth", count => $i ); £spaces£ £/spaces£$te->parse($capture); £spaces£ £/spaces£my $table = $te->first_table_found; £spaces£ £/spaces£foreach my $ts ($te->tables) { print "Table found at ", $ts->coords, ":\n"; foreach $row ($ts->rows) { £spaces£ £/spaces£#my $truc = $row->as_text; foreach my $truc ($row) { #my $quoi = $truc->text; foreach my $quoi ($truc) { print $quoi; } £spaces£ £/spaces£} £spaces£ £/spaces£#print "$truc\n"; £spaces£ £/spaces£} £spaces£ £/spaces£} £spaces£ £/spaces£} } Là je sèche, parce que malgré la doc [http://search.cpan.org/dist/HTML-TableExtract/lib/HTML/Table(...)](http://search.cpan.org/dist/HTML-TableExtract/lib/HTML/TableExtract.pm) et [http://search.cpan.org/~petek/HTML-Tree-3.23/lib/HTML/Elemen(...)](http://search.cpan.org/~petek/HTML-Tree-3.23/lib/HTML/Element.pm) j'arrive pas à déterminer si j'obtiens des choux ou des carottes, et surtout comment récupérer ce fichu html... Quelqu'un a l'habitude d'utiliser cette lib ?

AltStyle によって変換されたページ (->オリジナル) /