• [^] # Re: comment récupérer les données d'une page html

    Posté par (site web personnel) . En réponse au journal comment récupérer les données d'une page html. Évalué à 1.

    Au temps pour moi, il y avait aussi blockquote dans la page que j'ai copiée, plus tous les tags autorisés, templeet a fait comme il faut.

    Si tu as 200 pages à faire, je me demande si on peut faire ça avec un petit script contenant des -remote
    [ Execute in an already running Mozilla process. For more info, see: http://www.mozilla.org/unix/remote.html(...) ]

    Simmple, efficace.

    un truc du genre
    #!/bin/bash
    DESTDIR= met ici le répertoire de destination
    for i in $(find . -name "*.html")
    do
    mozilla -remote "openFile(file://$(pwd)${i})"
    mozilla -remote "saveAs(file://${DESTDIR}${i}, text)"
    done

    Sous réserve que le -remote saveAs qui ne marche pas sur ma version (mozilla 1.0) ait été fixé depuis ...