• [^] # Re: Weboob

    Posté par (site web personnel, Mastodon) . En réponse au journal Extraction de données du web - introduction à Scrapy (journal bookmark). Évalué à 10.

    La différence que je vois avec Scrapy, c'est que Browser 2 dispose de nombreux filtres qui font pas mal de boulot et permettent d'éviter de manipuler soit même du xpath. On décrit ce qu'on veut récupérer plus que faire le traitement soi-même. Je vous renvoie à cet article pour un peu plus d'info.

    Dans l'article que tu pointes, Browser2 s'appuie aussi sur XPath. Quand tu as ceci dans Browser2 :

    obj_id = Regexp(Link('.//a'), r'/videos/(.+).html')

    Tu as l'équivalents dans Scrapy :

    obj_id = response.xpath('.//a/@href').re(r'/videos/(.+).html')

    Je n'ai pas compris la différence.

    #tracim pour la collaboration d'équipe __ #galae pour la messagerie email __ dirigeant @ algoo