• [^] # Re: Même problème qu'avec Weboob?

    Posté par . En réponse au journal Demerdification de prévisions météo avec Puppeteer. Évalué à 3.

    Or dans le cadre de l'accès à la donnée personnelle, on peut assez légitimement s'appuyer sur le GDPR et la notion de portabilité, pour justifier l'automatisation de l'extraction.

    Ça me semblerait à la fois plus pratique, plus légal, et plus fiable d'exiger l'extraction d'une archive complète contenant ses données personnelles. Ensuite tu analyses ton archive en local comme tu veux, mais balancer des requêtes à un site destiné à interagir avec un utilisateur humain semble largement sous-optimal.

    Dans le cas de w[ebb]oob, de toutes manières, je ne vois pas du tout de distinction technique entre les deux. Il suffirait de trouver un jeu de mots graveleux avec "météo", et hop, tu peux utiliser un cadre de développement un peu plus abouti que des scripts qui trainent...

    Je ne suis pas en train de dire que le scraping c'est bien ou c'est mal, ça dépend qui et quoi. Mais c'est quand même la pire solution, que ce soit pour le développement lui-même (c'est quand même 99% de bricolage crade et de reverse-engineering), la maintenance, et la sécurité juridique. Et même pour le site cible, puisque même s'il est de bonne foi et qu'il encourage la récupération de données, il ne va pas pouvoir changer son architecture sans pêter les outils de scaping, ce qui risque quand même d'empêcher son évolution.