URL: https://linuxfr.org/users/lebouquetin/journaux/extraction-de-donnees-du-web-introduction-a-scrapy-journal-bookmark Title: Extraction de données du web - introduction à Scrapy (journal bookmark) Authors: LeBouquetin Date: 2015年01月30日T12:27:39+01:00 License: CC By-SA Tags: scrapy, python et crawler Score: 18 Bonjour, Ceci est un journal bookmark. [Scrapy](http://www.scrapy.org) est un framework python qui permet d'extraire des données structurées trouvées dans des sites web. Du crawling avec traitement de données. Comme dit sur le site de présentation : "An open source and collaborative framework for extracting the data you need from websites. In a fast, simple, yet extensible way." J'ai fait une présentation du framework hier au python user group de Grenoble (pyuggre comme on dit) ; si ça vous intéresse, la présentation est disponible sur Github, ainsi que les 3 exemples (dont un de crawling des news LinuxFR ;). - Voir les [slides de la présentation](http://lebouquetin.github.io/scrapy-presentation-pyuggre-01-2015/) - Voir [les sources des 3 exemples](https://github.com/lebouquetin/lebouquetin.github.io/tree/master/scrapy-presentation-pyuggre-01-2015)

AltStyle によって変換されたページ (->オリジナル) /