URL: https://linuxfr.org/forums/programmation-python/posts/script-python-impossible-de-ce-co-a-un-site
Title: script python impossible de ce co à un site
Authors: Zinzin
Date: 2016年03月30日T11:58:22+02:00
License: CC By-SA
Tags: script et python
Score: 0
Bonjour à tous
je débute en python, mais pour un stage je dois faire un petit script qui récupère des info sur une page web, les restructures et les affiches selon le besoin.
Jusque là pas de soucis, le problème que je rencontre c'est que la page nécessite une identification et comme le script et destiné à plusieurs pc je ne dois pas avoir besoin d'installer de librairies pour le faire fonctionner.
j'ai fais quelque chose que l'on peut sûrement optimiser mais impossible de récupérer les données, je m'explique :
Si je demande un affichage brut de la page je vois qu'il me retourne l'url suivi de :443
Pourtant dans les logs du site il indique logged in.
Je suppose qu'il y a un soucis avec les cookies ? Genre il ce connecte mais comme il gère mal les cookies au changement de page il n'est plus identifié...
Ou alors j'ai vraiment rien compris>< Du coup je vous donne la partie connexion et test d'affichage: ```ruby #!/usr/bin/python # -*- coding: utf-8 -*- import re, cookielib, urllib, urllib2 tab0=[] #tableau de travail i=0 #compteur username = 'UserTest' password = 'MdpTest00' # On active le support des cookies pour urllib2 cookiejar = cookielib.CookieJar() urlOpener = urllib2.build_opener(urllib2.HTTPCookieProcessor(cookiejar)) # On envoie login/password au site qui nous renvoie un cookie de session values = {'username':username, 'password':password } data = urllib.urlencode(values) request = urllib2.Request("https://network.societé.org/", data) url = urlOpener.open(request) # Notre cookiejar reçoit automatiquement les cookies print url # Test récupérartion des données htmlSource = urllib.urlopen("https://network.societé.org/devices/").read(100)#900000000) url = urlOpener.open(request) basesList = re.findall('