Techniquement, comment ? Je ne sais pas. Mais je serais curieuse d'explorer l'idée.
Tu configures ton serveur web.
Si la requête arrive avec un cookie, tu la laisse passer normalement.
Si la requête arrive sans cookie, tu sers une page qui installe un cookie et contient le texte "protection anti robot. appuyez sur F5 ou control+R pour entrer."
Y'a sûrement moyen de rendre le truc plus compliqué, genre un cookie qui dépend (de façon non triviale, genre sel+hash) de l'IP qui fait la requête, pour empêcher qu'il soit réutilisé par quelqu'un d'autre. Mais là, tu risques de commencer à bloquer les gens qui utilisent Tor, par exemhle.
Ça va fonctionner avec les robots de scrapping: la page ne contenant aucun lien, ils ne vont pas se rendre compte qu'il y a tout un site à découvrir derrière. Ça ne marchera pas avec le pur DDoS dont le but est d'envoyer des requêtes en masse, peu importe le contenu, pour faire tomber le serveur.
Je commence à me demander si on est pas dans ce deuxième cas: le but serait oe rendre le web "normal" invivable, et oe pousser un maximum de choses à passer à travers cloudflare, permettant à ce dernier et au gouvernement américain d'espionner facilement tout le traffic comme ils le faisaient par d'autres moyens avant le déploiement généralisé de https. L'excuse des robots scrappers pour les LLM étant parfaite pour qu'on ne cherche pas d'où ça vient. Est-ce que je vire parano-complotiste?
[^] # Re: Reload
Posté par pulkomandy (site web personnel, Mastodon) . En réponse au journal Comment bannir (presque) tout internet. Évalué à 10 (+8/-1).
Tu configures ton serveur web.
Si la requête arrive avec un cookie, tu la laisse passer normalement.
Si la requête arrive sans cookie, tu sers une page qui installe un cookie et contient le texte "protection anti robot. appuyez sur F5 ou control+R pour entrer."
Y'a sûrement moyen de rendre le truc plus compliqué, genre un cookie qui dépend (de façon non triviale, genre sel+hash) de l'IP qui fait la requête, pour empêcher qu'il soit réutilisé par quelqu'un d'autre. Mais là, tu risques de commencer à bloquer les gens qui utilisent Tor, par exemhle.
Ça va fonctionner avec les robots de scrapping: la page ne contenant aucun lien, ils ne vont pas se rendre compte qu'il y a tout un site à découvrir derrière. Ça ne marchera pas avec le pur DDoS dont le but est d'envoyer des requêtes en masse, peu importe le contenu, pour faire tomber le serveur.
Je commence à me demander si on est pas dans ce deuxième cas: le but serait oe rendre le web "normal" invivable, et oe pousser un maximum de choses à passer à travers cloudflare, permettant à ce dernier et au gouvernement américain d'espionner facilement tout le traffic comme ils le faisaient par d'autres moyens avant le déploiement généralisé de https. L'excuse des robots scrappers pour les LLM étant parfaite pour qu'on ne cherche pas d'où ça vient. Est-ce que je vire parano-complotiste?