URL: https://linuxfr.org/users/yellowiscool/journaux/un-projet-tout-neuf Title: Un projet tout neuf Authors: yellowiscool Date: 2011年02月04日T00:10:33+01:00 Tags: Score: 10 Bonjour, je vous écris pour vous faire part d'un projet auquel je réfléchis depuis longtemps maintenant. C'est légèrement utopique, mais je pense qu'avec les avancées techniques, c'est réalisable. L'idée est toute simple, archiver le web. Ça fait peur comme ça. Sachez que je connais bien webarchive, le logiciel libre qui est utilisé notamment par une bibliothèque à Paris, le cache google, et bien d'autres certainement. Ce que j'aimerais faire est un système différent de ce qui existe déjà. J'avais codé pour moi l'année dernière, une petite application permettant de sauvegarder une page web. Ça utilisait un wget récent, qui permet aussi de récupérer les images et les feuilles de style de la page, un système de catégories à base de dossiers et de liens symboliques, et le gestionnaire de version git. Seulement, ce n'est pas vraiment pratique, mais ce n'est surtout pas ouvert aux débutants en informatique. Et on l'a vu récemment, les débutants en informatique, ils font quand même des choses biens avec des outils critiquables. Mon projet, est de repartir de l'idée de sauvegarder des pages web, mais de rendre le système accessible à tous dans un site web. Imaginez un site web où il suffirait de noter une url, pour qu'elle soit immédiatement sauvegardée dans une base de données communautaire. Il n'est pas question d'utiliser des robots qui parcourent le web, mais bien de sauvegarder à la demande. Entre des robots et des humains, la différence est vite faite. Les pages seraient versionnées, avec git par exemple. Si une page est déjà dans le dépôt, et qu'une nouvelle demande de sauvegarde est réalisée, le site pourrait permettre de constater des différences de contenu si il y en a. Utiliser un système de version décentralisé, toujours avec git par exemple, permettrait de décentraliser la base. Le site pourrait être installé sur de nombreux serveurs, et les différents dépôts synchronisés entre eux. Avec évidemment un site principal, qui proposerait plus de garantie sur le contenu (enfin pas trop non plus). Le produit final se présenterait donc sous la forme d'un catalogue de pages webs, classées soigneusement. On pourrait consulter un article d'une certaine date, et observer son historique : date de première importation, quelques modifications, et suppression de l'article avec l'apparition d'une page d'erreur 404 par exemple. Pour éviter de sauvegarder n'importe quoi, une censure pourrait être effectuée, par la communauté. En ce qui concerne les droits, je suis dans un léger flou dans ce domaine. J'imagine bien qu'il est possible de garder une copie de ce que l'on télécharge (mais encore), mais de proposer ensuite le contenu en accès libre... Google et webarchive le font bien. Quoi qu'il arrive, je n'abandonnerais pas ce projet pour des questions de cet ordre. Si il faut mettre le serveur dans un pays plus souple sur ces questions, le serveur sera dans un autre pays. J'écris ce journal pour avoir vos avis sur ce projet, et pourquoi pas, faire la connaissance de gens qui seraient intéressés pour participer à ce projet, si il se réalise. Est-ce que le projet vous semble utile ? Est-ce que le projet est réalisable ? Selon vous, ce projet va t'il faire un flop ? Vous avez certainement des critiques très intéressantes. Si vous voulez participer au projet, qui pourrait se faire plus ou moins rapidement, n'hésitez pas à le dire dans les commentaires, ou par message privé. Merci pour votre attention.