Mais j’ai vite déchanté : mon premier problème concerne la difficulté de créer la dite archive. Impossible de trouver un outil à la ligne de commande facilement installable, donc j’ai finis par me rabattre, à contre-cœur, sur un site « Zim It » (dont je ne retrouve plus l’adresse...) qui m’a permis, étant donné l’URL, de télécharger l’archive Zim correspondante.
Ce n'est pas évident du tout de refaire des sites locaux à partir de site "en-ligne". On a des outils spécialisés pour les gros sites qu'on fourni (mwoffliner pour tout les mediawiki, sotoki pour stackoverflow, ...). Mais ils sont vraiment spécifique au format du site.
Et ils ne sont pas forcement sobre en ressources et en temps.
Qu’est-ce que j’ai raté pour créer l’archive facilement, en tant que commun des mortel·le·s ?
Pas vraiment, non. Mais si t'es content·e de la version offline créée avec wget -R, tu peux la mettre dans un zim avec zimwriterfs.
Est-ce que la taille de l’archive est dû au site utilisé, ou bien est-ce un « problème » connu ? (pour référence, le site c’est https://www.libraryofjuggling.com)
Non, c'est pas connu, et c'est surprenant. Si t'as le temps, tu peux créer une issue sur libzim avec toute les infos, ça nous aiderait beaucoup.
Après, on stocke une base de données xapian dans le zim pour faire de la recherche fulltext, c'est peut-être elle qui gonfle l'archive.
Suis-je vraiment le type d’utilisateur·ice envisagé par Zim ?
Oui :)
On est plus orienté utilisateurs finaux qui vont juste consulté les archives mais c'est principalement du à la difficulté de scrapper des sites de manière générique (d'où la création de youzim.it). Dans l'idée on s'adresse aussi au gens qui veulent créer leurs archives.
Si oui, comment peut-on améliorer cette première expérience avec Zim ?
Déjà, en remontant l'information. Ça nous permettra au moins de savoir où il faut s'améliorer.
Ensuite, c'est un projet libre. Nous sommes grandement ouvert aux contributions, n'hésitez pas à venir nous parler et à corriger les problèmes.
[^] # Re: Une base de données ?
Posté par GaMa (site web personnel) . En réponse à la dépêche Jubako et Arx, un conteneur universel et son format d’archive. Évalué à 6. Dernière modification le 07 novembre 2022 à 13:25.
Ce n'est pas évident du tout de refaire des sites locaux à partir de site "en-ligne". On a des outils spécialisés pour les gros sites qu'on fourni (mwoffliner pour tout les mediawiki, sotoki pour stackoverflow, ...). Mais ils sont vraiment spécifique au format du site.
Et ils ne sont pas forcement sobre en ressources et en temps.
Le service zimit est là : https://youzim.it/
Pas vraiment, non. Mais si t'es content·e de la version offline créée avec
wget -R, tu peux la mettre dans un zim avec zimwriterfs.Non, c'est pas connu, et c'est surprenant. Si t'as le temps, tu peux créer une issue sur libzim avec toute les infos, ça nous aiderait beaucoup.
Après, on stocke une base de données xapian dans le zim pour faire de la recherche fulltext, c'est peut-être elle qui gonfle l'archive.
Oui :)
On est plus orienté utilisateurs finaux qui vont juste consulté les archives mais c'est principalement du à la difficulté de scrapper des sites de manière générique (d'où la création de youzim.it). Dans l'idée on s'adresse aussi au gens qui veulent créer leurs archives.
Déjà, en remontant l'information. Ça nous permettra au moins de savoir où il faut s'améliorer.
Ensuite, c'est un projet libre. Nous sommes grandement ouvert aux contributions, n'hésitez pas à venir nous parler et à corriger les problèmes.
Matthieu Gautier|irc:starmad