• # NIH et autres considérations

    Posté par . En réponse à la dépêche Focus sur les performances avec Fim 1.2.0. Évalué à 2. Dernière modification le 02 juin 2016 à 13:34.

    J'ai des besoins de gestion de fichiers qui pourrait être couverts par FIM.
    En particulier, j'ai une vilaine tendance à dupliquer mes fichiers de travail un peu partout, sur plusieurs machines, sur plusieurs disques externes.
    Cette tendance est à la baisse depuis la création de mon instance d'un owncloud sur un serveur en datacenter. Mais j'ai encore un gros travail de consolidation à faire.

    J'ai fait un bout de script python+lmdb qui me permet de détecter des doublons, basé lui aussi sur SHA2.

    Je trouve certains choix de Fim pertinents :
    - interface calquée sur celle d'un VCS (svn ou git) : init, commit, diff, etc.
    - prise d'empreinte à différent points d'un fichier pour accélérer le diff

    Par contre mon script python ne prend que quelques MB de RAM quelque soit le nombre de fichiers et sous-répertoires ; Ce grâce à LMDB qui fait du mmap (allocation de l'espace mémoire de l'index hors du heap, utilisant le cache FS). Alors quand je vois "JAVA_OPTIONS="-Xmx4g -XX:MaxMetaspaceSize=4g" dans le script de lancement, je fais un bon. Ce n'est même pas la RAM que j'ai sur ce serveur (2GB).