• # Surveillance de santé

    Posté par (site web personnel) . En réponse à la dépêche Glances affiche l'état de votre système en un clin d'oeil. Évalué à 5.

    Je m'attendais à un autre panneau utilisant smartctl (secteurs réalloués), hddtemp, sensors...
    Et pourquoi pas un stockage périodique des relevés (par exemple dans /var/run/health/) de façon à pouvoir générer des courbes et envoyer des messages d'alerte.

    Je suis actuellement sensibilisé à cela par disque qui avait 14 tracks réalloués il y a quelques semaines, puis 15, puis 19 et 20. Je suis en train de monter un nouvelle machine avec un nouveau disque. J'ai branché l'ancien et il a maintenant 31 défauts. Je constate que le nombre de défauts varie très peu en fonctionnement mais augmente à chaque nouvelle mise en route. Le seuil tolérable est de 36, je devrais pouvoir faire jouer la garantie qui s'achève en juin. Pour un disque de 750 Go, ça en vaut la peine.
    Sur le site de seagate, on peut savoir la date de fin de garantie.

    Voici un petite liste d'utilitaires :

    • Pour avoir le nombre de défauts en ligne de commande : smartctl -a /dev/sdb | grep Reallocated
    • Pour connaître les paramètres du disque en mode graphique : gsmartcontrol (l'onglet Attributes de mon sdb est devenu rouge).
    • Les températures de disques : hddtemp /dev/sd[ab]
    • caractéristiques sommaires d'un disque : hdparm -tT /dev/sdb
    • Performances des disques : bonnie++
    • sensors

    NB: L'utilitaire nvidia indique la température du processeur vidéo mais il n'est pas utilisable en ligne de commande.