• [^] # Re: Résilience -- 3 points 1 question

    Posté par (site web personnel) . En réponse au journal Rapport sur la résilience de l'Internet en France. Évalué à 5.

    Le gros algo automatique pourrait être le cas d'erreur, en cas de grosse panique, histoire de gagner qq heures d'uptime ?

    Je ne suis pas sûr que le gros du downtime soit lié au protocole lui même ou a des erreurs d’architecture. Le dogme veut que les annonces soient faites par les routeurs de bordure. Du coup combien de routeurs continent d'annoncer des routes qu'ils n'ont plus (typiquement routeur à th2 serveurs à Courbevoie, lien th2 / Courbevoie tombé). Ce problème s'évite pourtant très simplement en faisant les annonces depuis Courbevoie et en les relayant à th2. Mais c'est contre le dogme.

    Pareillement l'injection d'une route par défaut en dur dans le noyau permet d'éviter les pannes en cas de plantage des daemon de routage.

    Enfin en général les gens essayent de tout faire passer par un ou deux énormes routeurs proprios alors qu'en divisant astucieusement leur réseau ils pourraient se contenter d'équipements plus légers, plus divers et minimiser l'impact des pannes.

    Je ne suis pas expert mais je pense qu'a la base des grandes pannes, il y a toujours une erreur d'architecture ou un manque de diversité. Le protocole est secondaire.