Aller au contenu
Wikipédia l'encyclopédie libre

Système de fichiers distribué

Un article de Wikipédia, l'encyclopédie libre.
Si ce bandeau n'est plus pertinent, retirez-le. Cliquez ici pour en savoir plus.
Si ce bandeau n'est plus pertinent, retirez-le. Cliquez ici pour en savoir plus.

La mise en forme de cet article est à améliorer ().

La mise en forme du texte ne suit pas les recommandations de Wikipédia: il faut le «wikifier».

Comment faire?

Les points d'amélioration suivants sont les cas les plus fréquents. Le détail des points à revoir est peut-être précisé sur la page de discussion.

  • Les titres sont pré-formatés par le logiciel. Ils ne sont ni en capitales, ni en gras.
  • Le texte ne doit pas être écrit en capitales (les noms de famille non plus), ni en gras, ni en italique, ni en «petit»...
  • Le gras n'est utilisé que pour surligner le titre de l'article dans l'introduction, une seule fois.
  • L'italique est rarement utilisé: mots en langue étrangère, titres d'œuvres, noms de bateaux,etc.
  • Les citations ne sont pas en italique mais en corps de texte normal. Elles sont entourées par des guillemets français: «et».
  • Les listes à puces sont à éviter, des paragraphes rédigés étant largement préférés. Les tableaux sont à réserver à la présentation de données structurées (résultats,etc.).
  • Les appels de note de bas de page (petits chiffres en exposant, introduits par l'outil « Source») sont à placer entre la fin de phrase et le point final[comme ça].
  • Les liens internes (vers d'autres articles de Wikipédia) sont à choisir avec parcimonie. Créez des liens vers des articles approfondissant le sujet. Les termes génériques sans rapport avec le sujet sont à éviter, ainsi que les répétitions de liens vers un même terme.
  • Les liens externes sont à placer uniquement dans une section «Liens externes», à la fin de l'article. Ces liens sont à choisir avec parcimonie suivant les règles définies. Si un lien sert de source à l'article, son insertion dans le texte est à faire par les notes de bas de page.
  • La présentation des références doit suivre les conventions bibliographiques. Il est recommandé d'utiliser les modèles {{Ouvrage}}, {{Chapitre}}, {{Article}}, {{Lien web}} et/ou {{Bibliographie}}. Le mode d'édition visuel peut mettre en forme automatiquement les références.
  • Insérer une infobox (cadre d'informations à droite) n'est pas obligatoire pour parachever la mise en page.

Pour une aide détaillée, merci de consulter Aide:Wikification.

Si vous pensez que ces points ont été résolus, vous pouvez retirer ce bandeau et améliorer la mise en forme d'un autre article.

En informatique, un système de fichier distribué (DFS ou « distributed filesystem ») [1] , est un protocole d'agrégation de ressources en réseau collectant des points d'entrée de multiple serveurs de fichier physiques actifs au sein du réseau, pour présenter les données au client (un utilisateur, ou une application) sous une dénomination unique. Le client en ignore ainsi la véritable localisation physique, et peut se servir de ces données de façon transparente, par exemple sans avoir à chaque fois à redéfinir un chemin d'accès précis. Voir plus bas au niveau des clarifications terminologiques, il serait souhaitable d'utiliser en France la terminologie système de fichiers agrégé (en réseau).

Description

[modifier | modifier le code ]

Le système de fichier distribué est par essence un système de fichiers en réseau. Le qualificatif « distribué » implique que les fichiers sont issus de sources (serveurs) multiples. Cela ne fait aucunement référence au fait qu'il y ait de multiple clients pour une source unique, puisque c'est la caractéristique même d'un système de fichier en réseau de s'exposer à plusieurs clients, ce n'est pas particulier à un système de fichier distribué.

Le système de fichier distribué expose donc fondamentalement plusieurs serveurs de fichiers face à plusieurs clients sous un mécanisme simplifié effaçant aux yeux du client final la présence réelle de sources multiples, alors qu'un simple système de fichier en réseau (non distribué), expose traditionnellement un serveur face à plusieurs clients.

Associé à une option de réplication, le système de fichier distribué assure une sauvegarde des données afin d'en assurer aussi la redondance le cas échéant.

Le « clustered filesystem » (CFS), ou en traduction littérale système de fichier organisé par grappe de serveurs, est une catégorie particulière de système de fichier distribué qui se caractérise par le fait que le « cluster » va présenter les fichiers aux clients réseau sous un point d'accès unique, ici un « block device » autorisant des accès concurrents de la part de plusieurs noeuds réseau. Dans un système de fichier distribué simple, un même fichier peut se trouver présent simultanément en de multiples noeuds réseau, par exemple sur les ordinateurs personnels de plusieurs utilisateurs, dans ce cas il y a un système de synchronisation qui assure que le fichier soit identique pour tout le monde. Si une source devient indisponible, il sera possible de « ressourcer » le fichier d'un autre endroit réputé détenir la même copie. Dans un système de fichier par grappe de serveur, le fichier en question se présente sur un noeud réseau unique, mais derrière le système va assurer la relation avec plusieurs serveurs physiques.

Pour un cas d'usage typique d'une architecture en « cluster », on va plus rechercher la performance en distribuant la charge réseau sur plusieurs serveurs physiques répliqués pour éviter les goulets d'étranglement.

L'utilisateur final ne verra pas la différence entre un système distribué simple et un « clustered filesystem », il s'agit d'une différence d'ordre technique qui intéresse avant tout les services informatiques et qui va les orienter sur leur choix en fonction de ce qu'ils préfèrent en termes d'architecture réseau. GlusterFS, CephFS sont par exemple des systèmes de fichier organisés en « cluster »[2] ou grappe.

Clarifications terminologiques

[modifier | modifier le code ]

DFS, CFS, « network filesystem » sont des notions couramment confondues, même dans la littérature anglaise. Ajoutons que le terme français « distribué » est ici un (mauvais) calque de son homologue anglais « distributed » qui conduit à une confusion assez courante laissant penser de prime abord que cela ferait référence à une relation « one to many » (un serveur vers de multiples clients), relation qui est par essence la base de tout système de fichier en réseau... mais qui ne sont pas obligatoirement des DFS. Le mot « distribué » en respectant le contexte et l'acception anglaise fait ici référence à la notion d'agrégation de sources multiples pour constituer l'illusion d'un système de fichier monolithique, et il implique une mise en réseau, l'adoption de la terminologie française « système de fichier agrégé en réseau » serait plus souhaitable.

Ainsi le protocole de partage Microsoft Windows connu tantôt sous l'acronyme CIFS, et pour les versions les plus récentes sous le protocole SMB, est souvent présenté comme un système de fichier distribué, ce qui est faux. Un ensemble de serveurs Windows généreront bien un système de fichier distribué uniquement si la fonctionnalité DFS est activée. Si le protocole DFS n'est pas activé chaque serveur agira comme autant de serveurs indépendants, ce qui impliquera pour l'utilisateur de se connecter à chaque fois sur des adresses réseau différentes. Monter un serveur de fichiers SMB sur un ordinateur personnel sous Windows ou Linux (via le paquet Samba) n'en fera donc pas un système de fichier distribué, le système de fichier distribué impliquant dans tous les cas à minima plusieurs serveurs.

SMB (partage Windows ou Samba sous Linux), est avant tout un protocole d'accès réseau aux fichiers (« network filesystem »), que le système de fichiers en dessous soit agrégé, « clusterisé » ou non, ce sont des aspects qui ne sont pas le sujet de la norme SMB, l'agrégation ou DFS est prise en charge par une autre couche logiciel. La remarque est la même pour le partage en réseau NFS sous les systèmes de la famille Unix élargie.

Finalités

[modifier | modifier le code ]

Le système de fichier distribué est un protocole d'agrégation de ressources en réseau qui :

- assure le partage des données au sein d'une organisation d'une façon plus simple et efficace

- assure la redondance et la sauvegarde de ces données

- permet l'évolutivité de l'architecture des données en réseau, en étant capable d'agglomérer de façon dynamique de nouvelles ressources réseau.

- permet des opérations de migration physique de données en toute transparence[3] .

- assure la performance du réseau en répartissant la charge de travail entre plusieurs serveurs, ce qui sera particulièrement vrai d'une architecture en « cluster » (grappe).

Articles connexes

[modifier | modifier le code ]

Références

[modifier | modifier le code ]
  1. (en-US) Nutanix, « Distributed File Systems - What is DFS? | Nutanix », sur www.nutanix.com, (consulté le )
  2. (en) « Difference between a distributed and a cluster file system », sur Unix & Linux Stack Exchange (consulté le )
  3. « OpenAFS », sur www.openafs.org (consulté le )

AltStyle によって変換されたページ (->オリジナル) /