Sur les serveurs Google (d'après les diverses infos que j'en ai) les disques sont en raid 1 par exemple
Les serveurs embarquent par exemple une batterie (finalement un onduleur par serveur en quelque sorte)
Le stockage est en effet sur le serveur, mais pas totalement de la manière dont le tu décris : les serveurs embarquent GFS / Colossus / Big Table
Si on veut le faire en libre, on prend du Hadoop et HDFS par exemple. Mais en fait l'information est répartie + dupliquée (en général 3 fois).
On est pas sur un "simple serveur de fichier en web"
D'ailleurs il se pose au dessus de tout ça le "référencement" et l'accès à la donnée (zookeeper ?)
(le serveur 4cpu et 12 disques c'était plutôt avec 96Go de ram...)
Dans le genre de machine dont tu parles, si on regarde chez Dell il y a ce type de modèle qui est intéressant : http://www.dell.com/fr/entreprise/p/poweredge-c5125/pd
Des "micro" serveurs, un cpu, 2 ou 4 disques SATA. C'est une assez bonne solution aussi.
je ne vois pas l’intérêt du raid 1, c'est les machines qui sont dupliquées, le raid fait perdre trop de performance
Perte en raid matériel ça donne quoi ?
Après c'est une histoire de fiabilité. Tu as beau dupliquer ta donnée entre diverses machines, si tu en perd une tu surcharge le reste. Si tu perd un disque et que tu est en raid 1, ben tu le change à chaud et on en parle plus. Aucune perte de service ni de perf (enfin quasiment pas, le disque va juste bosser un peu lors de la reconstruction). Le raid n'est pas là pour garantir la donnée (la réplication est là pour çà) mais pour fiabiliser un minimum le matériel.
[^] # Re: Décision de justice ?
Posté par CrEv (site web personnel) . En réponse au journal megafermeture.fbi. Évalué à 3.
hum... suis pas certain du tout
Sur les serveurs Google (d'après les diverses infos que j'en ai) les disques sont en raid 1 par exemple
Les serveurs embarquent par exemple une batterie (finalement un onduleur par serveur en quelque sorte)
Le stockage est en effet sur le serveur, mais pas totalement de la manière dont le tu décris : les serveurs embarquent GFS / Colossus / Big Table
Si on veut le faire en libre, on prend du Hadoop et HDFS par exemple. Mais en fait l'information est répartie + dupliquée (en général 3 fois).
On est pas sur un "simple serveur de fichier en web"
D'ailleurs il se pose au dessus de tout ça le "référencement" et l'accès à la donnée (zookeeper ?)
(le serveur 4cpu et 12 disques c'était plutôt avec 96Go de ram...)
Dans le genre de machine dont tu parles, si on regarde chez Dell il y a ce type de modèle qui est intéressant : http://www.dell.com/fr/entreprise/p/poweredge-c5125/pd
Des "micro" serveurs, un cpu, 2 ou 4 disques SATA. C'est une assez bonne solution aussi.
Perte en raid matériel ça donne quoi ?
Après c'est une histoire de fiabilité. Tu as beau dupliquer ta donnée entre diverses machines, si tu en perd une tu surcharge le reste. Si tu perd un disque et que tu est en raid 1, ben tu le change à chaud et on en parle plus. Aucune perte de service ni de perf (enfin quasiment pas, le disque va juste bosser un peu lors de la reconstruction). Le raid n'est pas là pour garantir la donnée (la réplication est là pour çà) mais pour fiabiliser un minimum le matériel.
D'ailleurs, concernant Google :
D'après http://static.googleusercontent.com/external_content/untrusted_dlcp/research.google.com/en//university/relations/facultysummit2010/storage_architecture_and_challenges.pdf une machine classique embarque 6x1To (je trouve ça un peu étrange car je croyais que c'était en général 2 disques en raid1)
http://pro.01net.com/editorial/500596/google-leve-le-voile-sur-le-mystere-de-ses-serveurs/
Je dois avoir quelques autre liens qui trainent, mais faut que je les retrouve...
Tiens, y'a celui-là mais c'est un peu dépassé je crois http://www.slideshare.net/hasanveldstra/the-anatomy-of-the-google-architecture-fina-lv11