URL: https://linuxfr.org/forums/general-cherche-logiciel/posts/probl%C3%A8me-mat%C3%A9riel-grave-ram Title: Problème matériel grave... ram ? Authors: mansuetus Date: 2007年03月19日T21:06:17+01:00 Tags: Score: 0 En phase de pré-suicide avancé, je m'en remets à vous en dernier recours avant la pomme au cianure, pour finir en beauté. _[Mavie] Heureux propriétaire d'une carte mère Asus A8V deluxe, socket 939, avec de la ram samsung, 3 disques durs, un lecteur de CD et une carte video AGP matrox, je rencontrais parfois quelques plantages pas méchants type : on lance "kino", et poof ça plante (freeze) On lance "xdtv" et au bout de 2 minutes, la souris bouge plus, mais l'image continue... donc pas grave... Mais pour le reste, ça marchait quand même pas mal. ça s'est aggravé méchamment il y a quelques jours (2 semaines) : dès que ça chauffe l'ordi plante. (parfois "segfault" même sur des programmes qui n'y sont a priori pas sensibles ("sleep")). Accusant d'abord le processeur (cf. [http://linuxfr.org/forums/44/21081.html](http://linuxfr.org/forums/44/21081.html) ), j'en ai racheté un, compatible, et les erreurs sont revenues.... immédiatement. Je suis donc allé chez mon dealer favori, et j'ai sorti le grand jeu : nouvelle alim, nouvelle carte mère, nouvelle carte graphique (il n'a plus de carte mères AGP en socket 939). Les problèmes se sont faits plus rares, mais ont continué à me casser les bonbons assez vite, j'ai donc accusé Gentoo, à base de "emerge -e system" puis "emerge -Due world" ; qui passaient parfois (pour system) mais globalement, ça plantait au milieu avec des "general protection fault". J'ai utilisé ultimate boot CD : memtest86 pendant 24 heures : rien à signaler. lucifer donnait 6 erreurs en 1 heure, ce qui m'avait alarmé suffisamment pour acheter la nouvelle carte mère. (je suppose que l'alim était défectueuse et a transmis le cancer). Mais en regardant les erreurs de plus près, j'ai vu des lignes type : ERREUR : 212.1229129172891 mult 0.00000000 gave 0 ce qui ne m'a pas semblé être une erreur a priori et m'a donc déçu de ce petit soft. Bref, j'ai craqué, j'ai pris le forfait "hardware" chez mon dealer qui a scanné mon ordi je ne sais trop comment pour me dire que le lecteur de CD faisait des pannes... Ce qui est vrai pusique mon ordi plante objectivement moins depuis que je l'ai changé. Bref, ré-ré-ré-ré-installant gentoo sur le même bon vieux disque, j'ai fini par craquer et accuser ce dernier matériel non changé, et j'ai racheté un disque aujourd'hui. [/Mavie]_ Au bout de 6 heures de compilations sans erreurs, en plein emerge -Du --newuse world, j'ai eu droit à un "top" : invalid operation (ou truc du genre) suivi de "ps x" Segfault. J'ai remis le champagne au frais (j'y croyais vraiment) et j'ai remis le Gentoo liveCD dans le lecteur : au boot :
erreur dans libc.so.6 : could not find mallo" function.(mallo", là ou je suppose qu'il aurait du chercher malloc). donc je n'arrive plus à booter sur ce CD, mais je suppose (ça me l'a fait toute le semaine dernière) que si j'attends 2 heures ordi éteint, il va booter comme un coeur. (et planter plus tard). De l'ancienne machine, il ne reste que : 2 barettes de RAM samsung, que je repasse à memtest86+ (de Ultimate boot CD) dans le doute. 1 lecteur de disquettes. les cables sont neufs (j'ai pas voulu prendre de risques). Le pire, c'est que quand mon dealer m'a proposé un disque dur sous windows pour tester, je ne suis pas parvenu à le faire planter (bon, d'accord, je ne connais pas d'équivalent à emerge -Du world sous windows, en terme d'utilisations de ressources.) Ce qui m'interpelle, c'est que SI c'est la RAM (ce que je testerai demain, en empruntant deux barettes à mon dealer), pourquoi ça plante 6 fois de suite au démarrage, et plus quand c'est froid, et surtout, pourquoi "à chaud" memetest86 ne trouve rien ?! (il vient de finir une passe au moment où j'écris ces lignes, 0 errors) Questions : * memtest86 trouve-t'il "toutes" les erreurs de ram ? * Un lecteur de disquettes deffectueux peut il engendrer de telles erreurs ? * avez-vous une idée de la cause du problème ?! Florilège des erreurs obtenues (non notées donc peut être déformées) : * Spurious ACK in serio0 : some program might want to access hardware directly * bus error * losing too many ticks * Sigsegv * kernel pannic * general failure (façon kernel pannic) * IO error (sur le disque hda, alors que c'est un disque données non monté. (root : /dev/sda1) badblocks -n /dev/{sda,hda} ne donnent AUCUNE erreur). * Attempt to kill init * lib".so.6 : file not found (au boot, donc forcément, ça boot pas) * (ça boot avec plein d'erreurs). login marche, cd /etc/ ls : "fs$ab mtab in!t.d " (avec des caractères cabalistiques à la place de certaines lettres) bref, tout cela pue le problème de ram, mais memtest86 trouve rien.