les infos raid postées étaient celle de l'incident précédent,
lorsque j'ai échangé les disques, j'avais déjà un disque failed, et un second l'a été du fait du changement de tiroir (là j'ai fortement déconné)
pour ce qui est de la faiblesse de l'alim, je doute un peu, il m'arrive de tourner avec 4 disques comme avec 5 ou 6 (dock + eSata) sans que le raid tombe, mais je suppose qu'il n'est pas exclu qu'une charge cpu plus forte ne fasse déborder le vase à un moment
pour le moment j'ai remplacé les cables sata anciens, tout raccordé aux ports sata interne, ça ne mange pas de pain
lorsque j'aurai fait une sauvegarde complète de mon système sur un disque d'1 to je me remettrai à jouer avec ta méthode
dernière info : lors du dernier incident, je suis allé voir dans errors.log :
Jan 15 17:20:41 zorg kernel: [19261.391636] ata1.00: exception Emask 0x50 SAct 0x1 SErr 0x680801 action 0x6 frozen
Jan 15 17:20:41 zorg kernel: [19261.391640] ata1.00: irq_stat 0x0c000000, interface fatal error
Jan 15 17:20:41 zorg kernel: [19261.391642] ata1: SError: { RecovData HostInt 10B8B BadCRC Handshk }
Jan 15 17:20:41 zorg kernel: [19261.391644] ata1.00: failed command: WRITE FPDMA QUEUED
Jan 15 17:20:41 zorg kernel: [19261.391647] ata1.00: cmd 61/08:00:f8:b7:72/00:00:0c:00:00/40 tag 0 ncq 4096 out
Jan 15 17:20:41 zorg kernel: [19261.391647] res 40/00:00:f8:b7:72/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
Jan 15 17:20:41 zorg kernel: [19261.391649] ata1.00: status: { DRDY }
Jan 15 17:20:42 zorg kernel: [19261.876434] ata1: softreset failed (device not ready)
Jan 15 17:20:42 zorg kernel: [19262.055945] end_request: I/O error, dev sda, sector 208844792
Jan 15 17:20:42 zorg kernel: [19262.055949] end_request: I/O error, dev sda, sector 208844792
et dans kernel.log :
Jan 15 17:20:41 zorg kernel: [19261.391636] ata1.00: exception Emask 0x50 SAct 0x1 SErr 0x680801 action 0x6 frozen
Jan 15 17:20:41 zorg kernel: [19261.391640] ata1.00: irq_stat 0x0c000000, interface fatal error
Jan 15 17:20:41 zorg kernel: [19261.391642] ata1: SError: { RecovData HostInt 10B8B BadCRC Handshk }
Jan 15 17:20:41 zorg kernel: [19261.391644] ata1.00: failed command: WRITE FPDMA QUEUED
Jan 15 17:20:41 zorg kernel: [19261.391647] ata1.00: cmd 61/08:00:f8:b7:72/00:00:0c:00:00/40 tag 0 ncq 4096 out
Jan 15 17:20:41 zorg kernel: [19261.391647] res 40/00:00:f8:b7:72/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
Jan 15 17:20:41 zorg kernel: [19261.391649] ata1.00: status: { DRDY }
Jan 15 17:20:41 zorg kernel: [19261.391652] ata1: hard resetting link
Jan 15 17:20:42 zorg kernel: [19261.876434] ata1: softreset failed (device not ready)
Jan 15 17:20:42 zorg kernel: [19261.876439] ata1: applying PMP SRST workaround and retrying
Jan 15 17:20:42 zorg kernel: [19262.042635] ata1: SATA link up 3.0 Gbps (SStatus 123 SControl 300)
Jan 15 17:20:42 zorg kernel: [19262.045120] ata1.00: configured for UDMA/133
Jan 15 17:20:42 zorg kernel: [19262.055922] sd 0:0:0:0: [sda]..
Jan 15 17:20:42 zorg kernel: [19262.055925] Result: hostbyte=0x00 driverbyte=0x08
Jan 15 17:20:42 zorg kernel: [19262.055926] sd 0:0:0:0: [sda]..
Jan 15 17:20:42 zorg kernel: [19262.055928] Sense Key : 0xb [current] [descriptor]
Jan 15 17:20:42 zorg kernel: [19262.055930] Descriptor sense data with sense descriptors (in hex):
Jan 15 17:20:42 zorg kernel: [19262.055931] 72 0b 00 00 00 00 00 0c 00 0a 80 00 00 00 00 00.
Jan 15 17:20:42 zorg kernel: [19262.055935] 0c 72 b7 f8.
Jan 15 17:20:42 zorg kernel: [19262.055937] sd 0:0:0:0: [sda]..
Jan 15 17:20:42 zorg kernel: [19262.055938] ASC=0x0 ASCQ=0x0
Jan 15 17:20:42 zorg kernel: [19262.055940] sd 0:0:0:0: [sda] CDB:.
Jan 15 17:20:42 zorg kernel: [19262.055941] cdb[0]=0x2a: 2a 00 0c 72 b7 f8 00 00 08 00
Jan 15 17:20:42 zorg kernel: [19262.055945] end_request: I/O error, dev sda, sector 208844792
Jan 15 17:20:42 zorg kernel: [19262.055949] end_request: I/O error, dev sda, sector 208844792
Jan 15 17:20:42 zorg kernel: [19262.055950] md: super_written gets error=-5, uptodate=0
Jan 15 17:20:42 zorg kernel: [19262.055953] md/raid10:md1: Disk failure on sda3, disabling device.
Jan 15 17:20:42 zorg kernel: [19262.055953] md/raid10:md1: Operation continuing on 3 devices.
Jan 15 17:20:42 zorg kernel: [19262.055982] ata1: EH complete
Jan 15 17:20:42 zorg kernel: [19262.072335] RAID10 conf printout:
Jan 15 17:20:42 zorg kernel: [19262.072338] --- wd:3 rd:4
Jan 15 17:20:42 zorg kernel: [19262.072340] disk 0, wo:0, o:1, dev:sdc3
Jan 15 17:20:42 zorg kernel: [19262.072341] disk 1, wo:0, o:1, dev:sdd3
Jan 15 17:20:42 zorg kernel: [19262.072342] disk 2, wo:1, o:0, dev:sda3
Jan 15 17:20:42 zorg kernel: [19262.072343] disk 3, wo:0, o:1, dev:sdb3
Jan 15 17:20:42 zorg kernel: [19262.075855] RAID10 conf printout:
Jan 15 17:20:42 zorg kernel: [19262.075857] --- wd:3 rd:4
Jan 15 17:20:42 zorg kernel: [19262.075859] disk 0, wo:0, o:1, dev:sdc3
Jan 15 17:20:42 zorg kernel: [19262.075860] disk 1, wo:0, o:1, dev:sdd3
Jan 15 17:20:42 zorg kernel: [19262.075861] disk 3, wo:0, o:1, dev:sdb3
je n'ai pas encore trouvé à quoi correspondait ce super_written qui se prend un error=-5
[^] # Re: soyons joueurs ou pas
Posté par pralines . En réponse au message software raid 10 avec failed event répétitif sur /dev/sda. Évalué à 1.
les infos raid postées étaient celle de l'incident précédent,
lorsque j'ai échangé les disques, j'avais déjà un disque failed, et un second l'a été du fait du changement de tiroir (là j'ai fortement déconné)
pour ce qui est de la faiblesse de l'alim, je doute un peu, il m'arrive de tourner avec 4 disques comme avec 5 ou 6 (dock + eSata) sans que le raid tombe, mais je suppose qu'il n'est pas exclu qu'une charge cpu plus forte ne fasse déborder le vase à un moment
pour le moment j'ai remplacé les cables sata anciens, tout raccordé aux ports sata interne, ça ne mange pas de pain
lorsque j'aurai fait une sauvegarde complète de mon système sur un disque d'1 to je me remettrai à jouer avec ta méthode
dernière info : lors du dernier incident, je suis allé voir dans errors.log :
Jan 15 17:20:41 zorg kernel: [19261.391636] ata1.00: exception Emask 0x50 SAct 0x1 SErr 0x680801 action 0x6 frozen
Jan 15 17:20:41 zorg kernel: [19261.391640] ata1.00: irq_stat 0x0c000000, interface fatal error
Jan 15 17:20:41 zorg kernel: [19261.391642] ata1: SError: { RecovData HostInt 10B8B BadCRC Handshk }
Jan 15 17:20:41 zorg kernel: [19261.391644] ata1.00: failed command: WRITE FPDMA QUEUED
Jan 15 17:20:41 zorg kernel: [19261.391647] ata1.00: cmd 61/08:00:f8:b7:72/00:00:0c:00:00/40 tag 0 ncq 4096 out
Jan 15 17:20:41 zorg kernel: [19261.391647] res 40/00:00:f8:b7:72/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
Jan 15 17:20:41 zorg kernel: [19261.391649] ata1.00: status: { DRDY }
Jan 15 17:20:42 zorg kernel: [19261.876434] ata1: softreset failed (device not ready)
Jan 15 17:20:42 zorg kernel: [19262.055945] end_request: I/O error, dev sda, sector 208844792
Jan 15 17:20:42 zorg kernel: [19262.055949] end_request: I/O error, dev sda, sector 208844792
et dans kernel.log :
Jan 15 17:20:41 zorg kernel: [19261.391636] ata1.00: exception Emask 0x50 SAct 0x1 SErr 0x680801 action 0x6 frozen
Jan 15 17:20:41 zorg kernel: [19261.391640] ata1.00: irq_stat 0x0c000000, interface fatal error
Jan 15 17:20:41 zorg kernel: [19261.391642] ata1: SError: { RecovData HostInt 10B8B BadCRC Handshk }
Jan 15 17:20:41 zorg kernel: [19261.391644] ata1.00: failed command: WRITE FPDMA QUEUED
Jan 15 17:20:41 zorg kernel: [19261.391647] ata1.00: cmd 61/08:00:f8:b7:72/00:00:0c:00:00/40 tag 0 ncq 4096 out
Jan 15 17:20:41 zorg kernel: [19261.391647] res 40/00:00:f8:b7:72/00:00:0c:00:00/40 Emask 0x50 (ATA bus error)
Jan 15 17:20:41 zorg kernel: [19261.391649] ata1.00: status: { DRDY }
Jan 15 17:20:41 zorg kernel: [19261.391652] ata1: hard resetting link
Jan 15 17:20:42 zorg kernel: [19261.876434] ata1: softreset failed (device not ready)
Jan 15 17:20:42 zorg kernel: [19261.876439] ata1: applying PMP SRST workaround and retrying
Jan 15 17:20:42 zorg kernel: [19262.042635] ata1: SATA link up 3.0 Gbps (SStatus 123 SControl 300)
Jan 15 17:20:42 zorg kernel: [19262.045120] ata1.00: configured for UDMA/133
Jan 15 17:20:42 zorg kernel: [19262.055922] sd 0:0:0:0: [sda]..
Jan 15 17:20:42 zorg kernel: [19262.055925] Result: hostbyte=0x00 driverbyte=0x08
Jan 15 17:20:42 zorg kernel: [19262.055926] sd 0:0:0:0: [sda]..
Jan 15 17:20:42 zorg kernel: [19262.055928] Sense Key : 0xb [current] [descriptor]
Jan 15 17:20:42 zorg kernel: [19262.055930] Descriptor sense data with sense descriptors (in hex):
Jan 15 17:20:42 zorg kernel: [19262.055931] 72 0b 00 00 00 00 00 0c 00 0a 80 00 00 00 00 00.
Jan 15 17:20:42 zorg kernel: [19262.055935] 0c 72 b7 f8.
Jan 15 17:20:42 zorg kernel: [19262.055937] sd 0:0:0:0: [sda]..
Jan 15 17:20:42 zorg kernel: [19262.055938] ASC=0x0 ASCQ=0x0
Jan 15 17:20:42 zorg kernel: [19262.055940] sd 0:0:0:0: [sda] CDB:.
Jan 15 17:20:42 zorg kernel: [19262.055941] cdb[0]=0x2a: 2a 00 0c 72 b7 f8 00 00 08 00
Jan 15 17:20:42 zorg kernel: [19262.055945] end_request: I/O error, dev sda, sector 208844792
Jan 15 17:20:42 zorg kernel: [19262.055949] end_request: I/O error, dev sda, sector 208844792
Jan 15 17:20:42 zorg kernel: [19262.055950] md: super_written gets error=-5, uptodate=0
Jan 15 17:20:42 zorg kernel: [19262.055953] md/raid10:md1: Disk failure on sda3, disabling device.
Jan 15 17:20:42 zorg kernel: [19262.055953] md/raid10:md1: Operation continuing on 3 devices.
Jan 15 17:20:42 zorg kernel: [19262.055982] ata1: EH complete
Jan 15 17:20:42 zorg kernel: [19262.072335] RAID10 conf printout:
Jan 15 17:20:42 zorg kernel: [19262.072338] --- wd:3 rd:4
Jan 15 17:20:42 zorg kernel: [19262.072340] disk 0, wo:0, o:1, dev:sdc3
Jan 15 17:20:42 zorg kernel: [19262.072341] disk 1, wo:0, o:1, dev:sdd3
Jan 15 17:20:42 zorg kernel: [19262.072342] disk 2, wo:1, o:0, dev:sda3
Jan 15 17:20:42 zorg kernel: [19262.072343] disk 3, wo:0, o:1, dev:sdb3
Jan 15 17:20:42 zorg kernel: [19262.075855] RAID10 conf printout:
Jan 15 17:20:42 zorg kernel: [19262.075857] --- wd:3 rd:4
Jan 15 17:20:42 zorg kernel: [19262.075859] disk 0, wo:0, o:1, dev:sdc3
Jan 15 17:20:42 zorg kernel: [19262.075860] disk 1, wo:0, o:1, dev:sdd3
Jan 15 17:20:42 zorg kernel: [19262.075861] disk 3, wo:0, o:1, dev:sdb3
je n'ai pas encore trouvé à quoi correspondait ce super_written qui se prend un error=-5
Envoyé depuis mon Archlinux