Bonjour. Mon dédié Proxmox a des problèmes RAID soft.
Le 1er disk semble mort
# cat /proc/mdstat
Personalities : [raid1] [linear] [multipath] [raid0] [raid6] [raid5] [raid4] [raid10]
md5 : active raid1 nvme1n1p5[1] nvme0n1p5[0](F)
476380160 blocks super 1.2 [2/1] [_U]
bitmap: 4/4 pages [16KB], 65536KB chunk
md3 : active raid1 nvme1n1p3[1] nvme0n1p3[0](F)
20954112 blocks super 1.2 [2/1] [_U]
md2 : active raid1 nvme1n1p2[1] nvme0n1p2[0]
1046528 blocks super 1.2 [2/2] [UU]
Je vois le status du NVMe 1 mais plus du NVMe 0
# nvme smart-log /dev/nvme0
/dev/nvme0: Resource temporarily unavailable
Usage: nvme smart-log <device> [OPTIONS]
Retrieve SMART log for the given device (or optionally a namespace) in either
decoded format (default) or binary.
Options:
[ --namespace-id=<NUM>, -n <NUM> ] --- (optional) desired namespace
[ --output-format=<FMT>, -o <FMT> ] --- Output format: normal|json|binary
[ --raw-binary, -b ] --- output in binary format
[ --human-readable, -H ] --- show info in readable format
------------
# nvme smart-log /dev/nvme1
Smart Log for NVME device:nvme1 namespace-id:ffffffff
critical_warning : 0
temperature : 36°C (309 Kelvin)
available_spare : 100%
available_spare_threshold : 10%
percentage_used : 28%
endurance group critical warning summary: 0
Data Units Read : 268,457,791 (137.45 TB)
Data Units Written : 182,982,608 (93.69 TB)
host_read_commands : 4,312,228,722
host_write_commands : 6,731,102,432
controller_busy_time : 12,051
power_cycles : 41
power_on_hours : 36,006
unsafe_shutdowns : 32
media_errors : 0
num_err_log_entries : 0
Warning Temperature Time : 0
Critical Composite Temperature Time : 0
Thermal Management T1 Trans Count : 0
Thermal Management T2 Trans Count : 0
Thermal Management T1 Total Time : 0
Thermal Management T2 Total Time : 0
====================
Je vais ouvrir un incident OVH. Je suppose qu'ils vont remplacer le NMVe O.
Est-ce qu'en suite le serveur boot sur 1 NMVe (le 2ème) ?
Je sais que je dois moi-même reconstruire le RAID.
Merci