Bonjour à tous,
J'ai configuré un NAS-HA sur un dédié Advance (via la doc : https://help.ovhcloud.com/csm/fr-public-cloud-storage-nas-nfs?id=kb_article_view&sysparm_article=KB0046742).
Ce dédié héberge un site web, le but du NAS-HA est d'y mettre les fichiers du site pour permettre l'ajout d'une instance complémentaire derrière un LoadBalancer.
Pas de problème avec le montage en suivant la documentation.
J'ai ensuite copié les fichiers du site puis modifier le pointage du domaine vers cet espace.
NB : la copie m'a déjà parue très longue par rapport à un cp interne sur le SSD du dédié.
Le site web fonctionne mais l'affichage d'une page prend 1 minute au lieu de quelques dixièmes de secondes lorsque le stockage est sur le SSD.
Je ne comprends pas cette performance. En état, l'utilisation du NAS-HA est impossible.
Rien dans les logs web.
Quelqu'un a une idée du problème ? ou comment améliorer cela.
Même chose avec un EFS. Mais bon cela utilise aussi un montage NFS.
Merci d'avance pour votre aide.
Complément : une page PHP avec un simple "echo 'ok';" prend deux secondes à s'afficher…
Il faudrait se placer dans le dossier du NAS et exécuter ces 2 commandes :
`/bin/dd if=/dev/zero of=speedtest bs=1M count=300 conv=fdatasync`
`fio --name=rand-write --ioengine=libaio --iodepth=32 --rw=randwrite --invalidate=1 --bsrange=4k:4k,4k:4k --size=512m --runtime=120 --time_based --do_verify=1 --direct=1 --group_reporting --numjobs=1`
ça donnera une idée des perfs.
Normalement les perfs du NAS ne sont pas si mauvaises, ça tournait pas trop mal (il y a qques années) quand j'en avais un.
Le NAS et le dédié sont dans le même DC ?
Hello,
Oui même DC.
/bin/dd if=/dev/zero of=speedtest bs=1M count=300 conv=fdatasync
300+0 records in
300+0 records out
314572800 bytes (315 MB, 300 MiB) copied, 5.4138 s, 58.1 MB/s
fio --name=rand-write --ioengine=libaio --iodepth=32 --rw=randwrite --invalidate=1 --bsrange=4k:4k,4k:4k --size=512m --runtime=120 --time_based --do_verify=1 --direct=1 --group_reporting --numjobs=1
rand-write: (g=0): rw=randwrite, bs=(R) 4096B-4096B, (W) 4096B-4096B, (T) 4096B-4096B, ioengine=libaio, iodepth=32
fio-3.25
Starting 1 process
rand-write: Laying out IO file (1 file / 512MiB)
Jobs: 1 (f=1): [w(1)][100.0%][w=10.7MiB/s][w=2748 IOPS][eta 00m:00s]
rand-write: (groupid=0, jobs=1): err= 0: pid=168930: Sat Jul 29 21:27:31 2023
write: IOPS=2746, BW=10.7MiB/s (11.2MB/s)(1288MiB/120011msec); 0 zone resets
slat (nsec): min=1776, max=3567.4k, avg=9004.97, stdev=10353.93
clat (usec): min=10723, max=43593, avg=11637.62, stdev=561.72
lat (usec): min=10756, max=43600, avg=11646.82, stdev=561.44
clat percentiles (usec):
| 1.00th=[10945], 5.00th=[11076], 10.00th=[11207], 20.00th=[11338],
| 30.00th=[11469], 40.00th=[11469], 50.00th=[11600], 60.00th=[11600],
| 70.00th=[11731], 80.00th=[11863], 90.00th=[12125], 95.00th=[12256],
| 99.00th=[12780], 99.50th=[13829], 99.90th=[17957], 99.95th=[19792],
| 99.99th=[27132]
bw ( KiB/s): min= 9532, max=11233, per=100.00%, avg=10995.37, stdev=162.55, samples=237
iops : min= 2383, max= 2808, avg=2748.56, stdev=40.61, samples=237
lat (msec) : 20=99.96%, 50=0.04%
cpu : usr=1.11%, sys=2.54%, ctx=140200, majf=0, minf=8
IO depths : 1=0.1%, 2=0.1%, 4=0.1%, 8=0.1%, 16=0.1%, 32=100.0%, >=64=0.0%
submit : 0=0.0%, 4=100.0%, 8=0.0%, 16=0.0%, 32=0.0%, 64=0.0%, >=64=0.0%
complete : 0=0.0%, 4=100.0%, 8=0.0%, 16=0.0%, 32=0.1%, 64=0.0%, >=64=0.0%
issued rwts: total=0,329626,0,0 short=0,0,0,0 dropped=0,0,0,0
latency : target=0, window=0, percentile=100.00%, depth=32
Run status group 0 (all jobs):
WRITE: bw=10.7MiB/s (11.2MB/s), 10.7MiB/s-10.7MiB/s (11.2MB/s-11.2MB/s), io=1288MiB (1350MB), run=120011-120011msec
Ce n'est pas violent, mais ça pourrait être pire…
Peut être un soucis de cache quelque part ?
On doit pouvoir configurer un cache pour les partages NFS, bon à voir selon les datas concernées, pour certaines (sessions ?) je présume que l'on ne peut pas se permettre d'avoir un cache. Mais tout ce qui peut l'être devrait être mis en cache.
Je n'ai jamais configuré un tel truc, mais il me semble que ça doit être faisable.
Bonjour,
Non je ne vois pas pour le cache
Comme je l'indiquais même une page php avec simplement un "echo" met 2 secondes à s'afficher.
A voir si quelqu'un de la team ovh peut répondre.
Les stats d'accès disque ne sont pas optimales, mais on ne devrait pas avoir de telles performances…