...

Les SSD PCIe 5.0 dans les centres de données : simple argument marketing ou véritable gain de performances ?

Les SSD NVMe PCIe 5.0 peuvent augmenter le débit de stockage local d'un serveur, mais ne constituent pas une amélioration générale des performances. Le bénéfice réel ne se concrétise qu'en cas de goulot d'étranglement avéré au niveau des E/S et une plateforme Gen5 adaptée de bout en bout. Pour l'OLTP, la virtualisation ou l'IA, le débit de liaison, le comportement des files d'attente, la latence, l'endurance des SSD et la topologie PCIe sont donc des facteurs qui comptent tous ensemble. Les données fournies par les fabricants constituent des repères précieux, à condition que le profil de test et les conditions d'exploitation soient documentés de manière transparente.

PCIe 5.0, NVMe et SSD : les différences

Pour une évaluation fiable, il convient de distinguer trois niveaux : PCIe Le bus de transport relie l'hôte à le périphérique ; NVMe est le protocole qui s'appuie sur ce bus pour la mémoire non volatile ; et le SSD est le périphérique concret comprenant un contrôleur, une mémoire flash NAND et un micrologiciel. Une connexion PCIe rapide ne décrit donc, dans un premier temps, que la connexion possible ; elle ne définit ni le traitement interne du SSD, ni les performances d'une application.

La norme PCIe 5.0 fonctionne à 32,0 GT/s par voie, tandis que la norme PCIe 4.0 atteint 16,0 GT/s par voie. Le débit de signalisation par voie est ainsi doublé, tout comme la bande passante théorique disponible par rapport à la Gen4. Cette affirmation concerne toutefois le chemin de transmission : elle ne garantit pas que les requêtes de base de données, les machines virtuelles ou les tâches d’IA fonctionneront également deux fois plus vite.

Débit de signalisation par voie PCIe

GT/s

PCIe 4.016
PCIe 5.032

Ces valeurs indiquent le débit de signalisation par voie. Elles ne correspondent ni au débit de données utiles ni à un benchmark d'application.

Tableau de données correspondant au graphique
EntréeGT/s
PCIe 4.016
PCIe 5.032

Dans le cas d'une Connexion x4 On peut en déduire l'ordre de grandeur à partir des données fournies par le PCI-SIG. Selon le PCI-SIG, une liaison PCIe 5.0 x32 offre une bande passante brute effective de 128 Go/s dans chaque sens. Quatre voies représentent un huitième de 32 voies, ce qui donne théoriquement environ 16 Go/s dans chaque sens pour le PCIe 5.0 x4. Il s’agit là d’une spécification de liaison et non d’un débit SSD atteignable ; d’autres éléments du protocole, ainsi que le contrôleur, la mémoire NAND et le micrologiciel, réduisent ou limitent les performances exploitables.

À cela s'ajoutent les contraintes liées au contrôleur SSD, au nombre et à l'organisation des puces NAND, aux algorithmes du micrologiciel, ainsi qu'aux schémas concrets de lecture et d'écriture. Une faible profondeur de file d'attente ou des accès mixtes de petite taille peuvent ralentir une application, même si la liaison PCIe dispose théoriquement encore de réserves. À l'inverse, un flux de données séquentiel parallèle peut exploiter judicieusement une connexion hôte plus rapide, sans pour autant que cela devienne une règle générale en matière de performances.

Pour l'achat de Stockage sur serveur La question cruciale n'est donc pas simplement „ Gen4 ou Gen5 ? “. Il faut plutôt vérifier si le chemin PCIe existant, le SSD lui-même et la charge de travail d'E/S réelle constituent le même goulot d'étranglement. Ce n'est que lorsque ces niveaux concordent que le débit de connexion supplémentaire du PCIe 5.0 peut avoir une réelle pertinence pour l'application.

Pourquoi les SSD d'entreprise sont-ils évalués différemment ?

A SSD d'entreprise n'est pas choisi uniquement en fonction du débit séquentiel en Mo/s. Dans un centre de données, outre les performances, ce sont surtout la fiabilité du fonctionnement en continu, la surveillance opérationnelle et l’intégration dans les plateformes de serveurs qui comptent. Les modèles grand public peuvent être techniquement adaptés à certaines tâches spécifiques, mais ils ne répondent pas automatiquement aux exigences en matière de disponibilité, de maintenance, de mécanismes de protection et de parcours de micrologiciels qualifiés dans un environnement de production.

Il existe des différences notables au niveau du format : les disques « Enterprise » sont par exemple disponibles aux formats U.2, E1.S ou E3.S et peuvent ainsi être intégrés dans des baies « hot-swap », des configurations de serveurs compactes et des systèmes de refroidissement spécifiques. La gamme Solidigm D7-PS1010, par exemple, est disponible dans les formats U.2, E1.S et E3.S. Le format joue donc un rôle déterminant dans le choix du fond de panier, de la circulation de l'air, de la densité de capacité et de la possibilité de remplacement ultérieur.

Formats de SSD d'entreprise à côté d'un emplacement ouvert permettant le remplacement à chaud
Image illustrative générée par IA : le format et l'environnement d'installation déterminent le choix des SSD pour serveurs.

Le Catégorie Endurance doit correspondre au profil d'écriture. Des taux de transfert élevés ne remplacent pas une endurance en écriture adaptée : la journalisation, le streaming et les écritures dans les bases de données génèrent des contraintes différentes de celles des charges de travail analytiques, qui sont principalement axées sur la lecture. Solidigm positionne le D7-PS1010 comme modèle à endurance standard et le D7-PS1030 comme modèle à endurance moyenne. La capacité, les performances et la charge d’écriture admissible constituent donc des critères de sélection à évaluer séparément.

Sont également importants Protection contre les coupures de courant et la télémétrie. La protection en cas de coupure de courant peut permettre de gérer de manière contrôlée les opérations d'écriture déjà lancées ; les données de télémétrie facilitent la surveillance de l'état, de la température et de l'usure. En fonction de l’environnement, les exigences d’achat peuvent également inclure des fonctions de chiffrement, des procédures d’effacement sécurisées et une prise en charge traçable du micrologiciel. Leur disponibilité concrète doit toutefois toujours être vérifiée pour chaque modèle et chaque configuration.

Le fonctionnement en double port peut constituer une autre caractéristique propre aux solutions d'entreprise. Le PM1743 de Samsung est présenté comme un SSD d'entreprise PCIe 5.0 doté de cette fonctionnalité, ce qui peut s'avérer pertinent pour certaines architectures à haute disponibilité. Cela ne signifie pas pour autant que tous les SSD Gen5 prennent en charge le fonctionnement à double port, ni que cette caractéristique soit nécessaire pour tous les serveurs. Cet exemple montre plutôt pourquoi il est indispensable de consulter à la fois les fiches techniques et les exigences de la plateforme.

Même les noms de produits ne peuvent se substituer à des tests techniques. La série Micron 9550 présente notamment des performances élevées et des profils de test spécifiés ; on ne peut toutefois en déduire une compatibilité générale avec tous les racks. Un choix judicieux tient compte à la fois des caractéristiques du disque dur concerné, de l'objectif d'endurance, du concept de maintenance, du format, des exigences de sécurité et de l'architecture réelle du serveur.

La plateforme détermine le débit de liaison possible

Un SSD PCIe 5.0 ne peut atteindre son débit maximal que si l'ensemble du chemin de transmission prend en charge la norme Gen5. Cela inclut la plate-forme CPU et le port racine, la carte mère, le riser ou le câble, le fond de panier, le commutateur PCIe (le cas échéant), la baie de disque ainsi que le micrologiciel des composants concernés. Un seul composant compatible Gen5 ne suffit pas, car la connexion entre les composants concernés fonctionne à une vitesse et une bande passante prises en charge en commun.

La norme PCIe 5.0 est compatible avec les générations précédentes de PCIe. Ainsi, si un disque Gen5 est connecté à un chemin exclusivement compatible Gen4, il peut en principe fonctionner, mais uniquement à la vitesse de liaison prise en charge par cette configuration. Le SSD ne bénéficie pas alors d’une connexion Gen5 ; il peut toutefois rester réutilisable lors d’un changement ultérieur de plateforme, à condition que le format, le micrologiciel et les autorisations du serveur soient également compatibles.

La question suivante mérite une attention particulière : Topologie PCIe. Plusieurs disques peuvent être connectés au processeur via un commutateur ou une liaison montante commune. Dans ce cas, la liaison individuelle du SSD n'est pas nécessairement le facteur limitant : en cas de charge parallèle, la liaison montante commune peut atteindre sa capacité maximale plus tôt. Il en va de même lorsque des accélérateurs supplémentaires, des cartes réseau ou d’autres cartes d’extension sont alimentés à partir du même budget de voies.

Une administratrice vérifie les risers, le fond de panier et le câblage d'un serveur en rack ouvert
Image illustrative générée par l'IA : l'inspection visuelle et la documentation du serveur viennent compléter l'analyse logicielle de la topologie PCIe.

La quantité disponible Budget par voie Il s'agit donc d'un paramètre de planification, et non d'une simple indication figurant dans la fiche technique. Quatre SSD x4 nécessitent au total 16 voies sur leurs liaisons de périphériques, mais leur bande passante combinée dépend de la manière dont ces liaisons sont connectées aux ports racine et aux liaisons montantes des commutateurs. Pour obtenir des débits globaux élevés, une architecture comportant plusieurs disques en parallèle peut s'avérer plus judicieuse que le remplacement d'un seul périphérique.

Avant tout achat, tu dois vérifier la configuration concrète par rapport au manuel du serveur et aux listes de compatibilité. Les éléments pertinents à prendre en compte sont la génération prise en charge et la largeur par emplacement, les restrictions en cas de configuration complète, les variantes de fond de panier et de risers, ainsi que les versions de micrologiciel disponibles. Seule cette vérification permet de distinguer un SSD d'entreprise théoriquement rapide d'une configuration capable de mettre effectivement à disposition sa connexion Gen5 sur un serveur en production.

Lire et comparer correctement les données fournies par le fabricant

Les valeurs indiquées dans les fiches techniques décrivent des conditions de mesure clairement définies, et ne reflètent pas nécessairement les performances d'une charge de travail serveur. Pour le Micron 9550, le fabricant annonce jusqu’à 14 000 Mo/s en lecture séquentielle, 10 000 Mo/s en écriture ainsi que jusqu’à 3,3 millions d’IOPS en lecture de 4 KiB. Ces unités répondent à des questions différentes : le MB/s évalue les transferts volumineux et continus ; les IOPS décrivent le nombre de petites opérations d'entrée et de sortie par unité de temps.

Les paramètres de mesure sont déterminants. Les valeurs séquentielles mentionnées reposent sur des transferts de 128 KiB avec une profondeur de file d'attente de 32, tandis que les valeurs aléatoires de 4 KiB reposent sur une profondeur de file d'attente de 512 et un état stable défini. Une base de données avec peu de requêtes simultanées peut donc atteindre des IOPS nettement inférieures, malgré un SSD rapide. Le rapport lecture/écriture, la variante de capacité et le taux de remplissage modifient également le tableau.

Comparaison entre PCIe 4.0 et PCIe 5.0 : la bande passante de la liaison n'est pas synonyme de performances du SSD ou de l'application
CaractéristiquePCIe 4.0PCIe 5.0Classification pratique
Fréquence de signalisation par voie16,0 GT/s32,0 GT/sLa technologie Gen5 double le débit de signalisation par voie.
Connexion typique d'un SSD NVMex4x4Le nombre de voies d'un disque NVMe individuel reste souvent inchangé.
Bande passante brute effective à x4environ 8 Go/s dans chaque sensenviron 16 Go/s dans chaque sensMathématiquement, un huitième des valeurs indiquées par PCI-SIG pour le x32 ; pas de débit de données utiles SSD.
Exigence relative à l'hôteParcours Gen4 de bout en boutParcours Gen5 de bout en boutLa connexion fonctionne uniquement à la vitesse prise en charge par l'ensemble de la configuration.
Déclaration relative aux applicationsPas de conclusion directePas de conclusion directeLes types de protocoles, la configuration du SSD, la topologie et la charge de travail limitent les performances effectivement exploitables.

PCI-SIG définit ces valeurs de bande passante comme la bande passante brute effective de la liaison. Pour déterminer le débit utile du SSD, il faut tenir compte d'autres facteurs liés au protocole et des limites de mise en œuvre. Une comparaison entre les générations de liaisons met donc en évidence la réserve de transport disponible, mais ne remplace ni la fiche technique du disque concerné, ni une mesure effectuée avec la charge de travail prévue.

Pour permettre des comparaisons fiables entre produits, les fabricants devraient indiquer la taille des transferts, la profondeur de la file d'attente, les modèles d'accès, la méthode de test et les conditions de fonctionnement. Les SNIA Enterprise PTS Elle définit à cet effet des procédures qui permettent de mieux comprendre les mesures de performances des SSD d'entreprise. Elle ne remplace pas une analyse de charge spécifique, mais aide à éviter de considérer à tort les valeurs maximales issues de différents profils de test comme directement comparables.

Quelles charges de travail tirent réellement parti de la technologie Gen5 ?

Dans le cadre des pipelines de données d'IA et du HPC, la Gen5 peut s'avérer utile lorsque de grands ensembles de données locaux ralentissent le processus de calcul. GPUDirect Storage permet des transferts DMA directs entre le stockage et la mémoire du GPU, sans tampon intermédiaire dans la mémoire vive du CPU. NVIDIA décrit les pipelines de calcul entièrement déportés vers le GPU comme un cas d'utilisation favorable : le GPU prend en charge le premier et le dernier accès aux données transférées entre le stockage et le GPU. Il s'agit là d'un profil d'utilisation, et non d'une condition fonctionnelle stricte et universelle. L'efficacité de GDS dépend du chemin d'accès réel aux données, des API utilisées et du goulot d'étranglement au niveau du stockage.

Dans le cadre de l'OLTP, on compte généralement Latences de queue et les performances d'écriture sous charge sont plus marquées que les pics de débit séquentiels. Un taux de réussite élevé du cache empêche de nombreuses opérations de lecture d'atteindre le SSD ; les requêtes limitées par le CPU restent également limitées par le CPU même après un remplacement du disque. Il convient donc de mesurer les latences P95 et P99, la latence de validation, le temps d’attente d’E/S et la profondeur de la file d’attente, plutôt que le seul débit.

Conditions de planification pour les chemins de stockage proches des GPU avec GPUDirect Storage
ConditionImplications pour les avantages potentielsGrandeur à analyser
Les E/S de stockage se trouvent sur le chemin critiqueUn chemin d'accès aux données plus direct peut s'avérer utile lorsque le stockage limite le pipeline du GPU.Mesurer simultanément le temps de chargement des données, l'utilisation du GPU et le débit de stockage.
Le GPU se charge du premier et du dernier accès aux donnéesLes pipelines de calcul entièrement déportés vers le GPU constituent un cas d'utilisation pertinent du GDS, et non une condition fonctionnelle universelle.Vérifier le premier accès après la lecture et le dernier accès avant l'écriture, ainsi que l'utilisation de cuFile dans le chemin d'accès réel aux données.
Transferts en streaming volumineux ou à faible débitL'orientation GDS telle qu'elle est documentée convient mieux aux transferts à grande échelle qu'aux accès aléatoires à petite échelle.Recenser les volumes de transfert et les modèles d'accès de l'application.
Plusieurs lecteurs et transferts parallèlesPour exploiter pleinement les voies PCIe larges, plusieurs périphériques x4 et des transferts simultanés peuvent être nécessaires.Vérifier le nombre d'appareils, le fonctionnement en parallèle, la liaison montante du commutateur et la topologie du port racine.

La virtualisation peut tirer parti d'un SSD plus rapide lorsque de nombreuses machines virtuelles génèrent simultanément des E/S aléatoires et que les latences de stockage limitent la consolidation. Cette hypothèse est considérée comme heuristique de planification à prendre en compte, et non comme un résultat général de Gen5. Le temps de disponibilité du processeur, la pression sur la mémoire vive, les liaisons montantes PCIe partagées et un système de stockage distribué peuvent limiter davantage une charge de travail que le disque dur lui-même.

Dans les domaines de l'analyse, de l'ETL, de la sauvegarde et de l'archivage également, la décision d'achat découle du goulot d'étranglement mesuré. Les transferts locaux parallèles volumineux peuvent exploiter une bande passante de liaison plus élevée, tandis que le réseau, la compression ou le système cible peuvent limiter l'effet lors des tâches de sauvegarde. Comparez donc la durée totale d'exécution des tâches et le débit de bout en bout, plutôt que de tirer directement des conclusions sur les performances de l'application à partir du pic de performance séquentiel du SSD.

Les pipelines à forte intensité d'écriture nécessitent en outre une classe d'endurance adaptée. Solidigm positionne le D7-PS1010 comme modèle à endurance standard et le D7-PS1030 comme modèle à endurance moyenne. Cela ne donne pas lieu à un choix de produit universel, mais à une règle de conception : les performances, la capacité et la charge d'écriture admissible sont des critères distincts et doivent correspondre au profil d'écriture réel.

Plan de mesure pour le stockage sur serveur avant l'acquisition

Ne commencez pas l'évaluation par un benchmark synthétique extrême, mais par des données de référence issues d'un environnement proche de la production. Pour cela, définissez quelques cas de charge représentatifs : par exemple, des transactions de base de données, des pics de démarrage de machines virtuelles ou une exécution ETL. Distinguez le démarrage à froid de État d'équilibre; des caches pleins et une charge d'écriture prolongée peuvent conduire à des résultats fondamentalement différents. L'article explique ce même principe méthodologique Mesurer correctement les performances après les mises à jour de WordPress en prenant l'exemple des charges d'hébergement dépendantes du cache.

Affichez conjointement les valeurs par cas de charge P95/P99 : latence, latence de validation, temps d'attente d'E/S, utilisation de la file d'attente et taux de réussite du cache. Une file d'attente longue associée à une faible utilisation du SSD peut indiquer un goulot d'étranglement en amont ; en revanche, un taux de réussite en cache élevé explique pourquoi un SSD plus rapide n'apporte guère de gain perceptible. Tenez également compte des métriques relatives au processeur, à la mémoire vive et au réseau afin de ne pas attribuer trop hâtivement la cause du problème au stockage.

Avant chaque évaluation des performances, vérifiez quels périphériques sont reconnus par le système. Sur un serveur Linux sur lequel nvme-cli est installé, la commande suivante permet de nvme list État des lieux : selon la documentation du projet, la commande parcourt l'arborescence sysfs à la recherche de périphériques NVMe et affiche leurs nœuds ainsi que les informations associées. Commence donc par décrire les périphériques détectés avant de comparer les performances.

Code
nvme list

Les exemples suivants, tirés de l'ancien guide Red Hat pour OpenStack Platform 10, constituent un point de départ pour le diagnostic PCIe : LnkCap y est réglé pour la vitesse maximale de la liaison et LnkSta évalué pour connaître l'état actuel de la liaison. Il ne s'agit pas d'une validation de la plateforme Gen5. Remplace l'adresse de l'exemple par l'adresse PCI de ton périphérique et vérifie la syntaxe, le résultat complet et la signification à l'aide de la documentation pciutils installée localement et du manuel du serveur.

Code
lspci -s 81:00.0 -vv | grep LnkCap
lspci -s 81:00.0 -vv | grep LnkSta

En ce qui concerne les données de santé, la documentation nvme-cli-Master citée précise smart-log en tant qu'alias obsolète de log smart; cet alias est destiné aux anciens scripts, tandis que les nouveaux scripts doivent utiliser la nouvelle syntaxe. Le terme « Master » décrit toutefois l'état d'avancement du développement et ne correspond pas automatiquement à l'ensemble des commandes d'une version stable de la distribution. Vérifie donc d’abord la version du paquet que tu as installée ainsi que son aide ou sa page de manuel. Utilise ci-dessous exclusivement la forme de commande qui y est documentée et remplace le chemin d’accès au périphérique donné en exemple par celui correspondant à ton système. Aucune limite de version générale n’en est déduite ici.

Code
# Nur die lokal dokumentierte Befehlsform verwenden:
nvme log smart /dev/nvme0

# Alternative, wenn lokal dokumentiert:
nvme smart-log /dev/nvme0

Un benchmark destructeur général n'est pas adapté aux systèmes de production : il peut écraser des données, affecter les caches ou générer un résultat non représentatif en raison d'une profondeur de file d'attente atypique. Comparez plutôt les mêmes scénarios d'utilisation avant et après un changement matériel planifié. Documentez la version du micrologiciel, la capacité, le taux de remplissage, la température et la topologie afin que les écarts puissent être retracés ultérieurement.

Planifier le refroidissement, l'endurance et la puissance en continu

Les valeurs maximales indiquées dans les fiches techniques correspondent à des profils de test définis et ne reflètent pas nécessairement le fonctionnement en continu d'un serveur en charge. À mesure que le taux de remplissage augmente, lors d'opérations d'écriture mixtes et pendant la Collecte des ordures Un SSD doit réorganiser les données. La gestion NAND et le profil d'écriture concret peuvent donc modifier le débit et, en particulier, la latence par rapport à des tests courts et sans données. Les données ne sont comparables que lorsque le profil d'exploitation et l'état stationnaire sont pris en compte.

La température fait également partie de la planification des performances. La gamme D7-PS1010 comprend les modèles U.2, E1.S et E3.S ; pour la gamme E1.S, Solidigm distingue les versions à refroidissement par air et une variante à refroidissement liquide direct avec une plaque froide unilatérale. Le sigle E1.S ne signifie donc pas à lui seul qu’il s’agit d’un refroidissement liquide. Vérifiez le modèle et la hauteur de montage commandés, ainsi que leur compatibilité avec le serveur, le baie et, le cas échéant, la plaque de refroidissement. Pour les modèles refroidis par air, la consommation électrique homologuée, le débit d’air, l’espacement des emplacements et la température d’entrée doivent être pris en compte lors de la vérification de la compatibilité avec la plateforme.

Le Catégorie Endurance doit être sélectionnée indépendamment de la génération d'interface. Pour l’ingestion continue de logs ou les caches d’écriture, une version « Mid-Endurance » peut être plus adaptée qu’un modèle conçu pour une endurance standard, même si les deux offrent des vitesses de lecture similaires. La capacité n’influence pas seulement les coûts et l’espace utile, mais peut également modifier l’endurance et le profil de performances selon le modèle.

Critères d'achat des SSD d'entreprise destinés aux serveurs
CritèreQuestion à clarifierCohérence opérationnelle
Format et capacitéLes modèles U.2, E1.S ou E3.S s'adaptent-ils au baie, au fond de panier et au riser ; la capacité utile est-elle suffisante ?Vérifier la compatibilité mécanique et électrique avant de passer commande.
Autonomie et profil d'écritureLa classe est-elle adaptée au volume d'écriture quotidien prévu et au rapport lecture/écriture ?Prévoir des rôles nécessitant beaucoup d'écriture séparément des rôles nécessitant beaucoup de lecture.
Profil de latenceLes centiles, l'état de charge et le profil d'essai sont-ils consignés ?Ne pas se limiter à une comparaison avec les valeurs maximales séquentielles.
Protection et télémétrieLa protection contre les coupures de courant, les fonctions de sécurité et les données d'état sont-elles nécessaires ?Prendre en compte la maintenance, la prévention des pannes et la conformité dans le processus de sélection.
Micrologiciel et plateformeLa prise en charge du micrologiciel ainsi que les homologations pour les serveurs, les fonds de panier et les systèmes de refroidissement sont-elles disponibles ?Garantir de manière contraignante la compatibilité avant le déploiement.

Identifier systématiquement les erreurs typiques de la Gen5

Ne commencez pas le dépannage par le remplacement du SSD, mais par le lien indiqué. Une vitesse réduite est avant tout un constat diagnostique et ne constitue pas encore une cause certaine. Comparez les données expliquées dans le plan de mesure LnkSta et LnkCap en respectant la documentation locale relative aux outils ; le guide OpenStack plus ancien cité ici présente ce contrôle de base, mais ne remplace pas la documentation actuelle du serveur. Vérifiez ensuite la configuration des emplacements, les risers, le fond de panier, le chemin de commutation et la version du micrologiciel par rapport aux spécifications de la plateforme.

Si le lien est correct, voici la suite : Comportement de la file d'attente de l'application. Un faible nombre d'IOPS associé à une faible profondeur de file d'attente ne prouve pas qu'il y ait un défaut du SSD ; de même, une liaison montante partagée saturée peut limiter plusieurs disques. Vérifiez donc le temps d’attente d’E/S, l’utilisation de la file d’attente, la répartition lecture/écriture et les centiles de latence en parallèle avec les métriques du processeur, de la mémoire et du réseau. Seule la corrélation permet de déterminer si le stockage se trouve sur le chemin critique.

Dans le cas des chemins de données proches du GPU, un chemin PCIe théoriquement direct ne suffit pas. GPUDirect Storage nécessite une configuration matérielle et logicielle adaptée ; selon la topologie, l’ACS et l’IOMMU peuvent acheminer les données via les ports racine du CPU. Les modifications apportées à ces fonctionnalités ont des répercussions sur l’isolation, la sécurité et la virtualisation. Elles ne doivent donc être effectuées qu’après une analyse de l’architecture et une évaluation documentée des risques, et non comme un simple « commutateur de performances » généralisé.

Si les performances restent instables sous charge, vérifiez ensuite la température, les données d'intégrité et la charge applicative. Choisissez la commande SMART en fonction de la version du paquet installé et de sa page de manuel. La documentation Master citée recommande nvme log smart et conduit nvme smart-log comme un alias obsolète ; elle ne reflète pas l'étendue de chaque distribution stable. Comparez séparément le démarrage à froid et l'état stationnaire, et consignez les conditions de mesure, au lieu de conclure à un défaut à partir d'une seule valeur aberrante.

Quand acheter la Gen5 et quand conserver la Gen4 ?

L'acquisition d'un SSD PCIe 5.0 se justifie lorsque les données de mesure révèlent un goulot d'étranglement au niveau du stockage ou de la liaison hôte et que l'ensemble de la plateforme prend effectivement en charge la norme Gen5. Les indicateurs pertinents sont une charge élevée et récurrente des files d'attente, un débit insuffisant ou une latence problématique sous une charge représentative. Le PCIe 5.0 double le débit binaire pris en charge par voie par rapport au PCIe 4.0 ; cela n'entraîne toutefois pas automatiquement une accélération de l'application.

Il est judicieux de continuer à utiliser la Gen4 lorsque les disques existants ne sont pas pleinement exploités, que la plate-forme serveur ne négocie que la Gen4 ou que le processeur, la mémoire vive et le réseau limitent le service. Même en cas de faible parallélisme ou de taux de réussite du cache élevé, l’écart au niveau de l’application peut rester faible. Le budget ainsi économisé peut alors, le cas échéant, être utilisé de manière plus efficace pour la capacité, la redondance, la mémoire vive ou la suppression du goulot d’étranglement identifié.

Un nombre réduit de disques Gen5 n'est pas systématiquement préférable à plusieurs périphériques Gen4. Pour obtenir des débits globaux élevés, ce qui compte, c'est le nombre de voies parallèles, le Budget par voie et les liaisons montantes des commutateurs ou des ports racines. En ce qui concerne les chemins de stockage locaux proches du GPU, NVIDIA précise que plusieurs périphériques NVMe x4 et des transferts parallèles peuvent être nécessaires pour exploiter pleinement une liaison PCIe x16. Il s'agit là d'une remarque concernant la topologie GDS et non d'une règle générale relative au nombre de périphériques par serveur.

Le NVMe over Fabrics, ou stockage désagrégé, constitue en revanche une option lorsque la capacité doit être répartie de manière flexible entre les hôtes. Dans ce cas, les cartes réseau, les commutateurs réseau, les chemins de protocole et le modèle d'exploitation déterminent également les performances atteignables. Les SSD NVMe locaux privilégient les chemins de données proches de l’hôte ; les systèmes centralisés peuvent permettre le partage et une évolutivité indépendante. Ces deux approches doivent être évaluées au regard des exigences en matière de latence, de disponibilité et d’exploitation.

Avant l'acquisition, la charge de travail et la fenêtre de mesure doivent être définies, le débit de liaison et la topologie vérifiés, et la capacité, l'endurance, le refroidissement, la prise en charge du micrologiciel et les fonctions de protection doivent faire l'objet d'une comparaison contraignante. Par ailleurs, l'alimentation électrique, l'environnement de rack et les options d'évolutivité doivent être pris en compte dans la décision relative à l'infrastructure. Cet article présente les critères concrets à cet effet. Critères pour choisir le centre de données adapté. La décision d'achat repose ainsi sur le goulot d'étranglement avéré plutôt que sur une valeur maximale isolée.

Sources et état des connaissances

État de la recherche :

Mise à jour : 26 septembre 2026. Les informations relatives aux interfaces, aux produits et à la syntaxe de nvme-cli se réfèrent aux documentations des fabricants et des projets citées dans l'article ; vérifiez la compatibilité et la version du micrologiciel avant toute utilisation.

https://pcisig.com/faq?field_category_value%5B%5D=pci_express_5.0

https://www.snia.org/solid-state-sss

https://nvmexpress.org/specification/nvme-over-pcie-transport-specification/

https://www.solidigm.com/products/data-center/d7/ps1010.html

https://www.solidigm.com/content/dam/solidigm/en/site/products/data-center/product-briefs/ps1010-ps1030/solidigm-d7-ps1010-d7-ps1030-product-brief.pdf

https://semiconductor.samsung.com/ssd/enterprise-ssd/pm1743/

https://www.micron.com/content/dam/micron/global/public/products/data-sheet/ssd/9550-nvme-ssd-tech-prod-spec.pdf

https://docs.nvidia.com/gpudirect-storage/overview-guide/

https://docs.nvidia.com/gpudirect-storage/pdf/design-guide.pdf

https://github.com/linux-nvme/nvme-cli/blob/master/Documentation/nvme-list.txt

https://docs.redhat.com/zh_hans/documentation/red_hat_openstack_platform/10/pdf/ovs-dpdk_end_to_end_troubleshooting_guide/red_hat_openstack_platform-10-ovs-dpdk_end_to_end_troubleshooting_guide-en-us.pdf

https://github.com/linux-nvme/nvme-cli/blob/master/Documentation/nvme-smart-log.txt

https://www.solidigm.com/archive-v2/products/data-center/d7/ps1010.html

https://docs.nvidia.com/gpudirect-storage/best-practices-guide/

Derniers articles

Plateforme serveur abstraite avec des chemins d'accès aux données vers la RAM, le NVMe et le réseau pour différentes charges d'hébergement.
Serveurs et machines virtuelles

AMD EPYC ou Intel Xeon : choisir la bonne plateforme pour l'hébergement web

Les processeurs AMD EPYC 9005 et Intel Xeon 6 ne peuvent pas faire l'objet d'une évaluation générale dans le domaine de l'hébergement web. Les facteurs déterminants sont le modèle d'hébergement, la référence spécifique, la topologie de la mémoire vive et des E/S, la configuration NUMA, ainsi que les mesures effectuées avec une charge représentative.