Els dispositius NVMe tenen dades intel·ligents?

Interfície de gestió de NVMTM (NVMe-MITM) específica

L' especificació NVMe-MITM gestiona l' especificació NVMe SSDs fora de la banda (fora del sistema operatiu) a través de SMBUS/MCTP i PCIe/VDMs. Això s' usa principalment per la màquina BMC ( Controladors de gestió de la base) per a comprovar l' inventari, monitor per errors, seguiment SMART i resistència, i es pot informar a través d' una consola de gestió (per exemple, Dell iDRAC). Això és important per als OEM que donen suport a múltiples sistemes operatius (Windows, Linux, VMware) i volen una consola de gestió.

Esdeveniments asíncrons

Els controladors NVMe / Discs tenen la capacitat d' informar d' un esdeveniment al programari de la màquina quan detecta un error, esdeveniment SMART, quan diversos atributs en el canvi de la unitat, o quan es completa l' esdeveniment (p. ex. L'era segura d'un SSD que elimina de manera segura totes les dades d'usuari.

Ordre d' autocomprovació del dispositiu

Aquesta característica de l' especificació de la NVMe permet que la màquina iniciï una petita o llarga prova que s' ha d' executar per a diagnòstics fora de línia. Molts OEM, ODDDD, i integradors de sistemes ho fan servir a la fàbrica quan es posen a una nova NVMa SSD per assegurar-se que tot funciona correctament. L' especificació de NVMe té un exemple d'auto-test però els proveïdors poden fer diagnòstics més profunds fora de línia si volen durant la implementació de SSD.

Pàgina de registre d' errors

Les unitats NVM (nVM) mantenen una pàgina de registre d'errors que informa quan hi ha errors i registre. Les pàgines de registre compten pel nombre d' errors, la cua que va venir i quines dades (LBA) i es va veure afectada per l' espai de noms.

Pàgina de registre de SMART

Aquesta pàgina de registre s' usa per a informació general de la salut sobre la unitat. L'indicador de salut principal s'anomena warning crític quan està habilitat que la unitat tingui un problema. El controlador NVMe/drive informarà a la màquina del tipus de problema: la unitat està en un mode de desactualitzat o només de lectura degut als errors dels mitjans de comunicació, un fracàs de maquinari, o la unitat actualment incrementa el llindar de temperatura i/omblopit. La unitat també pot enviar a la màquina un esdeveniment asíncron quan això succeeix, així que és conscient quan una unitat falla. La SMART resumeixrà la pàgina de registre d' errors per als errors de suports o integritat de dades i també llistarà el nombre d' aturada insegures que poden causar esdeveniments de pèrdua de potència i potència en hores per tal de calcular estadístiques.

Monitorant final

La manera fàcil de controlar la resistència d'un NVMe SSD és el camp usat pel percentatge SMART, que és com una mesura de gas per a la resistència que mostra l'ús real de la unitat. La majoria de les aplicacions utilitzen això per informar de la resistència utilitzada o de la vida SSD (100% 1) com a percentatge. El camp de reserva disponible es pot establir amb el proveïdor per enviar una notificació a la màquina quan es troben sota un cert llindar, que és una altra manera de representar resistència i s' usa menys sovint.

TelemetryCity name (optional, probably does not need a translation)

Telemetria permet als proveïdors de SSD / fabricars per recollir registres interns en el fracàs del dispositiu. Els registres humans estàndard llegibles s'animan aquí degut a la sensibilitat de la col·lecció de dades IP i interna dels clients. L' ordre pot ser o bé màquina o controlador iniciat, però generalment té sentit per a una màquina (a mida en aquest cas) per a llegir el registre de telemetria quan un dispositiu falla i enviar- lo a un venedor SSD o OEM que el van comprar per a més anàlisi.

Registre d' esdeveniments persistents

Penseu en això com a càmera negra per a la SSD. Esdeveniments que passen a la SSD com a errors, actualitzar el microprogramari, formatar, esborrar segur, etc. S' ha accedit a la bitàcola d' esdeveniments persistents en forma llegible humana amb una marca de temps. Un venedor OEM o SO pot implementar la lectura d'això en el gestor d'esdeveniments per ajudar a identificar tecnologies del centre de dades i gestionar dispositius, o localitzar quan hi ha hagut un esdeveniment específic o fallada.

Pàgines de registre únic del venedor

Molts proveïdors donen suport a informació addicional de SMART. Aplicacions com NVMe-CI en Linux, que és l'eina de gestió de codi obert, que permet llegir aquests registres específics d' aquests proveïdors mitjançant connectors/ extensió. Els proveïdors també tenen les seves pròpies eines que poden descodificar la informació. Intel· ligent, per exemple, informa de molts altres errors com el programa NAND i esborra els seus errors (ha fallat l' esborrat de SSD a escala), els errors PCIe CRC (per a connexions PCI de depuració), els bytes de la màquina i la màquina escrits per calcular l' amplificació, i molt més.

Errors del controlador

L' especificació de la NVM té una secció sencera dedicada a informar d' errors i recuperar- se per l' ús del controlador/ unitat, controlador i ús del sistema operatiu. Coses com PCIedesktop (eliminació de la funció) que requereixen configurar el programari de la màquina i la BIOS, l'error PCIe de recuperació, i la pèrdua de la potència de la NVMe SSD es va produir a través de moltes especificacions de Mrzy, però estan treballant en tots els sistemes operatius avui en dia.

Usant les característiques per a detectar errors

Utilitzant les característiques a l' error predict

Una presentació de FMS 2019 per Bren Watt de Microsoft en preveure errors de SSD a escala il·lustra això. Bàsicament, hom informa dels registres que es llisten més amunt i que s'executen l'AI i s'anàlisin a escala per predir els errors de SSD abans de passar.

Artículos Relacionados:

- Disc Dur -

Esta web usa cookies, puedes ver la política de cookies, aquí -
Política de cookies +