SupermicroSYS-422GA-NRT-01-G2

Cuatro NVIDIA RTX PRO 6000 Blackwell con 384 GB de memoria de GPU entre todas, dos Xeon 6960P de 72 núcleos y 1 TB de DDR5 en un chasis de 4U con hueco para otras cuatro.

Supermicro SYS-422GA-NRT-01-G2Rack 4U · Gold Series G2

La configuración exacta

Es la configuración que Supermicro tiene montada y probada. Datasheet oficial

Frontal esquemático: pasa el ratón por cada componente.
Procesador2× Intel Xeon 6960P72 núcleos · 2,7 GHz
GPU4× NVIDIA RTX PRO 6000 Blackwell Server Edition
Memoria1 TBDDR5-6400
Almacenamiento1× 960 GB M.2 NVMe2× 3,84 TB E1.S
Red1× dual 10 GbE RJ45
FormatoRack 4U
Garantía
3 años de piezas y mano de obra
Técnico in situ
Opcional, al siguiente día laborable durante 3 años

GPU compartidas entre varios equipos y servicios

Supermicro orienta esta familia a plataformas de inferencia compartidas, y es donde mejor rinde: un servidor del que tiran a la vez el equipo de datos, el que desarrolla agentes y un par de servicios en producción. Cada RTX PRO 6000 se puede partir con MIG (la división de NVIDIA de una GPU en instancias aisladas) en hasta cuatro trozos con su propia memoria, así que la máquina puede repartirse en dieciséis GPU pequeñas o funcionar con cuatro grandes según lo que pida cada carga. Los 144 núcleos de los dos Xeon 6960P sobran para el preprocesado, las bases vectoriales y el resto de servicios que rodean a un modelo.

Las cuatro GPU se comunican por un conmutador PCIe 5.0, sin la red NVLink de las máquinas HGX, y eso marca su techo. Para servir un modelo repartido entre las cuatro va bien; para entrenar un modelo grande, donde las GPU intercambian datos sin parar, una HGX B300 rinde en otra liga. La red de serie es de 10 GbE, suficiente si los modelos viven en los discos E1.S locales y escasa si los vas a cargar desde un almacenamiento compartido.

Lo que hacemos nosotros

Encaja de forma natural en OpenShift AI o en Kubernetes con el NVIDIA GPU Operator, que es quien reparte las instancias MIG entre los proyectos y deja a cada equipo pedir la GPU que necesita sin tocar la máquina. Encima montamos vLLM para los modelos en producción y los cuadernos y canalizaciones que use el equipo de datos. Si queréis ver el diseño completo, lo contamos en inferencia de IA sobre Kubernetes y Ceph.

Qué necesita tu CPD

Son 4U con 737 mm de fondo, así que entra en casi cualquier armario. La ficha oficial indica cuatro fuentes de 3.200 W Titanium en redundancia 3+1, las mismas que la versión de ocho GPU, de modo que si la amplías más adelante la alimentación ya está dimensionada y lo que hay que prever desde el principio son las tomas y la PDU. Se refrigera por aire con diez ventiladores de 8 cm.

Frente al resto de la familia

ModeloLo que llevaCuándo elegirlo
SYS-822GS-NB3RT-01-G2HGX B300 8-GPU · 2 TBLa HGX B300 con Intel; la opción si vuestro estándar es Xeon.
AS-8126GS-NB3RT-01-G2HGX B300 8-GPU · 3 TBMisma HGX B300 con AMD, 3 TB y red de almacenamiento aparte.
AS-5126GS-TNRT-01-G22x RTX PRO 6000 · 1,5 TBDos GPU hoy, hueco para ocho y memoria de sobra.
SYS-212GB-FNR-01-G22x RTX PRO 6000 · 512 GBLa más compacta: 2U, un solo procesador, hasta cuatro GPU.
SYS-422GA-NRT-02-G28x RTX PRO 6000 · 1,5 TBEl máximo en PCIe: ocho GPU y red de 400 GbE.
SYS-C542i-11302ULista para RTX 50 · 32 GBTorre de desarrollo sin GPU de serie; eliges tú la tarjeta.
ARS-511GD-NB-LCC-01-G2Grace + B300 · 748 GBUn nodo GB300 en torre para el equipo que entrena.

Ver todos los servidores IA y GPU

Qué incluye la entrega

De fábrica

  • Configuración montada y probada por Supermicro
  • Garantía de 3 años de piezas y mano de obra (1 año en edge y puesto)

De nuestra parte

  • Montaje en el rack
  • BMC y firmware al día
  • Sistema operativo y la pila que vaya encima
  • Pruebas con tu carga antes de pasar a producción

Si lo necesitas

  • Guardia 24×7 con SLA
  • Técnico in situ al siguiente día laborable, durante 3 años

Preguntas sobre la SYS-422GA-NRT-01-G2

¿Qué diferencia hay entre la SYS-422GA-NRT-01-G2 y la -02?

Comparten chasis y procesadores de la serie Xeon 6900. La -01 lleva cuatro RTX PRO 6000, 1 TB de memoria y solo red de 10 GbE; la -02 llena el chasis con ocho GPU, sube a 1,5 TB y añade una tarjeta de 200 GbE y dos de 400 GbE para almacenamiento y para unir nodos. La -01 encaja como plataforma compartida que irá creciendo y la -02 cuando el modelo o el número de usuarios ya piden ocho GPU.

¿Se puede repartir una GPU entre varios usuarios?

Sí, con MIG cada RTX PRO 6000 se divide en hasta cuatro instancias aisladas, cada una con su memoria y sus núcleos, de modo que lo que haga un equipo no frena al de al lado. En Kubernetes u OpenShift AI esas instancias se piden como un recurso más, y las configuramos según el tamaño de los modelos que vaya a usar cada grupo.

¿Cuánto tarda en llegar?

Menos que un servidor fabricado por pedido, porque la configuración ya está montada y probada. El plazo exacto depende del stock del canal europeo en ese momento, y te lo confirmamos por escrito con el presupuesto.

¿Se puede cambiar la configuración?

La configuración Gold Series es fija, y por eso sale antes. Si necesitas otra memoria, otros discos u otra red, te presupuestamos el mismo modelo base a medida, sabiendo que entonces el plazo pasa a ser el de una fabricación por pedido.

¿La SYS-422GA-NRT-01-G2 encaja con lo que vais a montar?

Cuéntanos la carga y el CPD donde va a ir, y te devolvemos el precio, el plazo confirmado y lo que haría falta para ponerla en marcha.