SupermicroSYS-422GA-NRT-02-G2

Ocho NVIDIA RTX PRO 6000 Blackwell con 768 GB de memoria de GPU, dos Xeon de 72 núcleos, 1,5 TB de DDR5 y red de 200 y 400 GbE, todo en 4U y sin pasar al formato HGX.

Supermicro SYS-422GA-NRT-02-G2Rack 4U · Gold Series G2

La configuración exacta

Es la configuración que Supermicro tiene montada y probada. Datasheet oficial

Frontal esquemático: pasa el ratón por cada componente.
Procesador2× Intel Xeon 6960P72 núcleos · 2,7 GHz
GPU8× NVIDIA RTX PRO 6000 Blackwell Server Edition
Memoria1,5 TBDDR5-6400
Almacenamiento1× 960 GB M.2 NVMe2× 3,84 TB E1.S
Red1× dual 10 GbE RJ451× 2-port 200 GbE/NDR200 + 2× 1-port 400 GbE
FormatoRack 4U
Garantía
3 años de piezas y mano de obra
Técnico in situ
Opcional, al siguiente día laborable durante 3 años

Ocho GPU para modelos grandes sin dar el salto a HGX

Con 768 GB de memoria de GPU caben modelos de varios cientos de miles de millones de parámetros en 8 bits, o varios modelos medianos sirviéndose a la vez, que es como acaban muchas plataformas internas cuando cada departamento quiere el suyo. A diferencia de la -01, esta viene con la red preparada para salir del chasis: una tarjeta de 200 GbE y dos de 400 GbE que sirven para leer los modelos y los datos desde un almacenamiento compartido y para unir dos o más nodos cuando el servicio necesite redundancia.

El límite está en cómo se hablan las GPU. Las ocho cuelgan de conmutadores PCIe 5.0, sin la malla NVLink de una HGX B300, y para inferencia eso apenas pesa, pero en un entrenamiento distribuido o en un modelo enorme repartido entre las ocho la comunicación entre tarjetas se convierte en el cuello de botella. Si tu plan es entrenar modelos propios desde cero, mira antes la SYS-822GS-NB3RT-01-G2.

Lo que hacemos nosotros

La montamos con RHEL u Ubuntu, el GPU Operator y Kubernetes u OpenShift AI, con vLLM sirviendo cada modelo en su grupo de GPU, y conectamos los puertos de 200 y 400 GbE a vuestro almacenamiento o a un clúster Ceph que también podemos montar. Si después preferís no depender del fabricante para el mantenimiento, os damos soporte independiente con guardia 24×7 por contrato.

Qué necesita tu CPD

Mismo chasis de 4U y 737 mm de fondo que la -01. Según la ficha oficial lleva cuatro fuentes de 3.200 W Titanium en redundancia 3+1, y con las ocho GPU instaladas la máquina trabaja mucho más cerca de esa capacidad que su hermana, así que el reparto de circuitos y la potencia por rack son lo primero que revisamos. Se refrigera por aire con diez ventiladores de 8 cm, y un rack con varias de estas necesita pasillo frío confinado.

Frente al resto de la familia

ModeloLo que llevaCuándo elegirlo
SYS-822GS-NB3RT-01-G2HGX B300 8-GPU · 2 TBLa HGX B300 con Intel; la opción si vuestro estándar es Xeon.
AS-8126GS-NB3RT-01-G2HGX B300 8-GPU · 3 TBMisma HGX B300 con AMD, 3 TB y red de almacenamiento aparte.
AS-5126GS-TNRT-01-G22x RTX PRO 6000 · 1,5 TBDos GPU hoy, hueco para ocho y memoria de sobra.
SYS-212GB-FNR-01-G22x RTX PRO 6000 · 512 GBLa más compacta: 2U, un solo procesador, hasta cuatro GPU.
SYS-422GA-NRT-01-G24x RTX PRO 6000 · 1 TBCuatro GPU y 144 núcleos; la mitad del camino hasta ocho.
SYS-C542i-11302ULista para RTX 50 · 32 GBTorre de desarrollo sin GPU de serie; eliges tú la tarjeta.
ARS-511GD-NB-LCC-01-G2Grace + B300 · 748 GBUn nodo GB300 en torre para el equipo que entrena.

Ver todos los servidores IA y GPU

Qué incluye la entrega

De fábrica

  • Configuración montada y probada por Supermicro
  • Garantía de 3 años de piezas y mano de obra (1 año en edge y puesto)

De nuestra parte

  • Montaje en el rack
  • BMC y firmware al día
  • Sistema operativo y la pila que vaya encima
  • Pruebas con tu carga antes de pasar a producción

Si lo necesitas

  • Guardia 24×7 con SLA
  • Técnico in situ al siguiente día laborable, durante 3 años

Preguntas sobre la SYS-422GA-NRT-02-G2

¿Cuándo compensa una HGX B300 en lugar de esta?

Cuando vas a entrenar modelos grandes o a servir uno que no cabe en 768 GB. La HGX B300 suma más de 2 TB de memoria de GPU y une las ocho tarjetas por NVLink, mucho más rápido que PCIe para el tráfico entre GPU, pero exige 8U y una instalación eléctrica de otra categoría. Para inferencia de modelos de hasta unos pocos cientos de miles de millones de parámetros, esta suele bastar.

¿Qué modelo de IA cabe en 768 GB?

Con la regla de unos 2 GB por cada mil millones de parámetros en 16 bits y 1 GB en 8 bits, entra un modelo de unos 300.000 millones en 16 bits o uno de más de 500.000 millones en 8 bits, dejando sitio para la caché de contexto. Afinamos la cuenta con el modelo concreto y el número de usuarios que esperáis.

¿Cuánto tarda en llegar?

Menos que un servidor fabricado por pedido, porque la configuración ya está montada y probada. El plazo exacto depende del stock del canal europeo en ese momento, y te lo confirmamos por escrito con el presupuesto.

¿Se puede cambiar la configuración?

La configuración Gold Series es fija, y por eso sale antes. Si necesitas otra memoria, otros discos u otra red, te presupuestamos el mismo modelo base a medida, sabiendo que entonces el plazo pasa a ser el de una fabricación por pedido.

¿La SYS-422GA-NRT-02-G2 encaja con lo que vais a montar?

Cuéntanos la carga y el CPD donde va a ir, y te devolvemos el precio, el plazo confirmado y lo que haría falta para ponerla en marcha.