Servidores IA y GPU Supermicro con NVIDIA RTX PRO 6000 Blackwell y HGX B300

Las configuraciones Gold Series de Supermicro para IA, desde una torre de desarrollo hasta la HGX B300 de ocho GPU, que montamos en tu CPD con la pila de software lista para tu carga.

Supermicro AS-8126GS-NB3RT-01-G2AS-8126GS-NB3RT-01-G2

Comparativa

ModeloProcesadorGPUMemoriaAlmacenamientoRedFormato
SYS-822GS-NB3RT-01-G22x Intel Xeon 6768P (64C/2.4GHz)NVIDIA HGX B300 8-GPU2TB DDR5-64001x 960GB M.2 NVMe8-port 800GbE / XDR800Rack 8U
AS-8126GS-NB3RT-01-G22x AMD EPYC 9575F (64C/3.3GHz)NVIDIA HGX B300 8-GPU3TB DDR5-64002x 1.9TB M.2 NVMe2x 2-port 200GbE / NDR200 + 8-port 800GbE / XDR800Rack 8U
AS-5126GS-TNRT-01-G22x AMD EPYC 9355 (32C/3.55GHz)2x NVIDIA RTX PRO 6000 Blackwell Server Edition1.5TB DDR5-64001x 960GB M.2 NVMe1x dual 10GbE RJ45Rack 5U
SYS-212GB-FNR-01-G21x Intel Xeon 6731P (32C/2.5GHz)2x NVIDIA RTX PRO 6000 Blackwell Server Edition512GB DDR5-64001x 960GB M.2 NVMe + 2x 3.84TB E1.S1x dual 10GbE RJ45Rack 2U
SYS-422GA-NRT-01-G22x Intel Xeon 6960P (72C/2.7GHz)4x NVIDIA RTX PRO 6000 Blackwell Server Edition1TB DDR5-64001x 960GB M.2 NVMe + 2x 3.84TB E1.S1x dual 10GbE RJ45Rack 4U
SYS-422GA-NRT-02-G22x Intel Xeon 6960P (72C/2.7GHz)8x NVIDIA RTX PRO 6000 Blackwell Server Edition1.5TB DDR5-64001x 960GB M.2 NVMe + 2x 3.84TB E1.S1x dual 10GbE RJ45 + 1x 2-port 200GbE/NDR200 + 2x 1-port 400GbERack 4U
SYS-C542i-11302U1x Intel Core Ultra 7 265 (20C/5.3GHz)Preparado para NVIDIA RTX 5070 / 5080 / 5090 (opcional)32GB DDR5-56001TB NVMe1GbE, Thunderbolt 4 / USB4, USB-C 20G frontal, Wi-Fi 7, Bluetooth 5.4Torre
ARS-511GD-NB-LCC-01-G2NVIDIA Grace 72 núcleos Arm Neoverse V2NVIDIA Blackwell Ultra (B300)748GB memoria coherente (496GB LPDDR5X ECC + 252GB HBM3e ECC)2x 1.92TB M.2 NVMe + 2x 960GB M.2 NVMe2x QSFP 400GbE, NVIDIA ConnectX-8 SuperNICTorre

Cómo elegir un servidor de IA según el modelo que vas a ejecutar

La primera cifra que hay que mirar es la memoria de GPU, porque el modelo tiene que caber entero en ella con margen para la caché de contexto. Una regla útil: cada mil millones de parámetros ocupan unos 2 GB en 16 bits y 1 GB en 8 bits, de modo que un modelo de 70.000 millones necesita unos 70 GB solo para los pesos en 8 bits, y luego crece con la longitud de las conversaciones y con los usuarios simultáneos. Cada NVIDIA RTX PRO 6000 Blackwell Server Edition aporta 96 GB.

Con esa cuenta, la escala de las RTX PRO 6000 queda clara. La SYS-212GB-FNR-01-G2 y la AS-5126GS-TNRT-01-G2 salen con dos tarjetas y 192 GB, la primera en 2U para un servicio concreto y la segunda en 5U con hueco para ocho; la SYS-422GA-NRT-01-G2 sube a cuatro y 384 GB, y la SYS-422GA-NRT-02-G2 llega a ocho y 768 GB, con red de 400 GbE. Por encima están la SYS-822GS-NB3RT-01-G2 y la AS-8126GS-NB3RT-01-G2, ambas con la placa HGX B300 de ocho GPU y más de 2 TB de memoria.

La otra pregunta es si vas a servir modelos o a entrenarlos. Para inferencia, las RTX PRO 6000 conectadas por PCIe rinden muy bien y se pueden partir en instancias para varios equipos. Para entrenar o ajustar modelos grandes, las GPU intercambian datos todo el rato y ahí la HGX B300, con sus ocho GPU unidas por NVLink, juega en otra categoría.

Y no todo tiene que ir a un rack. La SYS-C542i-11302U es una torre sin GPU de serie para que un desarrollador pruebe modelos en su mesa con una RTX 5090, y la ARS-511GD-NB-LCC-01-G2, la Super AI Station con NVIDIA GB300, pone 748 GB de memoria compartida entre CPU y GPU al servicio de un equipo que desarrolla y ajusta modelos sin depender de un clúster.

Qué necesita tu CPD

Un servidor con varias GPU de esta generación es lo que más exige de un CPD: muchas fuentes de alimentación de alto vatiaje por chasis, que necesitan circuitos y PDU dimensionados para ellas, y un calor concentrado que obliga a revisar el pasillo frío y la potencia disponible por rack. Antes de proponerte una máquina miramos contigo esos números con la ficha oficial en la mano, y si el CPD no da para una HGX, preferimos decírtelo y buscar la configuración que sí cabe.

Por qué comprarla con nosotros

Con nosotros la máquina llega instalada, y si un día falla llamas al mismo equipo que la puso en marcha.

La montamos en el rack, configuramos la BMC e instalamos RHEL, SUSE, Ubuntu o Proxmox, con lo que vaya a correr encima ya instalado y probado: un clúster de Ceph, OpenStack, Kubernetes con el NVIDIA GPU Operator o Slurm.

Cuando algo falla hablas con las personas que conocen esa máquina porque la pusieron en marcha, y si lo necesitas hay guardia 24×7 con SLA por contrato. Es el mismo soporte independiente que damos a parques de IBM Power, Linux y Ceph.

Si necesitas otra memoria, otros discos u otra red, partimos del mismo modelo base. Con el configurador de servidor a medida nos dices qué necesitas y te llamamos en menos de 24 horas con la propuesta.

Somos IBM Business Partner y partner de Red Hat, SUSE y Canonical, que es lo que pesa cuando el servidor tiene que entrar en un entorno con sistemas y licencias que ya existen.

Trabajamos en toda Europa y atendemos en los tres idiomas, también en el soporte, así que si tu empresa tiene oficinas en Madrid y en Bruselas te atiende el mismo equipo en las dos.

Preguntas frecuentes

¿Qué servidor necesito para ejecutar un LLM en local?

Depende del tamaño del modelo y de cuántas personas lo van a usar. Para probar y desarrollar basta una torre como la SYS-C542i-11302U con una RTX 5090; para dar servicio a un departamento con un modelo de unos 70.000 millones de parámetros, una máquina con dos RTX PRO 6000 como la SYS-212GB-FNR-01-G2; y a partir de ahí se suman GPU hasta las ocho de la SYS-422GA-NRT-02-G2 o la HGX B300.

¿RTX PRO 6000 Blackwell o HGX B300?

Las RTX PRO 6000 Blackwell Server Edition van por PCIe, se pueden poner de dos en dos hasta ocho por chasis y cubren la mayoría de proyectos de inferencia. La HGX B300 une ocho GPU Blackwell Ultra por NVLink con más de 2 TB de memoria en total y es la opción para entrenar modelos grandes o servir los más grandes a mucha gente, a cambio de 8U y un CPD preparado para ella.

¿Se pueden añadir GPU más adelante?

En los chasis de RTX PRO 6000, sí: la AS-5126GS-TNRT-01-G2 y las SYS-422GA admiten hasta ocho GPU de doble ancho y la SYS-212GB-FNR-01-G2 hasta cuatro. Nos encargamos de las tarjetas, del firmware y de volver a validar la máquina. En la HGX B300 las ocho GPU vienen soldadas a la placa y lo que se amplía es el número de nodos.

¿Hace falta refrigeración líquida?

En esta gama, solo la Super AI Station GB300 la lleva, en un circuito cerrado dentro del propio equipo. Los servidores de rack, incluida la HGX B300, se refrigeran por aire según sus fichas oficiales, aunque eso exige un pasillo frío que funcione y comprobar la carga térmica por rack.

¿Cuál encaja con lo que vais a montar?

Cuéntanos la carga y el CPD donde va a ir, y te devolvemos el precio, el plazo confirmado y lo que haría falta para ponerla en marcha.