Saltar al contacto
Formación oficial IBM · HPC y computación de alto rendimiento

Cursos de HPC
y computación de alto rendimiento

Formación oficial de IBM Spectrum LSF (workload scheduling), IBM Storage Scale (GPFS) y Elastic Storage Server. Cinco cursos oficiales IBM para equipos que operan clústeres HPC en producción — desde el batch scheduling hasta el filesystem paralelo. Alternativa empresarial a Ceph y SLURM cuando el negocio pide soporte oficial y SLA.

Partner oficial IBM Business PartnerFormación oficial certificada
[ 01 ]Dos administraciones que no puedes separar

Un clúster HPC son dos administraciones pegadas con hilo.

Un clúster de computación de alto rendimiento tiene dos capas técnicas que se suelen aprender por separado y administrar juntas. Por un lado el workload scheduling (LSF, SLURM): decide qué se ejecuta, cuándo, con qué prioridad y contra qué SLA. Por otro el filesystem paralelo (Storage Scale/GPFS, Ceph, Lustre): da acceso simultáneo a los datos desde cientos de nodos sin caerse. Este hub agrupa las dos porque en producción nadie las mantiene de forma aislada durante mucho tiempo.

Formación oficial IBM de Spectrum LSF (H010G), Storage Scale / GPFS (H005G, H006G, H008G) y monitorización de Elastic Storage Server. Impartida directamente por nuestros ingenieros de despliegue, no por instructores externos.

Si necesitas otras piezas del stack: Ceph SDS para storage distribuido open-source, Linux avanzado como base, el hub IBM Storage para backup y almacenamiento empresarial, y consultoría IBM Spectrum Compute · HPC cuando el clúster hay que montarlo, no solo aprenderlo.

CATÁLOGO5 cursos // FAMILIASLSF · Storage Scale · Elastic Storage // ALT.SLURM · PBS // IDIOMASES · EN · FR // MODOonline · in-company
admin@hpc-master · ~ · bash
# enviar un job GPU a la cola "gpu" reservando A100 en modo exclusivo
$ bsub -q gpu -n 8 -gpu "num=2:mode=exclusive_process" \
    -R "select[gpu_model0=NVIDIAA100]" ./train.sh
Job <18274> is submitted to queue <gpu>.

# ver estado del trabajo con columnas útiles
$ bjobs -o "jobid stat queue exec_host time_left"
JOBID  STAT  QUEUE  EXEC_HOST       TIME_LEFT
18274  RUN   gpu    2*gpu-node-04   3:47:12

# estado de una cola: prioridad, jobs pendientes/corriendo, límites
$ bqueues gpu

Lo que vas a hacer desde el primer día del curso H010G.

[ 03 ]Preguntas frecuentes

Dudas frecuentes sobre HPC

¿Qué es HPC (High Performance Computing) y para qué se usa?

HPC (High Performance Computing) — en español computación de alto rendimiento — es la disciplina que agrega decenas o cientos de servidores en un clúster para ejecutar cargas de trabajo que un solo servidor no puede: simulación numérica (CFD, meteorología, química), entrenamiento de modelos de IA a gran escala, análisis financiero de riesgo, procesamiento sísmico, EDA en semiconductores o renderizado. Un clúster HPC empresarial necesita al menos dos capas: un workload scheduler que decide qué trabajo corre dónde y cuándo (LSF, SLURM, PBS), y un filesystem paralelo que da acceso simultáneo a los datos desde todos los nodos (Storage Scale / GPFS, Lustre, Ceph).

¿En qué se diferencia IBM Spectrum LSF de SLURM?

SLURM es un scheduler libre y muy extendido en HPC académico. IBM Spectrum LSF es la alternativa empresarial: cubre SLAs contractuales, priorización compleja entre proyectos, gestión fina de licencias caras, políticas fairshare avanzadas y soporte oficial IBM. Cuando el negocio pide compromisos de tiempo de ejecución y trazabilidad auditables, LSF encaja mejor. Cuando la prioridad es coste cero y flexibilidad académica, SLURM es la vía. En el curso H010G hacemos comparativa práctica en el clúster.

¿Necesito Storage Scale (GPFS) si ya tengo LSF?

No obligatoriamente. LSF puede funcionar sobre NFS o cualquier filesystem compartido — es agnóstico al storage. Pero en HPC serio, NFS se queda corto en cuanto la carga aumenta: se convierte en el cuello de botella. Storage Scale (GPFS) es un filesystem paralelo pensado para que cientos de nodos accedan a los mismos datos sin degradación. También se puede sustituir por Ceph (open-source) o Lustre. La combinación LSF + Storage Scale es el stack HPC empresarial de referencia de IBM.

¿Ceph puede sustituir a Storage Scale (GPFS)?

Depende del perfil de la carga. Ceph es potente y flexible para storage distribuido de objetos, bloques y ficheros — coste cero de licencia y control total. Pero en cargas HPC con muchos I/O pequeños y latencia crítica, Storage Scale (GPFS) sigue rindiendo mejor gracias a años de tuning específico. Ceph gana cuando prima la flexibilidad, el multi-tenancy y la mezcla de cargas. En SIXE formamos y desplegamos ambos — el criterio de decisión depende del perfil real del clúster.

¿La formación se puede pedir in-company sobre nuestro clúster real?

Sí. Todas las formaciones del hub HPC se pueden impartir in-company, adaptando el temario a tu versión de LSF y Storage Scale, a tu topología de red y a las aplicaciones reales que corren en producción. Trabajamos sobre entorno de preproducción del cliente y salís del curso con la configuración prácticamente lista para promover. Pide presupuesto indicando número de asistentes, versiones y ubicación.

¿Los cursos son online, presenciales o híbridos?

Ambas modalidades y las tres lenguas (ES, EN, FR). Online en directo con aula virtual y clúster real dedicado por participante, o presencial in-company en la sede del cliente. La calidad práctica es equivalente — los laboratorios corren sobre el mismo entorno.

¿SIXE también despliega el clúster, o solo forma?

Ambas cosas, en servicios separados. Además del catálogo formativo, ofrecemos consultoría, despliegue e integración de clústeres HPC IBM Spectrum Computing (LSF + Storage Scale + Elastic Storage Server). Muchos clientes contratan primero el despliegue y luego forman al equipo interno para operarlo.
[ 05 ]   Solicitar información

Cuéntanos qué clúster tenéis

Dinos cuántos sois, qué scheduler y filesystem usáis (o de qué scheduler venís) y si os interesa online o presencial. Volvemos con formato, fechas y equipo docente concretos.

Teléfono+34 91 198 02 43
PrecioA consultar por grupo
IdiomasES · EN · FR
SIXE