Saltar al contacto
Formación HPC · 2 días · scheduler open source

SLURM
administración básica de clúster HPC

Dos jornadas para desplegar, operar y depurar un clúster SLURM Workload Manager en producción: instalación de slurmctld, slurmd y slurmdbd, particiones y QoS, políticas fairshare y backfill, gestión de CPU, GPU y memoria con GRES, accounting y troubleshooting. El scheduler open source que corre en el MareNostrum y en la mayoría del Top500 — el primo libre de IBM Spectrum LSF.

Duración 2 días · 16 h
Nivel Intermedio · admin Linux
Práctica Clúster HPC real
Formato Online o presencial
slurm Workload Manager
SLURM Workload Manager Clúster HPC sbatch · srun · squeue Fairshare y backfill GPU con GRES MUNGE auth slurmdbd accounting vs LSF · PBS · Torque slurmctld · slurmd SLURM Workload Manager Clúster HPC sbatch · srun · squeue Fairshare y backfill GPU con GRES
[ 01 ]Por qué este curso

Del sbatch a operar
un clúster SLURM en producción.

Dos jornadas con un clúster SLURM real montado en nuestros laboratorios: controlador, backup y nodos de cómputo, particiones configuradas, CPU y GPU compartidas con GRES, y cargas de simulación reales para ejercitar la operativa. Al terminar sales operando el sistema, no solo con apuntes.

Cubrimos lo que aparece todos los días: envío y control de trabajos con sbatch, srun y squeue, diseño de particiones y QoS, políticas fairshare y backfill, límites por usuario, cuenta y asociación, accounting con slurmdbd y depuración cuando algo se rompe. Complemento natural del curso de IBM Spectrum LSF — cubres los dos schedulers que se reparten el mercado HPC.

[ 02 ]Para quién es · qué te llevas

Un curso para quien administra o migra HPC en serio

Es para tu equipo si…

  • Sois administradores de Linux que vais a desplegar o mantener un clúster SLURM en producción.
  • Venís de LSF, PBS o Torque y necesitáis pasar a SLURM, o mantener los dos en paralelo mientras migráis.
  • Gestionáis cargas batch científicas — simulación, CFD, bioinformática, ML, renderizado — con priorización por proyecto.
  • Necesitáis compartir CPU, GPU y memoria entre grupos con reglas claras, límites justos y accounting auditable.

Al terminar ya operas

  • Instalas SLURM de cero sobre RHEL o Debian con slurmctld, slurmd, slurmdbd y MUNGE.
  • Envías y controlas trabajos con sbatch, srun, squeue, scancel y sinfo.
  • Diseñas particiones y QoS con fairshare, backfill, límites y priorización por proyecto.
  • Configuras GPU con GRES, límites por asociación y contabilización real con slurmdbd.
  • Administras y depuras con logs, sacct y scontrol cuando un trabajo se cuelga o un nodo cae.
[ 03 ]Temario · 2 días

De la arquitectura de SLURM a la operación diaria

Dos días que construyen el mismo clúster capa a capa: arrancamos con fundamentos y despliegue, y subimos hasta particiones, políticas fairshare, accounting y troubleshooting como en producción real.

01 Día 1 · Fundamentos e instalación

Arquitectura, despliegue y primer envío de trabajos

  • Qué resuelve SLURM y comparativa con LSF, PBS y Kubernetes para HPC.
  • Arquitectura: slurmctld, slurmd, slurmdbd y MUNGE; controlador, backup y nodos.
  • Instalación paso a paso sobre RHEL o Debian y verificación del clúster.
  • Primer envío con sbatch y srun; consulta con squeue, sinfo y scontrol.
Práctica sobre clúster real
02 Día 2 · Particiones, políticas y operación

Recursos, QoS, accounting y troubleshooting

  • Diseño de particiones y QoS; límites por usuario, cuenta y asociación.
  • Políticas fairshare, backfill y preemption con prioridades multifactor.
  • GPU y recursos genéricos (GRES); asignación por trabajo y por partición.
  • Accounting con slurmdbd y sacct; depuración con logs, scontrol y sdiag.
Práctica sobre clúster real
[ 05 ]Dudas frecuentes

Preguntas frecuentes

¿Qué experiencia previa necesito?

Administración básica de Linux — bash, permisos, redes, sistemas de ficheros compartidos (NFS o similar). No hace falta experiencia previa con SLURM ni con otros schedulers. Si vienes de LSF, PBS o Torque los conceptos te resultarán familiares.

¿Cuándo tiene sentido SLURM frente a LSF?

SLURM es el estándar de facto en HPC académico y científico: open source, sin coste de licencia, comunidad enorme y presencia en la mayoría del Top500 — incluido el MareNostrum del BSC. LSF sigue siendo la opción cuando el negocio pide SLAs contractuales, soporte oficial IBM y gestión fina de licencias caras (EDA, CAE). Cubrimos la comparativa práctica en clase.

¿Sobre qué infraestructura se hacen las prácticas?

Sobre un clúster HPC real de nuestros laboratorios con controlador, controlador de respaldo y varios nodos de cómputo. Cada participante trabaja contra un entorno que simula producción, no una máquina virtual aislada.

¿Cubrís GPU y aceleradores?

Sí. La gestión de GPU vía GRES se cubre en el bloque de recursos: cómo declararlas, asignarlas por trabajo, compartirlas entre usuarios y contabilizarlas. El patrón sirve igual para otros aceleradores.

¿Este curso incluye scripting avanzado y tuning?

Es el curso de administración básica — cubre despliegue completo y operación diaria. El tuning fino del scheduler, integraciones específicas (Lustre, GPFS, contenedores) y arquitecturas multi-clúster van en formaciones avanzadas in-company a medida cuando el equipo ya tiene la base sólida.

¿Qué modalidades hay disponibles?

Contacta para consultar modalidades y fechas. Impartimos en español, inglés y francés, en modo online en directo o presencial, y preparamos convocatorias in-company a medida sobre vuestro clúster real.

¿Cuánto cuesta?

El precio se calcula por grupo y depende del formato, idioma y modalidad. Cuéntanos el caso — número de alumnos, ubicación y fechas objetivo — y te devolvemos una propuesta concreta.

¿Puedo cursarlo junto con el de LSF?

Sí, es lo habitual en equipos que operan HPC mixto o están en fase de migración entre schedulers. Podemos encadenar las dos formaciones (2+3 días) o preparar un itinerario in-company con el balance que necesite tu equipo. Escríbenos con vuestro escenario.
[ 06 ]   Solicitar información

Cuéntanos qué clúster tenéis

Dinos cuántos sois, en qué idioma, qué versión de SLURM usáis (o de qué scheduler venís) y si es online o presencial. Te devolvemos una propuesta concreta con formato, fechas y equipo docente — no un presupuesto genérico.

Teléfono+34 91 198 02 43
PrecioA consultar por grupo
IdiomasES · EN · FR
SIXE