Saltar al contacto
Formación oficial IBM · HPC · 3 días · H010G

IBM Spectrum LSF
administración básica de clúster HPC

Curso oficial IBM H010G de tres jornadas para desplegar, operar y depurar un clúster Spectrum LSF en producción: instalación, colas, políticas fairshare y SLAs, gestión de CPU, GPU y memoria, integración de aplicaciones y troubleshooting. Alternativa empresarial a SLURM cuando el negocio pide soporte, priorización real y HA.

Duración 3 días · 24 h
Nivel Intermedio · admin Linux
Práctica Clúster HPC real
Formato Online o presencial
Logo IBM Spectrum LSF
IBM Spectrum LSF Clúster HPC bsub · bjobs · bkill Fairshare y SLAs GPU scheduling EGO vs SLURM · PBS LIM · RES · mbatchd IBM Spectrum LSF Clúster HPC bsub · bjobs · bkill Fairshare y SLAs GPU scheduling EGO vs SLURM · PBS LIM · RES · mbatchd
[ 01 ]Por qué este curso

Del bsub a operar
un clúster HPC en producción.

Tres jornadas con un clúster IBM Spectrum LSF real montado en nuestros laboratorios: master, candidate masters y hosts, colas configuradas, GPU y CPU compartidas, y aplicaciones reales de simulación numérica. El objetivo es que salgas con capacidad efectiva para operar un clúster, no solo con apuntes.

Cubrimos lo que aparece todos los días en producción — envío y control de trabajos con bsub, diseño de colas, políticas fairshare y SLAs, límites por usuario y proyecto, integración de aplicaciones, administración vía EGO y depuración cuando algo se rompe. Todo alineado con el temario oficial IBM H010G.

[ 02 ]Para quién es · qué te llevas

Un curso para equipos que operan cargas HPC en serio

Es para tu equipo si…

  • Sois administradores de Linux o UNIX que vais a desplegar o mantener un clúster LSF en producción.
  • Venís de SLURM, PBS o LoadLeveler y necesitáis pasar a LSF, o mantener ambos en paralelo.
  • Gestionáis cargas batch con SLA y priorización por proyecto: simulación numérica, EDA, ML, renderizado.
  • Necesitáis compartir CPU, GPU, memoria y licencias entre usuarios y grupos con reglas claras y auditables.

Al terminar ya operas

  • Instalas LSF de cero sobre RHEL o Debian y validas master, candidate masters y hosts.
  • Envías y controlas trabajos con bsub, bjobs, bkill, bstop y bresume.
  • Configuras recursos consumibles (CPU, GPU, memoria, licencias) y límites por usuario, grupo y proyecto.
  • Diseñas colas con fairshare, preemption y SLAs para cargas críticas.
  • Administras el clúster día a día y depuras con logs, trazas y bconf cuando algo falla en producción.
[ 03 ]Temario · 3 días

De la arquitectura de LSF a la operación diaria

Tres días que construyen el mismo clúster capa a capa: partimos de los fundamentos y la instalación, subimos hasta colas, políticas fairshare y SLAs, y acabamos administrando y depurando el sistema como en producción real.

01 Día 1 · Fundamentos e instalación

Arquitectura, instalación y primer envío de trabajos

  • Qué resuelve LSF y en qué se diferencia de SLURM, PBS o Kubernetes para HPC.
  • Arquitectura interna: LIM, RES, sbatchd, mbatchd y rol del master.
  • Instalación paso a paso sobre RHEL o Debian y verificación del clúster.
  • Primer envío con bsub y comandos básicos de consulta.
Práctica sobre clúster real
02 Día 2 · Recursos, colas y políticas

Gestión de recursos, colas y políticas de programación

  • Recursos consumibles: CPU, GPU, memoria y licencias de software.
  • Diseño de colas por perfil de usuario y tipo de carga.
  • Políticas fairshare, preemption y prioridades relativas.
  • SLAs y guarantees, límites por usuario, grupo, host y proyecto.
Práctica sobre clúster real
03 Día 3 · Operación, EGO y troubleshooting

Aplicaciones, administración vía EGO y depuración

  • Integración y despliegue de aplicaciones dentro del clúster.
  • Administración diaria: arranque, parada, incorporación de nuevos hosts.
  • Administración de recursos vía EGO cuando la instalación lo requiere.
  • Depuración con logs, trazas y bconf, y resolución de fallos habituales.
Práctica sobre clúster real
[ 05 ]Dudas frecuentes

Preguntas frecuentes

¿Qué experiencia previa necesito?

Administración básica de Linux o UNIX — bash, permisos, redes, sistemas de ficheros compartidos (NFS o similar). No se requiere experiencia previa con LSF ni con otros productos IBM. Si vienes de SLURM, PBS o LoadLeveler, los conceptos te resultarán familiares.

¿Cuándo tiene sentido LSF frente a SLURM o Kubernetes?

LSF es la opción empresarial cuando necesitas SLAs contractuales, priorización compleja entre proyectos, gestión fina de licencias caras y soporte oficial IBM. SLURM cubre la parte de scheduling libre, y Kubernetes está pensado para servicios, no para cargas batch tradicionales de HPC. En el curso hacemos comparativa práctica y ayudamos a decidir con criterio.

¿Sobre qué infraestructura se hacen las prácticas?

Sobre un clúster HPC real de nuestros laboratorios, con master, candidate masters y varios hosts. Cada participante trabaja contra un entorno que simula producción, no una máquina virtual aislada.

¿Cubrís GPU scheduling?

Sí. La gestión de GPU como recurso consumible se cubre dentro del bloque de gestión de recursos: cómo declararlas, asignarlas por trabajo y compartirlas entre usuarios con reglas fairshare o límites por proyecto.

¿En qué se diferencia de los cursos LSF avanzados?

Este es el curso oficial de administración básica (H010G) — cubre despliegue completo y operación diaria de un clúster LSF. Los cursos avanzados profundizan en tuning fino, integraciones específicas y arquitecturas grandes; los impartimos aparte cuando el equipo ya tiene la base sólida.

¿Qué modalidades hay disponibles?

Contacta para consultar modalidades y fechas. Ofrecemos formación en español, inglés y francés, en modo online en directo o presencial, y podemos preparar convocatorias in-company a medida sobre vuestro clúster real.

¿Cuánto cuesta?

El precio se calcula por grupo y depende del formato, idioma y modalidad. Cuéntanos el caso — número de alumnos, ubicación y fechas objetivo — y te devolvemos una propuesta concreta.

¿Puedo pedirlo in-company para mi equipo?

Sí. Ajustamos ritmo, ejemplos y ejercicios al stack real de tu organización — versiones de sistema operativo, topología de red, aplicaciones y SLAs. Escríbenos con número de alumnos, ubicación (presencial o remoto) e idiomas necesarios.
[ 06 ]   Solicitar información

Cuéntanos qué clúster tenéis

Dinos cuántos sois, en qué idioma, qué versión de LSF usáis (o de qué scheduler venís) y si es online o presencial. Te devolvemos una propuesta concreta con formato, fechas y equipo docente — no un presupuesto genérico.

Teléfono+34 91 198 02 43
PrecioA consultar por grupo
IdiomasES · EN · FR
SIXE