Saltar al contacto
Formación avanzada · Nivel 3

Ceph Production OperationsCuando un clúster de 200 TB falla a las 3 AM y necesitas respuestas, no teoría

El único curso independiente de distribución — IBM Storage Ceph, Red Hat, Ubuntu, Rocky, Alma Linux o Ceph upstream. Escenarios reales de producción a escala petabyte que los vendors no enseñan, con temario alineado a la certificación Red Hat EX260.

Formación Ceph Production Operations impartida por SIXE — instructora explicando escenarios críticos de administración de clústeres Ceph a escala petabyte
3 díasIntensivos
100%Hands-on
EscenariosReales de producción
Máx 10Alumnos por grupo
[ 01 ]Aprenderás a resolver

Los escenarios que no aparecen en la documentación

Cuatro clases de problemas reales que trabajamos durante el curso, no diapositivas ni ejemplos de manual.

01

Fallos críticos en clústeres de 200 TB+

02

Recovery de 40 TB de CephFS corrupto

03

Tuning extremo para AI/ML (500 TB/día)

04

Troubleshooting bajo presión 24/7

[ 02 ]Para quién
Nivel
Senior

Administradores certificados o con experiencia real en producción que necesitan dominar escenarios críticos que los vendors no enseñan — los que llegan a las 3 AM cuando el clúster se cae.

[ 03 ]Estructura · 3 días

Programa intensivo para enfrentar crisis reales

Diseñado para optimizar clústeres de producción a escala petabyte. Cada día combina una mañana de fundamentos avanzados con una tarde de laboratorio sobre problemas reales.

01
Día 1

Performance Engineering y Forensics avanzado

De arquitectura a troubleshooting forense real.

Mañana

Optimización arquitectural

  • BlueStore internals: RocksDB tuning, compaction, write amplification
  • CPU optimization: impacto de C-states (labs con 5× de degradación), NUMA
  • Red: patrones 100 GbE, TCP tuning, nf_conntrack
  • NVMe-specific: reactor tuning, optimización de bdevs_per_cluster
Tarde

Troubleshooting forense

  • Diagnostic toolchain: blktrace, perf, objectstore-tool
  • Case studies reales: NVMe degradation, OSD flapping post-upgrade
  • PG lifecycle avanzado: stuck states, intervención manual
  • Labs: clúster con problemas reales para diagnosticar
02
Día 2

Disaster Recovery, Multi-Site y Petabyte Scaling

Recuperación extrema y arquitecturas multi-sitio.

Mañana

DR avanzado

  • Caso Edinburgh 40 TB: cadena completa del error y procedimiento de recovery
  • CephFS disasters: corrupción de metadata, MDS failure handling
  • RBD mirroring: pool-based vs image-based, automatización de failover
  • DR físico: extracción de disco, preservación de journal y whoami
Tarde

Multi-Site y Petabytes

  • RGW multisite: master zone failure, promoción manual, sync fairness
  • Planificación WAN: fórmula 1 GbE por 8 TB de ingest diario
  • Petabyte challenges: CERN 30 PB (7 200 OSDs), 310 M objetos
  • Labs: simulación de multi-site failover y recovery
03
Día 3

Security, AI/ML Workloads y Cost Engineering

Seguridad enterprise y optimización para cargas modernas.

Mañana

Security Hardening

  • Encryption: OSDs con LUKS/dmcrypt, msgr2 secure, RGW SSE-S3/KMS
  • Key management: rotación (Squid 19.2.3+), integración con Barbican
  • Compliance: arquitectura HIPAA, GDPR, audit logging
  • Threat detection: patrones de monitorización y gestión de vulnerabilidades
Tarde

AI/ML y ROI Engineering

  • S3 Select: integración con Trino (rendimiento 2,5× a 9×), analytics pushdown
  • Patrones AI/ML: checkpointing, optimización de acceso paralelo
  • Análisis TCO: eficiencia EC, ahorros con hardware commodity
  • Arquitecturas híbridas: OpenStack DCN, edge-to-core, multi-cloud
[ 04 ]Especificaciones del laboratorio

Infraestructura realista en cloud enterprise

Cada alumno trabaja sobre un clúster real con datos pre-poblados. El laboratorio se mantiene accesible 7 días después del curso para consolidar el aprendizaje.

Infraestructura

  • Clúster de 5-6 nodos reales
  • 500 GB+ de datos pre-poblados por alumno
  • Acceso 24/7 durante y 7 días después

Escenarios reales

  • Disk failures y network partitions
  • Corrupción simulada de metadata
  • Performance degradation inyectada

Herramientas

  • blktrace, perf, objectstore-tool
  • Debugging symbols preinstalados
  • Datasets reales con I/O patterns
[ 05 ]Independiente de distribución

Trabajamos con tu distribución y versión

Alineamos el laboratorio con lo que tu equipo tiene en producción. Sin sesgo de vendor.

Distribuciones disponibles

  • Rocky Linux 9
  • Ubuntu 24.04 LTS
  • Red Hat Enterprise Linux
  • Alma Linux

Versiones Ceph

  • Ceph upstream Squid 19.2+
  • IBM Storage Ceph 7.1
  • Red Hat Ceph Storage 7.x
[ 06 ]Próximas convocatorias

Tres formatos, grupos reducidos

Formación intensiva de 3 días, máximo 10 participantes para maximizar la interacción y el troubleshooting colaborativo.

Modalidad · 01

Presencial

En nuestras instalaciones, con acceso completo a laboratorios y equipamiento especializado.

Modalidad · 02

On-site

En tu organización, para equipos de 4 o más personas, con configuración personalizada al entorno del cliente.

Modalidad · 03

Remota

En vivo con laboratorio cloud dedicado y acceso completo a los recursos de práctica en tiempo real.

[ 07 ]Certificación SIXE

Badge Ceph Production Operations + preparación EX260

Al completar el curso obtienes el badge digital Ceph Production Operations emitido por SIXE en Credly (Nivel 3, el más senior del itinerario). El temario está alineado con las áreas evaluadas en Red Hat EX260Red Hat Certified Specialist in Ceph Cloud Storage: deployment, gestión de pools replicated y erasure coded, RBD/RGW/CephFS, troubleshooting, performance tuning, security y alta disponibilidad/disaster recovery. Si buscas simulacro de examen específico y guía de preparación paso a paso, ese está en el Nivel 2 (Avanzado).

Badge digital Ceph Production Operations emitido por SIXE en Credly — certificado del Nivel 3 (Experto) del itinerario formativo en Ceph

Ceph Production Operations · Nivel 3 · Experto

Emitido por SIXE en Credly al completar el curso. Certifica capacidad de operar clústeres Ceph a escala petabyte en producción: forensics, disaster recovery, multi-site, security hardening y cargas AI/ML. Credencial verificable con enlace único.

Ver credenciales SIXE en Credly
[ 08 ]Más allá de la formación

SIXE es IBM Business Partner

Además de la formación, vendemos, implantamos y damos soporte a IBM Storage Ceph. Si necesitas cubrir el ciclo completo, cuenta con nosotros.

Adquisición de licencias

Asesoría técnica para dimensionar y adquirir licencias de IBM Storage Ceph adaptadas al caso de uso de tu organización.

Despliegue en producción

Diseño e implantación de IBM Storage Ceph: arquitectura, hardware, red, integración con OpenStack, Kubernetes y sistemas legacy.

Soporte técnico Ceph

Soporte continuo con respuesta especializada de nuestro equipo de ingeniería. Ver servicio →

[ 09 ]Itinerario formativo

Este curso es el Nivel 3 del itinerario Ceph

Tres cursos independientes. Este es el más senior: pensado para quien ya opera Ceph y necesita dominar los escenarios críticos que ningún vendor enseña.

01 Nivel 1 · Iniciación

Despliegue y administración

Fundamentos hasta clúster funcional Más información
02 Nivel 2 · Avanzado

Administración avanzada

Tuning, multi-site DR y EX260 Más información
Estás aquí 03 Nivel 3 · Experto

Production Operations

Forensics, DR, AI/ML, HIPAA y EX260 Ver programa

Cursos relacionados: OpenStack avanzado · Docker y Kubernetes · Ansible. Servicios: Soporte técnico Ceph · Inferencia IA sobre Ceph.

[ 10 ]Dudas frecuentes

Preguntas frecuentes

¿Qué perfil se espera del alumno?

Administradores certificados o con experiencia real en producción con Ceph. No es un curso de iniciación ni de repaso: se asume manejo previo de OSDs, pools, RBD, RGW, CephFS y troubleshooting básico. Si no tienes ese nivel, empieza por el Nivel 1 o el Nivel 2.

¿Funciona el curso si usamos IBM Storage Ceph? ¿Y con Ceph upstream?

Sí, con ambos. El curso es independiente de distribución: cubrimos IBM Storage Ceph 7.1, Red Hat Ceph Storage 7.x, Ceph upstream Squid 19.2+ y las distribuciones base Rocky Linux 9, Ubuntu 24.04 LTS, RHEL y Alma Linux. Adaptamos el laboratorio a la combinación que tu equipo usa en producción.

¿Qué tamaño de grupo tiene el curso?

Máximo 10 participantes por convocatoria. Es una decisión de diseño: en escenarios de crisis y troubleshooting colaborativo, grupos más grandes matan la interacción. Para formación in-company el mínimo es de 4 personas.

¿Cuánto dura el acceso al laboratorio?

Acceso 24/7 durante los 3 días del curso y 7 días adicionales tras la última sesión. El objetivo es que puedas repetir los ejercicios y consolidar el aprendizaje mientras el material está fresco.

¿Este curso prepara para la certificación Red Hat EX260?

Sí. El temario está alineado con las áreas evaluadas en EX260Red Hat Certified Specialist in Ceph Cloud Storage: deployment, pools replicated y erasure coded, RBD/RGW/CephFS, troubleshooting, performance tuning, security y HA/DR. Si además del contenido necesitas simulacro específico de examen y guía de preparación paso a paso, esa parte está en el Nivel 2 (Avanzado). El curso no incluye la matrícula del examen: se contrata directamente a Red Hat.

¿Los escenarios del laboratorio son reales o simulados?

Ambas cosas. Cargas y datasets con I/O patterns reales, y sobre eso se inyectan fallos controlados: disk failures, network partitions, corrupción de metadata, degradación de performance. El diagnóstico y la respuesta son al 100 % tuyos.

¿Se puede reducir el temario a 2 días?

Se puede, pero no lo recomendamos. El día de DR + multi-site necesita tiempo para hacer los failover completos. Si tienes limitación de agenda, hablemos: normalmente lo resolvemos manteniendo los 3 días pero comprimiendo alguna sesión.

¿Podéis dar soporte 24/7 a nuestro clúster después del curso?

Sí. SIXE es IBM Business Partner y ofrecemos soporte técnico Ceph continuo con acuerdos de respuesta especializada.
[ 11 ]   Solicita información

¿Listo para eliminar el respeto a los escenarios críticos?

Solicita información sobre próximas fechas, programa detallado y condiciones. Respuesta en menos de 24 horas.

O llámanos directamente +34 91 198 02 43
SIXE