Tech_Ingeniero/a de Almacenamiento HPC e IA
Fecha: 7 sept 2026
Ubicación: MADRID, ES
Empresa: Telefónica

¿QUÉ ES TELEFONICA TECH?
Telefónica Tech es la compañía líder en trasformación digital del Grupo Telefónica. Contamos con una amplia oferta de servicios y soluciones tecnológicas integradas de Ciberseguridad, Cloud, IoT, Big Data, Inteligencia Artificial y Blockchain, con la que acompañamos a nuestros clientes en su transformación digital.
Somos un grupo de más de 6200 personas valientes que trabajamos a diario desde distintos puntos del mundo para alcanzar la excelencia, a través de un liderazgo basado en la transparencia y en el espírItu de equipo. Si te identificas con nuestros pilares, ¡estamos deseando conocerte!
¿QUÉ HACEMOS EN EL EQUIPO?
Dentro de Telefónica Tech tenemos la misión de explotar los sistemas de almacenamientos propios y de nuestros clientes dando valor al servicio con un equipo en 24x7 en dos husos horarios
Incorporamos una visión de extremo a extremo, con cultura DevOps, desarrollamos plataformas, las implantamos y las operamos, porque queremos mantener nuestras plataformas en la mejor forma, adaptándonos a la evolución que exigen los clientes y siempre con la vista puesta en la calidad.
¿CÓMO SERÁ TU DÍA A DÍA?
Buscamos un/a profesional experto/a en almacenamiento para HPC e inteligencia artificial que actúe como principal responsable de la arquitectura y administración de nuestra infraestructura all-flash IBM Storage Scale System 6000 (ESS 6000).
En este puesto, serás responsable de aprovechar al máximo la capacidad de transferencia de varios TB/s de nuestra plataforma ESS de varios petabytes, proporcionando el rendimiento necesario para clústeres de entrenamiento de inteligencia artificial con un elevado consumo de datos y para entornos complejos de computación de alto rendimiento (HPC).
Esta posición conecta el almacenamiento paralelo optimizado por hardware con las cargas de trabajo cloud basadas en contenedores. Liderarás la integración de almacenamiento de objetos S3 de alto rendimiento mediante Cluster Export Services (CES), garantizando un flujo de datos eficiente hacia niveles NVMe de alta densidad y clústeres de GPU multinodo, aprovechando al máximo la capacidad de la infraestructura.
Responsabilidades principales
- Administración de la plataforma y del hardware ESS 6000: desplegar, ampliar y mantener sistemas IBM ESS 6000. Responsabilizarse de las actualizaciones del software basado en contenedores y de la supervisión del estado del hardware en los dos módulos servidor del sistema.
- Gestión de Storage Scale RAID y codificación de borrado: diseñar, formatear y optimizar configuraciones de Storage Scale RAID. Administrar grupos de recuperación, discos virtuales —vdisks— y discos físicos —pdisks—, utilizando codificación de borrado distribuida (declustered erasure coding) para garantizar un rendimiento de escritura extremo y reducir los tiempos de reconstrucción.
- Gestión jerárquica del almacenamiento (HSM) y almacenamiento por niveles en cinta: diseñar, implantar y mantener políticas transparentes de almacenamiento en cinta mediante IBM Storage Archive —anteriormente Spectrum Archive / Linear Tape File System (LTFS)—. Automatizar la migración y recuperación transparente de los datos entre el nivel flash de ESS y la infraestructura de cintas.
- Administración de librerías de cintas empresariales: gestionar librerías IBM de gama alta, como TS4500, que incorporen tecnologías de unidades LTO o TS1100 de nivel empresarial. Supervisar las particiones de las librerías, el ciclo de vida de los cartuchos, las configuraciones de las rutas de acceso a las unidades y la zonificación SAN mediante Fibre Channel o SAS.
- S3 de alto rendimiento y acceso multiprotocolo: implantar, ampliar y monitorizar clústeres CES S3 basados en NooBaa sobre nodos de protocolo específicos. Optimizar la concurrencia multiprotocolo para permitir que los mismos bloques NVMe subyacentes de ESS puedan leerse mediante API S3 nativas, POSIX o NFS, sin corrupción de datos ni penalizaciones significativas de latencia.
- Ingeniería de redes de alto rendimiento y transporte directo: administrar redes InfiniBand/RoCE de 400 Gb NDR o 200 Gb HDR mediante los adaptadores ConnectX-7 integrados en la plataforma. Desplegar y validar NVIDIA GPUDirect Storage (GDS) y S3 sobre RDMA para transferir los datos directamente desde el nivel flash del ESS 6000 hasta la memoria de las GPU.
- Orquestación de flujos de datos HPC e IA: alinear las operaciones de almacenamiento con planificadores de trabajos paralelos, como Slurm, e interfaces de almacenamiento para contenedores (CSI) en Kubernetes u OpenShift. Utilizar Active File Management (AFM) para proporcionar caché de baja latencia y automatizar la gestión del ciclo de vida y el almacenamiento por niveles.
Y PARA ELLO, CREEMOS QUE SERÍA IDEAL QUE CONTARAS CON…
Experiencia
Experiencia directa con IBM ESS/SSS: al menos tres años de experiencia práctica y específica en la administración de dispositivos IBM Elastic Storage System (ESS) o Storage Scale System (SSS). Dominio de la ejecución de comandos especializados de la plataforma, como mmvdisk, mmhealth y mmchrecoverygroup.
Conocimientos avanzados de S3 de alto rendimiento: experiencia demostrable en el diseño de nodos empresariales de almacenamiento de objetos S3. Conocimiento experto de las estructuras de buckets CES S3, aplicación de políticas, balanceo de carga multinodo y análisis del rendimiento mediante herramientas como COSBench.
Dominio de sistemas de archivos paralelos: conocimiento profundo de la arquitectura interna de IBM Storage Scale —anteriormente GPFS—, incluyendo la gestión de tokens, la definición de pagepool y los mecanismos de bloqueo distribuido.
Experiencia en infraestructuras all-flash: conocimiento sólido de las rutas de almacenamiento NVMe/PCIe Gen 5, la optimización de la capa de bloques del kernel y los mecanismos de entrada/salida directa.
Conocimientos avanzados de redes de alto rendimiento: experiencia de nivel experto en la administración de redes RDMA, gestores de subred (Subnet Managers), enrutamiento adaptativo y diseño de redes de almacenamiento de baja latencia.
IDIOMAS
- Inglés nivel avanzado.
Para desempeñar el puesto, las habilidades que encajarían con el equipo y el proyecto serían:
- Capacidad de trabajo en equipo.
¿QUÉ OFRECEMOS?
• Medidas de conciliación y flexibilidad horaria.
• Formación continua y certificaciones.
• Modelo híbrido de teletrabajo.
• Atractivo paquete de beneficios sociales.
• Excelente ambiente de trabajo dinámico y multidisciplinar.
• Programas de voluntariado.
#SomosDiversos #Fomentamosigualdad
Estamos convencidos/as de que los equipos diversos e inclusivos son más innovadores, transformadores y consiguen mejores resultados.
Por ello promovemos y garantizamos la inclusión de todas las personas sin importar género, edad, orientación e identidad sexual, cultura, discapacidad o cualquier otra condición
¡Queremos conocerte! 😊