Arquitecto de Infraestructuras IA & Capacity Planning (GPU / Observabilidad)

Tecdata Engineering
Madrid, Spain
13 days ago
Apply on www.indeed.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
English, French
Job source

Tech stack

Linux Prometheus Technical Data Management Systems Grafana Docker

Job description

El rol se centra en la planificación de capacidad, optimización de recursos, análisis de demanda y definición de roadmap de infraestructura alineado con negocio, más que en el desarrollo software tradicional., Monitorización y Observabilidad

  • Diseño, mantenimiento y evolución de dashboards en Prometheus y Grafana.
  • Monitorización de uso de GPU en clusters de alto rendimiento.
  • Análisis continuo de métricas técnicas de rendimiento e инфраструктura.

Gestión de Infraestructura GPU

  • Supervisión de nodos Linux con GPU asegurando rendimiento, seguridad y estabilidad.
  • Control del ciclo de vida de la infraestructura (actualización, renovación, escalado).
  • Optimización del uso de recursos en entornos de computación intensiva.

Capacity Planning & Forecasting

  • Desarrollo de modelos de capacidad y predicción de demanda.
  • Análisis de consumo de recursos y proyección de crecimiento.
  • Recomendación de escalado, inversión y optimización de costes., * Colaboración con equipos de negocio, finanzas, compras e ingeniería.
  • Traducción de métricas técnicas en impacto económico y estratégico.
  • Elaboración de reporting ejecutivo para dirección (C-level).

Reporting & Comunicación ejecutiva

  • Creación de informes mensuales y trimestrales.
  • Preparación de presentaciones estratégicas para comité de dirección.
  • Explicación de evolución de infraestructuras y necesidades futuras.

Requirements

  • Inglés: C1
  • Francés: C2, * Experiencia sólida con arquitecturas GPU y rendimiento en entornos de alto cómputo.
  • Administración de sistemas Linux.
  • Experiencia con Docker y contenedores.
  • Conocimiento avanzado de Prometheus y Grafana.
  • Capacidad para analizar grandes volúmenes de datos de infraestructura.
  • Experiencia en capacity planning y forecasting de recursos IT.
  • Habilidad para traducir datos técnicos en informes ejecutivos., * Mentalidad analítica y orientada a optimización de recursos.
  • Experiencia en entornos HPC o infraestructuras cloud complejas.
  • Capacidad de trabajo transversal sin foco en desarrollo puro.
  • Experiencia en entornos de alta escala y rápido crecimiento.
  • Excelente comunicación con stakeholders técnicos y no técnicos., Perfil senior, orientado a infraestructura, datos de rendimiento y estrategia tecnológica, con capacidad para actuar como puente entre tecnología, negocio y finanzas, liderando la evolución de plataformas críticas de IA y computación de alto rendimiento.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.indeed.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

1:46 min

Introduction to the speaker and engineering background

Llywelyn Griffith-Swain · World Congress 2023

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · World Congress 2025

2:07 min

Inspecting default bridge architectures and custom Docker networks

Oliver Seitz Oliver Seitz · World Congress 2025

1:07 min

Architecting the availability stack with Prometheus and Grafana

Gabriel Labachelerie · World Congress 2023

3:30 min

Transitioning from CUDA software architect to user

Stephen Jones · Coffee With Developers

3:55 min

Demonstrating .NET installation on Debian and Azure Linux

Silvano Coriani Silvano Coriani · Europe 2026 Virtual

Videos

See all

Related articles

See all