Arquitecto de Infraestructuras IA & Capacity Planning (GPU / Observabilidad)
Tecdata Engineering
Madrid, Spain
13 days ago
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Apply on www.indeed.com
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
English, French
Job source
Tech stack
Linux
Prometheus
Technical Data Management Systems
Grafana
Docker
Job description
El rol se centra en la planificación de capacidad, optimización de recursos, análisis de demanda y definición de roadmap de infraestructura alineado con negocio, más que en el desarrollo software tradicional., Monitorización y Observabilidad
- Diseño, mantenimiento y evolución de dashboards en Prometheus y Grafana.
- Monitorización de uso de GPU en clusters de alto rendimiento.
- Análisis continuo de métricas técnicas de rendimiento e инфраструктura.
Gestión de Infraestructura GPU
- Supervisión de nodos Linux con GPU asegurando rendimiento, seguridad y estabilidad.
- Control del ciclo de vida de la infraestructura (actualización, renovación, escalado).
- Optimización del uso de recursos en entornos de computación intensiva.
Capacity Planning & Forecasting
- Desarrollo de modelos de capacidad y predicción de demanda.
- Análisis de consumo de recursos y proyección de crecimiento.
- Recomendación de escalado, inversión y optimización de costes., * Colaboración con equipos de negocio, finanzas, compras e ingeniería.
- Traducción de métricas técnicas en impacto económico y estratégico.
- Elaboración de reporting ejecutivo para dirección (C-level).
Reporting & Comunicación ejecutiva
- Creación de informes mensuales y trimestrales.
- Preparación de presentaciones estratégicas para comité de dirección.
- Explicación de evolución de infraestructuras y necesidades futuras.
Requirements
- Inglés: C1
- Francés: C2, * Experiencia sólida con arquitecturas GPU y rendimiento en entornos de alto cómputo.
- Administración de sistemas Linux.
- Experiencia con Docker y contenedores.
- Conocimiento avanzado de Prometheus y Grafana.
- Capacidad para analizar grandes volúmenes de datos de infraestructura.
- Experiencia en capacity planning y forecasting de recursos IT.
- Habilidad para traducir datos técnicos en informes ejecutivos., * Mentalidad analítica y orientada a optimización de recursos.
- Experiencia en entornos HPC o infraestructuras cloud complejas.
- Capacidad de trabajo transversal sin foco en desarrollo puro.
- Experiencia en entornos de alta escala y rápido crecimiento.
- Excelente comunicación con stakeholders técnicos y no técnicos., Perfil senior, orientado a infraestructura, datos de rendimiento y estrategia tecnológica, con capacidad para actuar como puente entre tecnología, negocio y finanzas, liderando la evolución de plataformas críticas de IA y computación de alto rendimiento.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Apply on www.indeed.com
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
IK
Igor Khokhriakov
about 2 months ago
CS
Christina Schaireiter
Best US AI Conferences for CTOs in 2026: Build vs. Buy, Vendor Evaluation, and Peer Intelligence
4 months ago
CH
Chris Heilmann
Dev Digest 120 - Apple and peers
over 2 years ago
LM
Luis Minvielle
Top-Paying Tech Jobs (with Salaries)
over 2 years ago
BB
Benedikt Bischof
Making Data Warehouses Fast: A Developer’s Story
about 4 years ago
LM
Luis Minvielle
The Most Popular IT Jobs on the Market
over 2 years ago