Arquitecto de infraestructuras IA

Tecdata Engineering
Madrid, Spain
13 days ago
Apply on www.indeed.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience required
5 years minimum
Working hours
Regular working hours
Languages
English, French
Job source

Tech stack

Linux Prometheus Usage Analysis Grafana Docker

Job description

Buscamos un/a Platform Monitoring Owner con experiencia en plataformas de monitorización basadas en Prometheus y Grafana, gestión de entornos con GPU, administración de plataformas Linux y contenedores Docker. La persona será responsable de la evolución de las plataformas de monitorización, alineando métricas técnicas con objetivos de negocio y liderando iniciativas de Capacity Planning, Infrastructure Lifecycle Management, Demand Forecasting y definición de la hoja de ruta de las plataformas., * Monitorizar y analizar la utilización de GPU en diferentes clústeres mediante dashboards de Prometheus y Grafana.

  • Diseñar, mantener y evolucionar plataformas de monitorización y observabilidad.
  • Desarrollar y mantener modelos de capacidad para prever necesidades futuras de infraestructura.
  • Definir estrategias de escalado, renovación de hardware y optimización de costes.
  • Gestionar el ciclo de vida de la infraestructura y su alineación con las necesidades del negocio.
  • Realizar previsiones de demanda de proyectos y capacidad tecnológica.
  • Garantizar el cumplimiento de estándares de seguridad y fiabilidad en nodos Linux con GPU.
  • Coordinarse con equipos de ingeniería, compras y finanzas para alinear las decisiones de infraestructura con los objetivos corporativos.
  • Elaborar informes ejecutivos mensuales y trimestrales para dirección, incluyendo análisis de uso, previsiones de crecimiento e impacto de inversión.
  • Definir y ejecutar la hoja de ruta de evolución de las plataformas.

Requirements

  • Mínimo 5 años de experiencia en posiciones similares.
  • Experiencia sólida con Prometheus y Grafana.
  • Conocimiento y experiencia en monitorización y gestión de infraestructuras con GPU.
  • Conocimientos avanzados de Linux.
  • Experiencia en Docker y entornos containerizados.
  • Experiencia en Capacity Planning, gestión de capacidad y previsión de demanda tecnológica.
  • Capacidad para transformar grandes volúmenes de datos en documentación e informes ejecutivos.
  • Experiencia presentando información a perfiles directivos y C-Level.
  • Nivel de inglés C1.
  • Nivel de francés C2.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.indeed.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

1:07 min

Architecting the availability stack with Prometheus and Grafana

Gabriel Labachelerie · World Congress 2023

1:46 min

Introduction to the speaker and engineering background

Llywelyn Griffith-Swain · World Congress 2023

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · World Congress 2025

2:07 min

Inspecting default bridge architectures and custom Docker networks

Oliver Seitz Oliver Seitz · World Congress 2025

2:48 min

Daily responsibilities and alignment practices for technical engineering leadership

Edoardo Dusi · LIVE

3:55 min

Demonstrating .NET installation on Debian and Azure Linux

Silvano Coriani Silvano Coriani · Europe 2026 Virtual

Videos

See all

Related articles

See all