> Markdown version of [/jobs/ext/3361867-arquitecto-de-infraestructuras-ia-capacity-planning-gpu-observabilidad](https://www.wearedevelopers.com/jobs/ext/3361867-arquitecto-de-infraestructuras-ia-capacity-planning-gpu-observabilidad). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Arquitecto de Infraestructuras IA & Capacity Planning (GPU / Observabilidad) - **Company:** Tecdata Engineering - **Location:** Madrid, Spain - **Contract:** Permanent contract - **Skills:** Linux, Prometheus, Technical Data Management Systems, Grafana, Docker - **Published:** September 21, 2026 - **Apply:** https://www.indeed.com/viewjob?jk=4ebf0c6ab5ce45bc ## About the Role * Inglés: C1 * Francés: C2, * Experiencia sólida con arquitecturas GPU y rendimiento en entornos de alto cómputo. * Administración de sistemas Linux. * Experiencia con Docker y contenedores. * Conocimiento avanzado de Prometheus y Grafana. * Capacidad para analizar grandes volúmenes de datos de infraestructura. * Experiencia en capacity planning y forecasting de recursos IT. * Habilidad para traducir datos técnicos en informes ejecutivos., * Mentalidad analítica y orientada a optimización de recursos. * Experiencia en entornos HPC o infraestructuras cloud complejas. * Capacidad de trabajo transversal sin foco en desarrollo puro. * Experiencia en entornos de alta escala y rápido crecimiento. * Excelente comunicación con stakeholders técnicos y no técnicos., Perfil senior, orientado a infraestructura, datos de rendimiento y estrategia tecnológica, con capacidad para actuar como puente entre tecnología, negocio y finanzas, liderando la evolución de plataformas críticas de IA y computación de alto rendimiento. ## Description El rol se centra en la planificación de capacidad, optimización de recursos, análisis de demanda y definición de roadmap de infraestructura alineado con negocio, más que en el desarrollo software tradicional., Monitorización y Observabilidad * Diseño, mantenimiento y evolución de dashboards en Prometheus y Grafana. * Monitorización de uso de GPU en clusters de alto rendimiento. * Análisis continuo de métricas técnicas de rendimiento e инфраструктura. Gestión de Infraestructura GPU * Supervisión de nodos Linux con GPU asegurando rendimiento, seguridad y estabilidad. * Control del ciclo de vida de la infraestructura (actualización, renovación, escalado). * Optimización del uso de recursos en entornos de computación intensiva. Capacity Planning & Forecasting * Desarrollo de modelos de capacidad y predicción de demanda. * Análisis de consumo de recursos y proyección de crecimiento. * Recomendación de escalado, inversión y optimización de costes., * Colaboración con equipos de negocio, finanzas, compras e ingeniería. * Traducción de métricas técnicas en impacto económico y estratégico. * Elaboración de reporting ejecutivo para dirección (C-level). Reporting & Comunicación ejecutiva * Creación de informes mensuales y trimestrales. * Preparación de presentaciones estratégicas para comité de dirección. * Explicación de evolución de infraestructuras y necesidades futuras. ## Related Videos - [Docker network without Docker](https://www.wearedevelopers.com/videos/1418-docker-network-without-docker) - [Monitoring as Code - Managing your dashboards at scale](https://www.wearedevelopers.com/videos/753-monitoring-as-code-managing-your-dashboards-at-scale) - [Docker Compose: Rediscovered](https://www.wearedevelopers.com/videos/1978-docker-compose-rediscovered) - [Shipping Faster with Less: Render on Cloud Hosting, AI Workloads, and the Future of DevOps](https://www.wearedevelopers.com/videos/1894-shipping-faster-with-less-render-on-cloud-hosting-ai-workloads-and-the-future-of-devops) - [All your telemetry data from any source in one place](https://www.wearedevelopers.com/videos/57-all-your-telemetry-data-from-any-source-in-one-place) - [Docker exec without Docker](https://www.wearedevelopers.com/videos/1094-docker-exec-without-docker) ## Related Articles - [How We Built a Worry-Free System That Runs for 10+ Years – And What We’d Do Again](https://www.wearedevelopers.com/magazine/751-how-we-built-a-worry-free-system-that-runs-for-10-years-and-what-we-d-do-again) - [Best US AI Conferences for CTOs in 2026: Build vs. Buy, Vendor Evaluation, and Peer Intelligence](https://www.wearedevelopers.com/magazine/736-best-us-ai-conferences-for-ctos-in-2026-build-vs-buy-vendor-evaluation-and-peer-intelligence) - [Dev Digest 120 - Apple and peers](https://www.wearedevelopers.com/magazine/455-dev-digest-120-apple-and-peers) - [Top-Paying Tech Jobs (with Salaries)](https://www.wearedevelopers.com/magazine/372-top-paying-tech-jobs-with-salaries) - [Making Data Warehouses Fast: A Developer’s Story](https://www.wearedevelopers.com/magazine/107-making-data-warehouses-fast-a-developer-s-story) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market)