> Markdown version of [/jobs/ext/3362060-site-reliability-engineer-observabilidad-ia](https://www.wearedevelopers.com/jobs/ext/3362060-site-reliability-engineer-observabilidad-ia). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Site Reliability Engineer (Observabilidad IA) - **Company:** LOGICALIS SPAIN - **Location:** Madrid, Spain - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Amazon Web Services, Microsoft Azure, Continuous Integration, DevOps, Python (Programming Language), Machine Learning, Prometheus, Graphics Processing Unit (GPU), Large Language Models, Grafana, Kubernetes, Bicep, Terraform - **Published:** September 22, 2026 - **Apply:** https://www.indeed.com/viewjob?jk=766f06434497f64a ## About the Role * 3-6 años de experiencia como Site Reliability Engineer (SRE), DevOps Engineer, Production Engineer o Observability Engineer en entornos de producción. * Experiencia trabajando con AWS y/o Azure, así como con plataformas basadas en Kubernetes. * Experiencia con herramientas de observabilidad como Prometheus, Grafana y OpenTelemetry. * Conocimientos de Infraestructura como Código mediante Terraform y/o Bicep y experiencia en entornos CI/CD. * Conocimientos de Python orientados a automatización y mejora de procesos operativos. * Valorable experiencia en entornos de Machine Learning, LLMs, GPUs o plataformas de IA. * Nivel de inglés B2/C1., > Posibilidad de acogerse a planes de retribución flexible (tarjeta restaurante, tarjeta transporte y tarjeta guardería). > Seguro médico y GYMPASS. > Planes de formación adaptados a cada perfil (cursos técnicos, certificaciones oficiales, formación de idiomas...). > Portal de descuentos especiales para empleados. > Buen ambiente de trabajo y entorno muy colaborativo. ## Description El equipo de Data & AI de Logicalis trabaja con clientes nacionales e internacionales, llevando a cabo importantes proyectos de ingeniería de datos, inteligencia artificial y analítica avanzada, estrategia del dato, gobierno, integración y arquitectura, abarcando todo el ciclo de vida del dato., * Garantizar la fiabilidad, disponibilidad y rendimiento de plataformas y productos de IA en entornos de producción. * Definir y gestionar SLIs, SLOs y Error Budgets, colaborando con los equipos de producto para equilibrar innovación y estabilidad. * Diseñar e impulsar soluciones de observabilidad y monitorización, valorable en entornos de Inteligencia Artificial. * Liderar la gestión de incidencias y coordinar la resolución de problemas en entornos críticos, promoviendo una cultura de mejora continua. * Automatizar procesos operativos y desarrollar mecanismos de auto-remediación para mejorar la eficiencia y reducir tareas manuales. * Trabajar junto a equipos de desarrollo, plataforma e IA para garantizar la escalabilidad, resiliencia y optimización de los servicios.