> Markdown version of [/jobs/ext/2856593-principal-aws-resilience-site-reliability-consultant](https://www.wearedevelopers.com/jobs/ext/2856593-principal-aws-resilience-site-reliability-consultant). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Principal AWS Resilience & Site Reliability Consultant - **Company:** Hays plc - **Location:** London, UK - **Contract:** Temporary contract - **Skills:** Amazon Web Services, Backup Devices, Software as a Service, Cloud Computing, Cloud Engineering, Disaster Recovery, Failover, Real-Time Operating Systems, Reliability Engineering, Site Reliability Engineering Practices, Web Platforms, Backup and Restore, Datadog, Cloud Platform System, Grafana, Terraform, Splunk - **Published:** September 12, 2026 - **Apply:** https://www.hays.co.uk/job-detail/principal-aws-resilience-site-reliability-consultant-london_4827137 ## About the Role * Extensive AWS architecture and cloud platform experience * AWS Backup and AWS Elastic Disaster Recovery (DRS) * Disaster Recovery and Business Continuity planning * Terraform and Infrastructure as Code * AWS multi-account environments * Cross-region resilience and recovery architectures * Recovery testing, failover and failback planning * Strong understanding of Site Reliability Engineering principles * Automation and platform engineering experience * Excellent stakeholder management and consultancy skills Desirable * AWS Resilience Hub * Cyber recovery and ransomware resilience * Observability tooling such as Grafana, Datadog, Splunk or Elastic * Experience supporting large-scale consumer-facing digital platforms * Gaming, media, entertainment, SaaS or cloud-native technology environments * AWS Solutions Architect Professional certification ## Description We're seeking a Principal AWS Resilience & Site Reliability Consultant to help shape and deliver cloud resilience, disaster recovery and service reliability capabilities across a large-scale multinational technology environment. 3-month contract initially London (1 day per week) Inside IR35 Working within a highly available AWS platform estate, you'll lead the design of recovery architectures, resilience frameworks and automated recovery capabilities, ensuring business-critical services remain secure, recoverable and available. This role combines AWS architecture, disaster recovery, operational resilience, platform engineering and Site Reliability Engineering (SRE), making it ideal for a senior consultant who enjoys solving complex availability and recoverability challenges. Responsibilities * Design and implement AWS-native backup, disaster recovery and resilience solutions * Define and govern recovery strategies, RTOs and RPOs for critical services * Lead adoption of AWS Backup, AWS Elastic Disaster Recovery (DRS), AWS Resilience Hub and multi-region recovery patterns * Develop backup & restore, pilot light, warm standby and active/active architectures * Drive Terraform adoption and Infrastructure as Code standards * Create automated recovery workflows, runbooks and operational playbooks * Establish SRE practices including SLIs, SLOs, observability and service reliability metrics * Lead disaster recovery testing, failover exercises and resilience assurance activities * Partner with engineering, architecture and leadership teams to improve platform recoverability and operational readiness * Provide technical leadership and strategic guidance across resilience initiatives Essential Skills * Extensive AWS architecture and cloud platform experience * AWS Backup and AWS Elastic Disaster Recovery (DRS) * Disaster Recovery and Business Continuity planning * Terraform and Infrastructure as Code * AWS multi-account environments * Cross-region resilience and recovery architectures * Recovery testing, failover and failback planning * Strong understanding of Site Reliability Engineering principles * Automation and platform engineering experience * Excellent stakeholder management and consultancy skills Desirable * AWS Resilience Hub * Cyber recovery and ransomware resilience * Observability tooling such as Grafana, Datadog, Splunk or Elastic * Experience supporting large-scale consumer-facing digital platforms * Gaming, media, entertainment, SaaS or cloud-native technology environments * AWS Solutions Architect Professional certification Ideal Background * AWS Resilience Architect * AWS Disaster Recovery Architect * Principal AWS Consultant * Cloud Platform Architect * Site Reliability Architect * AWS Infrastructure Architect * Cloud Recovery & Resilience Consultant This is an opportunity to play a key role in improving the resilience, recoverability and reliability of a globally distributed AWS platform supporting critical customer-facing services. #4827137 - Karl ## Related Videos - [SRE Methods In an Agency Environment](https://www.wearedevelopers.com/videos/348-sre-methods-in-an-agency-environment) - [Our journey with Spring Boot in a microservice architecture](https://www.wearedevelopers.com/videos/511-our-journey-with-spring-boot-in-a-microservice-architecture) - [5 steps for running a Kubernetes environment at scale](https://www.wearedevelopers.com/videos/88-5-steps-for-running-a-kubernetes-environment-at-scale) - [Debugging in the Dark](https://www.wearedevelopers.com/videos/1658-debugging-in-the-dark) - [Software Engineering Social Connection: Yubo’s lean approach to scaling an 80M-user infrastructure](https://www.wearedevelopers.com/videos/1583-software-engineering-social-connection-yubo-s-lean-approach-to-scaling-an-80m-user-infrastructure) - [Azure-Well Architected Framework - designing mission critical workloads in practice](https://www.wearedevelopers.com/videos/1529-azure-well-architected-framework-designing-mission-critical-workloads-in-practice) ## Related Articles - [Best Companies to work for in London: Top 25 Companies in 2023](https://www.wearedevelopers.com/magazine/187-best-companies-to-work-for-in-london-top-25-companies-in-2023) - [What Are The Top Skills Required For Azure Developers?](https://www.wearedevelopers.com/magazine/77-what-are-the-top-skills-required-for-azure-developers) - [The Geometry of Incidents: Connecting User Impact to Architecture](https://www.wearedevelopers.com/magazine/764-the-geometry-of-incidents-connecting-user-impact-to-architecture) - [Software Engineer Salary London](https://www.wearedevelopers.com/magazine/252-software-engineer-salary-london) - [Find a Developer Job: 12 Best Job Sites For Developers](https://www.wearedevelopers.com/magazine/165-find-a-developer-job-12-best-job-sites-for-developers) - [How We Built a Worry-Free System That Runs for 10+ Years – And What We’d Do Again](https://www.wearedevelopers.com/magazine/751-how-we-built-a-worry-free-system-that-runs-for-10-years-and-what-we-d-do-again)