> Markdown version of [/jobs/ext/2794886-senior-gpu-systems-engineer-large-scale-inference-rl](https://www.wearedevelopers.com/jobs/ext/2794886-senior-gpu-systems-engineer-large-scale-inference-rl). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Senior GPU Systems Engineer: Large-Scale Inference & RL - **Company:** Reflection - **Location:** Greater London, UK - **Experience:** Expert - **Contract:** Permanent contract - **Skills:** Systems Engineering, Software Debugging, Distributed Systems, Reinforcement Learning, Hardware Infrastructure - **Published:** September 8, 2026 - **Apply:** https://www.collegerecruiter.com/job/2840674381-senior-gpu-systems-engineer-large-scale-inference--rl ## About the Role Reflection is seeking an experienced professional to design and operate large-scale GPU infrastructure for model inference and reinforcement learning. The role involves developing systems for high-performance inference platforms, optimizing GPU utilization, and diagnosing performance bottlenecks. Ideal candidates will have hands-on experience with GPU systems, knowledge of modern inference frameworks, and skills in debugging complex performance issues across distributed systems. The company offers competitive compensation and comprehensive benefits. #J-18808-Ljbffr ## Related Videos - [Best Practices for AI-Assisted Development of Distributed Systems](https://www.wearedevelopers.com/videos/100200-best-practices-for-ai-assisted-development-of-distributed-systems) - [Using AI Without Losing Your Skills](https://www.wearedevelopers.com/videos/2045-using-ai-without-losing-your-skills) - [Model Based Systems Engineering in an Agile Product Development Process](https://www.wearedevelopers.com/videos/68-model-based-systems-engineering-in-an-agile-product-development-process) - [Tour de Force: Open-Source LLM Inference Optimization from Simple to Sophisticated](https://www.wearedevelopers.com/videos/100099-tour-de-force-open-source-llm-inference-optimization-from-simple-to-sophisticated) - [What I learned as a developer from accidents in space](https://www.wearedevelopers.com/videos/642-what-i-learned-as-a-developer-from-accidents-in-space) - [Efficient deployment and inference of GPU-accelerated LLMs​](https://www.wearedevelopers.com/videos/929-efficient-deployment-and-inference-of-gpu-accelerated-llms) ## Related Articles - [What Are Large Language Models?](https://www.wearedevelopers.com/magazine/304-what-are-large-language-models) - [Software Engineer Salary London](https://www.wearedevelopers.com/magazine/252-software-engineer-salary-london) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Dev Digest 120 - Apple and peers](https://www.wearedevelopers.com/magazine/455-dev-digest-120-apple-and-peers) - [Graph and AI Trends 2026: Why Is AI Running but Not Yet Delivering?](https://www.wearedevelopers.com/magazine/680-graph-and-ai-trends-2026-why-is-ai-running-but-not-yet-delivering) - [Dev Digest 121 - AI goes offline](https://www.wearedevelopers.com/magazine/456-dev-digest-121-ai-goes-offline)