> Markdown version of [/jobs/ext/1997645-ai-back-end-engineer-llm-specialist](https://www.wearedevelopers.com/jobs/ext/1997645-ai-back-end-engineer-llm-specialist). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Ai Back End Engineer (Llm Specialist) - **Company:** FacTECH Servicios Informáticos - **Location:** Madrid, Spain - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Amazon Web Services, Application Services, Microsoft Azure, Cloud Computing, Continuous Integration, DevOps, Distributed Systems, Github, Infrastructure as a Service (IaaS), Python (Programming Language), Machine Learning, NLTK (NLP Analysis), Octopus Deploy, Platform as a Service (PAAS), Scrum Methodology, Prometheus, Azure Service Bus, Test-Driven Development (TDD), Chatbots, Delivery Pipeline, Large Language Models, Grafana, Backend, Cloudformation, Fastapi, Kubernetes, ONNX (Open Neural Network Exchange) Format, HuggingFace, AWS Fargate, Cosmos DB, Machine Learning Operations, Cloudwatch, Spacy, Terraform, GPT, Jenkins, Microservices - **Published:** August 9, 2026 - **Apply:** https://www.buscojobs.com.es/ai-back-end-engineer-llm-specialist-en-madrid-ID-366699468 ## About the Role con experiencia en arquitecturas cloud, MLOps y soluciones basadas en LLM. La persona seleccionada participará en el diseño e implementación de infraestructuras cloud escalables y soluciones de inteligencia artificial avanzadas, incluyendo arquitecturas RAG, sistemas de verificación de IA y despliegue de servicios de alto rendimiento., Más de 5 años de experiencia diseñando e implementando soluciones cloud en AWS (experiencia con Azure es un plus). Experiencia en arquitecturas basadas en IaaS, PaaS, Serverless y sistemas distribuidos. Conocimiento avanzado de Kubernetes, microservicios e Infrastructure as Code (Terraform). Experiencia práctica con pipelines de Machine Learning, MLOps y soluciones basadas en LLM (chatbots, RAG). Amplia experiencia en Python, incluyendo frameworks como FastAPI. Experiencia con herramientas de observabilidad como Prometheus, Grafana, ELK u OpenTelemetry. Experiencia diseñando y desplegando sistemas RAG y arquitecturas de agentes de IA. Conocimiento sólido de CI/CD y prácticas DevOps. Experiencia desplegando servicios cloud-native en AWS o Azure. Experiencia con optimización de modelos (ONNX, cuantización). Experiencia trabajando en entornos ágiles (Scrum). Nivel alto de inglés (C1 o equivalente). Mentalidad proactiva, orientada a resultados y a la innovación tecnológica. ## Description En FACTECH somos una consultora tecnológica con presencia en España y Colombia, especializada en ofrecer soluciones IT de alto impacto para grandes compañías.Apostamos por el talento, la excelencia técnica y la cercanía con nuestros clientes.Buscamos incorporar un/aAI / Cloud Engineercon experiencia en arquitecturas cloud, MLOps y soluciones basadas en LLM.La persona seleccionada participará en el diseño e implementación de infraestructuras cloud escalables y soluciones de inteligencia artificial avanzadas, incluyendo arquitecturas RAG, sistemas de verificación de IA y despliegue de servicios de alto rendimiento.ResponsabilidadesDiseñar, implementar y gestionar infraestructura cloud en AWS utilizando Infrastructure as Code (IaC) con herramientas como Terraform o AWS CloudFormation.Mantener y mejorar pipelines CI/CD utilizando herramientas como GitHub Actions, AWS CodePipeline, Jenkins o ArgoCD.Implementar soluciones de observabilidad y monitorización mediante herramientas como Amazon CloudWatch, Prometheus/Grafana o ELK.Gestionar entornos de orquestación de contenedores como Kubernetes (EKS), ECS o Fargate.Diseñar y desarrollar arquitectura backend para servicios de AI Verification y ChatGPT Services utilizando Python y FastAPI.Implementar soluciones siguiendo principios de Domain-Driven Design (DDD) y Test-Driven Development (TDD).Desarrollar y mantener servicios de validación de contenido generado por IA (LLM-as-a-judge) utilizando herramientas como HuggingFace, Transformers, SpaCy, NLTK y BM25.Optimizar el rendimiento de modelos mediante técnicas de compresión y optimización como ONNX y cuantización.Desplegar y gestionar soluciones de IA multi-servicio en Kubernetes con monitorización mediante Prometheus y Grafana.Diseñar pipelines CI/CD para integración y despliegue continuo de servicios de inteligencia artificial.Diseñar, construir y mantener arquitecturas RAG de alto rendimiento, incluyendo servicios de ingestión, brokers de mensajería y sistemas de recuperación.Integrar herramientas y frameworks como LangChain, Azure OpenAI, Embeddings, Azure Cosmos DB, Azure Service Bus y Azure App Services.Realizar prompt engineering utilizando técnicas como Chain-of-Thought o few-shot learning en múltiples LLMs.Investigar y evaluar arquitecturas basadas en agentes y soluciones de IA ofrecidas por distintos proveedores cloud.Requisitos (imprescindibles)Más de 5 años de experiencia diseñando e implementando soluciones cloud en AWS (experiencia con Azure es un plus).Experiencia en arquitecturas basadas en IaaS, PaaS, Serverless y sistemas distribuidos.Conocimiento avanzado de Kubernetes, microservicios e Infrastructure as Code (Terraform).Experiencia práctica con pipelines de Machine Learning, MLOps y soluciones basadas en LLM (chatbots, RAG).Amplia experiencia en Python, incluyendo frameworks como FastAPI.Experiencia con herramientas de observabilidad como Prometheus, Grafana, ELK u OpenTelemetry.Experiencia diseñando y desplegando sistemas RAG y arquitecturas de agentes de IA.Conocimiento sólido de CI/CD y prácticas DevOps.Experiencia desplegando servicios cloud-native en AWS o Azure.Experiencia con optimización de modelos (ONNX, cuantización).Experiencia trabajando en entornos ágiles (Scrum).Nivel alto de inglés (C1 o equivalente).Mentalidad proactiva, orientada a resultados y a la innovación tecnológica.#J-*****-Ljbffr ## Related Videos - [Introduction to Azure Machine Learning](https://www.wearedevelopers.com/videos/368-introduction-to-azure-machine-learning) - [ Evaluating AI models for code comprehension](https://www.wearedevelopers.com/videos/1462-evaluating-ai-models-for-code-comprehension) - [From DevOps to Scaled DevOps: How We’re Rebuilding Continuous Delivery as a Platform](https://www.wearedevelopers.com/videos/100018-from-devops-to-scaled-devops-how-we-re-rebuilding-continuous-delivery-as-a-platform) - [DevOps for AI: running LLMs in production with Kubernetes and KubeFlow](https://www.wearedevelopers.com/videos/1222-devops-for-ai-running-llms-in-production-with-kubernetes-and-kubeflow) - [Shipping Faster with Less: Render on Cloud Hosting, AI Workloads, and the Future of DevOps](https://www.wearedevelopers.com/videos/1894-shipping-faster-with-less-render-on-cloud-hosting-ai-workloads-and-the-future-of-devops) - [Streaming AI Responses in Real-Time with SSE in Next.js & NestJS](https://www.wearedevelopers.com/videos/1630-streaming-ai-responses-in-real-time-with-sse-in-next-js-nestjs) ## Related Articles - [What Are Large Language Models?](https://www.wearedevelopers.com/magazine/304-what-are-large-language-models) - [MLops – Deploying, Maintaining And Evolving Machine Learning Models in Production](https://www.wearedevelopers.com/magazine/115-mlops-deploying-maintaining-and-evolving-machine-learning-models-in-production) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market) - [Dev Digest 121 - AI goes offline](https://www.wearedevelopers.com/magazine/456-dev-digest-121-ai-goes-offline) - [Fully Remote Software Engineer Jobs](https://www.wearedevelopers.com/magazine/447-fully-remote-software-engineer-jobs) - [MLOps – What’s the deal behind it?](https://www.wearedevelopers.com/magazine/125-mlops-what-s-the-deal-behind-it)