> Markdown version of [/jobs/ext/2959391-data-science](https://www.wearedevelopers.com/jobs/ext/2959391-data-science). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Science - **Company:** Capitole - **Location:** Madrid, Spain - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Amazon Web Services, Artificial Neural Networks, Cloud Computing, Continuous Integration, Data Cleansing, Extract Transform Load (ETL), Github, Python (Programming Language), Machine Learning, SonarQube, Pytorch, Large Language Models, Pandas, GPT - **Published:** September 17, 2026 - **Apply:** https://www.buscojobs.com.es/data-science-en-madrid-ID-371691045 ## About the Role modelos de clasificación, tokenización y pipelines NLP. Trabajar con transformers (BERT, GPT, RoBERTa) y técnicas de fine?tuning. Aplicar prompt engineering y evaluación avanzada de modelos. Data Science & Machine Learning Construir modelos predictivos: regresión, árboles, redes neuronales, optimización, recomendadores y forecasting. Evaluar, validar y optimizar modelos con metodologías rigurosas. Realizar análisis exploratorio, detección de patrones y anomalías. Infraestructura & Producción Desarrollar soluciones en AWS y entornos cloud. Implementar código de calidad: testing, CI/CD, GitHub, SonarQube. Colaborar con equipos de producto para llevar modelos a producción. Visualización & Comunicación Crear dashboards y visualizaciones claras para stakeholders no técnicos. Comunicar insights y resultados de forma estructurada y orientada a negocio. Data Governance Garantizar cumplimiento de GDPR y buenas prácticas de calidad de datos. Requisitos 4-5+ años de experiencia en Data Science o roles similares. Experiencia sólida en NLP , LLMs , transformers y modelos predictivos . Python avanzado (Pandas, PyTorch, Modin, etc.). Experiencia con AWS y despliegue de modelos. Conocimientos de ETL, manipulación y limpieza de datos. Excelentes habilidades de comunicación y storytelling técnico. Inglés alto/fluido. Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans, Barcelona) ¿Por qué unirte a nosotros? ## Description ¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, NLP, RAG y Machine Learning?EnCapitolebuscamos un/aData Scientist especializado en NLP y Large Language Models (LLMs)para unirse a nuestro equipo en Barcelona.Serás responsable de diseñar soluciones avanzadas de procesamiento de lenguaje, construir infraestructuras RAG, desarrollar modelos predictivos y llevar tus modelos a producción junto a equipos de ingeniería y producto.Tu trabajo tendrá impacto directo en decisiones estratégicas del grupo, transformando datos complejos en insights accionables y modelos robustos.Responsabilidades principales NLP & LLMs Diseñar y construir arquitecturasRAGpara mejorar el rendimiento de LLMs.Desarrollarembeddings, modelos de clasificación, tokenización y pipelines NLP.Trabajar contransformers(BERT, GPT, RoBERTa) y técnicas de fine?tuning.Aplicarprompt engineeringy evaluación avanzada de modelos.Data Science & Machine Learning Construir modelos predictivos: regresión, árboles, redes neuronales, optimización, recomendadores y forecasting.Evaluar, validar y optimizar modelos con metodologías rigurosas.Realizar análisis exploratorio, detección de patrones y anomalías.Infraestructura & Producción Desarrollar soluciones enAWSy entornos cloud.Implementar código de calidad: testing, CI/CD, GitHub, SonarQube.Colaborar con equipos de producto para llevar modelos a producción.Visualización & Comunicación Crear dashboards y visualizaciones claras para stakeholders no técnicos.Comunicar insights y resultados de forma estructurada y orientada a negocio.Data Governance Garantizar cumplimiento de GDPR y buenas prácticas de calidad de datos.Requisitos 4-5+ años de experiencia en Data Science o roles similares.Experiencia sólida enNLP,LLMs,transformersymodelos predictivos.Python avanzado (Pandas, PyTorch, Modin, etc.).Experiencia conAWSy despliegue de modelos.Conocimientos de ETL, manipulación y limpieza de datos.Excelentes habilidades de comunicación y storytelling técnico.Inglés alto/fluido.Modalidad híbrida en Barcelona(2 días de presencialidad en Viladecans, Barcelona)¿Por qué unirte a nosotros?*****€ anuales para formación y certificaciones.Seguro médico privado.? Retribución flexible (restaurante, transporte y guardería).? Acceso a Wellhub con miles de gimnasios y actividades deportivas.Eventos, team buildings y actividades de equipo.Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo.Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.? ¿Quieres saber más?? y descubre todos los detalles.Descubre lo que dicen sobre nosotros en? ?? ¿Te gustaría conocer más sobre nuestra cultura?Mira este video ¿Te animas a este gran reto y equipo?Empowering People, Unlocking Innovation El empleado se adherirá a las políticas de seguridad de la información: · Tendrá acceso a información confidencial relacionada con Capitole y el proyecto en el que está trabajando.· Deberá cumplir con las políticas de seguridad y las pautas internas de la empresa y del cliente.· Se le requerirá firmar un NDA. ## Related Videos - [ Evaluating AI models for code comprehension](https://www.wearedevelopers.com/videos/1462-evaluating-ai-models-for-code-comprehension) - [Innovating Developer Tools with AI: Insights from GitHub Next](https://www.wearedevelopers.com/videos/1268-innovating-developer-tools-with-ai-insights-from-github-next) - [Advanced Typing in TypeScript](https://www.wearedevelopers.com/videos/496-advanced-typing-in-typescript) - [Developer Experience, Platform Engineering and AI powered Apps](https://www.wearedevelopers.com/videos/990-developer-experience-platform-engineering-and-ai-powered-apps) - [Data Science on Software Data](https://www.wearedevelopers.com/videos/162-data-science-on-software-data) - [Bringing AI Model Testing and Prompt Management to Your Codebase with GitHub Models](https://www.wearedevelopers.com/videos/1536-bringing-ai-model-testing-and-prompt-management-to-your-codebase-with-github-models) ## Related Articles - [MLops – Deploying, Maintaining And Evolving Machine Learning Models in Production](https://www.wearedevelopers.com/magazine/115-mlops-deploying-maintaining-and-evolving-machine-learning-models-in-production) - [Coffee with Developers - Maria Apazoglou - Making AI understandable for all in production](https://www.wearedevelopers.com/magazine/475-coffee-with-developers-maria-apazoglou-making-ai-understandable-for-all-in-production) - [MLOps – What’s the deal behind it?](https://www.wearedevelopers.com/magazine/125-mlops-what-s-the-deal-behind-it) - [Graph and AI Trends 2026: Why Is AI Running but Not Yet Delivering?](https://www.wearedevelopers.com/magazine/680-graph-and-ai-trends-2026-why-is-ai-running-but-not-yet-delivering) - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany) - [Dev Digest 121 - AI goes offline](https://www.wearedevelopers.com/magazine/456-dev-digest-121-ai-goes-offline)