> Markdown version of [/jobs/ext/2968925-data-science](https://www.wearedevelopers.com/jobs/ext/2968925-data-science). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Science - **Company:** Capitole - **Location:** Barcelona, Spain - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Amazon Web Services, Artificial Neural Networks, Continuous Integration, Extract Transform Load (ETL), Github, Machine Learning, Natural Language Processing, Pytorch, Large Language Models, Pandas, GPT - **Published:** September 17, 2026 - **Apply:** https://www.buscojobs.com.es/data-science-en-barcelona-ID-372276661 ## About the Role Experiencia con AWS y despliegue de modelos.Conocimientos de ETL, manipulación y limpieza de datos.Excelentes habilidades de comunicación y storytelling técnico.Inglés alto/fluido.Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans, Barcelona)¿Por qué unirte a nosotros? ## Description ¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, NLP, RAG y Machine Learning?En Capitole buscamos un/a Data Scientist especializado en NLP y Large Language Models (LLMs) para unirse a nuestro equipo en Barcelona.Serás responsable de diseñar soluciones avanzadas de procesamiento de lenguaje, construir infraestructuras RAG, desarrollar modelos predictivos y llevar tus modelos a producción junto a equipos de ingeniería y producto.Tu trabajo tendrá impacto directo en decisiones estratégicas del grupo, transformando datos complejos en insights accionables y modelos robustos.Responsabilidades principalesNLP & LLMsDiseñar y construir arquitecturas RAG para mejorar el rendimiento de LLMs.Desarrollar embeddings, modelos de clasificación, tokenización y pipelines NLP.Trabajar con transformers (BERT, GPT, RoBERTa) y técnicas de fine?tuning.Aplicar prompt engineering y evaluación avanzada de modelos.Data Science & Machine LearningConstruir modelos predictivos: regresión, árboles, redes neuronales, optimización, recomendadores y forecasting.Evaluar, validar y optimizar modelos con metodologías rigurosas.Realizar análisis exploratorio, detección de patrones y anomalías.Infraestructura & ProducciónDesarrollar soluciones en AWS y entornos cloud.Implementar código de calidad: testing, CI/CD, GitHub, SonarQube.Colaborar con equipos de producto para llevar modelos a producción.Visualización & ComunicaciónCrear dashboards y visualizaciones claras para stakeholders no técnicos.Comunicar insights y resultados de forma estructurada y orientada a negocio.Data GovernanceGarantizar cumplimiento de GDPR y buenas prácticas de calidad de datos.Requisitos4-5+ años de experiencia en Data Science o roles similares.Experiencia sólida en NLP, LLMs, transformers y modelos predictivos.Python avanzado (Pandas, PyTorch, Modin, etc.).Experiencia con AWS y despliegue de modelos.Conocimientos de ETL, manipulación y limpieza de datos.Excelentes habilidades de comunicación y storytelling técnico.Inglés alto/fluido.Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans, Barcelona)¿Por qué unirte a nosotros?*****€ anuales para formación y certificaciones.Seguro médico privado.Retribución flexible (restaurante, transporte y guardería).Acceso a Wellhub con miles de gimnasios y actividades deportivas.Eventos, team buildings y actividades de equipo.Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo.Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.Empowering People, Unlocking InnovationEl empleado se adherirá a las políticas de seguridad de la información:Tendrá acceso a información confidencial relacionada con Capitole y el proyecto en el que está trabajando.Deberá cumplir con las políticas y las pautas internas de la empresa y del cliente.Se le requerirá firmar un NDA.#J-*****-Ljbffr ## Related Videos - [Alibaba Big Data and Machine Learning Technology](https://www.wearedevelopers.com/videos/37-alibaba-big-data-and-machine-learning-technology) - [ Evaluating AI models for code comprehension](https://www.wearedevelopers.com/videos/1462-evaluating-ai-models-for-code-comprehension) - [Innovating Developer Tools with AI: Insights from GitHub Next](https://www.wearedevelopers.com/videos/1268-innovating-developer-tools-with-ai-insights-from-github-next) - [Advanced Typing in TypeScript](https://www.wearedevelopers.com/videos/496-advanced-typing-in-typescript) - [PySpark - Combining Machine Learning & Big Data](https://www.wearedevelopers.com/videos/44-pyspark-combining-machine-learning-big-data) - [Speak, Code, Deploy: Transforming Developer Experience with Voice Commands](https://www.wearedevelopers.com/videos/1159-speak-code-deploy-transforming-developer-experience-with-voice-commands) ## Related Articles - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany) - [Top Big Data Technologies That You Need to Know](https://www.wearedevelopers.com/magazine/108-top-big-data-technologies-that-you-need-to-know) - [Dev Digest 132 - Binging WADFlix?](https://www.wearedevelopers.com/magazine/473-dev-digest-132-binging-wadflix) - [Dev Digest 121 - AI goes offline](https://www.wearedevelopers.com/magazine/456-dev-digest-121-ai-goes-offline) - [Dev Digest 120 - Apple and peers](https://www.wearedevelopers.com/magazine/455-dev-digest-120-apple-and-peers) - [MLops – Deploying, Maintaining And Evolving Machine Learning Models in Production](https://www.wearedevelopers.com/magazine/115-mlops-deploying-maintaining-and-evolving-machine-learning-models-in-production)