Data Science

Capitole
Madrid, Spain
1 day ago
Apply on www.buscojobs.com.es
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience required
4 years minimum
Working hours
Shift work
Languages
English

Tech stack

Artificial Intelligence Amazon Web Services Artificial Neural Networks Cloud Computing Continuous Integration Data Cleansing Extract Transform Load (ETL) Github Python (Programming Language) Machine Learning SonarQube Pytorch
+3 more
Large Language Models Pandas GPT

Job description

¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, NLP, RAG y Machine Learning?EnCapitolebuscamos un/aData Scientist especializado en NLP y Large Language Models (LLMs)para unirse a nuestro equipo en Barcelona.Serás responsable de diseñar soluciones avanzadas de procesamiento de lenguaje, construir infraestructuras RAG, desarrollar modelos predictivos y llevar tus modelos a producción junto a equipos de ingeniería y producto.Tu trabajo tendrá impacto directo en decisiones estratégicas del grupo, transformando datos complejos en insights accionables y modelos robustos.Responsabilidades principales NLP & LLMs Diseñar y construir arquitecturasRAGpara mejorar el rendimiento de LLMs.Desarrollarembeddings, modelos de clasificación, tokenización y pipelines NLP.Trabajar contransformers(BERT, GPT, RoBERTa) y técnicas de fine?tuning.Aplicarprompt engineeringy evaluación avanzada de modelos.Data Science & Machine Learning Construir modelos predictivos: regresión, árboles, redes neuronales, optimización, recomendadores y forecasting.Evaluar, validar y optimizar modelos con metodologías rigurosas.Realizar análisis exploratorio, detección de patrones y anomalías.Infraestructura & Producción Desarrollar soluciones enAWSy entornos cloud.Implementar código de calidad: testing, CI/CD, GitHub, SonarQube.Colaborar con equipos de producto para llevar modelos a producción.Visualización & Comunicación Crear dashboards y visualizaciones claras para stakeholders no técnicos.Comunicar insights y resultados de forma estructurada y orientada a negocio.Data Governance Garantizar cumplimiento de GDPR y buenas prácticas de calidad de datos.Requisitos 4-5+ años de experiencia en Data Science o roles similares.Experiencia sólida enNLP,LLMs,transformersymodelos predictivos.Python avanzado (Pandas, PyTorch, Modin, etc.).Experiencia conAWSy despliegue de modelos.Conocimientos de ETL, manipulación y limpieza de datos.Excelentes habilidades de comunicación y storytelling técnico.Inglés alto/fluido.Modalidad híbrida en Barcelona(2 días de presencialidad en Viladecans, Barcelona)¿Por qué unirte a nosotros?*****€ anuales para formación y certificaciones.Seguro médico privado.? Retribución flexible (restaurante, transporte y guardería).? Acceso a Wellhub con miles de gimnasios y actividades deportivas.Eventos, team buildings y actividades de equipo.Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo.Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.? ¿Quieres saber más?? y descubre todos los detalles.Descubre lo que dicen sobre nosotros en? ?? ¿Te gustaría conocer más sobre nuestra cultura?Mira este video ¿Te animas a este gran reto y equipo?Empowering People, Unlocking Innovation El empleado se adherirá a las políticas de seguridad de la información: · Tendrá acceso a información confidencial relacionada con Capitole y el proyecto en el que está trabajando.· Deberá cumplir con las políticas de seguridad y las pautas internas de la empresa y del cliente.· Se le requerirá firmar un NDA.

Requirements

modelos de clasificación, tokenización y pipelines NLP. Trabajar con transformers (BERT, GPT, RoBERTa) y técnicas de fine?tuning. Aplicar prompt engineering y evaluación avanzada de modelos. Data Science & Machine Learning Construir modelos predictivos: regresión, árboles, redes neuronales, optimización, recomendadores y forecasting. Evaluar, validar y optimizar modelos con metodologías rigurosas. Realizar análisis exploratorio, detección de patrones y anomalías. Infraestructura & Producción Desarrollar soluciones en AWS y entornos cloud. Implementar código de calidad: testing, CI/CD, GitHub, SonarQube. Colaborar con equipos de producto para llevar modelos a producción. Visualización & Comunicación Crear dashboards y visualizaciones claras para stakeholders no técnicos. Comunicar insights y resultados de forma estructurada y orientada a negocio. Data Governance Garantizar cumplimiento de GDPR y buenas prácticas de calidad de datos. Requisitos 4-5+ años de experiencia en Data Science o roles similares. Experiencia sólida en NLP , LLMs , transformers y modelos predictivos . Python avanzado (Pandas, PyTorch, Modin, etc.). Experiencia con AWS y despliegue de modelos. Conocimientos de ETL, manipulación y limpieza de datos. Excelentes habilidades de comunicación y storytelling técnico. Inglés alto/fluido. Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans, Barcelona) ¿Por qué unirte a nosotros?

Benefits & conditions

*****€ anuales para formación y certificaciones. Seguro médico privado. ? Retribución flexible (restaurante, transporte y guardería). ? Acceso a Wellhub con miles de gimnasios y actividades deportivas. Eventos, team buildings y actividades de equipo. Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo. Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.buscojobs.com.es
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

40 sec

Generative pre-trained transformer models powering code completions

lgonta lgonta +1 · World Congress 2024

6:36 min

Funding open source through GitHub Accelerator and Sponsors

Stormy Peters · World Congress 2023

2:03 min

Accelerating pandas dataframes using cudf module plugins

Ankit Patel Ankit Patel · World Congress 2024

3:14 min

Structuring career paths and localized data architectures

Ulrich Wurstbauer +1 · LIVE

51 sec

Assessing GPT-4o performance for pull request feedback

Merrill Lutsky Merrill Lutsky · World Congress 2025

3:13 min

Addressing language barriers and the data science talent deficit

Markus Hacker Markus Hacker +3 · World Congress 2024

Videos

See all

Related articles

See all