Data Science

Capitole
Viladecans, Spain
3 days ago
Apply on www.buscojobs.com.es
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience required
3 years minimum
Working hours
Shift work

Tech stack

Artificial Intelligence Microsoft Azure Information Extraction Python (Programming Language) Machine Learning Unstructured Data Large Language Models Generative AI Information Technology Software Version Control

Job description

¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, VLMs, OCR y Machine Learning?En Capitole buscamos un/a Data Scientist con experiencia en modelos de lenguaje, procesamiento de lenguaje natural y extracción de información no estructurada, para incorporarse a un proyecto estratégico en un entorno global e innovador.Responsabilidades del puestoDiseñar, prototipar y evaluar soluciones de IA, LLMs y Machine Learning para la extracción, clasificación y transformación de documentos complejos.Desarrollar y optimizar prompts, lógica de validación, métricas de evaluación automatizada y datasets de ground-truth.Escribir código en Python limpio, testeable y mantenible, colaborando estrechamente con el equipo de AI Engineers para llevar modelos a producción.Analizar la viabilidad técnica de nuevos casos de uso y comunicar hallazgos, métricas y limitaciones tanto a equipos técnicos como de negocio.Must Have+3 años de experiencia profesional en Data Science, Machine Learning o IA aplicada, con dominio de LLMs, Generative AI y Prompt Engineering.Sólida base en NLP y ML tradicional, con capacidad para evaluar cuándo un enfoque clásico o determinista es superior a un LLM.Excelentes competencias de programación en Python (testing, control de versiones, reproducibilidad) y conocimientos estadísticos para validar hipótesis y métricas.Experiencia práctica trabajando con datos no estructurados/semiestructurados, diseño de schemas y creación de datasets de evaluación.Fluidez en inglés y habilidades de comunicación para explicar decisiones y trade-offs técnicos a perfiles no técnicos.Titulación universitaria en Informática, IA, Data Science, Matemáticas, Ingeniería o campo afín.Requisitos deseablesExperiencia en Document Intelligence y OCR (especialmente Azure Document Intelligence).Manejo de plataformas gestionadas de IA como Azure Open AI o Amazon nocimientos en clasificación de documentos, extracción de información, NER o modelos multimodales (VLM).Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans) ¿Por qué unirte a nosotros?*****€ anuales para formación y certificaciones.Seguro médico privado.Retribución flexible (restaurante, transporte y guardería).Acceso a Wellhub con miles de gimnasios y actividades deportivas.Eventos, team buildings y actividades de unidades tecnológicas internas para compartir conocimiento y seguir creciendo.Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.¿Quieres saber más?Haz clic here y descubre todos los detalles.Descubre lo que dicen sobre nosotros en Glassdoor Reviews¿Te gustaría conocer más sobre nuestra cultura?Mira este video You Tube¿Te animas a este gran reto y equipo?Empowering People, Unlocking InnovationEl empleado se adherirá a las políticas de seguridad de la información: Tendrá acceso a información confidencial relacionada con Capitole y el proyecto en el que está trabajando.Deberá cumplir con las políticas de seguridad y las pautas internas de la empresa y del cliente.Se le requerirá firmar un NDA.

Requirements

Must Have+3 años de experiencia profesional en Data Science, Machine Learning o IA aplicada, con dominio de LLMs, Generative AI y Prompt Engineering.Sólida base en NLP y ML tradicional, con capacidad para evaluar cuándo un enfoque clásico o determinista es superior a un LLM.Excelentes competencias de programación en Python (testing, control de versiones, reproducibilidad) y conocimientos estadísticos para validar hipótesis y métricas.Experiencia práctica trabajando con datos no estructurados/semiestructurados, diseño de schemas y creación de datasets de evaluación.Fluidez en inglés y habilidades de comunicación para explicar decisiones y trade-offs técnicos a perfiles no técnicos.Titulación universitaria en Informática, IA, Data Science, Matemáticas, Ingeniería o campo afín. Requisitos deseablesExperiencia en Document Intelligence y OCR (especialmente Azure Document Intelligence). Manejo de plataformas gestionadas de IA como Azure Open AI o Amazon nocimientos en clasificación de documentos, extracción de información, NER o modelos multimodales (VLM). Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans) ¿Por qué unirte a nosotros? *****€ anuales para formación y certificaciones.Seguro médico privado.Retribución flexible (restaurante, transporte y guardería). Acceso a Wellhub con miles de gimnasios y actividades deportivas.Eventos, team buildings y actividades de unidades tecnológicas internas para compartir conocimiento y seguir creciendo.Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.buscojobs.com.es
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:37 min

Tracing the evolution from early AI to generative AI

Mike Mike · World Congress 2025

1:06 min

Outline of free tools for Microsoft Azure

Radu Vunvulea Radu Vunvulea · World Congress 2022

2:36 min

Applying supervised machine learning for practical rule extraction

Katja Träumner

3:14 min

Structuring career paths and localized data architectures

Ulrich Wurstbauer +1 · LIVE

2:14 min

Introduction to generative AI and content warnings

Cheuk Ho · World Congress 2023

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

Videos

See all

Related articles

See all