Data Science

Capitole
Valladolid, Spain
4 days ago
Apply on www.buscojobs.com.es
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience required
3 years minimum
Working hours
Regular working hours

Tech stack

Artificial Intelligence Microsoft Azure Information Extraction Python (Programming Language) Machine Learning Unstructured Data Large Language Models Prompt Engineering Generative AI Information Technology Software Version Control

Job description

¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, VLMs, OCR y Machine Learning?Si los siguientes requisitos del puesto y la experiencia coinciden con sus habilidades, por favor, asegúrese de enviar su solicitud sin demora.En Capitole buscamos un/a Data Scientist con experiencia en modelos de lenguaje, procesamiento de lenguaje natural y extracción de información no estructurada, para incorporarse a un proyecto estratégico en un entorno global e innovador.Responsabilidades del puesto Diseñar, prototipar y evaluar soluciones de IA, LLMs y Machine Learning para la extracción, clasificación y transformación de documentos complejos.Desarrollar y optimizar prompts, lógica de validación, métricas de evaluación automatizada y datasets de ground-truth.Escribir código en Python limpio, testeable y mantenible, colaborando estrechamente con el equipo de AI Engineers para llevar modelos a producción.Analizar la viabilidad técnica de nuevos casos de uso y comunicar hallazgos, métricas y limitaciones tanto a equipos técnicos como de negocio.Must Have +3 años de experiencia profesional en Data Science, Machine Learning o IA aplicada, con dominio de LLMs, Generative AI y Prompt Engineering .Sólida base en NLP y ML tradicional , con capacidad para evaluar cuándo un enfoque clásico o determinista es superior a un LLM.Excelentes competencias de programación en Python (testing, control de versiones, reproducibilidad) y conocimientos estadísticos para validar hipótesis y métricas.Experiencia práctica trabajando con datos no estructurados/semiestructurados, diseño de schemas y creación de datasets de evaluación.Fluidez en inglés y habilidades de comunicación para explicar decisiones y trade-offs técnicos a perfiles no técnicos.Titulación universitaria en Informática, IA, Data Science, Matemáticas, Ingeniería o campo afín.Requisitos deseables Experiencia en Document Intelligence y OCR (especialmente Azure Document Intelligence).Manejo de plataformas gestionadas de IA como Azure OpenAI o Amazon Bedrock.Conocimientos en clasificación de documentos, extracción de información, NER o modelos multimodales (VLM).Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans) ¿Por qué unirte a nosotros?*****€ anuales para formación y certificaciones.Seguro médico privado.Retribución flexible (restaurante, transporte y guardería).Acceso a Wellhub con miles de gimnasios y actividades deportivas.Eventos, team buildings y actividades de equipo.Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo.Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.¿Quieres saber más?y descubre todos los detalles.Descubre lo que dicen sobre nosotros en ¿Te gustaría conocer más sobre nuestra cultura?Mira este video ¿Te animas a este gran reto y equipo?Empowering People, Unlocking Innovation El empleado se adherirá a las políticas de seguridad de la información: · Tendrá acceso a información confidencial relacionada con Capitole y el proyecto en el que está trabajando.xsgfvud · Deberá cumplir con las políticas de seguridad y las pautas internas de la empresa y del cliente.· Se le requerirá firmar un NDA.

Requirements

Must Have +3 años de experiencia profesional en Data Science, Machine Learning o IA aplicada, con dominio de LLMs, Generative AI y Prompt Engineering . Sólida base en NLP y ML tradicional , con capacidad para evaluar cuándo un enfoque clásico o determinista es superior a un LLM. Excelentes competencias de programación en Python (testing, control de versiones, reproducibilidad) y conocimientos estadísticos para validar hipótesis y métricas. Experiencia práctica trabajando con datos no estructurados/semiestructurados, diseño de schemas y creación de datasets de evaluación. Fluidez en inglés y habilidades de comunicación para explicar decisiones y trade-offs técnicos a perfiles no técnicos. Titulación universitaria en Informática, IA, Data Science, Matemáticas, Ingeniería o campo afín. Requisitos deseables Experiencia en Document Intelligence y OCR (especialmente Azure Document Intelligence). Manejo de plataformas gestionadas de IA como Azure OpenAI o Amazon Bedrock. Conocimientos en clasificación de documentos, extracción de información, NER o modelos multimodales (VLM). Modalidad híbrida en Barcelona (2 días de presencialidad en Viladecans) ¿Por qué unirte a nosotros? *****€ anuales para formación y certificaciones. Seguro médico privado. Retribución flexible (restaurante, transporte y guardería). Acceso a Wellhub con miles de gimnasios y actividades deportivas. Eventos, team buildings y actividades de equipo. Comunidades tecnológicas internas para compartir conocimiento y seguir creciendo. Proyecto internacional con tecnologías de vanguardia y gran impacto en negocio.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.buscojobs.com.es
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:14 min

Structuring career paths and localized data architectures

Ulrich Wurstbauer +1 · LIVE

2:37 min

Tracing the evolution from early AI to generative AI

Mike Mike · World Congress 2025

1:06 min

Outline of free tools for Microsoft Azure

Radu Vunvulea Radu Vunvulea · World Congress 2022

2:36 min

Applying supervised machine learning for practical rule extraction

Katja Träumner

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

2:14 min

Introduction to generative AI and content warnings

Cheuk Ho · World Congress 2023

Videos

See all

Related articles

See all