Data Engineer

Xylem
Valencia, Spain
24 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Job source

Tech stack

Application Programming Interfaces (APIs) Artificial Intelligence Airflow Big Data Data Architecture Data Integration Extract Transform Load (ETL) Data Structures Python (Programming Language) Meta-Data Management SQL Databases Feature Engineering
+8 more
Apache Spark Vue.js Data Lakes Pyspark Information Technology Machine Learning Operations Databricks Microservices

Job description

En Xylem Vue, formarás parte de un equipo colaborativo donde tu trabajo habilita directamente la predicción, la optimización y la toma de decisiones basada en IA en el sector del agua. Si buscas un puesto en el que puedas dar forma a la base de la IA a escala-y crecer con ello…, Jugar un papel clave en la definición de la dirección técnica y la estrategia del Data Lake de Xylem Vue, construyendo datasets analíticos de alta calidad y pipelines escalables que impulsen analítica avanzada y soluciones basadas en IA en toda la plataforma., * Construir y mantener modelos analíticos y datasets de features para predicción, detección de anomalías, optimización y soporte a la decisión

  • Diseñar pipelines de datos end-to-end (ingesta, transformación, control de calidad, trazabilidad/lineage) para múltiples fuentes del sector del agua (telemetría time-series, modelos hidráulicos, datos geoespaciales, activos e historiales de eventos)
  • Garantizar la calidad, consistencia, gobierno y disponibilidad de los datos en todo el Data Lake
  • Colaborar con AI Engineers, data scientists, equipos de producto y arquitectos para entender requisitos de modelos y traducirlos a tareas accionables de data engineering
  • Liderar la adopción de buenas prácticas en arquitectura de datos, gestión de metadatos, modelado de datos y MLOps/feature engineering
  • Desarrollar capacidades a nivel plataforma (feature stores, interfaces modelo-dato, herramientas de automatización) para acelerar el desarrollo de IA en los equipos de producto
  • Monitorizar el rendimiento y la fiabilidad de los pipelines, resolviendo proactivamente cuellos de botella o incidencias de datos
  • Documentar arquitecturas, transformaciones y estructuras de datos para asegurar transparencia y mantenibilidad a largo plazo, Al crear una alerta, aceptas nuestros Términos y condiciones y Política de privacidad, y el uso de cookies., Alemania Australia Austria Bélgica Brasil Canadá España Estados Unidos Francia India Italia México Nueva Zelanda Holanda Polonia Reino Unido Singapur Sudáfrica Suiza

Requirements

  • Grado o Máster en Informática, Data Engineering o un campo técnico relacionado
  • Sólida experiencia práctica en ingeniería de datos: construcción de pipelines ETL/ELT, trabajo con grandes volúmenes de datos e implementación de flujos distribuidos
  • Experiencia diseñando y manteniendo Data Lakes en la nube y tecnologías Big Data
  • Buen entendimiento de las necesidades de datos para IA/ML, feature engineering y diseño de datasets “model-ready”
  • Dominio de Python y SQL, y herramientas como PySpark/Spark, Databricks, Airflow (o similares)
  • Experiencia con APIs, microservicios y patrones de integración de datos
  • Familiaridad con herramientas de MLOps, feature stores y marcos de gobierno del dato
  • Habilidad para colaborar con equipos multidisciplinares y comunicar conceptos complejos con claridad
  • (Valorable) Conocimiento de tipos de datos y contexto operativo del sector del agua, + Técnico
  • Recepciónista
  • Administrador
  • Ventas
  • Enfermero
  • Limpieza
  • Mantenimiento
  • Telefonista
  • Compras
  • Recursos humanos

Tipo de trabajo

  • Desde casa
  • Estudiantes
  • Online
  • Trabajos Verticales
  • En inglés
  • Teletrabajo
  • Media jornada

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.adzuna.es

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

2:15 min

Empowering domain teams with an open data platform

Sandhya Menon Sandhya Menon · World Congress 2026 Europe

2:10 min

Analyzing the out-of-the-box security posture of Vue.js

Philippe De Ryck · LIVE

3:37 min

Scaling machine learning pipelines from prototypes to petabytes

Julian Joseph · LIVE

3:05 min

Audience questions on AI agents and pipeline vectorization

Joy Joy · World Congress 2024

Videos

See all

Related articles

See all