Data/ML Platform Engineer
Role details
Job location
Tech stack
Job description
Binnen ons data science team bouwen we aan modellen en dataproducten die direct impact hebben op de operatie (o.a. voorspellen, optimaliseren en ondersteunen van besluitvorming). De uitdaging zit niet in het bouwen van modellen, maar in het betrouwbaar en schaalbaar in productie krijgen en houden ervan. Daarom zoeken we iemand die deze kloof kan overbruggen.
Je werkt embedded binnen het Data Science-team en bent verantwoordelijk voor het ontwikkelen en beheren van de technische basis van onze data- en machine learning-oplossingen. Daarbij zorg je ervoor dat data en modellen betrouwbaar, schaalbaar en productiegericht ingezet kunnen worden.
Je richt data- en ML-pipelines in, van data-ingestie tot modelinzet, en ontwikkelt reproduceerbare workflows waarmee data en modellen efficiënt kunnen worden ontwikkeld, getest en uitgerold. Daarnaast beheer je de benodigde cloudomgeving in Azure en ontwikkel je API's en services waarmee modellen beschikbaar worden gemaakt voor de business.
Ook houd je toezicht op de prestaties van pipelines, de kwaliteit van data en de werking van modellen in productie. Samen met data scientists en BI-specialisten zorg je ervoor dat oplossingen niet alleen goed werken in de ontwikkelomgeving, maar ook succesvol in productie kunnen draaien. Daarbij stem je af met centrale IT op het gebied van infrastructuur, security en governance.
In de praktijk werk je onder andere aan geautomatiseerde feature pipelines, trainingsprocessen voor forecasting- en machine learning-modellen, de deployment van modellen als API of batchproces en het aanbrengen van structuur in data-afhankelijkheden en datacontracten. Daarnaast analyseer en verhelp je storingen in cloudomgevingen wanneer pipelines niet naar behoren functioneren.
Requirements
Je bent geen pure infrastructuurspecialist en ook geen data scientist, maar juist de verbindende schakel daartussen. Je voelt je thuis in zowel de technische kant van softwareontwikkeling als in de wereld van data en machine learning.
-
Je hebt ervaring met Python en gebruikt dit voor het ontwikkelen van productiecode, niet alleen voor analyses in notebooks.
-
Je begrijpt hoe je systemen bouwt die betrouwbaar, schaalbaar en reproduceerbaar zijn.
-
Je hebt ervaring met, of een sterke interesse in: cloudplatformen (bij voorkeur Azure); CI/CD-processen; containerisatie, bijvoorbeeld met Docker; data- en ML-pipelines.
-
Je hebt affiniteit met data, analytics en machine learning en vindt het interessant om modellen naar productie te brengen.
-
Je bent nieuwsgierig naar AI-ondersteunde ontwikkeling en ziet kansen om nieuwe tooling in te zetten om slimmer, sneller en efficiënter te werken.
-
handmatige werkzaamheden die geautomatiseerd kunnen worden;
-
onduidelijke of slecht ingerichte pipelines;
-
oplossingen die alleen werken op de laptop van de ontwikkelaar, maar niet in productie.
Je denkt in duurzame oplossingen, automatiseert waar mogelijk en zorgt ervoor dat data- en ML-oplossingen betrouwbaar kunnen draaien in een professionele omgeving.
Benefits & conditions
Je krijgt afhankelijk van je relevante werkervaring een salaris in schaal 11 (max. € 7.583), passend bij jouw ervaring en verantwoordelijkheden.
- 30 vakantiedagen (o.b.v. 40 uur);
- een Persoonlijk Keuze Budget (je hebt recht op een 13e maand en 8% vakantiegeld);
- een Persoonlijk Ontwikkel Budget voor opleidingen die niet werk-gerelateerd zijn;
- volop mogelijkheden om je te ontwikkelen via onze Arriva Academy (leerportaal) en ook fysiek, met een bedrijfsfitness-regeling;
- reiskostenvergoeding en gratis reizen met al onze bussen en treinen via Arriva's reisapp glimble;
- je kunt uiteraard (deels) vanuit huis werken. Daarvoor is een thuiswerkplekbudget beschikbaar van €900.