AI Data Engineer / AI Data Scientist

Jobriver Hr Service
Berlin, Germany
2 months ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Compensation
€44,000.0 - €68,000.0
Working hours
Regular working hours
Languages
English, German
Job source

Tech stack

Training Data Artificial Intelligence Information Engineering Python (Programming Language) Machine Learning NumPy SQL Databases Data Processing Pandas Pyspark

Requirements

Der ideale Kandidat hat ein abgeschlossenes Studium und mehrjährige Berufserfahrung im Bereich Data Engineering, Data Science oder einer vergleichbaren Position. Sie verfügen über solide Kenntnisse in der Aufbereitung und Qualitätssicherung von Trainingsdaten für Machine Learning und haben fundierte Erfahrung in der Datenaufbereitung sowie der Pipeline-Architektur. Ein sicherer Umgang mit Python und gängigen Tools zur Datenverarbeitung wie Pandas, NumPy, SQL und PySpark ist erforderlich. Zudem bringen Sie ein Verständnis für die Grundprinzipien der Bildsegmentierung und -annotation industrieller Bilddaten mit. Eine sorgfältige Dokumentation von Datenzuständen und Qualitätsbefunden ist für Sie selbstverständlich. Sie arbeiten teamorientiert, strukturiert und lösungsorientiert und haben Interesse an neuen Technologien. Fließende Deutsch- und Englischkenntnisse sind notwendig, um effektiv in einem internationalen Team zu kommunizieren.

Technologien

Python

Soft Skills

Teamfähigkeit Strukturierte Arbeitsweise Lösungsorientierung

Erforderliche Sprachen

Deutsch Englisch

About the company

Unser Kunde ist ein führendes Unternehmen im Bereich der zerstörungsfreien Werkstoffprüfung, das innovative Lösungen für verschiedene Industrien anbietet. Als AI Data Engineer / AI Data Scientist (m/w/d) sind Sie ein zentraler Bestandteil des KI-Teams und tragen zur Entwicklung leistungsfähiger KI-Systeme bei. Ihre Hauptaufgaben umfassen die Datenaufbereitung, Qualitätssicherung und die Optimierung von Machine-Learning-Workflows. Sie werden an der intelligenten Nutzung industrieller Bilddaten arbeiten und innovative Lösungen für die automatisierte Röntgenprüfung weiterentwickeln. In Ihrer Rolle sind Sie verantwortlich für die Entwicklung und Optimierung von Datenpipelines sowie die Qualitätssicherung der Trainingsdatensätze. Sie kuratieren und bereiten Trainingsdatensätze auf, stellen deren Konsistenz und Vollständigkeit sicher und koordinieren Labeling-Aufgaben über verschiedene Teams hinweg. Zudem nutzen Sie interne Tools zur Datenverwaltung und Pflege technischer Dokumentationen. Das Arbeitsumfeld ist international und kollegial, und es werden flexible Arbeitsmodelle sowie individuelle Weiterbildungsmöglichkeiten angeboten. Ihr Engagement wird durch verschiedene Laufbahnmodelle und übergesetzliche Zuschüsse zur betrieblichen Altersvorsorge unterstützt.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on xing.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:34 min

Maximizing execution memory effectively via python numpy broadcasting

Jodie Burchell · LIVE

2:03 min

Accelerating pandas dataframes using cudf module plugins

Ankit Patel Ankit Patel · WWC 2024

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

3:14 min

Structuring career paths and localized data architectures

Ulrich Wurstbauer +1 · LIVE

3:37 min

Scaling machine learning pipelines from prototypes to petabytes

Julian Joseph · LIVE

6:58 min

Analyzing production code coverage data using pandas

Markus Harrer Markus Harrer · WWC 2021

Videos

See all

Related articles

See all