> Markdown version of [/jobs/ext/2767406-cloud-data-ai-engineer-databricks](https://www.wearedevelopers.com/jobs/ext/2767406-cloud-data-ai-engineer-databricks). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Cloud Data & AI Engineer - Databricks - **Company:** Instaffo GmbH - **Location:** Heidelberg, Germany (Remote available) - **Contract:** Permanent contract - **Skills:** Application Programming Interfaces (APIs), Artificial Intelligence, Airflow, Amazon Web Services, Data Analysis, Microsoft Azure, Cloud Computing, Cloud Database, Databases, Continuous Integration, Information Engineering, Data Governance, Python (Programming Language), Machine Learning, SQL Azure, Search Technologies, SQL Databases, Data Streaming, Cloud Platform System, Large Language Models, Apache Spark, Git, Data Lakes, Pyspark, Infrastructure Automation Frameworks, Information Technology, Apache Kafka, Machine Learning Operations, Terraform, Databricks - **Published:** September 7, 2026 - **Apply:** https://jobs.meinestadt.de/heidelberg/standard?id=259744009 ## About the Role Machine Learning CRM-System Cloud Informatik Datenmodellierung Englisch HR-Bereich Security SQL Azure ERP-System Lakehouse Praktikumserfahrung Berufserfahrung AWS Python GIT Wirtschaftsinformatik Unity Continuous Integration Engineering Deutsch Verantwortungsvolle Arbeitsweise Flexibilität Wertschätzung Engagement, * Erste bis mehrjährige praktische Erfahrung im Bereich Data Engineering, Machine Learning Engineering, AI Engineering oder in einer vergleichbaren Rolle * Gute Kenntnisse in Databricks * Gute Kenntnisse in Python, SQL, Spark und PySpark * Praxiserfahrung mit mindestens einer Cloud-Plattform, idealerweise Azure oder AWS * Erfahrung im Aufbau oder in der Weiterentwicklung moderner Datenplattformen in der Cloud * Erfahrung mit MLflow, Model Serving und Vector Search, idealerweise im Databricks-Umfeld * Grundlegendes bis gutes Verständnis moderner AI-/LLM-Konzepte, z. B. RAG, Retrieval, Evaluation, Serving und produktiver GenAI-Anwendungen * Gutes Verständnis für Lakehouse-Architekturen, Datenmodellierung und produktive Datenprozesse * Erste Erfahrung in den Bereichen Data Governance, Data Quality, Security und Monitoring * Sicherer Umgang mit Git und idealerweise erste Erfahrung mit CI/CD und Infrastructure as Code * Abgeschlossenes Studium in Wirtschaftsinformatik, Informatik, Data Science oder einem vergleichbaren Studiengang * Strukturierte, eigenverantwortliche und lösungsorientierte Arbeitsweise * Sehr gute Deutsch- und gute Englischkenntnisse Worüber wir uns zusätzlich freuen: * Erfahrung mit Terraform oder OpenTofu * Erfahrung mit Kafka, CDC oder eventgetriebenen Architekturen * Kenntnisse in Airflow, dbt oder vergleichbaren Tools * Erfahrung in der Anbindung unterschiedlicher Quellsysteme * Freude an der Zusammenarbeit mit Kunden und interdisziplinären Teams * Zertifizierungen im Umfeld von Databricks, Azure oder AWS ## Description Was du bei uns bewegst: * Du entwickelst moderne Data-&-AI-Lösungen auf Basis von Databricks * Du baust robuste Batch- und Streaming-Pipelines mit Python, SQL, Spark und PySpark * Du arbeitest an Lakehouse-Architekturen für Analytics-, ML- und GenAI-Anwendungsfälle mit * Du nutzt zentrale Databricks-Komponenten wie Delta Lake, Unity Catalog, Workflows, MLflow, Model Serving und Vector Search * Du unterstützt bei der Umsetzung und Weiterentwicklung von ML-, LLM- und GenAI-Use-Cases * Du arbeitest an Themen wie Serving, Retrieval, Evaluation, Monitoring und Governance für AI-Anwendungen * Du bindest unterschiedliche Quellsysteme wie APIs, Datenbanken, ERP- oder CRM-Systeme an * Du unterstützt bei der Umsetzung von Anforderungen rund um Data Quality, Security, Governance und Observability * Du arbeitest mit Git, CI/CD und Infrastructure as Code an produktiven Deployments * Du bringst dich in technische Konzepte, Best Practices und die Weiterentwicklung unserer Delivery-Standards ein ## Related Videos - [From Messy Queries to Scalable Systems - How Data Engineering actually works](https://www.wearedevelopers.com/videos/100203-from-messy-queries-to-scalable-systems-how-data-engineering-actually-works) - [PySpark - Combining Machine Learning & Big Data](https://www.wearedevelopers.com/videos/44-pyspark-combining-machine-learning-big-data) - [How a Small Team Shrank a Microsoft Monorepo by 94%](https://www.wearedevelopers.com/videos/1236-how-a-small-team-shrank-a-microsoft-monorepo-by-94) - [Data Science in Retail](https://www.wearedevelopers.com/videos/586-data-science-in-retail) - [Empowering Retail Through Applied Machine Learning](https://www.wearedevelopers.com/videos/976-empowering-retail-through-applied-machine-learning) - [Enjoying SQL data pipelines with dbt](https://www.wearedevelopers.com/videos/823-enjoying-sql-data-pipelines-with-dbt) ## Related Articles - [The Biggest German Tech Companies](https://www.wearedevelopers.com/magazine/424-the-biggest-german-tech-companies) - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany) - [System change: restart as developer?](https://www.wearedevelopers.com/magazine/39-system-change-restart-as-developer) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market) - [Top-Paying Tech Jobs (with Salaries)](https://www.wearedevelopers.com/magazine/372-top-paying-tech-jobs-with-salaries) - [Fullstack developer salary in Germany [2023]](https://www.wearedevelopers.com/magazine/197-fullstack-developer-salary-in-germany-2023)