> Markdown version of [/jobs/ext/3664640-data-engineer](https://www.wearedevelopers.com/jobs/ext/3664640-data-engineer). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Engineer - **Company:** twomynds - **Location:** Köln, Germany - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Airflow, Amazon Web Services, Data Analysis, Microsoft Azure, Cloud Computing, Continuous Integration, Information Engineering, Extract Transform Load (ETL), Data Warehousing, Python (Programming Language), SQL Databases, Snowflake, Pyspark, Databricks - **Published:** October 10, 2026 - **Apply:** https://www.careerjet.de/jobad/de498e4bfb107391a08ec9ac66bb943b26 ## About the Role * Erfahrung im Data Engineering: Du hast bereits produktive Datenpipelines und -infrastruktur gebaut und betrieben und arbeitest gerne an sauberen, skalierbaren Lösungen. * Tool-Stack: Du bist sicher im Umgang mit Python und SQL, kennst dich mit ETL/ELT, Data Warehouses/Lakehouses und einer Cloud-Umgebung (Databricks/Snowflake/AWS/Azure/GCP) aus; Erfahrung mit PySpark, Airflow und CI/CD ist ein Plus. * Datenmodellierung & Qualitätsbewusstsein: Du verstehst Datenmodellierung und legst Wert auf Datenqualität, Tests und wartbaren Code. * Umsetzungskompetenz & Eigenverantwortung: Du bringst Lösungen pragmatisch und zielorientiert von der Idee bis in den Betrieb und übernimmst Verantwortung für Ergebnis und Qualität. * Teamplayer: Du arbeitest gerne mit Data Scientists, Analysten und Kunden zusammen und kommunizierst technische Sachverhalte klar. * Sprachen: Fließende Deutschkenntnisse (C1+), gute Englischkenntnisse sind ein Plus. ## Description * Aufbau & Betrieb von Datenpipelines: Du entwickelst, testest und betreibst robuste ETL/ELT-Pipelines, die Daten aus unterschiedlichsten Quellen zuverlässig ingestieren, transformieren und bereitstellen. * Datenmodellierung & Architektur: Du entwirfst und pflegst Datenmodelle, Schemata und Strukturen für Data Warehouses/Lakehouses, die analytische und operative Use Cases sauber unterstützen. * Datenqualität & Zuverlässigkeit: Du implementierst Validierungen, Qualitätschecks und Monitoring, damit Daten korrekt, konsistent und jederzeit verfügbar sind. * Cloud & Skalierung: Du baust und optimierst Datenlösungen in der Cloud (AWS/Azure/GCP), achtest auf Performance, Skalierbarkeit und Kosten und arbeitest mit Infrastruktur-as-Code. * Automatisierung & Orchestrierung: Du automatisierst wiederkehrende Datenflüsse (z. B. mit Airflow) und sorgst mit CI/CD für saubere, wiederholbare Deployments. * Enablement für Analytics & KI: Du stellst Data Scientists und Analysten performante, gut dokumentierte Datensätze bereit und unterstützt dabei, Modelle und Use Cases produktiv zu machen. * Zusammenarbeit & Übersetzung: Du arbeitest eng mit interdisziplinären Teams und Kunden zusammen, verstehst fachliche Anforderungen und übersetzt sie in tragfähige technische Lösungen.