> Markdown version of [/jobs/ext/1646685-data-scientist-machine-learning-engineer](https://www.wearedevelopers.com/jobs/ext/1646685-data-scientist-machine-learning-engineer). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Scientist /Machine Learning Engineer - **Company:** Wdr Mediagroup Gmbh - **Location:** Köln, Germany - **Contract:** Temporary contract - **Skills:** Application Programming Interfaces (APIs), Artificial Intelligence, User Authentication, Encodings, Databases, Continuous Integration, Data Centers, Relational Databases, Elasticsearch, Python (Programming Language), PostgreSQL, Machine Learning, OAuth, Azure Active Directory, Software Engineering, Data Processing, Pytorch, Large Language Models, Git, Containerization, Gitlab-ci, Scikit Learn, Information Technology, HuggingFace, Machine Learning Operations, Api Gateway, Full-text Search, Software Version Control, Docker - **Published:** July 9, 2026 - **Apply:** https://de.indeed.com/viewjob?jk=0a4b33efba659674 ## About the Role * Du hast ein erfolgreich abgeschlossenes oder kurz vor dem Abschluss stehendes Studium in einer einschlägigen Fachrichtung wie Informatik, Mathematisch-technische Softwareentwicklung (MATSE), Künstliche Intelligenz, Machine Learning oder Data Science - oder bringst vergleichbare praktische Erfahrung mit. * Du hast gute Kenntnisse in der Programmierung mit Python und erste Erfahrung in der Entwicklung KI- bzw. LLM-gestützter Anwendungen. Kenntnisse in Agent-/LLM-Frameworks (z. B. LangChain) oder in ML-Bibliotheken (z. B. Hugging Face Transformers, PyTorch, scikit-learn) sind ein Plus. * Du bringst erste Erfahrung im Aufbau von Daten-Pipelines mit und hast Grundkenntnisse in der Containerisierung mit Docker. Erfahrung mit Compose-basierten Deployments ist von Vorteil. * Du hast Kenntnisse im Umgang mit relationalen Datenbanken (z. B. PostgreSQL) und Interesse an Vektor- und Such-Datenbanken (z. B. Qdrant, Elasticsearch) für den Einsatz in RAG-Szenarien. * Du arbeitest sauber mit Versionsverwaltung (Git) und hast ein Grundverständnis für den sicheren, datensouveränen Betrieb von Anwendungen im eigenen Rechenzentrum (On-Premise, DSGVO). Offenheit für perspektivisch hybride Betriebsmodelle bringst Du mit. * Du bist ein Teamplayer, möchtest mit Deinem Team gemeinsam wachsen und identifizierst Dich mit der Grundidee des öffentlich-rechtlichen Rundfunks. ## Description * Du entwickelst auf unserer KI-Plattform im eigenen Rechenzentrum Agenten, Anwendungen und Datenpipelines auf Basis gängiger Sprachmodelle (LLMs) und betreust deren Bereitstellung und Pflege. * Du setzt Use-Cases für die Kerngeschäftsbereiche unserer Unternehmensgruppe um - von der Konzeption über die Umsetzung bis hin zum Deployment - und trägst damit zum Wachstum von KI in der größten Werbegesellschaft der ARD bei. * Du entwickelst Agenten und RAG-Anwendungen mit Python und LangChain, bindest Sprachmodelle über unser API-Gateway (LiteLLM) an und integrierst Fachsysteme über REST- und MCP-Schnittstellen. * Gemeinsam mit unseren Architekten (m/w/d) baust Du Daten- und RAG-Pipelines auf, bereitest Dokumente- und Datenquellen für die Vektor- und Volltextsuche auf und steuerst automatisierte Workflows von der Datenaufbereitung über Embedding und Retrieval bis zum Deployment. * Du betreust das lokale Modell-Portfolio (z. B. über Ollama und LiteLLM), pflegst Versionsstände und verbesserst kontinuierlich Retrieval-Qualität, Prompts und Antwortgüte. * Du arbeitest eng und interdisziplinär mit Softwareentwicklern (m/w/d), Architekten (m/w/d) und unserem AI-Officer (m/w/d) zusammen und vermittelst den Fachbereichen Verständnis für die operative Nutzung von KI-Modellen. Und wenn Du noch mehr wissen willst … in diese Themen wächst Du bei uns hinein: * Prompt-Engineering, Embeddings und Retrieval-Augmented Generation (RAG) * Fine-Tuning lokaler Sprachmodelle (LoRA/QLoRA, Hugging Face) * Anbindung von APIs sowie in Authentifizierung über OAuth/Microsoft Entra ID * CI/CD-Pipelines (z. B. Git Actions, GitLab CI) für automatisierte Builds und Deployments * Evaluierung, Monitoring und Observability von KI-Anwendungen (LLMOps) * Hybride Betriebsmodelle (On-Premise plus Public Cloud) und die damit verbundenen Architektur- und Datenschutzfragen ## Related Videos - [How a Small Team Shrank a Microsoft Monorepo by 94%](https://www.wearedevelopers.com/videos/1236-how-a-small-team-shrank-a-microsoft-monorepo-by-94) - [Keeping applications secure by evolving OAuth 2.0 and OpenID Connect](https://www.wearedevelopers.com/videos/100152-keeping-applications-secure-by-evolving-oauth-2-0-and-openid-connect) - [Docker Compose: Rediscovered](https://www.wearedevelopers.com/videos/1978-docker-compose-rediscovered) - [Empowering Retail Through Applied Machine Learning](https://www.wearedevelopers.com/videos/976-empowering-retail-through-applied-machine-learning) - [Git for Code Reviews](https://www.wearedevelopers.com/videos/429-git-for-code-reviews) - [Beyond Hiring: Building a Sustainable Talent Acquisition Engine at Deutsche Bahn](https://www.wearedevelopers.com/videos/1856-beyond-hiring-building-a-sustainable-talent-acquisition-engine-at-deutsche-bahn) ## Related Articles - [The Biggest German Tech Companies](https://www.wearedevelopers.com/magazine/424-the-biggest-german-tech-companies) - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market) - [Data Analyst Salary Germany](https://www.wearedevelopers.com/magazine/277-data-analyst-salary-germany) - [Finding IT & Technology English-speaking Jobs in Germany ](https://www.wearedevelopers.com/magazine/446-finding-it-technology-english-speaking-jobs-in-germany) - [Where to Find German Tech Jobs](https://www.wearedevelopers.com/magazine/366-where-to-find-german-tech-jobs)