Senior GenAI Engineer LLMs/ RAG/ Python remote in DE

Talents2Germany GmbH
Frankfurt am Main, Germany
2 months ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
2 years minimum
Working hours
Regular working hours
Languages
German
Job source

Tech stack

Application Programming Interfaces (APIs) Artificial Intelligence Databases Text Processing Fault Tolerance Github Human-Computer Interaction Information Retrieval Python (Programming Language) Open Source Technology Management of Software Versions Large Language Models
+5 more
Multi-Agent Systems Prompt Engineering HuggingFace Laptops Machine Learning Operations

Job description

Was du aufbauen wirst

  • Konzeption und Verantwortung für End-to-End-RAG-Pipelines - von der Dokumentenaufnahme und Chunking-Strategie bis zur Retrieval-Evaluierung und Antwortqualität
  • Bewertung, Fine-Tuning und Deployment von LLMs (OpenAI, Anthropic, Open-Source) für domänenspezifische deutschsprachige Anwendungsfälle
  • Architektur robuster, skalierbarer KI-Systeme unter Einhaltung von Enterprise-Anforderungen an Zuverlässigkeit und Compliance
  • Aufbau von Evaluierungsrahmen - automatisierte Evals, Human-in-the-Loop-Tests, Regressions-Suites - zur Sicherstellung der Produktionszuverlässigkeit
  • Zusammenarbeit mit Fullstack-Entwickler:innen zur Bereitstellung von KI-Funktionen über saubere APIs und intuitive Produktoberflächen
  • Enge Zusammenarbeit mit Unternehmenskunden: Anforderungen verstehen, in technische Lösungen übersetzen und maßgeschneiderte Ergebnisse liefern
  • Verfolgung aktueller GenAI-Entwicklungen und kurzfristige Übersetzung relevanter Forschung in praktische Produktverbesserungen

Requirements

  • 5+ Jahre Softwareentwicklungserfahrung, davon mindestens 2 Jahre in angewandter KI/ML in Produktionsumgebungen
  • Tiefe Python-Kenntnisse - du schreibst sauberen, testbaren, produktionsreifen Code (nicht nur Notebooks)
  • Praktische Erfahrung mit RAG-Architekturen und Vector-Datenbanken (Pinecone, Weaviate, Qdrant o.ä.)
  • Fundiertes Wissen über mindestens einen großen LLM-Anbieter (OpenAI, Anthropic, Cohere) und Best Practices im Prompt Engineering
  • Solides Verständnis von MLOps: Modell-Versionierung, Deployment, Monitoring und graceful Degradation in der Produktion
  • Erfahrung mit Orchestrierungs-Frameworks wie LangChain, LlamaIndex o.ä.

Persönlichkeit & Arbeitsweise

  • Du überbrückst den Weg von der Forschung zur Produktion schneller als jede:r andere im Team
  • Gute Deutschkenntnisse (mindestens auf B2-Niveau und Bereitschaft, innerhalb von 6 Monaten C1-Niveau zu erreichen)
  • Sicherer Umgang mit Unklarheiten - du definierst das Problem und schlägst die Lösung vor, anstatt auf ein Spec-Dokument zu warten

Besonders willkommen

  • Erfahrung mit mehrsprachigen NLP-Aufgaben, insbesondere deutschsprachiger Textverarbeitung
  • Fine-Tuning oder RLHF-Erfahrung (LoRA, QLoRA, DPO)
  • Kenntnisse in Multi-Agent-Frameworks (LangGraph, CrewAI, AutoGen)
  • Hintergrund in Enterprise-KI-Deployments, Information Retrieval oder Wissensgraphen
  • Open-Source-GenAI-Projekte, technische Artikel oder Community-Beiträge (GitHub, HuggingFace, arXiv)

Benefits & conditions

Der Tech-Stack ist modern, das Team vielfältig, und die Arbeitsweise schnell und pragmatisch. Du arbeitest eng mit Product, Design und GenAI Engineers zusammen, um Lösungen zu entwickeln, die bereits von großen Enterprise-Kunden genutzt werden., * Data Science- und KI-Beratung bilden den Schwerpunkt unserer Arbeit. Dich erwarten abwechslungsreiche Projekte sowie moderne NLP Use Cases bei renommierten Kunden.

  • Du arbeitest an fachlich anspruchsvollen Fragestellungen und vielseitigen Projekten. Dadurch entwickelst du deine Expertise in Data Science, Machine Learning und KI kontinuierlich weiter und profitierst von einer steilen Lernkurve.
  • Wir bieten dir umfassende Möglichkeiten zur fachlichen, methodischen und persönlichen Weiterentwicklung.
  • Dich erwarten flache, teamorientierte Strukturen und ein wertschätzendes, kollegiales Arbeitsumfeld.
  • Wir legen großen Wert auf ein offenes, inklusives, chancengerechtes und diverses Miteinander.
  • Kurze Entscheidungswege, agile Arbeitsweisen, regelmäßige Feedbackgespräche im Jahresverlauf sowie ein Mentoring-Programm unterstützen dich in deiner Entwicklung.
  • Wir bieten ein faires und transparentes Vergütungsmodell mit klaren Gehaltsstufen, die regelmäßig an aktuelle Marktentwicklungen angepasst werden.

About the company

Talents2Germany besetzt diese Position im Auftrag unseres Kunden, einem schnell wachsenden KI-Unternehmen im Bereich technologischer Lösungen für den Handel.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

6:36 min

Funding open source through GitHub Accelerator and Sponsors

Stormy Peters · WWC 2023

1:05 min

Establishing access through laptop farms and unwitting facilitators

George Proorocu George Proorocu · WWC Europe 2026

3:04 min

Database evolution and the funding behind vector databases

Erik Bamberg · LIVE

2:14 min

Exploring internal AI product initiatives and global engineering roles

Maria Apazoglou · Coffee With Developers

2:40 min

Using GitHub primitives for internal documentation and corporate operations

Kyle Daigle · Coffee With Developers

3:22 min

Evaluating advanced artificial intelligence platforms for daily recruitment

Rudi Bauer Rudi Bauer +1 · Cappuccino with HR

Videos

See all

Related articles

See all