Data Scientist Large Language Models
Role details
Job location
Tech stack
Job description
- Du arbeitest aktiv an der Entwicklung von Machine-Learning-Algorithmen. Zu deinen Aufgaben gehören die Extraktion und Aufbereitung relevanter Daten, die Durchführung von Feature Engineering, das Training von Modellen sowie deren Evaluation und Optimierung.
- In dieser Position arbeitest du an der Entwicklung und Optimierung von Anwendungen auf Basis großer Sprachmodelle (LLMs). Deine Aufgaben umfassen die Aufbereitung und Anreicherung von Textdaten und Optimierung von Prompts sowie die Evaluierung der Modellleistung im Hinblick auf Genauigkeit, Konsistenz und Zuverlässigkeit.
- Du führst das Fine-Tuning von LLMs durch, um Modelle gezielt auf domänenspezifische Anwendungsfälle anzupassen, und wählst dafür geeignete Trainingsstrategien und Datensätze aus.
- Du konzipierst und implementierst agentenbasierte Workflows, in denen LLMs eigenständig Aufgaben planen, Tools einbinden und mehrstufige Prozesse orchestrieren.
- Du entwickelst RAG-Systeme (Retrieval-Augmented Generation), inklusive Aufbau und Optimierung von Vektordatenbanken, Retrieval-Pipelines und der Integration externer Wissensquellen.
- Du arbeitest an verschiedenen Themen rund um den Schwerpunkt Natural Language Processing, von der Erstellung von Text-Modellen, zu Topic Modelling und dem Erstellen von Transformer basierten Modellen.
- Die Standardisierung von Daten liegt in deiner Hand, außerdem unterstützt du dabei Muster in den Daten zu finden.
- Du hilfst beim Deployment, der Wartung und dem Monitoring unserer KI-Modelle.
Requirements
- Ausbildung/Studium: Du bringst ein abgeschlossenes Studium, zum Beispiel Informatik, oder eine vergleichbare Ausbildung mit.
- Deine Erfahrungen: Du hast Erfahrungen rund um das Thema Data Science, insbesondere im Bereich Natural Language Processing. Idealerweise hast du bereits mit LLM Fine-Tuning, agentenbasierten Workflows oder RAG-Architekturen gearbeitet.
- Deine Kenntnisse: Du bringst bereits sehr gute Kenntnisse in Python, NLP und Deep Learning mit. Kenntnisse gängiger LLM-Frameworks (z. B. LangChain, LlamaIndex, Hugging Face) sowie von Fine-Tuning-Methoden (z. B. LoRA, PEFT) sind von Vorteil.
- Sprachen: Du verfügst über fließende Deutschkenntnisse in Wort und Schrift.
- Soft Skills: Ausgeprägtes analytisches Denkvermögen und konzeptionelle Fähigkeiten sind Attribute, die dich treffend beschreiben.
- Nice-To-Have: Hervorstechen würdest du mit Kenntnissen in SQL, Transformer, MLOps, Docker, Vektordatenbanken (z. B. Pinecone, Weaviate, FAISS) sowie im Aufbau agentenbasierter Systeme.
Benefits & conditions
Neben unseren zahlreichen Benefits, wie den festgelegten 30 Urlaubstagen pro Jahr und unseren flexiblen Arbeitszeiten, bietet dir diese Stelle:
- Stetig neue Herausforderungen: Die immer neuen Anforderungen löst du mit großen Freiräumen für eigene Ideen und Verantwortung. Hier ist dein Wissen gefragt.
- Homeoffice: Bei uns hast du die Möglichkeit bis zu 100% aus dem Homeoffice zu arbeiten.
- Neueste Technologien: bei uns arbeitest du innerhalb agiler Methoden mit einem modernen Tech-Stack.
About the company
HR ZUKUNFT FLEXIBEL GESTALTEN
Wie entscheidend eine innovative HR Abteilung zur Widerstandsfähigkeit eines Unternehmens beitragen kann, hat die jüngste Vergangenheit gezeigt. HR hat den Stresstest bestanden: etablierte Verfahren gewandelt, vernetzte Kommunikation hergestellt, Prozesse automatisiert. Digitales HR Leadership und Gestaltung der Unternehmenskultur sind die Aufgaben der Zukunft.
VEDA bietet passende Software und Services für ein innovatives und kollaboratives HR-Management – im Abgleich mit den individuellen Anforderungen des Unternehmens.
Mehr als 1200 Kundinnen und Kunden sind täglich mit unseren Produkten „on“, mit unseren Mitarbeitenden in direktem Kontakt oder nutzen unsere Services wie das Payroll-Outsourcing.
Wir verbinden HR-Entgeltabrechnung, Zeit und Zutritt, Recruiting, Personalentwicklung und Weiterbildung über unser Portal VEDA Horizon in der Cloud.