Data Scientist Large Language Models

VYDA GmbH
Germany
22 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Shift work
Languages
German
Job source

Tech stack

Artificial Intelligence Python (Programming Language) Natural Language Processing SQL Databases Large Language Models Deep Learning Information Technology HuggingFace Machine Learning Operations Docker

Job description

  • Du arbeitest aktiv an der Entwicklung von Machine-Learning-Algorithmen. Zu deinen Aufgaben gehĂśren die Extraktion und Aufbereitung relevanter Daten, die DurchfĂźhrung von Feature Engineering, das Training von Modellen sowie deren Evaluation und Optimierung.
  • In dieser Position arbeitest du an der Entwicklung und Optimierung von Anwendungen auf Basis großer Sprachmodelle (LLMs). Deine Aufgaben umfassen die Aufbereitung und Anreicherung von Textdaten und Optimierung von Prompts sowie die Evaluierung der Modellleistung im Hinblick auf Genauigkeit, Konsistenz und Zuverlässigkeit.
  • Du fĂźhrst das Fine-Tuning von LLMs durch, um Modelle gezielt auf domänenspezifische Anwendungsfälle anzupassen, und wählst dafĂźr geeignete Trainingsstrategien und Datensätze aus.
  • Du konzipierst und implementierst agentenbasierte Workflows, in denen LLMs eigenständig Aufgaben planen, Tools einbinden und mehrstufige Prozesse orchestrieren.
  • Du entwickelst RAG-Systeme (Retrieval-Augmented Generation), inklusive Aufbau und Optimierung von Vektordatenbanken, Retrieval-Pipelines und der Integration externer Wissensquellen.
  • Du arbeitest an verschiedenen Themen rund um den Schwerpunkt Natural Language Processing, von der Erstellung von Text-Modellen, zu Topic Modelling und dem Erstellen von Transformer basierten Modellen.
  • Die Standardisierung von Daten liegt in deiner Hand, außerdem unterstĂźtzt du dabei Muster in den Daten zu finden.
  • Du hilfst beim Deployment, der Wartung und dem Monitoring unserer KI-Modelle.

Requirements

  • Ausbildung/Studium: Du bringst ein abgeschlossenes Studium, zum Beispiel Informatik, oder eine vergleichbare Ausbildung mit.
  • Deine Erfahrungen: Du hast Erfahrungen rund um das Thema Data Science, insbesondere im Bereich Natural Language Processing. Idealerweise hast du bereits mit LLM Fine-Tuning, agentenbasierten Workflows oder RAG-Architekturen gearbeitet.
  • Deine Kenntnisse: Du bringst bereits sehr gute Kenntnisse in Python, NLP und Deep Learning mit. Kenntnisse gängiger LLM-Frameworks (z. B. LangChain, LlamaIndex, Hugging Face) sowie von Fine-Tuning-Methoden (z. B. LoRA, PEFT) sind von Vorteil.
  • Sprachen: Du verfĂźgst Ăźber fließende Deutschkenntnisse in Wort und Schrift.
  • Soft Skills: Ausgeprägtes analytisches DenkvermĂśgen und konzeptionelle Fähigkeiten sind Attribute, die dich treffend beschreiben.
  • Nice-To-Have: Hervorstechen wĂźrdest du mit Kenntnissen in SQL, Transformer, MLOps, Docker, Vektordatenbanken (z. B. Pinecone, Weaviate, FAISS) sowie im Aufbau agentenbasierter Systeme.

Benefits & conditions

Neben unseren zahlreichen Benefits, wie den festgelegten 30 Urlaubstagen pro Jahr und unseren flexiblen Arbeitszeiten, bietet dir diese Stelle:

  • Stetig neue Herausforderungen: Die immer neuen Anforderungen lĂśst du mit großen Freiräumen fĂźr eigene Ideen und Verantwortung. Hier ist dein Wissen gefragt.
  • Homeoffice: Bei uns hast du die MĂśglichkeit bis zu 100% aus dem Homeoffice zu arbeiten.
  • Neueste Technologien: bei uns arbeitest du innerhalb agiler Methoden mit einem modernen Tech-Stack.

About the company

VYDA ist einer der fßhrenden Datenexperten im deutschsprachigen Raum und verbindet menschliche Expertise mit innovativer Technologie. Als verantwortungsvoller Partner fßr Prozessautomatisierung unterstßtzt VYDA die datengetriebene Transformation in den Zielbranchen Insurance und Real Estate. Mit ßber 400 Mitarbeitenden vereint das Unternehmen mit Sitz in Mßnster fundiertes Branchen-Know-how mit ISO-zertifizierter Technologie und langjähriger Erfahrung in der End-to-End-Steuerung von Geschäftsprozessen.

Mit passgenauen Lösungen stärkt VYDA die Wettbewerbsfähigkeit von Unternehmen in den Bereichen Kfz-, Sach-, Personenschaden und Real Estate. KI-gestützte Prozesse und fachlich validierte Analysen bilden das Fundament für datengetriebene Entscheidungsfindung in der Versicherungs- und Immobilienwirtschaft. Dabei arbeitet das Unternehmen eng mit seinem strategischen Partner, dem Sachverständigenbüro STIBL in Österreich, zusammen.

VYDA - Value your Data.

Weitere Informationen unter www.vyda.de

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on de.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

1:14 min

Evolution of distributed SQL database architectures

Wei Hu Wei Hu ¡ World Congress 2024

2:07 min

Inspecting default bridge architectures and custom Docker networks

Oliver Seitz Oliver Seitz ¡ World Congress 2025

1:35 min

How LLMs imitate human data discovery behavior

Jordan Tigani Jordan Tigani ¡ World Congress 2026 Europe

1:36 min

Evolution from key-value stores to distributed SQL

Wei Hu Wei Hu ¡ World Congress 2025

2:34 min

Docker sandbox architecture and microVM environment integration

Manuel de la Peùa Manuel de la Peùa ¡ World Congress 2026 Europe

4:30 min

How LLMs process language using word vectors

Stephen Chin Stephen Chin ¡ World Congress 2024

Videos

See all

Related articles

See all