> Markdown version of [/jobs/ext/1378114-data-scientist-large-language-models](https://www.wearedevelopers.com/jobs/ext/1378114-data-scientist-large-language-models). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Scientist Large Language Models - **Company:** VYDA GmbH - **Location:** Germany (Remote available) - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Python (Programming Language), Natural Language Processing, SQL Databases, Large Language Models, Deep Learning, Information Technology, HuggingFace, Machine Learning Operations, Docker - **Published:** July 22, 2026 - **Apply:** https://de.indeed.com/viewjob?jk=684a8c49212d389f ## About the Role * Ausbildung/Studium: Du bringst ein abgeschlossenes Studium, zum Beispiel Informatik, oder eine vergleichbare Ausbildung mit. * Deine Erfahrungen: Du hast Erfahrungen rund um das Thema Data Science, insbesondere im Bereich Natural Language Processing. Idealerweise hast du bereits mit LLM Fine-Tuning, agentenbasierten Workflows oder RAG-Architekturen gearbeitet. * Deine Kenntnisse: Du bringst bereits sehr gute Kenntnisse in Python, NLP und Deep Learning mit. Kenntnisse gängiger LLM-Frameworks (z. B. LangChain, LlamaIndex, Hugging Face) sowie von Fine-Tuning-Methoden (z. B. LoRA, PEFT) sind von Vorteil. * Sprachen: Du verfügst über fließende Deutschkenntnisse in Wort und Schrift. * Soft Skills: Ausgeprägtes analytisches Denkvermögen und konzeptionelle Fähigkeiten sind Attribute, die dich treffend beschreiben. * Nice-To-Have: Hervorstechen würdest du mit Kenntnissen in SQL, Transformer, MLOps, Docker, Vektordatenbanken (z. B. Pinecone, Weaviate, FAISS) sowie im Aufbau agentenbasierter Systeme. ## Description * Du arbeitest aktiv an der Entwicklung von Machine-Learning-Algorithmen. Zu deinen Aufgaben gehören die Extraktion und Aufbereitung relevanter Daten, die Durchführung von Feature Engineering, das Training von Modellen sowie deren Evaluation und Optimierung. * In dieser Position arbeitest du an der Entwicklung und Optimierung von Anwendungen auf Basis großer Sprachmodelle (LLMs). Deine Aufgaben umfassen die Aufbereitung und Anreicherung von Textdaten und Optimierung von Prompts sowie die Evaluierung der Modellleistung im Hinblick auf Genauigkeit, Konsistenz und Zuverlässigkeit. * Du führst das Fine-Tuning von LLMs durch, um Modelle gezielt auf domänenspezifische Anwendungsfälle anzupassen, und wählst dafür geeignete Trainingsstrategien und Datensätze aus. * Du konzipierst und implementierst agentenbasierte Workflows, in denen LLMs eigenständig Aufgaben planen, Tools einbinden und mehrstufige Prozesse orchestrieren. * Du entwickelst RAG-Systeme (Retrieval-Augmented Generation), inklusive Aufbau und Optimierung von Vektordatenbanken, Retrieval-Pipelines und der Integration externer Wissensquellen. * Du arbeitest an verschiedenen Themen rund um den Schwerpunkt Natural Language Processing, von der Erstellung von Text-Modellen, zu Topic Modelling und dem Erstellen von Transformer basierten Modellen. * Die Standardisierung von Daten liegt in deiner Hand, außerdem unterstützt du dabei Muster in den Daten zu finden. * Du hilfst beim Deployment, der Wartung und dem Monitoring unserer KI-Modelle. ## Related Videos - [Large Language Models ❤️ Knowledge Graphs](https://www.wearedevelopers.com/videos/1154-large-language-models-knowledge-graphs) - [Fault Tolerance and Consistency at Scale: Harnessing the Power of Distributed SQL Databases](https://www.wearedevelopers.com/videos/1146-fault-tolerance-and-consistency-at-scale-harnessing-the-power-of-distributed-sql-databases) - [Docker Compose: Rediscovered](https://www.wearedevelopers.com/videos/1978-docker-compose-rediscovered) - [Inside the Mind of an LLM](https://www.wearedevelopers.com/videos/1617-inside-the-mind-of-an-llm) - [Fault Tolerance and Consistency at Scale: Harnessing the Power of Distributed SQL Databases](https://www.wearedevelopers.com/videos/1520-fault-tolerance-and-consistency-at-scale-harnessing-the-power-of-distributed-sql-databases) - [Docker build without Docker](https://www.wearedevelopers.com/videos/100114-docker-build-without-docker) ## Related Articles - [What Are Large Language Models?](https://www.wearedevelopers.com/magazine/304-what-are-large-language-models) - [The Biggest German Tech Companies](https://www.wearedevelopers.com/magazine/424-the-biggest-german-tech-companies) - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany) - [The Best Large Language Models on The Market](https://www.wearedevelopers.com/magazine/319-the-best-large-language-models-on-the-market) - [Data Analyst Salary Germany](https://www.wearedevelopers.com/magazine/277-data-analyst-salary-germany) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market)