Junior AI Application Engineer – AI Products (LLM & RAG) (m/f/d)
🌏 Worldwide
Python
Docker
Kubernetes
AWS
GCP
Azure
Machine Learning
Backend
Data Science
Devops
Junior AI Application Engineer – AI Products (LLM & RAG) (m/f/d)
from 🌏 Worldwide
Bei Machine Learning Reply unterstützen wir Unternehmen dabei, modernste AI-Technologien in reale Anwendungen und skalierbare digitale Produkte zu verwandeln.
Zur Verstärkung unseres Teams suchen wir einen Junior AI Application Engineer, der Freude daran hat, AI-powered solutions und intelligente Produkt-Features mit Hilfe von modernen Machine Learning und Generative AI Technologien zu entwickeln.
Während sich unsere GenAI Engineers auf die Modellentwicklung und AI-Architekturen konzentrieren, liegt der Fokus der AI Application Engineers auf der Entwicklung nutzerzentrierter AI-Applications und der Überführung von AI-Capabilities in skalierbare Produkte.
In dieser Rolle arbeitest du an der Schnittstelle von AI Engineering, Backend Development, Produktentwicklung und Cloud Deployment, um produktionsreife AI-Systeme zu bauen, die echten geschäftlichen Mehrwert schaffen.
Aufgaben
Als Junior AI Application Engineer (m/w/d) entwirfst und entwickelst du KI-gestützte Anwendungen und Produktfunktionen für Unternehmenskunden. Zu deinen Aufgaben gehören:
Konzeption und Entwicklungvon KI-Anwendungen wie Enterprise-Assistenten, Copiloten, semantischen Suchplattformen und Automatisierungssystemen
Unterstützung bei derEntwicklung von LLM-basierten Lösungen (inkl. RAG) sowieEnd-to-End-KI-Produkten unter Integration von APIs, Unternehmensdaten und Backend-Services
Aufbau skalierbarer KI-Microservices, APIs sowie Vektorsuche-, Embedding- und Retrieval-Systeme
SchnellesPrototyping von KI-Featuresund derenWeiterentwicklungzu produktiven Systemen
Enge ZusammenarbeitmitProduktmanagern, Designern, KI-Ingenieuren und Kunden zur Entwicklung wirkungsvoller Lösungen
Deployment von KI-Systemen in Cloud- und Produktionsumgebungen unter Nutzung moderner DevOps-Praktiken
Sicherstellungvon Zuverlässigkeit, Skalierbarkeit und Observability durchCI/CD, Monitoring und containerisierte Deployments
Benefits
HYBRIDES ARBEITEN
FIRMEN EVENTS
EXPERTEN NETZWERK
ZERTIFIZIERUNGEN
Regelmäßige und systematische (externe und interne)Weiterbildungsmöglichkeitenin den Bereichen Generative AI, LLM-Entwicklung, Cloud-Architektur und Data Science
Arbeit in eineroffenen, flachen Umgebung, innerhalb eines breiten Reply-Netzwerks zum Wissensaustausch
PreisgekrönteBüroräumein der Münchner Innenstadt mit Zugang zur Stammstrecke
Fahrkarte für öffentliche Verkehrsmittel mitDeutschlandticket
Beteiligung an deinen sportlichen Aktivitäten über den EGYM Wellpass und weitere Benefits der Reply Gruppe
Flexible Arbeitsumgebungzwischen Kunden, Reply-Büro und Remote-Arbeit
Anforderungen
Abgeschlossenes Studium in Informatik, Software Engineering, Data Science oder einem vergleichbaren technischen Bereich
Programmierkenntnisse in Python und modernen Backend-Frameworks sowieErfahrung mit KI-, Machine-Learning- und generativen KI-Anwendungen
ErsteErfahrungin derEntwicklung skalierbarer Backend-Systeme, APIs und Microservices sowieKenntnisse in RAG,Vektordatenbanken und Retrieval-Technologien
Praxis in Containerisierung und DevOps(z. B. Docker, CI/CD, Kubernetes) sowie Deployment von KI-Services in Cloud-Umgebungen (AWS, Azure, GCP)
Berührungspunkte mit relevanten Frameworks(z. B. LangChain, LlamaIndex, Hugging Face)
Kenntnisse inMonitoring, Observability sowie Evaluation und Optimierung von LLM-Systemen
Sehr gute Deutsch- und Englischkenntnisse für Workshops und Kommunikation
Beispielprojekte, an denen du arbeiten könntest
Enterprise AI Knowledge Assistants
AI Copilots für interne Business-Tools
Semantic Search Plattformen für Unternehmensdaten
Document Intelligence Systeme auf Basis von LLMs
AI Agents und Automatisierungssysteme für Enterprise Workflows














