Looking for experts?

Find now

Back

ID: 2972479

2. GPU Infrastructure Engineer (Senior) (m/w/d)

SOMI experts logo

Freelance

Kassel

30.09.2026 - 30.06.2027

Hybrid

Full-time

Einleitung

Für die technische Umsetzung einer modernen GPU-Infrastruktur suchen wir einen erfahrenen Infrastructure Engineer mit Schwerpunkt auf NVIDIA-Technologien, Kubernetes und containerisierten KI-Anwendungen.

Du übernimmst eine zentrale Rolle bei der technischen Inbetriebnahme der GPU-Systeme und stellst sicher, dass diese zuverlässig für LLM-Inference ebenso wie für allgemeine CUDA-Workloads genutzt werden können. Dabei stehen ein sicherer On-Premise-Betrieb, effizientes Ressourcenmanagement und eine stabile Integration in die bestehende Plattformlandschaft im Mittelpunkt.

Deine Tätigkeiten

  • Technische Inbetriebnahme und Konfiguration von GPU-basierten Rechenressourcen
  • Einrichtung und Optimierung des NVIDIA-Treiber- und CUDA-Stacks
  • Integration der GPU-Systeme in bestehende Container- und Kubernetes-Umgebungen
  • Einsatz und Konfiguration des NVIDIA GPU Operators
  • Konzeption und Umsetzung einer geeigneten GPU-Ressourcenverteilung
  • Bewertung und Implementierung von NVIDIA Multi-Instance GPU (MIG)
  • Prüfung weiterer Verfahren für GPU-Sharing, Scheduling und Ressourcensteuerung
  • Sicherstellung der Nutzung der Infrastruktur für native CUDA-Anwendungen
  • Aufbau und Konfiguration von LLM-Serving-Infrastrukturen
  • Arbeit mit Technologien wie vLLM, NVIDIA Triton oder TGI
  • Integration von KI-/LLM-Diensten in bestehende Unternehmens- und Fachanwendungssysteme
  • Unterstützung bei der technischen Anbindung SAP-basierter Verfahren
  • Aufbau bzw. Anpassung von Netzwerk-, Storage- und Sicherheitskomponenten
  • Einrichtung grundlegender Monitoring- und Observability-Funktionen
  • Umsetzung geeigneter Zugriffs- und Sicherheitsmechanismen
  • Unterstützung bei der Härtung containerisierter KI-Anwendungen
  • Analyse und Behebung technischer Probleme im Plattformbetrieb
  • Erstellung technischer Dokumentationen und Betriebsunterlagen
  • Wissenstransfer an interne Infrastruktur-, Plattform- und Betriebsteams

Das gesuchte Profil

  • Technische Inbetriebnahme und Konfiguration von GPU-basierten Rechenressourcen
  • Einrichtung und Optimierung des NVIDIA-Treiber- und CUDA-Stacks
  • Integration der GPU-Systeme in bestehende Container- und Kubernetes-Umgebungen
  • Einsatz und Konfiguration des NVIDIA GPU Operators
  • Konzeption und Umsetzung einer geeigneten GPU-Ressourcenverteilung
  • Bewertung und Implementierung von NVIDIA Multi-Instance GPU (MIG)
  • Prüfung weiterer Verfahren für GPU-Sharing, Scheduling und Ressourcensteuerung
  • Sicherstellung der Nutzung der Infrastruktur für native CUDA-Anwendungen
  • Aufbau und Konfiguration von LLM-Serving-Infrastrukturen
  • Arbeit mit Technologien wie vLLM, NVIDIA Triton oder TGI
  • Integration von KI-/LLM-Diensten in bestehende Unternehmens- und Fachanwendungssysteme
  • Unterstützung bei der technischen Anbindung SAP-basierter Verfahren
  • Aufbau bzw. Anpassung von Netzwerk-, Storage- und Sicherheitskomponenten
  • Einrichtung grundlegender Monitoring- und Observability-Funktionen
  • Umsetzung geeigneter Zugriffs- und Sicherheitsmechanismen
  • Unterstützung bei der Härtung containerisierter KI-Anwendungen
  • Analyse und Behebung technischer Probleme im Plattformbetrieb
  • Erstellung technischer Dokumentationen und Betriebsunterlagen
  • Wissenstransfer an interne Infrastruktur-, Plattform- und Betriebsteams

Sprachanforderungen

  • Deutsch: Verhandlungssicher
  • Englisch: Erweiterte Kenntnisse
Lisa Nauen image

Your contact person

Lisa Nauen

Recruiting Manager

Line art illustration of a woman reading a book while sitting cross-legged with a laptop nearby

Create your MySOMI account and find the right job.

Join MySOMI
Line art illustration of a hand holding a pen writing on a Surface

Not the right job? Send us your application anyway!

Initiative application