Stichworte
Zusammenfassung
inovex GmbH in Karlsruhe sucht einen Cloud Engineer mit Fokus auf Data & AI-Infrastruktur, der GPU-Cluster orchestriert, moderne Datenplattformen aufbaut und ML-Pipelines in Produktion stabil betreibt. Die Rolle verbindet tiefe Kubernetes-Expertise mit der Konzeption von Lakehouse-Architekturen, Orchestrierungstools und inferenzstabilen Schnittstellen. Bewerber:innen erwartet ein breites Technologie-Stack aus AWS, Azure, Terraform, Airflow, Spark und Databricks – mit der Freiheit, den eigenen Schwerpunkt flexibel zu verlagern. Neben Mentoring-Jungkollegen zählt ein sicherheitsbewusster Ansatz, bei dem Network Policies und Data Governance von Tag eins mitgedacht werden. Ein formales Studium ist ausdrücklich nicht Voraussetzung – entscheidend sind fundierte Praxiserfahrung im produktiven Kubernetes-Betrieb und die Fähigkeit, komplexe Technik auch nicht-technischen Stakeholdern verständlich zu machen.
Benefits und Qualifikationen
- Mentoring-Jungkollegen
- Flexibler Technologie-Schwerpunkt-Wechsel
- Keine feste Bildungsanforderung (Studium oder Ausbildung nebensächlich)
- KI-Tools im Arbeitsalltag
- Security-by-Design-Ansatz
Stellenausschreibung
Bei inovex GmbH in Karlsruhe gestaltest du als Cloud Engineer die moderne Data- und AI-Infrastruktur: Du orchestrierst GPU-Cluster, strukturierst Datenplattformen und automatisierst Pipelines für effizientes Modell-Training sowie den stabilen Betrieb von Inferenz-Schnittstellen.
Du konzipierst Datenplattformen von der Storage-Architektur über Lakehouse-Formate bis zur Integration von Orchestrierung und Streaming-Komponenten. Tools wie Airflow, Spark on Kubernetes oder Ray setzt du auf, verknüpfst sie miteinander und stellst sicher, dass Data- und ML-Workflows zuverlässig in Produktion laufen. Infrastructure-as-Code und GitOps sind dein Standard – bei sensiblen Datenprodukten baust du Sicherheit von Anfang an ein, von Network Policies bis zu den Anforderungen der Data Governance. Monitoring, Incident-Handling und GPU-Kapazitätsplanung liegen in deiner Verantwortung.
Technologiestack in unseren Projekten:
AWS, Azure, Google Cloud, StackIT, Kubernetes
Terraform, ArgoCD, Helm, Cilium, Kyverno
Airflow, Spark, Kafka, Ray, Kueue
Databricks, Snowflake, dbt, IcebergS3, PostgreSQL, pgvector, MLflow, vLLM, KServe
Prometheus, Grafana, OpenTelemetry, Python, Go
Deinen technologischen Schwerpunkt kannst du jederzeit verlagern. Als Expert:in im Engineering-Bereich unterstützt du zudem jüngere Kolleg:innen durch Mentoring.
Wer gut zu uns passt
Ob Studium oder Ausbildung im IT-Bereich – für uns zählt vor allem dein fachliches Können und deine Persönlichkeit:
- Fundierte Kubernetes-Erfahrung im produktiven Betrieb und tiefgehende Kenntnisse in einem der großen Cloud-Provider (AWS, Azure, Google Cloud, StackIT).
- Infrastructure-as-Code setzt du routiniert ein. Du verstehst, wie Storage-Architekturen für unterschiedliche Workloads ausgelegt werden.
- Erfahrung mit Workflow-Orchestrierung, Streaming, GPU-Scheduling, Model Serving und Lakehouse-Plattformen – oder die Motivation, dich in diese Bereiche einzuarbeiten.
- Netzwerk-Härtung und Security-Best-Practices denkst du von Anfang an mit, nicht als nachgelagerten Schritt.
- KI-Tools gehören zu deinem Arbeitsalltag: Code-Assistenten und KI-basierte Automatisierung nutzt du selbstverständlich, etwa beim Aufsetzen von Terraform-Modulen oder beim Optimieren von GPU-Workload-Konfigurationen.
- Komplexe technische Zusammenhänge vermittelst du auch nicht-technischen Ansprechpartner:innen verständlich. Sehr gute Deutschkenntnisse (mind. C1) und gute Englischkenntnisse runden dein Profil ab.
Arbeitsort: 76131 Karlsruhe, Baden