Mirantis
Mirantis
Mirantis entwickelt cloudnative Infrastruktur- und Container-Management-Software für Organisationen, die Kubernetes-Umgebungen in großem Maßstab aufbauen, absichern und betreiben. Das Portfolio umfasst Mirantis Kubernetes Engine, Mirantis OpenStack for Kubernetes, Mirantis Container Cloud, Mirantis Container Runtime und Mirantis Secure Registry und unterstützt den Clusterbetrieb sowie die Sicherheit der Software-Lieferkette. Darüber hinaus trägt das Unternehmen mit Projekten und Tools wie Lens Desktop, einer Kubernetes-IDE, zum Open-Source-Ökosystem bei und bietet technischen Support für Unternehmen. Mirantis arbeitet mit Organisationen aus den Bereichen Beratung, Gesundheitswesen, Logistik, öffentliche Dienstleistungen, Finanzdienstleistungen und technologieorientierte Branchen zusammen, die moderne Cloud-Infrastrukturen einsetzen.

Senior Site Reliability Engineer (SRE)

Senior Site Reliability Engineer zur Unterstützung von Mirantis bei der Bereitstellung von Kubernetes-Infrastrukturen auf NVIDIA-Basis. Im Mittelpunkt stehen zuverlässige, sichere und skalierbare Cloud- und KI-Operationen.

Beschreibung

  • Unterstützung bei der Entwicklung, dem Aufbau und dem Betrieb moderner cloudbasierter KI-Plattformen im CNCF-Ökosystem, einschließlich Kubernetes
  • Bereitstellung von KI-Infrastrukturen auf NVIDIA-zertifizierter Hardware gemäß genehmigten Architektur- und Implementierungsplänen
  • Sicherstellung zuverlässiger, sicherer und leistungsstarker Containerplattformen
  • Coaching von Kolleginnen und Kollegen sowie Mirantis-Kunden bei der Bereitstellung zuverlässiger Software und Services
  • Zusammenarbeit mit international verteilten Teams zur Bearbeitung technischer Probleme und Verbesserung von Prozessen
  • Aufbau, Betrieb, Wartung und Diagnose von Cloud- und KI-Infrastrukturen auf Basis von Open-Source-Technologien
  • Einbindung von Stakeholdern zur Erfassung, Klärung und Präzisierung technischer Anforderungen
  • Verbesserung der Plattformeffizienz, Ausfallsicherheit und Skalierbarkeit
  • Untersuchung, Diagnose und Behebung komplexer technischer Probleme
  • Überprüfung von Code zur Einhaltung von Qualitätsstandards in der Softwareentwicklung
  • Verfolgung aktueller Praktiken und Entwicklungen im Cloud-Betrieb und in der Softwarebereitstellung
  • Entwicklung KI-gestützter Automatisierung für den gesamten DevOps-Lebenszyklus, von der Entwicklung bis zur Wartung
  • Wissensvermittlung an Kunden während der Implementierung und Bereitstellung
  • Zusammenarbeit mit Stakeholdern an der technischen Ausrichtung, bei komplexer Problemlösung und bei der reibungslosen Integration von Cloud- und Software-Services

Anforderungen

  • Mindestens fünf Jahre Berufserfahrung im DevOps-Bereich, insbesondere mit Cloud- und Infrastrukturplattformen wie Kubernetes oder OpenStack
  • Erfahrung mit Hochleistungsrechen-, Netzwerk- und Speicherumgebungen in Rechenzentren
  • Erfahrung mit Go sowie praktische Kenntnisse in Sprachen wie Python und JavaScript
  • Sehr gute Kenntnisse verteilter Systeme, von Microservices sowie von Pipelines für Continuous Integration und Continuous Delivery
  • Ausgeprägte Fähigkeiten bei der Fehlerbehebung in Netzwerk- und Speicherhardware und -software, Linux und Kubernetes mit Schwerpunkt auf Leistung und Sicherheit
  • Nachweisliche Fähigkeit, technische Arbeiten zu leiten und mit unterschiedlichen Teams zusammenzuarbeiten
  • Fähigkeit, eigenständig fundierte Entscheidungen zu treffen und dabei mit Kunden sowie unter geringer täglicher Anleitung zu arbeiten
  • Ausgezeichnete schriftliche und mündliche Kommunikationsfähigkeiten in Englisch
  • Ausgeprägte Kommunikationsfähigkeiten im direkten Kundenkontakt
  • Engagement für Innovation, kontinuierliches Lernen und hochwertige Ergebnisse
  • Bereitschaft zu internationalen Reisen bei Bedarf, bis zu 25 Prozent
  • Bachelorabschluss in Informatik oder einem verwandten Fachgebiet oder gleichwertige Berufserfahrung
  • Umfangreiche Erfahrung in der Entwicklung von Netzwerk- oder Speicherarchitekturen
  • Erfahrung mit High-Performance-Computing- oder GPU-Plattformen, einschließlich GPU-Scheduling, MIG oder vGPU, RDMA/RoCE oder InfiniBand, NVLink, DCGM-Zustandsprüfungen, Lebenszyklen von GPU-Treibern und Firmware oder NVIDIA AI Enterprise
  • Aktive Beteiligung an Open Source, etwa durch Beiträge zu Upstream-Projekten oder Konferenzvorträge
  • Erfahrung mit Rancher, OpenShift und VMware

Zusatzleistungen

  • Werde Teil eines etablierten Unternehmens aus dem Silicon Valley mit Schwerpunkt auf Cloud-Infrastruktur
  • Arbeite mit engagierten Kolleginnen und Kollegen zusammen und unterstütze Fortune-500- und Global-2000-Unternehmen bei der Einführung moderner Cloud-Technologien
  • Trage zu fortschrittlicher Open-Source-Innovation bei
  • Arbeite in einem dynamischen Umfeld, das Offenheit, Zusammenarbeit, durchdachtes Eingehen von Risiken und kontinuierliche Entwicklung schätzt
  • Nutze Möglichkeiten zur beruflichen Weiterentwicklung und Weiterbildung
  • Nimm an Konferenzen und Arbeitsgruppen der Branche teil
  • Nimm an Unternehmensveranstaltungen, informellen Treffen, Hackathons und technischen Vorträgen teil
  • Erhalte ein wettbewerbsfähiges Vergütungspaket mit einem umfassenden Leistungspaket

Ähnliche Stellen

Mercor

KI-Sicherheit Red Teamer

Mercor
51 – 200 Mitarbeitende

Mercor sucht eine Fachkraft für Red Teaming im Bereich KI-Sicherheit, die fortgeschrittene KI-Systeme mit adversarialen Prompts auf die Probe stellt. Die Tätigkeit umfasst die Dokumentation von Risiken und die Zusammenarbeit mit Forschenden, um die Sicherheit und Ausrichtung von Modellen zu stärken.

Öffnen
Terumo Medical Corporation

Gebietsleiter Interventionssysteme – Philadelphia

Terumo Medical Corporation

Verantwortung für den Vertrieb von Terumo-Interventionssystemen an Krankenhäuser und ambulante Einrichtungen im Raum Philadelphia. Kundenbeziehungen ausbauen, Eingriffe begleiten, Fachpersonal schulen und Vertriebsziele erreichen.

Öffnen
Cross River

Engineering Manager Cloud und verteilte Systeme – Cross River, Jerusalem

Cross River

Führe und unterstütze Engineers beim Aufbau von Fintech-Diensten und Infrastruktur für Zahlungen, Karten, Kredite und Krypto. In dieser hybriden Rolle in Jerusalem liegt der Schwerpunkt auf cloudnativen Systemen und zuverlässiger Engineering-Umsetzung.

Öffnen