Mirantis
Mirantis
Mirantis udvikler cloudbaseret infrastruktur og software til containeradministration for organisationer, der bygger, sikrer og driver Kubernetes-miljøer i stor skala. Produktporteføljen omfatter Mirantis Kubernetes Engine, Mirantis OpenStack for Kubernetes, Mirantis Container Cloud, Mirantis Container Runtime og Mirantis Secure Registry, som understøtter drift af klynger og sikkerhed i softwareforsyningskæden. Virksomheden bidrager også til open source-økosystemet gennem projekter og værktøjer som Lens Desktop, en Kubernetes-IDE, samt teknisk support til virksomheder. Mirantis arbejder med organisationer inden for rådgivning, sundhedssektoren, logistik, offentlige tjenester, finansielle tjenester og teknologifokuserede brancher, der tager moderne cloudinfrastruktur i brug.

Senior Site Reliability Engineer (SRE)

Senior SRE-rolle med fokus på implementering af NVIDIA-baseret Kubernetes- og cloud-AI-infrastruktur hos Mirantis. Stillingen omfatter driftssikkerhed, sikkerhed, automatisering og kundeleverancer på tværs af distribuerede internationale teams.

Beskrivelse

  • Designe, udvikle, implementere, drive, vedligeholde og fejlfinde open source-løsninger til cloud- og AI-infrastruktur
  • Implementere AI-infrastruktur på NVIDIA-certificeret hardware i overensstemmelse med godkendte arkitektur- og implementeringsdesigns
  • Vedligeholde containerinfrastrukturens driftssikkerhed, sikkerhed og ydeevne
  • Samarbejde med geografisk distribuerede internationale teams om tekniske udfordringer og procesforbedringer
  • Indsamle og kvalificere tekniske krav sammen med interessenter
  • Forbedre systemets ydeevne, driftssikkerhed og skalerbarhed
  • Undersøge, fejlfinde og løse komplekse tekniske problemer
  • Bidrage til code reviews
  • Designe og implementere AI-drevet automatisering gennem hele DevOps-livscyklussen
  • Overføre viden til kunder i leveringsfaserne
  • Være mentor for teammedlemmer og Mirantis-kunder
  • Definere tekniske strategier og integrere cloud- og softwaretjenester problemfrit

Krav

  • Mindst fem års professionel DevOps-erfaring med fokus på cloud- og infrastrukturteknologier som Kubernetes eller OpenStack
  • Erfaring med højtydende datacenterbehandling, netværk og lagring
  • Kendskab til Golang samt praktisk erfaring med Python og JavaScript
  • Stærk forståelse af distribuerede systemer, mikrotjenestearkitektur og CI/CD-pipelines
  • Avancerede problemløsnings- og fejlfindingskompetencer inden for netværk, lagring, Linux og Kubernetes
  • Viden om ydeevneoptimering og sikkerhed
  • Evne til at lede tekniske opgaver og arbejde effektivt sammen med forskellige teams
  • Evne til at udvise selvstændigt skøn i direkte arbejde med kunder
  • Fremragende skriftlige og mundtlige engelskkundskaber
  • Stærke kommunikationsevner i kundekontakt
  • Engagement i innovation, kontinuerlig læring og leverancer af høj kvalitet
  • Villighed til at rejse internationalt og nationalt op til 25 procent
  • Bachelorgrad i datalogi eller et beslægtet område eller tilsvarende erfaring
  • Mindst fem års erfaring med DevOps, softwareudvikling eller en sammenlignelig rolle
  • Foretrukket: erfaring med netværks- eller lagringsarkitektur
  • Foretrukket: erfaring med højtydende databehandling eller GPU-infrastruktur, herunder GPU-planlægning, MIG/vGPU, RDMA/RoCE eller InfiniBand, NVLink, DCGM-sundhedstjek, livscyklus for GPU-drivere og firmware eller NVIDIA AI Enterprise
  • Foretrukket: deltagelse i open source-fællesskaber gennem bidrag til upstream-projekter eller konferencepræsentationer
  • Foretrukket: erfaring med Rancher, OpenShift og VMware

Fordele

  • Muligheder for faglig udvikling og træning
  • Deltagelse i konferencer og arbejdsgrupper
  • Virksomhedsudflugter, fyraftensarrangementer, hackathons og teknologiforedrag
  • Konkurrencedygtig lønpakke med en omfattende fordelspakke
  • Samarbejde med engagerede, dygtige og inspirerende kolleger
  • Arbejde med Fortune 500- og Global 2000-kunder om næste generations cloudteknologier
  • Deltagelse i open source-innovation
  • En energisk kultur med fokus på åbenhed, samarbejde, velovervejet risikotagning og kontinuerlig vækst

Relaterede job

Terumo Medical Corporation

Territoriechef, interventionelle systemer — Philadelphia

Terumo Medical Corporation

Lede salget af Terumo Interventional Systems-produkter til hospitaler og ambulante behandlingssteder i Philadelphiaområdet. Udvikle kundekonti, støtte indgreb, undervise klinikere og nå distriktets salgsmål.

Åbn
Aleph Alpha

Senior AI-forsker, prætræning af grundmodeller — Aleph Alpha, Heidelberg

Aleph Alpha
51 – 200 Medarbejdere
B2BKunstig intelligens

Led arkitekturarbejde og prætræning i stor skala for Aleph Alphas europæiske grundmodeller, og sæt retningen for træningsmetoder på tværs af tusindvis af GPU'er. Byg og forfin PyTorch-træningsopskrifter sammen med det hybride team i Heidelberg.

Åbn