NVIDIA
NVIDIA
NVIDIA utvecklar tekniker för accelererad databehandling och artificiell intelligens som används inom spel, datacenter, molnbaserad databehandling, sjukvård, tillverkning, fordonsindustrin och robotik. Företagets arbete omfattar grafikprocessorer, AI-plattformar, simulering och branschspecifika lösningar, däribland NVIDIA Omniverse för samarbetsinriktade 3D-arbetsflöden, NVIDIA DRIVE för utveckling av autonoma fordon och NVIDIA Clara för tillämpningar inom sjukvården. Företaget samlar stora tekniska team som arbetar med den infrastruktur och programvara som stöder avancerad databehandling, simulering och AI-baserad analys.

Senior systemprogramvaruingenjör, Kubernetes-skala – NVIDIA DGX Cloud

Skala och optimera Kubernetes-infrastruktur för NVIDIA DGX Cloud och distribuerade AI-arbetsbelastningar. Bygg system för prestandatester, övervakning, analys och CI/CD för accelererad databehandling i stor skala.

Beskrivning

  • Ansvara för end-to-end-analys av prestanda och skalbarhet i NVIDIA DGX Clouds programvarustack, inklusive Kubernetes kontroll- och dataplan, GPU Operator, Network Operator, DCGM, NIM och distribuerad inferenstjänst.
  • Samarbeta med AI-forskare, utvecklare och kunder för att skapa automatiserade tester som modellerar verkliga arbetsbelastningar.
  • Analysera prestanda- och skalbarhetsproblem i komplexa distribuerade system och fastställa deras grundorsaker.
  • Skapa verktyg för övervakning, rapportering och analys av programvaru-, GPU- och CPU-prestanda samt skalning.
  • Prioritera, felsöka och lösa problem vid drift av Kubernetes-kluster i extremt stor skala.
  • Utveckla och underhålla kontinuerliga prestanda- och skalbarhetstester genom en modern CI/CD-pipeline.
  • Dokumentera forskning, metoder och resultat samt presentera dem vid interna och externa evenemang som KubeCon och GTC.
  • Delta i Kubernetes-, CNCF- och NVIDIAs open source-communities för att utvärdera prestanda för AI-arbetsbelastningar och bidra till utformningen av tekniska beslut.

Krav

  • Minst åtta års erfarenhet av datorarkitektur, nätverk, lagringssystem eller acceleratorer.
  • Kandidat- eller masterexamen i ingenjörsvetenskap, helst elektroteknik, datorteknik eller datavetenskap, eller motsvarande erfarenhet.
  • Expertkunskaper i Kubernetes och kännedom om relaterade CNCF-projekt.
  • Erfarenhet av storskaliga parallella och distribuerade system baserade på acceleratorer.
  • Expertis inom optimering av prestanda och AI-arbetsbelastningar i storskaliga system.
  • Erfarenhet av prestandamodellering och benchmarking i stor skala.
  • Goda kunskaper i Golang och Python.
  • Erfarenhet av NVIDIAs programvaruekosystem för träning och inferens.
  • Expertis inom minst en publik molninfrastrukturleverantör, exempelvis GCP, AWS, Azure eller OCI.
  • Gedigen driftserfarenhet av en Kubernetes-distribution.
  • Erfarenhet av att skala Kubernetes-kluster till extremt stora antal noder och objekt.
  • Dokumenterad medverkan i open source-communities.
  • Doktorsexamen inom ett relevant område är en särskilt meriterande kvalifikation.
  • Utmärkt kommunikations- och samarbetsförmåga.

Relaterade jobb

CNA Insurance

Specialist inom arbetsskadeersättning

CNA Insurance

Hantera kommersiella arbetsskadeärenden med låg till måttlig komplexitet, från granskning av försäkringsskydd och utredning till reglering och regelefterlevnad.

Öppna
ServiceMaster DSI

Marknadskoordinator

ServiceMaster DSI

Samordna integrerade marknadsföringskampanjer och varumärkesmaterial för ServiceMaster DSI, en franchisekedja inom återställning efter katastrofer. Rollen stödjer digital marknadsföring, trycksaker, leverantörssamarbeten och marknadsaktiviteter på filialerna.

Öppna
Child Trends

Tillfällig rekryterare på distans

Child Trends

Ansvara för rekrytering i stor skala av 40–50 tjänster inom forskning, analys och programverksamhet hos Child Trends under de kommande månaderna. Förbättra rekryteringsflödena i ADP och samordna urval, intervjuer, uppsökande arbete och regelefterlevnad.

Öppna