NVIDIA
NVIDIA
NVIDIA udvikler teknologier til accelereret databehandling og kunstig intelligens, som anvendes inden for gaming, datacentre, cloud computing, sundhedspleje, produktion, bilindustrien og robotteknologi. Virksomhedens arbejde omfatter grafikprocessorer, AI-platforme, simulering og branchespecifikke løsninger, herunder NVIDIA Omniverse til samarbejdsbaserede 3D-arbejdsgange, NVIDIA DRIVE til udvikling af autonome køretøjer og NVIDIA Clara til sundhedsapplikationer. Virksomheden samler store tekniske teams, der arbejder med den infrastruktur og software, som understøtter avanceret databehandling, simulering og AI-drevet analyse.

Senior softwareingeniør inden for distribuerede systemer og EDA-infrastruktur

Byg pålidelig automatisering og platformstjenester til NVIDIAs infrastruktur til elektronisk designautomation. Driv store GPU- og CPU-computermiljøer gennem systemer til planlægning, overvågning, diagnosticering og gendannelse.

Beskrivelse

  • Skab platforme, der automatiserer klargøring, konfiguration, drift og livscyklusstyring af storskala GPU- og CPU-computerinfrastruktur
  • Udvikl funktioner til overvågning, systemtilstand og afhjælpning, der styrker pålideligheden, tilgængeligheden og udnyttelsen af EDA-computermiljøer
  • Automatiser hardwareimplementering, opsætning af operativsystemer, opdateringer af firmware og software, klyngeregistrering samt gendannelsesprocedurer
  • Byg pålidelige tjenester og arbejdsgange, der forbinder arbejdsbelastningsplanlæggere med platforme til infrastrukturstyring og observability
  • Analyser hardwarediagnostik, operativsystemsignaler, planlægningsoplysninger samt netværks- og lagringstelemetri for at diagnosticere fejl og gendanne systemer, der ikke fungerer korrekt
  • Samarbejd med teams inden for EDA, infrastruktur, netværk, lagring og hardwareudvikling om at levere skalerbare platforme til kritiske chipdesignarbejdsbelastninger
  • Bidrag til hændelseshåndtering, rodårsagsanalyser, kapacitetsplanlægning og løbende forbedringer af produktionstjenester

Krav

  • Mindst fem års erfaring med software- eller infrastrukturingeniørarbejde, der understøtter storskala produktionssystemer
  • Bachelorgrad i datalogi, ingeniørvidenskab, fysik, matematik eller et beslægtet område eller tilsvarende praktisk erfaring
  • Stærke programmeringsevner i Go eller Python
  • Solid forståelse af datastrukturer, algoritmer, test og principper for softwaredesign
  • Erfaring med at skabe automatisering til distribuerede systemer og omfattende Linux-baserede computermiljøer
  • Forståelse af ydeevne, sikkerhed, pålidelighed, fejltolerance, tilstandsstyring og datakonsistens i komplekse systemer
  • Erfaring med infrastrukturautomatisering, softwarelevering, observability og driftsmæssig gendannelse
  • Gode kommunikationsevner og evnen til at samarbejde på tværs af teams, organisationer og geografiske regioner
  • Erfaring med storskala EDA- eller højtydende comput infrastruktur er en fordel
  • Indgående kendskab til Linux, GPU- og CPU-serverarkitektur, netværk, lagring og livscyklusstyring af bare-metal-systemer er en fordel
  • Praktisk erfaring med Slurm, LSF, Kubernetes eller Bright Cluster Manager er en fordel
  • Erfaring med support af EDA-applikationer, licensstyringsplatforme, batcharbejdsbelastninger med højt gennemløb eller halvlederdesignprocesser er en fordel
  • Erfaring med at udvikle automatiserede sundhedstjek, fejlretningsprocedurer, processer til opgradering af firmware og operativsystemer eller systemer til nodeklargøring er en fordel
  • Erfaring med drift af infrastruktur på tværs af flere datacentre eller forskellige hardwaremiljøer er en fordel

Fordele

  • Aktier
  • Fordele

Relaterede job

Cornell University

Vicedirektør for virksomhedssamarbejde og arbejdsgiverrelationer

Cornell University

Opbyg branchepartnerskaber for Cornell Duffield Engineering ved at forbinde fakultetet med virksomhedssamarbejdspartnere. Koordinér arbejdsgiverkontakt, rekrutteringsveje, forskningssponsorater og samarbejde på tværs af campus.

Åbn