NVIDIA
NVIDIA
NVIDIA razvija tehnologije pospešenega računalništva in umetne inteligence, ki se uporabljajo v igrah, podatkovnih centrih, računalništvu v oblaku, zdravstvu, proizvodnji, avtomobilski industriji in robotiki. Njeno delo obsega grafične procesne enote, platforme umetne inteligence, simulacije in rešitve za posamezne panoge, vključno z NVIDIA Omniverse za sodelovalne 3D-delovne tokove, NVIDIA DRIVE za razvoj avtonomnih vozil in NVIDIA Clara za zdravstvene aplikacije. Podjetje združuje velike tehnične ekipe, ki delajo na infrastrukturi in programski opremi za napredno računalništvo, simulacije in analitiko, ki jo poganja umetna inteligenca.

Višji programski inženir za shranjevanje – DGX Cloud

Vodili boste razvoj programske opreme za shranjevanje za infrastrukturo NVIDIA AI s poudarkom na odprtokodnih porazdeljenih datotečnih sistemih in objektnih shrambah. Diagnosticirali boste težave velikih gručenih sistemov GPU ter vzpostavljali standarde za zmogljivost, vzdržljivost in nastavitve.

Opis

  • Razvijati odprtokodne vzporedne in porazdeljene datotečne sisteme ter porazdeljene objektne shrambe.
  • Prispevati popravke in funkcionalnosti v nadrejene projekte ter sodelovati s projektnimi skupnostmi in vzdrževalci.
  • Pisati in pregledovati produkcijsko kodo kot praktično usmerjeni vodja programske opreme za shranjevanje.
  • Pregledovati kodo jedra, NFS, NVMe-oF in SPDK za diagnosticiranje napak v programski opremi.
  • Sprejemati končne tehnične odločitve o rešitvah za shranjevanje na podlagi merljivih ciljev.
  • Razvrščati, odpravljati in ugotavljati temeljne vzroke zapletenih težav s shranjevanjem v zelo velikih gručah GPU.
  • Analizirati zmogljivost I/O in metapodatkov, poškodbe podatkov ter vedenje pri obnovi.
  • Ocenjevati arhitekturo, zmogljivosti, učinkovitost in vzdržljivost shranjevanja.
  • Izvajati testiranje v velikem obsegu, primerjalne teste in vaje obnovitve.
  • Preverjati nove gradnje glede na opredeljene cilje zmogljivosti in vzdržljivosti.
  • Vzpostavljati in priporočati prakse konfiguriranja, nastavljanja in delovanja visokozmogljivih datotečnih sistemov na infrastrukturi GPU.
  • Pomagati operaterjem in notranjim strankam pri izvajanju smernic za shranjevanje.
  • Sodelovati z ekipami za učenje, sklepanje, pospešeno računalništvo, SRE, operacije, omrežja in varnost.
  • Sodelovati z oblačnimi ponudniki, operaterji neoblakov in dobavitelji shranjevanja pri skupni arhitekturi.
  • Uporabljati sodobna orodja AI za programiranje in agentska orodja za pospeševanje razvoja, odpravljanja napak, preverjanja in operacij.

Zahteve

  • Diploma dodiplomskega, magistrskega ali doktorskega študija računalništva, elektrotehnike ali sorodnega področja oziroma enakovredne izkušnje.
  • Več kot 12 let neposrednih izkušenj s programskim inženirstvom za shranjevanje.
  • Obsežne izkušnje z visokozmogljivim vzporednim ali porazdeljenim datotečnim sistemom, ki deluje v večpetabajtnem obsegu.
  • Dokazane izkušnje s prispevanjem k odprtokodnim projektom porazdeljenih ali vzporednih datotečnih sistemov.
  • Praktične izkušnje z razvojem in pregledovanjem produkcijske kode, pregledovanjem izvorne kode datotečnih sistemov, jedra, NVMe-oF ali SPDK ter izvajanjem obsežnih testov ali vaj obnovitve.
  • Izkušnje z diagnosticiranjem in reševanjem težav s shranjevanjem v velikih gručah GPU ali HPC, vključno z analizo zmogljivosti I/O in metapodatkov.
  • Dobro obvladanje vsaj enega sistemskega jezika: C, C++, Rust ali Go.
  • Dobro znanje Pythona.
  • Delovno poznavanje skladov za shranjevanje in omrežja v jedru Linuxa, vključno z blokovno plastjo, RDMA, RoCE, InfiniBand, NVMe, predpomnilnikom strani, VFS in multipath.
  • Dobro razumevanje tehnologij objektnega shranjevanja, kot sta S3 in Swift.
  • Dobro razumevanje tehnologij blokovnega shranjevanja, kot sta NVMe-oF in iSCSI.
  • Odlične pisne in ustne komunikacijske sposobnosti.
  • Sposobnost dela v produkcijskem okolju, ki deluje 24/7.
  • Varnostno usmerjen pristop k inženirstvu in operacijam.
  • Izkušnje z vzdrževanjem ali trajnim prispevanjem k široko uporabljenim javnim projektom.
  • Izkušnje z načrtovanjem ali upravljanjem shranjevanja za učenje ali sklepanje AI v zelo velikem obsegu GPU.
  • Izkušnje z razvojem jedra ali datotečnih sistemov, razširljivostjo metapodatkov, umeščanjem podatkov, obnovo po napakah ali sistemi HSM oziroma enakovrednimi sistemi.
  • Izkušnje s Kubernetesom in razvojem gonilnikov CSI za shranjevanje.
  • Praktične izkušnje z optimizacijo zmogljivosti s SPDK, libfabric ali FUSE.

Ugodnosti

  • Lastniško nadomestilo
  • Ugodnosti za zaposlene

Sorodna delovna mesta

Kreato Global | BPO and Language Solutions

Remote English-Spanish OPI/VRI Interpreter

Kreato Global | BPO and Language Solutions

Interpret remotely between English- and Spanish-speaking people in medical, financial, social service, and customer care settings. Provide language support for Kreato Global across Latin America.

Odpri
RecruitGo

Remote Executive Assistant, Outreach and Marketing — Philippines

RecruitGo
51 – 200 Zaposleni
LogistikaSvetovanjeTrženje

Handle administrative support, CRM, outreach, and marketing for RecruitGo, an Employer of Record serving global clients with talent from emerging markets. Support two UK-facing clients with day-to-day administration and creative campaigns.

Odpri