NVIDIA
NVIDIA
NVIDIA sviluppa tecnologie di calcolo accelerato e intelligenza artificiale utilizzate nei videogiochi, nei data center, nel cloud computing, nell’assistenza sanitaria, nella produzione, nel settore automobilistico e nella robotica. Le sue attività comprendono unità di elaborazione grafica, piattaforme di IA, simulazione e soluzioni specifiche per diversi settori, tra cui NVIDIA Omniverse per flussi di lavoro collaborativi in 3D, NVIDIA DRIVE per lo sviluppo di veicoli autonomi e NVIDIA Clara per le applicazioni sanitarie. L’azienda riunisce grandi team tecnici impegnati nello sviluppo dell’infrastruttura e del software che supportano il calcolo avanzato, la simulazione e l’analisi basata sull’IA.

Ingegnere senior del software di storage – DGX Cloud

Guida il software di storage per l’infrastruttura di IA di NVIDIA, con particolare attenzione ai file system distribuiti open source e allo storage a oggetti. Diagnostica i problemi dei cluster GPU su larga scala e stabilisce standard per prestazioni, durabilità e ottimizzazione.

Descrizione

  • Sviluppare file system paralleli e distribuiti open source e storage a oggetti distribuito.
  • Contribuire con correzioni e funzionalità al progetto principale collaborando con le community e i maintainer.
  • Scrivere e revisionare codice di produzione come responsabile tecnico operativo del software di storage.
  • Ispezionare il codice del kernel, di NFS, NVMe-oF e SPDK per diagnosticare difetti software.
  • Prendere le decisioni tecniche finali sulle consegne di storage utilizzando obiettivi misurabili.
  • Eseguire il triage, risolvere e identificare le cause principali di problemi complessi di storage in cluster GPU di grandissime dimensioni.
  • Analizzare le prestazioni di I/O e metadati, la corruzione dei dati e il comportamento di ripristino.
  • Valutare architettura, funzionalità, prestazioni e durabilità dello storage.
  • Condurre test di scalabilità, benchmark ed esercitazioni di ripristino.
  • Qualificare le nuove build rispetto a obiettivi definiti di prestazioni e durabilità.
  • Stabilire e raccomandare pratiche di configurazione, ottimizzazione e gestione operativa per file system ad alte prestazioni su infrastrutture GPU.
  • Aiutare operatori e clienti interni a implementare le linee guida sullo storage.
  • Collaborare con i team di training, inferenza, calcolo accelerato, SRE, operations, networking e sicurezza.
  • Collaborare con provider cloud, operatori neocloud e fornitori di storage su architetture condivise.
  • Applicare moderni strumenti di programmazione con IA e strumenti agentici per accelerare sviluppo, debug, validazione e operations.

Requisiti

  • Laurea, laurea magistrale o dottorato in Informatica, Ingegneria Elettrica o disciplina correlata, oppure esperienza equivalente.
  • Oltre 12 anni di esperienza diretta nell’ingegneria del software di storage.
  • Esperienza approfondita con un file system parallelo o distribuito ad alte prestazioni operativo su scala multi-petabyte.
  • Comprovata esperienza di contributi a progetti open source di file system distribuiti o paralleli.
  • Esperienza pratica nello sviluppo e nella revisione di codice di produzione, nell’ispezione del codice sorgente di file system, kernel, NVMe-oF o SPDK e nell’esecuzione di test di scalabilità o esercitazioni di ripristino.
  • Esperienza nella diagnosi e risoluzione di problemi di storage in grandi cluster GPU o HPC, inclusa l’analisi delle prestazioni di I/O e metadati.
  • Solida conoscenza di almeno un linguaggio di sistema: C, C++, Rust o Go.
  • Competenza in Python.
  • Conoscenza operativa degli stack di storage e networking del kernel Linux, inclusi block layer, RDMA, RoCE, InfiniBand, NVMe, page cache, VFS e multipath.
  • Solida conoscenza delle tecnologie di object storage come S3 e Swift.
  • Solida conoscenza delle tecnologie di block storage come NVMe-oF e iSCSI.
  • Eccellenti capacità di comunicazione scritta e orale.
  • Capacità di operare in un ambiente di produzione 24/7.
  • Approccio all’ingegneria e alle operations orientato innanzitutto alla sicurezza.
  • Esperienza nella manutenzione o in contributi continuativi a progetti pubblici ampiamente utilizzati.
  • Esperienza nella progettazione o gestione di storage per il training o l’inferenza dell’IA su scala GPU molto grande.
  • Esperienza nello sviluppo del kernel o di file system, nella scalabilità dei metadati, nel posizionamento dei dati, nel ripristino dai guasti o in sistemi HSM o equivalenti.
  • Esperienza con Kubernetes e lo sviluppo di driver CSI per lo storage.
  • Esperienza pratica nell’ottimizzazione delle prestazioni con SPDK, libfabric o FUSE.

Benefit

  • Compenso azionario
  • Benefit per i dipendenti

Offerte correlate

Inkster GmbH

Responsabile marketing, ibrido ad Amburgo

Inkster GmbH

Guida lo sviluppo creativo delle campagne, i contenuti per i social media e l’analisi delle performance in Inkster, fornitore europeo di tatuaggi temporanei a base di frutta. Sperimenta e ottimizza i creativi di marketing usando gli insight delle campagne e le tendenze di mercato.

Apri
Kreato Global | BPO and Language Solutions

Interprete da remoto inglese-spagnolo OPI/VRI

Kreato Global | BPO and Language Solutions

Interpreta da remoto tra persone anglofone e ispanofone in ambito medico, finanziario, dei servizi sociali e dell’assistenza clienti. Fornisci supporto linguistico a Kreato Global in tutta l’America Latina.

Apri
Taurus SA

Tecnico IT e specialista del supporto clienti

Taurus SA
51 – 200 Dipendenti
CriptoFintechServizi bancari

Fornisci supporto agli utenti aziendali e ai clienti esterni di Taurus in una fintech regolamentata che opera nel settore degli asset digitali. Gestisci l’infrastruttura Azure, il supporto agli endpoint, la classificazione dei ticket e la risoluzione dei problemi dei clienti.

Apri
RecruitGo

Assistente esecutivo da remoto, prospezione e marketing — Filippine

RecruitGo
51 – 200 Dipendenti
ConsulenzaLogisticaMarketing

Fornisce supporto amministrativo, gestisce il CRM e si occupa di prospezione e marketing per RecruitGo, un’azienda di Employer of Record che serve clienti globali con talenti provenienti dai mercati emergenti. Supporta due clienti rivolti al Regno Unito nelle attività amministrative quotidiane e nelle campagne creative.

Apri