Designworks Talent LLC
Designworks Talent LLC
Designworks Talent LLC est un cabinet de recrutement et de conseil en talents qui accompagne des startups à forte croissance et des entreprises internationales. Fondée en 2009, l’entreprise associe des recruteurs expérimentés à des outils alimentés par l’intelligence artificielle afin de favoriser des recrutements plus rapides et mieux ciblés. Ses activités couvrent les recherches de profils de bout en bout, le recrutement par projet et les modèles flexibles à la demande, ainsi que la stratégie de recrutement évolutive, les opérations de recrutement, la direction de l’acquisition des talents en entreprise, la recherche de candidats fondée sur les données et l’expérience candidat. L’approche de l’équipe vise à fournir aux organisations un accompagnement adaptable à mesure que leurs besoins de recrutement évoluent.

Ingénieur principal en kernels de performance GPU (hybride)

Dirigez l’optimisation des kernels GPU pour une plateforme cloud d’infrastructure d’IA, en améliorant l’utilisation, la latence, le débit et l’évolutivité. Travaillez sur des charges d’entraînement et d’inférence afin de renforcer les performances de l’ensemble du parc de GPU.

Description

  • Analyser et optimiser les kernels GPU afin d’augmenter l’utilisation et d’améliorer les performances et la latence.
  • Diagnostiquer et éliminer les goulets d’étranglement du plan de données dans des charges de travail d’IA à grande échelle.
  • Régler les charges de travail critiques pour les performances dans des environnements d’entraînement et d’inférence.
  • Collaborer avec les équipes d’infrastructure d’IA, de machine learning et d’ingénierie des plateformes afin d’optimiser le comportement du système en fonction des caractéristiques des charges de travail.
  • Créer des approches de benchmarking et des pratiques de mesure des performances pour l’infrastructure GPU.
  • Évaluer les nouveaux matériels GPU, les outils de profilage et les méthodes d’optimisation à mesure que les plateformes évoluent.
  • Faire progresser les pratiques d’ingénierie qui améliorent l’efficacité, l’évolutivité et la fiabilité du parc de GPU.
  • Améliorer la couche de performance qui soutient l’infrastructure d’IA de nouvelle génération.

Exigences

  • Expérience significative dans le développement et l’optimisation de kernels GPU avec CUDA, ROCm ou des frameworks comparables de programmation GPU.
  • Expérience avérée dans l’amélioration de l’utilisation des GPU, la réduction de la latence ou l’augmentation du débit pour des charges de travail d’IA en production.
  • Connaissance approfondie de l’architecture GPU, des hiérarchies mémoire, du calcul parallèle et du chemin entre le code applicatif et l’exécution matérielle.
  • Expérience du profilage et du débogage de problèmes de performance dans des systèmes complexes d’IA ou de calcul distribué.
  • Capacité à diriger de manière autonome des initiatives techniquement complexes et à fournir des solutions dans un environnement d’ingénierie dynamique.
  • Solide formation en programmation système et approche orientée ingénierie des performances.
  • Souhaité : expérience dans l’optimisation de charges de travail pour les architectures GPU NVIDIA et AMD.
  • Souhaité : expérience des compilateurs GPU, de l’optimisation du runtime ou des performances des systèmes bas niveau.
  • Souhaité : contributions à des projets open source de performance GPU, à des outils de compilation ou à l’optimisation de systèmes d’IA.
  • Souhaité : expérience de l’entraînement d’IA à grande échelle, des plateformes d’inférence, du HPC ou de l’infrastructure GPU cloud.
  • Souhaité : familiarité avec Nsight Systems, Nsight Compute, les outils de profilage ROCm ou des technologies comparables.
  • Une autorisation de travail aux États-Unis est requise.
  • Le parrainage de visa n’est actuellement pas disponible ; les employés doivent travailler au bureau au moins trois jours par semaine une fois le bureau permanent établi.
  • avantages ?

Avantages

  • Les postes éligibles peuvent proposer des augmentations au mérite, des primes annuelles et des incitations à long terme liées aux performances individuelles.
  • Couverture médicale, dentaire et optique pour les employés basés aux États-Unis.
  • Plan 401(k) avec abondement de l’entreprise.
  • Jours fériés payés selon le calendrier de l’entreprise.
  • Organisation de travail hybride.

Offres similaires

4M Analytics

Ingénieur senior en algorithmes de vision par ordinateur

4M Analytics

Développez des systèmes de vision par ordinateur et d’apprentissage automatique pour la plateforme de cartographie des réseaux souterrains de 4M Analytics. Pilotez les algorithmes de la recherche à la production avec les équipes d’ingénierie des données et produit.

Ouvrir
Joom

Responsable de la réussite client grands comptes, Brésil (à distance)

Joom

Pilotez les renouvellements, la fidélisation et le développement des comptes clients grands comptes de JoomPulse. Transformez les analyses de Mercado Livre et Shopee en recommandations concrètes pour les vendeurs sur les marketplaces.

Ouvrir
Terumo Medical Corporation

Responsable régional des ventes, Terumo Interventional Systems

Terumo Medical Corporation

Pilotez les ventes de dispositifs médicaux dans une région du centre-nord du New Jersey, en encadrant les équipes de terrain et les relations avec les hôpitaux. Développez le chiffre d’affaires régional, les performances commerciales et la promotion conforme des produits Terumo Interventional Systems.

Ouvrir
Claroty

Ingénieur en automatisation QA

Claroty

Développez l’automatisation des API et de l’interface utilisateur ainsi que des contrôles qualité CI/CD pour la plateforme de sécurité cyberphysique de Claroty. Contribuez à protéger les infrastructures critiques grâce à des tests fiables.

Ouvrir