NVIDIA
NVIDIA
NVIDIA entwickelt Technologien für beschleunigtes Rechnen und künstliche Intelligenz, die in den Bereichen Gaming, Rechenzentren, Cloud Computing, Gesundheitswesen, Fertigung, Automobilindustrie und Robotik eingesetzt werden. Das Unternehmen arbeitet an Grafikprozessoren, KI-Plattformen, Simulationslösungen und branchenspezifischen Anwendungen, darunter NVIDIA Omniverse für kollaborative 3D-Workflows, NVIDIA DRIVE für die Entwicklung autonomer Fahrzeuge und NVIDIA Clara für Anwendungen im Gesundheitswesen. NVIDIA vereint große technische Teams, die an der Infrastruktur und Software für fortschrittliches Rechnen, Simulationen und KI-gestützte Analysen arbeiten.

Senior Manager Developer Relations, NVIDIA Dynamo KI-Inferenz

Baue das Entwicklerökosystem für NVIDIA Dynamo aus, ein Open-Source-Framework für verteilte KI-Inferenz. Erstelle technische Ressourcen, unterstütze Entwickler und gestalte Produktprioritäten für Inferenz anhand von Community-Feedback.

Beschreibung

  • Baue das Entwicklerökosystem für NVIDIA Dynamo aus, NVIDIA’s Open-Source-Framework für verteilte KI-Inferenz.
  • Arbeite mit vLLM, SGLang, Mooncake, llm-d und weiteren Inferenzprojekten durch gemeinsame Demos, Integrationsleitfäden, Beiträge zu Upstream-Projekten und Community-Programme.
  • Erstelle ausführbare Demos, Beispielcode, technische Dokumentation und Videos, die Dynamos modulares Ökosystem und seinen Leistungsbeitrag für Rechenzentren erläutern.
  • Bringe Entwicklerfeedback bei NVIDIA ein, indem du es in technische und Produktanforderungen übersetzt, Prioritäten beeinflusst und Entwicklern Fortschritte vermittelst.
  • Vertrete NVIDIA nach außen mit technischen Vorträgen, Live-Demos, Workshops und Sprechstunden.
  • Unterstütze Entwickler bei der Fehlersuche in realen Deployments und bei Beiträgen zu Projekten.
  • Miss wiederholte Teilnahme, das Wachstum der Contributor-Community und die Zahl gelöster Probleme.
  • Erstelle technische Ressourcen und organisiere regelmäßige Meetups sowie praktische Workshops mit Inferenz-Communities.
  • Leite aus Entwicklerfeedback, Entscheidungen bei Serving-Stacks und neuen Inferenz-Workloads Empfehlungen für Produkt-Roadmaps, Investitionen ins Ökosystem und Partnerprioritäten ab.

Anforderungen

  • Abschluss in Informatik, Ingenieurwesen oder einem verwandten Fachgebiet oder gleichwertige Berufserfahrung.
  • Mindestens 8 Jahre Berufserfahrung in der Technologiebranche, davon mindestens 4 Jahre mit KI-/ML-Infrastruktur, Model Serving oder verteilten Systemen.
  • Erfahrung mit der Leitung von Entwickler- oder Partnerprogrammen über die Bereiche Engineering, Produkt, Vertrieb, Marketing und Recht hinweg.
  • Praktische Erfahrung mit dem Bereitstellen und Verwalten von Model-Serving-Systemen, einschließlich der Konfiguration von Deployments, der Überwachung von Latenz und Durchsatz, der Skalierung von Kapazitäten und der Behebung von Zuverlässigkeits- oder Leistungsproblemen.
  • Vertrautheit mit Inferenz-Engines wie vLLM, SGLang oder TensorRT-LLM.
  • Vertrautheit mit verteilten Serving-Stacks wie Dynamo oder llm-d.
  • Erfahrung mit dem Bereitstellen und Betreiben von Inferenz-Workloads auf Kubernetes.
  • Erfahrung in der Zusammenarbeit mit Open-Source-Maintainern über Issues, Pull Requests und Design-Diskussionen.
  • Erfahrung darin, Entwicklerfeedback in technische Prioritäten zu überführen.
  • Portfolio mit technischen Leitfäden, funktionierenden Demos, Vorträgen oder Workshops, die du selbst durchgeführt hast, um Entwicklern bei praktischen Problemen zu helfen.
  • Fähigkeit, Inferenzarchitektur und Leistungskompromisse einem Publikum von Ingenieuren bis hin zu Führungskräften zu erläutern.
  • Nachweis, extern das Vertrauen von Entwicklern zu gewinnen und intern Entscheidungen zu beeinflussen.
  • Erfahrung in der direkten Zusammenarbeit mit den Communities von vLLM, SGLang oder Mooncake.
  • Fähigkeit, Muster in Entwicklerfeedback, Entscheidungen bei Serving-Stacks und neuen Inferenz-Workloads zu erkennen und daraus Empfehlungen abzuleiten.

Zusatzleistungen

  • Aktienanteile.
  • Mitarbeiterleistungen.
  • Informationen zu den Leistungen für NVIDIA-Mitarbeitende und ihre Familien findest du unter www.nvidiabenefits.com/.

Ähnliche Stellen

Knowtion Health

Remote Manager für Talentgewinnung

Knowtion Health

Verantwortet Recruiting-Systeme, Stellenanforderungen, Analysen und die Verwaltung externer Arbeitskräfte bei Knowtion Health. Unterstützt skalierbare Einstellungsprozesse für ein wachsendes Gesundheitsunternehmen.

Öffnen
Napco National

Einkaufskoordinator/in, Saudi-Arabien (Remote)

Napco National

Koordination der Einkaufsabläufe für ein Fertigungsunternehmen in Saudi-Arabien – von Bestellungen und Lieferungen bis zu Zollunterlagen und Materialtransfers. Unterstützung bei der Zollabfertigung, Rechnungsbearbeitung, Lieferantenreklamationen und der Verlängerung von Produktzertifikaten.

Öffnen
4M Analytics

Senior Engineer für Computer-Vision-Algorithmen

4M Analytics

Entwickle Computer-Vision- und Machine-Learning-Systeme für die Plattform zur Kartierung unterirdischer Versorgungsleitungen von 4M Analytics. Verantworte Algorithmen von der Forschung bis zum Produktiveinsatz und arbeite dabei mit Datenengineering- und Produktteams zusammen.

Öffnen
Terumo Medical Corporation

Regionalmanager Vertrieb für Terumo Interventional Systems

Terumo Medical Corporation

Leiten Sie den Vertrieb medizinischer Produkte in einer Region im Norden von Zentral-New-Jersey und verantworten Sie Außendienstteams sowie die Beziehungen zu Krankenhäusern. Steigern Sie den regionalen Umsatz und die Vertriebsleistung und sorgen Sie für eine regelkonforme Vermarktung der Produkte von Terumo Interventional Systems.

Öffnen
Claroty

QA-Automatisierungsingenieur

Claroty

Entwickle API- und UI-Automatisierungen sowie Qualitätsprüfungen in CI/CD-Pipelines für Clarotys Plattform für die Sicherheit cyberphysischer Systeme. Mit zuverlässigen Tests trägst du zum Schutz kritischer Infrastrukturen bei.

Öffnen