The Home Depot
The Home Depot
The Home Depot ist ein großer Einzelhändler für Heimwerkerbedarf, der Hauseigentümer, Heimwerker und professionelle Bauunternehmer über stationäre Filialen und eine Online-Plattform versorgt. Das Angebot umfasst Baumaterialien, Produkte für die Wohnungs- und Hausverbesserung, Artikel für Rasen und Garten sowie damit verbundene Dienstleistungen. Unterstützt wird dies durch Aktivitäten in den Bereichen Einzelhandel, Bauwesen und Logistik. Das Unternehmen beschäftigt Mitarbeiterinnen und Mitarbeiter in vielen verschiedenen Bereichen und legt Wert auf Kundenservice, die Einbindung der Beschäftigten sowie ein vielfältiges und inklusives Arbeitsumfeld.

Staff Software Engineer, Cloud-Plattformprodukte – Remote

Leiten Sie die Entwicklung und Bereitstellung von Google-Cloud- und GKE-Plattformprodukten für agentische KI-Workloads bei The Home Depot. Verbessern Sie sichere Skalierbarkeit, Zuverlässigkeit, Self-Service für Entwickler und technische Bereitstellungsprozesse.

Beschreibung

  • Verantwortung für Cloud-Plattformprodukte für agentische Workloads – vom ersten Entwurf über die Veröffentlichung bis zum laufenden Betrieb
  • Unklare Initiativen in sequenzierte Arbeitsschritte überführen, die eine planbare, schrittweise und risikoarme Umsetzung ermöglichen
  • Technische Blockaden, Abhängigkeiten und Engpässe bei der Bereitstellung lösen
  • Wiederverwendbare Services, Bibliotheken, Vorlagen, standardisierte Entwicklungswege und Automatisierungen erstellen
  • CI/CD, progressive Bereitstellung, Infrastructure as Code, GitOps, Tests und Release-Prozesse weiterentwickeln
  • KI-gestützte Entwicklung und agentische Engineering-Workflows fördern
  • Produktionscode für komplexe, risikoreiche und kritische Initiativen schreiben
  • Gesundheitsmetriken der Bereitstellung überwachen und zur Verbesserung nutzen
  • Die Nutzung der Plattform durch Dokumentation, Referenzarchitekturen, Self-Service-Workflows und bessere Entwicklererfahrungen steigern
  • Technische Vision, Architektur und langfristige Ausrichtung für Cloud-Plattformprodukte festlegen
  • Architekturprüfungen, Design-Sitzungen und technische Deep Dives leiten
  • Neue Technologien in den Bereichen KI-Infrastruktur, LLM-Gateways, Agentenlaufzeiten, MCP- und Tool-Integration, Model Serving und Orchestrierung bewerten
  • Mit Architektur-, Sicherheits- und Zuverlässigkeitsteams zusammenarbeiten, um Unternehmensstandards zu erfüllen
  • SLOs, Observability, Alarmierung, Runbooks und Bereitschaft für den On-Call-Betrieb etablieren
  • Als technische Eskalationsstelle für komplexe Produktionsvorfälle agieren und Ursachenanalysen leiten
  • Systeme auf Wartbarkeit, Skalierbarkeit, hohe Verfügbarkeit und Kosteneffizienz auslegen
  • Ingenieurinnen und Ingenieure durch Coaching, Designberatung, Code-Reviews und Pairing weiterentwickeln
  • Engineering-Standards stärken und Verantwortung delegieren, um technische Führungskräfte zu entwickeln
  • Communities of Practice für cloudnative Entwicklung, agentische KI und Plattform-Engineering aufbauen

Anforderungen

  • Mindestens 18 Jahre alt sein
  • Eine rechtliche Arbeitsgenehmigung für die Vereinigten Staaten besitzen
  • Fundierte Kenntnisse in einer objektorientierten Programmiersprache nachweisen, vorzugsweise Go
  • Umfangreiche Erfahrung im Entwurf, Aufbau und in der Bereitstellung verteilter cloudnativer Systeme mitbringen
  • Berufserfahrung mit Google Cloud Platform und Kubernetes einschließlich GKE besitzen
  • Architektur, technische Entscheidungen und Bereitstellung über mehrere Anwendungen oder Teams hinweg geleitet haben
  • Mindestens sieben Jahre Berufserfahrung besitzen
  • Einen Bachelorabschluss oder eine gleichwertige Qualifikation in einem verwandten Fachgebiet besitzen
  • Bevorzugt: Acht oder mehr Jahre Erfahrung in der Softwareentwicklung sowie technische Führungserfahrung mit groß angelegten Plattformen oder verteilten Systemen mitbringen
  • Tiefgehende Kenntnisse in Go, Google Cloud, Kubernetes, Infrastructure as Code, GitOps, Automatisierung, CI/CD, progressiver Bereitstellung, Observability, Cloud-Sicherheit und Plattform-Engineering besitzen
  • Plattformen für agentische KI-Workloads entwickelt haben, einschließlich LLM-Gateways, Agentenlaufzeiten, Model Serving, MCP-Integration, Orchestrierungsebenen und Vektordatenbanken
  • Entwicklerplattformen, APIs und Self-Service-Erfahrungen entworfen haben
  • Mit SRE- oder Reliability-Engineering-Teams zusammengearbeitet haben, um hochverfügbare Produktionssysteme aufzubauen
  • Unternehmensweite Architekturprüfungen geleitet und die technische Ausrichtung über mehrere Teams hinweg beeinflusst haben
  • Die Fähigkeit nachweisen, Stakeholder aus Engineering, Produktentwicklung, Architektur, Sicherheit und Betrieb aufeinander abzustimmen
  • Erfahrung darin zeigen, Ingenieurinnen und Ingenieure zu betreuen und technische Exzellenz innerhalb einer Organisation voranzutreiben
  • Erfahrung mit dem Betrieb hochverfügbarer Einzelhandelsplattformen rund um die Uhr besitzen
  • Google-Cloud-Professional-Zertifizierungen sind von Vorteil

Zusatzleistungen

  • Remote- oder virtuelle Arbeitsvereinbarung
  • In der Regel weniger als 10 % Reisen mit Übernachtung
  • Berufliche Weiterentwicklung durch technisches Coaching, Designberatung, Code-Reviews, Pairing, kontinuierliches Lernen und praktische Experimente
  • Möglichkeit, mit neuen Technologien in den Bereichen KI-Infrastruktur, agentische KI und Cloud-Plattformen zu arbeiten

Ähnliche Stellen

Terumo Medical Corporation

Gebietsleiter Interventionssysteme – Philadelphia

Terumo Medical Corporation

Verantwortung für den Vertrieb von Terumo-Interventionssystemen an Krankenhäuser und ambulante Einrichtungen im Raum Philadelphia. Kundenbeziehungen ausbauen, Eingriffe begleiten, Fachpersonal schulen und Vertriebsziele erreichen.

Öffnen
Cross River

Engineering Manager Cloud und verteilte Systeme – Cross River, Jerusalem

Cross River

Führe und unterstütze Engineers beim Aufbau von Fintech-Diensten und Infrastruktur für Zahlungen, Karten, Kredite und Krypto. In dieser hybriden Rolle in Jerusalem liegt der Schwerpunkt auf cloudnativen Systemen und zuverlässiger Engineering-Umsetzung.

Öffnen
Aleph Alpha

Senior AI Researcher für das Pre-Training von Foundation Models — Aleph Alpha, Heidelberg

Aleph Alpha
51 – 200 Mitarbeitende
B2BKünstliche Intelligenz

Leite Architektur- und Pre-Training-Arbeiten im großen Maßstab für Aleph Alphas europäische Foundation Models und gestalte Trainingsmethoden für Tausende GPUs. Entwickle und verfeinere PyTorch-Trainingsrezepte im hybriden Team in Heidelberg.

Öffnen
General Motors

Sommerpraktikum in der KI-Forschung: Embodied AI

General Motors

Erforsche maschinelles Lernen, Robotik und multimodale Modelle für autonomes Fahren bei General Motors. Führe Experimente durch und arbeite in einem hybriden Praktikum in Sunnyvale, Kalifornien, mit Forschungs- und Entwicklungsteams zusammen.

Öffnen