Cloudflare
Cloudflare
Cloudflare stellt eine Connectivity Cloud bereit, die Organisationen dabei unterstützt, Mitarbeitende, Geräte, Anwendungen, Netzwerke und Daten über lokale Umgebungen, öffentliche Clouds, SaaS-Plattformen und das Internet hinweg zu schützen und zu verbinden. Die Plattform vereint Anwendungssicherheit, Netzwerkschutz, Leistungsoptimierung und Tools für Transparenz. So können Teams die technische Komplexität reduzieren und Software effizienter entwickeln und bereitstellen. Cloudflares Arbeit umfasst Cloud- und Edge-Bereitstellung, sichere Netzwerke und eine widerstandsfähige digitale Infrastruktur und ist damit für Fachkräfte in den Bereichen Cybersicherheit, Netzwerke, Cloud-Plattformen und Anwendungsleistung relevant.

Senior DevOps Engineer für kundenseitige Implementierungen – Cloudflare

Leiten Sie die Bereitstellung von Cloudflare-Computing-Kapazitäten für strategische Kunden – von der Infrastrukturplanung und Hardwarevalidierung bis zur Übergabe an den Produktionsbetrieb. Automatisieren Sie den Flottenbetrieb, etablieren Sie Zuverlässigkeitsstandards und koordinieren Sie Kunden- und Infrastrukturteams.

Beschreibung

  • Bringen Sie neue Computing-Kapazitäten für strategische Kunden durch Planung, Bereitstellung, Validierung und Übergabe an den Produktionsbetrieb online
  • Definieren Sie Abnahmekriterien und Validierungsabläufe für Burn-in-Tests, Benchmarking und Zustandsprüfungen von Computing, Speicher und Netzwerken
  • Arbeiten Sie mit Teams in den Rechenzentren vor Ort zusammen, um Prüfungen durchzuführen und betriebliche Probleme zu lösen
  • Setzen Sie Standards für Aufbau, Konfiguration, Sicherheit und Beobachtbarkeit durch, bevor Kapazitäten in Betrieb genommen werden
  • Erstellen Sie Monitoring, Alarmierung und Runbooks für Produktionssysteme
  • Koordinieren Sie die Teams für Cloudflare-Infrastruktur, Hardwareentwicklung, Rechenzentrumsbetrieb, Lieferkette, Netzwerk und Kundenentwicklung
  • Agieren Sie als primärer technischer Ansprechpartner für die Kundeninfrastruktur und gestalten Sie zugleich Account-Strategie und technische Ausrichtung
  • Nehmen Sie an täglichen Abstimmungen, Kapazitätsprüfungen, Änderungsmanagement und der Reaktion auf Vorfälle teil
  • Leiten Sie vorwurfsfreie Ursachenanalysen und setzen Sie Verbesserungen nach Vorfällen um
  • Entwickeln Sie produktionsreife Automatisierungen und Tools für Bereitstellung, Validierung und Flottenmanagement
  • Prognostizieren Sie den Kapazitätsbedarf der Kunden und identifizieren Sie proaktiv Engpässe
  • Eskalieren Sie betriebliche Probleme und Möglichkeiten für die Plattform an die Teams für Infrastruktur, Hardware und Produkt
  • Bauen Sie vertrauensvolle technische Beziehungen zu Staff+-Ingenieuren, Direktoren und Vizepräsidenten in beiden Organisationen auf
  • Arbeiten Sie regelmäßig vor Ort in den Büros der Kunden

Anforderungen

  • Nachgewiesene Erfahrung in Infrastruktur, SRE oder Produktionstechnik beim Betrieb und bei der Skalierung großer Produktionssysteme
  • Praktische Erfahrung beim Inbetriebnehmen von Serverkapazitäten, einschließlich Bereitstellung, Imaging, Konfigurationsmanagement und Lifecycle-Betrieb im großen Maßstab
  • Praktische Kenntnisse von Serverhardware, Firmware, BMC/IPMI/Redfish und Diagnoseprozessen
  • Fähigkeit, Validierungsstandards zu etablieren, Probleme aus der Ferne zu beheben und mit Technikern vor Ort zusammenzuarbeiten
  • Fundierte Kenntnisse von Linux und grundlegender Netzwerktechnik, einschließlich TCP/IP, BGP, DNS, Load-Balancing und Rechenzentrumstopologien
  • Beherrschung von Go, Python oder Rust
  • Erfahrung mit Infrastructure-as-Code- und Konfigurationsmanagement-Tools wie Terraform, Ansible oder Salt
  • Erfahrung in der Unterstützung geschäftskritischer Dienste durch Bereitschaftsdienste, Reaktion auf Vorfälle, SLO-Management und Reliability Engineering
  • Vertrautheit mit Monitoring-, Metrik- und Logging-Tools wie Prometheus, Grafana oder ClickHouse
  • Erfahrung mit Kubernetes oder vergleichbaren Plattformen zur Workload-Planung
  • Interesse an oder Erfahrung mit modernen KI-Tools für Automatisierung, Debugging und Dokumentation
  • Fähigkeit, komplexe Lieferungen über mehrere Teams, Regionen und Zeitzonen hinweg zu koordinieren
  • Fähigkeit, strategische technische Gespräche mit Führungskräften zu führen
  • Erfahrung bei einem Hyperscaler, Cloud-Anbieter oder in einem großen Rechenzentrum ist von Vorteil
  • Vertrautheit mit der Plattform und Netzwerkarchitektur von Cloudflare ist von Vorteil
  • Erfahrung in kundenintegrierten oder partnerorientierten technischen Infrastrukturrollen ist von Vorteil
  • Technisches Schreiben, internes Mentoring, Open-Source-Arbeit oder Präsentationen in Fachgemeinschaften sind zusätzliche Vorteile
  • Bewerber benötigen möglicherweise eine Genehmigung, um Software oder Technologie zu erhalten, die den US-Exportgesetzen unterliegt, ohne eine Exportlizenzsponsoring zu benötigen

Zusatzleistungen

  • Teilnahme an einem Aktienbeteiligungsplan
  • Kranken- und verschreibungspflichtige Medikamentenversicherung
  • Zahnversicherung
  • Sehversicherung
  • Flexible Ausgabenkonten
  • Pendlerausgabenkonten
  • Leistungen für Fruchtbarkeit und Familiengründung
  • Bedarfsgerechte Unterstützung für psychische Gesundheit und ein Employee Assistance Program
  • Globale Reisekrankenversicherung
  • Berufsunfähigkeitsversicherung für kurze und lange Zeiträume
  • Lebens- und Unfallversicherung
  • 401(k)-Altersvorsorgeplan
  • Mitarbeiter-Aktienbeteiligungsplan
  • Flexible bezahlte freie Tage für Urlaub und Krankheit
  • Urlaubsprogramme für Elternzeit, gesundheitliche Belange während der Schwangerschaft, medizinische Gründe und Trauerfälle

Ähnliche Stellen

Deepdub

Brasilianisch-portugiesische Synchronregie, Dialogadaption oder Sprechrolle

Deepdub
11 – 50 Mitarbeitende
Künstliche Intelligenz

Gestalte brasilianisch-portugiesische Synchronfassungen für Film, Fernsehen und digitale Projekte – als Regisseur:in, Dialogautor:in oder Sprecher:in. Nutze Deepdubs KI-gestützte Lokalisierungsplattform für ausdrucksstarke, emotionale Darbietungen.

Öffnen
Telepatia AI

KI-Implementierungsstratege für Mexiko (hybrid)

Telepatia AI

Leite Telepatia-KI-Implementierungen in Krankenhäusern, bei Versicherern und Kliniknetzwerken in Mexiko. Begleite die klinische Einrichtung, die Akzeptanz bei Ärztinnen und Ärzten, die Pilotleistung und die Implementierungsteams.

Öffnen
Mercor

KI-Sicherheit Red Teamer

Mercor
51 – 200 Mitarbeitende

Mercor sucht eine Fachkraft für Red Teaming im Bereich KI-Sicherheit, die fortgeschrittene KI-Systeme mit adversarialen Prompts auf die Probe stellt. Die Tätigkeit umfasst die Dokumentation von Risiken und die Zusammenarbeit mit Forschenden, um die Sicherheit und Ausrichtung von Modellen zu stärken.

Öffnen