Backblaze
Backblaze
Backblaze erbjuder molnlagring och dataskyddstjänster för företag och privatpersoner. Plattformen B2 Cloud Storage tillhandahåller S3-kompatibel objektlagring för hantering och skydd av data, medan den automatiska och obegränsade säkerhetskopieringen av datorer underlättar återställning när system eller filer går förlorade. Företaget möjliggör även integrationer med andra applikationer, vilket gör produkterna lämpliga både för team som bygger dataarbetsflöden och för kunder som söker enkla säkerhetskopieringslösningar.

Site Reliability Engineer III, databaser – distans i USA

Leda tillförlitlighet, automatisering, incidenthantering och operativ beredskap för Backblazes produktionsdatabaser med Vitess och Cassandra. Stöd molnlagringsplattformens motståndskraft genom databasarkitektur, återställning, övervakning och infrastrukturdrift.

Beskrivning

  • Utforma, driftsätta och ansvara för mycket tillgängliga databasarkitekturer för Vitess, distribuerad MySQL och Cassandra
  • Skapa och underhålla procedurer, driftmanualer och eskaleringsvägledning för SRE-databasingenjörer på nivå 1 och 2
  • Förbättra databasprestanda genom frågeoptimering, indexering, schemadesign och kapacitetsplanering
  • Ansvara för strategier för databassäkerhetskopiering, återställning, replikering och katastrofåterställning
  • Genomföra och validera tester av katastrofåterställning och procedurer för databasåterställning
  • Leda arbetet med databassäkerhet, åtkomstkontroll, patchning, härdning och efterlevnad
  • Samarbeta med DBA- och datainfrastrukturteamen kring omshardning, kapacitet, replikering och shardad MySQL-arkitektur
  • Bidra till att upprätthålla tillgängligheten och beständigheten hos kritiska produktionstjänster
  • Följa tjänsternas hälsa med SLI:er, SLO:er, felbudgetar, övervakning, loggning och aviseringar
  • Delta i beredskapsrotationer och bidra till incidenthantering, rotorsaksanalys och uppföljningar efter incidenter
  • Vara eskaleringsresurs för komplexa produktionsincidenter i databaser
  • Automatisera databasadministration och operativa processer
  • Bidra till system för övervakning, loggning och avisering med Prometheus, Grafana, Catchpoint och ELK
  • Koppla samman operativa driftmanualer och arbetsflöden för incidenthantering med FireHydrant
  • Använda CI/CD, konfigurationshantering och verktyg för infrastruktur som kod, inklusive Terraform, Ansible och Jenkins
  • Skriva operativa skript i Bash, Python, Go eller jämförbara språk
  • Driva och felsöka containeriserade produktionssystem med Kubernetes och Docker
  • Leda granskningar av produktionsberedskap och bidra till att förbereda nya databasbaserade tjänster för drift
  • Skapa utbildningsplaner, introduktionsresurser och teknisk dokumentation för SRE-databasingenjörer på nivå 1 och 2
  • Samarbeta med Engineering-, Product-, Operations- och DBA-/datainfrastrukturteam i tillförlitlighetsprogram
  • Stödja kapacitetsplanering, övningar i katastrofåterställning, databasflyttar och infrastrukturinitiativ
  • Samordna med leverantörer och tjänsteleverantörer för att lösa problem och övervaka SLA-prestanda
  • Utreda och lösa incidenter i produktionsdatabaser, infrastruktur och tjänster
  • Felsöka och eskalera problem inom databaser, Linux, nätverk, applikationer och infrastruktur
  • Åtgärda återkommande problem med varaktiga korrigerande åtgärder som stärker tillförlitligheten

Krav

  • Ha 6–8 års erfarenhet av site reliability, systemteknik, infrastrukturdrift, databasengineering eller närliggande område, inklusive omfattande stöd för produktionsdatabaser
  • Ha djup praktisk erfarenhet av MySQL och distribuerade eller shardade databassystem
  • Erfarenhet av Vitess i produktion är starkt meriterande
  • Ha erfarenhet av administration och support av NoSQL-databaser som Cassandra
  • Kunna utforma mycket tillgängliga databasarkitekturer, replikeringstopologier, säkerhetskopieringsstrategier och processer för katastrofåterställning
  • Ha starka SQL-kunskaper för frågeanalys, indexering, schemadesign och felsökning
  • Ha goda kunskaper i Linux-administration och felsökning
  • Ha erfarenhet av säkerhetsfokuserad drift, inklusive patchning, härdning, åtkomstkontroll och åtgärdande av sårbarheter
  • Förstå tillförlitlighetsmetoder som övervakning, aviseringar, incidenthantering, rotorsaksanalys, SLI:er, SLO:er och felbudgetar
  • Ha arbetat med containrar och orkestreringsplattformar som Kubernetes och Docker
  • Känna dig bekväm med att drifta Kubernetes- och Vitessmiljöer med verktyg som kubectl, mysqlsh och Vitess keyspaces
  • Ha erfarenhet av verktyg för infrastruktur och konfigurationshantering, inklusive Terraform, Ansible, Jenkins och HashiCorp-produkter som Vault och Nomad
  • Vara skicklig i minst ett skriptspråk, till exempel Python, Bash eller Go
  • Ha etablerat operativa procedurer, driftmanualer, dokumentation och eskaleringsprocesser
  • Ha handlett, utbildat eller introducerat ingenjörer i komplexa tekniska miljöer
  • Erfarenhet av SaaS, molntjänster, tjänsteleverantörsmiljöer eller storskaliga distribuerade system är meriterande
  • Erfarenhet av AWS, GCP, Azure eller jämförbara molnplattformar är meriterande
  • Kännedom om ITIL-/OSS-metoder och SLA-/SLO-hantering är meriterande
  • Ha en kandidatexamen i datavetenskap, ingenjörsvetenskap eller närliggande område, eller motsvarande yrkeserfarenhet

Förmåner

  • Familjesjukförsäkring, inklusive tandvård och synvård
  • Konkurrenskraftig ersättning och en 401(k)-plan
  • RSU-tilldelningar för heltidsanställda
  • Program för aktieköp för anställda
  • Flexibel semesterpolicy
  • Mammaledighet och pappaledighet
  • MacBook Pro för arbetet samt bidrag för personlig anpassning av arbetsstationen
  • Barnomsorgsbonus för mänskliga barn
  • Fertilitetsbehandling och stöd
  • Program för lärande och utveckling
  • Pendlingsförmåner
  • En kultur som främjar en hälsosam balans mellan arbete och privatliv

Relaterade jobb

Intersect Power

Ansvarig för myndighetskontakter och regleringsfrågor (hybrid i Austin)

Intersect Power

Leda regional strategi för myndighetskontakter och regleringsfrågor inom ERCOT och framtida utveckling i SPP, med stöd för tillväxt inom förnybar energi och digital infrastruktur. Bygga allianser, leda påverkansarbete och omsätta policyutveckling till åtgärder för Intersect Power.

Öppna
Honeywell

Honeywell ledande analytiker inom materialhantering (hybrid)

Honeywell

Leda SAP S/4HANA-materialhantering och lagerplanering för Honeywells verksamhet inom processautomation. Stödja ERP-implementering, standardiserade processer, konfiguration och användaracceptanstestning i tillverkningsteamen.

Öppna
Illinois Farm Bureau

Videoproducent – Illinois Farm Bureau (hybrid, Bloomington)

Illinois Farm Bureau

Illinois Farm Bureau söker en videoproducent som ska skapa multimedia för både längre och kortare format. Rollen omfattar produktion, redigering, grafik, livestreaming och stöd inom eventteknik i hela Illinois.

Öppna
Vericel® Corporation

Senior Manager, regulatoriska frågor hos Vericel (hybrid)

Vericel® Corporation

Leda regulatorisk strategi, FDA-ansökningar och efterlevnadsaktiviteter för Vericels produkter inom regenerativ cellterapi. Samarbeta med tvärfunktionella team, hälsomyndigheter och externa leverantörer för att utveckla biologiska läkemedelsprogram.

Öppna
Greenlight

Senior innehållsskapare för sociala medier (distans, USA)

Greenlight

Greenlight söker en senior innehållsskapare för sociala medier som ska producera snabbfotat videoinnehåll och leda influencerinitiativ för ett familjefokuserat teknikvarumärke. Rollen driver organisk tillväxt på TikTok, Instagram, YouTube och ytterligare sociala kanaler.

Öppna
Factory

Chef för utvecklarrelationer – distansarbete i USA

Factory

Leda Factorys strategi för utvecklarrelationer för den AI-drivna plattformen för mjukvaruutveckling. Ansvara för tekniskt innehåll, communitytillväxt, partnerskap, evenemang och feedbackprogram som hjälper utvecklare att börja använda Factory och lyckas med plattformen.

Öppna