Reap
Reap
201 – 500 Anställda
B2BFintechKrypto
Reap är ett fintechföretag som bygger gränslös finansiell infrastruktur för företag som verkar över flera valutor och marknader. Företaget grundades 2018 och kombinerar gränsöverskridande betalningar med stöd för stablecoins, företagskonton, Visa-företagskort, utgiftshantering i flera valutor och API:er för inbäddad finansiering. Plattformen stöder globala utbetalningar i fiatvalutor, kortutgivning, betalningsautomatisering och treasury-arbetsflöden för företag som söker mer flexibla sätt att hantera internationell ekonomi. Reap verkar inom fintech-, krypto- och B2B-marknaderna och har 201–500 anställda.

Senior Site Reliability Engineer – Reap Mexico hybrid

Led tillförlitlighetsarbete för Reaps globala betalningsplattform baserad på stablecoins, med fokus på observerbarhet, självbetjäningsinfrastruktur och operativ motståndskraft. Arbeta med AWS, Kubernetes, Terraform och PCI DSS-reglerade system.

Beskrivning

  • Fastställ mål för tillförlitlighet med produkt- och ingenjörsteamen genom SLI:er, SLO:er och felbudgetar.
  • Delta i beredskapsrotationen och stärk rutinerna för incidenthantering och skuldfria efteranalysmöten.
  • Modernisera äldre infrastruktur med Infrastructure as Code och minska samtidigt manuell provisionering och konfigurationsdrift.
  • Samla Terraform i en styrd kodbas med konsekventa moduler och automatiserad detektering av drift.
  • Automatisera skapande av konton och miljökonfiguration mellan regioner och tjänster.
  • Skapa standardiserade vägar och självbetjäningsverktyg för provisionering, driftsättning och observerbarhet.
  • Utforma tillfälliga miljöer som liknar produktion, med automatisk rensning.
  • Utveckla observerbarhet för loggar, mätvärden, distribuerade spår och åtgärdsbara aviseringar.
  • Led molndriften för PCI DSS-kompatibla finansiella system, inklusive tillgänglighet, redundansväxling, kapacitet, katastrofåterställning och incidenthantering.
  • Integrera hantering av hemligheter, IAM med minsta privilegium, nätverkssegmentering och efterlevnadsskydd i infrastrukturen.
  • Utveckla säker och granskningsbar infrastruktur för AI-assistenter och AI-agenter.
  • Samarbeta med produkt- och ingenjörsteam och hantera samtidigt plattformen som en produkt.

Krav

  • Erfarenhet av att fastställa SLO:er, hantera felbudgetar eller utveckla rutiner för incidenter och efteranalys.
  • Goda kunskaper i Linux och datorsystem, inklusive operativsystemens interna funktioner, nätverk och administration.
  • Avancerad erfarenhet av Terraform, inklusive tillståndshantering, modularkitektur och gemensamma standarder för team.
  • Erfarenhet av att leda en storskalig migrering till Infrastructure as Code eller en ny implementation från grunden.
  • Gedigen AWS-bakgrund i miljöer med flera konton och regioner, inklusive Control Tower, IAM, nätverk, RDS och kostnadshantering.
  • Erfarenhet av att köra ECS och Fargate samt Kubernetes-miljöer i produktion i stor skala.
  • Förståelse för livscykelhantering av Kubernetes-kluster, uppgraderingar, automatisk skalning, resursbegränsningar och isolering av arbetsbelastningar för flera klienter.
  • Erfarenhet från produktion av Lambda, SQS och EventBridge, inklusive återförsök, meddelanden som fastnar, ordning och idempotens.
  • Erfarenhet av Argo CD eller en motsvarande plattform samt GitHub Actions CI/CD-pipelines.
  • Praktisk erfarenhet av observerbarhet med loggnings-, mätvärdes- och spårningsverktyg som New Relic, CloudWatch, Datadog eller Prometheus.
  • Förmåga att använda Python, Go eller Bash för automatisering och verktyg.
  • Erfarenhet av att ansvara för tjänster genom design, leverans, observerbarhet, incidenthantering, kapacitetsplanering, uppgraderingar och säkerhetskorrigeringar.
  • Erfarenhet av reglerade miljöer och kännedom om PCI DSS och finansiell efterlevnad.
  • Förmåga att självständigt driva projekt och skapa samsyn utan formellt mandat.
  • Tydlig kommunikation på klarspråk och förmåga att bryta ned komplexa problem till arbetsuppgifter för människor eller AI-agenter.
  • Omfattande användning av AI-verktyg för kodning, granskning, automatisering, incidentanalys och dokumentation.
  • Bekväm med att hantera produktionsincidenter med betydande möjlig påverkan.
  • Betydande erfarenhet av SRE, DevOps eller infrastrukturingenjörskap är meriterande.
  • Erfarenhet från fintech, betalningar, kortutgivning eller annan reglerad sektor är meriterande.
  • Praktisk erfarenhet av PCI DSS är meriterande.
  • Erfarenhet av Kubernetes eller EKS i en PCI DSS-miljö är meriterande.
  • Erfarenhet av att utforma och driva plattformar för tillfälliga miljöer eller miljöer på begäran är meriterande.
  • Erfarenhet av att från grunden bygga en intern utvecklarplattform, kontofabrik eller landningszon är meriterande.
  • Erfarenhet av Ansible eller liknande verktyg för konfigurationshantering är meriterande.
  • AWS-certifieringar är meriterande.
  • Nyfikenhet på stablecoins och mötet mellan Web2 och Web3 är meriterande.

Relaterade jobb