RELX
RELX
RELX udvikler informationsbaserede analyse- og beslutningsværktøjer til professionelle og erhvervskunder verden over. Virksomhedens produkter kombinerer specialiseret indhold, data og teknologi for at understøtte bedre beslutninger og stærkere resultater inden for risikostyring, videnskab, teknik og medicin, jura samt udstillinger. RELX er også aktiv inden for rådgivning samt sundheds- og forsikringsrelaterede markeder, hvor virksomheden hjælper organisationer med at forbedre produktiviteten, håndtere risici, fremme forskning, understøtte juridisk arbejde og gennemføre mere effektive forretningstransaktioner.

Senior Site Reliability Engineer – AWS | Philadelphia på kontoret

Senior Site Reliability Engineer med ansvar for at forbedre AWS-platformens pålidelighed, observability, automatisering og genoprettelse på tværs af Elseviers videnskabelige og medicinske informationstjenester. Rollen understøtter også sikre AI-baserede systemer og udviklingsteams.

Beskrivelse

  • Vedligeholde pålidelighed, skalerbarhed og ydeevne for kritiske platforme og tjenester
  • Lede komplekse pålidelighedsprogrammer og automatisere processer for at reducere operativt merarbejde
  • Anvende ekspertise inden for observability, incident response og distribuerede systemer til at diagnosticere og løse pålidelighedsproblemer
  • Designe og levere forbedringer af tjenestetilgængelighed, operationel effektivitet og systemgenoprettelse
  • Opretholde strenge standarder for kodekvalitet og identificere risici eller blokeringer tidligt
  • Samarbejde med interessenter i værtsfunktionerne for at tilpasse løsninger til de faktiske operationelle arbejdsgange
  • Sikre effektive overdragelser og opbygge interne kompetencer, så løsningerne forbliver ejede og driftbare
  • Udvikle overvågningsforespørgsler og definere baselines for serviceniveauer
  • Assistere senioringeniører under incident response
  • Bidrage til gennemgange efter hændelser og analyser af grundlæggende årsager
  • Deltage i test af katastrofegenoprettelse
  • Opbygge automatiseringer og køre kode i produktionsmiljøer
  • Bidrage til SRE-vidensdokumentation og operationel vejledning
  • Understøtte implementering, overvågning og pålidelighed af tjenester, der integrerer AI-værktøjer
  • Vedligeholde infrastrukturens topologidiagrammer og implementeringsarbejdsgange
  • Validere tjenestetilgængelighed, pålidelighed og genoprettelighed i ikke-produktionsmiljøer

Krav

  • Dokumenteret avanceret Terraform-kompetence, herunder moduler, providers, state management, livscykluskontroller, registrering af afvigelser, sikker refaktorering, remote state, låsning og afhængigheder på tværs af stacks
  • Praktisk erfaring med drift af AWS-produktionsmiljøer på tværs af flere konti og regioner
  • Praktisk erfaring med ECS, RDS, ALB, VPC, IAM, Route 53, ECR, S3, Lambda, DynamoDB, SQS, Secrets Manager, KMS og CloudWatch
  • Erfaring med at oprette og fejlfinde genanvendelige GitHub Actions-workflows, der dækker OIDC-godkendelse, godkendelsesporte, runners, Terraform- og applikationsimplementeringer samt migrationspipelines
  • Arbejdskendskab til Docker, ECR, ECS-taskdefinitioner og -tjenester, IAM-roller, health checks, autoskalering, ALB-integration og procedurer for tilbagerulning af implementeringer
  • Kompetence inden for AWS-netværk og -sikkerhed, herunder VPC'er, ALB'er, Route 53, ACM/TLS, IAM, OIDC, Secrets Manager, KMS og bedste praksis for cloud-sikkerhed
  • Erfaring med incident response og observability ved hjælp af logs, metrikker, alarmer, implementeringshistorik, grundårsagsanalyser, beslutninger om tilbagerulning og operationelle runbooks
  • Stærke grundlæggende færdigheder i Linux og Git
  • Evne til at skrive Bash- og Python-scripts til AWS CLI-automatisering, CI/CD og operationelle værktøjer
  • Praktisk erfaring med at integrere og køre AI-tjenester og API'er i produktion med passende kontroller for overvågning, pålidelighed og sikkerhed
  • Evne til at understøtte flere udviklingsteams, fejlfinde på tværs af infrastruktur- og applikationslagene, dokumentere løsninger og muliggøre sikre selfservice-metoder

Fordele

  • Mulighed for en årlig incitamentsbonus
  • Fordele tilpasset det relevante land
  • Støtte til rimelige tilpasninger gennem hele rekrutteringsprocessen

Relaterede job