Pragmatike
Pragmatike
Pragmatike är ett distansbaserat företag inom IT-rekrytering och bemanning som hjälper nystartade företag och större företag att hitta internationella teknikprofessionella. Tjänsten kombinerar manuellt kvalitetssäkrad matchning av kandidater med tekniska bedömningar och omfattar roller inom bland annat programvaruutveckling, data engineering, mobil- och spelutveckling, produktledning samt andra specialistområden. Pragmatike hjälper också till med de administrativa delarna av internationell rekrytering, inklusive onboarding, fakturering och lönehantering, och är verksamt i fler än 60 länder. Företaget uppger att dess kvalitetssäkrade talangnätverk kan bidra till snabba tillsättningar, där kvalificerade specialister potentiellt kan presenteras inom 48 timmar.

Senior Site Reliability Engineer MAAS Armenien distans

Senior SRE med ansvar för Pragmatikes distribuerade moln- och GPU-infrastruktur. Rollen omfattar MAAS, Kubernetes, nätverk, automatisering, observerbarhet och maskinvarutillförlitlighet.

Beskrivning

  • Driva och underhålla storskaliga Linux-system i Debian- och Ubuntu-miljöer med både bare metal och virtualisering
  • Hantera MAAS-baserad provisionering av bare metal, inklusive region- och rackkontrollanter, PXE, driftsättning, cloud-init, nodlivscykler samt API- eller CLI-automatisering
  • Driva Kubernetes-kluster i produktion och hantera uppgraderingar, nodpooler, nätverk, lagring, säkerhetshärdning och felsökning
  • Utforma och stödja nätverk på flera platser med VLAN, routing på lager 2 och 3, länkade gränssnitt, VPN, brandväggar och DNS
  • Automatisera provisionering och drift av infrastruktur med Ansible, Bash eller Python, OpenTofu eller Terraform samt Git-baserade arbetsflöden
  • Skapa och underhålla automatiserade distributionsprocesser med PXE, Preseed och cloud-init
  • Driva system för observerbarhet med Prometheus, Grafana, Alertmanager, VictoriaMetrics eller VictoriaLogs eller liknande verktyg
  • Etablera och förbättra SLI:er, SLO:er, larmhantering och tillförlitlighetsrutiner för infrastruktur- och plattformstjänster
  • Leda incidenthantering, utredning, eskalering och förbättringar efter incidenter inom infrastrukturen
  • Underhålla beredskapsrutiner och operativ täckning i distribuerade miljöer
  • Arbeta på maskinvarunivå med IPMI eller Redfish, BMC:er, RAID, lagring, diagnostik och GPU-infrastruktur
  • Administrera virtualiseringsplattformar som Proxmox, KVM/libvirt, OpenStack eller VMware, inklusive GPU-genomkoppling vid behov
  • Utveckla interna infrastrukturverktyg för värdidentifiering, konfiguration, IPAM, maskinvaruhälsa och operativ automatisering
  • Hantera arbete under infrastrukturens livscykel, inklusive anslutning av platser, underhåll, avveckling, upptäckt av avvikelser och driftinstruktioner
  • Samarbeta med utvecklings- och tvärfunktionella team för att förbättra tillförlitlighet, resursutnyttjande och operativ effektivitet

Krav

  • Minst fem års praktisk erfarenhet av SRE, infrastruktur, system eller plattformsutveckling
  • Avancerad kompetens inom Linux-administration, särskilt Debian och Ubuntu
  • Dokumenterad produktionserfarenhet av MAAS och provisionering av bare metal
  • Avancerad praktisk erfarenhet av att driva Kubernetes i produktion, inklusive klusterlivscykler, nätverk, lagring, uppgraderingar och felsökning
  • Stark nätverkskompetens inom VLAN, routing på lager 2 och 3, länkning, VPN, brandväggar och DNS
  • God förmåga att automatisera med Ansible, Bash och eller Python
  • Erfarenhet av Terraform eller OpenTofu och Git-baserade arbetsflöden för infrastruktur
  • Produktionserfarenhet av Prometheus, Grafana eller jämförbara plattformar för observerbarhet
  • Bakgrund inom incidenthantering, beredskapsarbete, övervakning, larmhantering och tillförlitlighetsrutiner
  • Erfarenhet av Proxmox, KVM/libvirt, OpenStack, VMware eller liknande virtualiseringsplattformar
  • Erfarenhet av att hantera bare metal-maskinvara, BMC:er, IPMI eller Redfish, lagring och maskinvarufelsökning
  • Goda kunskaper om distribuerade system, containerorkestrering och infrastrukturtillförlitlighet
  • Erfarenhet av att säkra infrastruktur genom RBAC, brandväggar, nätverkspolicyer, hemlighetshantering och härdning
  • Förmåga att ta fram SOP:er, driftinstruktioner och operativa processer från grunden
  • Förmåga att arbeta självständigt i en snabb och ingenjörsorienterad miljö
  • Flytande engelska krävs

Förmåner

  • Helt distansbaserat arbete med flexibla arbetstider
  • En betydelsefull roll med stort tekniskt ägarskap och hög självständighet
  • Direkt arbete med bare metal-system, Kubernetes, nätverk och GPU-infrastruktur
  • Samarbete med ett internationellt, ingenjörsorienterat team
  • Stort fokus på automatisering, tillförlitlighet och infrastruktur i stor skala
  • Möjlighet att forma arkitekturen och den operativa grunden för en växande molnplattform

Relaterade jobb

My Hero VA

Tvåspråkig mötesbokare (distans, Colombia)

My Hero VA

Ring ut på engelska och spanska för att boka skolbesök åt ett barberarutbildningsföretag baserat i Florida. I den här distansrollen från Colombia ingår även uppföljning av potentiella kunder och dagliga administrativa uppgifter.

Öppna