Stratus
Stratus
Stratus on B2B-teknologia- ja konsultointiyritys, joka keskittyy kiinteistö- ja vahinkovakuuttajien sekä Managing General Agent -toimijoiden vakuutustoimintojen modernisointiin. Sen tiimit auttavat organisaatioita korvaamaan tai optimoimaan vanhoja ydinjärjestelmiä, ottamaan käyttöön Guidewire- ja Insurity-alustoja, suunnittelemaan ja toteuttamaan Azure-pilvimigraatioita sekä kehittämään datan hallinnan strategioita ja käytäntöjä. Stratus tukee myös tekoälyvalmiuksien kehittämistä, sovellusten ylläpitoa, laadunvarmistusta, alustojen valintaa ja sulautettua IT-toimitusta tarvittaessa koottavien osaajatiimien avulla. Yrityksen työ yhdistää vakuutusalan asiantuntemuksen käytännönläheiseen teknologiamuutokseen, jotta asiakkaat voivat parantaa analytiikkaansa, tehostaa toimintaansa ja tuoda uusia tuotteita markkinoille entistä tehokkaammin.

Kokenut Site Reliability Engineer – etätyö Yhdysvalloissa

Kokenut SRE vastaa Stratusin luotettavuuden käytännön toteutuksesta. Stratusin ohjelmisto digitalisoi MEP-urakoitsijoiden työnkulkuja, ja tehtävä kattaa SLO-tavoitteet, observabilityn, häiriötilanteiden hallinnan ja tuotantojärjestelmien suorituskyvyn Azure-ympäristössä.

Kuvaus

  • Vastaat asiakasrajapinnan palvelujen palvelutason mittareista, tavoitteista ja virhebudjeteista
  • Kehität mittausputkia, jotka raportoivat saatavuutta ja viivettä määriteltyihin tavoitteisiin verrattuna
  • Hallinnoit tuotannon observabilitya instrumentointistandardien, koontinäyttöjen ja toimintaan ohjaavien hälytysten avulla
  • Ylläpidät observability-työkaluja Azure AKS-, Prometheus-, Loki-, Tempo-, Grafana-, Istio- ja Flux-ympäristöissä
  • Rakennat häiriötilanteiden hallinnan toimintamallit, jotka kattavat päivystysvuorot, sivutukset, vakavuusasteet, omistajuuden, eskaloinnin ja syyllistämättömät jälkipuintikokoukset
  • Määrittelet palautus- ja toipumisstandardit ja validoit ne toistuvilla harjoituksilla
  • Johdat suorituskyky- ja kapasiteettitekniikkaa kyselyjen ja indeksien optimoinnin, yhteyspoolien mitoituksen, kapasiteettimallinnuksen ja hallitun suorituskyvyn heikentämisen suunnittelun avulla
  • Teet yhteistyötä tiimin kanssa k6-kuormitus-, rasitus-, piikki- ja kestotestauksessa
  • Määrittelet SLO-pohjaiset päätepisteiden viivekynnykset ja käytät testituloksia toimitusten portteina
  • Johdat tuotantovalmiuden katselmuksia, joissa käsitellään instrumentointia, hälytyksiä, vikatiloja, resurssirajoja ja palautussuunnitelmia
  • Viet jälkipuintien korjaavat toimet loppuun asti ja varmistat tuotantomuutosten toteutumisen
  • Tuet liiketoiminnan jatkuvuuden ja katastrofipalautumisen suunnittelua, mukaan lukien varmuuskopioiden ja palautusten validointi, vikasietosuunnittelu ja palautumistavoitteet
  • Valmennat suunnittelutiimejä niiden palvelujen instrumentoinnissa ja operoinnissa
  • Luot työkaluja, automaatiota, instrumentointikirjastoja ja tuotantokoodin korjauksia
  • Teet yhteistyötä suunnittelutiimien, alusta- ja tietoturvatiimien sekä asiakasrajapinnan ryhmien välillä
  • Raportoit Platform Engineering -organisaation Senior Directorille

Vaatimukset

  • Vähintään kuuden vuoden ammatillinen kokemus ohjelmistokehityksestä tai suunnittelusta
  • Vähintään kolme vuotta erillisessä SRE- tai tuotantotekniikan tehtävässä B2B SaaS -yrityksessä
  • Todistettu vastuu tuotannon SLO-tavoitteista ja virhebudjeteista
  • Edistynyt käytännön observability-kokemus Prometheuksesta, Lokista, Temposta, Grafanasta tai vastaavista työkaluista
  • Käytännön kokemus merkittävien häiriötilanteiden häiriötilannejohtajana toimimisesta
  • Kokemus päivystys- ja eskalointiprosessien rakentamisesta alusta alkaen
  • Vahva tietokantojen suorituskykyosaaminen, mukaan lukien kyselyiden profilointi, indeksien suunnittelu, yhteyspoolit ja kuormituksen aikainen kyllästymisen diagnosointi
  • MongoDB-kokemus katsotaan eduksi; vastaava syvällinen osaaminen dokumentti- tai relaatiotietokannoista hyväksytään
  • Tuotantokokemus Kubernetesista, mieluiten AKS:stä
  • Kyky selvittää podien ajoitukseen, resurssirajoihin, verkkoyhteyksiin ja palveluverkkojen toimintaan liittyviä ongelmia; Istio-kokemus katsotaan eduksi
  • Sujuva vähintään yhdessä kielistä Go, Python, C# tai TypeScript
  • Valmius työskennellä C#/.NET-koodipohjassa
  • Kokemus kuormitus- ja suorituskykytyökaluista, kuten k6:sta, JMeteristä tai Gatlingista
  • Tuotantokokemus Azuresta tai AWS:stä sekä hallittujen palvelujen vikatilojen ymmärtäminen
  • Tekoälyavusteisten suunnittelutyökalujen sujuva käyttö ja kokemus tekoälyä hyödyntävien työnkulkujen suunnittelusta
  • Erinomainen kirjallinen viestintätaito jälkipuintien, käyttöohjeiden ja luotettavuusraporttien laatimiseen
  • Hyvä harkintakyky ja rauhallisuus paineen alla
  • Kokemus SRE-käytännön perustamisesta tai kehittämisestä katsotaan eduksi
  • Kokemus Sentrystä tai vastaavasta sovellusten virhevalvonta-alustasta katsotaan eduksi
  • Kokemus tapahtumavetoisten ja reaaliaikaisten järjestelmien operoinnista katsotaan eduksi
  • Kokemus MongoDB Atlasin ajamisesta tuotantomittakaavassa katsotaan eduksi
  • Kokemus kestävistä työnkulkujen orkestrointialustoista, kuten Temporalista, katsotaan eduksi
  • Tausta monialueisesta tai monivyöhykkeisestä arkkitehtuurista ja katastrofipalautumisen suunnittelusta katsotaan eduksi
  • Kokemus incident.io:sta, PagerDutysta tai vastaavista häiriötilanteiden hallinta-alustoista katsotaan eduksi
  • DORA-mittareiden tuntemus ja luotettavuustyön kokemus SOC 2- tai NIST 800-171 -ympäristöissä katsotaan eduksi
  • Kokemus vanhojen monoliittien luotettavuuden parantamisesta katsotaan eduksi
  • Kiinnostus MEP-, BIM-, AEC- tai rakennusteknologiaa kohtaan katsotaan eduksi
  • Aiempi kokemus Series B -yrityksestä tai kasvuvaiheen yrityksestä katsotaan eduksi

Edut

  • Kattavat ja kilpailukykyiset terveydenhuollon edut
  • 401(k)-maksut työnantajan vastaavalla osuudella
  • Kaksikymmentä palkallista vapaapäivää vuodessa
  • Pääasiassa etätyöhön perustuva työjärjestely
  • Satunnaisia vuosittaisia tiimin lähitapahtumia

Samankaltaiset työpaikat

Sikla GmbH

Asiakas- ja myyntituen asiantuntija

Sikla GmbH
501 – 1 000 Työntekijät
KonsultointiLogistiikkaValmistus

Tue Sikla UK:n teknisten modulaaristen tukijärjestelmien liiketoimintaa Milton Keynesissä ja käsittele asiakkaiden ja myynnin kyselyjä tarjouksesta toimitukseen. Koordinoi tilauksia, dokumentaatiota, logistiikkaa ja ERP-hallintoa asiakkaiden sekä sisäisten tiimien kanssa.

Avaa
Newstel Worldwide

Osa-aikainen tanskankielinen asiakaspalvelija (Portugali, etätyö)

Newstel Worldwide
201 – 500 Työntekijät
KonsultointiLogistiikkaMarkkinointi

Tarjoat etänä tanskankielistä asiakastukea Newstelin monikielisille BPO-asiakkaille ja saavutat palvelu- ja laatutavoitteet. Osa-aikatyössä hoidat Portugalista käsin sähköposti-, chat- ja puhelintiedusteluja.

Avaa
Thermo Fisher Scientific

Senior Clarity PPM -järjestelmäkehittäjä

Thermo Fisher Scientific

Johda Thermo Fisher Scientificin Clarity PPM -alustan kehitystä ja tukea, mukaan lukien integraatiot, päivitykset ja tuotantojulkaisut. Vastaa vaativasta vianmäärityksestä, teknisestä hallinnasta, mentoroinnista ja SOX-vaatimusten mukaisesta toiminnasta.

Avaa
Chargeflow

Asiakasrajapinnan käyttöönottoinsinööri

Chargeflow
51 – 200 Työntekijät
FintechVerkkokauppa

Johda API-integraatioita ja yritysasiakkaiden käyttöönottoja Chargeflow’n tekoälypohjaiselle takaisinveloitus- ja petostentorjunta-alustalle. Vastaa käyttöönotosta sopimuksen allekirjoituksesta palvelun käynnistämiseen Modi’inissa Israelissa sijaitsevassa hybridiroolissa.

Avaa