Qutwo
Qutwo
Qutwo er et AI-laboratorium og en softwarevirksomhed, der arbejder i krydsfeltet mellem kunstig intelligens, kvantecomputere og optimering af virksomheder. Platformen Qutwo OS hjælper teams med at udvikle kvante- og hybride AI-algoritmer, forbinde højtydende computere, GPU'er og forskellige typer kvanteprocessorenheder samt køre produktionsarbejdsbelastninger med datapipelines, overvågning og robusthed. Qutwo hjælper også kunder gennem forskningspartnerskaber, forskere, der arbejder tæt på kundernes organisationer, og integrationstjenester, som er udviklet til at omsætte avancerede eksperimenter inden for AI og kvantecomputere til praktiske virksomhedsapplikationer. Det internationale team omfatter AI- og kvanteforskere samt ingeniører, og virksomheden rekrutterer inden for AI, MLOps og DevOps, kvantealgoritmer og platformsteknik.

Senior Site Reliability Engineer i Helsinki (hybrid)

Led en pålidelig og sikker Kubernetes-infrastruktur på tværs af flere cloudmiljøer for Qutwos kvante-AI-platform. Driv distribuerede maskinlæringsarbejdsbelastninger, og videreudvikl observability, GitOps og CI/CD.

Beskrivelse

  • Design og drift af Kubernetes-infrastruktur på tværs af flere cloudplatforme
  • Udvikling af funktioner til målinger, logning, tracing og alarmering
  • Etablering af praktiske mål for serviceniveauer og processer for håndtering af hændelser
  • Automatisering af reproducerbare og gennemgåelige miljøer med infrastruktur som kode og GitOps
  • Håndtering af planlægning, autoskalering og omkostningseffektivitet for distribueret træning og inferens, herunder Ray-klynger på Kubernetes
  • Beskyttelse af platforme gennem håndtering af secrets, netværkspolitikker, workload-identitet og sikkerhed i softwareforsyningskæden
  • Oprettelse af CI/CD- og deploymentplatforme for ingeniører og coding-agenter
  • Vedligeholdelse af dokumentation for infrastruktur- og arkitekturbeslutninger

Krav

  • Mindst syv års erfaring med at bygge og drive produktionssystemer, herunder betydeligt arbejde inden for SRE, platform- eller infrastrukturengineering
  • Avanceret praktisk viden om Kubernetes, herunder klyngedrift, netværk, lager og fejlfinding
  • Erfaring med at drive platforme på tværs af flere cloududbydere og vurdere deres afvejninger
  • Stærke kompetencer inden for infrastruktur som kode og automatisering med værktøjer som Terraform, Helm og GitOps
  • Gode kundskaber i Python eller Go til udvikling af ingeniørværktøjer
  • Solid forståelse af distribuerede systemer, fejlsituationer og afvejninger omkring pålidelighed
  • Sikkerhedsfokuseret tilgang til tillidsgrænser, identitet, secrets og softwareforsyningskæder
  • Evne til at bruge AI-assisterede udviklingsværktøjer og kritisk gennemgå coding-agenters output, herunder infrastrukturændringer
  • Flydende engelsk i skrift og tale
  • Dokumenteret evne til at arbejde effektivt i agile, tværfunktionelle teams

Fordele

  • Hybrid arbejdsordning i Helsinki
  • Mulighed for at etablere praksisser for pålidelighed og et solidt infrastrukturfundament
  • Indblik i distribuerede maskinlæringsarbejdsbelastninger, kvante-AI-systemer og multicloudmiljøer
  • Samarbejdsorienteret, agil og tværfunktionel arbejdskultur

Relaterede job