Qutwo
Qutwo
Qutwo este un laborator de inteligență artificială și o companie de software care activează la intersecția dintre inteligența artificială, calculul cuantic și optimizarea organizațională. Platforma Qutwo OS ajută echipele să dezvolte algoritmi cuantici și algoritmi hibrizi de inteligență artificială, să conecteze calculul de înaltă performanță, GPU-uri și diferite tipuri de unități de procesare cuantică și să opereze sarcini de lucru în producție cu fluxuri de date, monitorizare și reziliență. Qutwo își sprijină, de asemenea, clienții prin parteneriate de cercetare, oameni de știință integrați în echipele clienților și servicii de integrare concepute pentru a transforma experimentele avansate de inteligență artificială și calcul cuantic în aplicații practice pentru companii. Echipa internațională include oameni de știință și ingineri specializați în inteligență artificială și calcul cuantic, iar recrutarea vizează domenii precum inteligența artificială, MLOps și DevOps, algoritmii cuantici și ingineria platformelor.

Senior Site Reliability Engineer in Helsinki (Hybrid)

Lead reliable, secure multi-cloud Kubernetes infrastructure for Qutwo’s quantum-AI platform. Operate distributed machine-learning workloads while advancing observability, GitOps, and CI/CD.

Descriere

  • Design and run Kubernetes infrastructure across multiple cloud platforms
  • Develop metrics, logging, tracing, and alerting capabilities
  • Establish practical service-level objectives and incident-response processes
  • Automate reproducible, reviewable environments with infrastructure as code and GitOps
  • Manage scheduling, autoscaling, and cost efficiency for distributed training and inference, including Ray clusters on Kubernetes
  • Protect platforms through secrets management, network policies, workload identity, and supply-chain security
  • Create CI/CD and deployment platforms for engineers and coding agents
  • Maintain documentation for infrastructure and architectural decisions

Cerințe

  • Seven or more years of experience building and operating production systems, including substantial work in SRE, platform, or infrastructure engineering
  • Advanced practical knowledge of Kubernetes, including cluster operations, networking, storage, and troubleshooting
  • Experience operating platforms across multiple cloud providers and evaluating their trade-offs
  • Strong infrastructure-as-code and automation capabilities with tools such as Terraform, Helm, and GitOps
  • Proficiency in Python or Go for developing engineering tools
  • Sound understanding of distributed systems, failure scenarios, and reliability trade-offs
  • Security-focused approach to trust boundaries, identity, secrets, and software supply chains
  • Ability to use AI-assisted development tools and critically review coding-agent output, including infrastructure changes
  • Fluent English communication skills
  • Demonstrated effectiveness in agile, cross-functional teams

Beneficii

  • Hybrid working arrangement in Helsinki
  • Chance to establish reliability practices and infrastructure foundations
  • Exposure to distributed machine-learning workloads, quantum-AI systems, and multi-cloud environments
  • Collaborative, agile, cross-functional working culture

Locuri de muncă similare