
赫爾辛基資深網站可靠性工程師(混合辦公)
負責 Qutwo 量子 AI 平台可靠且安全的多雲 Kubernetes 基礎設施。運行分散式機器學習工作負載,同時推進可觀測性、GitOps 與 CI/CD。
說明
- 在多個雲端平台上設計並運行 Kubernetes 基礎設施
- 開發指標、日誌、追蹤與告警能力
- 建立實用的服務等級目標與事件回應流程
- 透過基礎設施即程式碼與 GitOps 自動化建立可重現、可審查的環境
- 管理分散式訓練與推論的排程、自動擴縮及成本效益,包括在 Kubernetes 上運行 Ray 叢集
- 透過密鑰管理、網路政策、工作負載身分與軟體供應鏈安全保護平台
- 為工程師與程式設計代理建立 CI/CD 與部署平台
- 維護基礎設施與架構決策文件
職位要求
- 具備七年或以上建置與運營生產系統的經驗,其中包括豐富的 SRE、平台或基礎設施工程經驗
- 具備 Kubernetes 的進階實務知識,包括叢集運維、網路、儲存與故障排除
- 具備跨多個雲端服務供應商運營平台並評估其取捨的經驗
- 具備扎實的基礎設施即程式碼與自動化能力,熟悉 Terraform、Helm 與 GitOps 等工具
- 熟練使用 Python 或 Go 開發工程工具
- 深入理解分散式系統、故障情境與可靠性取捨
- 重視安全,理解信任邊界、身分、密鑰與軟體供應鏈
- 能夠使用 AI 輔助開發工具,並批判性地審查程式設計代理的輸出,包括基礎設施變更
- 具備流利的英語溝通能力
- 已證明能在敏捷、跨職能團隊中有效工作
福利待遇
- 在赫爾辛基採用混合辦公安排
- 有機會建立可靠性實務與基礎設施基礎
- 接觸分散式機器學習工作負載、量子 AI 系統與多雲環境
- 協作、敏捷的跨職能工作文化







