
Numeric 软件工程师,开发者基础设施
为 Numeric 的会计数据平台构建云基础设施、部署系统、可观测性平台和内部工具。通过安全可靠的环境与工作流,提升开发者和 AI 智能体的生产力。
描述
- 开发和维护提升工程师与 AI 智能体生产力的共享基础设施
- 负责路线图项目从定义到交付,并通过直接观察工程师的工作来指导改进
- 在各项服务中实施串行且经过门控的部署工作流
- 自动化支持回滚的架构迁移,并创建可靠的从预发布环境到生产环境的发布流程
- 构建可靠的本地和远程开发环境、沙箱以及预览或评审环境
- 创建面向智能体的基础设施,包括 MCP 网关、治理机制、成本控制和基础模型选择
- 使用 Spacelift 和 OpenTofu 管理基础设施即代码,解决配置漂移,将 DigitalOcean 工作负载迁移到 AWS,并制定 IaC 标准
- 制定代码仓库标准、所有权清单和所有权注册表,并建设内部开发者门户
- 建立可观测性基础,包括追踪、日志、指标、Datadog 成本与规范管理、事件管理和状态页面
- 通过机密与配置管理、SSO、IAM 权限范围控制、ECR 扫描、审计日志和漏洞管理,加强安全性与访问控制
- 运营 Numeric Labs,让员工无需独立解决身份验证、托管和可观测性问题即可构建内部工具
- 与工程师结对协作,观察入职过程,并通过 Slack 发现流程摩擦
任职要求
- 至少 3 年软件工程经验,其中包括大量基础设施、平台工程或开发者生产力方面的工作经验
- 熟悉 AWS、Terraform 或 OpenTofu 等基础设施即代码工具、CI/CD 系统,以及 Linux 和容器基础
- 具备扎实的通用编程能力,主要在合适的场景下使用 TypeScript 和 Python
- 深入了解 AWS、容器与 ECS、网络以及基础设施即代码
- 以产品为导向的开发者体验理念
- 愿意在适当情况下构建内部解决方案,并评估第三方工具
- 有 Spacelift 或 Atlantis、Datadog、Firetiger 或 Chronosphere,或 GitHub Actions 或 Buildkite 使用经验者优先
- 有事件管理、定义 SLA 以及在极高流量期间维护网站的经验者优先
- 有支持非工程师贡献者的经验者优先
- 必须获准在美国工作
福利待遇
- 股权
- 混合办公安排
- 以办公室办公为主的团队环境
- 高信任、高自主性的文化
- 参与塑造产品方向的机会
- 与一支快速发展且高度诚信的团队协作







