
HPC与人工智能性能工程师
负责在 CPU、GPU、网络、内存、存储和人工智能系统之间开展基准测试与优化。 将工作负载和架构分析转化为面向客户及工程团队的可靠性能建议。
描述
- 负责在 CPU、GPU、网络、内存和存储平台上开展基准测试
- 使用性能模型和基准测试数据评估 HPE 及竞争对手的 HPC 和人工智能架构
- 运行并解读科学、工程、大语言模型、人工智能训练与推理、存储及 I/O 工作负载
- 诊断性能限制,并优化应用程序、人工智能框架、库、编译器、运行时和系统软件
- 运用并行计算、GPU 加速、性能分析以及内存和 I/O 优化技术
- 为 HPE HPC 和人工智能解决方案产出可靠、可重复的性能结果
- 向工程师、客户和业务利益相关者传达技术发现
任职要求
- 至少六年 HPC 和人工智能工作负载相关经验
- 具备科学与工程应用、MLPerf、大语言模型、人工智能训练与推理、存储基准测试及性能分析工具经验
- 了解涵盖 CPU、GPU、加速器、内存、网络、存储和软件栈的 HPC 与人工智能架构
- 理解 MPI、OpenMP、OpenSHMEM、算法以及并行或分布式编程方法
- 能够领导复杂的 HPC 和人工智能性能项目,并将结果转化为面向客户的建议
- 具备在 Linux 系统上分析和调优计算应用程序及基准测试的经验
- 具备 C、C++、Fortran、Python、Linux 脚本、编译器、MPI、MPI-IO、OpenMP、人工智能框架和库经验
- 具备 NVIDIA GPU 和 AMD Instinct MI 系列加速器经验
- 具备 CUDA、HIP、OpenMP target offload、OpenACC 或类似编程模型经验
- 具备使用基于 Linux 的性能分析、跟踪和调试工具的经验
- 能够解读基准测试数据、定位性能瓶颈并提出改进建议
- 具备出色的分析和解决问题能力
- 具备出色的书面和口头沟通能力
- 具备专业英语能力
- 拥有计算机科学、工程、数学、物理、化学、环境科学或相关技术领域的硕士学位
- 博士学位优先
福利待遇
- 涵盖身体、财务和情绪健康的福利
- 支持个人和职业发展的计划
- 提供灵活的工作选择,以平衡职业与个人责任
- 致力于打造包容的工作环境
- 美国员工可享受福利详情









