Hewlett Packard Enterprise
Hewlett Packard Enterprise
Hewlett Packard Enterprise 为运营混合云和人工智能驱动业务的组织开发企业级技术。其产品组合涵盖 HPE ProLiant 服务器、HPE Cray 高性能计算、HPE Alletra 存储、HPE Aruba 网络、人工智能平台和交钥匙人工智能工厂,以及以服务形式提供的 GreenLake 解决方案。HPE 还提供零信任和安全访问服务边缘(SASE)等安全能力,以及专业服务、咨询服务和支持服务,帮助大型组织实现基础设施现代化、管理数据中心环境,并大规模部署人工智能。

HPC与人工智能性能工程师

负责在 CPU、GPU、网络、内存、存储和人工智能系统之间开展基准测试与优化。 将工作负载和架构分析转化为面向客户及工程团队的可靠性能建议。

描述

  • 负责在 CPU、GPU、网络、内存和存储平台上开展基准测试
  • 使用性能模型和基准测试数据评估 HPE 及竞争对手的 HPC 和人工智能架构
  • 运行并解读科学、工程、大语言模型、人工智能训练与推理、存储及 I/O 工作负载
  • 诊断性能限制,并优化应用程序、人工智能框架、库、编译器、运行时和系统软件
  • 运用并行计算、GPU 加速、性能分析以及内存和 I/O 优化技术
  • 为 HPE HPC 和人工智能解决方案产出可靠、可重复的性能结果
  • 向工程师、客户和业务利益相关者传达技术发现

任职要求

  • 至少六年 HPC 和人工智能工作负载相关经验
  • 具备科学与工程应用、MLPerf、大语言模型、人工智能训练与推理、存储基准测试及性能分析工具经验
  • 了解涵盖 CPU、GPU、加速器、内存、网络、存储和软件栈的 HPC 与人工智能架构
  • 理解 MPI、OpenMP、OpenSHMEM、算法以及并行或分布式编程方法
  • 能够领导复杂的 HPC 和人工智能性能项目,并将结果转化为面向客户的建议
  • 具备在 Linux 系统上分析和调优计算应用程序及基准测试的经验
  • 具备 C、C++、Fortran、Python、Linux 脚本、编译器、MPI、MPI-IO、OpenMP、人工智能框架和库经验
  • 具备 NVIDIA GPU 和 AMD Instinct MI 系列加速器经验
  • 具备 CUDA、HIP、OpenMP target offload、OpenACC 或类似编程模型经验
  • 具备使用基于 Linux 的性能分析、跟踪和调试工具的经验
  • 能够解读基准测试数据、定位性能瓶颈并提出改进建议
  • 具备出色的分析和解决问题能力
  • 具备出色的书面和口头沟通能力
  • 具备专业英语能力
  • 拥有计算机科学、工程、数学、物理、化学、环境科学或相关技术领域的硕士学位
  • 博士学位优先

福利待遇

  • 涵盖身体、财务和情绪健康的福利
  • 支持个人和职业发展的计划
  • 提供灵活的工作选择,以平衡职业与个人责任
  • 致力于打造包容的工作环境
  • 美国员工可享受福利详情

相关职位