Nvidia logo
英伟达
Performance Engineer

Performance Engineer

发布于 大约 3 小时前

普通员工/个人贡献者

上海市
中级经验
全职员工
仅现场办公
本科
软件工程
Ai/Llm
Automation
Gpu
Nvidia

AI 估算 · 30k–50k

英伟达处于AI高性能计算领先赛道,薪资高于市场基准,含绩效奖金。

职位详情

关于这个职位

作为英伟达上海Perflab团队的性能工程师,你将负责GPU及相关产品在全生命周期内的性能优化与基准测试

工作涉及AI/LLM、游戏、工作站等负载的性能分析、自动化脚本开发与数据管道建设,需要扎实的Python能力和计算机体系结构知识
适合对性能优化有浓厚兴趣、希望深耕AI计算领域的技术人才

最低要求

拥有学士或硕士学位(BS/MS)

在计算机科学、电气工程、计算机工程或相关技术领域拥有2年以上同等实践经验
熟练掌握Python或其他脚本/编程语言
对AI/LLM工作负载、PC游戏、工作站应用和内容创作流程有实际操作兴趣
深入理解PC和服务器架构
具有处理大型数据集的经验,以及较强的分析和故障排查能力
出色的沟通、组织、时间管理和任务优先级排序能力

工作职责

设计和执行具有代表性的基准测试方法和真实用例,在服务器、PC、工作站、SoC和笔记本电脑上展示产品在AI/LLM、游戏、工作站、内容创建和系统工作负载方面的能力

分析性能指标和系统遥测数据,以识别瓶颈、回归和优化机会
生成清晰、数据驱动的竞争分析和技术报告,帮助内外部利益相关者有效定位NVIDIA产品
在Windows、Linux和MacOS上开发和调试各种基准性能和系统监控数据收集的自动化脚本
构建和维护可扩展的自动化框架、AI代理、仪表盘和数据管道,以提高测试效率、覆盖率和分析稳健性

优先资格

熟悉NVIDIA GPU及NVIDIA技术

了解AI推理或训练、微调概念
有构建、测试或运营AI平台和LLM推理栈的经验
有开发AI代理或智能体工作流的经验
了解容器化和虚拟化工作流,包括Docker、Kubernetes和虚拟机

AI 洞察

优缺点分析

优点

  • 头部公司平台,能接触最先进的GPU技术和AI计算生态
  • 工作领域极具前沿性,技能积累具有高市场价值
  • 与全球顶尖工程师协作,职业视野广阔
  • 英伟达技术影响力大,个人贡献能快速被认可
  • 工作涉及多平台多负载,任务复杂度高,可能面临较大强度
  • 适合对计算机体系结构和性能优化有浓厚兴趣,喜欢解决复杂技术问题的工程师

缺点 / 挑战

  • 性能工程需要对系统有极深理解,技术门槛高,持续学习压力大
  • 需要与多团队紧密配合,沟通成本较高

角色解读

  • 在GPU性能优化领域形成深厚积累,可向资深性能工程师或架构师方向发展
  • 依托英伟达平台,可横向拓展至AI平台开发、深度学习系统优化等前沿方向
  • 具备成为技术领导者或项目管理者的潜力,逐渐参与更多产品级决策
  • 设计并执行各类基准测试方法和真实场景,涵盖AI/LLM、游戏、工作站、内容创作等负载,覆盖服务器、PC、工作站、SoC及笔记本平台
  • 分析性能指标与系统遥测数据,定位性能瓶颈、回归问题,提出优化方案
  • 生成数据驱动的竞争分析和技术报告,帮助内外部利益相关者进行产品定位
  • 开发与维护自动化脚本、自动化框架、AI代理、数据仪表盘和数据管道,提升测试效率与覆盖率
  • 精通Python或其他脚本语言,具备扎实的编程能力
  • 深入理解PC与服务器体系结构,熟悉底层硬件
  • 具有大规模数据处理和分析能力,熟悉性能调优工具与方法论
  • 对AI/LLM工作负载、游戏及内容创作流程有实际操作兴趣

申请策略

  • 提前了解英伟达产品线(如GeForce、DGX)及性能测试工具(如Nsight)
  • 在简历中量化你的性能优化成果,例如将某系统吞吐量提升X%
  • 突出性能优化相关的项目经验,如基准测试、瓶颈分析、优化前后数据对比
  • 强调Python编程能力,展示自动化脚本或工具开发成果
  • 体现对AI/LLM、GPU等技术的了解,如使用过CUDA、TensorRT等
  • 如果有处理大数据集或构建数据看板的经验,务必列出
  • 深入学习GPU体系结构和并行计算知识,了解NVIDIA CUDA与TensorRT
  • 加强AI推理/训练框架(如PyTorch、TensorFlow)的性能调优能力

面试指南

  • 使用STAR法则:情境、任务、行动、结果,结合量化数据
  • 强调系统思维:从硬件架构、操作系统、应用层综合考量
  • 展示动手能力:结合具体工具和代码示例说明方案
  • 请分享一个你主导过的性能优化案例,如何发现瓶颈并解决?
  • 你如何理解GPU的性能指标?有哪些常用工具?
  • 如何设计一套基准测试来评估AI/LLM推理性能?
  • 解释一下CPU和GPU的架构差异及其对性能影响
  • 在Linux环境下,你会如何排查CPU/内存/IO瓶颈?

职位点评

81
综合评分

英伟达上海性能工程师,接触AI/GPU前沿技术,薪资竞争力强,成长空间大,但需现场办公且加班情况未知。

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
适合追求前沿技术成长、渴望在高性能计算和AI领域深入发展的工程师。
表现最好
成长发展
相对薄弱
工作生活
薪资福利85
成长发展92
工作生活55
使命价值88

薪资福利

85较高

英伟达作为行业头部企业,薪资福利通常优于市场平均水平,但JD未明确披露具体待遇。

薪资信号未披露(AI估算:30K-50K/月)

成长发展

92较高

岗位深度涉足AI/LLM、GPU性能优化等前沿领域,技术挑战大,成长空间广阔。

技术前沿前沿/新兴技术
技术栈Python、AI/LLM、GPU、Performance Tuning、Benchmarking、Automation、Data Pipelines、Docker、Kubernetes、AI Agents
业务类型profit_center

工作生活

55较低

JD未提及远程办公或弹性工时,按现场工作评估;办公地点与加班情况不明。

工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)

使命价值

88较高

参与AI与GPU前沿技术研发,对推动计算领域发展有直接价值。

行业发展高速增长赛道
社会影响正向社会影响力较高
使命信号make a lasting impact on the world
创新程度开拓性创新(行业首创)
Watch Jobs