
英伟达
Performance Engineer
Performance Engineer
发布于 大约 3 小时前普通员工/个人贡献者
上海市
中级经验
全职员工
仅现场办公
本科
软件工程
Ai/Llm
Automation
Gpu
Nvidia
AI 估算 · 30k–50k
英伟达处于AI高性能计算领先赛道,薪资高于市场基准,含绩效奖金。
职位详情
关于这个职位
作为英伟达上海Perflab团队的性能工程师,你将负责GPU及相关产品在全生命周期内的性能优化与基准测试
工作涉及AI/LLM、游戏、工作站等负载的性能分析、自动化脚本开发与数据管道建设,需要扎实的Python能力和计算机体系结构知识
适合对性能优化有浓厚兴趣、希望深耕AI计算领域的技术人才
最低要求
拥有学士或硕士学位(BS/MS)
在计算机科学、电气工程、计算机工程或相关技术领域拥有2年以上同等实践经验
熟练掌握Python或其他脚本/编程语言
对AI/LLM工作负载、PC游戏、工作站应用和内容创作流程有实际操作兴趣
深入理解PC和服务器架构
具有处理大型数据集的经验,以及较强的分析和故障排查能力
出色的沟通、组织、时间管理和任务优先级排序能力
工作职责
设计和执行具有代表性的基准测试方法和真实用例,在服务器、PC、工作站、SoC和笔记本电脑上展示产品在AI/LLM、游戏、工作站、内容创建和系统工作负载方面的能力
分析性能指标和系统遥测数据,以识别瓶颈、回归和优化机会
生成清晰、数据驱动的竞争分析和技术报告,帮助内外部利益相关者有效定位NVIDIA产品
在Windows、Linux和MacOS上开发和调试各种基准性能和系统监控数据收集的自动化脚本
构建和维护可扩展的自动化框架、AI代理、仪表盘和数据管道,以提高测试效率、覆盖率和分析稳健性
优先资格
熟悉NVIDIA GPU及NVIDIA技术
了解AI推理或训练、微调概念
有构建、测试或运营AI平台和LLM推理栈的经验
有开发AI代理或智能体工作流的经验
了解容器化和虚拟化工作流,包括Docker、Kubernetes和虚拟机
AI 洞察
优缺点分析
优点
- 头部公司平台,能接触最先进的GPU技术和AI计算生态
- 工作领域极具前沿性,技能积累具有高市场价值
- 与全球顶尖工程师协作,职业视野广阔
- 英伟达技术影响力大,个人贡献能快速被认可
- 工作涉及多平台多负载,任务复杂度高,可能面临较大强度
- 适合对计算机体系结构和性能优化有浓厚兴趣,喜欢解决复杂技术问题的工程师
缺点 / 挑战
- 性能工程需要对系统有极深理解,技术门槛高,持续学习压力大
- 需要与多团队紧密配合,沟通成本较高
角色解读
- 在GPU性能优化领域形成深厚积累,可向资深性能工程师或架构师方向发展
- 依托英伟达平台,可横向拓展至AI平台开发、深度学习系统优化等前沿方向
- 具备成为技术领导者或项目管理者的潜力,逐渐参与更多产品级决策
- 设计并执行各类基准测试方法和真实场景,涵盖AI/LLM、游戏、工作站、内容创作等负载,覆盖服务器、PC、工作站、SoC及笔记本平台
- 分析性能指标与系统遥测数据,定位性能瓶颈、回归问题,提出优化方案
- 生成数据驱动的竞争分析和技术报告,帮助内外部利益相关者进行产品定位
- 开发与维护自动化脚本、自动化框架、AI代理、数据仪表盘和数据管道,提升测试效率与覆盖率
- 精通Python或其他脚本语言,具备扎实的编程能力
- 深入理解PC与服务器体系结构,熟悉底层硬件
- 具有大规模数据处理和分析能力,熟悉性能调优工具与方法论
- 对AI/LLM工作负载、游戏及内容创作流程有实际操作兴趣
申请策略
- 提前了解英伟达产品线(如GeForce、DGX)及性能测试工具(如Nsight)
- 在简历中量化你的性能优化成果,例如将某系统吞吐量提升X%
- 突出性能优化相关的项目经验,如基准测试、瓶颈分析、优化前后数据对比
- 强调Python编程能力,展示自动化脚本或工具开发成果
- 体现对AI/LLM、GPU等技术的了解,如使用过CUDA、TensorRT等
- 如果有处理大数据集或构建数据看板的经验,务必列出
- 深入学习GPU体系结构和并行计算知识,了解NVIDIA CUDA与TensorRT
- 加强AI推理/训练框架(如PyTorch、TensorFlow)的性能调优能力
面试指南
- 使用STAR法则:情境、任务、行动、结果,结合量化数据
- 强调系统思维:从硬件架构、操作系统、应用层综合考量
- 展示动手能力:结合具体工具和代码示例说明方案
- 请分享一个你主导过的性能优化案例,如何发现瓶颈并解决?
- 你如何理解GPU的性能指标?有哪些常用工具?
- 如何设计一套基准测试来评估AI/LLM推理性能?
- 解释一下CPU和GPU的架构差异及其对性能影响
- 在Linux环境下,你会如何排查CPU/内存/IO瓶颈?
职位点评
81
综合评分
英伟达上海性能工程师,接触AI/GPU前沿技术,薪资竞争力强,成长空间大,但需现场办公且加班情况未知。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
适合追求前沿技术成长、渴望在高性能计算和AI领域深入发展的工程师。
表现最好
成长发展
相对薄弱
工作生活
薪资福利85
成长发展92
工作生活55
使命价值88
薪资福利
85较高
英伟达作为行业头部企业,薪资福利通常优于市场平均水平,但JD未明确披露具体待遇。
薪资信号未披露(AI估算:30K-50K/月)
成长发展
92较高
岗位深度涉足AI/LLM、GPU性能优化等前沿领域,技术挑战大,成长空间广阔。
技术前沿前沿/新兴技术
技术栈Python、AI/LLM、GPU、Performance Tuning、Benchmarking、Automation、Data Pipelines、Docker、Kubernetes、AI Agents
业务类型profit_center
工作生活
55较低
JD未提及远程办公或弹性工时,按现场工作评估;办公地点与加班情况不明。
工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)
使命价值
88较高
参与AI与GPU前沿技术研发,对推动计算领域发展有直接价值。
行业发展高速增长赛道
社会影响正向社会影响力较高
使命信号make a lasting impact on the world
创新程度开拓性创新(行业首创)
英伟达 的其他在招职位
Circuit Design Engineer - Hardware
英伟达 · 上海市AI 估算 · 25k-45kSenior ASIC Verification Engineer - PMU
英伟达 · 上海市AI 估算 · 35k-55kSupplier Operations Program Manager
英伟达 · 深圳市AI 估算 · 30k-50kAI Infrastructure Software Engineer — CosmosLab
英伟达 · 上海市AI 估算 · 40k-70kSenior System Software Engineer, Modeling and Validation
英伟达 · 上海市AI 估算 · 30k-50k
相似职位推荐
Watch Jobs