Alibaba logo
阿里巴巴
阿里云智能-AI性能优化技术专家-软硬协同加速-杭州

阿里云智能-AI性能优化技术专家-软硬协同加速-杭州

发布于 大约 2 小时前

普通员工/个人贡献者

杭州市
专家级经验
全职员工
仅现场办公
本科
算法优化工程师
Ai推理
Cuda
Gpu优化
大模型
性能优化
性能分析
深度学习
算子优化
软硬协同

AI 估算 · 50k–80k

AI性能优化为高需求技术专家岗,阿里云平台提供高薪酬,结合杭州市场水平,月薪中位数约6.5万。

职位详情

关于这个职位

作为阿里云智能的AI性能优化技术专家,你将专注于解决大模型等场景下的算力和访存瓶颈,通过软硬协同的方式提升AI模型在GPU等硬件上的部署性能和效率

你将负责业界领先的性能优化算法创新与工程落地,构建高性能AI基础设施,为云业务创造核心价值
该职位需要深厚的深度学习知识、扎实的工程能力以及对GPU硬件和算子优化的深入理解

最低要求

熟悉深度学习算法,对AI深度学习相关知识和技术栈有清晰的理解和系统性的认知

熟悉AI部署和推理流程,工程能力强,具备独立工程研发、性能分析和落地能力
熟悉常见的性能分析及优化加速方法
熟悉硬件,有GPU优化和算子优化相关经验和能力
学习和研究能力强,能够快速掌握新领域和新技术,并具备创新能力
思考沟通表达能力强

工作职责

负责研发AI类算法的计算性能优化能力,解决大模型等情境的算力和访存瓶颈,提升AI模型在GPU、AI加速器等硬件上部署性能和效率,推动大模型普惠应用和高性价比的竞争力

负责研发业界SOTA的计算性能优化算法创新和工程落地,增强技术壁垒,并在云的商业业务中产生核心价值
负责高性能AI基础设施的构建,基于软硬结合的计算性能优化能力,在AI类业务场景尤其是大模型场景下,通过结合模型算法和硬件来充分挖掘软硬协同的组合优化潜力,实现单一领域无法达到的优化边界和收益,带来高价值的性能和成本优势

AI 洞察

优缺点分析

优点

  • 技术前沿性:专注于大模型和AI加速器优化,是当前AI领域最核心的技术方向之一
  • 平台优势:阿里云作为头部云厂商,提供大规模GPU集群和丰富的业务场景
  • 商业价值高:性能优化直接带来成本降低和竞争力提升,个人价值体现明显
  • 软硬结合:有机会深入接触硬件架构,技术壁垒高,职业发展空间大
  • 技术难度高:需要同时精通算法、系统和硬件,学习曲线陡峭
  • 竞争激烈:该领域人才济济,需要持续学习和创新才能保持优势

缺点 / 挑战

  • 工作强度大:大模型迭代快,性能优化任务紧迫,可能面临较大工作压力
  • 适合对AI底层技术有浓厚兴趣,具备扎实的深度学习、系统编程和硬件知识,喜欢挑战高难度技术问题,并希望在AI基础设施领域深耕的工程师

角色解读

  • 技术专家路线:在AI性能优化领域深耕,成为软硬协同优化方向的权威专家
  • 技术管理路线:未来可带领团队,负责更大规模AI基础设施的性能优化和架构设计
  • 业务影响力路线:通过性能优化直接提升云产品竞争力,对商业化产生核心影响
  • 负责AI算法(尤其是大模型)在GPU等硬件上的性能优化,解决算力和访存瓶颈,提升部署效率
  • 研发业界领先的计算性能优化算法,并推动其工程落地,为云业务创造核心价值
  • 构建高性能AI基础设施,通过软硬协同设计,挖掘组合优化潜力,实现性能和成本优势
  • 精通深度学习算法和主流AI技术栈,对大模型训练和推理流程有深入理解
  • 具备扎实的工程能力,能独立进行性能分析、优化和落地,熟悉常见性能分析工具
  • 熟悉GPU硬件架构和算子优化,有CUDA、Triton等编程经验者优先
  • 具备出色的学习和研究能力,能快速掌握新技术,并有良好的沟通表达能力

申请策略

  • 了解阿里云在AI基础设施和性能优化方面的布局,如PAI、灵骏等产品
  • 在面试中多展示对软硬协同优化的理解,以及如何将技术转化为业务价值
  • 突出GPU算子优化、CUDA编程、性能分析等具体项目经验,量化性能提升成果
  • 强调对大模型推理引擎(如vLLM、TensorRT-LLM)的优化经验
  • 展示在深度学习算法和系统架构方面的综合能力,以及独立解决复杂问题的能力
  • 如有相关论文、开源项目或技术博客,务必在简历中体现
  • 系统学习CUDA编程和GPU架构,掌握NVIDIA Nsight等性能分析工具
  • 深入研究大模型推理优化技术,如量化、蒸馏、算子融合、KV Cache优化等

面试指南

  • STAR法则:清晰描述项目背景、任务、行动和结果,突出量化指标
  • 结构化思维:从算法、算子、系统、硬件等多个层面系统性地分析问题
  • 强调软硬结合:在回答中体现对硬件架构的理解,以及如何与算法结合进行优化
  • 请详细描述你做过的一个GPU算子优化项目,包括性能瓶颈分析、优化方案和最终效果
  • 如何优化一个Transformer模型在GPU上的推理性能?请从算法、算子、系统层面分别阐述
  • 你对CUDA中的内存访问模式、共享内存、Warp调度等概念的理解?
  • 如何分析一个AI模型的性能瓶颈?你常用哪些性能分析工具?
  • 谈谈你对大模型时代AI性能优化挑战和机遇的看法

职位点评

76
综合评分

技术前沿、成长空间大、薪资竞争力强,但工作强度高、WLB一般。

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
适合追求技术前沿、渴望在AI性能优化领域深耕,并愿意接受高强度工作挑战的工程师。
表现最好
成长发展
相对薄弱
工作生活
薪资福利80
成长发展95
工作生活40
使命价值85

薪资福利

80较高

阿里云作为头部云厂商,薪酬福利具有竞争力,但具体薪资未披露,且高强度工作可能影响稳定性。

薪资信号未披露(AI估算:50K-80K/月)

成长发展

95较高

该职位处于AI技术前沿,涉及软硬协同优化,技术挑战大,成长空间广阔,是技术专家发展的理想平台。

技术前沿前沿/新兴技术
技术栈深度学习、GPU、AI加速器、大模型、性能优化、软硬协同
业务类型profit_center

工作生活

40较低

职位要求现场办公,未提及弹性工作制,且AI优化任务强度高,工作生活平衡可能面临挑战。

工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)

使命价值

85较高

该职位致力于推动大模型普惠应用,通过性能优化降低算力成本,具有较高的技术价值和社会意义。

行业发展高速增长赛道
社会影响正向社会影响力较高
使命信号推动大模型普惠应用
创新程度积极采用新技术
Watch Jobs