
普通员工/个人贡献者
综合评分 79
核心AI基础设施岗,技术前沿且成长空间巨大,薪资竞争力强,但工作强度与排障压力可能较高。
从薪资福利、成长发展、工作生活和使命价值四个维度综合评估,方便横向比较。
薪资怎么样
5万
与DevOps/SRE中位数基本持平
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 3430 个在招 · 其中DevOps/SRE 27 个
市场机会
选择适中
杭州 · DevOps/SRE · 44 个在招
该岗位隶属于阿里云智能集团,主要负责设计和运维基于RDMA的高性能网络架构,支撑万卡级GPU等大规模AI训练集群
计算机科学、网络工程、电子工程等相关专业
)AI 训练集群网络架构设计与运维:部署、运维和维护基于 RoCE/InfiniBand 的 RDMA 网络架构,支撑大规模 AI 训练集群(如万卡级 GPU 集群)
有 RDMA 硬件(如 Mellanox/ConnectX 系列网卡)配置、调优经验
优点
缺点 / 挑战
该岗位属于核心技术基础设施研发,技术门槛高,结合整体薪酬体系,薪资竞争力强,但JD未明确披露具体薪资与福利细节。
岗位聚焦AI大模型底层高性能网络,技术栈极其前沿,能接触到万卡级集群等顶尖基础设施,技术成长与行业视野拓展空间巨大。
JD未明确说明工作模式与加班情况,但作为核心基础架构研发岗且涉及大规模集群运维,可能面临一定的突发故障处理压力,WLB情况无法确切判断。
岗位直接支撑AI大模型训练与推理的下一代网络基础设施,处于当前科技行业最具爆发力和战略意义的赛道,使命感与行业前景极佳。
阿里巴巴 的其他在招职位