JD logo
京东
国际产研-运维工程师

国际产研-运维工程师

发布于 大约 2 小时前

普通员工/个人贡献者

北京市
高级经验
全职员工
仅现场办公
本科
信息技术与基础设施
Aiops
Cdn
Dns
Go
Gpu
Llm
Jdc

AI 估算 · 25k–45k

大厂高级运维岗位,技能涵盖云原生、AI基础设施,市场需求旺盛,薪资具有竞争力。

职位详情

关于这个职位

该职位负责京东零售海外业务的基础设施运维,包括公有云管理、CDN优化、监控告警、自动化运维、AI基础设施保障及智能运维(AIOps)落地

需要5年以上经验,熟悉海外云平台、容器化、网络优化及AI工具应用
适合热爱技术、追求前沿、能适应跨时区协作的运维专家

最低要求

本科及以上学历,计算机、通信或相关专业,5年以上运维 / SRE / DevOps 相关经验

熟悉至少一种海外主流公有云平台,有多区域 / 海外节点部署与运维经验
熟悉容器与编排技术(Docker、Kubernetes),具备实际生产环境维护经验
掌握至少一种脚本语言(Shell / Python / Go),具备自动化运维能力
熟悉网络基础(TCP/IP、DNS、CDN、负载均衡、VPN 等),了解跨境网络优化方案
具备 AI 工具使用意识与能力,能熟练运用大模型(如 ChatGPT / Claude 等)辅助日常运维工作,提升效率
具备良好的英文读写能力,能够阅读英文文档并与海外团队 / 供应商进行书面沟通
责任心强,抗压能力好,能适应跨时区协作与值班安排

工作职责

管理基于公有云(JDC/ AWS / GCP / TCP 等)的基础设施,进行多区域、多可用区的架构部署与容灾设计

优化全球用户访问体验,负责 CDN、DNS、跨境网络专线、链路加速等的配置与调优,降低跨区域访问延迟
搭建并维护监控告警体系,及时发现并处理线上故障,主导或参与故障应急的排查、复盘与改进
编写自动化运维脚本与工具,推进 CI/CD 流水线、配置管理(Ansible / Terraform 等)与基础设施即代码(IaC)落地
保障海外业务的数据安全与合规,配合满足当地法规要求(如 GDPR 等数据保护规定)
负责 AI / 大模型相关基础设施的运维保障,包括 GPU 算力资源的调度管理、推理与训练环境的部署、AI 服务的稳定性与性能优化
推进 AIOps(智能运维)落地,利用 AI / 机器学习实现智能告警降噪、异常检测、根因分析(RCA)与容量预测,提升故障发现与处理效率
运用 AI 工具与大模型辅助运维提效,如自动化脚本生成、日志智能分析、智能问答与故障知识库建设等

AI 洞察

优缺点分析

优点

  • 技术栈前沿,涉及云原生、AI基础设施和智能运维,极具成长性
  • 京东作为头部电商,平台稳定,业务场景复杂,能积累大规模运维经验
  • 技术面要求广泛,需持续学习云服务、容器、网络、AI等多领域知识
  • 团队规模可能有限,个人需独立承担较多责任

缺点 / 挑战

  • 国际化业务带来多区域运维挑战,提升全球视野和跨文化协作能力
  • 需应对海外节点时差,可能涉及值班和应急响应,工作压力较大
  • 适合乐于挑战、技术追求强烈、能适应跨时区协作的资深运维工程师,尤其对云原生和AI运维感兴趣者

角色解读

  • 纵向成长为SRE专家或云架构师,主导大规模分布式系统设计
  • 横向向AI基础设施方向深耕,成为AIOps/MLOps专家
  • 可转向技术管理岗,带领运维团队负责海外业务稳定性
  • 管理海外公有云基础设施,设计多区域容灾架构,确保服务高可用
  • 优化全球CDN、DNS及跨境网络,降低用户访问延迟
  • 搭建监控告警和AIOps体系,利用AI实现智能故障检测与根因分析
  • 维护GPU算力集群,支持AI/大模型训练推理环境,提升资源利用率
  • 深入掌握至少一种海外公有云平台(AWS/GCP等)及跨区域部署经验
  • 精通Docker、Kubernetes,有生产环境容器编排经验
  • 熟练Shell/Python/Go,能编写自动化脚本和运维工具
  • 具备AI工具使用能力(如ChatGPT),能利用大模型辅助运维提效

申请策略

  • 面试前了解京东零售海外业务布局,思考如何优化现有基础设施
  • 准备一个完整的故障处理或架构优化案例,用STAR法则展现技术深度
  • 突出海外云平台(AWS/GCP等)的实际运维项目,尤其是多区域部署和容灾经验
  • 展示容器化(K8s)生产环境的维护案例,包括集群规模、故障处理等
  • 强调自动化运维成果,如CI/CD流水线、IaC脚本(Terraform/Ansible)编写
  • 如有AI工具辅助运维或AIOps实践,务必详细描述
  • 若海外云平台经验不足,可先通过AWS/GCP认证快速补强
  • 学习AIOps相关工具(如ELK、Prometheus、Grafana)和机器学习基础

面试指南

  • 对于架构设计类问题,采用「场景-方案-权衡」结构:先描述业务背景,再给出架构设计及选型理由,最后说明优缺点和容灾策略
  • 对于故障排查类问题,采用「现象-排查-根因-解决-预防」流程,强调系统性思考和自动化手段
  • 对于AI应用类问题,突出实际效果:用什么工具、解决了什么问题、带来了多少效率提升
  • 请描述你设计过的一个跨区域云架构,如何保证高可用和灾备?
  • Kubernetes集群中遇到Pod调度不均或资源瓶颈时,如何排查和解决?
  • 如何利用AI工具或AIOps方法提升运维效率?请举例说明
  • 海外业务网络延迟高,你会从哪些方面优化CDN和跨境链路?
  • 面对突发故障(如云服务商故障),你的应急响应流程是什么?

职位点评

69
综合评分

大厂高级运维,技术栈前沿,薪资优厚,但需现场办公和弹性值班。

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
最看重技术成长和前沿栈的工程师,对工作时间灵活性要求不高,愿意接受一定值班压力。
表现最好
成长发展
相对薄弱
工作生活
薪资福利75
成长发展85
工作生活40
使命价值65

薪资福利

75中等

虽然JD未明确薪资和福利,但京东作为上市大厂,薪资水平处于市场前列,且通常包含五险一金、补充医疗等福利,对补偿性动机满足度较高。

薪资信号未披露(AI估算:25K-45K/月)

成长发展

85较高

该职位涉及云原生、AI基础设施、AIOps等前沿技术,能极大提升个人技术深度和广度,但JD未明确晋升通道或培训机制,发展性动机满足度较高但有提升空间。

技术前沿前沿/新兴技术
技术栈JDC、AWS、GCP、Docker、Kubernetes、Terraform、Ansible、GPU、AIOps、LLM
业务类型cost_center

工作生活

40较低

JD要求能适应跨时区协作与值班安排,且为现场办公,没有明确WLB信号,生活化动机满足度较低。

工作模式仅现场办公
办公地点市区核心地段
加班情况明确要求弹性/高强度

使命价值

65中等

京东作为行业巨头,业务稳定;AI基础设施运维对社会数字化转型有间接贡献,但整体社会影响力为中性,使命感不强。

行业发展稳定成熟行业
社会影响中性/一般
创新程度积极采用新技术
Watch Jobs