Lilith logo
莉莉丝
游戏运维开发工程师

游戏运维开发工程师

发布于 大约 10 小时前

普通员工/个人贡献者

上海市
中级经验
全职员工
仅现场办公
本科
信息技术与基础设施
CI/CD
云原生
故障排查
混合云
自动化运维

AI 估算 · 20k–40k

游戏大厂莉莉丝,上海运维开发岗位,技术栈前沿,薪资竞争力强,中高端人才月薪2-4万较为普遍。

职位详情

关于这个职位

作为游戏运维开发工程师,您将负责公司游戏业务的日常运维保障,包括故障处理、容灾策略、CI/CD流程优化以及成本管控

您需要深入理解业务架构,推动云原生和AIOps技术落地,提升系统稳定性和运维效率
这是一个技术深度与广度兼具的岗位,适合热爱挑战、追求自动化的运维工程师

最低要求

计算机相关专业本科及以上学历,具备较强的问题分析和解决能力

熟悉主流公有云厂商的云产品,有混合云组网经验者优先
熟悉K8s云原生体系,有大规模使用公有云容器服务部署线上业务的经验者优先
熟悉至少一门脚本语言,如Shell、Python等,能够编写自动化脚本提升运维效率
具备Golang开发经验者优先
熟悉Linux操作系统、网络基础、常见中间件和服务排障方法,具备线上问题定位和应急处理能力
具备优秀的文档能力和意识,能够沉淀故障复盘、运维规范、发布流程、应急预案和知识库内容
具备良好的责任心、沟通协作能力和线上风险意识,具备良好的团队意识,能够在高压场景下快速响应并推动问题闭环

工作职责

独立负责公司游戏业务的日常运维保障工作

对业务常见异常和故障原因具备深入理解,能够结合实际场景提出可行的容灾策略、高可用方案和稳定性优化建议
具备较强的应用故障分析和处理能力,能够独立应对线上突发问题
深入理解业务流水线和研发流程,接入代码检查、测试服发布、正式服发布、灰度发布、回滚等研发效能流程
有成本意识,熟悉业务运营过程中的成本构成,能够提出并推进成本优化方案
推动游戏运维场景中的先进技术落地实践,包括故障根因辅助定位、巡检报告生成、运维知识库问答等方向
沉淀和维护运维知识库、故障案例库、SOP文档,并结合大模型能力优化知识检索、问答和复盘生成体验

优先资格

加分项:有游戏行业运维、游戏服务器架构、全球化游戏发行或大规模在线业务保障经验

AI 洞察

优缺点分析

优点

  • 莉莉丝是知名游戏公司,平台稳定,技术氛围浓厚,可参与大规模在线业务保障,实战经验丰富
  • 技术栈前沿(云原生、大模型应用),有利于个人技术成长和职业竞争力
  • 岗位包含成本优化和智能化运维,能培养业务敏感度和创新思维
  • 游戏业务对在线率要求高,故障处理需快速响应,可能面临高压和突发情况
  • 涉及混合云、K8s等多技术领域,需要持续学习,知识广度要求高
  • 需要较强的沟通协作能力,与研发、测试等多部门协调推进流程优化

缺点 / 挑战

  • 适合有2-5年运维经验、热爱自动化、对云原生技术感兴趣、乐于在游戏中挑战高可用场景的工程师

角色解读

  • 可向运维架构师方向发展,负责大规模分布式系统的稳定性设计
  • 也可转向SRE或DevOps方向,深入自动化运维和研发效能领域
  • 积累游戏行业经验后,可成为技术专家或团队管理者,负责整体运维体系规划
  • 负责游戏业务的日常运维,包括监控、故障处理和容灾演练,保障服务高可用
  • 参与CI/CD流水线建设,推动代码检查、灰度发布、回滚等研发效能工具链的落地
  • 利用云原生技术(K8s、混合云)优化资源利用率,降低运营成本
  • 沉淀运维知识库,结合大模型实现故障辅助定位和智能问答,提升运维智能化水平
  • 深入掌握Linux操作系统、网络协议和常见中间件(如Nginx、Redis)的排障能力
  • 精通至少一门脚本语言(Python/Shell),能编写自动化脚本
  • 有Golang开发经验更佳
  • 熟悉K8s云原生生态,有大规模容器化部署和运维经验
  • 熟悉主流公有云(如阿里云、AWS)产品,具备混合云网络管理经验

申请策略

  • 关注莉莉丝游戏技术博客或开源项目,了解其技术栈文化,在面试中展示共鸣
  • 准备一个从故障到优化的完整案例(背景、分析、解决、沉淀),体现系统性思维
  • 重点突出K8s、混合云的实际运维经验,如大规模集群管理、容器编排、服务发现等案例
  • 展示自动化脚本开发成果,例如用Python/Shell实现的监控、部署或故障恢复脚本
  • 强调故障处理实战经历,包括故障复盘、SOP文档编写和优化成果
  • 如有游戏行业或大流量分布式系统经验,务必标注
  • 若对K8s不熟,可快速学习并考取CKA认证,或自己搭建集群实践
  • 补充Golang开发能力,能提升自动化工具和Operators的开发潜力

面试指南

  • STAR法则(Situation, Task, Action, Result)用于故障案例,清晰展示分析过程
  • 对于架构设计类问题,从需求出发,提出多方案对比,强调高可用、可扩展和成本
  • 技术实现类问题,分步骤阐述:现状→目标→方案→验证,体现工程化思维
  • 请描述一次你处理过的线上重大故障,你是如何定位根因并确保不再发生的?
  • 你们公司的CI/CD流程是怎样的?如何实现灰度发布和回滚?
  • 谈谈你对K8s的掌握程度,如何设计一个高可用的服务架构?
  • 如何评估并优化云资源成本?你有哪些具体的优化手段?
  • 你了解大模型在运维领域的应用吗?如何设计一个故障辅助定位系统?

职位点评

71
综合评分

游戏大厂运维开发岗,技术前沿,成长性强,但工作节奏较快,WLB一般。

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
最适合追求技术成长、挑战高并发场景、乐于学习新技术的求职者,对WLB要求不高。
表现最好
成长发展
相对薄弱
工作生活
薪资福利75
成长发展85
工作生活50
使命价值60

薪资福利

75中等

莉莉丝作为知名游戏公司,薪资福利在行业中上水平,且公司自负盈亏,稳定性较好。但JD未详细列出具体福利,薪资明确度一般。

薪资信号未披露(AI估算:20K-40K/月)

成长发展

85较高

岗位技术栈前沿(云原生、大模型),涉及自动化与智能化运维,成长空间大。JD中多次强调推动先进技术落地,且要求沉淀知识库,有很强的学习导向。

技术前沿前沿/新兴技术
技术栈K8s、云原生、混合云、大模型、AIOps
成长机会故障案例库、知识库
业务类型ambiguous

工作生活

50较低

岗位要求快速响应突发问题,可能涉及on-call,工作节奏与压力较大。JD未提及弹性工时或远程办公,默认现场办公,WLB一般。

工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)

使命价值

60中等

游戏运维保障玩家体验,具有一定的使命感,但主要属于技术支撑角色。行业增长稳定,莉莉丝产品线成熟,社会影响力有限。

行业发展稳定成熟行业
社会影响中性/一般
使命信号保障工作、稳定性优化
创新程度积极采用新技术
Watch Jobs