
波克城市
资深云原生基础设施工程师(Kubernetes/云网络方向)
资深云原生基础设施工程师(Kubernetes/云网络方向)
发布于 大约 14 小时前普通员工/个人贡献者
上海市
高级经验
全职员工
仅现场办公
本科
DevOps/SRE
Ack
Calico
Cilium
Cni
Csi
Ebpf
Eks
Go
Tke
AI 估算 · 35k–55k
资深云原生专家,要求高,游戏行业稳定,薪资竞争力强。
职位详情
关于这个职位
作为资深云原生基础设施工程师,你将负责公司多云Kubernetes集群的架构治理、生产运维与稳定性保障,深入解决容器网络、存储等复杂问题,并参与游戏业务的重要活动保障
该职位要求扎实的Kubernetes和云网络功底,适合有大型互联网或游戏行业经验的技术专家
最低要求
全日制本科及以上学历,计算机相关专业,5 年及以上运维、SRE、平台工程或云原生基础设施经验,具备大型互联网、游戏或高并发业务生产经验
具备扎实的 Linux 和 TCP/IP 基础,能够独立分析生产环境中的网络、存储、性能及稳定性问题
具备完整的 Kubernetes 生产实践,熟悉集群运维、资源调度、服务发布、滚动升级、容量规划、故障恢复和性能优化
深入理解 Kubernetes 网络体系,能够讲清并排查 Pod、Service、kube-proxy或eBPF、Ingress/Gateway、CNI、NetworkPolicy与云 LB 之间的完整流量链路
熟悉 Cilium、Calico、Kube-OVN或云厂商 CNI 中至少一种
熟悉公有云网络,具备 VPC、子网、路由、安全组/NACL、ENI、负载均衡、对等连接等实际经验
能够从 Kubernetes 配置追踪至云平台控制台或 API 完成问题定位
熟悉 Kubernetes 存储体系,理解 PV/PVC、StorageClass、动态供给、扩容、快照及备份机制,具备云盘或文件存储 CSI 的生产实践和故障处理经验
具备至少两类 Kubernetes 环境的生产经验,其中至少一类为 ACK、TKE、EKS或GKE等托管 Kubernetes
能够独立承担相关环境的运维和优化
具备自动化与工程化能力,熟悉 Shell、Python或Go中的至少一种,有平台治理、运维自动化或基础设施标准化项目经验
责任意识和风险意识良好,能够参与游戏业务值班、应急响应及重大活动保障
工作职责
负责公司云原生基础设施的架构治理、生产运维与稳定性保障,覆盖多云托管 Kubernetes 集群及相关网络、存储、调度、发布和故障恢复能力
深入负责 Kubernetes 数据面与公有云基础设施,重点建设和治理 CNI、CSI、VPC、负载均衡、DNS、路由、安全组、ENI、NetworkPolicy等能力,解决跨节点、跨可用区及多云环境中的复杂网络与存储问题
逐步承接业务运维侧的 VPC 网络职责,梳理从公网或内网入口、云 LB、VPC、节点到 Service、CNI及Pod的完整流量路径,建立自主排障和稳定性保障能力
负责 ACK、TKE、EKS、GKE 等多云托管 Kubernetes 环境的运维、治理与优化,推动集群基线、容量管理、弹性扩缩容、发布回滚和资源治理标准化
参与游戏业务的部署交付、线上保障和重大活动保障,承担必要的值班及应急响应,在复杂故障中负责核心定位与处置,推动问题复盘和闭环整改
与平台工程、研发、安全等团队协作,完善监控、告警、日志、Event和链路追踪等排障闭环
推动多集群、安全治理及云原生能力的工程化落地
沉淀云原生基础设施相关文档、SOP、排障手册和最佳实践,提升团队对云网络、容器网络及存储体系的接管能力
优先资格
eBPF、Cilium、Hubble或容器网络性能优化经验
多集群管理、跨集群服务发现或跨地域部署经验
NetworkPolicy、零信任或与安全团队协同治理经验
AWS EKS、海外业务或游戏行业经验
Service Mesh、Operator、Admission Webhook、GitOps实践
CNCF 项目贡献经历
AI/AI Agent在智能运维、故障分析或平台提效方面的实践
AI 洞察
优缺点分析
优点
- 公司稳定,不需要融资,业务持续盈利,工作稳定性高
- 技术栈前沿,涉及多云、Kubernetes、eBPF等,能积累高价值技能
- 团队协作紧密,有平台工程、研发等支持,能提升综合能力
- 技术深度要求高,需要持续学习,保持对新技术敏感度
缺点 / 挑战
- 游戏行业业务场景复杂,能接触高并发和复杂网络问题,挑战性强
- 需要参与值班和应急响应,可能面临非工作时间的工作压力
- 涉及多云环境,需要处理不同云厂商的差异,复杂度较高
- 适合有多年Kubernetes和云网络经验,热爱技术,能承受一定工作压力,追求稳定平台的技术专家
角色解读
- 可向云原生架构师或平台工程负责人方向发展,负责更大规模基础设施的架构设计
- 可深入容器网络、eBPF等前沿技术,成为技术专家
- 有机会参与AI运维等创新实践,拓展技术视野
- 负责多云Kubernetes集群的架构治理和日常运维,确保集群稳定、高效运行
- 深入解决容器网络和存储问题,包括CNI、CSI、VPC等,保障跨节点、跨可用区的通信
- 参与游戏业务的部署和重大活动保障,承担值班和应急响应,快速定位并解决故障
- 与平台工程、研发、安全团队协作,完善监控、告警、日志等排障体系,推动基础设施标准化
- 扎实的Linux和TCP/IP基础,能独立分析网络、存储和性能问题
- 深入理解Kubernetes网络体系,熟悉Cilium、Calico等CNI插件
- 熟悉公有云网络(VPC、安全组、负载均衡等)和存储CSI机制
- 具备自动化能力,熟悉Shell、Python或Go,有平台治理或运维自动化经验
申请策略
- 了解波克城市的游戏业务,在面试中体现对业务的理解
- 强调对稳定性保障的重视,展示应急处理能力
- 突出Kubernetes生产环境的运维经验,包括集群规模、故障处理案例
- 强调网络和存储方面的具体项目,如CNI选型、VPC规划、CSI使用
- 展示自动化脚本或平台开发经验,体现工程化能力
- 如有游戏行业或大型互联网背景,务必突出
- 深入学习Cilium和eBPF,了解最新网络技术
- 熟悉主流云厂商的托管Kubernetes服务(ACK、TKE、EKS等)
面试指南
- 使用STAR法则回答行为问题,突出情境、任务、行动和结果
- 技术问题从底层原理出发,结合实践经验,展示分析思路
- 强调故障处理中的系统性思维,如从监控、日志、链路追踪入手
- 如何排查Kubernetes集群中Pod间网络不通的问题?
- 描述一次你处理过的复杂故障,你是如何定位和解决的?
- 如何设计一个多集群的Kubernetes网络方案?
- 谈谈你对Cilium和eBPF的理解,以及它们如何提升网络性能?
- 在云环境中,如何确保存储的可靠性和性能?
职位点评
68
综合评分
技术前沿、薪资稳定,但工作强度大,适合技术专家。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
适合追求技术成长、能接受一定工作压力、重视稳定性的求职者。
表现最好
成长发展
相对薄弱
工作生活
薪资福利75
成长发展85
工作生活40
使命价值60
薪资福利
75中等
公司稳定,薪资竞争力强,但具体福利未在JD中明确。
薪资信号未披露(AI估算:35K-55K/月)
成长发展
85较高
技术前沿,涉及Kubernetes、eBPF等,有较大成长空间,但晋升路径未明确。
技术前沿前沿/新兴技术
技术栈Kubernetes、Cilium、eBPF、CNI、CSI、VPC、Go、Python
业务类型ambiguous
工作生活
40较低
工作地点固定,需要值班和应急响应,可能影响工作生活平衡。
工作模式仅现场办公
办公地点未明确
加班情况JD含高强度暗示词
使命价值
60中等
游戏行业稳定,但社会价值一般,技术驱动性强。
行业发展稳定成熟行业
社会影响中性/一般
创新程度积极采用新技术
波克城市 的其他在招职位
相似职位推荐
Watch Jobs