普通员工/个人贡献者
AI 估算 · 30k–50k
该职位负责设计并开发大规模GPU集群调度系统,包括任务队列管理、资源分配、拓扑感知调度、多集群联邦调度等核心模块,并参与异构芯片的统一资源抽象与调度适配
计算机科学、软件工程等相关专业本科及以上学历,3年以上分布式系统或云原生平台开发经验
设计并开发大规模GPU集群调度系统核心模块,包括但不限于:任务队列管理、资源分配引擎、训推混部调度、弹性伸缩控制面
有万卡以上规模GPU集群调度系统的设计或开发经验
暂无 AI 洞察数据