
蚂蚁集团
蚂蚁集团-数据工程师-后端开发
蚂蚁集团-数据工程师-后端开发
发布于 大约 8 小时前普通员工/个人贡献者
上海市
高级经验
全职员工
仅现场办公
学历未注明
数据工程
Etl
Mybatis
Spring Cloud
具身智能
多模态数据
AI 估算 · 35k–60k
具身智能数据平台是前沿方向,Java后端+大数据技能稀缺,上海一线大厂薪资竞争力强,综合估算月薪3.5-6万。
职位详情
关于这个职位
该职位负责蚂蚁集团具身智能数据平台的后端设计与开发,支撑机器人/具身模型的数据采集、管理、处理、标注与训练数据构建等核心流程
你将参与ETL链路建设,设计高可用平台服务,并与算法、产品及机器人研发团队紧密协作,推动数据闭环效率提升
适合具备深厚Java后端经验并对AI数据平台感兴趣的技术人才
最低要求
-8 年 Java 后端开发经验,具备扎实的 Java 基础,熟悉 JVM、并发编程、多线程、集合及常见设计模式
有具身智能、机器人、自动驾驶、智能制造、AI 数据平台、算法平台、训练数据平台等相关行业或平台建设经验,其中具身智能/机器人数据平台经验优先
熟悉 Spring Boot、Spring Cloud、MyBatis 等主流 Java 技术栈,具备微服务架构设计和落地经验
熟悉大数据 ETL 流程,有数据接入、清洗、转换、调度、质量校验、任务监控、数据追踪等相关实践经验
熟悉 MySQL/PostgreSQL、Redis、Kafka、Elasticsearch 等常用数据库和中间件,具备良好的数据库设计和 SQL 优化能力
了解多模态数据处理场景,如图像、视频、语音、文本、传感器数据、机器人运行日志、轨迹数据、动作数据等
具备平台型产品建设经验,能够围绕复杂业务流程进行系统抽象、模块拆分和工程落地
具备良好的沟通协作能力、问题拆解能力和技术责任心,能够独立负责复杂模块设计与交付
工作职责
负责具身智能相关数据平台的后端设计与开发,支撑机器人/具身模型的数据采集、数据管理、数据处理、数据标注、训练数据构建等核心流程
参与具身智能数据 ETL 链路建设,包括多模态数据接入、清洗、转换、任务调度、数据质量校验、数据追踪与监控
建设高可用、可扩展的平台服务,支持数据集管理、任务流转、样本筛选、标注结果管理、训练数据版本管理等平台能力
与算法、数据、产品、机器人研发及基础设施团队协作,将业务流程抽象为通用平台能力,提升数据闭环效率
负责核心模块的架构设计、性能优化、稳定性治理、问题排查及工程质量提升
参与平台技术方案设计、代码评审、工程规范建设及关键技术选型
优先资格
有具身智能数据闭环、机器人数据平台、机器人训练数据管理、数据标注平台、模型训练数据平台建设经验优先
熟悉机器人数据链路,如遥操作数据、轨迹数据、动作序列、传感器数据、环境感知数据、任务执行日志等优先
有数据集管理、样本筛选、数据版本管理、数据血缘、元数据管理、数据质量平台建设经验优先
熟悉 Spark、Flink、Hive、ClickHouse、StarRocks、Trino、Airflow、DolphinScheduler 等一种或多种技术者优先
熟悉 Kubernetes、Docker、云原生部署、DevOps 或 MLOps 平台建设者优先
AI 洞察
优缺点分析
优点
- 技术栈全面,涉及Java、大数据、AI基础设施,个人技能提升快
- 团队协作紧密,能深入了解算法与机器人研发,拓宽技术视野
- 具身智能数据平台属于新兴方向,业务需求可能不明确,需要较强的抽象和工程能力
- 涉及多模态数据处理,技术复杂度高,需要持续学习和探索
缺点 / 挑战
- 蚂蚁集团平台大,技术挑战高,能接触到前沿的具身智能数据领域,经验和履历含金量高
- 互联网大厂节奏快,可能面临一定的工作压力和加班
- 适合有5-8年Java后端经验,对大数据和AI平台感兴趣,喜欢挑战复杂系统设计的工程师
角色解读
- 可向具身智能数据平台架构师方向发展,深入数据闭环与AI基础设施
- 有机会转型为具身智能领域的技术专家,积累机器人数据链路的稀缺经验
- 未来可晋升为技术Leader,带团队负责数据平台整体架构
- 负责具身智能数据平台的后端设计与开发,支撑数据采集、管理、处理、标注和训练数据构建等核心流程
- 建设ETL链路,处理多模态数据(图像、视频、语音、传感器等)的接入、清洗、转换和调度
- 设计高可用、可扩展的平台服务,包括数据集管理、任务流转、样本筛选和版本管理
- 与算法、产品、机器人研发团队协作,抽象业务流程为通用平台能力
- 扎实的Java基础,熟悉JVM、并发编程、常用设计模式
- Spring Boot/Spring Cloud微服务架构设计与落地能力
- 大数据ETL技术栈,熟悉Kafka、MySQL/PostgreSQL、Redis、Elasticsearch等
- 了解多模态数据特点,具备平台型产品建设经验
申请策略
- 关注蚂蚁集团在具身智能领域的布局,了解其业务方向和技术栈
- 在简历中明确写出与JD匹配的关键词,如'数据平台'、'ETL'、'多模态'
- 突出Java后端和微服务架构项目经验,尤其是高并发、高可用系统设计
- 重点展示大数据ETL相关项目,如数据接入、清洗、调度、质量监控等
- 如果有机器人、自动驾驶、AI平台相关经验,务必强调,这是加分项
- 描述平台建设能力,如何将复杂业务抽象为通用平台能力
- 补充学习具身智能/机器人数据链路的基本概念,如遥操作数据、轨迹数据、传感器数据
- 熟悉Spark、Flink等流批计算引擎,了解Kubernetes、Docker等云原生技术
面试指南
- 用STAR法则回答项目经历:背景-任务-行动-结果,突出个人贡献和技术难点
- 回答技术问题时,先给结论,再分点阐述原理和实际案例
- 对于开放式问题,要结合行业理解,展示学习热情和思考深度
- 请介绍你过去设计的数据平台架构,如何支撑大规模数据ETL流程?
- 在处理多模态数据(如图像、视频、传感器)时,你遇到过哪些挑战?如何解决?
- 如何保证数据平台的高可用性和数据质量?有什么实际经验?
- 谈谈你对具身智能数据平台的理解,与传统AI数据平台有什么区别?
- 在微服务架构中,如何设计任务调度和数据版本管理?
职位点评
71
综合评分
前沿具身智能数据平台,技术栈新,薪资优厚,但加班可能、WLB一般。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
该职位最适合重视技术成长和职业发展的求职者,能接受一定工作强度。
表现最好
成长发展
相对薄弱
工作生活
薪资福利72
成长发展85
工作生活50
使命价值70
薪资福利
72中等
蚂蚁集团提供具有市场竞争力的薪酬,平台稳定,但JD未列明具体福利,薪资信号未披露。
薪资信号未披露(AI估算:35K-60K/月)
成长发展
85较高
岗位涉及前沿具身智能领域,技术栈新,成长空间大,但JD未明确晋升机制。
技术前沿前沿/新兴技术
技术栈Java、Spring Boot、Spring Cloud、MyBatis、ETL、Kafka、Redis、Elasticsearch、Spark、Flink、Kubernetes、Docker、多模态
业务类型ambiguous
工作生活
50较低
未提及弹性工作或远程,互联网大厂通常节奏较快,工作强度可能较高,WLB一般。
工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)
使命价值
70中等
具身智能是未来重要方向,岗位有前瞻性,但日常工作偏基础设施,社会使命感一般。
行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
蚂蚁集团 的其他在招职位
相似职位推荐
Watch Jobs