AgiBot logo
智元机器人
大模型预训练研究员

大模型预训练研究员

发布于 大约 15 小时前

普通员工/个人贡献者

北京市 / 上海市
高级经验
全职员工
仅现场办公
硕士
研究与开发 (研发)
Vla
Vlm
具身智能
大模型预训练
强化学习
指令微调
数据构建
模型结构设计

AI 估算 · 30k–60k

大模型预训练研究员属于高技能稀缺岗位,市场竞争力强,结合北京上海薪酬水平,预估月薪3-6万。

职位详情

关于这个职位

该职位专注于机器人具身操纵场景下的VLA算法设计与研发,涉及大模型预训练、指令微调和强化学习等前沿技术

你将深入研究VLM/VLA预训练,优化模型训练范式与数据配比,推动技术突破并在业务中落地
适合具有扎实深度学习背景、对具身智能充满热情的研究型人才

最低要求

研究生及以上学历,计算机、AI、Robotics等相关专业优先

优秀的问题分析与解决能力,能够深入解决大模型训练及应用中的复杂问题
具备数据构建、指令微调及模型开发经验
熟悉大模型相关技术,对大模型预训练、指令微调、RL等方向有深入研究和实践

工作职责

聚焦机器人具身操纵场景,负责VLA相关算法的设计与研发

深入研究VLM,VLA预训练前沿技术,提升算法的准确性与效率
在模型训练范式、模型结构、数据配比探索最佳实践方案,取得业务效果大幅提升的同时实现前沿技术突破
持续跟踪VLM,VLA领域的最新技术动态,并将其应用于实际业务场景中,推动技术落地

优先资格

有Pretrain研究或应用经验者优先,熟悉具身领域预训练方法者优先

以第一作者在ICML、ICLR、NeurIPS、ACL、RSS、ICRA等顶级学术会议发表过高影响力研究成果者优先
在ACM/ICPC、NOI/IOI、Kaggle等编程或AI竞赛中获奖者优先
主导或参与过具有广泛影响力的具身开源或闭源项目者优先

AI 洞察

优缺点分析

优点

  • 接触最前沿的大模型和具身智能技术,技术含量高,成长空间大
  • 公司处于高速发展期(B轮),技术影响力机会多,成果易被关注
  • 团队水平高,能向顶级研究者学习,积累高质量项目经验
  • 研究到落地的周期不确定,可能面临业务快节奏的要求
  • 行业竞争激烈,需要不断产出高影响力成果
  • 适合热爱前沿AI研究、有扎实理论基础、愿意在具身智能领域深耕的技术型人才

缺点 / 挑战

  • 技术难度高,需要持续学习和跟踪最新动态,压力较大

角色解读

  • 成为大模型预训练领域的资深研究员或技术专家,主导关键技术方向
  • 可晋升为技术团队负责人,带领团队攻克前沿难题
  • 未来可转向AI架构师或创业,在具身智能赛道发挥更大影响力
  • 设计并实现VLA算法,提升机器人操纵能力,解决具身场景中的复杂任务
  • 深入研究VLM/VLA预训练技术,优化模型训练范式、模型结构和数据配比
  • 跟踪领域最新技术动态,将前沿成果落地到实际业务中,推动技术突破
  • 熟练掌握大模型预训练、指令微调、强化学习等核心技术
  • 具备优秀的编程能力(如Python)和深度学习框架使用经验(如PyTorch)
  • 有数据构建、模型开发和问题分析解决经验
  • 了解具身智能和机器人学基础知识

申请策略

  • 提前调研公司具身产品和技术路线,在面试中展现对业务的思考
  • 准备2-3个技术深度项目,能够清晰阐述技术难点和解决方案
  • 突出大模型预训练或微调项目经验,尤其是与VLM/VLA相关的经历
  • 强调顶会论文、竞赛获奖、开源项目等可量化的成果
  • 展示数据处理和模型优化方面的具体案例,体现问题解决能力
  • 深入学习VLM/VLA相关论文,熟悉典型模型架构和训练方法
  • 加强强化学习(RL)实践,了解Reward Modeling、PPO等
  • 了解机器人仿真平台(如MuJoCo、Isaac Gym),提升具身场景理解

面试指南

  • 使用STAR方法(情境-任务-行动-结果)结构化回答,结合具体项目细节,突出技术深度和问题解决逻辑
  • 对于开放性问题,展示思考框架和对比分析能力
  • 请解释VLA模型的工作原理,并对比VLM和VLA的区别
  • 描述一次你参与大模型预训练的经验,遇到了哪些挑战?如何解决?
  • 如何设计数据配比以提升模型在特定任务上的性能?
  • 在训练大模型中遇到loss不收敛或OOM问题,你会如何调试?
  • 你怎样跟踪具身智能领域的前沿进展?最近有哪些突破让你印象深刻?
  • 复习Transformer、扩散模型、RLHF等基础知识,理解核心技术细节

职位点评

64
综合评分

大模型预训练研究岗,技术前沿,薪资高阶,工作强度较高

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
该职位最适合追求技术成长、愿意高强度投入的求职者,不太适合看重工作生活平衡的人。
表现最好
成长发展
相对薄弱
工作生活
薪资福利60
成长发展85
工作生活40
使命价值70

薪资福利

60中等

薪资未在JD中明确披露,但根据岗位稀缺性和市场水平,预期薪资较高;福利未提及,整体满足度中等。

薪资信号未披露(AI估算:30K-60K/月)

成长发展

85较高

技术前沿且成长空间大,涉及预训练、强化学等最新技术,但JD未明确提及晋升通道,略有限制。

技术前沿前沿/新兴技术
技术栈大模型预训练、VLM、VLA、RL、指令微调
业务类型profit_center

工作生活

40较低

仅现场办公,地点北京上海,工作强度可能较大,JD未提及弹性或WLB,生活平衡满足度较低。

工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)

使命价值

70中等

具身智能+大模型属于高速增长赛道,技术前沿且有突破性意义,社会影响中性,整体满足度高。

行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
Watch Jobs