
智元机器人
具身感知算法工程师-通用业务部
具身感知算法工程师-通用业务部
发布于 大约 16 小时前普通员工/个人贡献者
上海市
中级经验
全职员工
仅现场办公
硕士
具身智能
Lidar
Pytorch
Vla
Vlm
三维重建
具身智能
多传感器融合
多模态模型
深度估计
AI 估算 · 25k–45k
该职位位于上海,涉及具身智能前沿领域,技能要求较高,薪资有竞争力,由于未在JD中披露,基于行业水平估算。
职位详情
关于这个职位
该职位聚焦具身智能机器人的空间感知能力,负责3D视觉感知、多传感器融合及感知-规划联合模型研发
你将参与VLA等具身基础模型的研究,构建数据闭环,推动算法落地
适合对机器人、3D视觉和深度学习有热情的算法工程师
最低要求
硕士及以上学历,计算机、机器人、人工智能等相关专业
具备计算机视觉或深度学习项目/科研经验,熟悉视觉语言模型(VLM)、多模态模型或大模型相关技术
熟练掌握PyTorch等深度学习框架,具备模型训练、调优、推理优化及工程落地能力
具备独立算法研发能力,能够完成数据处理、模型训练、实验分析、性能评测及失败案例定位
工作职责
负责3D视觉感知算法研发:围绕双目/单目深度估计、三维重建、3D场景理解、Occupancy预测等方向,提升机器人空间感知能力
攻关复杂环境下多模态感知问题:研究多相机、LiDAR等多传感器融合,跨视角特征交互、时空信息建模及动态环境理解
负责感知-规划联合模型研发:研究3D视觉表征、多模态融合与Planner/Policy模型协同优化,提升机器人空间理解、行为预测与自主决策能力
探索具身基础模型中的3D空间理解能力:面向VLA/WMA等模型,构建视觉-语言-空间联合表征,研究3D场景理解、多模态对齐与空间推理方法
建立数据闭环与模型评测体系:负责多模态数据采集、自动化标注、难例挖掘、仿真/真实场景评测及算法持续优化
优先资格
顶级会议论文、专利或开源贡献经验(CVPR、ICCV、ECCV、NeurIPS、ICLR、RSS、CoRL等)
具备3D视觉基础模型或多模态大模型经验(VLM、Vision-Language-3D等)
具备大规模机器人数据闭环、仿真环境(Habitat、Isaac、Omniverse等)或具身智能系统研发经验
AI 洞察
优缺点分析
优点
- 处于具身智能高速发展赛道,技术前沿性强,个人成长空间大
- 涉及3D视觉、多模态、大模型等多个热门方向,技能积累丰富
- 公司专注机器人领域,有实际落地场景,能接触真实机器人平台
- 团队研发氛围浓厚,有利于发表论文和专利
- 算法研发难度高,需要同时掌握视觉、深度学习和机器人知识
- 工作强度可能较大,需快速迭代算法并处理复杂工程问题
- 具身智能领域尚未成熟,技术路线存在不确定性
缺点 / 挑战
- 适合对机器人、3D视觉和AI充满热情,喜欢挑战前沿技术难题的算法工程师
角色解读
- 从算法工程师成长为具身智能领域的专家,深入VLA、空间智能等前沿方向
- 可向技术管理方向发展,带领团队负责核心感知模块
- 有机会参与从研究到产品的全链路,积累机器人落地经验
- 负责机器人3D视觉感知算法研发,包括深度估计、三维重建、场景理解等核心模块
- 研究多传感器(相机、LiDAR)融合方法,提升复杂环境下的感知鲁棒性
- 参与感知与规划联合模型开发,推动VLA等具身基础模型的空间理解能力
- 构建数据采集、标注、评测闭环,支撑算法的持续迭代
- 扎实的计算机视觉和深度学习基础,熟悉3D视觉相关任务
- 熟练掌握PyTorch,具备模型训练、调优和部署经验
- 了解VLM、多模态模型或大模型技术,有相关项目经验
- 具备独立研究和工程实现能力,能解决复杂技术问题
申请策略
- 提前了解智元机器人的产品和技术方向,在面试中展现你对具身智能的热情
- 准备一个能体现你算法工程能力的项目案例,并详述你在其中的贡献
- 突出3D视觉或深度学习的项目/科研经历,尤其是与机器人感知相关的成果
- 强调VLM、多模态模型或大模型相关经验,展示对前沿技术的理解
- 如有顶级会议论文或开源贡献,务必重点提及
- 描述数据处理、模型训练到部署的完整项目闭环能力
- 补充机器人感知相关的基础知识,如相机模型、点云处理、SLAM等
- 学习主流的VLA模型和具身智能框架(如RT-2、PaLM-E等)
面试指南
- 使用STAR法则(情境-任务-行动-结果)结构化描述项目经验,突出你的独立贡献和最终效果
- 对于算法设计问题,先明确问题定义,再分析挑战,然后提出方案并比较不同方法的优劣
- 表达对具身智能行业趋势的理解,展示你对该领域的热爱和长期发展的意愿
- 请介绍一个你参与的3D视觉或深度学习项目,你在其中负责什么?
- 你如何设计一个双目深度估计模型?有哪些关键优化点?
- 多传感器融合(如相机和LiDAR)有哪些常见方法?如何应对时空对齐问题?
- 你对VLA(Vision-Language-Action)模型有什么理解?如何提升其空间推理能力?
- 如何构建一个数据闭环来持续优化机器人感知模型?
职位点评
74
综合评分
具身智能前沿算法岗,技术成长快,薪资有竞争力但未披露,WLB未知。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
该职位最适合重视技术成长和行业前沿的求职者,愿意投入精力攻克算法难题,对具身智能有浓厚兴趣的人。
表现最好
成长发展
相对薄弱
工作生活
薪资福利65
成长发展90
工作生活60
使命价值85
薪资福利
65中等
职位薪资未在JD中披露,但作为B轮公司上海算法岗,整体薪酬有竞争力,福利待遇需面谈确认。
薪资信号未披露(AI估算:25K-45K/月)
成长发展
90较高
该职位聚焦具身智能前沿技术,涉及3D视觉、多模态模型和VLA等方向,技术成长空间巨大,能显著提升算法研发和工程落地能力。
技术前沿前沿/新兴技术
技术栈3D视觉、深度估计、三维重建、Occupancy预测、多传感器融合、LiDAR、VLM、多模态模型、PyTorch、VLA
业务类型ambiguous
工作生活
60中等
工作地点为上海,未明确工作模式与加班情况。算法研发岗位可能面临较高工作强度,但具体需面试确认。
工作模式未明确
办公地点未明确
加班情况未提及(无法判断)
使命价值
85较高
具身智能是未来AI重要方向,岗位直接参与机器人核心算法研发,有助于推动机器人智能落地,行业前景广阔。
行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
智元机器人 的其他在招职位
相似职位推荐
Watch Jobs