
实习/见习
综合评分 78
大模型前沿算法实习岗,学术与工程双重培养,技术成长空间极大,但研究周期与强度要求较高。
从薪资福利、成长发展、工作生活和使命价值四个维度综合评估,方便比较实习机会。
薪资怎么样
9千
比机器学习工程中位数低
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 3100 个在招 · 其中机器学习工程 约 180 个
市场机会
选择面较广
北京 · 机器学习工程 · 约 460 个在招
该职位是阿里巴巴大模型数据评测算法方向的日常实习生,主要参与奖励模型研发、评测体系构建及数据合成技术创新
学历要求:高校在读博士生(特别优秀的硕士生可放宽限制),计算机、人工智能、软件工程、认知科学、脑科学或其他AI相关专业
裁判/奖励模型(Reward Model)研发:结合最前沿的训练技术(如 SFT、RLHF、DPO/PPO 等),构建 SOTA 级别的奖励模型,为业务侧强化学习(RL)提供核心动能
有顶级会议(如ACL, ICLR, NeurIPS, ICML, colm等)论文发表经验者优先
优点
缺点 / 挑战
暂无明显挑战项
实习津贴处于市场较高水平,且能直接参与核心业务,但作为实习岗位,整体薪酬绝对值受限于实习身份。
岗位处于大模型最前沿领域,提供顶会一作发表机会和专家1v1指导,学术与工程成长空间极大。
实习期要求不少于3个月且需沉下心推进完整研究,工作强度可能较大,未提及弹性工作或WLB相关福利。
致力于大模型评测与数据合成,推动AI技术从理论向实际场景转化,具有较高的技术使命感与行业前沿价值。