
普通员工/个人贡献者
综合评分 72
前沿AI核心技术岗,技术成长性极强,薪资有竞争力,但WLB信息不明。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
55K
比人工智能中位数高
发布情况
新岗位 · 2 天前发布
公司情况
这家公司招聘很活跃
约 2560 个在招 · 其中人工智能 约 240 个
市场机会
选择面较广
杭州 · 人工智能 · 约 280 个在招
负责在强化学习(RL)数据与模型训练环节设计核心评分规则(Rubric)与奖励信号(Reward),确保模型训练效果与数据质量
有实际 RL/RFT 训练经验,理解 reward 设计、rubric 与训练效果的关系,能独立跑通训练闭环
Rubric 与 Reward 设计:和领域专家一起,把领域的专业判断(漏洞是否成立、时序是否收敛、回答是否可用等)拆成可自动化验证的评分规则
优点
缺点 / 挑战
作为大型科技公司上市企业的核心技术岗,薪资待遇通常处于市场较好水平,但JD未明确说明具体薪酬福利,存在一定不确定性。
职位聚焦AI前沿领域的强化学习数据工程与规则设计,技术挑战高,且明确要求‘设计→训练→反查’的迭代闭环,能提供极强的技术成长驱动力。
JD未提及任何关于工作模式、弹性工时或工作强度的信息,结合岗位性质(算法设计与训练验证),现场办公和一定强度的投入可能性较高。
岗位工作直接服务于AI大模型训练效果提升,属于当前科技行业的核心价值创造环节,具有较高的技术创新性和业务影响力。
阿里巴巴 的其他在招职位