
普通员工/个人贡献者
综合评分 77
前沿AI对齐算法岗,技术成长天花板高,对齐使命明确,但工作模式与强度未知。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
45K
比人工智能中位数高
发布情况
正常在招 · 18 天前发布
公司情况
这家公司招聘很活跃
约 2450 个在招 · 其中人工智能 约 240 个
市场机会
选择面较广
杭州 · 人工智能 · 约 270 个在招
该职位是阿里巴巴通义千问(Qwen)大模型团队的RLHF算法专家,专注于大语言模型(LLM)的对齐与优化工作
计算机、机器学习、人工智能、自然语言处理等相关专业,硕士及以上学历
用户偏好采集与建模:设计并构建系统化的用户偏好数据采集方案,深入分析用户行为与反馈信号,建立多维度、可扩展的用户偏好表征与建模体系,为 Reward Model 训练提供高质量数据基础
熟悉主流 RL 训练框架(如 veRL )及大规模分布式训练方案(DeepSpeed、Megatron-LM、FSDP)
优点
缺点 / 挑战
该职位对薪资和福利有较好保障,但未在JD中明确说明具体数额和结构。
该职位处于AI大模型对齐技术的最前沿,技术挑战性极高,且有明确的职责推动前沿探索,能为求职者提供卓越的技术成长和职业发展平台。
JD未提及任何关于工作模式、办公时间或工作生活平衡的信息,无法判断其对生活化动机的满足程度。
该职位致力于提升大模型的安全性与人类价值观对齐,具有明确的社会价值导向,且AI对齐是当前人工智能领域的核心使命之一。
阿里巴巴 的其他在招职位