
普通员工/个人贡献者
综合评分 75
前沿大模型Agent后训练岗,技术成长空间极大,薪资有竞争力,但办公模式与工作强度待确认。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
4.5万
比算法优化工程师中位数高
发布情况
新岗位 · 今天发布
公司情况
公司还在招多个职位
9 个在招
市场机会
选择面较广
北京 · 算法优化工程师 · 约 220 个在招
该职位负责企业微信大模型Agent的后训练工作,通过设计与实施SFT、奖励模型、强化学习等方案,提升模型在真实业务场景下的规划、推理、工具调用及指令遵循能力
计算机、人工智能、机器学习、数学等相关专业,硕士及以上学历,具备扎实的计算机基础与算法基础,2年以上相关领域工作经验
参与 Agent 大模型的后训练工作,在 SFT、奖励模型、强化学习等方向进行方案设计、数据构建与训练落地,持续提升真实场景下的规划、推理、工具调用与指令遵循能力
熟悉数据构建与评估体系,有强化学习环境搭建、奖励模型训练或高质量指令/偏好数据合成经验者优先
优点
缺点 / 挑战
职位属于高技术门槛的前沿领域,市场人才稀缺,薪资水平通常具有较强竞争力。JD未提及具体福利,补偿性满足主要依赖于薪酬本身。
职位直接切入大模型与Agent最核心的后训练技术环节,技术挑战大、前沿性强,能为从业者提供极佳的技能成长和行业视野提升机会。
JD未明确提及办公模式、工作时间或WLB相关信息。作为大型企业的核心技术岗位,其工作强度可能较高,生活化动机的满足程度存在不确定性。
将前沿AI技术应用于亿级用户的产品(企业微信)中,具有明确的业务价值和社会影响力。行业处于高速增长阶段,技术落地能带来强烈的使命感和成就感。