
普通员工/个人贡献者
综合评分 78
前沿技术、高薪、发展空间大,但工作强度可能较高。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
65K
比人工智能中位数高
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 110 个在招
市场机会
选择适中
深圳 · 人工智能 · 22 个在招
该职位专注于大语言模型的后训练算法研发与智能体(Agent)架构设计,涉及SFT、强化学习(DPO/GRPO等)及多智能体协同机制
计算机科学、人工智能、数学或相关专业毕业,本科及以上学历(硕士或博士优先)
负责大语言模型LLM后训练阶段的核心算法研发与模型迭代,包括但不限于SFT、Reward Model训练以及强化学习DPO,GRPO,GSPO,Agentic RL等,持续提升模型作为Agent大脑的逻辑推理能力、指令遵循能力
有LLM后训练、强化学习、智能体(Agent)或计算机视觉等人工智能方向相关顶级会议(如ACL、NeurIPS、ICLR、CVPR等)论文发表者优先
优点
缺点 / 挑战
该职位为高级算法专家,薪资水平预计较高,且公司为上市公司,福利体系相对完善,但具体薪资未在JD中披露。
该职位处于AI大模型和Agent技术的最前沿,技术挑战大,成长空间广阔,且明确要求跟踪业界前沿技术,发展性极强。
JD未提及工作模式,但作为AI Lab的核心算法岗位,通常需要现场办公,工作强度可能较高。
该职位致力于推动AI技术在实际业务中的落地,解决模型幻觉等实际问题,具有较高的技术价值和社会意义。
深信服 的其他在招职位