
实习/见习
综合评分 78
头部企业大模型前沿算法实习岗,技术成长空间极大,聚焦AI安全与对齐,WLB情况未知。
从学习成长、工作节奏、岗位方向和实习待遇综合评估,方便比较实习机会。
薪资怎么样
1.2万
比NLP工程中位数低
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 3080 个在招 · 其中NLP工程 29 个
市场机会
选择适中
杭州 · NLP工程 · 32 个在招
该职位主要负责大语言模型(LLM)的偏好对齐与强化学习研究,包括用户偏好建模、Reward Model训练与优化、以及LLM Judge体系建设
计算机、机器学习、人工智能、自然语言处理等相关专业在读
用户偏好采集与建模:设计并构建系统化的用户偏好数据采集方案,深入分析用户行为与反馈信号,建立多维度、可扩展的用户偏好表征与建模体系,为 Reward Model 训练提供高质量数据基础
熟悉主流 RL 训练框架(如 veRL )及大规模分布式训练方案(DeepSpeed、Megatron-LM、FSDP)
优点
缺点 / 挑战
暂无明显挑战项
作为头部企业的算法研究实习岗,实习津贴在市场中处于较高水平,但实习生身份在整体薪酬福利体系上不及正式员工。
岗位聚焦大模型最前沿的偏好对齐技术,能接触到顶尖的算力资源与海量数据,技术成长空间与学术/工程影响力极大。
JD未明确提及工作模式与加班情况,但大模型算法研究岗通常面临较高的研发压力与迭代节奏,WLB情况无法准确判断。
致力于大模型的安全对齐与人类偏好学习,推动AI技术向善,具有较高的社会价值与行业使命感。