
实习/见习
综合评分 78
阿里Qwen核心团队研究型实习,前沿大模型RL技术栈,技术成长价值极高,WLB未明确。
从薪资福利、成长发展、工作生活和使命价值四个维度综合评估,方便比较实习机会。
薪资怎么样
9千
比机器学习工程中位数低
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 3340 个在招 · 其中机器学习工程 约 190 个
市场机会
选择面较广
北京 · 机器学习工程 · 约 480 个在招
该职位是阿里巴巴Qwen大模型团队的研究型实习生,主要参与强化学习(RL)算法在复杂任务、Agent推理与规划等场景的研究与优化
计算机、人工智能、自动化等相关专业在读硕士/博士
研究 PPO、GRPO 等强化学习算法,提升训推分离场景下大规模 RL 训练的稳定性与效率
有大模型 RL、Agent、代码生成、Reward Modeling 或大规模训练相关经验者优先
优点
缺点 / 挑战
作为头部科技公司的研究型实习岗,实习津贴在市场中处于中上水平,但具体薪资未披露,整体补偿性满足度较好。
岗位直接参与Qwen大模型核心演进,接触最前沿的RL与Agent技术,与顶尖专家共事,技术成长与科研发展价值极高。
JD未提及工作模式与作息安排,但研究型算法岗通常面临较高的科研与实验压力,WLB情况无法明确判断。
参与通用人工智能(AGI)底层基础模型的研发,推动大模型在复杂任务中的自主性,具有极高的行业前瞻性与科技探索意义。