
普通员工/个人贡献者
综合评分 80
阿里千问核心大模型团队,前沿Agentic评测岗,技术成长空间大,薪资竞争力强。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
2.8万
比数据标注与评测中位数低
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 3130 个在招 · 其中数据标注与评测 36 个
市场机会
选择适中
杭州 · 数据标注与评测 · 33 个在招
该职位隶属于阿里千问事业部,主要负责大模型在Agentic场景下的自动化评测集建设与能力诊断
深入理解大语言模型的能力边界与常见评测范式,具备独立设计完整评测方案的能力
建设面向产品Agentic场景(Search Agent、Office Agent、对话Agent、生活服务Agent等)的端到端评测集,量化模型在真实产品链路中的表现,并拆解到模型原子能力,确保评测粒度可拆解至独立能力维度
有1年以上大语言模型评测、AI产品质量评估或相关领域工作经验优先
优点
缺点 / 挑战
该岗位处于大模型核心业务线,结合1年以上经验要求,薪资预期处于市场较高水平。
岗位聚焦大模型前沿Agentic场景评测,能深度参与核心算法迭代,技术成长空间极大。
JD未明确提及办公模式与WLB相关信息,无法判断实际工作强度与通勤情况。
推动大模型在真实产品场景中的落地,助力AI技术演进,具有较高的行业使命感与技术价值。