
普通员工/个人贡献者
综合评分 81
前沿技术栈与高成长空间的大模型核心评测岗,薪资竞争力强,但工作节奏与挑战并存。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
3.5万
比数据标注与评测中位数高
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 2910 个在招 · 其中数据标注与评测 31 个
市场机会
选择适中
北京 · 数据标注与评测 · 17 个在招
该职位主要负责大语言模型(LLM)的人工评测竞技场设计与运营,包括题库构建、排名算法维护及AI Agent办公助手类产品的端到端评测
计算机、统计学、数据科学等相关专业本科及以上学历,具备大模型评测、数据分析或产品测评相关工作经验
负责 LLM 人工评测竞技场(Arena)的整体设计与运营,统筹题库构建、对战机制、评委组织与排名算法
优点
缺点 / 挑战
该岗位属于前沿技术方向,对统计学与数据分析复合能力要求较高,市场同类岗位薪资具备较强竞争力,能较好满足补偿性动机。
岗位处于大模型与AI Agent最前沿,能深度参与行业级评测榜单建设,技术成长与行业视野拓展空间极大。
JD未明确提及工作模式与WLB信息,无法准确判断工作强度与生活平衡情况,生活化动机满足程度中等。
参与大模型能力边界的探索与行业评测标准的制定,工作成果对推动AI技术健康发展具有显著的正向社会价值。