
普通员工/个人贡献者
综合评分 76
前沿AI评测岗,技术成长性强,平台好,薪资有竞争力,但工作地点和WLB需进一步确认。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
30K
比人工智能中位数低
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 2480 个在招 · 其中人工智能 约 160 个
市场机会
选择面较广
北京 · 人工智能 · 约 220 个在招
该职位负责大语言模型(LLM)代码能力评测体系的全流程建设
计算机相关专业本科及以上学历,具备扎实的编程能力,熟练掌握 Python 及至少一门主流开发语言
负责代码评测集的建设、维护与迭代,覆盖 SWE-bench 系、Terminal-Bench、LiveCodeBench、BigCodeBench、SciCode 等主流评测集,把控子指标权重与维度聚合口径
优点
缺点 / 挑战
该职位薪资处于市场中上水平,公司平台成熟稳定,能提供有竞争力的薪酬福利。
该职位处于AI技术前沿,直接参与核心评测体系的构建,能快速提升对大模型能力的深刻理解和全栈数据处理能力,成长路径清晰。
工作地点位于北京,办公模式与加班情况JD未明确说明,可能面临互联网行业的常规工作节奏。
投身于人工智能这一高增长领域,通过构建科学的评测体系,为AI技术的良性发展和优化提供关键度量标尺,具有行业影响力。
阿里巴巴 的其他在招职位