
普通员工/个人贡献者
综合评分 81
AI前沿技术岗,主导代码与Agent评测体系,成长性极强,薪资有竞争力,WLB与加班情况需进一步确认。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
38K
比人工智能中位数低
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 2550 个在招 · 其中人工智能 约 230 个
市场机会
选择面较广
杭州 · 人工智能 · 约 260 个在招
负责主导设计并构建面向代码生成(Code Intelligence)与智能体(Agent)的评测基准与体系,定义模型能力边界
对代码生成与智能体领域有深入理解和判断,能清晰阐述“什么是好的代码能力”和“什么是好的 Agent 能力”,并将其转化为可量化的评测维度
主导设计并构建面向代码生成与智能体的评测基准,涵盖能力维度拆解、任务难度分级、数据集构造、评分标准制定等全流程,具备从 0 到 1 打造高区分度评测集的能力
研发背景、在代码智能或 Agent 评测领域有学术发表或开源项目贡献(如参与 SWE-bench、BigCodeBench 等项目建设)
优点
缺点 / 挑战
作为大型科技集团的专家级岗位,薪资竞争力预期较强,平台稳定。但JD未明确列出具体福利项。
岗位聚焦于AI领域最前沿的代码智能与Agent评测,技术门槛高,能深度参与构建评测体系,直接接触模型能力核心,成长空间和专业积累价值极高。
工作地点在杭州或北京,均为一线城市。JD未明确办公模式与加班情况,但基于跨团队协作和项目制工作性质,可能需要较高的现场办公灵活性和一定的工作投入。
该岗位通过定义评测标准来推动AI在编程和自动化任务上的进步,直接服务于提升生产力,具有明确的行业创新价值和技术使命感。