
普通员工/个人贡献者
综合评分 72
AI 评测前沿技术岗,技术挑战高,成长空间大,但工作强度与生活平衡需权衡。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
53K
比人工智能中位数低
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 2800 个在招 · 其中人工智能 6 个
市场机会
选择面较广
北京 · 人工智能 · 约 170 个在招
加入小红书 Agent 平台,负责 AI 大模型评测平台的核心研发,涵盖平台架构、评测数据生产、自动化流水线、深度诊断与开发者工具链
本科及以上学历,计算机、软件工程、人工智能等相关专业优先
评测平台架构与建设:负责 LLM 及 AI 应用评测平台的架构设计与核心开发,构建对基座大模型、多模态(图/文/音/视)、Agent 及各类 Tools/Skills 的自动化评测能力
主导或深度参与过主流评测框架(如 OpenCompass、DeepEval、LangSmith 等)的开发
优点
缺点 / 挑战
该职位为高级技术岗,薪资水平在市场中上,但 JD 未提及具体福利,补偿性动机满足程度中等偏上。
该职位处于 AI 评测前沿领域,技术挑战高,成长空间大,发展性动机满足程度高。
JD 未提及工作模式与 WLB 相关信息,且岗位位于一线城市,通勤与生活成本较高,生活化动机满足程度有限。
该职位强调评测是 AI 产品的生命线,对推动 AI 迭代有直接价值,意义感动机满足程度较高。