ZTE logo
中兴通讯
AI评测资深专家

AI评测资深专家

发布于 大约 3 小时前

普通员工/个人贡献者

西安市
专家级经验
全职员工
仅现场办公
硕士
测试开发
Aiops
Ai评测
C-Eval
Rag
Ragas
大模型
数字孪生
智能体
质量保证

AI 估算 · 30k–60k

AI评测人才稀缺,中兴平台稳定,西安薪资中上,资深专家有溢价。

职位详情

关于这个职位

这是一个在中兴通讯担任AI评测资深专家的职位,负责构建智能体评测体系,设计多维评估框架,推动AI驱动的自主测试,并参与质量管理

你将接触到前沿的大模型、Agent、RAG等技术,需要8年以上系统架构或测试经验,并有硕士以上学历
适合希望在AI测评领域深入发展的资深技术专家

最低要求

教育背景与经验:

计算机、通信、人工智能等相关专业硕士及以上学历,8年以上大型系统架构或测试经验
熟悉智能体评测,AI驱动测试,有实际落地经验者优先
技术能力:
熟悉AI大模型原理、RAG架构、Agent行为机制
掌握AIOps、DevOps测试流程
精通评测方法论: 熟悉业界主流评测集(如MMLU, C-Eval)及自动化评测框架(如 Ragas, TruLens, Arize Phoenix),能设计多维度评测指标(准确率、时延、安全性等)
数据敏感度: 能够设计高质量的测试数据集(Golden Datasets),并运用统计学方法分析评测结果,产出有指导意义的优化报告,具备数据建模与统计分析能力
行业知识与解决问题能力:
具备端到端系统视角,能识别智能体在复杂环境中的潜在风险与失效模式
了解6G-AIOps与自智网络发展趋势,理解ToB业务痛点,能将技术架构与业务交付紧密结合
熟悉智能体生命周期管理方法论,包括版本控制、监控告警、安全审计与持续迭代机制
软技能与团队合作:
良好的沟通与协作能力,能够跨团队协作并推动项目进展
强烈的责任心和自驱力,具备在压力下完成高质量工作的能力

工作职责

构建智能体评测体系与落地

)构建覆盖“感知-分析-决策-执行”全链路的智能体评测体系,设计并实现包括准确性、安全性、幻觉率、指令遵循能力在内的多维评估框架
)推动建立公司级智能体准入机制,确保各类Agent在上线前通过标准化测试验证
)负责交付面向无线通信领域的AI评测智能体,并确保产品竞争力业内领先
实施智能体闭环测试与多智能体协同验证
)搭建仿真测试环境(含数字孪生网络),开展端到端闭环任务测试,评估智能体在真实或模拟场景下的任务完成率、响应时延与异常恢复能力
)验证多智能体间的通信效率、角色分工清晰度与协同流程稳定性,识别并防范幻觉传播、流程断点等问题
)支持“人机协同”模式下的自然语言交互测试,确保智能体能准确理解运维意图并合理调用工具
建设AI驱动的自主测试能力
)推动AI自动生成测试用例、自动执行回归测试、智能缺陷识别与根因定位,实现测试流程的“自测试、自优化”
)构建模型漂移检测机制,定期对智能体输出质量进行监控与预警,保障其长期运行可靠性
)训练优化测试大模型,推进知识回收机制,将测试过程中发现的新场景、新问题沉淀至RAG知识库,支撑智能体持续学习与进化
推动质量管理体系落地与改进,促进质量文化建设与经验共享
)协助部门负责人及质量总监开展质量管理,履行质量否决权,组织质量风险识别、跟踪与闭环
)负责本部门质量KPI达成与绩效提升,推动质量管理要求(如质量红线、白皮书)在团队内部落地执行
)总结智能体评测与AI测试最佳实践,形成可复用的方法论与案例库
前沿技术探索与落地
)跟踪前沿技术,规划技术路线图,确保产品技术竞争力处于行业第一梯队
)转化关键技术为核心专利(5G-A、6G、AI/ML)、构建通信领域Agent及AI/ML技术壁垒,打造行业技术影响力
)领导跨部门技术攻关小组及方案推进,指导团队完成关键技术突破,建立人才培养梯队

优先资格

加分项:

具备跨团队协作能力,能与数据科学家、网络工程师、产品团队高效协同
对具身智能、自主AI程序员(如Devin)等新兴方向有深入思考,能推动智能体向真实环境执行任务演进
在相关领域有论文发表、专利成果或开源项目经验者优先

AI 洞察

优缺点分析

优点

  • 前沿技术领域,接触大模型、Agent、数字孪生等先进技术,个人技能成长快
  • 中兴通讯作为跨国巨头,平台稳定,资源丰富,能参与大型项目
  • 有推动技术创新和贡献行业标准的机会
  • 涉及跨部门协作,推进难度大,需要较强的沟通和影响力
  • 公司流程可能较为复杂,创新落地可能需要克服体制阻力
  • 适合具有深厚技术背景,对AI质量保障和测试体系有热情,同时具备良好跨团队沟通能力的资深技术专家

缺点 / 挑战

  • 职位影响力大,负责构建公司级评测体系,有较高的话语权
  • 专业要求高,需要同时掌握AI、通信、测试等多领域知识,学习压力大

角色解读

  • 在AI评测领域深耕,成为公司级智能体质量保障的权威,推动行业标准建立
  • 向技术管理方向发展,带领团队完成关键技术突破,建立人才培养梯队
  • 通过前沿技术探索,在5G-A/6G、AI/ML领域形成核心专利,提升行业影响力
  • 构建智能体评测体系,设计覆盖感知、分析、决策、执行全链路的评测框架,确保AI Agent上线前通过标准化测试
  • 搭建仿真环境(含数字孪生网络),进行端到端闭环测试,评估智能体在真实场景下的任务完成率、时延和异常恢复能力
  • 推动AI驱动的自主测试,实现测试用例自动生成、回归测试自动执行、缺陷智能识别,并构建模型漂移检测机制
  • 参与质量管理体系,协助部门负责人进行质量风险识别和闭环,总结最佳实践
  • 熟悉AI大模型原理、RAG架构和Agent行为机制,理解AIOps和DevOps流程
  • 精通评测方法论,熟悉业界主流评测集和自动化评测框架,能设计多维评测指标
  • 具备数据敏感度,能设计高质量测试数据集并运用统计学分析结果,产出优化报告
  • 有端到端系统视角,能识别复杂环境下的风险与失效模式,并具备跨团队协作能力

申请策略

  • 建议提前了解中兴通讯在5G-A和6G的技术布局,在面试中展示对行业趋势的关注
  • 可以准备一个你主导过的评测体系案例,从设计到落地完整讲述,体现解决复杂问题的能力
  • 突出在智能体评测、AI测试方面的实际项目经验,展示具体落地成果
  • 强调对评测方法论和框架(如Ragas、TruLens)的掌握,以及设计评测指标的能力
  • 展示在大模型、RAG、Agent方面的技术积累,以及构建仿真测试环境的能力
  • 体现质量管理经验,如参与制定质量流程、达成质量KPI等
  • 深入学习AI Agent的评测标准和方法,熟悉业界最新评测集和工具
  • 补充数据建模和统计分析能力,掌握使用SPSS、Python等进行测试数据分析

面试指南

  • 使用STAR法则:先说明背景和目标,然后描述你采取的具体行动,突出你的角色和贡献,最后量化结果
  • 结合具体案例,强调方法论和工具的使用,展示你的系统性思维
  • 结尾总结经验和教训,体现持续改进和自驱力
  • 请描述你如何设计一个智能体评测体系?包括哪些维度和指标?
  • 如何评估大模型RAG系统在特定领域的性能?遇到过哪些挑战?
  • 你如何构建仿真测试环境进行端到端闭环测试?有哪些关键步骤?
  • 面对幻觉传播或流程断点等问题,你会如何识别和防范?
  • 你如何推动跨团队协作来落地质量体系?请举例

职位点评

71
综合评分

通讯巨头AI评测专家,前沿技术栈,成长空间大,薪资待谈,工作模式不明确。

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
该职位最适合追求技术成长和自我实现、对AI评测有浓厚兴趣并能接受一定工作压力的求职者。
表现最好
成长发展
相对薄弱
工作生活
薪资福利70
成长发展85
工作生活55
使命价值70

薪资福利

70中等

该职位位于大型通信企业,薪资未明确披露,但公司平台稳定,福利体系完善,补偿性动机得到一定满足。

薪资信号未披露(AI估算:30K-60K/月)

成长发展

85较高

职位聚焦前沿AI技术,有大量技术探索和人才培养机会,发展性动机得到较好满足。

技术前沿前沿/新兴技术
技术栈AI大模型、RAG、Agent、AIOps、DevOps、数字孪生、6G-AIOps、自智网络
成长机会人才培养梯队、持续学习与进化
业务类型ambiguous

工作生活

55较低

职位未明确远程或弹性工作,工作地点在西安,办公模式信息不足,生活化动机满足有限。

工作模式未明确
办公地点未明确
加班情况未提及(无法判断)

使命价值

70中等

职位通过AI评测确保产品可靠性和安全性,具有积极社会价值,但JD未突出使命导向,意义感动机中等。

行业发展高速增长赛道
社会影响正向社会影响力较高
创新程度积极采用新技术
Watch Jobs