
百度
AI效能与质量保障(J104103)
AI效能与质量保障(J104103)
发布于 大约 16 小时前普通员工/个人贡献者
深圳市
中级经验
全职员工
仅现场办公
本科
测试开发
Eval
Go
测试
质量保障
AI 估算 · 25k–40k
AI方向测试岗位,技能要求高,薪酬有竞争力,百度平台加持,综合估算月薪25-40k。
职位详情
关于这个职位
加入百度AI效能与质量保障团队,你将负责服务端产品的质量保障工作,利用AI工具和AI原生测试方法提升测试效率与覆盖度
你会参与制定测试策略、开发测试工具,并将质量标准转化为可执行的Eval/Benchmark体系,推动质量保障前置到研发环节
这是一个技术前沿、成长空间大的岗位,适合对AI应用充满热情的测试工程师
最低要求
本科及以上学历,计算机专业优先
具有一定的服务端产品的测试经验,了解服务端各个纬度的测试方法
能熟练地应用如java、Python、go等至少一门语言,基于vibecoding进行软件开发
工作职责
使用AI工具做服务端产品质量保证工作
参与软件产品的需求分析,负责测试计划和方案制定,并能预先评估质量风险
通过AI等技术手段完善测试方案,持续提升监控覆盖率以及敏感度,引进和开发各种工具来提高测试效率
探索并落地AI原生测试工作方式:将质量标准转化为机器可执行的Eval/Benchmark体系,推动质量拦截前置到研发Agent生成环节,构建人机协同的测试Workflow
优先资格
有广告业务和AI工程化相关经验者优先
具备AI First/AI Native思维方式者优先,包括但不限于:
能将隐性的质量经验(安全红线、验收标准、埋点规范等)显性化为机器可读的Eval标准
能借助AI快速生成测试用例、构造边界数据、辅助复现问题,形成人机协同测试流程
具备设计针对AI生成代码/Agent产出的评测集(覆盖异常路径的"地狱级测试集")经验
清楚AI测试能力边界,知道哪些场景必须人工介入,并能设计双重校验机制
能快速适应AI生成代码带来的新型缺陷模式,灵活调整测试策略
AI 洞察
优缺点分析
优点
- 处于AI与测试交叉的稀缺赛道,技术前沿,技能成长快
- 百度平台大,业务场景丰富,可深度参与广告等核心业务的质量保障
- 借助AI工具能大幅提升工作效率,学习最新测试方法论
- 互联网大厂竞争激烈,绩效和业务节奏较快
- 适合对AI技术充满热情、喜欢探索新工具的测试工程师,能适应快节奏并追求技术深度
缺点 / 挑战
- AI技术迭代快,需要持续学习和适应,可能带来较大压力
- 测试工作部分环节重复,需要主动创新才能体现价值
角色解读
- 从测试工程师向AI测试专家发展,深耕AI原生质量保障领域
- 横向拓展至AI工程化、研发效能或DevOps,拓宽职业路径
- 可晋升为技术专家或测试团队管理者,带领团队推进质量体系升级
- 使用AI工具进行服务端产品的质量保障,制定测试计划和方案,评估质量风险
- 通过AI技术优化测试流程,提升监控覆盖率和敏感度,开发自动化测试工具
- 构建AI原生测试体系,将质量标准转化为Eval/Benchmark,推动质量拦截前置
- 与研发和AI团队协作,设计人机协同测试流程,适应AI生成代码的新缺陷模式
- 掌握Python/Java/Go至少一门语言,能基于vibecoding进行软件开发
- 熟悉服务端测试方法和工具,具备质量风险分析和测试设计能力
- 了解AI工具和AI原生测试理念,能够设计评测集并理解AI能力边界
- 具备逻辑思维和问题解决能力,能快速适应新技术变化
申请策略
- 了解百度AI战略和文心一言等产品,在面试中展示对百度的认同和关注
- 准备一个完整的AI辅助测试项目,用数据说明效率提升效果
- 突出服务端测试经验,特别是测试方案设计、风险评估和自动化工具开发案例
- 展示编程能力,列出用Python/Java/Go实现的具体测试项目
- 强调任何AI相关实践,例如使用AI生成测试用例、构建评测集或参与AI项目测试
- 学习AI提示词工程,掌握用AI生成测试用例和边界数据的技巧
- 了解Eval/Benchmark体系,熟悉RAG、LLM评测等前沿技术
- 阅读AI生成代码缺陷模式的案例,积累人机协同测试经验
面试指南
- 结合具体案例,从规则梳理、标准化建模到机器执行的过程
- 采用需求分析→测试设计→AI辅助生成→人工审核→持续迭代的框架
- 强调人机协同,明确AI的能力边界和必须人工介入的场景
- 如何将隐性的质量经验转化为机器可读的Eval标准?
- 你如何利用AI生成测试用例并保证覆盖率?
- 面对AI生成代码带来的新型缺陷,你的测试策略是什么?
- 请描述一次你用AI工具提升测试效率的经历
- 你如何理解AI原生测试与传统测试的区别?
职位点评
69
综合评分
百度AI测试工程师,前沿技术栈,薪资竞争力不错,但WLB一般。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
适合追求技术成长、对AI应用充满热情的测试工程师,能接受互联网快节奏。
表现最好
成长发展
相对薄弱
工作生活
薪资福利70
成长发展85
工作生活50
使命价值65
薪资福利
70中等
职位未提及具体薪资和福利,但百度作为大型上市公司,薪酬体系完善,稳定性强,但信息不足。
薪资信号未披露(AI估算:25K-40K/月)
成长发展
85较高
该职位聚焦AI原生测试,技术前沿,涉及Eval/Benchmark等新兴领域,有丰富的技能成长机会。
技术前沿前沿/新兴技术
技术栈AI、Eval、Benchmark、Agent、vibecoding
业务类型ambiguous
工作生活
50较低
职位未提及工作与生活平衡,互联网大厂通常节奏较快,现场办公模式,生活方式满足度一般。
工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)
使命价值
65中等
该职位通过AI技术提升测试效率,对软件质量有积极贡献,但社会影响力相对中性。
行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
百度 的其他在招职位
相似职位推荐
Watch Jobs