Agora logo
声网
AI软件测试工程师

AI软件测试工程师

发布于 1 天前

普通员工/个人贡献者

上海市
初级经验
全职员工
仅现场办公
本科
软件工程
Asr
Grpc
Llm
Pytest
Tts
Unittest
Websocket
自动化测试
语音测试

AI 估算 · 15k–25k

AI测试岗位技术门槛较高,但要求初级,上海大厂薪资中等偏上,综合估算15-25K。

职位详情

关于这个职位

加入声网AI产品团队,负责语音/对话式AI产品的质量保障工作

你将参与LLM、多轮对话、实时语音交互等前沿领域的测试设计与执行,构建自动化测试框架,评估模型输出质量,推动产品迭代
适合对AI测试充满热情、追求技术成长的初级工程师

最低要求

本科及以上学历,计算机、软件工程、电子信息等相关专业优先

应届毕业生或1-2年测试开发相关工作经验,有音视频测试、SDK/API测试、AI Agent开发相关经验者优先
熟悉至少一种编程语言(Python / Java 优先)
对软件测试有基础认知(需求转换、测试方法、用例设计等)
具备 Codex / Cursor 等 AI IDE 编程能力

工作职责

参与对话式 AI 产品的测试方案设计与测试用例编写

针对 LLM、多轮对话、语音交互等场景进行专项测试
构建和执行自动化测试(API / SDK / 端到端)
设计评估指标(如:回答准确率、上下文一致性、延迟等)
协助定位问题(模型问题 / 工程问题 / prompt 问题)
与研发、产品协作推动质量改进

优先资格

有自动化测试经验(pytest / unittest / 接口测试等)

有 AI 相关项目经验(课程项目 / 实习 / 竞赛)
熟悉 HTTP / WebSocket / gRPC 等协议
了解语音技术(ASR / TTS)
参与过开源项目或技术社区

AI 洞察

优缺点分析

优点

  • 处于AI前沿赛道,接触LLM、语音交互等热门技术,技能积累快
  • 声网作为实时互动领域的上市公司,平台大,技术氛围浓厚
  • 岗位涉及测试与AI交叉领域,职业发展空间广阔
  • 有机会参与自动化测试框架和评估体系建设,锻炼架构能力
  • AI测试缺乏成熟方法论,需要较强的学习和问题定位能力
  • 适合对AI充满热情、有较强编程和测试基础、希望在技术深度上快速成长的初级工程师或应届生

缺点 / 挑战

  • 工作涉及多轮对话、语音等复杂场景,测试设计难度较高
  • 可能面临模型效果不稳定带来的重复测试和回归压力

角色解读

  • 从初级测试工程师成长为AI测试专家,深入理解模型评估和系统稳定性
  • 可向测试开发或AI质量架构方向进阶,主导测试平台建设
  • 积累AI领域经验后,可转型为AI产品经理或AI解决方案工程师
  • 负责设计对话式AI系统的测试方案,编写覆盖LLM、多轮对话、语音交互的测试用例
  • 构建和执行自动化测试框架(API/SDK/端到端),提升测试效率
  • 设计评估指标(如准确率、一致性、延迟),并协助定位模型、工程或prompt问题
  • 与研发和产品团队协作,推动质量改进和产品迭代
  • 熟悉Python或Java,能编写自动化测试脚本
  • 掌握软件测试基础理论和用例设计方法
  • 了解LLM、语音技术(ASR/TTS)和AI Agent的基本原理
  • 具备使用AI IDE(如Codex、Cursor)辅助编程的能力

申请策略

  • 在求职信中表达对AI测试的兴趣,可结合声网的实时互动场景
  • 了解声网的产品和AI战略,体现对业务的理解
  • 突出AI相关项目经验(如LLM应用、语音识别、对话系统测试),尤其是自动化测试实践
  • 强调编程能力(Python/Java)和测试工具(pytest、unittest)的使用经验
  • 展示对测试方法的理解,如用例设计、边界分析、缺陷跟踪
  • 如有开源贡献或技术博客(AI方向),重点呈现
  • 提前学习LLM、ASR/TTS的基本概念和评估方法
  • 熟悉HTTP/WebSocket/gRPC协议,能进行接口测试

面试指南

  • 针对测试设计问题,先明确测试范围(功能/性能/安全),再分模块(模型、工程、交互)提出测试方法和指标
  • 对于区别类问题,从确定性vs概率性、输入输出复杂性、评估指标差异等角度对比
  • 对于自动化问题,描述工具选型(pytest/locust)和测试架构(模拟客户端、断言逻辑)
  • 请设计一个测试方案,评估一个LLM驱动的客服对话机器人的质量
  • 如何测试语音识别(ASR)的正确率和延迟?
  • 请举例说明如何对多轮对话的上下文一致性进行测试
  • 你认为AI测试与传统软件测试最大的区别是什么?
  • 如何自动化测试一个基于WebSocket的实时语音交互系统?

职位点评

67
综合评分

AI测试初级岗位,前沿技术栈,成长空间大,但WLB和福利不明确。

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
该职位最适合发展性动机强的求职者,希望快速积累AI测试技能,对薪资和WLB要求不苛刻。
表现最好
成长发展
相对薄弱
工作生活
薪资福利60
成长发展85
工作生活50
使命价值70

薪资福利

60中等

薪资水平中等偏上,但JD未明确具体福利,且作为初级岗位,稳定性较高但薪资竞争力一般。

薪资信号未披露(AI估算:15K-25K/月)

成长发展

85较高

该岗位涉及前沿AI技术(LLM、语音),有大量技能成长机会,但JD未明确晋升通道或培训机制。

技术前沿前沿/新兴技术
技术栈LLM、ASR、TTS、AI Agent、自动测试
业务类型ambiguous

工作生活

50较低

仅现场办公,未提及弹性工作或WLB,上海通勤压力较大,加班情况不明。

工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)

使命价值

70中等

AI行业高速增长,社会影响力中性,产品聚焦实时互动有一定创新性,但使命导向不明显。

行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
Watch Jobs