
腾讯
AI评测工程师
AI评测工程师
发布于 大约 7 小时前普通员工/个人贡献者
深圳市
中级经验
全职员工
仅现场办公
本科
质量管理
Ai评测
Llm
Rag
Sql
医疗Ai
多模态
工具调用
质量保障
AI 估算 · 20k–35k
腾讯AI相关岗位薪资竞争力强,评测岗略低于算法,但结合公司平台和职级,预估月薪2-3.5万,15薪。
职位详情
关于这个职位
作为腾讯AI评测工程师,你将专注于医疗Agent核心业务的质量保障,覆盖健康问问、AI诊室等场景
你需要设计评测方案、推动自动化评测,并跟进线上问题闭环,确保AI产品的安全性、准确性和用户体验
该职位需要你深入理解LLM、Agent等大模型技术,并具备扎实的数据分析能力
最低要求
计算机或相关专业本科及以上学历,具备基本的软件测试与质量保障知识,理解测试用例设计、缺陷跟踪等基础测试流程
熟悉 LLM、Agent、RAG、工具调用等大模型应用的核心概念及其基本技术实现方式,对 AI 产品质量评测、Agent 链路评测等工作方向有兴趣,愿意长期投入 AI 评测与质量保障领域
具备较好的逻辑分析能力和问题拆解能力,能够根据业务场景设计基础测试点,准确记录问题现象,并进行初步的问题归类和原因分析
具备一定的数据处理和工具使用能力,熟悉 Python、SQL、Excel 或其他数据分析工具之一,能够完成复杂的数据清洗、结果统计、日志查看或脚本辅助工作
具备良好的学习能力、沟通能力和责任心
工作职责
负责医疗 Agent 核心业务的质量评测工作,覆盖健康问问、AI 诊室、医保智能助手等场景,围绕意图理解、多轮交互、信息收集、工具调用、结果生成、异常兜底等关键环节,完成评测方案设计、落地、结果记录与问题反馈
参与医疗复杂场景专项评测,包括 AI 问诊流程、科室/服务匹配、医保政策问答与办理指引、多模态报告解读等场景,沉淀可量化、可复用的评测方法和评估标准
推动评测数据与自动化能力建设,建设高质量评测集、标准答案、链路 Trace 标注规范和评测流水线,支持人工评测、规则评测及自动化评测任务落地
跟进线上 Badcase 分析与问题闭环,针对医疗安全、内容安全、隐私合规、诊疗建议边界等高风险问题,协助定位问题原因,并推动产品、算法、研发侧跟进修复
AI 洞察
优缺点分析
优点
- 腾讯平台提供海量用户场景和前沿AI技术,接触医疗AI这一高速增长领域
- 工作内容聚焦LLM评测,技术前沿性强,能深度参与AI产品质量体系建设
- 公司福利完善,薪资有竞争力,且医疗AI项目具有社会价值
- 团队技术氛围浓厚,有机会与优秀同事交流,个人成长空间大
- AI技术迭代快,需要持续学习新模型和评测方法,保持技术敏锐度
- 适合对AI质量保障有强烈兴趣、细心严谨、具备良好数据分析能力,且愿意在医疗AI领域深耕的技术人才
缺点 / 挑战
- 医疗领域对安全合规要求极高,工作压力较大,需严谨处理高风险问题
- 评测工作可能涉及大量重复性验证,需要耐心和细致
角色解读
- 从AI评测工程师向评测专家发展,深入掌握AI质量保障体系,成为领域权威
- 横向拓展至算法或产品方向,结合评测经验转型AI产品经理或测试开发
- 纵向晋升为质量团队Leader,管理评测团队并制定质量策略
- 负责医疗AI产品的质量评测方案设计,覆盖多轮交互、工具调用等关键环节,确保产品稳定可靠
- 参与专项评测,如AI问诊流程、医保政策问答等,沉淀可量化的评估标准和方法
- 推动评测数据与自动化能力建设,搭建评测集、标注规范和自动化流水线
- 跟进线上Badcase分析,针对医疗安全、隐私合规等高风险问题推动修复
- 掌握LLM、Agent、RAG等大模型核心技术原理,了解AI产品质量评测方法
- 具备Python、SQL等数据处理能力,能进行数据清洗、日志分析和脚本编写
- 拥有良好的逻辑分析和问题拆解能力,能设计测试点并准确定位问题
- 具备较强的沟通和责任心,能推动跨团队协作解决复杂问题
申请策略
- 深入了解腾讯医疗AI产品(如健康问问、AI诊室),在面试中展现业务理解
- 关注AI安全与合规话题,准备相关案例体现对医疗风险的认知
- 突出软件测试或AI相关项目经验,特别是LLM应用评测、Agent链路测试经历
- 强调Python/SQL数据处理能力,展示数据清洗、自动化脚本编写等成果
- 列举参与过的问题分析案例,体现逻辑分析和问题归因能力
- 如有医疗或安全相关背景,务必重点突出
- 系统学习LLM评测指标(如BLEU、ROUGE、GPT-based评估),掌握RAG链路评估方法
- 熟悉自动化测试框架(如pytest)和CI/CD流程,提升评测效率
面试指南
- 采用STAR法则:具体情境、任务、行动、结果,结合项目经验回答
- 体现系统性思维:从评测目标、指标选取、数据准备、执行流程到结果分析
- 展示协作能力:强调跨团队沟通,推动算法、产品、研发共同改进
- 如何设计一个LLM在医疗问诊场景下的评测方案?
- 请举例说明你如何处理线上Badcase,推动问题闭环
- 你如何评估Agent在工具调用环节的准确性?
- 如何平衡人工评测和自动化评测的成本与收益?
- 你对医疗AI的隐私合规有哪些了解?
职位点评
77
综合评分
腾讯AI评测岗,前沿技术栈,薪资优厚,专注医疗AI质量,WLB一般。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
该职位最适合追求技术成长和职业发展的求职者,尤其是对AI质量保障有热情、愿意深耕前沿领域的人才。
表现最好
成长发展
相对薄弱
工作生活
薪资福利80
成长发展85
工作生活60
使命价值80
薪资福利
80较高
腾讯提供行业领先的薪酬福利,但JD未明确具体薪资和福利项,因此评分较高但非满分。
薪资信号未披露(AI估算:20K-35K/月)
成长发展
85较高
该职位涉及LLM、Agent等前沿技术,强调长期投入和成长,但未明确提及晋升通道,整体发展潜力大。
技术前沿前沿/新兴技术
技术栈LLM、Agent、RAG、Python、SQL
成长机会愿意长期投入
业务类型ambiguous
工作生活
60中等
办公地点为深圳腾讯总部(科技园),未提及弹性工作或远程,WLB信号缺失,评分中等。
工作模式仅现场办公
办公地点科技园/产业园
加班情况未提及(无法判断)
使命价值
80较高
医疗AI领域具有明显社会价值,行业高速增长,但JD未直接强调使命感,评分较高。
行业发展高速增长赛道
社会影响正向社会影响力较高
创新程度积极采用新技术
腾讯 的其他在招职位
相似职位推荐
Watch Jobs