
阿里巴巴
数据技术及产品部-大模型评测专家-医疗方向
数据技术及产品部-大模型评测专家-医疗方向
发布于 大约 3 小时前普通员工/个人贡献者
北京市 / 杭州市
中级经验
全职员工
仅现场办公
本科
机器学习工程
Icd-10
临床指南
医疗Ai
大模型评测
数据脱敏
病历质控
Ood测试
临床诊断推理
评分Rubric设计
AI 估算 · 35k–60k
大厂医疗AI评测岗,专业稀缺,一线城市薪资高,年终奖丰厚。
职位详情
关于这个职位
该职位负责构建医疗领域大模型评测体系,包括设计临床场景的评测任务、制定专业评分标准、运行评测管线并分析模型能力短板
你将与临床专家和医院信息科协作,确保AI输出的安全性与合规性
适合兼具医学背景和AI兴趣,希望投身医疗AI方向的人才
最低要求
● 本科及以上学历,临床医学、药学、医学信息、公共卫生相关专业
● 3年以上医疗相关从业经验,具备以下至少一项深度背景:临床医师、临床药师、病案/质控管理、医学信息、CRO临床研究
● 熟悉临床诊断推理逻辑与鉴别诊断方法,能解读检验检查报告并对照权威临床指南(CSCO/NCCN/中华医学会共识等)
● 熟悉ICD-10编码、药品说明书与配伍禁忌、病历书写规范
● 优秀的中文书面表达能力,能将临床判断拆解为清晰、无歧义的评分标准
● 细致耐心,具备高度的医疗安全意识与合规意识
工作职责
设计医疗领域真实生产力评测任务,覆盖临床诊断推理、治疗方案制定、用药审核、病历质控、会诊记录、临床路径执行等真实场景,产出任务描述、源文件(病历/检验报告/影像报告/指南)与标准交付物
撰写医疗专业评分 Rubric,将"一份合格的诊断/治疗方案"拆解为可独立证伪的标准(诊断依据完整性、指南依从性、禁忌与风险告知、术语规范性等),并设计反幻觉、反偷懒护栏
运行评分管线,分析模型在医疗任务上的得分分布与能力短板,输出分析报告
执行 OOD 保障:确保病例数据完成脱敏且来自合规渠道,完成对抗自检与变体自检
对接临床专家与医院信息科,梳理诊疗工作流与专业能力维度,维护医疗领域知识库
优先资格
硕士及以上优先
有规培/临床经验者强优先
AI 洞察
优缺点分析
优点
- 平台优势:阿里巴巴集团资源,接触最前沿的大模型技术,与顶尖团队合作
- 行业前景:AI+医疗是高速增长赛道,职业发展空间大
- 岗位价值:工作直接决定模型质量,对患者安全有重要影响,成就感强
- 跨领域学习:同时深耕医学和AI,复合型人才稀缺
- 知识要求高:需要同时具备医学专业性和AI评测能力,学习曲线陡峭
- 责任重大:医疗领域容错率低,对评测的严谨性和细致度要求极高
- 适合有临床医学背景,对AI技术充满热情,注重细节和逻辑的人
缺点 / 挑战
- 工作内容可能较为繁琐:评测任务设计、数据分析、文档撰写占比较高
- 可能面临压力:大厂节奏快,多项目并行
角色解读
- 在医疗AI评测方向深耕,成为该领域的专家,参与行业标准制定
- 可向医疗AI产品经理、解决方案架构师或技术管理方向发展
- 随着医疗大模型落地加速,该领域的人才缺口将持续扩大
- 设计医疗真实场景的评测任务,覆盖临床诊断、治疗方案、用药审核等,产出评测集与标准答案
- 撰写医疗评分标准(Rubric),将临床判断转化为可量化维度,并设计反幻觉、反偷懒机制
- 运行评分管线,分析模型输出质量,定位能力短板并输出分析报告
- 与临床专家、医院信息科协作,梳理诊疗工作流,维护医疗知识库
- 扎实的临床医学功底,熟悉诊断推理、鉴别诊断和权威临床指南
- 评测设计能力,能制定清晰可执行的评分标准并分析数据
- 对大模型技术有基本了解,能够使用相关工具进行评测和数据分析
- 高度的医疗安全与数据合规意识
申请策略
- 研究阿里巴巴在医疗AI的业务布局,在面试中展现对产品的理解
- 准备一个医疗评测方案案例,以展示你的专业能力和思维方式
- 重点展示临床实战经验,如诊断、治疗、病历质控等,用具体案例说明
- 如有药物、CRO、医学信息等经验,突出与岗位的匹配度
- 展示对AI或大模型的了解,如参与过相关项目、自学过机器学习
- 强调分析能力:能拆解复杂问题为可量化标准,体现结构化思维
- 补充大模型评测方法,如熟悉LLM评估指标(BLEU、ROUGE等)和评测工具
- 学习基础Python编程,用于数据处理和评测脚本编写
面试指南
- 对于评测方案题:先明确目标场景,然后设计任务类型和样本量,接着制定评分维度(准确性、完整性、安全性等),再选择评估方法(人工+自动),最后给出结果分析框架
- 对于数据合规题:强调脱敏、授权、合规渠道,以及遵守法律法规(如个人信息保护法)
- 对于挑战题:结合医疗专业性和AI技术局限,从评测角度提出系统化保障措施
- 请设计一个评估医疗大模型诊断结果的评测方案,包括任务设计和评分标准
- 如何确保评分标准既专业又可执行?请举例说明
- 医疗数据敏感,你如何设计合规的评测流程?
- 你认为当前医疗大模型最大的挑战是什么?如何通过评测来应对?
- 请描述一次你如何将一个临床问题转化为可评测的任务
职位点评
79
综合评分
大厂医疗AI评测岗,技术前沿,薪资竞争力强,但现场办公且工作强度不明。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
最适合追求技术成长和职业发展的求职者,尤其是医学背景转AI方向的人。
表现最好
成长发展
相对薄弱
工作生活
薪资福利80
成长发展90
工作生活60
使命价值85
薪资福利
80较高
该职位提供阿里巴巴级别的薪酬福利,虽然JD未披露具体数字,但行业竞争力强。
薪资信号未披露(AI估算:35K-60K/月)
成长发展
90较高
岗位聚焦大模型评测,技术前沿,医疗AI方向成长空间大,有助于成为复合型专家。
技术前沿前沿/新兴技术
技术栈大模型、评分管线、OOD、ICD-10、临床指南
业务类型ambiguous
工作生活
60中等
现场办公,地点为北京或杭州,通勤可能较远,JD未提及弹性工作,WLB不确定。
工作模式仅现场办公
办公地点科技园/产业园
加班情况未提及(无法判断)
使命价值
85较高
医疗AI关乎患者安全,具有明显的社会价值,行业处于高速增长期。
行业发展高速增长赛道
社会影响正向社会影响力较高
创新程度积极采用新技术
阿里巴巴 的其他在招职位
相似职位推荐
Watch Jobs