
蚂蚁集团
蚂蚁集团-大模型评测高级前端研发工程师-北京/杭州
蚂蚁集团-大模型评测高级前端研发工程师-北京/杭州
发布于 大约 1 小时前普通员工/个人贡献者
北京市 / 杭州市
高级经验
全职员工
仅现场办公
学历未注明
前端开发
JavaScript
前端工程化
大模型
性能优化
数据可视化
状态管理
复杂表单
AI 估算 · 30k–50k
大模型方向热门,高级前端稀缺,一线城市薪资水平高,综合预估月薪3-5万。
职位详情
关于这个职位
该职位负责蚂蚁集团大模型评测平台的前端研发,通过优秀的交互设计和数据可视化,帮助模型研发人员高效完成评测配置、任务分析和结果报告
你将参与复杂的平台型产品建设,涉及大模型、可视化、性能优化等前沿技术,适合有深耕前端领域并愿意接受挑战的工程师
最低要求
【前端技术基础】具备扎实的计算机基础和前端工程能力,熟练掌握 JavaScript、TypeScript、HTML、CSS,以及 React、Vue 等至少一种主流前端技术栈
【复杂平台研发】有复杂平台型产品的研发经验,能够独立负责中大型前端模块的架构设计和交付,熟悉组件设计、状态管理、数据流、权限、路由、构建发布及前端监控等工程机制
【产品理解与复杂交互】具备较强的产品 sense,能够深入理解模型研发和评测用户的工作目标,参与信息架构与交互方案设计,并将配置关系、任务状态、执行轨迹、版本差异和分析结果转化为清晰、易理解的用户体验
有复杂表单、工作台、可观测或数据分析产品经验者优先
【工程质量与诊断】具备较强的工程质量意识,重视类型安全、代码可维护性、性能优化、异常处理、自动化测试和兼容性,能够结合日志、监控及上下游接口定位并闭环复杂问题
【学习与协作】具备快速学习能力和持续的技术热情,对大模型和复杂工程问题保持好奇心和主动性
具备良好的沟通协作能力,能够与产品、后端、测试及领域专家共同推进方案落地
工作职责
参与建设支撑大模型研发与进化的下一代评测平台,围绕评测方案生产、模型能力分析和发版决策等核心场景,设计并实现清晰、高效的产品交互,持续降低复杂评测系统的使用门槛
负责评测配置、开发调试、任务执行、失败诊断、版本对比、样本分析和结果报告等核心工作台建设,通过任务拓扑、运行时间线、轨迹、Diff 和多模型结果等可视化方式,帮助用户理解评测过程和结论依据
建设可复用的评测前端基础能力,包括 Schema 驱动表单、状态与错误表达、复杂数据表格、可视化组件和统一交互规范,并持续提升大型任务和海量结果场景下的性能、稳定性和可维护性
深入模型研发和评测一线,与产品、后端、测试开发及评测专家共同定义问题,参与领域模型和接口设计,对需求分析、技术方案、开发测试、灰度发布和用户反馈闭环承担端到端责任
优先资格
【加分项】有大模型或 Agent 平台、机器学习平台、研发工具、工作流系统、可观测平台、数据分析产品或低代码平台建设经验者优先
AI 洞察
优缺点分析
优点
- 岗位涉及复杂平台建设、可视化、性能优化等多个高价值方向,技能积累极具市场竞争力
- 明确的职责范围,从产品交互到工程实现端到端负责,能培养全面的技术判断和产品 sense
- 大模型评测领域尚在发展,业务需求可能快速变化,需要较强的学习和适应能力
- 适合热爱前端技术、对 AI 和复杂系统有好奇心,具备较强工程能力并能适应快节奏的工程师
缺点 / 挑战
- 蚂蚁集团作为头部互联网公司,平台大、技术氛围好,能接触到大模型评测这个前沿领域,技术挑战大,成长快
- 平台型产品复杂度高,涉及数据量大、任务调度等难题,对技术深度和工程能力要求较高
- 互联网大厂工作节奏普遍较快,可能需要应对多任务并行和时间压力
角色解读
- 在大模型领域深耕,成为大模型基础设施方向的前端专家,深入理解 AI 评测系统和模型研发流程
- 向技术专家或架构师方向发展,主导大型前端平台的设计与架构演进,领导复杂技术项目的落地
- 有机会横向拓展至 Agent 平台、机器学习平台等更广泛的前沿领域,积累跨领域复合经验
- 负责蚂蚁大模型评测平台的前端架构设计与开发,构建支撑评测方案生产、任务执行和结果分析的工作台
- 通过任务拓扑、运行时间线、轨迹、Diff 等可视化方式,帮助模型研发人员理解评测过程和结论依据
- 建设可复用的前端基础能力,包括 Schema 驱动表单、复杂数据表格、可视化组件等,提升平台易用性和性能
- 与产品、后端、测试等角色协作,参与需求分析、领域模型设计,并对开发到发布全流程负责
- 扎实的前端基础,熟练掌握 JavaScript/TypeScript、HTML/CSS,以及 React 或 Vue 等主流框架
- 丰富的复杂平台研发经验,熟悉组件设计、状态管理、数据流、权限、路由、构建发布及前端监控
- 较强的产品理解能力,能够将复杂业务转化为清晰易用的交互体验,有复杂表单、工作台或数据可视化经验
- 优秀的工程质量意识,重视类型安全、性能优化、自动化测试和异常处理,并具备良好的协作与沟通能力
申请策略
- 在简历中尽量用数据量化成果,例如性能提升百分比、复杂模块数量、服务用户规模等
- 提前了解蚂蚁集团的大模型和测评相关产品,思考如何改进现有交互,可增加面试深度
- 突出复杂平台型产品的项目经验,特别是架构设计、组件模块划分、状态管理和性能优化方面的成就
- 展示在数据可视化、复杂表单或工作台类产品中的具体贡献,包括交互设计和技术实现
- 强调对前端工程质量的理解,如类型安全、自动化测试、监控告警等落地实践
- 体现对大模型或机器学习领域的了解,如有相关项目或自驱学习经历,会更有吸引力
- 深入掌握至少一种前端框架(React/Vue)的底层原理,并学习状态管理、数据流等复杂应用架构方案
- 补充大模型基础知识,了解模型评测的概念、流程和常用工具,能更好地理解业务场景
面试指南
- 用 STAR 法则回答项目问题:清晰阐述背景、任务、行动和结果,重点突出个人贡献和量化成效
- 对于技术方案类问题,可以从业务需求出发,对比不同方案的优缺点,结合团队实际情况给出选型理由
- 性能优化问题可以按照“分析瓶颈-定位原因-实施优化-效果验证”的流程展开,体现系统化思维
- 请描述一个你负责过的复杂前端项目,从架构设计到实现,你如何解决其中的关键难点?
- 你如何看待大模型评测平台的前端技术挑战?你会如何设计一个可扩展的可视化方案来展示大批量任务的运行轨迹?
- 在构建复杂表单或工作台时,你如何保证组件的可复用性和可维护性?
- 如何优化大数据量场景下的渲染性能?请给出具体的实践方案
- 当需求不明确且涉及多个团队时,你会如何协作推进项目落地?
职位点评
75
综合评分
大厂大模型评测平台,技术前沿,薪资高,但工作生活平衡一般。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
适合追求技术前沿、渴望在大模型领域快速成长的工程师,能接受互联网节奏和一定的工作强度。
表现最好
成长发展
相对薄弱
工作生活
薪资福利80
成长发展88
工作生活50
使命价值70
薪资福利
80较高
蚂蚁集团作为头部互联网企业,薪酬福利体系完善,岗位薪资竞争力强,但工作强度可能较大。
薪资信号未披露(AI估算:30K-50K/月)
成长发展
88较高
岗位处于大模型评测这一前沿领域,技术挑战大,学习机会多,成长空间广阔。
技术前沿前沿/新兴技术
技术栈JavaScript、TypeScript、React、Vue、大模型、数据可视化、性能优化
业务类型ambiguous
工作生活
50较低
工作地点为一线城市,但未提及弹性办公或远程,互联网大厂通常加班较多,工作生活平衡一般。
工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)
使命价值
70中等
大模型评测有助于推动 AI 技术更可靠地发展,具有一定社会价值,但岗位本质以技术实现为主,意义感中等。
行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
蚂蚁集团 的其他在招职位
相似职位推荐
Watch Jobs