
蚂蚁集团
蚂蚁集团-大模型评测高级前端研发工程师-北京/杭州
蚂蚁集团-大模型评测高级前端研发工程师-北京/杭州
发布于 大约 3 小时前普通员工/个人贡献者
北京市 / 杭州市
高级经验
全职员工
仅现场办公
学历未注明
前端开发
JavaScript
前端工程化
大模型
性能优化
数据可视化
评测平台
复杂交互
AI 估算 · 30k–50k
大厂高级前端、大模型核心方向,技术难度高,薪资竞争力强。
职位详情
关于这个职位
这个职位是蚂蚁集团大模型评测平台的前端研发工程师,主要负责构建支撑大模型研发的评测平台,包括复杂交互设计、数据可视化、性能优化等
你将与产品、后端和评测专家紧密合作,端到端负责核心功能模块
适合有扎实前端基础、复杂平台开发经验,并对大模型技术充满热情的工程师
最低要求
【前端技术基础】具备扎实的计算机基础和前端工程能力,熟练掌握 JavaScript、TypeScript、HTML、CSS,以及 React、Vue 等至少一种主流前端技术栈
【复杂平台研发】有复杂平台型产品的研发经验,能够独立负责中大型前端模块的架构设计和交付,熟悉组件设计、状态管理、数据流、权限、路由、构建发布及前端监控等工程机制
【产品理解与复杂交互】具备较强的产品 sense,能够深入理解模型研发和评测用户的工作目标,参与信息架构与交互方案设计,并将配置关系、任务状态、执行轨迹、版本差异和分析结果转化为清晰、易理解的用户体验
有复杂表单、工作台、可观测或数据分析产品经验者优先
【工程质量与诊断】具备较强的工程质量意识,重视类型安全、代码可维护性、性能优化、异常处理、自动化测试和兼容性,能够结合日志、监控及上下游接口定位并闭环复杂问题
【学习与协作】具备快速学习能力和持续的技术热情,对大模型和复杂工程问题保持好奇心和主动性
具备良好的沟通协作能力,能够与产品、后端、测试及领域专家共同推进方案落地
工作职责
参与建设支撑大模型研发与进化的下一代评测平台,围绕评测方案生产、模型能力分析和发版决策等核心场景,设计并实现清晰、高效的产品交互,持续降低复杂评测系统的使用门槛
负责评测配置、开发调试、任务执行、失败诊断、版本对比、样本分析和结果报告等核心工作台建设,通过任务拓扑、运行时间线、轨迹、Diff 和多模型结果等可视化方式,帮助用户理解评测过程和结论依据
建设可复用的评测前端基础能力,包括 Schema 驱动表单、状态与错误表达、复杂数据表格、可视化组件和统一交互规范,并持续提升大型任务和海量结果场景下的性能、稳定性和可维护性
深入模型研发和评测一线,与产品、后端、测试开发及评测专家共同定义问题,参与领域模型和接口设计,对需求分析、技术方案、开发测试、灰度发布和用户反馈闭环承担端到端责任
优先资格
【加分项】有大模型或 Agent 平台、机器学习平台、研发工具、工作流系统、可观测平台、数据分析产品或低代码平台建设经验者优先
AI 洞察
优缺点分析
优点
- 涉及前沿的大模型评测领域,有较大技术影响力
- 能和优秀团队协作,提升复杂系统设计和工程能力
- 涉及领域复杂,需要快速学习大模型评测知识
- 大厂节奏较快,可能需要一定的抗压能力
- 适合有复杂平台前端开发经验、对大模型技术感兴趣、追求技术深度和影响力的人
缺点 / 挑战
- 蚂蚁集团大平台,技术挑战大,参与大模型核心基础设施
- 平台对性能和稳定性要求高,面临海量数据和复杂交互的挑战
角色解读
- 在前端技术方向深入,成为前端架构师或技术专家
- 结合大模型评测领域知识,向全栈或AI工程方向发展
- 有机会晋升为技术leader,带领团队
- 负责大模型评测平台的前端架构设计和核心功能开发,包括评测配置、任务执行、结果分析等模块
- 通过可视化方式(任务拓扑、时间线、Diff等)帮助模型研发人员理解评测过程和结论
- 建设可复用的前端基础能力,如Schema驱动表单、复杂表格、可视化组件,并优化大型任务和海量数据下的性能
- 与产品、后端、测试和评测专家协作,参与领域模型设计,端到端交付功能
- 扎实的前端基础:JavaScript、TypeScript、HTML、CSS,熟练掌握React或Vue等主流框架
- 复杂平台开发经验:熟悉组件设计、状态管理、数据流、权限、路由、构建发布及前端监控
- 产品理解与复杂交互设计能力,能将复杂业务逻辑转化为清晰易用的用户体验
- 工程质量意识:重视类型安全、性能优化、自动化测试、异常处理等
申请策略
- 了解蚂蚁集团大模型评测平台的产品形态,关注技术博客
- 在简历和面试中体现对大模型技术的好奇心和主动学习
- 突出复杂平台型产品的前端架构设计经验,特别是可视化、数据密集场景
- 展示具体项目中的性能优化、工程效能提升案例
- 提及对TypeScript、React等技术的深入使用
- 若有数据可视化、工作流、低代码或机器学习平台经验,务必强调
- 补充大模型基础概念,了解评测流程和常用方法
- 学习数据可视化库(如ECharts、D3)和复杂表格处理方案
面试指南
- 用STAR法则(情境-任务-行动-结果)描述项目经验,突出技术决策和业务价值
- 针对大模型问题,展示学习能力和思考深度
- 请描述一个你处理过的复杂前端项目的架构设计,遇到了哪些挑战?
- 如何设计一个支持海量数据渲染的表格或可视化组件?
- 你对大模型评测了解多少?如何理解评测平台的核心价值?
- 在跨团队协作中,如何保证前端方案的有效推进?
- 如何优化前端性能?举例说明
- 准备1-2个复杂的项目案例,说明架构设计和优化过程
职位点评
76
综合评分
大厂核心AI基础设施,前沿技术栈,薪资高但工作强度可能较大。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
更适合这类人
适合追求技术成长、对前沿技术有热情、能接受一定工作强度的求职者。
表现最好
成长发展
相对薄弱
工作生活
薪资福利80
成长发展90
工作生活50
使命价值80
薪资福利
80较高
蚂蚁集团作为行业巨头,薪资水平高,稳定性好,但JD未明确福利信息。
薪资信号未披露(AI估算:30K-50K/月)
成长发展
90较高
大模型评测属于前沿领域,技术挑战大,有广阔的学习和成长空间。
技术前沿前沿/新兴技术
技术栈JavaScript、TypeScript、React、Vue、Schema驱动表单、可视化组件、性能优化、自动化测试、大模型、Agent
业务类型ambiguous
工作生活
50较低
职位要求现场办公,未提及弹性工作时间,大厂节奏可能较快,WLB不确定性较高。
工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)
使命价值
80较高
参与大模型核心基础设施,推动AI技术发展,具有较强的使命感和行业影响力。
行业发展高速增长赛道
社会影响正向社会影响力较高
创新程度积极采用新技术
蚂蚁集团 的其他在招职位
相似职位推荐
Watch Jobs