iFLYTEK logo
科大讯飞
AI研究算法工程师-语音大模型方向(J13388)

AI研究算法工程师-语音大模型方向(J13388)

发布于 大约 5 小时前

普通员工/个人贡献者

合肥市 / 西安市
无经验要求
全职员工
仅现场办公
硕士
研究与开发 (研发)
Nlp
Pytorch
Tensorflow
多模态
大模型
深度学习
语音合成
语音识别

AI 估算 · 20k–35k

校招硕士,语音大模型方向需求旺盛,科大讯飞上市大厂,薪资有竞争力,参考同类岗位估算。

职位详情

关于这个职位

作为科大讯飞AI研究算法工程师,你将专注于研发多模态大模型等前沿技术,探索语音、语言、音频生成与理解的上限

你将推动大模型技术在语音识别、合成、翻译和交互等场景的应用落地,提升产品体验
该岗位适合对大模型有浓厚兴趣、具备扎实深度学习基础的硕士及以上学历同学,工作地点在合肥、西安或上海

最低要求

对大模型有浓厚的兴趣

重点院校硕士及以上学历,计算机、信号处理、自动化、应用数学等相关专业,具备一定的数理统计、模式识别、图像处理等理论知识
熟悉常见深度学习算法和理论,熟练掌握至少一种常见的深度学习框架(Pytorch、TensorFlow等)
具备较好的C/C++或Python编程能力,熟悉数据结构、Linux操作系统等,有一定的代码开发经历,能够快速实现相关算法
从事过AI相关的研发任务,包括研究论文发表、研发项目经历、实习经历等

工作职责

研发多模态大模型等下一代人工智能核心技术,探索语言、语音、音频生成与理解的上限

推进大模型技术在语音识别、语音合成、语音翻译、语音交互等场景的广泛应用,提升语音产品体验
深入调研和关注音频/NLP/多模态等方向的前沿技术

优先资格

在人工智能会议(包括但不限于ACL、COLING、IJCAI、AAAI、ICLR、NIPS、CVPR、ICCV、INTERSPEECH、ICASSP)或期刊上发表过文章

在国内外知名评测任务或比赛中获得过优异成绩
在智能语音、计算机视觉、自然语言处理等相关方向有较丰富的实际系统研究和开发经验

AI 洞察

优缺点分析

优点

  • 科大讯飞是国内语音领域龙头,平台大,技术积累深厚,能接触到最前沿的大模型技术
  • 校招岗位,提供系统化的培训和导师制,成长速度快
  • 语音大模型方向人才稀缺,职业发展空间广阔,薪资待遇优厚
  • 大模型研发对数学和算法能力要求高,需要持续学习和跟进最新论文
  • 工作强度可能较大,尤其是项目交付期需要加班
  • 竞争激烈,校招门槛高,需要出色的学术或项目背景
  • 适合对AI和大模型充满热情、具备扎实理论基础和编程能力的硕士及以上应届生,愿意在语音/NLP方向深入钻研

缺点 / 挑战

暂无明显挑战项

角色解读

  • 从算法工程师逐步成长为技术专家,主导大模型核心算法研发
  • 可向技术管理方向发展,带领团队攻克关键技术难题
  • 在科大讯飞内部有机会接触多种业务场景,横向拓展至语音、NLP、多模态等方向
  • 研发多模态大模型,探索语音、语言、音频生成与理解的技术上限
  • 推动大模型技术在语音识别、合成、翻译、交互等场景的落地应用,优化产品体验
  • 持续跟踪和调研音频、NLP、多模态等前沿技术动态,将最新研究成果应用到实际系统中
  • 扎实的深度学习理论基础,熟悉常见算法和框架(如Pytorch, TensorFlow)
  • 较强的编程能力,熟练掌握C/C++或Python,熟悉Linux环境
  • 有AI相关研发经验,包括论文发表、项目或实习经历,对大模型有浓厚兴趣

申请策略

  • 关注科大讯飞校园招聘官网和宣讲会,了解具体岗位需求和面试流程
  • 准备一个高质量的项目展示,突出技术深度和业务价值
  • 突出与大模型相关的项目或研究经历,如预训练模型微调、多模态模型开发等
  • 列举发表的AI顶会论文或参与的竞赛获奖,尤其是ACL、ICASSP、NIPS等
  • 详细描述在语音识别、合成或NLP方向的实习或项目成果,强调技术难点和解决方案
  • 展示扎实的编程能力,如用Pytorch实现复杂网络、优化推理性能等
  • 提前学习大模型相关技术,如Transformer、Attention机制、Prompt Tuning、LoRA等
  • 熟悉至少一个深度学习框架(Pytorch优先),并动手复现经典论文

面试指南

  • 对于原理性问题,先给出核心概念,再逐步展开细节,最后补充实际应用中的注意事项
  • 对于项目经验问题,采用STAR法则(情境、任务、行动、结果),突出技术难点和个人贡献
  • 对于开放性问题,先表达个人见解,再列举论据,最后联系实际应用场景
  • 请简述Transformer的结构和自注意力机制原理
  • 你如何评价目前主流语音大模型的优缺点?
  • 描述一个你参与过的AI项目,你在其中的具体贡献是什么?
  • 如何解决大模型训练中的显存不足问题?
  • 你对语音合成中的自然度和可控性有什么理解?

职位点评

76
综合评分

大厂语音大模型研发岗,技术前沿发展好,薪资可观但工作地点固定且可能加班。

从起薪待遇、成长路径、工作节奏和岗位方向综合评估,方便比较职业起点。

更适合这类人
最看重技术成长和职业发展的求职者,愿意投入时间学习前沿技术,对WLB要求不高。
表现最好
成长发展
相对薄弱
工作生活
薪资福利80
成长发展90
工作生活50
使命价值70

薪资福利

80较高

科大讯飞作为上市大厂,薪资待遇在行业内具有竞争力,尤其对校招生提供有吸引力的薪酬和福利。但由于薪资未明确披露,且工作地点不同城市薪资有差异,评分略降。

薪资信号未披露(AI估算:20K-35K/月)

成长发展

90较高

该岗位聚焦大模型前沿技术,技术栈先进,且有研发项目落地机会,发展空间大。京东未明确提及晋升通道,但大平台通常有完善机制。

技术前沿前沿/新兴技术
技术栈大模型、多模态、语音识别、语音合成、NLP、深度学习、Pytorch、TensorFlow
业务类型profit_center

工作生活

50较低

工作地点固定为合肥、西安、上海,需现场办公,未提及弹性工作或远程。作为大厂研发,可能有一定加班压力。

工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)

使命价值

70中等

语音大模型是AI领域的热点,有较大社会影响力,科大讯飞产品广泛应用于教育、医疗等行业,能带来使命感。但京东未强调社会价值。

行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
Watch Jobs