
科大讯飞
AI研究算法工程师-语音大模型方向(J13388)
AI研究算法工程师-语音大模型方向(J13388)
发布于 大约 5 小时前普通员工/个人贡献者
合肥市 / 西安市
无经验要求
全职员工
仅现场办公
硕士
研究与开发 (研发)
Nlp
Pytorch
Tensorflow
多模态
大模型
深度学习
语音合成
语音识别
AI 估算 · 20k–35k
校招硕士,语音大模型方向需求旺盛,科大讯飞上市大厂,薪资有竞争力,参考同类岗位估算。
职位详情
关于这个职位
作为科大讯飞AI研究算法工程师,你将专注于研发多模态大模型等前沿技术,探索语音、语言、音频生成与理解的上限
你将推动大模型技术在语音识别、合成、翻译和交互等场景的应用落地,提升产品体验
该岗位适合对大模型有浓厚兴趣、具备扎实深度学习基础的硕士及以上学历同学,工作地点在合肥、西安或上海
最低要求
对大模型有浓厚的兴趣
重点院校硕士及以上学历,计算机、信号处理、自动化、应用数学等相关专业,具备一定的数理统计、模式识别、图像处理等理论知识
熟悉常见深度学习算法和理论,熟练掌握至少一种常见的深度学习框架(Pytorch、TensorFlow等)
具备较好的C/C++或Python编程能力,熟悉数据结构、Linux操作系统等,有一定的代码开发经历,能够快速实现相关算法
从事过AI相关的研发任务,包括研究论文发表、研发项目经历、实习经历等
工作职责
研发多模态大模型等下一代人工智能核心技术,探索语言、语音、音频生成与理解的上限
推进大模型技术在语音识别、语音合成、语音翻译、语音交互等场景的广泛应用,提升语音产品体验
深入调研和关注音频/NLP/多模态等方向的前沿技术
优先资格
在人工智能会议(包括但不限于ACL、COLING、IJCAI、AAAI、ICLR、NIPS、CVPR、ICCV、INTERSPEECH、ICASSP)或期刊上发表过文章
在国内外知名评测任务或比赛中获得过优异成绩
在智能语音、计算机视觉、自然语言处理等相关方向有较丰富的实际系统研究和开发经验
AI 洞察
优缺点分析
优点
- 科大讯飞是国内语音领域龙头,平台大,技术积累深厚,能接触到最前沿的大模型技术
- 校招岗位,提供系统化的培训和导师制,成长速度快
- 语音大模型方向人才稀缺,职业发展空间广阔,薪资待遇优厚
- 大模型研发对数学和算法能力要求高,需要持续学习和跟进最新论文
- 工作强度可能较大,尤其是项目交付期需要加班
- 竞争激烈,校招门槛高,需要出色的学术或项目背景
- 适合对AI和大模型充满热情、具备扎实理论基础和编程能力的硕士及以上应届生,愿意在语音/NLP方向深入钻研
缺点 / 挑战
暂无明显挑战项
角色解读
- 从算法工程师逐步成长为技术专家,主导大模型核心算法研发
- 可向技术管理方向发展,带领团队攻克关键技术难题
- 在科大讯飞内部有机会接触多种业务场景,横向拓展至语音、NLP、多模态等方向
- 研发多模态大模型,探索语音、语言、音频生成与理解的技术上限
- 推动大模型技术在语音识别、合成、翻译、交互等场景的落地应用,优化产品体验
- 持续跟踪和调研音频、NLP、多模态等前沿技术动态,将最新研究成果应用到实际系统中
- 扎实的深度学习理论基础,熟悉常见算法和框架(如Pytorch, TensorFlow)
- 较强的编程能力,熟练掌握C/C++或Python,熟悉Linux环境
- 有AI相关研发经验,包括论文发表、项目或实习经历,对大模型有浓厚兴趣
申请策略
- 关注科大讯飞校园招聘官网和宣讲会,了解具体岗位需求和面试流程
- 准备一个高质量的项目展示,突出技术深度和业务价值
- 突出与大模型相关的项目或研究经历,如预训练模型微调、多模态模型开发等
- 列举发表的AI顶会论文或参与的竞赛获奖,尤其是ACL、ICASSP、NIPS等
- 详细描述在语音识别、合成或NLP方向的实习或项目成果,强调技术难点和解决方案
- 展示扎实的编程能力,如用Pytorch实现复杂网络、优化推理性能等
- 提前学习大模型相关技术,如Transformer、Attention机制、Prompt Tuning、LoRA等
- 熟悉至少一个深度学习框架(Pytorch优先),并动手复现经典论文
面试指南
- 对于原理性问题,先给出核心概念,再逐步展开细节,最后补充实际应用中的注意事项
- 对于项目经验问题,采用STAR法则(情境、任务、行动、结果),突出技术难点和个人贡献
- 对于开放性问题,先表达个人见解,再列举论据,最后联系实际应用场景
- 请简述Transformer的结构和自注意力机制原理
- 你如何评价目前主流语音大模型的优缺点?
- 描述一个你参与过的AI项目,你在其中的具体贡献是什么?
- 如何解决大模型训练中的显存不足问题?
- 你对语音合成中的自然度和可控性有什么理解?
职位点评
76
综合评分
大厂语音大模型研发岗,技术前沿发展好,薪资可观但工作地点固定且可能加班。
从起薪待遇、成长路径、工作节奏和岗位方向综合评估,方便比较职业起点。
更适合这类人
最看重技术成长和职业发展的求职者,愿意投入时间学习前沿技术,对WLB要求不高。
表现最好
成长发展
相对薄弱
工作生活
薪资福利80
成长发展90
工作生活50
使命价值70
薪资福利
80较高
科大讯飞作为上市大厂,薪资待遇在行业内具有竞争力,尤其对校招生提供有吸引力的薪酬和福利。但由于薪资未明确披露,且工作地点不同城市薪资有差异,评分略降。
薪资信号未披露(AI估算:20K-35K/月)
成长发展
90较高
该岗位聚焦大模型前沿技术,技术栈先进,且有研发项目落地机会,发展空间大。京东未明确提及晋升通道,但大平台通常有完善机制。
技术前沿前沿/新兴技术
技术栈大模型、多模态、语音识别、语音合成、NLP、深度学习、Pytorch、TensorFlow
业务类型profit_center
工作生活
50较低
工作地点固定为合肥、西安、上海,需现场办公,未提及弹性工作或远程。作为大厂研发,可能有一定加班压力。
工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)
使命价值
70中等
语音大模型是AI领域的热点,有较大社会影响力,科大讯飞产品广泛应用于教育、医疗等行业,能带来使命感。但京东未强调社会价值。
行业发展高速增长赛道
社会影响中性/一般
创新程度积极采用新技术
科大讯飞 的其他在招职位
相似职位推荐
Watch Jobs