
普通员工/个人贡献者
综合评分 74
前沿多模态AI岗位,技术成长性高,薪资福利待确认,WLB不明确。
从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。
薪资怎么样
35K
与人工智能中位数基本持平
发布情况
新岗位 · 今天发布
公司情况
这家公司招聘很活跃
约 2420 个在招 · 其中人工智能 34 个
市场机会
选择面较广
北京 · 人工智能 · 约 490 个在招
该职位负责多模态视频理解算法的研究与开发,包括视频描述生成、指令改写、奖励模型训练等,旨在提升视频生成模型的性能和用户需求匹配度,支持快手可灵视频业务全链路AI任务
有音视频理解、多模态Caption、理解生成一体化、理解/生成Benchmark等方向的经验,有大厂实习、顶会论文优先
承担视频Caption和参考生成的Instruction职责,特别是在多分镜、高动态、长视频等场景提供精准、全面的描述,最大化弥合文本模态和视频模态之间的差异
优点
缺点 / 挑战
公司为上市企业,薪资福利体系可能较为完善,但JD未明确提及具体薪资和福利。
岗位涉及前沿多模态AI技术,有大量数据和实战机会,发展性很强。
JD未提及办公模式和工作时间,无法判断WLB情况。
多模态AI是高速增长赛道,岗位直接推动视频生成技术发展,具有较高社会影响力。