Tencent logo
腾讯
微信安全-大模型安全高级工程师

微信安全-大模型安全高级工程师

发布于 大约 13 小时前

普通员工/个人贡献者

深圳市
高级经验
全职员工
仅现场办公
硕士
信息安全
Dpo
Rag
Sft
内容安全
大模型安全
安全对齐
提示词注入
数据安全
红队评测

AI 估算 · 45k–65k

腾讯安全岗高级工程师职级,深圳薪资水平高,大模型安全为前沿方向,竞争激烈,月薪中位数在5.5万左右。

职位详情

关于这个职位

该职位是腾讯微信安全团队的大模型安全高级工程师,负责构建大模型内容安全风控体系,研究并防御提示词注入、数据投毒、模型幻觉等安全威胁,设计安全对齐与红队评测机制,推动前沿安全技术落地到微信产品中

适合对AI安全充满热情、有扎实大模型和攻防背景的技术专家

最低要求

计算机科学、人工智能、信息安全、网络空间安全、数学等相关专业硕士及以上学历

年以上互联网内容安全、AI安全或风控策略相关经验,对AIGC相关风险(如幻觉、合规、滥用、对抗攻击等)有深刻理解
熟悉大语言模型关键技术(SFT、DPO、RAG、Agent等),有模型训练或微调实战经验
熟悉大模型安全攻防技术,包括但不限于提示词注入防御、安全对齐、红队测试、对抗样本、模型水印等方向
具备独立开展实验与工程化落地的能力
具备出色的逻辑思维、数据分析和系统规划能力,拥有极强的自驱力、责任心及解决复杂问题的热情,能够跨团队协作推动安全方案落地

工作职责

安全体系规划与建设:主导大模型内容安全风控的策略规划,系统性地构建覆盖风险识别、评估、处置与迭代的闭环安全体系,制定模型安全准入规范与基线标准

前沿安全技术研究与落地:深入研究大模型及智能体的安全机制,攻克提示词注入、数据投毒、模型幻觉、隐私泄露等安全难题,设计安全对齐、安全推理与防御方案,推动从研究到产品落地的全链路转化
安全攻防能力建设:构建自动化红队评测与蓝队防御体系,开发安全评估工具与测试框架,建立安全评估基准与持续回归测试机制,实现攻防闭环迭代
全链路策略优化:通过数据驱动的方法,深度分析安全策略效果,持续优化风险识别精度与效率,主导策略从验证到全量上线的完整生命周期管理
安全架构设计:主导大模型架构安全方案设计,覆盖向量数据库安全、Agent应用安全、AI接口与调用链路安全、模型水印与溯源等关键环节
行业洞察与合规:保持对全球大模型安全领域技术动态与合规政策(生成式AI合规、数据安全、个人信息保护等)的敏锐洞察,将前沿成果与合规要求转化为提升产品安全竞争力的有效实践

AI 洞察

优缺点分析

优点

  • 能与顶尖安全专家和AI研发团队协作,接触全球前沿安全技术和合规要求
  • 薪资福利有竞争力,腾讯提供完善的职业发展通道和内部技术交流机会
  • 跨部门协作多,需要极强的沟通能力和推动力,项目落地周期可能较长

缺点 / 挑战

  • 腾讯大厂平台,海量数据和业务场景,安全团队资源充足,技术挑战大,能快速积累大模型安全的实战经验
  • 大模型安全是新兴前沿方向,技术含量高,行业人才稀缺,具有较高的职业价值
  • 大模型安全攻防技术更新快,需要保持持续学习和研究热情,压力较大
  • 安全风控工作往往需要7x24小时应急响应,偶尔需要处理突发安全事件,工作强度可能较高
  • 适合对AI安全有强烈兴趣,具备扎实大模型基础和攻防经验,喜欢挑战复杂技术难题并乐于推动产品落地的技术专家

角色解读

  • 在腾讯安全团队内部,可向技术专家或安全架构师方向发展,成为大模型安全领域的权威
  • 积累前沿技术经验后,可跨团队转向AI产品安全总体架构设计,或进入AI安全创业公司担任核心技术角色
  • 随着AI安全领域人才紧缺,职业发展空间广阔,有望晋升到安全技术管理岗位
  • 负责搭建大模型内容安全风控体系,制定安全基线标准,覆盖风险识别、评估、处置和迭代的闭环
  • 深入研究并解决提示词注入、数据投毒、模型幻觉、隐私泄露等安全难题,设计安全对齐和防御方案
  • 建设自动化红队评测和蓝队防御体系,开发安全评估工具和测试框架
  • 主导大模型架构安全设计,包括向量数据库、Agent应用、AI接口链路等安全防护,并关注合规政策
  • 扎实的计算机科学功底,硕士及以上学历,通常要求5年以上安全或风控经验
  • 熟悉大模型关键技术(SFT、DPO、RAG、Agent),有模型训练或微调实战经验
  • 掌握大模型安全攻防技术,如提示词注入防御、安全对齐、红队测试、对抗样本、模型水印等
  • 出色的数据分析、逻辑思维和跨团队协作能力,能推动安全方案落地

申请策略

  • 提前了解腾讯安全团队的现有成果和技术博客,在简历和面试中体现对具体业务场景的思考
  • 强调自身能够跨团队协作,并给出实际解决复杂问题的案例,展现自驱力
  • 突出大模型安全相关的项目经验,如提示词注入防御、安全对齐、红队测试等具体案例
  • 强调模型训练/微调实操经验,包含SFT、DPO、RAG等,最好展示效果数据和量化成果
  • 突出安全体系建设和技术规划能力,例如设计过的安全风控框架或基线标准
  • 展示在顶尖会议或行业论坛发表的论文、专利或获得的攻防比赛奖项
  • 深入学习大模型安全前沿论文和工具,如TensorFlow Privacy、Artemis、Garak等红队评测工具
  • 动手实践大模型微调和安全对齐技术,尝试复现攻击和防御方法,积累实战经验

面试指南

  • 按照「理解问题-分析威胁-设计防御-验证效果」的结构回答,突出逻辑性和实操性,最好结合项目案例
  • 对于防御方案,要同时考虑攻击者的视角和业务实际限制,说明方案的可行性和效果度量
  • 回答技术问题时,强调数据驱动和持续迭代,展示你的闭环思维
  • 如何对大模型进行红队测试?请描述完整的流程和方法
  • 提示词注入攻击有哪些类型?如何防御?给出具体方案
  • 如何设计一个安全对齐的奖励模型?请结合项目经验说明
  • 在RAG系统中如何防止数据投毒或恶意检索结果?
  • 如何平衡内容安全与用户体验?请举例说明你的优化策略

职位点评

76
综合评分

腾讯大模型安全高级工程师,前沿技术栈,成长空间大,薪资优厚,但工作强度和弹性未知。

从薪资福利、成长空间、工作节奏和岗位方向综合评估,方便横向比较。

更适合这类人
该职位最适合高度重视技能成长、追求技术前沿和职业发展空间的求职者,同时能接受一定的工作压力。
表现最好
成长发展
相对薄弱
工作生活
薪资福利78
成长发展92
工作生活45
使命价值85

薪资福利

78中等

腾讯作为上市巨头,薪资水平在业内具有竞争力,但JD未明确具体薪资和福利,因此补偿性动机满足度较高但存在不确定性。

薪资信号未披露(AI估算:45K-65K/月)

成长发展

92较高

大模型安全是当前最前沿的技术领域之一,岗位涉及研究、攻防、架构等多方面,成长空间巨大,技术挑战高,对个人能力提升显著。

技术前沿前沿/新兴技术
技术栈大模型安全、提示词注入、红队评测、安全对齐、RAG、Agent、SFT、DPO、模型水印
业务类型ambiguous

工作生活

45较低

JD未提及远程或弹性工作,明确要求现场办公,且安全岗位可能面临应急响应压力,工作强度不确定,生活化动机满足度较低。

工作模式仅现场办公
办公地点未明确
加班情况未提及(无法判断)

使命价值

85较高

大模型安全直接保障用户信息和内容安全,具有较高的社会价值,同时行业处于高速增长期,使命感和前景较好。

行业发展高速增长赛道
社会影响正向社会影响力较高
创新程度积极采用新技术
Watch Jobs