岗位职责
- 安全体系规划与建设:主导大模型内容安全风控的策略规划,系统性地构建覆盖风险识别、评估、处置与迭代的闭环安全体系,制定模型安全准入规范与基线标准;
- 前沿安全技术研究与落地:深入研究大模型及智能体的安全机制,攻克提示词注入、数据投毒、模型幻觉、隐私泄露等安全难题,设计安全对齐、安全推理与防御方案,推动从研究到产品落地的全链路转化;
- 安全攻防能力建设:构建自动化红队评测与蓝队防御体系,开发安全评估工具与测试框架,建立安全评估基准与持续回归测试机制,实现攻防闭环迭代;
- 全链路策略优化:通过数据驱动的方法,深度分析安全策略效果,持续优化风险识别精度与效率,主导策略从验证到全量上线的完整生命周期管理;
- 安全架构设计:主导大模型架构安全方案设计,覆盖向量数据库安全、Agent应用安全、AI接口与调用链路安全、模型水印与溯源等关键环节;
- 行业洞察与合规:保持对全球大模型安全领域技术动态与合规政策(生成式AI合规、数据安全、个人信息保护等)的敏锐洞察,将前沿成果与合规要求转化为提升产品安全竞争力的有效实践。
职位要求
- 计算机科学、人工智能、信息安全、网络空间安全、数学等相关专业硕士及以上学历;
- 5年以上互联网内容安全、AI安全或风控策略相关经验,对AIGC相关风险(如幻觉、合规、滥用、对抗攻击等)有深刻理解;
- 熟悉大语言模型关键技术(SFT、DPO、RAG、Agent等),有模型训练或微调实战经验;熟悉大模型安全攻防技术,包括但不限于提示词注入防御、安全对齐、红队测试、对抗样本、模型水印等方向;具备独立开展实验与工程化落地的能力;
- 具备出色的逻辑思维、数据分析和系统规划能力,拥有极强的自驱力、责任心及解决复杂问题的热情,能够跨团队协作推动安全方案落地。