岗位职责
- 智能体安全风险建模与评估针对大模型智能体系统(工具调用、插件集成、多步工作流等场景),系统性发现并建模安全风险,包括Prompt Injection(直接/间接注入)、指令绕过、越权调用、敏感数据泄露、上下文污染、模型幻觉引发的业务风险等;建立风险分级与影响评估框架,制定安全基线与准入规范;
- 防护策略与安全机制设计结合威胁模型与业务场景,设计并迭代智能体安全防护架构,覆盖输入输出过滤、Prompt防护层、工具调用权限沙箱、上下文隔离、敏感操作审批、安全对齐(Alignment)及基于意图识别的异常行为检测;
- 安全评测体系与红队测试构建覆盖智能体核心攻击面的标准化安全评测基准(Benchmark),组织执行红队测试,开发自动化攻击模拟与对抗性测试框架,推动防护能力的工程化落地;
- 跨团队协作与能力落地与产品、工程、算法、合规团队协作,将安全研究成果转化为可工程化的安全组件与规范流程,推动安全能力在智能体产品全链路中的持续集成与运营。
职位要求
- 专业背景计算机科学、信息安全、人工智能或相关领域本科及以上学历,或具备同等水平的工作经验;
- LLM/Agent安全实战经验具备大模型应用或智能体系统的安全研究、攻防测试或安全治理经验,熟悉主流AI安全问题与攻防方法,包括Prompt Injection、Jailbreak、数据投毒、模型逆向、对抗样本、模型滥用及越权调用等;
- 安全攻防或威胁建模能力具备渗透测试、红队演练或威胁建模经验,能从攻击者视角系统性分析复杂系统的风险面;
- 工程与代码实现能力扎实的编程能力(以Python为主),能独立构建POC、安全测试脚本与对抗性测试框架;具备将安全研究成果转化为自动化工具或平台化服务的工程经验。