岗位职责
- 设计面向云安全场景(入侵检测、自动化渗透、合规审计)的大模型评测体系,定义“懂安全的 AI”量化标准;
- 落地自动化攻击算法,构建红蓝智能体对抗环境,持续挑战 AI 极限,评估其接管复杂防御决策的资质;
- 深入研究并创新应用 Claude、OpenAI评测框架等前沿技术,构建云安全领域的评测标杆;
- 探索多智能体对抗、自动化反馈强化学习等技术,实现评测结果直接驱动模型进化的闭环系统。
职位要求
- 扎实的机器学习/深度学习基础,熟悉大模型评测方法(LLM-as-a-Judge、红队测试、对抗评测等);
- 深入理解 Claude、OpenAI 等顶尖实验室的模型评测技术体系,具备改进与创新能力;
- 对安全攻防有强烈兴趣,具备构造 Corner Case 和对抗样本的偏执热情,擅长逼出 AI 能力边界;
- 优秀的算法工程能力,能够将评测理念转化为可落地的系统架构;
- 有 CCF-A/NeurIPS/ICML/Security 等顶会论文,或 DEF CON/GEEKPWN/强网杯等竞赛经验者优先。