岗位职责
- 结合研发需求与内容安全标准,负责Prompt撰写及Agent搭建,通过系统性测试与深度分析,持续提升模型安全防护能力;
- 负责大模型自动化评估日常运营,配置和维护评测集、组装评测套件、发起并跟踪模型评测任务,输出评估分析报告;
- 探索Prompt攻击的新型形式与潜在场景,覆盖内容合规性、可靠性、鲁棒性等多维度测试,构建全面的安全测试体系;
- 负责已上线产品的安全巡检与效果评估,联动产品研发、策略等相关团队,精准识别并闭环线上安全风险,保障产品重点保护期风险可控、不外露;
- 协同各作业团队,完成产品研发需求相关的数据生产、分析、总结工作,通过数据提取与解读优化交付流程,保障交付质量与效率。
职位要求
- 本科及以上学历,理工类或文理交叉学科背景;
- 具备基础Python能力,能熟练使用SQL进行数据提取、筛选、分析,理解业务数据逻辑,有大模型评测、模型训练场景下的自动化脚本搭建经验者优先;
- 有AI、机器学习平台或模型评估平台的使用与运营经验;
- 具备归纳总结、问题拆解、分析能力,拥有良好的团队沟通与协作意识,能适应的工作氛围。