岗位职责
- 负责芝麻信用事业部重点AI项目的算法与架构优化,保证对话准确率和长程任务完成率;
- 探索包括SFT、RL在内的后训练算法研发与优化;
- 构建具备深度思考和自主行动能力的基座模型,提升大模型在芝麻信用专项任务上的Agentic能力上限。
职位要求
- 硕士及以上学历,计算机科学或相关专业背景;
- 具备大模型研发经验,在 Post-Training(如SFT、RL等)某一方向上有实操积累;
- 具备较强的算法程能力,了解主流RL算法原理(如PPO、GRPO);
- 熟悉数据与训练策略,了解主流训练和推理框架(如 Megatron、SGLang、vLLM等);
- 具备极强的“发现问题-分析问题-解决问题”的闭环能力;
- 拥有良好的团队协作精神与跨团队沟通能力。 加分项
- 相关领域的研究和实践经验,顶级会议发表过大模型相关论文,或作为核心贡献者参与过社区高 Star 开源项目;
- 具备大规模模型训练、调优及稳定性保障的实际研发和工程经验;
- 优秀的研究品味,卓越的动手能力,强大的自我驱动力等。