岗位职责
- 参与大语言模型(LLM)的预训练、微调与对齐技术研发,以及工具构建;
- 探索大模型在垂直行业领域(金融/能源/医疗等)的高效适配与落地,推动模型能力与行业场景深度融合,支撑蚂蚁数字科技对外输出的大模型产品(如百灵大模型系列);
- 协助构建高质量数据集(如对话、工具调用、文档解析),设计数据清洗与增强策略,以及工具构建;
- 开发自动化评估工具,监控模型在准确性、安全性、公平性等维度的表现;
- 跟踪大模型前沿进展(如MoE、长上下文、Agent框架),参与内部技术复现与验证;
- 与产品、工程及行业解决方案团队紧密协作,将前沿算法能力转化为可交付、可复用的技术方案。
职位要求
- 计算机、人工智能、数学等相关专业硕士及以上学历,1-6年相关工作经验;
- 精通主流大语言模型架构(如 LLaMA、ChatGLM、Qwen 等),具备扎实的 NLP 和深度学习基础;
- 精通分布式训练框架(如 DeepSpeed、Megatron-LM);
- 精通 SFT、RLHF(如PPO/DPO/GRPO)及对齐算法,有实际的大模型预训练、微调或对齐经验,具备构建复杂奖励模型(Reward Model)的实战经验;
- 精通Agentic技术架构,对Claude Code、OpenClaw等有深入理解,有大规模沙箱环境构建、工具调用(Tool Use)及多轮决策轨迹合成的相关研发经验;
- 具备良好的工程实现能力,熟练使用 PyTorch/TensorFlow 等框架;
- 对大模型在产业落地中的挑战(如幻觉控制、领域泛化、问题修复)有深入理解者优先。 加分项 ● 在NeurIPS/ICML/ACL/EMNLP等顶会发表过大模型相关论文者优先; ● 有代表性开源大模型/智能体项目者优先。