岗位职责
我们正在面向淘宝复杂工程技术体系,构建深度理解研发上下文的垂域大模型,打造具备"架构师级"洞察力的研发智能体。作为实习生,你将参与以下方向的研究与实践:
- 领域模型训练: 参与研发垂域大模型的数据构建与训练工作,包括研发数据的高质量组织与清洗、用户轨迹数据的迭代优化,以及持续预训练(CPT)、指令微调(SFT)、强化学习对齐(RL/RLHF)等训练流程。
- 理解与记忆能力研究: 参与探索如何让模型更好地理解、记忆和运用领域知识,提升模型在实际研发场景中的专业能力。
- 能力评估与迭代: 参与评测体系建设,协助评估模型在研发场景中的实际表现,分析bad case,推动数据和算法的持续优化。
职位要求
- 计算机科学、人工智能、软件工程等相关专业,毕业时间在26年11月以后的硕博在校生。
- 具备扎实的NLP基础,有LLM大模型相关的研究或项目经验,熟悉预训练、SFT、RLHF等关键技术。
- 熟悉Python,熟练掌握PyTorch等深度学习框架。
- 具备良好的问题拆解和解决能力,强自驱力与团队协作精神,敢于探索新思路、新技术。 加分项:
- 在相关领域顶会(如NeurIPS、ICML、ICLR、ACL、EMNLP、AAAI等)发表过一作论文。
- 理解软件研发全流程,有将AI技术应用于软件工程的经验,或具备知识图谱、知识工程背景。