岗位职责
- 跟进和研发大规模语言模型(LLM)的后训练、如 SFT、强化学习 RLHF、GRPO、OPD 等技术。跟进与研发 LLM4Rec 相关技术。
- 通过分布式训练、模型压缩、低延迟推理等技术,面向工业级应用完成千亿级参数大模型的高效训练与部署;
- 尝试生成式 AI、多智能体协作等前沿方向,推动 AI 技术在各类核心业务领域的创新应用;
- 数亿用户、百亿级行为数据的挑战,落地大模型应用;参与顶级核心业务场景的算法优化,见证大模型技术驱动商业增长的完整链路。
职位要求
- 本科及以上学历,计算机科学/人工智能/机器学习等相关专业优先;
- 具备扎实的编程基础(Python/C++/Java),熟悉常用算法与数据结构;
- 掌握机器学习基础理论,了解搜、推、广系统/自然语言处理/多模态等至少一个领域;
- 有 PyTorch/TensorFlow 等框架使用经验,参与过算法竞赛(Kaggle/天池等)或开源项目者优先;
- 具备良好的沟通能力,较强的问题拆解能力,能通过数据分析定位业务痛点并提出创新思路。 【加分项】
- 有大模型训练/微调经验(如 Llama、GPT、多模态模型)或搜推广算法相关项目经历;
- 有海量数据处理经验或者大厂实习经验;
- 在算法竞赛中获得优异成绩(ACM-ICPC/挑战赛 TOP 10 等)或者顶会论文发表。