岗位职责
- 负责国际化短视频下的LLM基座模型研发,包括基座预训练、指令微调(SFT)、强化学习(RLHF)等核心技术探索;
- 改进LLM基座模型在国际化短视频场景下的效果,包括但不限于大规模数据合成方法、模型训练策略优化、自适应推理以及可扩展知识注入方法等;
- 推动大模型技术在下游场景中的前沿应用,包括但不限于内容理解与推理、Agent系统、搜索推荐等各类高价值场景;
- 跟踪前沿研究成果(如NeurIPS、ICLR、CVPR、ACL等),将最新技术引入业务落地并形成突破;
- 在团队中发挥技术领军作用,指导核心研发工作,推动跨团队协作与技术标准化。
职位要求
- 扎实的机器学习与深度学习基础,在LLM/VLM、计算机视觉或多模态领域有多年研发经验;
- 熟悉大模型的预训练、微调与对齐方法,有实际落地或开源大模型项目经验者优先;
- 精通PyTorch/TensorFlow等深度学习框架,具备大规模分布式训练与模型优化经验;
- 对内容安全、风险建模或审核场景有深入理解者优先;
- 在顶会/顶刊(NeurIPS、ICML、ICLR、CVPR、ACL等)有论文发表,或在业界大模型相关项目中担任核心研发角色者优先。