岗位职责
- 推动多模态大模型技术在下游场景中的前沿应用,包括但不限于内容理解与推理、Agent系统、搜索推荐、端智能等各类高价值场景;
- 提升LLM/VLM等在翻译、OCR、Captioning等领域内的能力,打造业务专属模型,以优化在国际化短视频场景中的效果;
- 优化大模型应用中的效果及推理性能,包括大规模数据合成、自动数据标注、强化学习对齐、轻量化模型结构等方法;
- 跟踪前沿研究成果(如NeurIPS、CLR、CVPR、ACL等),将最新技术引入业务落地并形成突破;
- 在团队中发挥技术领军作用,指导核心研发工作,推动跨团队协作与技术标准化。
职位要求
- 扎实的机器学习与深度学习基础,在LLM/VLM、计算机视觉或多模态领域有多年研发经验;
- 熟悉大模型的预训练、微调与对齐方法,有实际落地或开源大模型项目经验者优先;
- 精通PyTorch/TensorFlow等深度学习框架,具备大规模分布式训练与模型优化经验;
- 对内容安全、风险建模或审核场景有深入理解者优先;
- 在顶会/顶刊(NeurIPS、ICML、ICLR、CVPR、ACL等)有论文发表,或在业界大模型相关项目中担任核心研发角色者优先。