部门介绍
ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。 剪映数据与智能团队旨在通过 AI 技术赋能剪映系产品,构建强大的算法能力壁垒。作为剪映系内的算法团队,负责推动整个业务在算法上的迭代与创新,为剪映、CapCut、即梦dreamina、Pippit、醒图等产品提供智能化支持。
- 负责研发提效场景所需要的大模型能力的研发和应用,研究高质量数据的挖掘和合成、大模型的对齐效率、Agent的设计&端到端训练等等,不断思考和跟进AI的最新进展对我们的价值,探索下一代的研发模式;
- 高质量数据挖掘清洗使用,数据自动、半自动合成方案研究探索,设计针对代码场景的原子任务、全链路任务的评测方法;
- 研究LLM/VLM训练与优化技术,包括微调、强化学习(RLHF)、知识蒸馏等,提高大模型在代码场景下的能力;
- 尝试落地到各种应用场景,比如:IDE代码补全、代码能力QA、场景化Agent、代码自动修复、漏洞检测等;
- 持续跟踪LLM/VLM领域的最新技术动态,并将其应用于实际业务场景中,推动技术落地。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 2027届本科及以上学历在读,计算机、软件工程等相关专业优先;
- 具备优秀的代码能力、数据结构和基础算法功底,熟练掌握至少一门语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 熟悉NLP、CV、ML等相关的技术,深入理解大模型相关技术栈(如Reward Model、GRPO/PPO/DPO、SFT/RFT、CT、PE等);
- 在大模型领域,在ACL/EMNLP/ECCV/CVPR等顶会发表相关论文者优先;
- 有代码基座模型训练经验,有强化学习结合大模型落地经验,有Multi-Agent、Tool-Use等有相关经验优先;
- 每周出勤至少4天,可实习4个月以上。