部门介绍
ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。 剪映数据与智能团队旨在通过 AI 技术赋能剪映系产品,构建强大的算法能力壁垒。作为剪映系内的算法团队,负责推动整个业务在算法上的迭代与创新,为剪映、CapCut、即梦dreamina、Pippit、醒图等产品提供智能化支持。
- 负责视频剪辑Agent相关的研发和应用,研究多模态理解技术和Agent实践前沿技术,期望通过Agent实践革新行业效率,赋能并影响整个视频剪辑与生成生态的发展;
- 探索研究多模态理解、多模态RAG、视觉CoT、多模态Agent、Reward Model及RL等前沿技术,并将其应用于视频剪辑场景,使模型具备对多轨道(画面、语音、音乐、字幕)的时序理解与联合规划能力;
- 基于通用大模型,结合多轨道剪辑垂类应用场景,进行相关的数据建设、指令微调、偏好对齐、模型优化,探索提升垂类大模型能力,并进一步提升基座模型对素材的理解深度及对画面美学、叙事逻辑的感知能力;
- 参与Agent Search/Tool Use技术建设,提升对素材资源搜索、复杂剪辑工具调用的准确率;
- 深度参与Agent规划与执行技术研发,提升Agent对于复杂剪辑指令任务拆解与推理能力,重点解决素材布局、时间线对齐等关键能力;
- 探索Long-Context技术在长视频处理中的应用,构建剪辑上下文,解决长视频剪辑中的跨片段关联分析与长程记忆问题,确保剪辑结果的一致性与连贯性。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 2027届本科及以上学历在读,计算机、软件工程等相关专业优先;
- 具备优秀的代码能力、数据结构和基础算法功底,熟练掌握至少一门语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 熟悉NLP、CV、ML等相关的技术,深入理解大模型相关技术栈(如RL、SFT),在大模型领域,主导过有影响力的项目或论文者优先,尤其是Agent相关者优先;
- 了解LLM架构,熟悉Multi-Agent技术、Prompt/Context Engineering工程技术,有AI Agent应用经验、AIGC实操经验的优先;
- 熟悉主流剪辑软件(如剪映、PR等)的基本操作与常见概念,对多轨道剪辑、时间线有一定了解,或平时有制作视频的习惯者优先;
- 每周出勤至少4天,可实习4个月以上。