岗位职责
- 负责计算机视觉及大模型领域前沿研究开发,重点聚焦AIGC技术在国际电商场景的落地,深耕图像、视频、3D生成技术;
- 为字节跳动国际电商内部核心产品提供不同场景下的各类AIGC基础模型支持,解决商品内容生产、视觉营销、用户交互等场景的技术需求;
- 构建高质量的视觉模型训练数据,探索高效的模型训练方案。
职位要求
- 有计算机视觉一个或多个领域的研究和实践经验,包括但不限于图像/视频生成、3D数字人、扩散模型、多模态理解等;
- 具有熟练的算法和编程能力,熟悉Python编程和常见大模型训练及推理框架,理解视频生成模型的关键技术,包括Diffusion,DiT,VAE,Position Embedding,Temporal Embedding等;
- 对技术有热情,关注大模型新研究和论文,对大模型的应用有兴趣,有独立解决问题的能力,有良好的技术沟通及协作能力,并乐于推动项目中问题的解决;
- 加分项:在顶会(NeurIPS/ICML/ICLR/ACL/CVPR)发表论文或参与过开源模型(LLaMA/Qwen/Mistral/DeepSeek/Wan等)的贡献。