部门介绍
字节跳动Seed团队成立于2023年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed团队在AI领域拥有长期愿景与决心,团队研究方向涵盖MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE等超过50个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包App用户量在中国市场排名第一,豆包大模型日均Token调用量行业领先。
- 设计实现高性能、可扩展、分布式的数据基建,涵盖数据存储、采集、清洗、标注、管理、分析等全生命周期,持续提升数据工作效率;
- 音视频多模态训练数据策略设计,开发高效的数据处理、合成、优化算子和流水线,构建多模态数据资产库,保障大模型研发的数据需要;
- 结合Agent,构建“数据-模型-评测”闭环,通过数据驱动大模型快速迭代;
- 追踪大模型数据领域前沿技术与方法,探索数据增强、数据蒸馏、高质量数据筛选等创新方案,落地到实际业务场景,提升数据价值。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历,计算机、数学、人工智能等相关专业,在音视频、文本大模型等一个或多个领域有较深入的经验;
- 熟练掌握C/C++、Python、Go等至少一门编程语言,熟悉Ray、Spark相关技术栈;
- 熟练使用AI Coding工具,熟悉CLI、Skills、Agent相关技术栈;
- 有大模型研发经验,参与过有行业影响力的项目者优先;
- 具备良好的沟通协作能力与团队意识,工作积极主动,愿意主动学习新技术、探索新方向,与团队共同推进技术突破。