部门介绍
字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。 Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。
- 负责千亿级别海量多模态数据的管理,包括视频、图像数据的存储,数据处理,数据安全,数据校验等等;
- 负责多模态数据链路基建的研发,追求极致的处理速度,达到业界领先的数据处理能力;
- 大规模数据的基础设施建设,为数据处理不断提高时间、资源效率;
- 与算法同学深度合作,加速训练数据的获取,提升数据质量,支持模型结果数据评测,打造数据闭环;
- 支持多模态数据分析和数据可视化工作,降低数据的获取门槛,提升数据的使用价值,从数据中挖掘出影响模型训练结果的可能因素,从而帮助模型训练改进。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 2028届及以后本科及以上学历在读,计算机、数学等专业优先;
- 有后端服务相关开发经验,熟练掌握Python、Golang等一种以上编程语言,有高并发和异步编程经验的优先;
- 掌握Hive,ClickHouse,MySQL、Mongo、ES等数据湖和数据仓库的底层原理,具备数据抽象和建模的能力;
- 对Hadoop、Spark,Flink,Ray等大数据处理的相关经验为加分项;
- 具备出色的沟通和协作能力,注重细节、善于分析问题并解决问题。