岗位职责
- 对图像、视频、文本等进行深入的语义理解,支持短视频、直播、搜索、推荐、商业化等业务需求;
- 推进视觉相关基础技术研发,如大规模分类、检测、分割、序列识别、人脸、自监督学习、内容生成、模型压缩和优化等;
- 对多模态大模型有基础的了解,可以用目前开源的多模态大模型解决内容安全领域的一系列问题。
职位要求
- 硕士及以上学历,对视觉前沿技术有浓厚兴趣,时刻跟进学术界最新进展,有自己独立的想法和判断,能够快速复现学术界最新成果;
- 编程基础扎实,熟练掌握C++/Python,熟悉Pytorch、TensorFlow等训练框架;
- 对常见的模型结构、建模方法、Loss设计、优化策略、训练过程中的重要tricks等有深入了解和丰富经验;
- 有优秀的逻辑思维能力、数据分析和新知识学习能力,善于分析和解决问题;良好的沟通能力与团队协作能力等。