岗位职责
- 探索AIGC技术的相关技术,包括图片生成、视频生成、语音合成、数字人、智能对话等领域;
- 结合业务场景,设计并实现AIGC相关的算法和模型;
- 参与AIGC技术的性能优化和工程化工作;
- 持续学习和跟踪AIGC技术的最新进展,为团队提供技术支持和指导。
职位要求
- 熟悉Python、java等编程语言;
- 熟悉Pytorch或者tensoflow, 有过CNN、RNN等深度学习模型的实践经验, 熟悉U-Net、GAN等网络结构;
- 熟悉计算机图形学、音视频处理等相关技术, 了解常用图片格式,音、视频常用编码,熟悉ffmpeg的使用;
- 熟悉多模态大模型、多模态数据处理等相关技术;
- 具备优秀的编程能力和创新思维,能够独立完成技术方案设计和实现。 加分项
- 了解Stable Diffusion的技术原理,熟悉ComfyUI的优先;
- 有过数字人相关项目经验优先;
- 有TTS等相关项目经验经验优先;
- 有AIGC相关项目经验或研究成果,或在AIGC领域有发表论文或专利;
- 有过前端开发经验,熟悉webgl优先。