岗位职责
- 主导公司在半导体领域大模型的尖端研发,包括但不限于预训练模型调优,指令微调等核心技术;
- 对接业务需求,在产品设计、验证、制造和测试的环节中构建定制化大语言模型解决方案,以提升研发效率和良率;
- 密切关注大模型领域的最新动态,将前沿技术转化为实际应用,推动公司技术边界持续拓展。
职位要求
- 硕士及以上学历,博士优先;
- 计算机、应用数学、信号处理、通信、自动化等相关专业。 其它要求
- 通过CET-4,具备良好的英语听、说、读、写能力;
- 熟练掌握Python,精通PyTorch、TensorFlow、HuggingFace等主流深度学习框架,熟悉Linux开发环境;
- 扎实的深度学习与机器学习基础,具备计算机视觉(CV)、自然语言处理(NLP)、语音或时序分析等至少一个方向的实践项目经验;
- 了解大模型(LLM)、多模态、AIGC等技术领域的基本原理与最新动态;
- 对智能算法与大模型技术有强烈的兴趣和热情,具备出色的自我驱动与持续学习能力;
- 逻辑清晰,具备良好的团队协作精神与沟通能力。 加分项
- 在CVPR、ECCV、NeurIPS、ICML等学术会议或期刊上发表过优秀论文;
- 在Kaggle、ACM、数学建模等高水平算法竞赛中取得优异成绩。