岗位职责
- 参与医疗领域大模型的预训练、SFT、强化等工作,使模型效果位于业界领先水平;
- 调研大模型前沿技术方案,在模型训练范式、模型结构、数据配比探索最佳实践方案,取得业务效果大幅提升的同时实现前沿技术突破;
- 探索理想态的CoT、LongCoT样本,结合GRPO/PPO等算法进行强化激发,提升模型的泛化能力。
职位要求
- 人工智能、计算机、数学相关专业优先;
- 优秀的代码能力、数据结构和基础算法功底,熟练掌握C/C++或Python编程语言;
- 熟悉计算机视觉(CV)相关的算法和技术,对MLLM中模型结构、ViT训练、Detail Caption等方向有深入理论研究和实践;
- 有自然语言处理(NLP)、大模型训练和强化学习(RL)算法经验者优先。 加分项:
- 有ICML、ICLR、NeurIPS、ACL、CVPR等顶级学术会议发表过有影响力研究成果的优先;
- 在ACM/ICPC、NOI/IOI、Kaggle等编程/AI比赛获奖者优先;
- 主导、参与过AI相关的有大影响力的开源/闭源项目的优先。