岗位职责
- 深度参与医疗领域大模型(Medical LLM)的全链路研发,负责包括基础模型预训练、指令微调(SFT)、以及基于人类反馈的强化学习(RLHF)等核心技术的建模与优化
- 探索并实现面向医疗诊断辅助、健康管理等复杂场景的 AI Agent 架构,设计多步推理、工具调用及反思机制,提升模型解决实际医学问题的能力
- 建立完善的医疗垂直领域模型评估体系,从医学专业性、安全性、逻辑性等维度持续迭代算法方案
职位要求
- 熟悉先进大模型的算法原理,有丰富的大模型训练(pre-train/post-train)或数据样本合成方面的经验或技巧优先
- 有大模型强化学习训练上有经验者优先,包括但不限于RFT、RLVR、PPO、GRPO等
- 在大模型方向有高质量(ACL、EMNLP、AAAI等)论文或开源项目产出者优先
- 自驱力强、有良好的协作能力
- 对医疗健康行业感兴趣,有热情