岗位职责
岗位介绍:用医学知识投喂+调教AI,做AI的医学老师。
- 梳理患者不同病情下,AI问诊的医学思路,帮助AI学习医生诊疗逻辑,让AI能像医生一样问诊患者;
- 梳理不同科室、不同病例,AI分析病情、完成初步诊断和鉴别诊断的医学思路,帮助AI强化鉴别诊断能力,让AI具备媲美医生的诊断准确率;
- 梳理判断AI回答专业度的评测维度、评测标准及评测方法,共同构建医疗AI评测体系。
职位要求
- 专业要求:临床医学、基础医学、预防医学,在校学生均可(若本科在校生则需有科室实习经验)。
- 其他要求:有医疗类AI产品使用经验,或者懂R、Python,或医疗数据处理经验更佳。
- 实习时间:至少实习2个多月,每周到岗3天及以上(每天8小时)。 请提前准备以下题目(任选其一)
- 评价一下Healthbench,或 PhysicianBench。
- 同时评测 4 个模型(GPT-
- Gemini-
- 1-Pro、DS-v4-Flash-0731、Claude Opus
- 8)在一道医学问答题上的表现,使用 LLM-as-judge 打分(0-10)。结果 Claude 得
- 2,显著高于其他3个模型(均值
- 5)。请列出至少 3 个可能导致该结果的系统性偏差,并针对每一个给出具体的排查或缓解方法。