岗位职责
- 预训练和持续学习:进行大规模预训练、持续学习和自主迭代,突破自然语料、多模态、上下文和记忆的瓶颈;
- 大语言模型数据科学:压缩世界知识和经验,构建基础模型智能的深厚内在和锋利边界;
- Scaling机制和最优化:解读模型的优化动态,用数学物理和实验科学,破解模型训练的不确定性难题;
- 通用效率优化:让数据更快迭代,让训练更快收敛,让评估更快置信,让实验更快见效,让下一代智能更早浮现。
职位要求
- 拥有扎实的数学功底和机器学习理论基础;
- 优秀的代码能力、数据结构和基础算法功底,熟练C/C++或Python/Rust,熟悉Vibe coding和Agent工程优先;
- 熟悉NLP/CV相关算法和技术,熟悉Pretrain、Post-training算法,在相关领域有良好研究记录者优先,在大模型领域主导过具有广泛影响力的项目或论文者优先。