岗位职责
- 聚焦豆包手机助手与产品形态,推动质量风险识别与问题解决,保障产品质量与用户体验;
- 统筹质量保障智能化建设,探索并实践人工智能(AI)/大模型在质量保障领域的应用,提升研发与测试的效率及质量;
- 跟踪大语言模型(LLM)领域最新研究成果,持续优化算法应用效果,研究方向涵盖大语言模型(LLM)、多模态大语言模型(MLLM)、提示词工程(Prompt工程)、检索增强生成(RAG)、智能代理(Agents)、监督微调(SFT)、人类反馈强化学习(RLHF)等前沿技术;
- 大模型业务场景的评测工作与评测体系建设,包括设计、制定及完善评测方案、评测指标,开展评测数据收集与更新、评测执行工作,并输出专业评测报告;
- 参与评测相关自动化工具的开发与维护,最大化提升评测效率。
职位要求
- 硕士学位及以上,计算机、人工智能、统计等相关专业优先;
- 熟悉Transformer、BERT、DiT、CLIP、CNN、GAN、VAE、Diffusion Models等AI模型基本原理;
- 熟悉LLM、MLLM模型的部署、训练或微调,熟悉大模型评测基准、评测方法;
- 扎实的代码基础,至少掌握一门高级语言,包括Python、C/C++、Java;
- 了解质量保障基础知识,具备良好的视野,善于学习新的知识、阅读论文、动手能力强;
- 良好的沟通能力和团队协作精神,严谨的工作态度与高质量意识,逻辑清晰、善于分析与总结,对大模型技术有热情和探索精神。 【加分项】
- 有大模型应用建设的经验者优先;
- 有智能化质量提效成功案例的经验者优先;
- 有成功构建AI测试系统、开发AI测试工具或相关项目经验者优先(比如AI Risk Analyse、AI案例、AI Test、AI Code Review等);
- 在会议(NeurIPS/ACL/CVPR/ICML/EMNLP/IJCAI/AAAI/SIGIR等)发表过论文者优先。