岗位职责
- 面向字节跳动豆包、电商、生活服务等业务,深耕路网领域多模态大模型技术体系建设,打造VLM驱动的下一代路网数据生产能力,为AI Agent提供精准的现实世界空间数据底座,支撑全场景出行与位置服务需求;
- 参与路网多模态生产全链路算法设计与落地,负责业务场景LLM、VLM的微调优化,结合传统感知能力,攻克小目标识别、复杂场景泛化、多源数据融合等算法难题,提升生产效率与自动化率准确率;
- 参与大模型智能审核侧的算法建设,落地RAG、Agent工具调用,针对拓扑维护、隐式语义、多源冲突等复杂场景构建裁决算法,持续提升审核自动化率,提升生产效率与数据质量;
- 跟踪多模态大模型、空间语义理解、端到端路网生成等前沿技术方向,探索VLM在LBS领域的创新应用,推动算法效果迭代与数据闭环建设,参与定义下一代路网数据生产的技术范式。
职位要求
- 本科及以上学历,计算机相关专业;
- 在计算机视觉/多模态某领域有深入的研究或项目经验;
- 熟悉多模态大模型(VLM)、大语言模型(LLM)、RL相关的算法技术,熟悉大模型相关的数据构造方法、Post-Training算法,对多模态数据处理具备优秀的独立开发与调试能力;
- 有模型训练、压缩、蒸馏、微调等经验;
- 优秀的分析和解决问题的能力,对解决具有挑战性的问题充满激情,良好的沟通和团队合作能力。 加分项
- 在学术会议有论文发表者或获得竞赛优胜者优先。