岗位职责
- 你将建设面向视频生产的多模态智能体系统,让 agent 能够理解用户需求、分析素材、生成脚本、规划镜头、调用生成模型、检查结果、自动编辑、失败重试并交付成片。
- 你会设计 content-centric harness, tool use、planner、memory、workflow、multi-agent collaboration、human-in-the-loop 和 evaluation environment。
- 协同优化agentic理解模型和生成模型,使得系统实现高质量及高效率生产面向专业场景的成品视频。
职位要求
- 熟悉 LLM/VLM agent、tool calling、RAG、workflow orchestration 等相关技术
- 能快速搭建 demo,也能把 demo 变成稳定系统;能分析 agent 在长链路任务中的失败模式
- 整体优化理解和生成模型性能,提升整体系统可用性 加分项 coding agent、computer use、RL environment、自动化创作工具、视频编辑工具、复杂 workflow 系统经验