部门介绍
AI数据与安全团队为Seed基座模型及AI原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据规模化生产、数据飞轮搭建,不断提升数据质量,支持模型快速迭代。 团队由产品经理、数据工程、数据运营等跨职能人才组成,并通过与Seed研究员、行业专家、全球顶尖数据供应商紧密合作,从真实场景中收集反馈并分析模型表现数据,解决AI前沿突破过程中的复杂数据问题,推动模型性能与用户体验的双重提升;我们既是帮助模型技术迭代的一线贡献者,也是模型和AI产品的一手用户。
- 挖掘模型短板,定义高价值数据,辅助模型能力的有效提升;
- 负责数据的采集、清洗、存储及管理,构建稳定高效的数据处理流程,并优化现有数据生产链路,提高数据处理效率;
- 设计数据生产策略,各节点数据交互逻辑,验收标准,对完整的挖掘生产链路负责;
- 运用数据挖掘、统计分析、大模型工具等方法,挖掘数据价值、满足业务需求,并对业务数据进行深入分析,输出数据报告与可视化结果,为业务决策提供支持;
- 跟踪前沿数据技术,持续推动数据工程能力落地和团队技术升级。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 计算机、统计学、数学、数据科学等相关专业,本科及以上学历;
- 精通Python、SQL等编程语言,具备良好的算法和数据结构基础;
- 熟练掌握数据挖掘、机器学习、深度学习等相关技术及工具;
- 熟悉常用数据分析方法,如回归分析、分类、聚类、关联规则挖掘等;
- 熟悉大数据处理技术和平台(如Hadoop、Spark、Hive);
- 具备良好的逻辑分析能力、问题解决能力、团队协作能力和数据敏感性,能够将业务需求转化为数据方案。 加分项:
- 重度大模型Agent使用者优先;
- 熟悉数据可视化工具者优先;
- 具备生产级数据处理和工程化经验。