岗位描述(节选)
1. 集团级AI数据引擎架构:负责架构基于文本和多模态数据(音频、图像、视频)的采集、清洗、处理、治理与资产化管理,打造可复用、可观测、可解释的 EB 级数据体系,支撑大模型训练与推理的高质量数据供给;
2. AI Native数据Pipeline设计和建设:设计并带领团队建设实施高效数据管线,实现数据分渠道过滤、去重、质量诊断、调度编排和异常告警等环节的自动化,显著降低人力成本;
3. 设计和实现数据&模型闭环迭代:与数据策略团队合作,基于评测反馈的短板,设计对应的专项数据集,并在训练过程中构建可观测指标,量化数据对模型能力提升的贡献,动态更新数据集,实现数据 → 模型 → 评测 → 数据的循环优化;
4. 负责数据资产治理:负责元数据、数据血缘、分类分级、质量评分、数据标准、价值评估等治理框架的设计与落地,推动数据资产的可视化与可运营化,让数据可管理、可复用、可增长。
【任职要求】
……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。