岗位描述(节选)
1、大规模多模态数据理解:负责海量多模态数据的打标分类、语义分割、检测、OCR文字识别、Caption生成等工作,提升数据的可用性与质量;
2、数据 pipeline 建设:负责多模态大模型训练数据的构建与管理,参与数据筛选、标注及质量评估工作。分析和挖掘现有数据资源,设计有效的数据分布策略,并设计数据飞轮闭环,将用户交互数据反哺模型迭代;
3、制订长期规划:制定并实施大模型数据建设的长期发展规划,持续推动技术迭代与业务应用场景的拓展。
【任职要求】
1、在深度学习、多模态大模型、视频内容理解等领域有深入理解;
2、熟悉深度学习框架(如PyTorch),在模型训练、压缩和微调方面有丰富实践经验;
3、掌握OCR文字检测与识别、多模态内容理解大模型、多模态相似检索和聚类等算法;
4、具备丰富的大规模视频理解系统的架构设计及开发经验,熟悉Python微服务开发,熟悉TensorRT、vllm……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。