岗位描述(节选)
1、负责快手短视频多模态内容理解工作,应用计算机视觉、NLP、多模态融合等技术,提升短视频内容体系建设、推荐、搜索的效果和体验;
2、基于多模态模型在下游业务上的应用,包括并不限于多模态分类、标签、caption等文本生成等;
3、负责计算机多模态理解方向前沿问题的研究,参与建设并持续保持部门在多模态业界的技术先进性,保持创新的同时将业界SOTA模型持续优化并落地至线上获得收益。
【任职要求】
1、硕士及以上学历,有大规模模型训练、压缩、蒸馏、微调等经验,熟悉megatron、deepspeed等框架者优先;
2、精通至少一种技术语言,包括但不限于Java、C/C++、C#、Python等;
3、熟悉至少一种深度学习框架(如 TensorFlow、PyTorch),对深度学习基础理论和大规模实践有较深理解;
4、有较强的学术调研、文献阅读和算法实现能力,优秀的独立开发、调试能力,有高质量……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。