岗位描述(节选)
1、大规模视频理解:负责可灵海量视频数据的打标分类、语义分割、文字识别、Caption生成、聚类分析等工作;
2、模型开发与优化:基于CNN、VLM等技术推进模型训练、微调、评测及高效部署,推动模型在实际场景中的大规模应用;
3、技术研究与创新:聚焦多模态视频生成领域前沿课题,探索生成模型的数据采样技术,提升生成模型的数据使用效率和语义响应能力,打造在业界的领先技术优势;
4、跨领域协作:参与跨团队跨部门技术协同,推动Human in the loop在视频生成领域的研究落地。
【任职要求】
1、学历与经验:硕士及以上学历,3年及以上相关工作经验。计算机视觉、自然语言处理或多模态方向背景优先;
2、学术背景:具备较强的学术调研能力,能快速理解和实现论文中的算法;有高质量论文发表、开源项目贡献、ACM竞赛或相关学术比赛获奖经历者优先;
3、深度学习能力:熟练掌握深度学习框架(如PyTorc……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 11029 个北京岗位(全城各职能合计),其中 2386 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 5.5K ~ 16K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:美团 1313 个快手 1014 个阿里巴巴集团(含高德/阿里云) 797 个理想汽车 498 个京东 336 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。