岗位描述(节选)
【岗位职责】
1、负责抖音直播实时互动相关的多模态内容理解工作,打造业界领先的多模态内容理解大模型;
2、基于CNN、VLM等技术推进模型训练、微调、评测及高效部署,推动模型在下游业务上的应用,包括并不限于多模态对话、多模态互动内容生成、Caption文本生成等,助力业务规模应用落地;
3、规划实现并优化海量多模态数据的预处理、清洗、标注、特征提取及高效融合方法。
【任职要求】
1、本科及以上学历,计算机相关专业;
2、在计算机视觉/多模态某领域有深入的研究或项目经验,在顶级学术会议有论文发表者或获得竞赛优胜者优先;
3、熟悉多模态大模型(VLM)、大语言模型(LLM)、RL相关的算法技术,熟悉大模型相关的数据构造方法、Post Training算法,对多模态数据处理具备优秀的独立开发与调试能力;
4、有大规模模型训练、压缩、蒸馏、微调等经验,熟悉Megatron、Deepspeed等框……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 19019 个北京岗位(全城各职能合计),其中 2814 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3923 个小米集团 1142 个快手 1017 个阿里巴巴集团(含高德/阿里云) 801 个美团 753 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。