岗位描述(节选)
【岗位职责】
1、针对字节跳动商业化(广告、电商、生活服务)场景中文本、视觉、语音多种模态的内容理解问题,负责多种尺寸的LLM、VLM、Omni基座模型迭代;围绕预训练、SFT、RL、及推理环节优化,提升模型在通用&领域多种测评集的真实泛化能力;
2、负责大规模多模态数据的分析洞察,利用算法深度挖掘数据多样性、数据分布、数据质量、数据特征对模型预训练、SFT微调效果的关联影响,为模型训练策略优化、效果迭代提供数据依据;
3、探索多模态大模型领域的长期关键问题,研究方向包括但不限于视觉/语音编码器(ViT/AuT)、模型结构、统一多模态理解-生成-编辑(Unified Model)、音频/视频内容理解、音乐理解、Reward Model、强化学习及其变种(PPO/GRPO/OPD.etc)、Agentic RL、推理加速等。
【任职要求】
1、本科及以上学历,计算机相关专业,具备扎实的深度……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 19019 个北京岗位(全城各职能合计),其中 2814 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 9K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3923 个小米集团 1142 个快手 1017 个阿里巴巴集团(含高德/阿里云) 801 个美团 753 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。