岗位描述(节选)
工作职责:
1. Omni VLM 基础模型研发
- 负责面向视频理解的 Omni VLM / 多模态理解基础模型研发。
- 参与模型架构、数据体系、训练方法和评测体系建设。
- 开展大规模图像、视频、音频和文本数据上的 VLM 预训练。
- 开展多模态 SFT、偏好对齐、强化学习、复杂推理等后训练工作。
- 提升模型在长视频理解、时序推理、细粒度感知和多模态交互等方面的能力。
2. Captioner
- 建设高质量视频 Caption 和结构化语义理解能力。
- 提升模型对人物、场景、动作、事件、镜头、风格、音频和叙事等信息的理解。
- 为视频生成基模提供高质量训练数据和语义条件。
3. Prompt Enhance(PE)
- 研发面向视频生成的 Prompt Enhance 模型与策略。
- 将用户简短或模糊的意图转化为准确、丰富且适合视频生成的提示词。
- 提升生成结果的语义一致……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 9394 个上海岗位(全城各职能合计),其中 1138 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7.5K ~ 20K(25~75 分位),中位约 12K,最低 0.8K、最高 100K。
在招岗位较多的企业:米哈游 618 个哔哩哔哩股份有限公司 432 个闻泰科技股份有限公司 409 个联影医疗 361 个阿里巴巴集团(含高德/阿里云) 319 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。