岗位描述(节选)
1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。
2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。
3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。
【任职要求】
1. 自然语言处理、机器学习、数据挖掘、人工智能等相关专业的硕士生/博士生;
2. 熟练掌握Tensorflow、Pytorch等深度学习框架,扎实的编程基础,具备独立的算法实现能力;
3. 有LLM实操经验,参与过大模型预训练,SFT,RLHF等项目;有垂域基座模型项目经验者优先,参与过大模型结合搜……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 6341 个北京岗位(全城各职能合计),其中 1549 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 4.7K ~ 10K(25~75 分位),中位约 6.5K,最低 2K、最高 250K。
在招岗位较多的企业:阿里巴巴集团(含高德/阿里云) 815 个美团 518 个理想汽车 497 个京东 311 个小米集团 305 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。