岗位描述(节选)
岗位职责
多模态大模型研发:主导图文、视频、音频、3D等多模态大模型的核心算法研发,包括但不限于多模态预训练、跨模态对齐、多模态理解与生成。
训练与对齐:负责多模态数据的清洗、配比与训练策略制定,主导SFT、RLHF/DPO等多模态对齐工作,提升模型的理解、推理与生成能力。
前沿技术跟踪与落地:跟踪CVPR/ICCV/NeurIPS/ICML/ACL等顶会前沿进展,推动LMM(如GPT-4V、Gemini、Qwen-VL、InternVL、LLaVA等)相关技术在业务场景中的落地。
业务场景赋能:与产品、工程团队协作,将多模态能力应用于图文问答、视频理解、文档解析、AIGC、智能体等场景,解决实际业务问题。
团队建设与指导:指导中初级算法工程师,参与技术路线规划、专利与论文撰写,提升团队整体技术影响力。
任职要求
计算机、人工智能、电子工程、数学等相关专业,硕士及以上学历,博士优先。
5年……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。