岗位描述(节选)
1.负责多模态大模型的算法研发与系统构建,推动CV与LLM的深度融合。
2.设计并实现视觉理解、图像/视频内容生成、跨模态检索等核心模块,支持工业级多模态应用落地。
3.开展多模态Agent系统开发,构建具备视觉感知能力的智能体决策与交互框架。
4.跟踪前沿技术动态,推动技术创新与业务场景结合。
【任职要求】
1. 硕士及以上学历,计算机科学、人工智能、计算机视觉、模式识别、电子信息等相关专业。
2. 3年以上计算机视觉或多模态相关项目经验,具备CV系统开发能力者
3. 熟悉多模态大模型技术栈(如视觉编码器、跨模态对齐、指令微调、RLHF)及优化技术(LoRA、QLoRA、模型量化、KV Cache优化)者优先
4. 熟悉Agent Harness系统(如OpenClaw等)者优先
5. 扎实的数学与算法基础,熟悉计算机视觉核心领域(目标检测、图像分割、视觉Transformer、多模态……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。