岗位描述(节选)
图像与多模态实验室致力于构建涵盖语言、视觉、语音等多种模态的基础模型,支持多模态感知、理解、推理、生成与编辑等核心任务。我们的目标是为模型应用提供世界一流的基础模型保障,推动从纯语言任务到多模态任务的拓展,并实现从数字世界到物理世界的深度融合。
1.与算法研究员协同工作,分析模型在训练与推理阶段的性能瓶颈,从系统-算法协同角度提出改进方案;
2.主导或参与量化方案(量化感知训练QAT/训练后量化PTQ)的设计与实施,保障低比特下的模型质量;
3.主导或参与Diffusion模型步数蒸馏工作,将业界前沿的加速技术(如一致性模型、渐进式蒸馏)落地到生产环境;
4.基于vLLM / Sglang / TensorRT-LLM等框架进行深度定制与优化,开发高性能推理引擎;
5.设计与实现动态批处理、持续批处理、流水线/张量并行等高级推理服务与调度策略。
【任职要求】
1.计算机科学、人工智能、……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。