岗位描述(节选)
1. 主导大模型推理性能优化:通过算子优化、模型压缩/量化/稀疏化、推理引擎开发及分布式系统设计等技术手段,全面提升大模型在GPU/PPU等异构硬件上的推理速度、系统效率与部署性价比。
2. 开展软硬协同的深度调优:针对不同架构和规模的AI加速硬件(如GPU、专用AI芯片),对KV Cache管理、内存调度、计算图优化等核心模块进行定制化性能调优,突破算力与访存瓶颈。
3. 支撑多模态与前沿模型架构落地:参与大模型推理系统的核心模块研发,支持Transformer、MoE、Diffusion、LLM、VLM等多种架构的高性能推理,并与算法、产品及业务团队紧密协作,实现端到端场景优化。
4. 构建高性能AI基础设施:基于软硬件协同理念,打造业界领先的AI推理底座,通过融合模型算法与底层硬件特性,释放组合优化潜力,形成显著的性能与成本优势。
5. 追踪和引领技术前沿:持续关注大模型推理领域的最……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。