岗位描述(节选)
负责集团多种大模型的基础训推性能优化,聚焦异构GPU的高性能算子库、通信库的开发和优化,提升计算、通信的并行效率,设计并实现高效的并行计算策略、分布式推理方案等。面向集团多变的大模型训推场景,提炼核心的优化方法,探索通用的编译优化方案,跟进前沿技术,并将优化能力集成到自研/开源大模型推理/训练框架/编译器,推动优化方案在实际业务场景中的落地,持续创新构建业界领先的AI Infra。
【任职要求】
1、计算机相关专业本科及以上学历,熟悉C++、Python,具备良好的算法与数据结构基础,有高性能计算相关经验优先;
2、熟悉GPU硬件架构,了解CUDA/ROCm/Triton/CUTLASS/Composable Kernel/TileLang等一种或多种并行编程语言,并具备实际算子开发经验,如GEMM/FlashAttention等计算Kernel优化经验,或DeepEP等通信Kernel……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。