岗位描述(节选)
1. 负责大模型推理系统与全链路仿真领域的技术规划与核心研发,制定仿真技术路线,主导震旦从模型、算子到调度和服务的仿真架构演进。
2. 构建请求调度、KV Cache、并行计算、通信及分离架构的系统模型,刻画异构AI服务器在真实业务负载下的时延、吞吐和资源效率。
3. 贯通流量画像、算子性能模型和系统仿真,形成异构AI服务器的部署策略、容量规划方案、瓶颈归因及系统优化方案,并推动业务应用。
4. 交付仿真引擎、系统模型库、标准接口和方案分析结论,并推动核心技术进入主流推理框架及开源社区。
【任职要求】
1. 3年大模型推理系统、分布式系统、性能建模或仿真平台研发经验,能够独立负责仿真模块从设计、实现到校准验收的完整交付。
2. 精通C++和Python,源码级熟悉SGLang、vLLM等推理框架的请求调度、KV Cache、批处理和多机多卡执行机制。
3. 熟悉离散事件仿真、虚拟时钟、H……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。