岗位描述(节选)
【岗位职责】
- 我们正在构建面向下一代大模型的 AI 基础设施。
- 你将深入超大规模 GPU 集群的核心调度链路,解决异构算力管理、复杂工作负载编排、资源效率与系统稳定性等关键问题,为模型训练、推理和持续迭代提供高性能、高弹性、高可用的算力底座。
- 这不是一个以 Kubernetes 运维为主的岗位。我们期待你能够深入调度系统,定义架构、设计机制,并将复杂的基础设施能力沉淀为简单、可靠的工程系统。
职位描述
1. 主导 MiniMax 大模型推理平台与机器学习平台的核心架构设计及演进,构建统一、高效、可扩展的 AI 计算基础设施;
2. 设计超大规模 GPU 集群的资源调度系统,解决异构资源建模、拓扑感知调度、队列与配额管理、优先级与抢占、Gang Scheduling、弹性伸缩等复杂问题;
3. 面向训练、推理、评测及数据处理等多类型工作负载,持续优化资源流转效率、任务吞吐、调度时……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 893 个北京技术研发岗位,其中 50 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 28K(25~75 分位),中位约 20K,最低 4K、最高 70K。
在招岗位较多的企业:理想汽车 241 个阿里巴巴集团(含高德/阿里云) 109 个京东 74 个美团 72 个小红书 55 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。