岗位描述(节选)
1. 大模型推理与调度平台建设:主导多模态/LLM 推理服务化与模型调度中台(自研/二方/三方)建设,支持同模型多账号、多模型共存、降级容错与弹性扩缩容,保障高并发低时延的线上推理体验。
2. 推理加速与资源效率优化:推进推理加速与 GPU 资源复用等优化策略落地,提升模型利用率并降低单位推理成本。
3. 模型成本治理体系:建设模型资源(如配额、用量、费用、使用期限/到期策略)可视化与治理闭环,推动降本动作落地并形成可持续的成本优化机制。
4. 服务端基础架构演进与全球化支撑:负责全球多 Region 架构规划与服务端架构演进,建设统一网关与用户服务体系,支撑业务快速迭代与流量调度、容错容灾与性能优化。
5. SRE 稳定性与可观测性建设:构建全链路监控与自动化运维能力,完善异常响应、容量管理与弹性扩容机制,提升平台可用性与可运营性。
6. 架构融合与平台化治理:推动团队多款 AI 产品服……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。