岗位描述(节选)
1. 负责 AI 模型推理服务的工程化部署和生产环境稳定性保障,覆盖 LLM、CV、语音、多模态等模型服务。
2. 负责推理平台能力建设,包括模型发布、服务编排、灰度发布、回滚、弹性扩缩容、流量治理、实例管理和资源隔离。
3. 基于 Docker、Kubernetes、Triton、vLLM、SGLang 等技术栈,推动模型服务标准化、自动化和平台化。
4. 建设推理服务监控、日志、告警、压测和性能回归体系,保障线上服务 SLA 和性能稳定性。
5. 负责推理服务线上问题排查与稳定性治理,包括资源异常、服务超时、性能抖动、显存不足、实例异常等问题定位。
6. 与算法、SRE、基础设施和业务团队协作,支持模型从实验环境到生产环境的落地。
【任职要求】
1. 有 2 年以上后端开发、平台工程、AI 基础设施、MLOps 或推理服务部署经验。
2. 熟悉 Linux、Docker、Kubern……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。