Devops运维工程师
2026-06-23 15:24:41 刷新
200-400/天 上海 不限 5天/周 实习3个月
周末双休一对一导师
微信扫码同步查看
投递方便通知及时
扫码手机查看
投个简历
职位描述:
负责生产环境服务、应用系统、GPU服务器的全生命周期管理,包括部署、运维、优化及故障根因分析,参与智算中心GPU组网,支撑高算力业务场景需求。 主导K8s集群及业务系统运维架构、CI/CD体系优化,推动云原生、微服务升级。 完善全链路监控体系,建立智能告警,主导重大故障应急与复盘,落地故障管理SOP。 跟踪Aiops/agent、云原生领域前沿技术,结合公司业务场景进行技术选型与落地实践,持续完善K8s集群平台功能,推动团队运维智能化。 跨部门协作,对接研发、测试团队,优化流程提升交付效率。 DevOps/运维开发经验,公有云及K8s运维经验,有大规模服务器(含GPU)自动化运维经验。 了解AIOPS技术栈,有实际操作经验优先 熟悉Linux系统,熟悉网络协议,具备扎实的系统、网络、存储知识,能独立解决复杂故障。 熟悉K8s及相关生态圈,有大规模K8s实战经验;熟悉GPU运维,有高算力及AI调度经验者优先。 熟悉主流监控工具,能独立搭建全链路监控,具备监控优化及问题排查能力。 了解掌握Python、Shell、Golang中等运维开发语言,熟悉Ansible,有自动化脚本开发经验。 熟悉SRE方法论,具备优秀的故障排查、根因定位及复盘能力。 具备良好的沟通协作与管理能力,责任心强、能抗压,
投递要求:
简历要求: 中文
截止日期:2026-12-08
工作地点:
上海市/上海市/浦东新区 浦东新区祥科路111号2#楼6楼、7楼
求职中若出现虚假宣传,收取财物等违法情况。请立即举报
投个简历

职位百科

为你揭秘各职业的工作内容|薪资水平…

架构师

百科详情

确认和评估系统需求,给出开发规范,搭建系统实现的核心构架,并澄清技术细节、扫清主要难点的技术人员。