工作职责:
1、Site Reliability Engineer,负责Keep公司大规模分布式系统及各类在线服务可靠、稳定、高效运行;
2、关注业界前沿技术动态,负责大规模流量系统的优化,演进和新技术探索和应用;
3、参与在线系统和各类产品架构设计及自动化系统的实现,满足更高的质量与效率要求;
4、参与Keep国内外整体资源运营规划,为产品用户提供优质的接入与使用体验布局;
5、设计研发服务运维解决方案,包括网站加速、持续交付、容量管理、弹性计算、故障分析、流量分配、性能调优等。
职责要求:
1、深入理解Linux操作系统;具备较好的计算机网络和体系结构基础;
2、熟练掌握Java/C/C++/Python/Go/Shell等至少一种主流编程语言;
3、良好的逻辑思维和分析能力,热衷于解决问题、追求极致;
4、强烈的责任心、进取心、团队合作精神和Ownership;
5、专业不限,但更倾向于计算机、通信、数学等理工学科的大三&研二毕业生。
具有以下条件者优先:
1、有大型互联网公司运维岗位实习经历;
2、有大规模分布式程序设计开发经验;
3、熟悉TCP/IP、HTTP/HTTPS等网络协议,有网络故障的Trace能力。
当前职位已下线
为你揭秘各职业的工作内容|薪资水平…
负责维护并确保整个服务的高可用性,同时不断优化系统架构提升部署效率、优化资源利用率提高整体的ROI。