1.参与公司阿里云基础设施和 AI 基础设施的日常运维、交付支持和技术研究工作,覆盖 IaaS、PaaS、SaaS 相关云服务能力。
2.协助上海基础架构团队完成重庆研发中心相关云资源、网络、账号权限、存储、监控、日志、安全审计等基础设施交付工作。
3.参与 AI 云服务相关能力的学习、验证和落地支持,包括阿里云 ECS、ACK、PAI、百炼、OSS、NAS、SLS、云监控、云安全中心、操作审计等产品。
4.协助对接重庆本地研发、测试、数据、算法和业务团队,收集基础设施与 AI 平台使用需求,并反馈给上海基础架构团队。
5.参与 AI 项目基础环境交付,包括云资源申请、权限开通、网络连通性检查、存储配置、容器环境检查、模型服务运行状态检查等。
6.参与重庆研发中心基础架构运维工作,包括办公网络、服务器、终端接入、基础运维平台、账号权限、故障响应和日常巡检等。
7.协助开展云资源和 AI 基础设施的监控、巡检、告警响应、日志分析、问题记录和故障复盘。
8.协助完成 AI 基础设施相关的安全、审计和合规支持工作,包括权限检查、日志留存、操作记录、安全基线、漏洞整改和审计材料整理。
9.参与云基础设施自动化能力建设,使用 Python、Shell、AI 编程工具等提升运维效率,沉淀巡检脚本、自动化工具和标准化文档。
10.跟踪云计算、AI 基础设施、MLOps、AIOps、云原生、AI Agent、模型服务等方向的新技术,参与内部技术调研、PoC 验证和方案整理。
任职要求
1.2027届硕士优先,计算机、软件工程、人工智能、网络工程、信息安全、自动化、电子信息等相关专业优先。
2.985 / 211 高校或同等水平院校背景优先。
3.具备较强的学习能力、逻辑分析能力和技术钻研能力,能够快速学习云计算、AI 基础设施、云原生和企业 IT 运维相关知识。
4.了解 Linux 操作系统基础,熟悉常用命令、进程、日志、磁盘、网络排查等基础操作。
5.了解云计算基础概念,理解 IaaS、PaaS、SaaS、虚拟机、容器、对象存储、网络、安全组、负载均衡、监控、日志等基本概念。
6.了解 Docker、Kubernetes、微服务、CI/CD、DevOps、SRE 等技术概念,有实际课程项目、实验项目或实习经验优先。
7.对 AI 技术有持续学习兴趣,了解大模型、模型训练、模型推理、RAG、AI Agent、MLOps、AIOps 等基础概念。
8.具备 Python、Shell、Go、Java 等至少一种语言的基础开发能力,能够编写简单脚本或工具解决实际问题。
9.能够熟练使用 AI 编程工具或大模型工具辅助学习、代码编写、问题分析和文档整理。
10.具备较好的沟通表达能力、文档能力和责任心,能够配合上海团队完成远程协作、任务反馈和问题闭环。