联系我们

课程大纲

AWS云运维基础

  • 云环境中的运维角色与职责
  • AWS账户结构、组织及多账户策略
  • 核心运维服务:CloudWatch、CloudTrail、AWS Config

基础设施即代码与配置

  • IaC及不可变基础设施的原则
  • 使用Terraform和AWS CloudFormation进行配置
  • 管理状态、模块及环境提升

CI/CD与部署策略

  • 为云原生应用设计CI/CD流水线
  • 蓝绿部署、金丝雀部署及滚动部署
  • 自动化回滚、健康检查及发布验证

监控、可观测性与告警

  • 指标、日志和追踪:传输、存储及分析
  • 使用CloudWatch、X-Ray及第三方可观测性工具
  • 定义SLO/SLI、告警策略及值班实践

安全运维与身份管理

  • IAM最佳实践、最小权限及跨账户访问
  • 密钥管理、KMS及安全参数存储
  • 运维安全:补丁策略、漏洞扫描及审计追踪

韧性、备份与灾难恢复

  • 设计容错和高可用性
  • 备份策略、快照自动化及恢复流程
  • 灾难恢复规划及运行手册创建

成本优化与治理

  • 成本可见性:账单、标签及成本分配策略
  • 调整规模、预留实例/节省计划及预算控制
  • 治理:合规政策、防护措施及自动化

容器、Serverless及运行时运维

  • ECS、EKS和Lambda的运维考量
  • 服务发现、自动扩展及资源限制
  • 容器化工作负载的日志记录、追踪及调试

应急响应、演练手册及混沌工程

  • 基于运行手册的应急响应及事后复盘实践
  • 自动化修复及自愈模式
  • 混沌实验入门,用于验证韧性

动手实践:运维一个示例工作负载

  • 使用IaC和CI/CD流水线部署示例应用
  • 实施监控、告警及自动化修复脚本
  • 模拟故障并练习基于运行手册的响应

总结与后续步骤

要求

  • 基本了解云概念和网络
  • 熟悉Linux命令行和脚本编写
  • 有源代码管理(Git)及基础CI/CD概念的经验

目标学员

  • 云运维工程师
  • SRE及平台工程师
  • DevOps工程师及技术团队负责人
 21 小时

客户评论 (1)

即将举行的公开课程

课程分类