聯繫我們
 課程時長 14 時間:

課程簡介

自我修复流水线基础

  • 自主恢复的关键概念
  • CI/CD中常见的故障模式
  • 提升流水线稳定性的AI驱动方法

即时异常侦测

  • 了解流水线遥测资料来源
  • 运用机器学习预测故障
  • 使用AI模型侦测异常模式

事件辨识与根本原因分析

  • 自动分类事件类型
  • 关联日志、追踪与指标
  • 利用AI讯号隔离根本原因

自动恢复工作流程设计

  • 定义自动修复动作
  • 从AI警报触发工作流程
  • 将Runbook与智能决策引擎整合

建立智能回馈循环

  • 撷取历史故障资料
  • 训练模型以持续改善
  • 确保流水线行为具备自适应学习能力

将自我修复能力整合至CI/CD

  • 在构建与部署阶段嵌入自动化
  • 支援混合云与多云交付平台
  • 与组织的DevOps治理保持一致

进阶可靠度模式

  • 设计具预测韧性的流水线
  • 运用基于政策的决策系统
  • 透过AI编排实作备援策略

端到端自我修复流水线实作

  • 结合异常侦测、根因分析与自动修复
  • 验证已完成工作流程的韧性
  • 确保工程师获得可观测性与透明度

总结与后续步骤

最低要求

  • 了解CI/CD流程
  • 具备DevOps或SRE实务经验
  • 熟悉监控或可观测性工具

目标受众

  • SRE
  • DevOps主管
  • 平台可靠度工程师

人數


每位參與者的報價

即將到來的課程

課程分類