🎯 課程目標__HTMLTAG_68___
- ✅ 災難復原規劃:RPO、RTO、故障情境
- ✅ K8s 資源 + PV 的 Velero 備份與還原
- ✅ etcd 快照備份與還原
- ✅ 跨站點災難復原策略
- ✅ 災難復原測試與運作手冊自動化
第 1 部分:災難復原規劃
程式碼區塊_0
第 2 部分:VELERO 備份與復原__HTMLTAG_86___
程式碼區塊_1
程式碼區塊_2
程式碼區塊_3
第 3 部分:ETCD 災難復原
程式碼區塊_4
第 4 部分:跨站點災難復原
程式碼區塊_5
第 5 部分:DR 運作手冊
程式碼區塊_6
程式碼區塊_7
💡 重點
-
___HTMLTAG_100__HTMLTAG_101___RPO/RTO:在災難發生前定義每個元件的目標
___HTMLTAG_104__HTMLTAG_105___Velero:K8s 資源 + PV 備份到 S3/Ceph
___HTMLTAG_108__HTMLTAG_109___etcd:定期快照,經過測試的復原過程
___HTMLTAG_112__HTMLTAG_113___GitOps:基礎設施即程式碼 = 即時重新部署
___HTMLTAG_116__HTMLTAG_117___跨站點災難復原:PostgreSQL 流複製 + S3 同步
___HTMLTAG_120__HTMLTAG_121___定期測試:未經測試的備份不是備份
🎯 練習__HTMLTAG_127___
練習 1:Velero DR
- 使用 S3 後端設定 Velero
- 為所有命名空間建立計劃備份__HTMLTAG_134___
- 模擬命名空間刪除→從備份還原
練習 2:災難復原練習
- 記錄叢集的災難復原操作手冊
- 執行 etcd 恢復練習__HTMLTAG_144___
- 測量實際 RTO 與目標
📚 下一篇文章
在 第 45 課:使用 Litmus 進行混沌工程,我們將主動測試系統彈性。