← Tất cả chương
CHƯƠNG 11 / 20 · Vận hành
Kubernetes SRE & Reliability
Scheduling, PDB, lỗi node, SLO, tracing và disaster recovery.
4 trang bài học•Ví dụ CLI/YAML•Lab có hướng dẫn
LỘ TRÌNH CHƯƠNG
0/4 đã đọc
Học từng phần, không cần đọc hết một lần
01
02
03
04
Scheduler: affinity, taints, topology
Placement là một quyết định reliability, không chỉ tìm CPU còn trống.
Đọc bài học ↗Node drain, PDB và disruption
Diễn tập failure mà không tự tạo downtime ngoài ý muốn.
Đọc bài học ↗SLI, SLO và Error Budget
Đo reliability bằng kết quả người dùng thay vì chỉ Pod Ready.
Đọc bài học ↗Incident Response và tracing
Từ một 500 đến một timeline có thể kiểm chứng.
Đọc bài học ↗
THỰC HÀNH
Đi từ lý thuyết đến kết quả
Bộ lab được thiết kế cho môi trường thực hành. Với cloud hoặc thao tác phá hủy dữ liệu, hãy đọc cảnh báo trong README trước khi chạy.