Commvault - Failover/Failback Orchestrated
Trong bài Lab này sẽ thực hiện kịch bản Failover/Failback, trước tiên hãy đọc nội dung bài viết sau Link, trước khi thực hiện bài Lab này.
PHẦN 1: Tạo kịch bản DR (Cấu hình Failover Group)
- Tại CommCell Browser, Dev-Test&DR > Chuột phải vào Failover Groups > New Group.
- Nhập tên cho nhóm (Ví dụ: FG_Core_Applications).
- Tab Virtual Machines (Xếp thứ tự khởi động):
- Nhấn Add để đưa các VM từ nhóm Live Sync vào đây.
- Thiết lập Sequence (Thứ tự): Bạn có thể nhóm các VM vào các nhóm ưu tiên (Group 1, Group 2...). Hệ thống sẽ tự động bật các VM ở Group 1 trước, đợi chạy xong (hoặc sau x phút) mới bật tiếp Group 2.
PHẦN 2: Thực hiện Failover
Khi site chính gặp sự cố, bạn chỉ cần mở Console lên và thực hiện các bước sau
- Chuột phải vào nhóm thảm họa bạn vừa tạo (FG_Core_Applications).
- Chọn Failover > Chọn một trong hai hình thức:
- Planned Failover (Thảm họa có kế hoạch): Dùng khi bạn chủ động bảo trì site chính. Commvault sẽ tắt VM site chính một cách an toàn -> Chạy 1 bản backup inc hoặc full để lấy các dữ liệu cuối cùng > replication sang site DR-> Bật VM site DR lên (đảm bảo dữ liệu gần như là chính xác). (Đảm bảo không mất dữ liệu - RPO = 0).
- Bước 1: Tắt nguồn VM ở site chính để đóng băng dữ liệu (không cho người dùng ghi thêm dữ liệu mới vào đĩa ảo nữa).
- Bước 2: Commvault tự động kích hoạt một job Incremental Backup cuối cùng. Mục đích là để vét sạch toàn bộ những khối dữ liệu thay đổi mới nhất (Final Delta Changes) phát sinh từ lần backup trước cho đến lúc tắt máy.
- Bước 3 (Replication): Lấy chính bản backup "vét" này truyền ngay sang site DR để cập nhật vào đĩa ảo của VM bản sao.
- Bước 4: Sau khi đĩa ảo ở site DR đã nhận đủ 100% dữ liệu mới nhất bằng site chính, Commvault mới ra lệnh bật nguồn VM ở site DR lên.
- Unplanned Failover (Thảm họa đột xuất): Dùng khi site chính bị sập nguồn hoàn toàn (mất điện, cháy nổ). Commvault sẽ lập tức bỏ qua site chính và kích hoạt bật nguồn toàn bộ VM ở site DR theo đúng thứ tự kịch bản bạn đã lập.
- Một bảng xác nhận hiện ra, nhấn OK
- Kiểm tra kết quả
PHẦN 3: Quy trình Failback
Sau khi sự cố tại site chính đã được khắc phục hoàn toàn, bạn muốn đưa dữ liệu mới phát sinh từ site DR ngược trở lại site chính. Quá trình này gọi là Failback:
- Chuột phải vào VM trên bảng Live Sync Monitor > Chọn Failback
- Restore in place: vị trí muốn failback về
- Nhấn OK.
Quá trình FailBack sẽ diễn ra như sau:
Bước 1: Tắt nguồn VM ở site
- Commvault gửi lệnh sang vCenter DR để Power Off VM đang chạy.
- Mục đích: "Đóng băng" dữ liệu. Không cho ứng dụng hay người dùng ghi thêm file mới vào đĩa ảo ở site DR nữa nhằm đảm bảo dữ liệu ko có thay đổi gì thêm để chuẩn bị truyền đi.
- Commvault tự động kích hoạt một job backup của vm đó tại site DR.
- Mục đích: vCenter DR sẽ tạo một snapshot tạm, Commvault quét và đóng gói toàn bộ các khối dữ liệu (blocks) mới phát sinh/thay đổi trong suốt thời gian bạn vận hành hệ thống bên site DR.
Bước 3: Đồng bộ ngược về Site chính (Reverse Replication / Restore)
- Commvault lấy các khối dữ liệu vừa backup được ở Bước 2, truyền ngược lại Site chính.
- Nó sẽ thực hiện lệnh ghi đè (Restore/Apply) các block dữ liệu mới này vào thẳng các file đĩa ảo .vmdk của các VM gốc ban đầu ở Site chính. Khi bước này đạt 100%, dữ liệu ở Site chính đã khớp hoàn toàn với dữ liệu mới nhất ở Site DR.
Bước 4: Bật nguồn VM ở Site chính
- Sau khi dữ liệu 2 bên đã đồng nhất, Commvault gửi lệnh sang vCenter Site chính để Power On (Bật nguồn) các VM gốc lên. Hệ thống Production chính thức hoạt động trở lại tại site chính.