Mục tiêu bài học
Chọn block storage, shared file system hoặc thiết bị truyền dữ liệu offline theo kiểu truy cập của workload.
Bài giảng chi tiết
Bài toán thực tế
Một ứng dụng có boot disk, một thư mục dùng chung cho nhiều instance và hàng chục TB ở chi nhánh có đường truyền yếu. Chọn cùng một loại storage cho cả ba sẽ gây sai access model hoặc chi phí.
Đừng học nội dung này như một danh sách tên dịch vụ. Hãy đi theo chuỗi: requirement → khái niệm → quyết định → bằng chứng. Một câu trả lời tốt phải nói được vì sao lựa chọn phù hợp, phương án gần nhất bị loại ở đâu, và kiểm tra nào chứng minh lựa chọn đó hoạt động.
Khái niệm được giải thích theo scenario
- EBS là block volume gắn cho compute và gắn với AZ theo thiết kế.
- EFS là file system managed cho nhiều compute mount đồng thời.
- Snow Family là phương án chuyển dữ liệu vật lý khi network không thực tế.
- Snapshot/transfer device không tự giải quyết retention, encryption, access control và cleanup.
Ví dụ khi gặp một scenario mới, hãy thay các từ khóa trong đề bằng một hệ thống cụ thể: ai là người dùng, dữ liệu đi qua đâu, thành phần nào có thể lỗi, quyền nào cần có và điều gì phải được quan sát. Cách làm này giúp phân biệt các đáp án gần đúng thay vì chọn theo trí nhớ tên service.
flowchart LR
A[Scenario / requirement] --> B[Concept and boundary]
B --> C[Service or control choice]
C --> D[Evidence and trade-off]
D --> E[Failure variant]
Khái niệm cốt lõi
EBS là block volume cho EC2 và gắn theo thiết kế vào một AZ. EFS là file system managed có thể mount từ nhiều compute. Snow Family dùng di chuyển dữ liệu lớn khi network không thực tế hoặc không đủ nhanh. EBS snapshot là point-in-time copy, cần tính retention và chi phí.
Ví dụ giảng viên: phân loại một quyết định cloud
Storage được chọn theo access model, không theo kích thước. Boot disk cần block semantics và thường gắn với một compute/AZ nên EBS phù hợp. Nhiều instance cần đọc/ghi cùng thư mục cần file semantics nên EFS phù hợp hơn. Hàng chục TB với đường truyền yếu là bài toán transport/logistics, nơi Snow có thể giảm thời gian truyền qua mạng.
Failure drill: ghi rõ điều gì xảy ra khi instance mất, AZ mất, file system mất mount hoặc thiết bị vận chuyển chưa được import. Snapshot, version và chain of custody đều là lifecycle control; chúng không tự tạo quyền truy cập hay kế hoạch restore.
Thực hành có kiểm soát
Phân loại ba workload: boot disk EC2 → EBS; thư mục dùng chung nhiều instance → EFS; hàng chục TB ở chi nhánh đường truyền yếu → Snow. Với mỗi lựa chọn, ghi một trade-off và kế hoạch cleanup.
Expected state và recovery
Trước khi thực hành, ghi rõ target/account/region, trạng thái hiện tại và output mong đợi. Sau thao tác, kiểm chứng bằng trạng thái thực tế hoặc command phù hợp; nếu kết quả sai, giữ lại evidence, quay về thay đổi nhỏ nhất và cleanup đúng owner. Không coi exit code 0 hoặc thông báo “success” là bằng chứng duy nhất.
- Chọn đúng EBS/EFS/Snow cho ba workload.
- Giải thích vì sao một EBS volume không phải shared file system thông thường.
- Nêu một chi phí hoặc operational trade-off của mỗi lựa chọn.
- Có cleanup/retention plan cho snapshot và dữ liệu chuyển.
Bẫy đề thi và cách tự kiểm tra
EBS không phải shared multi-instance file system thông thường. EFS không phải database. Snowball không phải storage class; dữ liệu được import vào dịch vụ đích sau khi thiết bị về AWS.