Lộ trình
Amazon Web ServicesCơ bảnTuần 2: Dịch vụ cốt lõi (Compute, Storage, Database, Networking)Bài 11 / 30

Ngày 11: Storage — EBS, EFS và Snow Family

Thời lượng: 45 phút
Mục tiêu: 2 nhiệm vụ chính
Tiến độ lộ trình
aws-clf-c02ngày 11
hoàn thành11 / 30 bài
Bối cảnh bài học

Chọn block storage, shared file system hoặc thiết bị truyền dữ liệu offline theo kiểu truy cập của workload.

đọc hiểuthực hànhcheckpoint
Bài giảng hôm nay

Học hiểu, rồi mới thực hành

Chọn block storage, shared file system hoặc thiết bị truyền dữ liệu offline theo kiểu truy cập của workload.

Bắt đầu đọc bài giảng

Nhiệm vụ bài học hôm nay

  • Tìm hiểu EBS, EFS, Storage Gateway
  • So sánh use case của từng loại storage
Instructor walkthrough

Bài giảng chi tiết: từ bài toán đến bằng chứng

Scenario xuyên suốt

Một ứng dụng có boot disk, một thư mục dùng chung cho nhiều instance và hàng chục TB ở chi nhánh có đường truyền yếu. Chọn cùng một loại storage cho cả ba sẽ gây sai access model hoặc chi phí.

01Đọc bài toán

Xác định actor, workload, constraint và trạng thái cuối cần đạt.

02Vẽ luồng / boundary

Chỉ ra request, dependency, identity và failure domain trước khi chọn công cụ.

03Chọn và thực hành

Thay đổi nhỏ nhất trong lab cô lập; command nào cũng phải nói rõ nó kiểm tra điều gì.

04Kiểm chứng / recovery

Đối chiếu trạng thái thực tế, tạo một failure variant và ghi cách hoàn tác.

Cách nối lý thuyết với thực tế
  • EBS là block volume gắn cho compute và gắn với AZ theo thiết kế.
  • EFS là file system managed cho nhiều compute mount đồng thời.
  • Snow Family là phương án chuyển dữ liệu vật lý khi network không thực tế.
  • Snapshot/transfer device không tự giải quyết retention, encryption, access control và cleanup.

Mục tiêu bài học

Chọn block storage, shared file system hoặc thiết bị truyền dữ liệu offline theo kiểu truy cập của workload.

Bài giảng chi tiết

Bài toán thực tế

Một ứng dụng có boot disk, một thư mục dùng chung cho nhiều instance và hàng chục TB ở chi nhánh có đường truyền yếu. Chọn cùng một loại storage cho cả ba sẽ gây sai access model hoặc chi phí.

Đừng học nội dung này như một danh sách tên dịch vụ. Hãy đi theo chuỗi: requirement → khái niệm → quyết định → bằng chứng. Một câu trả lời tốt phải nói được vì sao lựa chọn phù hợp, phương án gần nhất bị loại ở đâu, và kiểm tra nào chứng minh lựa chọn đó hoạt động.

Khái niệm được giải thích theo scenario

  1. EBS là block volume gắn cho compute và gắn với AZ theo thiết kế.
  2. EFS là file system managed cho nhiều compute mount đồng thời.
  3. Snow Family là phương án chuyển dữ liệu vật lý khi network không thực tế.
  4. Snapshot/transfer device không tự giải quyết retention, encryption, access control và cleanup.

Ví dụ khi gặp một scenario mới, hãy thay các từ khóa trong đề bằng một hệ thống cụ thể: ai là người dùng, dữ liệu đi qua đâu, thành phần nào có thể lỗi, quyền nào cần có và điều gì phải được quan sát. Cách làm này giúp phân biệt các đáp án gần đúng thay vì chọn theo trí nhớ tên service.

flowchart LR
  A[Scenario / requirement] --> B[Concept and boundary]
  B --> C[Service or control choice]
  C --> D[Evidence and trade-off]
  D --> E[Failure variant]

Khái niệm cốt lõi

EBS là block volume cho EC2 và gắn theo thiết kế vào một AZ. EFS là file system managed có thể mount từ nhiều compute. Snow Family dùng di chuyển dữ liệu lớn khi network không thực tế hoặc không đủ nhanh. EBS snapshot là point-in-time copy, cần tính retention và chi phí.

Ví dụ giảng viên: phân loại một quyết định cloud

Storage được chọn theo access model, không theo kích thước. Boot disk cần block semantics và thường gắn với một compute/AZ nên EBS phù hợp. Nhiều instance cần đọc/ghi cùng thư mục cần file semantics nên EFS phù hợp hơn. Hàng chục TB với đường truyền yếu là bài toán transport/logistics, nơi Snow có thể giảm thời gian truyền qua mạng.

Failure drill: ghi rõ điều gì xảy ra khi instance mất, AZ mất, file system mất mount hoặc thiết bị vận chuyển chưa được import. Snapshot, version và chain of custody đều là lifecycle control; chúng không tự tạo quyền truy cập hay kế hoạch restore.

Thực hành có kiểm soát

Phân loại ba workload: boot disk EC2 → EBS; thư mục dùng chung nhiều instance → EFS; hàng chục TB ở chi nhánh đường truyền yếu → Snow. Với mỗi lựa chọn, ghi một trade-off và kế hoạch cleanup.

Expected state và recovery

Trước khi thực hành, ghi rõ target/account/region, trạng thái hiện tại và output mong đợi. Sau thao tác, kiểm chứng bằng trạng thái thực tế hoặc command phù hợp; nếu kết quả sai, giữ lại evidence, quay về thay đổi nhỏ nhất và cleanup đúng owner. Không coi exit code 0 hoặc thông báo “success” là bằng chứng duy nhất.

  1. Chọn đúng EBS/EFS/Snow cho ba workload.
  2. Giải thích vì sao một EBS volume không phải shared file system thông thường.
  3. Nêu một chi phí hoặc operational trade-off của mỗi lựa chọn.
  4. Có cleanup/retention plan cho snapshot và dữ liệu chuyển.

Bẫy đề thi và cách tự kiểm tra

EBS không phải shared multi-instance file system thông thường. EFS không phải database. Snowball không phải storage class; dữ liệu được import vào dịch vụ đích sau khi thiết bị về AWS.

Terminal reference

Command list và cách dùng

Chạy từng lệnh theo đúng thứ tự. Trước các lệnh có thể tạo hoặc thay đổi tài nguyên, hãy kiểm tra profile, account và region.

Commands · read-only checkpoints
aws ec2 describe-volumes --profile study --query "Volumes[].{Id:VolumeId,Type:VolumeType,AZ:AvailabilityZone,Size:Size}" --output table
aws efs describe-file-systems --profile study --query "FileSystems[].{Id:FileSystemId,State:LifeCycleState,Size:SizeInBytes.Value}" --output table
Hands-on lab

Thực hành theo scenario

Lập bảng `workload → block/file/offline → service → trade-off`. Với EBS, ghi AZ và snapshot; với EFS, ghi mount/access model; với Snow, ghi logistics, chain of custody và import destination. Không cần tạo storage có phí.

Evidence checkpoint

Kiểm chứng kết quả

Không coi lệnh chạy thành công là đủ. Hãy đối chiếu output với trạng thái mong đợi:

  • Chọn đúng EBS/EFS/Snow cho ba workload.
  • Giải thích vì sao một EBS volume không phải shared file system thông thường.
  • Nêu một chi phí hoặc operational trade-off của mỗi lựa chọn.
  • Có cleanup/retention plan cho snapshot và dữ liệu chuyển.
Transfer to exam / production

Bẫy thường gặp và trade-off

EBS không phải shared multi-instance file system thông thường. EFS không phải database. Snowball không phải storage class; dữ liệu được import vào dịch vụ đích sau khi thiết bị về AWS.

Checkpoint · 3 phút

Kiểm tra nhanh

Câu hỏi: Nhiều EC2 cần mount cùng một file system managed. Lựa chọn phù hợp nhất?

Kết thúc bài

Checklist trước khi sang Ngày 2