CloudWatch Insights
CloudWatch Container Insights
- Thu thập, tổng hợp, tóm tắt metrics và logs từ container
- Hỗ trợ cho container chạy trên:
- Amazon Elastic Container Service (Amazon ECS)
- Amazon Elastic Kubernetes Service (Amazon EKS)
- Các nền tảng Kubernetes chạy trên EC2
- Fargate (hỗ trợ cả ECS và EKS)
- Trên Amazon EKS và Kubernetes, CloudWatch Insights sử dụng một phiên bản dạng container của CloudWatch Agent để tự động phát hiện container.

Sơ đồ ở bên phải minh hoạ luồng dữ liệu như sau:
- ECS Container và EKS Container gửi metrics và logs.
- Các dữ liệu này được thu thập bởi dịch vụ CloudWatch Container Insights.
- Sau đó, thông tin được trực quan hoá qua dashboard như:
- CPU Utilization
- Memory Utilization
- Network TX / RX
- Desired Tasks vs Running Tasks
- Task Sets, Deployments...
- CloudWatch Agent ở đây được deploy dưới dạng container trong cluster, và nó tự động tìm kiếm các container khác để thu thập thông tin.
CloudWatch Lambda Insights
- Giải pháp giám sát và xử lý sự cố cho các ứng dụng serverless chạy trên AWS Lambda
- Thu thập, tổng hợp và tóm tắt metrics ở cấp hệ thống bao gồm:
- CPU time
- Memory
- Disk
- Network
- Thu thập, tổng hợp và tóm tắt thông tin chẩn đoán (diagnostic) như:
- Cold starts
- Lambda worker shutdowns
- Ngoài ra các thông tin "diagnostic" là các dữ liệu không thuộc loại metrics thông thường như CPU, memory, mà là những biến cố hệ thống quan trọng ảnh hưởng đến hiệu năng hoặc độ tin cậy của Lambda
- Lambda Insights được cung cấp dưới dạng một Lambda Layer
CloudWatch Contributor Insights
- Phân tích dữ liệu log và hiển thị dữ liệu time series từ các contributors.
- Hiển thị metric về top-N contributors
- Tổng số lượng contributors duy nhất và mức sử dụng của họ
- Công cụ này giúp bạn xác định các thành phần top talkers, hiểu được ai hoặc cái gì đang ảnh hưởng đến hiệu năng hệ thống
- Hoạt động với mọi loại log do AWS tạo ra, ví dụ như log của VPC, DNS,...
- Ví dụ: bạn có thể tìm ra các host có vấn đề, xác định người dùng mạng sử dụng nhiều nhất (heaviest network users) hoặc tìm các URL gây ra nhiều lỗi nhất.
- Bạn có thể:
- Tự định nghĩa rule từ đầu
- Hoặc dùng rule mẫu do AWS cung cấp, tận dụng chính log trong CloudWatch để phân tích
- CloudWatch cũng cung cấp các built-in rule để bạn có thể phân tích metrics từ các service khác của AWS.

Luồng dữ liệu hoạt động như sau:
- VPC Flow Logs ghi lại toàn bộ traffic qua VPC
- Những log đó được gửi về CloudWatch Logs
- CloudWatch Contributor Insights phân tích log này theo các rule (ví dụ: theo IP)
- Kết quả: Ví dụ top-10 IP addresses tiêu tốn băng thông nhiều nhất
CloudWatch Application Insights
- Cung cấp dashboard tự động hiển thị các vấn đề tiềm ẩn với ứng dụng đang được giám sát, giúp khoanh vùng và cô lập lỗi đang diễn ra
- Ứng dụng của bạn chạy trên Amazon EC2 Instances với một số công nghệ được hỗ trợ như:
→Java,.NET,Microsoft IIS Web Server,Databases,... - Ngoài ra, bạn cũng có thể sử dụng các tài nguyên AWS khác như:
→Amazon EBS,RDS,ELB,ASG,Lambda,SQS,DynamoDB,S3 bucket,ECS,EKS,SNS,API Gateway,... - Được hỗ trợ bởi SageMaker (dịch vụ ML của AWS)
- Giúp tăng tính quan sát sâu (observability) vào tình trạng của ứng dụng → giảm thời gian xử lý sự cố và sửa lỗi
- Các phát hiện và cảnh báo sẽ được gửi tới Amazon EventBridge và SSM OpsCenter
CloudWatch Insights và Khả năng quan sát hệ thống (Operational Visibility)
CloudWatch Container Insights
- Hỗ trợ các nền tảng như:
ECS,EKS,Kubernetes on EC2,Fargate(Lưu ý: cần cài đặt agent cho Kubernetes) - Thu thập metrics và logs
CloudWatch Lambda Insights
- Thu thập metrics chi tiết để hỗ trợ việc debug các ứng dụng serverless
CloudWatch Contributors Insights
- Tìm ra các “Top-N” Contributors (các thành phần đóng góp nhiều nhất gây ra lỗi hoặc sử dụng tài nguyên cao), dựa vào CloudWatch Logs
CloudWatch Application Insights
- Tự động tạo dashboard để chẩn đoán lỗi trong ứng dụng và các dịch vụ AWS liên quan
Bạn thấy bài này thế nào?