Learning Hub
DevOps & Hạ tầng

Log, metric và trace

6 phút đọc·Cập nhật 2026-09-09

Log mô tả event rời rạc, metric tóm tắt hành vi số theo thời gian và trace nối công việc qua service boundary. Kết hợp lại giúp trả lời chuyện gì xảy ra, mức độ, vị trí và ảnh hưởng ai.

Log mô tả event rời rạc, metric tóm tắt hành vi số theo thời gian và trace nối công việc qua service boundary. Kết hợp lại giúp trả lời chuyện gì xảy ra, mức độ, vị trí và ảnh hưởng ai.

Nhìn nhanh

Câu hỏi Câu trả lời thực tế
Dùng khi nào? Checkout trace chậm chỉ ra database span, metric cho thấy latency tăng với mọi user và structured log nêu timeout detail cho một request ID.
Cần làm gì? Instrument một request bằng correlation ID, duration metric, structured start/error log và span qua hai function hoặc service.
Biết là đúng bằng cách nào? Từ một alert bạn đi được tới metric bị ảnh hưởng, representative trace và log liên quan mà không search đoán hay lộ personal data.
Lỗi hay gặp? Thu mọi thứ tạo cost và noise; định nghĩa question, retention, sampling, cardinality limit và privacy rule trước.
flowchart LR
  A[Câu hỏi] --> B[Log, metric và trace]
  B --> C[Ví dụ nhỏ]
  C --> D[Bằng chứng]

Điểm quan trọng của sơ đồ là không dừng ở định nghĩa: hãy nối khái niệm với một ví dụ nhỏ và bằng chứng có thể quan sát.

Ví dụ đã phân tích

Checkout trace chậm chỉ ra database span, metric cho thấy latency tăng với mọi user và structured log nêu timeout detail cho một request ID.

Trước khi làm, hãy viết dấu hiệu thành công. Sau đó chỉ thay đổi một yếu tố, quan sát kết quả và ghi lại assumption. Với Log, metric và trace, cách này giúp tách điều bạn biết khỏi điều bạn chỉ đang đoán.

Thực hành trong 20–30 phút

Mục tiêu: Instrument một request bằng correlation ID, duration metric, structured start/error log và span qua hai function hoặc service.

  1. Ghi lại trạng thái ban đầu và điều bạn dự đoán.
  2. Thực hiện phiên bản nhỏ nhất, không thêm công cụ chưa cần thiết.
  3. Thay đổi đúng một input hoặc constraint rồi chạy lại.
  4. Lưu command, screenshot, output hoặc checklist làm bằng chứng.

Kết quả mong đợi: Từ một alert bạn đi được tới metric bị ảnh hưởng, representative trace và log liên quan mà không search đoán hay lộ personal data.

Sai ở đâu và sửa thế nào

Thu mọi thứ tạo cost và noise; định nghĩa question, retention, sampling, cardinality limit và privacy rule trước.

Khi kết quả khác dự đoán, đừng đổi nhiều thứ cùng lúc. Kiểm tra input, version, environment, quyền truy cập và log trước; sau đó lặp lại từ ví dụ nhỏ nhất.

Định nghĩa hoàn thành

  • Tôi giải thích được khái niệm bằng ngôn ngữ của mình.
  • Tôi đã hoàn thành ví dụ nhỏ và giữ bằng chứng.
  • Tôi biết một failure mode và cách kiểm tra nó.
  • Người khác có thể làm lại mà không phải đoán bước còn thiếu.

Đi sâu hơn

Mở resource hoặc repository đi kèm ở cuối trang khi bạn cần implementation đầy đủ. Hãy kiểm tra version hiện hành trước khi dùng command trong dự án thật.