Giám sát cho biết hệ thống có đang hỏng hay không. Observability giúp bạn trả lời câu hỏi khó hơn nhiều: vì sao nó hỏng, và hỏng ở đâu trong chuỗi xử lý.
Ba trụ cột
- Log: ghi lại từng sự kiện rời rạc, hữu ích khi cần chi tiết.
- Metric: số liệu tổng hợp theo thời gian, hữu ích để phát hiện xu hướng.
- Trace: đường đi của một yêu cầu qua nhiều dịch vụ, hữu ích để tìm điểm nghẽn.
Bắt đầu từ đâu
- Gắn một mã tương quan cho mỗi yêu cầu và đưa vào mọi dòng log.
- Đo bốn tín hiệu vàng: độ trễ, lưu lượng, tỉ lệ lỗi, độ bão hòa.
- Chỉ đặt cảnh báo cho những thứ cần người phản ứng ngay.
Cảnh báo mà không ai hành động là tiếng ồn, và tiếng ồn làm mất lòng tin vào cả hệ thống cảnh báo.
