Monitoring
Observability, Prometheus Metrics & Grafana Guide for Reliability Engineers
💬Answer
- Monitoring: Focuses on known failure modes. It tells you when a system is broken by gathering predefined metrics (e.g., CPU > 90%, disk space full).
- Observability: Focuses on unknown failure modes. It provides the context and raw telemetry (metrics, logs, and distributed traces) to help you understand why a system is broken, especially in complex, distributed microservice architectures.

Created by
Apurv Gujjar
DevOps & Cloud Engineer
Specialized in:DevOpsAWSGCPKubernetesTerraformDocker
View Portfolio