Real-time health of the platform across services, infrastructure and releases.
Edge request volume and application error rate across all services
2 open
Aggregate percentiles
Aggregate CPU and memory across replicas
5 unresolved
Error rate above 1%
Database connections above 180
P95 latency above 750ms
Error rate above 1%
Queue depth above 5000
Releases across services in the last 24 hours
feat(cache): handle partial upstream failures
chore(push): bound retry backoff
chore(stripe-webhook): optimise connection pool reuse
test(checkout): optimise connection pool reuse
feat(tls): emit latency histogram
revert(stripe-webhook): add structured request logging
Live golden signals per service
Traffic and resources by AWS region
Latency
18ms
Request/s
12.5K
Resources
38
Latency
34ms
Request/s
7.4K
Resources
15
Latency
46ms
Request/s
5.3K
Resources
33
Latency
78ms
Request/s
3.2K
Resources
24