Files
curriculum-project-hub/.scratch/saas-production-readiness/issues/04-define-observability-recovery.md
T

13 lines
375 B
Markdown

# Define production observability and incident recovery
Type: research
Status: open
Blocked by: 01, 02, 03
## Question
Which logs, metrics, readiness signals, audit correlations, alerts, and operator
recovery actions are missing for a production operator to detect and diagnose
failures across HTTP, Feishu, PostgreSQL, agent execution, cph builds, and
workspace storage?