Demonstrated expertise in AI observability, operational reliability, and governance practices (e.g., tracing, telemetry, automated alerting, anomaly detection, incident triage, eval harnesses, safety guardrails, model explainability, approval paths, fallback mechanisms, tool-use auditing, cost/latency monitoring, and human-in-the-loop controls).