Engineering, Infrastructure, Security, and Product teams to improve platform reliability and operational readiness. Lead technical coordination during major incidents, helping drive rapid diagnosis, recovery, stakeholder communication, and root cause remediation. Drive continuous improvement initiatives focused on automation, observability, service reliability, operational efficiency, and reduction of manual processes. Evaluate production … ensure safe and controlled implementation. Analyze recurring incidents and operational trends to identify opportunities for resiliency improvements and long-term risk reduction. Support disaster recovery, business continuity, capacity planning, and platform resiliency initiatives across Digital Assets services. Contribute to the development of operational standards, runbooks, monitoring strategies ...