embed reliability engineering practices across systems that support live, business‐critical environments. The successful candidate will play a key role in improving service reliability, observability, incident response, automation, and disaster recovery readiness across IMG platforms, while working closely with engineering, operations, and project stakeholders. Key Responsibilities And Accountabilities Design, build … platform services across on‐premises and cloud environments. Improve service availability, latency, performance, and operational efficiency through engineering‐led reliability practices. Build and enhance observability across services and infrastructure, including monitoring, logging, alerting, dashboards, and service health indicators. Define and maintain SLIs, SLOs, alerting standards, and operational runbooks for critical ...