Site Reliability Engineer / Platform Lead - Datadog
Site Reliability Engineer / Platform Engineer / Platform Engineering Lead / Observability Engineer / Observability Lead / Manager / SRE / Datadog / Azure / 6-month contract / Hybrid – West Midlands / Remote / £500 – 650 per day. Find out exactly what skills, experience, and qualifications you will need to succeed in this role before applying below. One of our leading clients is seeking a Site Reliability Engineer / Platform Engineering Lead to build and operate a world-class monitoring, synthetic testing, and reliability platform. Location – West Midlands / Remote
Duration – 6 months +
Day rate – £500 – 650 per day This role will lead the implementation of Datadog across Azure and Cloudflare, creating a comprehensive early warning system that continuously validates APIs, integrations, and customer user journeys in production. Key Responsibilities:
Own and evolve the Datadog observability platform.
Design and maintain synthetic monitoring for critical API and UI workflows.
Build continuous production validation covering business-critical customer journeys.
Integrate monitoring, testing, dashboards, and alerting into Azure DevOps and GitHub pipelines.
Develop monitoring-as-code and testing-as-code practices using Terraform.
Create actionable dashboards, SLOs, SLIs, alerts, and anomaly detection.
Integrate Datadog with Azure, Cloudflare, and modern SaaS architectures.
Drive reliability, performance, and root-cause analysis across production systems.
Desirable:
Datadog certifications.
Azure certifications.
Cloudflare administration experience. xehkeey
Background in Site Reliability Engineering (SRE) or Platform Engineering leadership roles.
Duration – 6 months +
Day rate – £500 – 650 per day This role will lead the implementation of Datadog across Azure and Cloudflare, creating a comprehensive early warning system that continuously validates APIs, integrations, and customer user journeys in production. Key Responsibilities:
Own and evolve the Datadog observability platform.
Design and maintain synthetic monitoring for critical API and UI workflows.
Build continuous production validation covering business-critical customer journeys.
Integrate monitoring, testing, dashboards, and alerting into Azure DevOps and GitHub pipelines.
Develop monitoring-as-code and testing-as-code practices using Terraform.
Create actionable dashboards, SLOs, SLIs, alerts, and anomaly detection.
Integrate Datadog with Azure, Cloudflare, and modern SaaS architectures.
Drive reliability, performance, and root-cause analysis across production systems.
Desirable:
Datadog certifications.
Azure certifications.
Cloudflare administration experience. xehkeey
Background in Site Reliability Engineering (SRE) or Platform Engineering leadership roles.