Site Reliability Engineer / Platform Lead – Datadog / Azure
Site Reliability Engineer / Platform Engineer / Platform Engineering Lead / Observability Engineer / Observability Lead / Manager / SRE / Datadog / Azure / 6-month contract / Hybrid – West Midlands / Remote / £450 – 600 per day Inside IR35.
One of our leading clients is seeking a Site Reliability Engineer / Platform Engineering Lead to build and operate a world-class monitoring, synthetic testing, and reliability platform.
Location – West Midlands / Remote
Duration – 6 months +
Day rate – £450 – 600 per day Inside IR35
This role will lead the implementation of Datadog across Azure and Cloudflare, creating a comprehensive early warning system that continuously validates APIs, integrations, and customer user journeys in production.
Key Responsibilities:
- Own and evolve the Datadog observability platform.
- Design and maintain synthetic monitoring for critical API and UI workflows.
- Build continuous production validation covering business-critical customer journeys.
- Integrate monitoring, testing, dashboards, and alerting into Azure DevOps and GitHub pipelines.
- Develop monitoring-as-code and testing-as-code practices using Terraform.
- Create actionable dashboards, SLOs, SLIs, alerts, and anomaly detection.
- Integrate Datadog with Azure, Cloudflare, and modern SaaS architectures.
- Drive reliability, performance, and root-cause analysis across production systems.
Desirable:
- Datadog certifications.
- Azure certifications.
- Cloudflare administration experience.
- Background in Site Reliability Engineering (SRE) or Platform Engineering leadership roles.