Site Reliability Engineer
Site Reliability Engineer responsible for building resilient production systems, defining SLOs/SLIs, improving observability with Datadog/CloudWatch, leading incident response, automating toil reduction with AI tools, and collaborating with engineering teams on reliability practices. Requires 3+ years SRE/infra experience, coding in Python/Go, and distributed systems knowledge.